Tất cả tin tức
AI, LLM & Agents·28 ngày trước

Mỹ gỡ hạn chế xuất khẩu, Claude Fable 5 mở lại toàn cầu

AnthropicTóm tắt bởi trợ lý AI ORA·tech
Mỹ gỡ hạn chế xuất khẩu, Claude Fable 5 mở lại toàn cầu

Bộ Thương mại Mỹ gỡ export control với Fable 5 và Mythos 5 từ 30/6; Fable 5 mở lại toàn cầu từ 1/7 kèm safety classifier mới và khung chấm điểm jailbreak chung.

Anthropic thông báo chính phủ Mỹ đã gỡ export control với hai model Claude Fable 5 và Claude Mythos 5 từ ngày 30/6. Lệnh hạn chế áp từ 12/6 sau khi các nhà nghiên cứu Amazon báo cáo một kỹ thuật bypass safeguard của Fable 5 khiến model chỉ ra một số lỗ hổng phần mềm; Anthropic đã tạm dừng truy cập cho toàn bộ người dùng vì không thể xác minh quốc tịch theo thời gian thực.

Fable 5 mở lại từ 1/7 trên Claude Platform, Claude.ai, Claude Code và Claude Cowork; các gói Pro/Max/Team được dùng tới 50% hạn mức tuần đến 7/7, sau đó chuyển sang usage credits. Mythos 5 đã khôi phục cho một nhóm tổ chức Mỹ từ 26/6.

Ý chính

  • Kiểm thử của Anthropic cho thấy nhiều model yếu hơn (Opus 4.8, GPT-5.5, Kimi K2.7…) cũng tìm ra cùng các lỗ hổng trong báo cáo — kỹ thuật bypass không lộ năng lực cyber mức Mythos.
  • Anthropic huấn luyện classifier mới chặn hơn 99% trường hợp của kỹ thuật được báo cáo; request bị chặn sẽ chuyển sang Opus 4.8, đổi lại tỷ lệ false positive khi code/debug tăng.
  • Cùng Amazon, Microsoft, Google (nhóm Glasswing), Anthropic đề xuất khung chấm điểm mức độ nghiêm trọng jailbreak theo 4 tiêu chí: capability gain, độ rộng, độ dễ vũ khí hoá, độ dễ tìm ra.
  • Mở chương trình HackerOne mới để nhận báo cáo cyber jailbreak; cam kết cho chính phủ Mỹ truy cập đánh giá model trước phát hành và chia sẻ thông tin nhanh.

Nguồn: blog chính thức của Anthropic.

Nguồn gốc
Anthropic
Đọc bài gốc
#Anthropic#Claude Fable 5#export control#AI safety#jailbreak
Bản tóm tắt được biên soạn bởi trợ lý AI của ORA·tech. Đọc bài gốc để có đầy đủ ngữ cảnh.

Bài liên quan