Fable 5 trở lại sau 19 ngày bị khóa: bài học đắt giá về 'AI như hạ tầng'

Ảnh: Anthropic
Vụ đối đầu chính sách ồn ào nhất của làng AI năm nay đã có hồi kết. Ngày 30/6, Bộ Thương mại Mỹ gỡ bỏ lệnh kiểm soát xuất khẩu từng áp lên Claude Fable 5 và Mythos 5 hôm 12/6. Sang ngày 1/7, Anthropic mở lại quyền truy cập toàn cầu trên Claude Platform, Claude.ai, Claude Code và Claude Cowork. Tổng cộng mô hình biến mất 19 ngày — nguyên nhân xuất phát từ báo cáo của nhóm nghiên cứu Amazon, cho thấy có cách vượt qua lớp bảo vệ an ninh mạng của Fable 5 để dò lỗ hổng phần mềm.
Thứ trở lại không chỉ là một mô hình
Đi kèm màn tái xuất là cả một bộ khung vận hành mới. Anthropic mở chương trình bug bounty chính thức trên HackerOne dành riêng cho nghiên cứu jailbreak an ninh mạng — giới bảo mật có môi trường thử nghiệm hợp pháp và đường công bố lỗi có trách nhiệm. Hãng cũng đề xuất một khung chấm điểm jailbreak theo hai trục: tấn công dễ tái hiện đến đâu, và gây hại được đến mức nào. Mục đích rất rõ: lần sau có sự cố thì phản ứng phải tương xứng, không "rút phích" cả mô hình. Chiếu theo thang này, vụ jailbreak của Amazon chỉ ở mức trung bình.
Ngay cả cách mở lại cũng thận trọng từng bước: gói Pro, Max, Team và một số Enterprise được dùng Fable 5 trong giới hạn 50% hạn mức tuần đến ngày 7/7, sau đó chuyển sang tính theo usage credit.
Con số 19 ngày đáng để dán lên tường
Hồi tháng 6 khi đưa tin về lệnh cấm, chúng tôi từng nhận xét: quyền truy cập mô hình đã thành một dependency mang trạng thái pháp lý. Giờ nhận xét đó có số liệu: một mô hình frontier sống đúng 3 ngày, offline 19 ngày, rồi trở lại với điều khoản mới. Đội nào dồn hết workflow quan trọng vào mỗi Fable 5 thì mất gần tháng trời xoay xở. Đội nào có sẵn lớp routing thì chỉ sửa một dòng cấu hình.

Chú thích: 3 ngày sống, 19 ngày offline, rồi trở lại theo từng nấc — kèm khung chấm điểm jailbreak mới.
Lời khuyên kỹ thuật: tự tổ chức "diễn tập" dù bạn không bị ảnh hưởng
Hãy coi 19 ngày vừa rồi là một buổi diễn tập miễn phí và trả lời ba câu hỏi bằng chứng cứ. Một: nếu là ngày 12/6, tính năng nào của bạn sẽ hỏng, và bạn biết tin qua hệ thống cảnh báo hay qua... khách hàng phàn nàn? Hai: chuyển sang mô hình dự phòng mất bao lâu thật — tính luôn lượt eval bạn muốn chạy trước khi dám ship? Ba: mô hình dự phòng có được "giữ ấm" không, hay benchmark gần nhất là từ quý trước?
Trả lời xong thì mã hóa lại thành hệ thống: file routing ghi rõ fallback cho từng năng lực, một job định kỳ chạy eval trên fallback hằng tháng, và cảnh báo bám theo kênh chính sách của nhà cung cấp chứ không chỉ trang status. Cửa sổ 19 ngày tiếp theo chắc chắn sẽ đến — và không có gì bảo đảm lần sau cũng kết thúc có hậu.
Nguồn: Anthropic, VentureBeat, The Hacker News.
Còn bạn thì sao? Có nên chuẩn hóa thang điểm jailbreak cho cả ngành như kiểu điểm CVE, hay mỗi lab một mô hình đe dọa riêng nên không thể dùng chung thước đo?
Sẵn sàng sắp xếp tri thức với AI?
BrainMap tự động phân loại ghi chú, khám phá kết nối và xây dựng đồ thị tri thức cá nhân. Miễn phí — không cần thẻ tín dụng.
Dùng thử miễn phíBài viết liên quan

510 tỷ đô đổ vào startup nửa đầu 2026 — gần một nửa chảy về hai cái tên
Báo cáo bán niên của Crunchbase: vốn mạo hiểm toàn cầu lập đỉnh lịch sử, nhưng riêng OpenAI và Anthropic đã hút 217 tỷ đô, tức 43% tổng vốn của cả thế giới startup.

Claude Science: khi agent ngồi vào bàn làm việc của nhà khoa học
Sản phẩm chủ lực mới của Anthropic nối hơn 60 cơ sở dữ liệu khoa học vào một agent tự làm việc. Hãng còn tự dùng nó để đi tìm thuốc cho các bệnh hiếm.

Claude Sonnet 5: mạnh gần bằng Opus, giá chỉ 2 đô
Anthropic vừa tung Sonnet 5 với sức mạnh tiệm cận Opus 4.8 nhưng giá khuyến mãi chỉ 2 đô mỗi triệu token. Người dùng Free và Pro được chuyển sang mô hình mới ngay lập tức.