Claude Fable 5.1: Vòng lặp agent rẻ hơn, an toàn phân tầng

Ảnh: Hai vùng vận hành của Claude Fable 5.1 — một cho triển khai thật và một bị giới hạn cho nhóm được cấp quyền tin cậy.
Ngày 1/9/2026, Anthropic phát hành Claude Fable 5.1 và Claude Mythos 5.1: cùng một model nhưng hai mức bảo vệ. Fable 5.1 có mặt trên Pro, Max, Team và Enterprise, qua ứng dụng, API, AWS, Google Cloud và Azure. Lớp bảo vệ cho môi trường vận hành thật bật mặc định.
Mythos 5.1 chỉ dành cho tổ chức được cấp quyền tin cậy ở Mỹ trong an ninh mạng và khoa học sự sống, với lớp bảo vệ nới lỏng. Cách chia đôi biến an toàn thành bề mặt sản phẩm: model giống nhau nhưng vùng vận hành khác nhau.
Bài toán chi phí cũng đổi. Fable 5.1 rẻ hơn khoảng 25% với tác vụ thường, công việc tự động có thể rẻ hơn tới 45%. Giá đọc bộ nhớ đệm giảm từ $1 xuống $0,25 mỗi triệu token, tức giảm 75%, còn giá nền $10/$50 không đổi. Báo động nhầm giảm khoảng 60%.
Một model, hai vùng vận hành
Fable và Mythos cùng model nhưng không cùng trải nghiệm. Fable được cung cấp rộng rãi với lớp bảo vệ mặc định; Mythos giới hạn cho tổ chức tin cậy và có mức bảo vệ nới lỏng hơn.
Hãy hỏi vùng vận hành nào phù hợp với công việc, tổ chức và quyền truy cập thực tế. Tên model không mô tả hết kiểm soát xung quanh nó; hãy ghi các kiểm soát ấy cạnh tên trong hệ thống tri thức.
Đọc bộ nhớ đệm rẻ hơn làm đổi kinh tế của agent
Con số đáng chú ý là giá đọc bộ nhớ đệm: từ $1 xuống $0,25 mỗi triệu token, khiến ngữ cảnh lặp lại rẻ hơn mà không đổi giá nền. Điều này hữu ích khi agent chạy dài quay lại cùng một bối cảnh.
Tiêu đề đúng không phải “mọi lượt suy luận đều rẻ hơn 25%”. Chỉ một phần quy trình lặp lại rẻ hơn. Hãy đo ngữ cảnh dùng lại, số vòng agent và lúc lần đọc biến thành yêu cầu mới.

Chú thích: Fable 5.1 mặc định bật lớp bảo vệ khi triển khai thật, Mythos 5.1 chỉ mở cho tổ chức được cấp quyền tin cậy; giá đọc bộ nhớ đệm giảm 75%.
Lời khuyên kỹ thuật: Tính giá cả vòng lặp, không chỉ một lời nhắc
Với tính năng dùng agent, hãy tính cả lượt chạy: ngữ cảnh, lần đọc lặp lại, công cụ và câu trả lời. Tách token đọc bộ nhớ đệm thành một dòng riêng, rồi ghi model, mức bảo vệ và bề mặt triển khai.
Với quản lý tri thức cá nhân, lưu bản tóm tắt dự án dùng nhiều thành ghi chú có phiên bản, thay vì chép đoạn khác nhau vào từng lượt. Ngữ cảnh tái sử dụng phải còn cập nhật và có nguồn rõ ràng.
An toàn đã trở thành một bề mặt sản phẩm
Fable 5.1 và Mythos 5.1 cho thấy an toàn phân tầng là lựa chọn sản phẩm. Quyền triển khai rộng đi cùng bảo vệ mặc định; vùng vận hành nới lỏng hơn giới hạn cho tổ chức tin cậy và một số lĩnh vực. Giảm báo động nhầm giúp tầng rộng ít gián đoạn hơn.
Chọn model nay bao gồm mức bảo vệ, chính sách truy cập và chi phí ngữ cảnh lặp lại. Chúng quyết định hệ thống làm được gì, chạy ở đâu và vòng tác vụ có đủ rẻ hay không.
Nguồn: MacRumors, Anthropic News.
Còn bạn thì sao? Với người xây agent, giá đọc bộ nhớ đệm rẻ hơn có quan trọng hơn việc giảm giá mọi token không?
Sẵn sàng sắp xếp tri thức với AI?
BrainMap tự động phân loại ghi chú, khám phá kết nối và xây dựng đồ thị tri thức cá nhân. Miễn phí — không cần thẻ tín dụng.
Dùng thử miễn phíBài viết liên quan

Báo cáo đe dọa của Anthropic và câu hỏi có nên chậm lại
Anthropic cho biết họ đã ngăn chặn việc lạm dụng Claude cho nghiên cứu vũ khí sinh học, gián điệp mạng có liên hệ với Nga nhằm vào Ukraine và trích xuất năng lực của Claude. Một vụ tấn công bị bỏ sót đang làm dấy lên câu hỏi về tốc độ phát triển mô hình.

Siri AI trên iOS 27: Apple đưa ngữ cảnh cá nhân lên trợ lý ngay trên thiết bị
Siri AI beta trên iOS 27 hiểu ngữ cảnh từ email, tin nhắn, lịch, ảnh và ghi chú, với nhận biết màn hình và tác vụ liên ứng dụng.

Gemini 3.8 Flash có bản Cyber và chiếc đồng hồ giá API
Bản Flash thứ ba trong sáu tuần của Google hỗ trợ kỹ nghệ phần mềm, tác vụ tác tử, suy luận nhiều bước và ngữ cảnh 1 triệu token. Gemini 3.8 Flash Cyber tìm lỗ hổng, tự sinh bản vá qua chương trình Fairwind, còn giá API mở đầu sẽ tăng gấp đôi vào tháng 1.