Một mô hình, hai ranh giới vận hành
Anthropic đã công bố Claude Fable 5.1 và Claude Mythos 5.1 vào ngày 01-09-2026. Hai cấu hình sử dụng các trọng số mô hình hoàn toàn giống nhau. Sự khác biệt nằm ở lớp rào chắn an toàn bao bọc cùng một mô hình cốt lõi, biến chính sách truy cập thành một phần định hình sản phẩm thay vì chỉ là một ghi chú phụ.
Fable 5.1 được cung cấp cho người dùng Claude trả phí và thông qua giao diện web, thiết bị di động, ứng dụng máy tính, Cowork, Claude Code, Claude Design, Microsoft 365, Tag, API của Claude và các nền tảng đám mây. Mythos 5.1 không phải là bản phát hành phổ thông: quyền truy cập trực tiếp chỉ giới hạn cho các tổ chức đã được kiểm chứng và các chương trình đối tác đáng tin cậy, hiện bao gồm một nhóm tổ chức tại Hoa Kỳ.
Đối với các nhóm phát triển tác nhân AI, quyết định cốt lõi là lựa chọn lớp rào chắn an toàn và ranh giới truy cập nào phù hợp nhất với tính chất công việc.
Mức giá biến nỗ lực tính toán thành công cụ kiểm soát
Anthropic niêm yết Fable 5.1 và Mythos 5.1 ở mức $10 cho mỗi triệu token đầu vào và $50 cho mỗi triệu token đầu ra. Chi phí đọc bộ nhớ đệm (cache read) là $0.25 cho mỗi triệu token, giảm 75% so với mức $1 trước đây; chi phí ghi bộ nhớ đệm không thay đổi. Đây là mức giá tính theo token, do đó các gói dịch vụ hoặc chợ ứng dụng đám mây có thể áp dụng cách thức tính cước khác nhau.
Fable 5.1 bổ sung các cấp độ nỗ lực (effort level) tùy chọn: low, medium, high, xhigh và max. Anthropic khuyến nghị mức high làm mặc định và cho biết các mức low hoặc medium có thể đánh đổi một phần năng lực để giảm chi phí, với kết quả tương đương hoặc vượt trội so với Fable 5 trong các bài đánh giá. Anthropic cũng ước tính mức tiết kiệm khoảng 25% cho các khối lượng công việc điển hình và lên tới khoảng 45% cho các tác vụ phức tạp đòi hỏi tính tự chủ cao của tác nhân, dựa trên 4 tuần sử dụng thực tế trong tháng 8 năm 2026 ở mức nỗ lực mặc định.

Hãy xem những số liệu này như một giả thuyết cần thử nghiệm thay vì một cam kết đảm bảo ngân sách. Hãy đo lường lượng đọc bộ nhớ đệm và mức độ nỗ lực dựa trên tỷ lệ thành công của tác vụ, số lần thử lại, độ trễ, dữ liệu đầu ra và chi phí trên mỗi quy trình làm việc hoàn thành.
Một điều chỉnh hạn mức liên quan cũng đòi hỏi sự chính xác tương tự. Thông báo chính thức từ ClaudeDevs nêu rõ khi mức tăng tạm thời 50% kết thúc vào ngày 13-09-2026 và mức tăng vĩnh viễn 25% so với mức cơ sở bắt đầu vào ngày 14-09-2026, kết quả là hạn mức hàng tuần của Claude Code cho các gói Pro, Max, Team và Enterprise theo chỗ ngồi sẽ giảm 17% so với hiện nay. Đây là phép so sánh riêng đối với hạn mức hàng tuần của Claude Code, không phải là sự cắt giảm áp dụng chung cho mọi hạn mức tin nhắn Claude.
Điểm chuẩn chỉ ra hướng đi, không phải phán quyết cuối cùng
Anthropic ghi nhận Fable 5.1 đạt 52.6% trên bài kiểm tra Terminal-Bench-Science 0.1, so với 24.7% của Fable 5, 29.0% của Opus 5 và 22.4% của GPT-5.6 Sol. Trên Terminal-Bench 4.0, các con số được công bố là 55.8% cho Fable 5.1, 42.0% cho Fable 5, 60.9% cho Mythos 5.1, 52.3% cho Opus 5 và 37.3% cho GPT-5.6 Sol.

Đây là các kết quả thử nghiệm nội bộ do chính nhà cung cấp thực hiện trước khi triển khai, không phải bằng chứng độc lập chứng minh sự vượt trội. Terminal-Bench-Science có sai số chuẩn ±3.5–4.5 điểm cho mỗi mô hình. Anthropic cũng lưu ý rằng OSWorld sử dụng bộ tác vụ tháng 8 năm 2026 vốn không thể so sánh trực tiếp với các bản phát hành trước đó, trong khi các cơ chế an toàn và hệ thống dự phòng trong môi trường thực tế có thể ảnh hưởng đến điểm số.
Rào chắn an toàn có giới hạn, không phải sự sụt giảm từ chối phổ quát
Anthropic cho biết người dùng Claude Code có thể kỳ vọng sự can thiệp từ rào chắn an ninh mạng giảm khoảng 60% mỗi phiên so với các rào chắn của Fable 5. Hãng cũng báo cáo rằng rào chắn an toàn sinh học của Fable 5.1 kích hoạt ít hơn 85% đối với các yêu cầu vô hại về sinh học cơ bản và y tế. Cả hai con số trên đều không đồng nghĩa với việc tỷ lệ từ chối giảm đồng loạt 60% hay 85% trên toàn bộ các sản phẩm. Các công việc chuyên môn có mục đích sử dụng kép trong khoa học đời sống vẫn được định tuyến tới Opus hoặc các kênh truy cập được kiểm duyệt.
Thẻ hệ thống (system card) ghi nhận các cuộc kiểm tra độc lập từ bên ngoài, bao gồm khoảng 74 giờ thử nghiệm và hơn 6.500 yêu cầu từ Trajectory Labs, với 11 dấu hiệu xâm nhập tiềm năng nhưng không có lỗ hổng khai thác đầu-cuối hoàn chỉnh nào xuất phát riêng từ Fable 5.1. Báo cáo cũng ghi nhận một sự cố lỗ hổng hộp cát mức độ thấp liên quan đến Mythos 5.1 trong quá trình thử nghiệm bên ngoài. Đây là lý do để duy trì ranh giới truy cập rõ ràng thay vì coi đợt ra mắt này hoàn toàn không có rủi ro.
Quyết định dành cho những người xây dựng tác nhân AI
Fable 5.1 phù hợp với các nhóm cần khả năng tiếp cận rộng và muốn thử nghiệm tối ưu chi phí. Hãy xác định rõ bề mặt mô hình, mức độ nỗ lực, cơ chế lưu bộ nhớ đệm và khung hạn mức Claude Code. Hãy đo lường chi phí trên mỗi quy trình làm việc thành công trong môi trường thử nghiệm độc lập; hãy coi các tuyên bố về điểm chuẩn và mức tiết kiệm của Anthropic là các giả định cần được tái hiện và kiểm chứng.
Mythos 5.1 thuộc về một quy trình đánh giá riêng biệt. Chương trình Cyber Verification Program được thiết kế xoay quanh nhiệm vụ an ninh phòng thủ, trong khi Life Sciences Verification Program là bản thử nghiệm beta chỉ dành cho những người được mời sử dụng Mythos 5.1 với các biện pháp bảo vệ chuyên biệt trong nghiên cứu. Project Glasswing là một khuôn khổ hợp tác an ninh phòng thủ liên quan, không phải là từ đồng nghĩa cho cả hai chương trình trên.
Đầu ra từ Fable 5.1 và Mythos 5.1 mang hình mờ văn bản vô hình dựa trên thống kê. Anthropic khẳng định cơ chế này không tiêu tốn thêm token và không sử dụng dữ liệu định danh người dùng; công cụ phát hiện hiện đang ở chế độ xem trước riêng tư. Tính năng này có thể hữu ích cho các nhóm đang xây dựng quy trình kiểm toán hoặc xác thực nguồn gốc, nhưng không thể thay thế cho các biện pháp kiểm soát truy cập, kiểm tra tải làm việc hoặc quy trình đánh giá độc lập.




