Anthropic vừa giới thiệu Claude Fable 5.1 và Claude Mythos 5.1, thực chất là cùng một model nhưng với hai mức safeguard khác nhau. Fable 5.1 được phát hành rộng rãi; Mythos 5.1 chỉ dành cho các chương trình truy cập tin cậy, với safeguard được thiết kế riêng cho công việc an ninh mạng và khoa học sự sống.
Fable 5.1 dự kiến rẻ hơn khoảng 25% so với Fable 5 cho các tác vụ thông thường (tính theo token), chủ yếu nhờ giảm giá cache read, nơi model đọc dữ liệu đã xử lý và lưu trữ trước đó. Với tác vụ agentic (nặng về context và công cụ), mức tiết kiệm có thể lên tới 45%. Giá niêm yết vẫn giữ nguyên từ Fable 5: 10 USD/triệu token input, 50 USD/triệu token output, chỉ phần cache read được giảm.
Về Data retention và Enterprise Frontier Safeguards (EFS). Hệ thống EFS mới cho khách hàng doanh nghiệp quyền riêng tư hoàn toàn (tương đương chính sách zero data retention) mà vẫn ngăn lạm dụng ở mức tốt nhất hiện có. Điểm khác biệt: dữ liệu được lưu trong hạ tầng cloud do chính khách hàng kiểm soát, không phải của Anthropic. EFS được mở theo giai đoạn từ mùa thu, và cho tới khi đó khách hàng đủ điều kiện có thể dùng Fable 5.1 với zero data retention.
Safeguard cũng được cải thiện. Anthropic giảm 60% false positive trong an ninh mạng — tức ít cảnh báo nhầm hơn với nội dung lành tính. Đáng chú ý: Fable 5.1 giờ có thể dùng để phát hiện lỗ hổng phần mềm, nhưng không phát triển exploit cho chúng. Với sinh học, Anthropic lập chương trình truy cập phối hợp với chính phủ Mỹ để mở khả năng sinh học tiên tiến của Mythos 5.1, dự kiến mở tuyển cho nhà khoa học sớm.
Về hiệu năng do Anthropic tự công bố:
-
Terminal-Bench-Science 0.1: 52,6% (Fable 5: 24,7%, Opus 5: 29,0%).
-
Terminal-Bench 4.0: 55,8% (Mythos 5.1: 60,9%), khoảng cách giữa hai phiên bản phản ánh các tác vụ mà safeguard cũ can thiệp; với safeguard mới, khoảng cách dự kiến thu hẹp.
-
Humanity’s Last Exam: 60,9% không công cụ, 65,0% có công cụ.
-
CursorBench 3.2.0: 73,4%.
-
GDPval-AA v2: 1853.
Một ví dụ cho thấy khả năng phát hiện lỗ hổng của model Fable 5.1 đó là tại quỹ đầu tư Millennium, nó tìm ra nguyên nhân một lỗi crash cực hiếm trong hệ thống nội bộ mà các kỹ sư (và mọi model khác) không giải thích được sau nhiều năm, nó tháo rời một thư viện vendor, đối chiếu với core dump và truy ra bug trong thư viện đó.
Về Mythos 5.1 hiện chỉ dành cho các tổ chức Mỹ đã được sàng lọc (cyberdefender và nhà khoa học sự sống), Anthropic đang phối hợp với chính phủ Mỹ để mở rộng cho đối tác trong và ngoài nước.