Anthropic cho biết hãng đang sử dụng nội bộ một mô hình trí tuệ nhân tạo mang tên Model 2, có hiệu năng cao hơn Claude Mythos 5, vốn là mô hình cao cấp nhất đang được công bố ra thị trường. Tuy nhiên, công ty hiện chưa có kế hoạch phát hành Model 2 cho người dùng bên ngoài.
Theo Gigazine ngày 17/8, trong báo cáo rủi ro AI công bố ngày 15/8, Anthropic đã công bố kết quả đánh giá an toàn đối với Claude Mythos 5 và Model 2.
Trong báo cáo, Anthropic mô tả Model 2 là mô hình có năng lực nhỉnh hơn Claude Mythos 5. Công ty cho biết Model 2 đang được dùng rộng rãi trong nội bộ cùng với Claude Mythos 5. Với các dịch vụ cung cấp ra bên ngoài, Anthropic hiện phát hành phiên bản đã được bổ sung các biện pháp an toàn dưới tên Claude Fable5, đồng thời nêu rõ chưa có kế hoạch phát hành Model 2 ra thị trường.
Kết quả đánh giá nội bộ dựa trên phản hồi của nhân viên Anthropic cũng cho thấy xu hướng tương tự. Theo công ty, Model 2 “cải thiện rõ rệt so với Claude Mythos 5 ở nhiều tác vụ”. Dù vậy, mức chênh lệch không lớn. Anthropic cho biết đây không phải bước nhảy đáng kể như giai đoạn chuyển từ Claude Opus 4.6 sang Claude Mythos Preview, nền tảng của Mythos 5, mà chủ yếu chỉ nhỉnh hơn ở mức vừa phải.
Trên thước đo nội bộ CoBench v2, Model 2 cũng đạt kết quả cao hơn, nhưng khoảng cách không lớn. Tuy nhiên, kết quả ở các hạng mục đánh giá an toàn lại không hoàn toàn đồng nhất. Trong bài kiểm tra khả năng AI hoàn thành một nhiệm vụ bí mật mà không bị hệ thống giám sát phát hiện, Claude Mythos Preview khi bật chế độ mở rộng suy luận đạt tỷ lệ thành công 6-10%. Model 2 cao hơn đôi chút so với Claude Mythos 5, nhưng thấp hơn đáng kể so với Claude Mythos Preview.
Thông tin này gây chú ý vì cho thấy rõ hơn cách Anthropic tách biệt giữa dòng mô hình phát triển nội bộ và các sản phẩm cung cấp ra thị trường. Hiện mô hình có hiệu năng cao nhất được biết đến ở bên ngoài không phải Claude Mythos 5, mà là Claude Fable5, phiên bản đã được bổ sung các biện pháp an toàn. Điều đó cho thấy ngay cả khi sở hữu mô hình nội bộ mạnh hơn, Anthropic vẫn quyết định phát hành sản phẩm dựa không chỉ vào hiệu năng mà còn vào khả năng kiểm soát rủi ro an toàn.
Báo cáo cũng nhắc tới cái tên Model 1. Từ chi tiết này, một số người dùng suy đoán Model 2 có thể là phiên bản kế tiếp của Model 1, và các mô hình này cùng Claude Mythos Preview có thể đóng vai trò nền tảng để chắt lọc thành những mô hình nhỏ hơn như Claude Mythos 5 và Claude Fable5. Tuy nhiên, Anthropic không xác nhận giả thuyết này.
Nhìn chung, báo cáo cho thấy Anthropic đang vận hành nội bộ một dòng mô hình hiệu năng cao tách biệt với các sản phẩm công khai, trong khi những mô hình được phát hành ra bên ngoài là các phiên bản đã qua tăng cường an toàn. Công ty cũng cho biết họ định kỳ công bố báo cáo rủi ro trong khuôn khổ Chính sách Mở rộng có Trách nhiệm, nhằm chia sẻ thông tin về rủi ro của hệ thống và mức độ sẵn sàng ứng phó.