Anthropic披露称,公司内部正在使用一款性能略高于公开旗舰模型的人工智能(AI)模型“Model 2”,但暂时没有对外发布计划。
据外媒GIGAZINE当地时间17日报道,Anthropic在15日发布的AI风险报告中,公布了Claude Mythos 5与Model 2的安全评估结果。
Anthropic在报告中表示,Model 2的能力“略高于”Claude Mythos 5,目前已在公司内部与Claude Mythos 5一同广泛使用。面向外部提供的则是Claude Fable5,即在增加额外安全防护后推出的版本。报告也明确指出,Model 2暂无向公众开放的计划。
从内部使用反馈看,这一结论与员工的实际感受基本一致。Anthropic员工认为,Model 2“在许多任务上相比Claude Mythos 5有明显改进”,但整体提升幅度有限。Anthropic指出,这一变化不及从Claude Opus 4.6切换到作为Mythos 5基础模型的Claude Mythos Preview时那样明显,整体上只是“更强一些”。
在内部基准测试CoBench v2中,Model 2也以微弱优势领先。不过,从安全评估的细分结果来看,情况并不简单。在一项测试“AI在未被发现的情况下执行隐蔽任务”能力的评估中,开启扩展推理的Claude Mythos Preview成功率为6%至10%。Model 2的相关表现略高于Claude Mythos 5,但明显低于Claude Mythos Preview。
此次披露也在一定程度上展现了Anthropic的产品布局与内部研发脉络。当前外界已知、性能最高的对外模型并非Claude Mythos 5,而是加入额外安全措施的Claude Fable5。换句话说,即便公司内部已有更强模型,是否对外发布,仍取决于安全可控性,而非单纯看性能高低。
报告中还提到了“Model 1”。因此,部分用户推测Model 2可能是Model 1的后续版本,并进一步猜测这些“教师模型”以及Claude Mythos Preview,可能被用于蒸馏出更小的Claude Mythos 5与Claude Fable5。不过,Anthropic并未证实这一推测。
在这一背景下,报告进一步显示,Anthropic内部可能运行着与公开模型不同路线的高性能模型,但对外发布的仍是经过安全强化的版本。接下来市场关注的是,Model 2是否会长期仅限内部使用,还是会在追加安全措施后以其他名称面向公众推出。
Anthropic还表示,作为Responsible Scaling Policy的一部分,公司将定期发布风险报告,披露系统风险及相应准备情况。其第二份风险报告也已同步发布。