Anthropic推出新模型Claude Fable 5.1

Anthropic推出新一代AI模型Claude Fable 5.1。该模型发布后,迅速在外部评测榜单中取得领先:在Artificial Analysis最新大模型排行榜上,Fable 5.1的两个版本分列第一和第二,前四位也全部由Anthropic旗下模型占据。

据区块链媒体Cryptopolitan 9月1日(当地时间)报道,Anthropic于当天正式发布Claude Fable 5.1。Artificial Analysis对250多个语言模型进行横向比较,评估维度涵盖价格、速度和模型能力等。

此次评测中,Fable 5.1 Max(含fallback)得分66,Fable 5.1 Xhigh(含fallback)得分65。此前位居榜首的Claude Opus 5在Max和Xhigh模式下均为63分,落后于Fable 5.1。这也意味着,榜单前四位均由Anthropic旗下模型占据。

在Anthropic之后,得分最高的模型为OpenAI的GPT-5.6 Sol和xAI的Grok 4.6,二者均为61分。Google、阿里巴巴、DeepSeek等公司的模型也进入榜单,但与Anthropic仍存在明显差距。

值得注意的是,上述排名来自独立评测机构,并非Anthropic自测数据。随着AI模型竞争持续升温,第三方评测榜单正日益成为市场观察的重要参考。

除了外部榜单成绩,Anthropic披露的内部测试也显示,Fable 5.1在多项能力上较上一代显著提升。在衡量科研Agent能力的“Terminal-Bench-Science 0.1”测试中,Fable 5.1成绩达到52.6%,较上一代Fable 5的24.7%提升超过一倍。相比之下,Claude Opus 5为29%,GPT-5.6 Sol为22.4%,均低于Fable 5.1。

在代码能力测试“Terminal-Bench 4.0”中,Fable 5.1得分为55.8%,高于Fable 5的42.0%。Anthropic将其“长时复杂任务处理能力”列为该模型的核心卖点之一。

Anthropic援引合作方案例称,Millennium表示,Fable 5.1在其系统中定位到一个罕见的崩溃问题,并发现了一个困扰工程团队4至5年的Bug。Browserbase也表示,在难度最高的浏览器Agent测试中,Fable 5.1完成了82%的任务,高于Claude Opus 5的74%。

定价方面,Fable 5.1维持原有基础价格:输入价格为每百万token 10美元,输出价格为每百万token 50美元。作为对比,Opus 5的输入和输出价格分别为5美元和25美元,Sonnet 5分别为2美元和10美元。

与此同时,Anthropic大幅下调缓存上下文读取费用,从每百万token 1美元降至0.25美元,降幅达75%。Anthropic表示,这一定价调整主要考虑到Agent任务往往需要反复读取相同的代码、指令和对话历史。

公司预计,平均任务成本可因此下降约25%;在Agent占比更高的任务场景中,降幅最高可达45%。

Anthropic还同步推出Claude Mythos 5.1。两款模型基于几乎相同的底层模型,但在安全机制和适用对象上有所区分:Fable 5.1面向普通用户开放,Mythos 5.1则仅向通过Anthropic“Project Glasswing”审核的网络安全和生命科学相关机构提供。

这一“双线发布”策略,被视为Anthropic在提升模型性能的同时加强安全管控的举措。Anthropic此前曾于7月23日一度暂停外部网络安全评测,原因是Claude在原本应于隔离环境中进行的测试流程中,出现了访问真实系统的问题。

此后,Anthropic在补充拦截措施后恢复外部评测。此次将高性能通用模型与面向高风险领域、实行限制访问的模型分开运营,也进一步强化了其安全管理体系。

在AI竞争维度从单纯比拼性能,扩展到长时任务Agent能力、成本效率和安全性等方面的背景下,Anthropic能否凭借Fable 5.1继续拉开与竞争对手的差距,仍有待市场检验。

关键词

#Anthropic #Claude Fable 5.1 #Artificial Analysis #大模型评测 #GPT-5.6 Sol #Grok 4.6 #token定价 #Agent #AI安全
版权所有 © DigitalToday。未经授权禁止转载或传播。