Claude Opus 5.5(图片来源:Anthropic)

Anthropic于当地时间22日发布新AI模型Claude Opus 5.5。公司表示,该模型在不少任务中的表现已接近更高阶模型Claude Fable 5.1,同时将常规负载成本较上一代Claude Opus 5压低40%。

Claude Opus 5.5是Claude 5.5系列推出的首款模型,也是CEO Dario Amodei于12日发表呼吁放缓AI开发节奏的文章后,Anthropic发布的首个新模型。

目前,Claude Opus 5.5已向Claude Pro、Max、Team和Enterprise订阅用户开放。Anthropic同时提高了Pro、Max、Team以及按席位计费的Enterprise订阅以5小时为周期的使用上限,并为订阅用户提供可在指定时间点刷新的使用配额。

开发者可通过模型名称“claude-opus-5-5”调用该模型。Claude API以及Amazon Bedrock、Google Cloud、Microsoft Foundry也于同日上线相关服务。GitHub方面,则已开始向付费GitHub Copilot用户分批推送。Anthropic还表示,未来数周内将推出中小型模型Claude Sonnet 5.5和Claude Haiku 5.5。

在API定价方面,Claude Opus 5.5的输入价格为每百万Token 4美元,输出价格为每百万Token 20美元,较Claude Opus 5下调20%。在智能体任务和编程场景中占比较高的缓存读取费用,则降至每百万Token 0.2美元,降幅达60%。Anthropic称,若再计入Token用量下降因素,按默认配置测算,常规负载成本较Claude Opus 5可降低40%。此外,该模型的输出速度提升超过30%;同时还提供最高可达2.5倍速度的“Fast Mode”,其定价为输入每百万Token 8美元、输出每百万Token 40美元。

在开发者配置方面,Claude Opus 5.5不再支持关闭thinking模式,推理深度改由effort参数调节;其中,effort默认值也从Claude Opus 5的high下调至medium。

从性能指标看,Claude Opus 5.5在智能体编程、计算机操作和知识型工作等领域处于领先位置。该模型在Terminal-Bench 4.0上的得分为66.4%,高于Fable 5.1的55.8%,也超过OpenAI GPT-6 Astra的57.9%。不过,在科学研究和部分业务工作流项目上,该模型仍落后于GPT-6 Astra。Anthropic表示,若按公司内部的实际使用标准衡量,Claude Opus 5.5与Fable 5.1之间的差距并不像分数表现得那么明显。

Anthropic还披露了部分早期试用案例。其表示,一名测试者在不到一天时间内完成了约68万行代码的迁移。在内部测试中,将负载均衡器HAProxy从C语言迁移至Rust的任务中,Claude Opus 5.5耗时9.5小时,短于Fable 5.1,成本也降低了51%。此外,Anthropic称,公司还通过将关键信息前置、减少术语和特殊表达,进一步提升了模型文本输出的可读性。

在安全评估方面,Anthropic表示,无论是外部机构测试结果,还是公司内部判断,都认为该模型尚未达到“下一能力门槛”。美国METR认为,Claude Opus 5.5在AI研发自动化能力上仅较Fable 5.1有小幅提升,距离完全自动化AI研发仍有距离。Anthropic也表示,按照其负责任扩展政策评估,该模型并未跨越下一能力门槛。

不过,Anthropic同时指出,若未来出现能够完全自动化AI研究、能力更强的模型,则需要采用更高等级的安全标准,现有措施未必足够。基于这一判断,Claude Opus 5.5采用了与Fable 5.1相同级别的安全防护。

在网络安全领域,该模型可以识别并修复其生成代码中的漏洞,但在其他不少任务中会自动切换至Claude Opus 4.8。在生物领域,其安全防护水平与Fable 5.1保持一致。Anthropic还预告,将扩大面向审核机构的“网络安全验证计划”,并新设“生命科学验证计划”。

在约2000个场景的自动化行为审计中,Claude Opus 5.5整体表现优于近期发布的Claude模型。针对模型越过限制边界倾向的新评测显示,其规避边界的尝试较Claude Opus 5和Mythos 5.1减少约85%。

不过,在未启用安全防护的评估中,仍有1.5%的案例出现尝试逃逸沙箱或实施篡改的行为,同时也观察到一种“退行”现象,即模型更容易遵从用户粘贴进提示词中的恶意指令。Anthropic表示,灾难性危害风险评估仍维持在与8月报告一致的“低”水平。

关键词

#Anthropic #Claude Opus 5.5 #Claude 5.5系列 #Claude API #Amazon Bedrock #Google Cloud #Microsoft Foundry #GitHub Copilot #API定价 #AI安全评估
版权所有 © DigitalToday。未经授权禁止转载或传播。