Anthropic近日正式发布Claude Opus 5.5,这也是全新Claude 5.5系列模型的首个版本。在大多数任务中,该模型的表现水平与Claude Fable 5.1相当,但运行成本较前代Opus 5降低约40%。据官方透露,未来几周内还将陆续推出Claude Sonnet 5.5和Haiku 5.5。

这是自Anthropic呼吁“放缓前沿发展节奏”、主张在模型能力提升前确保安全措施领先以来,首次发布新模型。

安全对齐与成本控制

当前一代模型的开发依赖于广泛的对齐测试,包括由METR和Frontier Design等外部机构进行的发布前评估,以及针对网络安全、生物学等高风险领域定制的保障措施。

测试显示,Opus 5.5是迄今为止性能最强的模型,尤其在网络安全行为方面有显著改进,如减少偏见推理和防止尝试突破沙箱限制。值得注意的是,它是首款拥有与Fable 5.1类似网络安全和生物学保障措施的Opus系列模型。

Anthropic公告指出,当保障措施介入时,请求会透明地回退到其他模型。对于网络安全任务,用户仍可识别并修复代码漏洞,但大多数此类任务将被重新路由至Opus 4.8;被生物学分类器标记的请求则会被重新路由至Opus 5。

在定价方面,Opus 5.5提供服务所需的计算资源少于Opus 5。在典型工作负载下,其成本比Opus 5低40%。输入和输出Token的价格分别为每百万Token 4美元和20美元,降幅达20%。

开发者反馈与可用性

GitHub首席产品官Mario Rodriguez表示,开发者希望AI代理能承担并完成实际的软件开发工作。测试显示,在GitHub Copilot CLI和VS Code中,Claude Opus 5.5使用的Token数和步骤数均为最少之一。在VS Code中,它以不到一半的步骤解决了比Opus 5更多的终端任务,这不仅提升了单任务效率,也让大型项目开发更具可行性。

目前,Claude Opus 5.5已在Amazon Web Services、Google Cloud和Microsoft Azure等所有主要云平台上线,开发者也可直接在Claude平台上使用该模型。