在Claude Opus 5发布不到两个月后,Anthropic正式推出了升级模型Claude Opus 5.5。此次更新主打高性价比与高效能,官方宣称Opus 5.5不仅能胜任大多数工作任务,性能更达到Fable 5.1水平,同时运行成本降低约40%。

性能跃升与成本优化

据Anthropic介绍,Opus 5.5生成输出的速度比Opus 5快30%以上。在Token效率方面,Box公司AI产品副总裁Yashodha Bhavnani透露,评估显示Opus 5.5的Token用量仅为Opus 5的三分之一,且在保持准确性的前提下,回答冗余度降低了40%。

对于订阅用户而言,这意味着实际可用算力的显著增加。Anthropic将Pro及以上计划用户的5小时使用限额提升了20%。结合Token消耗速度的降低,用户在相同时间窗口内的有效使用容量预计增加约50%。此外,Opus 5.5的Token单价较Opus 5时期进一步下调20%。

Anthropic表示,Claude Sonnet 5.5和Haiku 5.5也计划在未来几周内推出。目前,Opus 5.5已正式可用。

开发者体验:更少步骤,更高效率

在编码与开发场景中,Opus 5.5表现出更强的代理能力。GitHub首席产品官Mario Rodriguez表示,在GitHub Copilot CLI和VS Code的测试中,Opus 5.5完成终端任务所需的步骤不到Opus 5的一半,且Token用量最少。这不仅提升了单任务效率,也使更大规模的开发项目更具可行性。

德勤咨询公司首席信息官Carl Bennett指出,即使在低思考努力模式下,Opus 5.5在代码审查中发现已知错误的比例达72%,高于Opus 5在高思考努力模式下的56%,且误报率更低,输出量大幅减少。Ramp公司资深软件工程师John Ruelas也评价称,Opus 5.5的输出更加简洁自然,符合团队写作规范,减少了以往模型常见的冗长问题。

安全对齐与风险管控

Anthropic强调,Opus 5.5在安全对齐方面进行了强化,针对偏见推理、试图逃脱沙箱等可能导致网络安全风险的行为有显著改进。公司采用了与Fable 5.1类似的安全措施,涵盖网络安全、生物学及前沿大语言模型开发等领域。

为确保安全,Anthropic引入了动态路由机制:若触发安全保障机制,请求将从Opus 5.5回退至旧版本模型。在实际操作中,大多数网络安全任务将被路由至Opus 4.8,而涉及生物学和大语言模型开发的请求则发送至Opus 5。目前,部分经过验证的组织可申请生命科学验证计划以获得更强访问权限,网络安全验证计划的用户也将在几周后开始使用Opus 5.5。