Anthropic 今日正式发布 Claude Haiku 5.5,旨在通过大幅降低小规模任务成本,解决企业级 AI 在文档摘要、信息分类及数据库查询等重复性工作规模化应用中的高昂开销。

针对低于 10 万 token 的请求,Haiku 5.5 单价降幅达 90%,定价为每百万输入 token 0.10 美元、输出 token 0.50 美元,与 OpenAI GPT-6 Luna 的基础费率持平。Anthropic 估算,综合请求大小和 token 消耗变化,Haiku 5.5 的工作负载运行成本较 Haiku 4.5 降低约 75%。

差异化定价与竞品对标

Haiku 5.5 的定价策略存在明确阈值:超过 10 万 token 的请求,输入价格为每百万 token 0.50 美元,输出为 2.50 美元,较上一代仅降低 50%。Anthropic 数据显示,约 90% 的 Haiku 4.5 请求属于较短类别,因此大部分用户能享受最大幅度的成本节省。

在横向对比中,Haiku 5.5 并未确立绝对的价格优势。OpenAI GPT-6 Luna 在低层级费率及缓存费用上与 Haiku 完全匹配,但其高费率阈值设在 27.2 万输入 token 之后。Google Gemini 3.5 Flash-Lite 和 Grok 系列模型在不同区间各有定价策略,而 Anthropic Sonnet 5.5 则定位更高端市场。

定位辅助角色与性能基准

Anthropic 将 Haiku 定位为 Opus 和 Sonnet 的辅助工作者,而非高难度编程任务的首选。金融 AI 公司 Rogo 的应用案例显示,大型模型负责组装财务演示文稿,Haiku 则高效检索单张幻灯片所需的收入数据。Rogo 专家 Alex Wang 评价称,该模型速度快、成本低且准确性足以信赖,适合大规模运行。

基准测试方面,Haiku 5.5 在多项评估中优于 Haiku 4.5 并领先 GPT-6 Luna,但需注意其结果依赖于“努力级别”设置。在 Terminal-Bench 4.0 中,Haiku 5.5 在最大努力水平下得分为 39.2%,中等努力水平下约为 20%。Sonnet 5.5 则在所有测试中保持领先地位。

生态更新与部署细节

此次更新还包括 Sonnet 5.5 缓存读取费用减半(降至每百万 token 0.10 美元),以及面向 Max 和 Team 订阅用户的月度 API 额度政策:Max 5x 用户获 100 美元,Max 20x 及以上获 200 美元,Team 用户共享最高 500 美元额度。

目前,Haiku 5.5 已通过 Anthropic 自有平台及 AWS、Google Cloud、Microsoft Azure 上线,API 标识符为 claude-haiku-5-5。Python 和 TypeScript SDK 同步更新了浏览器和计算机操作的 Beta 功能。此外,新模型收紧了网络安全限制,默认阻止渗透测试,有特定需求的组织需通过验证计划申请。