Anthropic 发布 Claude Haiku 5.5:史上最便宜、最快的小模型,成本直降 75%
Anthropic 正式推出 Claude Haiku 5.5,官方称这是其迄今「最便宜、最快、能力最强」的小模型。在 Hacker News 上,该消息迅速斩获 353 分与 167 条评论,成为当日热门话题。
定位:高并发、成本敏感任务的「性价比之选」
Haiku 5.5 瞄准的是高吞吐、对成本敏感的场景。官方表示,它能稳定处理快速、重复性的工作负载,例如:
- 摘要生成与上下文压缩(compaction)
- 数据库查询
- 分类请求
同时,它还能作为**子代理(subagent)**配合 Opus 5.5 和 Sonnet 5.5 完成编码类任务。由于是 Anthropic 目前速度最快的模型,Haiku 5.5 也特别适合实时客服、浏览器操作等对延迟敏感的应用。
价格:运行成本平均下降约 75%
最引人注目的变化是价格。官方称,Haiku 5.5 的运行成本比 Haiku 4.5 平均低约 75%。
与此同时,Anthropic 还调整了整个模型家族的性价比:
- Claude Sonnet 5.5 的缓存读取价格减半,使得 Sonnet 5.5 在大多数代理型(agentic)工作中的成本降低约 20%。
- 面向 Claude Max 和 Team 订阅用户推出新的月度 API 额度,用于支持用户在 Claude 平台上构建新的代理与应用。
能力:首个支持「可调努力」的 Haiku 级模型
Haiku 5.5 是 Anthropic 首个带有可调 effort 设置的 Haiku 级模型。用户可以像使用其他模型一样,在「成本优先」与「智能优先」之间自行取舍。
官方展示的评测覆盖三大方向:
- 计算机操作:OSWorld
- 知识工作:GDPval-AA
- 多学科推理:Humanity's Last Exam
图表分别呈现了 Haiku 5.5 在不同 effort 设置下于上述基准的表现。
早期客户反馈:延迟显著下降
在早期测试中,客户反馈与官方公布的性能、成本改善趋势一致。参与测试的公司包括 Asana、HubSpot、AlphaSense、Box、Rogo 和 Cognition。
Asana 的软件工程师 Aaron Vinh 表示,团队将 Haiku 5.5 用于其 AI 代理产品 AI Teammates 的评测套件,覆盖 bug 分诊、项目搭建、在大规模项目组合中搜索高风险或逾期工作等场景。相比当前使用的模型,任务完成延迟降低超过 30%,每个代理轮次的推理速度最高提升 2.5 倍,整体体验「明显更迅捷」。
行业背景
小模型赛道正成为大模型厂商争夺的焦点。在保证可用能力的前提下,把价格和延迟压到极致,是让 AI 代理大规模落地的关键。Haiku 5.5 以「成本直降 75% + 速度最快」的组合切入,显然意在抢占高并发、代理型工作负载的入口。而同步下调 Sonnet 5.5 缓存价格、赠送订阅用户 API 额度,也显示出 Anthropic 希望进一步降低开发者构建代理应用的门槛。
