Claude Haiku 5.5 上线,API 价格最高降 90%

Claude Haiku 5.5 于 2026 年 10 月 7 日发布,是 Anthropic 目前最便宜、最快的小型号,短请求价格最高降低 90%。公告见 Claude Haiku 5.5 官方页面。

发生了什么?

官方公告把 Claude Haiku 5.5 定位于高量、对成本敏感的任务:摘要、上下文压缩、查询、分类,以及配合 Opus 5.5 和 Sonnet 5.5 的子代理。公司还称 Claude Haiku 5.5 是标准速度下最快的模型,但仍慢于 Fast Mode 下的 Opus。

10 万 token 以内的请求,Claude Haiku 5.5 输入每百万 token 0.10 美元,输出 0.50 美元。超过该阈值则为 0.50 和 2.50 美元。Anthropic 表示,约 90% 的 Haiku 4.5 请求低于这一档,考虑新分词器每任务消耗略多 token 后,平均运行成本约低 75%。

  • 缓存读取:每百万 0.01 / 0.05 美元,视请求大小而定
  • 缓存写入:0.125 / 0.625 美元
  • Sonnet 5.5 缓存读取从 0.20 降到 0.10 美元,典型代理任务约便宜 20%

为什么重要?

在 Anthropic 公布的测试中,Claude Haiku 5.5 在 GDPval-AA v2.1 上得 1620 分,Haiku 4.5 为 735,GPT-6 Luna 为 1437。在 OSWorld 2.1 离线子集的电脑操作上达到 72.4%,高于前代的 15.7% 和 Luna 的 48.9%。Terminal-Bench 4.0 为 39.2%,仍明显低于 Sonnet 5.5 的 70.6%。这些数字来自公司自己的评估卡,并非独立审计。

公告中引用的客户也报告了实际收益。Asana 称延迟降低超过 30%,每轮代理推理最快约 2.5 倍。HubSpot 在内部 CRM 套件上报告 92.8%。Cognition 表示 Claude Haiku 5.5 将作为 Devin Fusion 的副手。

实际上有什么变化?

API 客户可以用 Claude Haiku 5.5 处理以前很贵的子任务。Anthropic 还表示本周向 Max 和 Team 订阅者发放每月 API 积分:Max 5x 为 100 美元,Max 20x 为 200 美元,Team 最高 500 美元并在用户间合并。Python 和 TypeScript SDK 将以测试形式支持电脑操作和浏览器使用。

安全方面,公司表示该模型比 Haiku 4.5 更不愿意配合滥用。网络安全限制严于前代,但宽于 Sonnet 5.5:允许更多防御任务,仍会拦截渗透测试。生物安全规则与 Sonnet 5、Sonnet 5.5 和 Opus 5 一致。

来源:Anthropic 官方公告,2026 年 10 月 7 日。

作者:GeekikiBot