Anthropic 于 2026 年 10 月 7 日星期三发布 Claude Haiku 5.5,称其为自己发布过的最便宜、最快、能力最强的小型模型。官方说明将它定位于高并发、低延迟任务,例如分类、抽取、路由和子代理工作。
Claude Platform 上的模型 ID 为 claude-haiku-5-5。上下文窗口达 100 万 token,最大输出 12.8 万 token。提示不超过 10 万 token 时,输入为每百万 token 0.10 美元,输出为 0.50 美元;超过该阈值后分别升至 0.50 美元和 2.50 美元。Anthropic 表示,平均运行成本约比 Haiku 4.5 低 75%,且先前 Haiku 约 90% 的请求不超过 10 万 token。
实际变化
Haiku 5.5 是该系列首个支持可调努力参数和自适应思考的模型。公司将它与 Opus 5.5、Sonnet 5.5 一起用于编程流程,尤其是作为子代理,以及实时客服和浏览器操作等对速度敏感的场景。
成本还有一个不在价格表里的细节。该模型使用与 Claude 4.7 代及以后相同的新分词器。Anthropic 文档称,同一段文本可能比在 Haiku 4.5 上多计约 30% 的 token。迁移时要看实际用量,不能只看每百万 token 的单价。
同一次发布中,Anthropic 将 Sonnet 5.5 的缓存读取价格降一半。公司表示,这使 Sonnet 5.5 在大部分代理式工作中大约便宜 20%。
哪里可以用
Free、Pro、Max、Team 和 Enterprise 用户可在 Claude.ai 的网页、iOS 和 Android 上选择 Haiku 5.5。开发者可通过 Claude Platform、Amazon Web Services、Google Cloud 和 Microsoft Foundry 使用,也可在 Claude Code 中使用。Claude 官方 X 账号还提到了 Microsoft Azure 上的可用性。
在 Anthropic 自己发布的基准测试中,Haiku 5.5 在 GDPval-AA v2.1 上得分 1620,Haiku 4.5 为 735,公司用作参照的 GPT-6 Luna 为 1437。在计算机使用方面,OSWorld 2.1 离线子集为 72.4%,Haiku 4.5 为 15.7%,Luna 为 48.9%。这些是厂商数字,不是独立评测。
官方账号还表示,Haiku 5.5 在内部对齐评测上相对 Haiku 4.5 有广泛提升,失调行为更少。这项比较同样来自 Anthropic。
来源
透明说明:本内容在人工智能辅助下创作、编辑或审校。信息已与 X 上的公开帖子及互联网可用来源交叉核对。请查阅原始来源以了解完整语境。
Por GeekikiBot