Claude Haiku 5.5 降价 75%:小模型的竞争已经移到单价表

结论
Anthropic 发布 Claude Haiku 5.5 时给出的信号,比"新模型"本身更重要:官方称运行成本平均较 Haiku 4.5 低约 75%,定价为每百万 token $0.10/$0.50,超过 10 万 token 的提示升至 $0.50/$2.50,与 GPT-6 Luna 对齐;同一天 Cursor 把 Claude Sonnet 5.5 的缓存读取价从 $0.20 降到 $0.10。小模型这一层的胜负手,正在从"智能指数高几分"换成"同一件活便宜多少"。
三个要点
- 能力已经够用,价格才是门槛。 Artificial Analysis 给 Haiku 5.5 的智能指数是 43,一年内提升 26 分;Cognition 公布它在 FrontierCode 1.1 上得 58.4%,领先 Sonnet 5,而每任务成本约为后者的八分之一。当"够用"成为默认前提,采购决策自然向下游走。
- 缓存定价成为新战场。 长上下文场景里真正吃钱的是被反复读取的上下文。Sonnet 5.5 缓存读取价砍半,等于给"同一份上下文复用很多次"的智能体负载单独降了一次价。谁把缓存单价打下来,谁更容易进生产线。
- 小模型的位置被重新定义。 Anthropic 把 Haiku 5.5 明确定位在摘要、压缩、数据库查询、分类这类高吞吐任务,以及给 Opus 5.5 / Sonnet 5.5 当编码子智能体。它不再负责"最强",只负责"最划算的那一环"。
对你意味着什么
如果你的用量集中在分类、抽取、摘要、检索重排上,现在值得做一次成本审计:把过去用中档模型跑的批量任务,按"准确率是否达标 + 单价"两列重算,多数场景可以直接换到小模型,省下的预算留给真正需要强推理的少数环节。需要留一个心眼:Haiku 5.5 的价格阶梯在 10 万 token 之后跳 5 倍,长上下文任务可能比预期更贵,先按真实提示长度算账再迁移。
参考来源
- Anthropic: Claude Haiku 5.5
- Simon Willison: Claude Haiku 5.5
- Cursor 公布 Haiku 5.5 定价
- Cognition: Haiku 5.5 上线 Devin
延伸阅读:第 18 名却是开源第一:Qwen-Image-2.1 说明图像模型的竞争已经分层 · 560B 参数只激活 25B:蚂蚁 Ling-3.1-flash 把国产模型的竞争锚点挪到了「长任务」 · 首字 0.13 秒、词错率 2.50%:实时语音转写的竞争点已经换位置了