Anthropic 刚刚发布了 Claude Haiku 5.5——旗下史上最快、最便宜且能力最强的小模型。综合运行成本相比上一代直接暴跌 75%,同时每个月还向 Max 和 Team 订阅用户免费赠送最高 500 美元的 API 额度。
这次更新不仅带来了新模型,Claude Sonnet 5.5 的缓存读取价格今天起也同步腰斩。
一、Haiku 5.5 跑分表现

二、价格调整详情
每百万 token 的缓存读取价格从 0.20 美元降至 0.10 美元。

在绝大多数智能体任务中,Sonnet 5.5 的综合运行开销下降了大约 20%。
三、Haiku 5.5 的定位
新登场的 Haiku 5.5 专为高吞吐、对成本敏感的高频任务打造。它可以稳定处理文本摘要、上下文压缩、数据库查询以及数据分类等快节奏重复工作。
在编写代码时,它能够与 Opus 5.5 以及 Sonnet 5.5 配合,充当负责具体琐碎工作的子智能体。
作为目前响应速度最快的 Claude 模型,它尤其适合实时客服和浏览器操作这类追求极速反馈的场景。
在提示词长度不超过 10 万 token 的任务中,它的性价比优势最为突出。这个长度区间覆盖了老款 Haiku 此前约 90% 的实际请求。
这是首款支持自定义思考程度(effort setting)的 Haiku 级别模型,用户可以在成本控制与智力水平之间自由调节。
在不同思考程度设定下,Haiku 5.5 在基准测试中的表现如下:

早期测试客户的反馈显示,新模型的性能与成本优化符合基准测试预期。
四、可用性与工具链
Haiku 5.5 目前已经在亚马逊 AWS、谷歌云 Google Cloud、微软 Azure 以及 Claude 官方平台全面上线,开发者可以直接调用 claude-haiku-5-5。
在 Terminal-Bench 4.0 基准测试中,成本调整后的性能表现呈现出清晰分工:

对于复杂的智能体编程任务,Sonnet 5.5 和 Opus 5.5 依然是更好的选择。Haiku 5.5 更适合范围明确、此前受限于成本而难以铺开的任务,例如上下文压缩、文本总结或子智能体分工。
官方 Python 与 TypeScript SDK 已更新,加入对计算机使用与浏览器操作的测试版支持。凭借响应速度与低成本,Haiku 5.5 很适合接管这类操作任务。
五、Max/Team 订阅用户福利
本周起,Anthropic 将面向 Max 和 Team 订阅用户每月发放 API 额度,用于在 Claude 平台上搭建应用与智能体。这项福利适用于平台上的各种 Claude 模型。
Max 用户每月可获赠 500 美元 API 额度,Team 用户每月可获赠 100 美元 API 额度。这意味着你不仅可以自己用,还能在 Claude 平台上搭建自己的应用与智能体,直接抵扣 API 调用费用。
官方文档:https://docs.anthropic.com/en/docs/about-claude/models/all-models