Anthropic 发布了 Claude Haiku 5.5,把这档小模型继续往“便宜、快、能干活”的方向推了一步。Haiku 是 Claude 系列里最小、最便宜的一档,定位在 Sonnet 和 Opus 之下,适合跑量大、对延迟和成本都敏感的任务。

这次最直观的变化是价格。按照官方说法,处理 10 万 Token 以内的请求时,Haiku 5.5 每百万 Token 输入收费 0.1 美元、输出 0.5 美元,比 Haiku 4.5 便宜 90%;超过 10 万 Token 的长请求为输入 0.5 美元、输出 2.5 美元,价格大约便宜一半。考虑到上一代 Haiku 的请求里约 90% 都在 10 万 Token 以内,官方估算平均运行成本会比 Haiku 4.5 低约 75%。

10 万 Token 大致相当于一本中篇小说的篇幅。客服对话、文档摘要、分类打标、简单查询这类日常任务,很多都落在这个区间里。对开发者来说,这意味着批量处理、实时响应和高频调用的成本压力会小很多。

价格降了,能力也往上提。官方公布的测试里,Haiku 5.5 在操作电脑完成多步骤任务上的成绩,从 Haiku 4.5 的 15.7% 提升到 72.4%;在命令行里自主完成编程任务上,从 0% 提升到 39.2%。Anthropic 还说,除了 Opus 开启快速模式之外,它是目前速度最快的 Claude 模型。

官方给它划了两类典型用法。一类是重复、量大、要求快的任务,比如摘要、分类、数据库查询、实时客服和浏览器自动操作。另一类是给更大的模型当“子智能体”:主力让 Opus 5.5 或 Sonnet 5.5 负责,再把零碎子任务拆给 Haiku 5.5 去做。

Haiku 5.5 也是首个支持调节“effort(投入力度)”的 Haiku 模型,官方说法是从低到高共有五档。简单任务开低档可以省钱,遇到难题再把档位调高换效果,开发者可以按任务难度自己权衡。

目前,Haiku 5.5 已在 Claude API 以及亚马逊 AWS、谷歌云、微软 Azure 上线,模型名是 claude-haiku-5-5。

和它一起宣布的还有另一项降价:Sonnet 5.5 的缓存读取价格减半,降到每百万 Token 0.1 美元。缓存通常用来存放反复使用的内容,比如很长的系统提示词或整个代码库;在智能体任务里,这部分开销往往占大头。官方估算,这次调整后,大多数 Sonnet 5.5 智能体任务的成本大约能再低 20%。

图片说明