Anthropic 發布了 Claude Haiku 5.5,把這款小模型持續推向「更便宜、更快、更能實際做事」的方向。Haiku 是 Claude 系列裡最小、最便宜的一檔,定位在 Sonnet 和 Opus 之下,適合量大、對延遲和成本都敏感的任務。

這次最直接的變化是價格。按照官方說法,處理 10 萬 Token 以內的請求時,Haiku 5.5 每百萬 Token 輸入收費 0.1 美元、輸出 0.5 美元,比 Haiku 4.5 便宜 90%;超過 10 萬 Token 的長請求則是輸入 0.5 美元、輸出 2.5 美元,大約是前代的半價。

由於上一代 Haiku 大約 90% 的請求都在 10 萬 Token 以內,官方估計平均執行成本會比 Haiku 4.5 低約 75%。10 萬 Token 大約是一本中篇小說的長度,客服對話、文件摘要、分類標記、簡單查詢這類日常工作,很多都落在這個範圍內。對開發者來說,這代表批次處理、即時回應和高頻呼叫的成本壓力會明顯下降。

價格下降的同時,能力也跟著提升。在官方公布的測試中,Haiku 5.5 在操作電腦完成多步驟任務(OSWorld 2.1)的成績從 Haiku 4.5 的 15.7% 提升到 72.4%;在命令列裡自主完成編程任務(Terminal-Bench 4.0)則從 0% 提升到 39.2%。Anthropic 也表示,除了 Opus 開啟快速模式之外,Haiku 5.5 是目前速度最快的 Claude 模型。

官方為它劃出兩類典型用途。一類是重複性高、量大、要求快的工作,例如摘要、分類、資料庫查詢、即時客服和瀏覽器自動化。另一類是替更大的模型擔任「子智能體」:主要任務交給 Opus 5.5 或 Sonnet 5.5 處理,再把零碎的子任務分給 Haiku 5.5 執行。

Haiku 5.5 也是第一個支援調整「effort(投入力度)」的 Haiku 模型,官方說法是從低到高共有五段。簡單任務可以開低檔省成本,遇到難題時再調高換取更好的效果,開發者能依任務難度自行取捨。

目前,Haiku 5.5 已在 Claude API 以及 AWS、Google Cloud、Microsoft Azure 上線,模型名稱是 claude-haiku-5-5。

同步宣布的還有另一項降價:Sonnet 5.5 的快取讀取價格減半,降到每百萬 Token 0.1 美元。快取通常用來存放重複使用的內容,例如很長的系統提示詞或整個程式碼庫;在智能體任務裡,這部分開支往往占很大比例。官方估計,這次調整後,大多數 Sonnet 5.5 智能體任務的成本大約能再降低 20%。