原文標題:Claude Haiku 5.5

Anthropic 10 月 7 日發布 Claude Haiku 5.5,定位為該公司迄今速度最快、能力最強的小型模型,主要面向大量重複請求、摘要、分類、資料庫查詢與客服等工作。官方同時建議在複雜的程式開發流程中,讓 Haiku 擔任較大型 Claude 模型的子代理,處理範圍明確且對成本敏感的任務。這次發布不是單純更換名稱,而是把小模型的價格、效能與使用方式一起調整。

在定價方面,Haiku 5.5 對不超過 10 萬 tokens 的提示,每百萬輸入 tokens 為 0.10 美元、輸出為 0.50 美元;超過該門檻的提示則分別為 0.50 與 2.50 美元。Anthropic 表示,依既有工作負載的分布與 token 用量估算,平均執行成本較 Haiku 4.5 降低約 75%。新模型也提供可調整的推理努力程度,讓開發者依任務在成本與能力之間取捨。

Haiku 5.5 已在 Claude Platform、AWS、Google Cloud 與 Microsoft Azure 提供,模型識別碼為 claude-haiku-5-5。Anthropic 另外將 Sonnet 5.5 的快取讀取價格減半至每百萬 tokens 0.10 美元,並宣布為 Max 與 Team 訂閱者提供每月 API 額度。官方公布的 benchmark 屬其自家測試與引用的評測,實際企業工作流程仍需個別驗證。

發生了什麼事

Anthropic 正式推出 Haiku 5.5,調整小模型推論價格與功能,並同步降低 Sonnet 5.5 快取讀取成本。

為什麼重要

高頻任務的單次成本會在大量呼叫後放大,新模型與價格結構可能改變企業配置不同等級模型的方式。

影響哪些人

需要大量摘要、客服、分類、資料查詢或子代理工作的開發者,以及在多雲環境使用 Claude 的企業。

已確認與未確認

官方已公布模型識別碼、價格級距與供應平台;平均節省幅度取決於實際 token 分布,效能數據也不代表每種任務都能達到相同結果。