原文標題:Introducing Claude Sonnet 5.5
Anthropic 9 月 28 日推出 Claude Sonnet 5.5,這是 Claude 5.5 家族的第二款模型。公司表示,它相較 Claude Sonnet 5 有明顯升級,執行速度提高 30% 以上,而且多數工作成本最高可降低 30%,定位在高階 Opus 5.5 與未來高吞吐 Haiku 5.5 之間。
Anthropic 把 Sonnet 5.5 的強項描述為範圍清楚的日常任務、除錯,以及建立文件、簡報與試算表等知識工作。官方也強調長時間工作與影像理解能力,並指出它是第一個只靠遊戲畫面就能在相關測試中超越既有 Sonnet 的版本。
在 Terminal-Bench 4.0 代理式程式設計評測中,Anthropic 公布 Sonnet 5.5 得分 70.6%,相較 Sonnet 5 的 10.3% 大幅提高;在 GDPval-AA 等職業工作評測中則接近 Opus 5.5。不過 benchmark 結果高度依任務與測試設定,不能直接代表所有企業工作。
Anthropic 預告 Claude Haiku 5.5 將在數週內加入家族,進一步覆蓋大量、成本敏感的工作負載。Sonnet 5.5 的實際成本下降幅度也取決於輸入輸出量、工具使用與任務長度,因此「最多 30%」不應解讀為所有請求都固定便宜三成。
發生了什麼事
Anthropic 發布 Claude Sonnet 5.5,主打比 Sonnet 5 更快、更便宜,並提升代理式程式設計與長流程工作能力。
為什麼重要
企業部署模型通常同時看能力、延遲與單次成本;Sonnet 5.5 把高階模型家族的部分能力下放到更適合日常規模的價格帶,會影響模型選型。
影響哪些人
Claude API 開發者、使用 AI coding agent 的工程團隊、文件與知識工作自動化使用者,以及比較多模型成本的企業 AI 平台最直接受到影響。
已確認與未確認
速度、成本與 benchmark 數據均為 Anthropic 官方公布;實際效能與節省幅度仍會因工作負載、上下文與工具使用方式而不同。