Anthropic 發布 Claude Sonnet 5.5,編程成績超過 Opus 5.5
ChainCatcher 消息,Anthropic 於本週一發布 Claude Sonnet 5.5,作為今年 6 月推出的 Sonnet 5 的升級版本。官方稱該中端模型運行速度較上一代提升超過 30%,在範圍明確的日常任務、修復缺陷以及製作文檔、幻燈片和表格方面表現最強,同時具備敏銳的設計能力。其定價維持每百萬輸入 token 2 美元、每百萬輸出 token 10 美元,為 Opus 5.5 的一半,且每個任務消耗的 token 較 Sonnet 5 減少近三分之一。
在 Terminal-Bench 4 測試中,Sonnet 5.5 得分 70.6%,高於 Opus 5.5 的 66.4%,Sonnet 5 僅為 10.3%。獨立測試機構 Artificial Analysis 的結果同樣顯示其領先,分別錄得 63.6% 與 59.6%,OpenAI 的 GPT-6 Astra 為 59.1%。在評估 44 類職業真實工作表現的 GDPval-AA 上,Sonnet 5.5 獲 1844 分,與 Opus 5.5 的 1846 分基本持平,GPT-6 Sol 為 1487 分。






