剛剛,Claude Haiku 5.5發布!價格暴降90%

就在剛剛,Anthropic 發布了 Claude Haiku 5.5,單價只有上一代 Haiku 4.5 的 1/10、Sonnet 5.5 的 1/20,和 OpenAI 的 GPT-6 Luna 一個價。

官方跑分表裡 Luna 交了成績的六項全輸給了它,好幾項還咬住了 Sonnet。
操作電腦的 OSWorld 從上一代的 15.7% 衝到 72.4%,離 Sonnet 5.5 只差 11.5 個百分點
終端編程的 Terminal-Bench 4.0,上一代是零分,這次拿了 39.2%
知識工作的 GDPval-AA 拿下 1620 分,是上一代的兩倍多
「人類最後的考試」HLE 不帶工具,從 10.2% 漲到 45.9%

實際能省多少錢
價格是每百萬 Token 輸入 0.10 美元、輸出 0.50 美元,這是提示在 10 萬 Token 以內的價格,超過 10 萬按輸入 0.50 美元、輸出 2.50 美元算。
快取讀取每百萬 Token 0.01 美元,走批處理再打五折。

官方測算下來,同樣的活平均比 Haiku 4.5 省 75% 左右,同樣的預算大約能跑四倍的調用量。
沒省到九成,是因為超過 10 萬 Token 的請求只便宜一半,好在上一代 Haiku 約九成請求都在 10 萬以內,另外新分詞器會讓同樣一段話多出三成左右的 Token。
和 GPT-6 Luna 比,10 萬 Token 以內兩家的輸入、輸出、快取價格完全一樣。
面對長上下文時 Luna 更便宜,它要到 27 萬 Token 左右才漲價,漲完也才輸入 0.20 美元、輸出 0.75 美元。
Sonnet 5.5 的快取讀取也從今天起砍半,每百萬 Token 從 0.20 美元降到 0.10 美元,官方算下來大多數 Agent 任務能便宜兩成左右。
Max 和 Team 訂閱本週起每月送 API 額度,Max 5x 送 100 美元、Max 20x 送 200 美元,Team 最多 500 美元、全隊共用,在 Claude Platform 上哪個模型都能用。
跑分壓過 Luna 但複雜編程還差 Sonnet 一截
這一代 Haiku 相比上一代,跑分進步巨大。

操作電腦的 OSWorld 從上一代的 15.7% 衝到 72.4%,離 Sonnet 5.5 只差 11.5 個百分點
終端編程的 Terminal-Bench 4.0,上一代一分沒拿到,這次拿了 39.2%
知識工作的 GDPval-AA 拿下 1620 分,是上一代的兩倍多
「人類最後的考試」HLE 不帶工具,從 10.2% 漲到 45.9%
電腦操作是這次進步最猛的一項,OSWorld 上同價的 Luna 只有 48.9%,Haiku 5.5 甩開它 23.5 個百分點。
算上成本更誇張,它開到 Medium 档就超過了 Luna 滿檔的成績,花的錢還更少。

知識工作的 GDPval-AA 上,Haiku 5.5 的 1620 分壓過了 Luna 的 1437 分,離 Sonnet 5.5 的 1840 分還差一截,只開默認的 Medium 档也有 1277 分。
跑長線項目的 AA-Briefcase 上,它從上一代的 614 分漲到 1578 分,Luna 是 1336 分。

推理和讀圖上,HLE 帶上搜索和代碼工具時 Haiku 5.5 是 57.4%,Sonnet 5.5 是 64.5%。讀專業圖表的 Chartography,它從上一代的 6.4% 漲到 46.4%,Luna 是 29.1%,Sonnet 5.5 是 61.6%。

和 Sonnet 差距最大的是編程,Terminal-Bench 4.0 上它的 39.2% 是 Luna(16.4%)的兩倍多,但 Sonnet 5.5 是 70.6%。
FrontierCode 上它的 46.4% 也贏了 Luna 的 42.4%,離 Sonnet 5.5 最好成績的 52.1% 還差將近 6 個點。
官方也明說,複雜的 Agent 編程還是交給 Sonnet 5.5 和 Opus 5.5。
適合拿來幹什麼
官方給 Haiku 5.5 的定位是量大、要快、要省錢的活,比如寫摘要、壓縮上下文、查數據庫、做分類。
它也是目前最快的 Claude 模型,只比開了快速模式(價格很貴!)的 Opus 慢,適合即時客服和瀏覽器操作。
官方也給出了一批明星 AI 應用公司內測反饋。
Asana 測下來,任務完成的延遲比他們現用的模型降了三成多,Box 測得它的延遲只有 Haiku 4.5 的一半左右。

另一個主要用法是給 Opus 或 Sonnet 當子 Agent,大模型拆任務、拿主意,Haiku 分頭去跑。
Cognition 的 Devin Fusion 讓 Opus 5.5 當主力、Haiku 5.5 當副手,FrontierCode 穩在 66.2 分的頂級水平,成本和延遲都降了下來。

金融 AI 公司 Rogo 讓大模型做 PPT,Haiku 5.5 鑽進 10-K 財報扒分部營收數據。

Claude 開發者帳號給出了 Demo,任務是用一堆家用雜物設計裝雞蛋的架子,目標是從 32 米扔下不碎。

Opus 5.5 單幹用了 3 分 37 秒、試了 25 種方案、花了 0.47 美元,帶上 10 個 Haiku 5.5 子 Agent 只用了 58 秒、試了 86 種、花了 0.14 美元。
Haiku 5.5 使用指南
Haiku 5.5 已經在 Claude 客戶端、Claude Code 和 AWS、谷歌雲、微軟 Azure、Cursor、OpenRouter 等平台上線,模型 ID 是 claude-haiku-5-5,上下文 100 萬 Token,單次最多輸出 12.8 萬 Token。

它是第一個能調思考檔位的 Haiku,從 Low 到 Max 一共五檔,API 默認是 Medium。
Python 和 TypeScript SDK 也加上了電腦操作和瀏覽器操作,目前是 Beta。
從 Haiku 4.5 遷移過來,同樣的文字 Token 會多三成左右,max_tokens 和成本預估得重算。
budgettokens 換成了自適應思考加 Effort 檔位,temperature、topp、top_k 要刪掉,預填回覆不能用了,格式要求改用結構化輸出。
電腦操作要換成新工具集 computertoolset20260801,Priority Tier 暫不支持。
嫌麻煩可以在 Claude Code 裡跑一句:
讓它自己改。
當然,對於非開發者而言,你現在就可以直接在客戶端裡與 Haiku 5.5 對話了!

簡單的問題就不要麻煩 Fable、Opus、Sonnet 了,Haiku 5.5 即使只是開 Low 檔推理強度,也可以做到準確地秒出答案,完美替代搜尋引擎了。

快去試試吧!
參考資料:
https://www.anthropic.com/claude-haiku-5-5











