BTC $77,543.27 -1.46%
ETH $2,412.44 -2.46%
BNB $687.52 -0.85%
XRP $1.35 -2.65%
SOL $100.16 -3.36%
TRX $0.3216 -3.18%
DOGE $0.0814 -2.12%
ADA $0.1976 -1.68%
BCH $248.79 +0.44%
LINK $11.20 -2.02%
HYPE $82.93 -1.56%
AAVE $129.19 +3.03%
SUI $0.7224 -1.54%
XLM $0.1755 -1.30%
ZEC $839.52 -2.03%
BTC $77,543.27 -1.46%
ETH $2,412.44 -2.46%
BNB $687.52 -0.85%
XRP $1.35 -2.65%
SOL $100.16 -3.36%
TRX $0.3216 -3.18%
DOGE $0.0814 -2.12%
ADA $0.1976 -1.68%
BCH $248.79 +0.44%
LINK $11.20 -2.02%
HYPE $82.93 -1.56%
AAVE $129.19 +3.03%
SUI $0.7224 -1.54%
XLM $0.1755 -1.30%
ZEC $839.52 -2.03%

剛剛,Claude 5.1 發布!全球最強模型來了

核心觀點
Summary: Anthropic 推出新一代模型 Claude Fable 5.1 和 Claude Mythos 5.1。
推薦閱讀
2026-09-02 09:28:23
Anthropic 推出新一代模型 Claude Fable 5.1 和 Claude Mythos 5.1。

原創 關注AI的 機器之心
就在剛剛, Anthropic 推出新一代模型 Claude Fable 5.1 和 Claude Mythos 5.1。

Anthropic 稱 Claude Fable 5.1 是目前最強大的公開可用模型之一,專為複雜推理、長周期任務和 Agent 工作流打造。而 Claude Mythos 5.1 則代表他們探索的更高能力邊界。

需要注意的是,雖然兩者共享相同的基礎模型能力,但針對不同使用場景採用了不同的安全措施。

其中 Fable 5.1 面向普通用戶、開發者和企業開放, Mythos 5.1 則面向經過審核的高風險領域合作夥伴,保持更嚴格訪問控制。

換句話說,一個負責進入現實世界工作,另一個則被留在更嚴格控制的環境裡。而這也或許是 Anthropic 對未來 AI 產品形態的一次探索:最強模型,不一定會以同一種形式提供給所有人。

官方則表示,這兩個模型代表了 Claude 系列能力的重要進展,並展示了他們如何在提升模型能力的同時,繼續推進安全部署。 剛剛,Claude 5.1 發布!全球最強模型來了

作為「地表最強」模型的 Fable 5.1,性能表現依舊能打,官方數據顯示, Fable 5.1 多項基準測試的表現均優於上一代旗艦 Fable 5。 剛剛,Claude 5.1 發布!全球最強模型來了

但能力更強,價格卻便宜了。 Anthropic 表示, Fable 5.1 保持基礎價格不變,快取讀取成本相比 Fable 5 降低了 75%。在實際使用中,這使模型的整體成本對於典型工作負載降低約 25%;對於高度 Agent 化的工作負載,成本最高可降低 45%。 剛剛,Claude 5.1 發布!全球最強模型來了

看來,就連最強大模型也在講究性價比了。

下面來具體看一下。

低檔位追平上一代, Fable 5.1 主打「性價比」

相比單純刷新榜單, Anthropic 這次更想強調的是: Fable 5.1 可以用更低的推理成本,完成過去需要 Fable 5 高檔位才能完成的任務。

根據官方測試, Fable 5.1 在低、中等推理強度下,已經能夠取得接近甚至超過 Fable 5 的表現。 Claude Code 默認使用高推理強度, Claude Cowork 和 Claude . ai 則默認使用中等強度,用戶也可以根據任務複雜程度,在速度、成本與效果之間進行調整。

具體來看, Fable 5.1 在科學研究型 Agent 基準 Terminal - Bench - Science 0.1 中取得 52.6% 的成績,相比 Fable 5 的 24.7% 提升超過一倍;在 Terminal - Bench 4.0 中, Fable 5.1 達到 55.8%,開放更多能力的 Mythos 5.1 進一步達到 60.9%。

在知識工作、計算機操作和業務流程測試中,新模型同樣取得提升。 AutomationBench 成績從 Fable 5 的 17.1% 提高到 31.4%, CursorBench 3.2.0 則從 70.5% 提高到 73.4%。 剛剛,Claude 5.1 發布!全球最強模型來了

多項基準測試中, Fable 5.1 的成績均超過 Fable 5,科學研究型 Agent 與商業工作流能力提升最為明顯。 剛剛,Claude 5.1 發布!全球最強模型來了

Terminal - Bench 4.0 測試中, Fable 5.1 與 Mythos 5.1 在不同推理強度下均超過上一代 Mythos 5。 剛剛,Claude 5.1 發布!全球最強模型來了

在 Terminal - Bench - Science 0.1 測試中, Fable 5.1 最高得分達到 52.6%,超過 Fable 5 的兩倍。

Anthropic 認為, Fable 5.1 的一項重要變化,是更願意追蹤問題的根本原因,也更適合執行持續數小時甚至數十小時的複雜任務。

投資機構 Millennium 在測試中發現,一段內部代碼大約每百萬次運行會崩潰一次。這個問題困擾工程團隊四五年,其他模型也沒有找出原因。 Fable 5.1 則通過反匯編外部供應商的程序庫、比對核心轉儲文件,最終將問題定位到第三方程序庫中的一個 Bug 。

Ramp 還讓 Fable 5.1 連續運行了 38 小時。模型在發現原有機器學習結果受到標籤錯誤影響後,自行修正問題,並發啟動六組實驗,最終整理出新的結果與後續建議。

從寫代碼到做科研

這次發布中, Anthropic 用相當大的篇幅介紹 Fable 5.1 與 Mythos 5.1 在科學研究中的表現。

在蛋白質設計實驗中,研究人員讓 Mythos 5.1 調用開源蛋白質設計與折疊工具,再將生成的設計交給兩個外部機構進行實驗驗證。

在三個目標蛋白上, Mythos 5.1 設計的結合劑親和力達到 Adaptyv Bio 相關蛋白質設計競賽最佳方案的 10 倍。面對 12 個目標蛋白時,模型設計的有效結合劑命中率接近 50%,而 Anthropic 給出的行業常見水平為 10% 至 15%。

Fable 5.1 還利用 30 多年前 NASA 麥哲倫號探測器採集的雷達圖像,為金星約三分之一的表面生成了一張新的高分辨率高程圖。 剛剛,Claude 5.1 發布!全球最強模型來了

NASA 麥哲倫號探測器拍攝的金星雷達圖像,畫面中央為一座直徑約 15 公里的小型盾狀火山。

原有地圖只能呈現 10 至 20 公里尺度的細節,新地圖將分辨能力提高至 2 至 3 公里,高度測量準確度最多提升 25%。 Anthropic 計劃以知識共享許可公開這張地圖,供 NASA VERITAS 和歐洲航天局 EnVision 等後續任務參考。

在計算生物學領域, Mythos 5.1 通過編寫定制 GPU 內核、快取中間結果,將 7 個開源蛋白質與基因組深度學習模型的運行速度最高提高 2.5 倍,同時保持輸出結果一致。在部分全基因組分析任務中,預計可以降低 30% 至 60% 的 GPU 成本。 剛剛,Claude 5.1 發布!全球最強模型來了

Mythos 5.1 優化 7 個開源蛋白質與基因組模型後,推理速度提高 1.4 至 2.5 倍。

Anthropic 想借這些案例證明,模型正在從整理資料、編寫代碼,進一步走向提出方案、運行工具並交付可供實驗驗證的科研結果。

快取價格降了 75%, Agent 任務最高便宜 45%

性能之外,價格是 Fable 5.1 最直接的一個變化。

Fable 5.1 的輸入和輸出價格沒有調整,仍為每百萬 Token 10 美元和 50 美元,但快取讀取價格從原來的水平下調 75%,降至每百萬 Token 0.25 美元。

快取讀取指的是模型重複使用已經處理過的上下文。普通問答中的占比可能有限,但在需要反復讀取代碼庫、歷史對話和工具結果的 Agent 任務中,快取往往構成主要成本。

按照 Anthropic 對 2026 年 8 月實際使用數據的測算, Fable 5.1 運行典型任務的整體費用比 Fable 5 低約 25%;對於上下文較長、工具調用頻繁的複雜 Agent 任務,成本降幅最高可達到約 45%。 剛剛,Claude 5.1 發布!全球最強模型來了

快取讀取價格下調後, Fable 5.1 典型任務成本降低約 25%,高 Agent 化任務成本最高降低約 45%。

Fable 5.1 現已登陸 Claude . ai 、 Claude Code 和 Claude API ,同時通過 AWS 、 Google Cloud 與 Microsoft Azure 提供。開發者可以通過 claude - fable -5-1 調用新模型。

防蒸餾機制再加強

Fable 5.1 和 Mythos 5.1 實際上使用了同一個底層模型,二者的主要區別在於安全限制。

Fable 5.1 面向普通用戶和企業全面開放; Mythos 5.1 則擁有更寬鬆的網絡安全和生命科學限制,目前只提供給經過審核的個人與機構。

在網絡安全領域, Fable 5.1 已經可以幫助用戶發現軟件漏洞,但仍不能直接生成漏洞利用程序。滲透測試、漏洞利用生成和基於二進制文件的漏洞掃描等雙重用途任務,依然可能被轉交給限制更嚴格的模型處理。

經過調整後,新版網絡安全防護機制的誤攔截次數較 Fable 5 減少約 60%。生物安全機制對基礎生物學和醫療問題的誤攔截率也降低了 85%,涉及生命科學研發的高級能力則主要通過 Mythos 5.1 的審核計劃開放。

Anthropic 還推出了 Enterprise Frontier Safeguards 。企業可以將數據保存在自己控制的雲基礎設施中,由企業負責默認的人工審查,從而在保留安全監測能力的同時,實現接近「零數據保留」的隱私效果。這套機制計劃從今年秋季開始分階段上線。

針對大規模模型蒸餾, Fable 5.1 也加入了新的限制。當天以後創建的 API 賬戶,將無法在保留 Claude 歷史思考記錄的同時,手動修改多輪對話中的先前上下文。 Anthropic 表示,這項改動主要用於阻斷一種已經公開的能力提取方法。

此外,為滿足歐盟《人工智能法案》的要求, Fable 5.1 的文本輸出將包含不可見水印。 Anthropic 同時開始小範圍測試檢測 API ,首批面向監管機構、媒體、事實核查組織和研究機構開放。

最後,網友說得對,早起的鳥兒早用到 5.1。 剛剛,Claude 5.1 發布!全球最強模型來了

欢迎加入 ChainCatcher 官方社群
Telegram 订阅: @chaincatcher
X (Twitter): @ChainCatcher_
warnning 風險提示
app_icon
ChainCatcher 與創新者共建Web3世界