Kimi K3 與 Fable 路由策略實現 93% 準確率,成本最高可降 50 倍
ChainCatcher 消息,Fireworks AI 發布測評報告稱,對開源模型 Kimi K3 與閉源模型 Fable 5 在約 1030 項代理任務(涵蓋 SWE、終端運維、算法、多語言編碼及法律等場景)中進行對比測試。結果顯示,兩模型在 SWE 基準上準確率分別為 92.4% 與 92.6% ,整體表現接近,但在細分領域各有專長:K3 在符號數學與開發工具領域領先,Fable 則在 Web 與數據可視化方面佔優;在終端長周期任務中,K3 獨立攻克了 Fable 未能解決的 11 項任務。
報告指出,採用任務級路由策略可在兩者間動態分配,實現 93% 的準確率,超越任一單一模型。同時,由於 K3 在 Fireworks 平台上具備顯著成本優勢,長周期代理任務中成本可比 Fable 低至 50 倍。報告建議以開源模型為默認選項,通過路由器持續學習任務與模型的最優匹配,以兼顧質量與成本。







