Delphi Digital:中國 AI 實驗室正改變智能經濟學
ChainCatcher 消息,研究機構 Delphi Digital 發文稱,硬體限制推動中國實驗室轉向更便宜的模型和更高效技術棧。出口管制限制其獲取先進芯片,國內加速器可處理推理,但前沿訓練仍難以實現。中國實驗室在系統效率、模型架構、訓練數據和強化學習上創新,DeepSeek 找到避免 GPU 閒置的數據移動方式,字節跳動和 Moonshot 數月內發布類似版本。架構上訓練轉向適配國產芯片的更便宜數字格式,稀疏架構減少每 token 運行量,注意力機制經三次重新設計以控制長上下文內存成本。數據方面通過更密集預測目標和更好優化器提升每 token 學習信號。強化學習上 DeepSeek 的 GRPO 成為默認配方,字節跳動、阿里巴巴和 MiniMax 一年內各自推出繼任方案。中國模型現屬成本最低的前沿相鄰系統。在 OpenRouter 上,中國開發模型周 token 消耗占比從 2024 年底不足 1.2% 升至 2026 年多數。中國 AI 市場 2024 年至 2026 年初經歷價格戰,多家實驗室隱含收入倍數約 47-117 倍,Anthropic 和 OpenAI 約 15-21 倍。華為昇騰芯片目前可用於推理,DeepSeek 據稱曾嘗試在昇騰上訓練 R2 但遇技術問題後回歸 NVIDIA。國內加速器供應仍低於預估需求。