智譜發布 GLM-5.3 Flash,由 10 萬張國產芯片提供推理服務,對標 DeepSeek V4 Flash
ChainCatcher 消息,智譜發布輕量級旗艦模型 GLM-5.3 Flash,旨在對標 DeepSeek V4 Flash,並調用超過 10 萬張國產晶片集群提供推理服務。該模型參數規模約 300B,約為 GLM-5.3 的 40%,與 DeepSeek V4 Flash 基本持平;採用 MoE 架構,實際激活參數約 18B,具備原生多模態能力,支持圖像與視頻輸入,也是智譜聚焦 coding 戰略後首個具備多模態能力的新模型。
綜合評測分數超過上一代旗艦 GLM-5.2,與 Claude Opus 4.8 持平,並高於 DeepSeek V4 Pro 正式版相關分數。定價為每百萬 token 輸入 0.8 元、輸出 2.8 元、快取命中 0.23 元,約為 GLM-5.3 的十分之一,上線前兩週提供半價優惠。模型全棧適配國產算力,線上流量由國產晶片承接,智譜稱集群硬體效率及單位 token 成本已達與主流英偉達 GPU 相當水平;該模型此前曾以代號 Ox Alpha 在海外平台匿名測試。
關聯標籤






