OpenAI 首席科學家回應 Astra 爭議,鏈式思維監控仍是研究重點
ChainCatcher 消息,OpenAI 首席科學家 Jakub Pachocki 表示,希望避免因誤導性報導引發模型"不可監控化"的競賽。其稱,包括 Astra 在內的目前前沿模型,其計算圖深度與 GPT-4 相差不超過兩倍。OpenAI 自首批推理模型以來一直致力於保留並利用鏈式思維監控,認為該技術有助於觀察模型對齊能力如何從訓練分佈泛化。
Pachocki 同時指出,鏈式思維監控較為脆弱,且趨勢並不樂觀,但仍可透過研究加以強化,並已成為 OpenAI 當前研究計劃的核心目標。此前,The Information 報導稱,Astra 使用 recurrent depth,讓同一組 Transformer 層反覆計算。部分推理因此可以發生在模型內部,不必全部寫成思維鏈,也引發了模型會不會越來越難監控的擔憂。






