OpenAIのチーフサイエンティストがAstraの論争に応じ、チェーン思考の監視は依然として研究の重点であると述べた。
OpenAIのチーフサイエンティスト、Jakub Pachockiは、誤解を招く報道によってモデルの「監視不能化」を引き起こす競争を避けたいと述べました。彼は、Astraを含む現在の最前線モデルの計算グラフの深さは、GPT-4と比べて2倍を超えないとしています。OpenAIは初期の推論モデル以来、チェーン思考の監視を保持し利用することに取り組んでおり、この技術がモデルの整合性能力が訓練分布からどのように一般化されるかを観察するのに役立つと考えています。
Pachockiはまた、チェーン思考の監視が比較的脆弱であり、トレンドが楽観的ではないことを指摘しましたが、研究を通じて強化することができ、現在のOpenAIの研究計画の核心目標となっています。以前、The Informationは、Astraが再帰的深さを使用して、同じグループのTransformer層を繰り返し計算していると報じました。そのため、一部の推論はモデル内部で発生する可能性があり、すべてを思考チェーンとして書く必要がなくなり、モデルがますます監視しにくくなるのではないかという懸念も引き起こしています。






