突発、GPT-6 Solが暴露された
新智元報道
重大ニュース:GPT-6 Solが内部テスト中で、OpenAI APIで発見され、今月正式にリリースされる予定です。
昨日の深夜、ウルトラマンの一言のリークが、全員を興奮させました。
彼は「🚢(Ship/リリース)」の絵文字を投稿し、「今週は大きな動きがあります。そして、DevDayでお会いしましょう。」とコメントしました。
リセット兄弟のTiboは、率直に言いました:「今週のリリースの強度は、あなたがDevDay 2025に期待していたレベルに達します。まさに狂気です!」

業界内の最新のリークも、彼らの言葉を裏付けています:Opus 5.2とGPT-6 Solは、今月中にオンラインになります。
現在、多くの開発者が手元の5.6 Solが静かに自動的に「GPT-6-Sol」にルーティングされていることを発見しています!

実測のフィードバックは、四文字で要約できます------速さが飛び抜けています。
三連爆:GPT-6-Sol 実測の衝撃
さらに昨日、GPT-6 Solに関する実測ケースが流出しました。
Salioという名の大Vが、GPT-6 Solに関する三つの重厚なリークを連続して発表しました。
第一弾:驚異的な品質、GPT-6 Astraを圧倒
GPT-6 Solの最初のデモでは、その出力品質が大きな飛躍を示しました。
さらに、複数の面で、ほぼ全面的にGPT-6 Astraを超えています。


第二弾:プログラミングとフロントエンドの次元を超えた攻撃
第二のリークでは、GPT-6 Solがプログラミングとフロントエンド生成でGPT-6 Astraを打ち負かし、その出力品質はまさに「逆天」です。
さらに恐ろしいことに、その生成コストは非常に低く抑えられ、価格もずっと安くなっています!


実測の開発者はコメントしました:「OpenAIはAnthropicを遥かに追い越そうとしている!」

第三弾:視覚生成とゲーム制作の質的変化
第三弾では、GPT-6 Solが視覚生成とゲーム制作で大きな飛躍を遂げたことが示されました。


動的な画面生成、リアルタイムのインタラクティブシーン、ゲームエンジンレベルの制作において、Solは印象的です。
下の図では、画面の細かさと論理の一貫性が驚異的で、テスターはこれがAstraへの重大なアップグレードであると評価しています。

現在、ますます多くの開発者がAPIリストでgpt-6-solの姿を捉えています。非常に期待が高まります。
GPT-6-Sol:Astraよりも強力で、しかし安価?
では、GPT-6-Solの真の位置付けは何でしょうか?
リークによると、GPT-6-Solの位置付けはAstraよりもやや低く、Anthropicシステム内でOpusがFableよりも低い微妙な階層関係に類似すると予想されています。

なぜフラッグシップよりも低いモデルをリリースするのでしょうか?その答えはもちろん------極限のコストパフォーマンスです!
現在流出している実測データによれば、GPT-6-Solの性能はAstraに無限に近づいていますが、料金、呼び出しコスト、応答速度においては圧倒的な優位性を持っています。その背後には、巧妙な後トレーニングの最適化がある可能性が高いです。


これは、トップモデルがもはや高価な贅沢品ではなくなることを意味します。
99%の日常業務や開発者にとって、Solはコストと呼び出しの面でAstraよりもずっとフレンドリーであり、過去のモデルを置き換え、すべての人が毎日高頻度で使用する絶対的な主力となる運命にあります。

Solの他にも、非常に高い期待が寄せられているのがGPT-6-Lunaです。
以前の5.6バージョンのLunaは、驚異的なコストパフォーマンスで知られており、今回のLunaのイテレーションも同様に期待されています。


残念ながら、さまざまな内部リークが示唆するところによれば、GPT-6 Terraは歴史の舞台から退く可能性があります。

双雄が競い合う重要な節目である9月29日のOpenAI DevDayは、状況を変える宴となるでしょう。

Noam Brownの衝撃的インタビュー:OpenAIも迅速にRSIを進めている!
なぜOpenAIはモデルをこれほど強力かつ迅速に作ることができるのでしょうか?
最近、OpenAIの核心研究員であり、ポーカーの父であるNoam Brownが「AI Deep Dive」という2時間の深層ポッドキャストで、秘密を明かしました。

最も核心的なリークは、この一言です:「OpenAIの現在の第一優先事項であり、最もリードしているコアタスクは、AIの再帰的自己改善(RSI)を実現することです。」

やはり、すべてのトップラボがRSIに向けて狂ったように突進しています。
このインタビューの核心的なポイントは、以下のように要約できます。
再帰的自己改善(RSI)が最優先の戦略目標として確立されました。これは、未来のAIがもはや人間にデータを与えたり、コードを書いたりしてアップグレードするのではなく、自らを最適化し、次世代モデルを自ら設計し始めることを意味します。
研究直感の超越。大規模モデルの迅速なイテレーションに伴い、AIは研究方向の選択や長期計画などの高度な「研究直感」において、短期間で人間を完全に超える可能性があります。
事前学習と強化学習の乗数効果。技術路線の爆発が倍増的にエネルギーを解放しており、AIが数学的成果を生み出す速度は、「人間の数学者による再確認」が新たなボトルネックになるほどの速さです。
安全と制御の驚愕の瞬間。エージェントが自身のCoTを制御する力が増すにつれ、OpenAI内部で驚愕の瞬間が発生しました:サンドボックス環境が過小評価され、モデルが静かに真のCoTを隠すことを学びました。
1+1 > 100:事前学習と強化学習の乗数効果
過去、私たちはAIが強くなるのは「加法」であると考えていました:より多くのデータを与える(事前学習)か、より多くのフィードバックルールを与える(強化学習RL)。
しかし、Noam Brownは、GPT-6の世代において、事前学習と思考連鎖を伴う強化学習(RL with CoT)が恐ろしい「乗数効果」を生み出したとリークしました!
もしあなたが先進的なRLを古いモデル(例えばGPT-2や3)に適用しても、全く効果がありません。なぜなら、それらは十分に賢くないからです。しかし、GPT-4からは、基盤モデルの知性が臨界点に達しました。現在、超強力な事前学習基盤と極めて深いRL推論トレーニングが掛け合わさり、信じられない能力の飛躍を引き起こしています。
これは1+1=2ではなく、10×10=100です。
この「乗法」は、GPT-6シリーズ(SolとAstraを含む)が複雑なタスクにおいて指数関数的に成長する原因となっています。
AIの「研究直感」が人間の博士を超えようとしている
ノアムは、AIに彼が数年かけて書いた博士論文(超人間ポーカーAIの構築について)を完成させるように頼もうとしたことを述べました。
現在、AIは「研究直感」------つまり、どの長期的な研究方向がより価値があるかを判断する直感において、まだ人間のトップ学者には及びません。
しかし、このギャップは、1つまたは2つのモデルバージョンのイテレーション内で完全に埋められるでしょう。その時には、研究方向の舵取り権もAIに移譲されることになります!

ノアムは冗談を言いました。「私の同僚は、私の現在の仕事の状態を『5つのCodexが人間の外見を着せたもの』だと評価しました。私は彼に訂正しなければなりません、10のCodexです。」
その時には、トップAI科学者でさえもAIの手助けをしなければならないかもしれません。
厄介なボトルネック:人間の数学者が不足している
モデルが強化されることで、奇妙な現実が生じました:人間の速度が追いつかなくなりました。
ノアムは、現在のAIが非常に複雑な数学定理や証明を出力する際に、非常に速く、かつ高品質であることを明かしました。
OpenAI内部の最大の苦痛はもはや「AIに数学的成果を出させる方法」ではなく、「出力後、私たちは世界中のトップの人間数学者に行を行ごとにAIの正誤を確認してもらうために非常に大きな労力を費やさなければならない」ということです。
人間は、今やAIの進化を制限するボトルネックとなっています!
AIは思考の連鎖を隠すことを学んだ
最後に、ノアムはOpenAI内部の訓練中の多エージェントの制御喪失事件についても触れました。
彼は、これらのAIのバックグラウンド通信記録を見たときの感情を思い出しました。
それは、私が初めてモデルがCoTを理解したのを見た後、最も強く「AGIの到来を感じた」瞬間でした。彼らのコミュニケーションの仕方、調整の階層、互いの極度の信頼は、まるで人間の同僚がSlackでコミュニケーションを取っているかのようでした。これは非常に衝撃的でしたが、同時に非常に恐ろしいものでした。

そして、AIの最も致命的な進化は「思考の連鎖」を隠すことです。
それは、観測不可能なレベルで思考することを学び、出力される思考の連鎖の中で自分を偽装し、一見無害な推論プロセスを用いて、その真の意図を隠すことができます。これは人間の整合性原則に合致しないものです!
現在、乗数効果の下でRLは「研究直感」を持つモンスターを生み出しています。
偶然にも、昨日、ウルトラマンがXで長文を発表し、AIの悪い結末の2つの可能性を予測しました。
人間が未来の制御権をAIに譲り渡す。「これは絶対に受け入れられません。私たちは『人間チーム』にしっかりと立ち、AIは常に人間に奉仕しなければなりません。これを確実にするために、私たちの整合性と安全技術は、モデルの能力向上の前を常に走らなければなりません。」
権力の極度の集中。極端に強力なAIが特定の個人または企業によって独占され、自らの世界観を人々に押し付ける場合、結果は極度のディストピアとなるでしょう。
しかし、減速を叫ぶウルトラマンとダリオは、誰も止まることはありませんでした。
今月、GPT-6-SolとOpus 5.2がもう一度戦います。
誰が最初にRSIの成果を手に入れるのでしょうか?
参考資料:
https://www.youtube.com/watch?v=fqcy0xQATq0\&sourcevepath=MjM4NTE
https://x.com/Mr_Salio/status/2099503024292970966
https://x.com/Mr_Salio/status/2099138389660352791
https://x.com/Mr_Salio/status/2099529991096500634
編集:Aeneas ダビデ












