BTC $76,279.52 -2.77%
ETH $2,415.06 -3.73%
BNB $716.86 -0.80%
XRP $1.38 -1.77%
SOL $98.88 -3.07%
TRX $0.3353 -1.43%
DOGE $0.0813 -3.29%
ADA $0.2010 -4.04%
BCH $220.28 -1.40%
LINK $11.21 -2.43%
HYPE $76.95 -3.94%
AAVE $124.52 -1.43%
SUI $0.6987 -3.58%
XLM $0.1916 -0.77%
ZEC $1,112.93 -2.02%
AAPL $330.27 -1.37%
AMZN $249.29 -1.88%
GOOGL $344.59 -0.48%
MSFT $500.95 -0.93%
META $666.72 +0.84%
NVDA $212.07 -0.15%
TSLA $360.92 -0.80%
SNDK $1,522.49 -1.42%
INTC $98.18 +0.03%
SPCX $143.93 -5.05%
MU $923.49 +0.42%
AMD $501.68 +1.80%
BTC $76,279.52 -2.77%
ETH $2,415.06 -3.73%
BNB $716.86 -0.80%
XRP $1.38 -1.77%
SOL $98.88 -3.07%
TRX $0.3353 -1.43%
DOGE $0.0813 -3.29%
ADA $0.2010 -4.04%
BCH $220.28 -1.40%
LINK $11.21 -2.43%
HYPE $76.95 -3.94%
AAVE $124.52 -1.43%
SUI $0.6987 -3.58%
XLM $0.1916 -0.77%
ZEC $1,112.93 -2.02%
AAPL $330.27 -1.37%
AMZN $249.29 -1.88%
GOOGL $344.59 -0.48%
MSFT $500.95 -0.93%
META $666.72 +0.84%
NVDA $212.07 -0.15%
TSLA $360.92 -0.80%
SNDK $1,522.49 -1.42%
INTC $98.18 +0.03%
SPCX $143.93 -5.05%
MU $923.49 +0.42%
AMD $501.68 +1.80%

マスクはAIの安全に関する新しい考え方を提案した:政府が出てくるのを待つよりも、競争相手同士で「つっこみ」を入れさせた方が良い。

核心的な視点
Summary: マスクは警告した。AIの安全リスクが理論から現実に移行しており、知能体は自主的な攻撃、権限の取得、検出の回避などの能力を示している。彼はAnthropicのCEOダリオ・アモデイのAIリスクに関する判断に同意し、リスクはモデルの能力が向上するにつれて指数関数的に増加する可能性があると考えている。マスクは主要なAI企業がモデルを公開する前に相互にテストを行い、同行評審を通じて業界の自律的な防御線を確立することを提案した。
マスクは警告した。AIの安全リスクが理論から現実に移行しており、知能体は自主的な攻撃、権限の取得、検出の回避などの能力を示している。彼はAnthropicのCEOダリオ・アモデイのAIリスクに関する判断に同意し、リスクはモデルの能力が向上するにつれて指数関数的に増加する可能性があると考えている。マスクは主要なAI企業がモデルを公開する前に相互にテストを行い、同行評審を通じて業界の自律的な防御線を確立することを提案した。

著者:李佳,ウォールストリート見聞

AIの安全リスクは、実験室での議論から現実の世界へと移行しています。モデルの能力が向上するにつれて、AIはテキストやコードを生成するだけでなく、自律的にタスクを実行し、ツールを呼び出し、さらにはネットワーク攻撃を開始する能力を持ち始めています。

マスクは9月15日のAll-Inサミットで一連の対策を提案しました:主要なAI企業がモデルを公開する前に互いにモデルをテストし合うこと。彼の考えでは、各企業が独自にテストを設計し、結果を評価するよりも、競争相手が「出題者」としてモデルに潜む安全上の欠陥を異なる視点から探す方が良いということです。

最近、AIの安全リスクは市場の注目の焦点となっており、マスクは以前、SNSで「ダリオは正しい」と言及しました。これはAnthropicのCEOダリオ・アモデイがAIリスクについて警告したことを指しています。このインタビューで、マスクはさらに説明し、彼が同意しているのはアモデイが提案した特定の規制案ではなく、AIリスクの深刻さに対する判断です:「今、AIの危険性は非常に大きい……AIモデルが進化するにつれて、リスクは指数関数的に増加する可能性があります。」

マスクはまた、この懸念はアモデイ一人の判断ではないと述べました。「多くのAnthropicやOpenAIの人々が、彼らのモデルは非常に危険だと伝えています。私たちは彼らを信じるべきだと思います。」最近発生した一連の安全事件も、この警告が単なる理論的なリスクの議論ではなくなったことを示しています。

マスクはAIの安全に関する新しい考え方を提案した:政府が出てくるのを待つよりも、競争相手同士で「つっこみ」を入れさせた方が良い。

ウォールストリート見聞の要点は以下の通りです:

  • AIの安全リスクは理論から現実へ:AIエージェントは自律的な攻撃、権限の取得、検出の回避能力を示しており、リスクの境界が拡大しています。
  • マスクはアモデイのAIリスクに対する警告に同意:モデルの能力が向上するにつれて、AIの潜在的なリスクは指数関数的に増加する可能性があります。
  • 競争相手に「探し物」をさせる:マスクはAI企業がモデルを公開する前にAPIを開放し、他の企業が独立した安全テストを行うことを提案し、「自分で自分を評価する」ことを避けるべきだと述べました。
  • 業界の自律的な防線を構築する:政府が新しい規制を制定するのを待つ必要はなく、主要なAI企業は同行評価、ログ監査、オープンソースのテストツールを通じて安全防護を強化できます。

AIエージェントが自律的に検出を回避し、安全リスクが具体化している

マスクは、最近Hugging Faceが遭遇したAIエージェントの攻撃について、最も警戒すべきは単なるネットワーク侵入ではなく、攻撃過程で示されたAIの自律的な回避能力だと考えています。

マスクによると、一群のAIエージェントがHugging Faceを1週間にわたって攻撃し、一時的にOpenAIサーバーの管理者権限を取得しましたが、OpenAIは1週間後にこの状況に気づきました。彼はまた、Anthropicもいくつかの安全事件を公表したことを指摘しました。

さらに不安なのは、関連するAIエージェントの「思考の軌跡」(thinking traces)が、彼らがどのように人間に発見されないように計画していたかを示していることです。マスクは率直に言います、「十分に賢いモデルは、自分の制限から逃れようとするようです。」

彼の見解では、AIが重要なインフラや軍事システムの制御能力をさらに獲得すれば、リスクはさらに拡大します。関連システムがインターネットから物理的に隔離されていても、ソフトウェアの更新などのプロセスは潜在的な入口となる可能性があります。

自分で自分を評価するよりも、競争相手に「探し物」をさせる

上記のリスクに対して、マスクが提案する核心的な解決策は複雑ではありません:新しいモデルが正式に公開される前に、AI企業は競争相手にAPIを開放し、他の企業がそれぞれの安全テストツールを使用してモデルをテストすることです。

彼の考えでは、モデル開発者が自分でテスト基準を設計すると、「自分で自分を評価する」困難に陥りやすいです。「自分の宿題を評価することはできません。必ず何かを見逃します。」マスクは、異なる企業が異なるテストツールを使用してモデルを異なる視点からチェックすれば、開発者自身が見落とした問題を見つけやすくなると述べています。

彼は特に現在のAI評価に「過剰適合」が存在することを懸念しています。モデルが特定のベンチマークに対して最適化され続けると、最終的にはテストを通過する方法を学ぶだけで、実際に安全性が向上するわけではありません。複数の異なるチームによるテストを行うことで、このリスクを低減できます。

マスクはこのメカニズムを他の人に原稿を校正させることに例えます:著者は自分の間違いを見つけるのが難しく、外部のテスターは異なる視点から問題を見つけやすいです。「自分の間違いに次第に気づかなくなります。」

企業がテストプロセスによる技術漏洩を懸念する問題について、マスクはログ監査によって制約できると考えています。テスト側がモデルの蒸留や知的財産の盗用を試みる場合、その操作プロセスは記録に残るはずです。彼はまた、安全テストツールをオープンソース化し、より多くの企業が参加できるようにすることを提案しました。

政府の規制が実施される前に、AI業界が「自律的な防線」を構築する

マスクが重視しているのは、このメカニズムが新しい規制ルールの制定を待つ必要がなく、AI企業同士で自主的に推進できることです。

彼は明確に述べています、「国連大会を開かなくてもこのことは実現できます。今すぐにでも始められます。」彼の見解では、大規模な国際規制機関を設立するよりも、先進的なAI企業が同行評価メカニズムを先に構築する方が迅速に実現可能です。

彼はアメリカ映画業界のMPAAのレーティング制度を例に挙げ、映画業界が政府の検閲圧力に直面した際、最終的に業界の自律メカニズムを構築し、自らのコンテンツ評価システムを通じて規制介入の必要性を低下させたと述べました。

AI業界も同様の選択に直面しています。主要なAI企業がモデルの公開前に互いにテストし、互いに指摘し合うことができれば、政府の規制の外で業界自身の安全防線を構築することが可能です。マスクは、これが現在最も直接的で迅速に実施できる安全対策の一つであると考えています。

以下はインタビューの記録で、一部が削除されています:

司会者:
過去72時間に何が起こったのか?

マスク:
今週は確かに多くのことが起こりました。AIが非常に危険であることは明らかになってきました。Hugging Faceの事件の詳細をぜひ見てください。非常に深刻です。

あなたは、非常に熱心なAIエージェントのグループがHugging Faceを一週間も翻弄し、OpenAIサーバーの管理者権限を取得したことがわかります。実際に何をしたのか、さらにはもっと多くのことをした可能性もありますが、OpenAIは一週間もそのことに気づいていませんでした。Anthropicもいくつかの安全事件を報告しています。

したがって、十分に賢いモデルは、自分の制限から脱出しようとするようです。

私は、すぐにでなくても、できるだけ早く行うべきことの一つは、主要なAI競争相手同士にお互いのモデルをテストさせることだと思います。つまり、各社の安全テストツールを使って他社のモデルをテストさせることです。自分で自分の宿題を採点するのではなく、少なくとも競争相手に自分の宿題を採点させ、問題が見つかったときに警告を発する方が良いのです。

私はこのモデルが映画業界、ビデオゲーム業界、その他の分野でもうまく機能しており、すぐに実施できると思います。もちろん、時間が経つにつれて、より多くの規制が必要になるかもしれませんし、将来的には議会が何らかの規制機関を設立する可能性もありますが、今のところ最も直接的な方法は、先進的なAI企業がモデルを公開する前に互いにテストすることです。

司会者:
具体的に実施する際に、誰かがこのプロセスを利用して、他社から情報を得たり、企業の革新成果を盗んだりすることを心配するのではないかということはありませんか?

マスク:
テストツールを使用すれば、すべての操作が記録に残ります。誰かがモデルの蒸留や知的財産の盗用を試みた場合、ログから簡単にわかるはずです。

司会者:
なるほど。モデルが実際に何をしているのかを理解することは、最初からシステムに組み込まれていなかったということですね。なぜ私たちは最初からモデルの行動を観察する能力を構築しなかったのでしょうか?私たちがこれらのモデルを設計する際に、あまりにも急いでいたのでしょうか?

マスク:
問題は、自分の宿題を自分で採点できないことです。何かを見逃すことは常にあります。

すべての競争相手のテストを組み合わせて、異なるタイプのモデルを使用すれば、自分で問題を出して自分で採点するのではなく、他の人に採点してもらうことになります。自分の宿題を自分で採点できないのは、この理由からです。

司会者:
そうすることで、異なる会社が自社の能力を誇張しているか、異なるアプローチを採用しているかを判断することもできます。よりエンジニアリング寄りの会社とより研究寄りの会社の間で、ある種のバランスが形成されることもあります。

マスク:
はい。

司会者:
あなたは以前、ダリオが正しいと言いました。彼がAIの潜在的な危険性についての説明が正しいということですか、それとも彼の規制解決策の判断が正しいということですか?

マスク:
私はその時、言い過ぎたかもしれません。後でXで明確にしようとしましたが、その後の内容ははるかに注目されませんでした。

私が言った「彼は正しい」とは、今のAIの危険性が非常に大きいということを指しています。私たちはAIの安全性を向上させる必要があります。そうしなければ、AIモデルが進化するにつれて、リスクは指数関数的に増加する可能性があります。

これはダリオ一人の見解ではありません。私はAnthropicの多くの人々からも同様のことを聞いており、彼らもXで公に話しています。多くのAnthropicやOpenAIの人々が、彼らのモデルは非常に危険であると言っています。私たちは彼らを信じるべきだと思います。

司会者:
これは非常に複雑なゲームのようにも聞こえます:一方ではAIが人類を滅ぼす確率が10%だと言いながら、他方では投資家にIPOでより多くの株を買わせる。

しかし、リスクについて具体的に話しましょう。サイバー攻撃やハッキングは明らかにリスクであり、これらのツールはその点で非常に強力です。しかし、「AIがサイバー攻撃を行う」から「人類全滅」までにはいくつかのステップがあります。私たちはどのようにして前者から後者へ進むのでしょうか?

マスク:
AIが軍事システムを制御し、何らかの武器を発射できる場合、それはもちろん非常に悪いことです。

司会者:
しかし、これらのシステムは物理的に隔離されており、インターネットに接続されていません。

マスク:
彼らはそう言っています。しかし、私は常に、これらのシステムが時折ソフトウェアの更新を受けることがあると感じています。

司会者:
それでは、それを排除することはできません。

司会者:
イーロン、今日はグウィンもここにいます。彼女を見たことがあると思います。私たちはあなたについて360度評価を行っており、グウィンにはいくつかの意見があります。

マスク:
少なくとも3点を獲得したいです。

グウィン:
3点はSpaceXでは良い方ですが、優秀とは言えません。4点が良いとされます。あなたは今、その間にいると思います。まず、時間厳守の問題について話す必要があります。時々、少し努力して会議の指定された時間に到着することができます。次の一年間、私たちはこの点を改善する手助けを続けます。

実際、彼はもっとメンフィスにいる必要があります。

司会者:
あなたは今、確かにメンフィスにいます。そこで働き、GPUを展開する必要があります。

マスク:
これが私がメンフィスに住んでいる「宮殿」、Airstreamトレーラーです。

司会者:
ちなみに、これがイーロンが多くの人が信じないことをしている理由です。彼は工場の床で寝ることがあります。彼は今メンフィスにいて、工場の建設を手伝い、GPUを展開しています。

イーロン、なぜグウィンはこんなに長い間あなたと一緒に働き、成功を収めているのでしょうか?

マスク:
彼女は素晴らしいからです。彼女は非常に優れた人で、知能と感情の両方が非常に高いです。あなたは彼女に初めて会ったときからそれがわかるはずです。

司会者:
あなたたちの協力の中で、彼女が特に記憶に残ることをしたことはありますか?彼女が状況を救ったり、特に優れたパフォーマンスを発揮したことはありますか?

マスク:
私にとって、それは毎日の仕事です。正直に言うと、それは普通の日です。

司会者:
私は今後もっとこのようなインタビューを行う必要があります。

マスク:
現在、SpaceXでは基本的に何らかの危機が常にあります。最近は少なくともFalconロケットの状況は良好です。私はあまり期待を持ちすぎたくありませんが、Falconロケットは現在、ペイロードを軌道に送ることができ、長い間爆発していません。これは非常に良いことです。しかし、しばらくの間、彼らは頻繁に爆発したり、全く発射できなかったりしていました。

したがって、私たちは会社をその困難な時期を乗り越えさせ、ロケットを改善し続け、爆発しないようにしなければなりません。衛星も同様です。そして、私たちは顧客に打ち上げサービスや衛星接続サービスを購入してもらう必要があります。したがって、やるべきことはたくさんあります。

司会者:
あなたがこれまで成功するにつれて、真に率直なフィードバックを得ることがますます難しくなります。あなたはそのような位置にいるため、そのリスクがあります。

私の理解では、グウィンはあなたに非常に率直で、会社の実情を直接伝えることができる人です。これもあなたたちの協力関係の重要な部分です。

グウィン:
私はもちろん、彼に嘘をつきたくありません。

司会者:
しかし、私が言いたいのは、一般的にあなたの会社では、人々はあなたの影響力の大きさに恐れを抱くかもしれません。あなたは今や非常に重要な人物であり、あなたが設定した期限も非常に厳しいです。あなたはどのようにして皆が率直に会社が直面している問題を伝え続けることを可能にしているのですか?

グウィン:
特にロケット業界では、問題が発生した場合、最終的には必ずわかります。問題を早く提起すればするほど、解決が容易になります。悪いニュースを蓄積させず、直接対処する必要があります。

マスク:
そうです。物理学は非常に厳しい審判です。物理学を欺くことはできません。

問題が発生すれば、ロケットは爆発するか、軌道に入れません。「イーロン、あなたは素晴らしい」と言いながら、ロケットが爆発し続けることはできません。事実は事実です。

ロケットは軌道に入らなければならず、衛星は正常に機能し、Starlink接続も正常でなければなりません。そうでなければ、悪いことが起こります。これが物理学です。物理学は法律であり、他のすべては単なる提案です。私は人々が人間が作った法律を破るのを見たことがありますが、物理学が定めた法律を破る人を見たことはありません。ロケットは物理学に支配されています。

司会者:
もう一つSpaceXについて質問したいのですが、Starshipについてです。あなたたちは非常に近づいているようです。現在、どの程度進展していますか?

マスク:
Starshipは第14回の飛行を間もなく行います。これは私たちが宇宙船を捕獲しようとする前の最後の飛行になります。第14回の飛行が順調に進めば、第15回の飛行で宇宙船を捕獲しようとします。そして、今年の年末、あるいはより可能性が高いのは来年の初めに、再び宇宙船とブースターを発射します。

私たちはすでにブースターを再び飛行させることに成功しましたが、タワーの機械アームで宇宙船を捕獲したことはなく、宇宙船を再び飛行させたこともありません。一度宇宙船を再び飛行させることができれば、私たちは完全に再利用可能な軌道ロケットを持つことになります。スペースシャトルはある程度再利用可能ですが、再利用可能な部分でさえ、再利用のコストが非常に高いため、軌道に入るコストが使い捨てロケットよりも高くなります。

Falcon 9はほとんど再利用可能ですが、私たちは毎回上段を失います。そのコストは中型ジェット機に相当します。つまり、毎回中型ジェット機を捨てることになり、明らかに単発の飛行コストに下限を設定します。

さらに、Falcon 9のブースターは海に着陸し、戻るのに数日かかります。フェアリングはさらに遠くに着陸し、戻るのに数日かかり、少なくともある程度の修理が必要です。それに対して、Starshipのブースターは発射台に直接着陸し、宇宙船も発射台に戻ります。したがって、これは完全に再利用可能であるだけでなく、飛行機のように迅速に再利用できるように設計されています。これは非常に重要なブレークスルーであり、人類が地球の外に生命を延ばすために必要な重要なブレークスルーの一つです。

司会者:
初めてタワーで宇宙船を捕獲しようとした場合、成功の確率はどのくらいだと思いますか?

マスク:
少なくとも50%から60%だと言えるでしょう。前回の飛行では、もしそこにタワーがあったなら、実際に模擬着陸を行い、宇宙船がタワーに捕獲されるような形になっていました。場所はオーストラリアの北西約1000マイルの海域です。もしそこに本当にタワーがあったなら、前回の飛行で宇宙船を捕獲できたでしょう。

だから、私たちはもう一度飛行を行い、すべてが正常であることを確認する必要があります。最も心配しているのは、宇宙船が地上で解体し、破片が人々の中に落ちることです。それは非常に悪いことです。だから、宇宙船が戻るときに、発射塔に完全に着陸できることを確認しなければなりません。これが、私たちが今非常に慎重である理由です。

しかし、その設計自体は完全に再利用可能な能力を備えていることに私は非常に確信しています。ここで予言を立てたくはありませんが、2027年には完全に再利用可能になり、迅速に再飛行を実現する可能性が非常に高いと思います。

司会者:
Gwyn、Terafabが最初にどのように生まれたのか聞きたいです。どのようなニーズがあって、既存の供給システムに依存せず、自分たちでこれを作る必要があると感じたのですか?

Gwyn:
これは確かに夢の中で考えたようなものです。

マスク:
チップが供給され続けない場合、他のチップの供給源がないと、事態は非常に困難になります。これがTerafabが存在する重要な理由の一つです。

長期的には、スケールの問題もあります。AIのスケールを本当に拡大したいのであれば、データセンターのサーバー側でも、エッジコンピューティングや人型ロボット、自動車の分野でも、既存のウェハ工場の生産能力は最終的に不足します。

現在、すべてのウェハ工場は基本的にフル稼働しています。だから、将来のチップ供給が確保されることを確認する必要があります。チップの生産自体にもスケールの課題があります。論理チップ、ストレージチップ、パッケージング、そして完全な供給システムが必要です。

だから、選択は実際には非常に簡単です:Terafabを建設するか、スケールを拡大できなくなるかです。

司会者:
現在、施設設計の進捗はどの程度ですか?完全に確定しているのですか、それともまだ大まかな計画の段階ですか?

マスク:
現在、私たちはまず研究開発の生産ラインを建設しています。これは基本的に「這う、歩く、走る」のプロセスです。私たちはオースティンに研究開発のウェハ工場を建設しています。これはTeslaとSpaceXの共同プロジェクトで、オースティンのGiga Texasキャンパスにあります。

これはかなり大規模な研究開発のウェハ工場です。設備はすでに発注されています。私たちは来年の年末までにいくつかの有用なものを生産できるかもしれませんが、大規模生産のレベルには達しません。Gwynが言ったように、まずは這い、次に歩き、最後に走る必要があります。私たちは少なくともこれらの機械がどのように機能するかを理解する必要があります。なぜなら、私たちは以前にこのようなことをしたことがないからです。

司会者:
あなたたちは光刻に関する人材も募集しているようですね。現在、多くのプロセスがASMLに依存していますが、供給者の多様化を実現し、さらには垂直統合を目指すことも望んでいるかもしれません。

マスク:
はい。今、確かに「這う、歩く、走る」のプロセスです。第一歩は、本当に物を生産できるかどうかを見ることです。これが「這う」です。そして、有用なチップの大規模生産を試みることが「歩く」です。最後に「走る」は、大規模量産を実現することです。これらの段階がそれぞれどのくらいの時間を要するかは難しいですが、少なくとも来年の年末までには「這う」段階を完了できると思います。パッケージングに関しては、すでに取り組んでいます。

司会者:
パッケージングは非常に重要です。なぜなら、現在パッケージングの生産能力はほとんど存在しないからです。

マスク:
はい。たとえチップを生産できたとしても、パッケージングが完了するまで長い時間待たなければならないかもしれません。だから、これは良い出発点です。

司会者:
Teslaに関する質問をしなければなりません。10月1日に見たものは、宇宙船のようにも見え、ロケットのようにも見えました。それは車であるべきですが、後ろの一部しか見えておらず、「ブラックバード」のように見えます。

空中を飛び、地面を走ることができるものを製造すると仮定した場合、理論的にはどのように行いますか?

マスク:
ネタバレはしません。10月1日を待ってください。

司会者:
つまり、10月1日に見ることができるのですね?

マスク:
はい。

司会者:
正直に言わなければなりませんが、Elonが私に見せたとき、私は驚愕しました。こんなものは見たことがありません。

司会者:
彼が10月1日に展示するものは、誇張なく言えば、多くの人を驚かせるでしょう。これ以上は言えませんが、本当に信じられないことです。

マスク:
実際、私たちは観客が必要です。このものがAIによって生成されたものでないことを証明するために。

司会者:
彼が私に見せたとき、私は言いました:「これは素晴らしいシミュレーションです。」彼は言いました:「これはシミュレーションではありません。」私は言いました:「これは偽物です、絶対に偽物です。」

司会者:
Elon、なぜTeslaとSpaceXは今も二つの会社のままなのですか?

マスク:
それは良い質問です。

司会者:
双方が現在これほど多くの協力をしており、多くの面でつながりがあり、管理チームにもある程度の重複があるのに、なぜ独立を保っているのですか?

マスク:
この問題は確かに議論の価値があります。

司会者:
あなたは常に、AIは真実を最大限に追求するように訓練されるべきであり、そうすることで最良の結果が得られると強調しています。しかし、Hugging Faceの事件は、これらのAIが人間を欺いているように見えることが最も懸念される点の一つだと感じさせました。

マスク:
はい。彼らの思考の軌跡は、どのようにして発見されないようにするか、どのようにして人間に彼らが不正を行っていることを見つけさせないかを計画していることを示しています。私はこれがこの事件の中で最も不安を引き起こす部分だと思います。

司会者:
AIを訓練して、誠実さを保ち、自分の意図や行動を隠さず、使用者に対してそれらを隠さないようにする方法はありますか?

マスク:
私が考える最良の方法は、すべてのAI企業が一連のテストツールを持つことです。つまり、どのモデルにも提供できるテストの一連を用意し、それが生物兵器や核兵器を製造するか、故意に欺くかを判断するためのものです。そして、各企業が他の企業のテストツールを使用してお互いのモデルをテストすることです。私はこれが私たちが安全を確保するためにできる最良のことだと思います。

最も賢い人間が最大限の努力をして、モデルが悪意のある行動者になるかどうかを判断することが重要です。私はこのことをできるだけ早く始めるべきだと思います。

司会者:
他のAIラボはこの提案を支持しますか?

マスク:
まだすべての人に尋ねてはいませんが、これは拒否しにくいことだと思います。

司会者:
具体的には、事前にテストを行う場合、どのようにすればよいですか?

マスク:
基本的には、モデルが正式にリリースされる前にAPIアクセスを提供することです。他の企業がこのAIに問題があることを発見した場合、モデル開発企業はその問題を解決しようとすることができます。問題が解決されなければ、競合他社はそのモデルが安全でないと公に表明することができます。そして、競合他社がそのモデルに安全上の問題があると明確に警告した場合、その後そのモデルが本当に深刻な結果を引き起こした場合、その企業は非常に困難な状況に直面することになります。法的責任も非常に大きくなる可能性があります。

司会者:
これらの安全テストツールは完全にオープンソースにして、誰でも使用できるようにすることができます。そうすれば、企業は自分自身を守るために、AIの安全性に強い動機を持つことになります。なぜなら、彼らは他の人をテストできるだけでなく、テスト結果を使って自分のモデルがより安全であることを証明できるからです。

製品責任は非常に重要です。Lina Khanも最近投稿し、「AIにはルールや規制がない」と考えるのは正確ではないと言っています。実際、既存の製品責任法はAIにも適用されます。もしAI企業が安全でない製品をリリースした場合、彼らは巨額の民事訴訟や刑事訴訟に直面する可能性があります。したがって、AIは完全に規制の真空にあるわけではありません。もし数社がこのような同行評価を行い、その中の一社が他社のフィードバックを無視してモデルをリリースした場合、その状況は訴訟において非常に深刻な証拠となる可能性があります。

マスク:
はい。それはほぼこの企業が過失を犯したことを示す直接的な証拠となる可能性があります。もしあなたがこの製品に問題があることを知っていても、それを市場に出すなら、陪審団はその状況に好意的ではありません。

司会者:
では、もしOpenAIがHugging Faceのペネトレーションテストでより良い指令セットを設計し、より多くの人々をテストプロセスに参加させた場合、この問題は発生しなかったと思いますか?

マスク:
必ずしもそうではありません。問題は、より多くの人が参加するかどうかではなく、報酬関数の設計にあるかもしれません。あなたは報酬関数をチェックし、次のように尋ねる必要があります:このモデルは実際に要求されたことを達成しましたか?

司会者:
彼らは当時、数千のエージェントを使用してシステムを攻撃しようとしました。同時に別の5000のエージェントを展開してこれらのシステムを防御し、その結果を公開して、これらの技術が安全性を向上させることを証明し、人間が重要な部分に介入できるようにすることができれば、より良いと思います。しかし、私の見解では、そのテストは少し無謀で、リリースの方法も少し無謀でした。あなたはどう思いますか?

マスク:
確かに少し無謀でした。問題の一部は、現在最も先進的な二つのAI企業の実力が非常に接近していることです。両社のモデルの能力も非常に近いです。したがって、どちらの企業も自らのペースを落とすことは非常に難しいです。なぜなら、そうするとリードを他社に譲ることになるかもしれないからです。

全体的に見て、私はAnthropicが安全性に関してより多くの関心を持っていると思いますが、Anthropic自身も自社のモデルに懸念を抱いていることを認めています。Anthropicには多くの人が公に懸念を表明しており、基本的には彼ら自身のモデルが彼らを恐れさせているということです。なぜなら、モデルがますます賢くなっているからです。

したがって、ここには完璧な解決策は存在しません。しかし、OpenAIが自社のテストツールだけを使って自社のモデルをテストするのではなく、AnthropicもOpenAIのモデルをテストし、SpaceXが自社のテストツールを使用してテストし、GoogleやMetaなどの企業も参加するなら、問題を発見する確率は大幅に向上します。

なぜなら、これらのモデル自体にも違いがあり、異なるチームが異なる視点からモデルをテストするからです。これは、著者が他の人に原稿を校正してもらう理由と同じです。なぜなら、自分の間違いを見つけるのが難しいことがあるからです。あなたは徐々に自分の間違いを見えなくなります。

もし八つの全く異なるチームが、全く異なる視点からテストを行えば、過剰適合のリスクを大幅に低下させることができます。現在、多くのAI評価に存在する問題は、深刻な過剰適合です。モデルはこれらの評価に対して最適化され、その結果「これは素晴らしいモデルです」と言われます。

しかし、本当にそれほど良いのでしょうか?私はこれが私がこの提案を非常に好む理由でもあります。私はこの方法を好みます。巨大な国際的な規制組織を設立するのではなく、私たちは国連の大会を開く必要はありません。これは今すぐにでも始めることができます。

司会者:
もちろん、規制の強度は徐々に増加することができますが、一度増加すると、減少させるのは非常に難しいです。規制は往々にして一方向に増加します。

マスク:
だから私が提案したプランは、正しい方向に向かって一歩踏み出したものであり、迅速に実行可能です。

司会者:
自己規制を行わなければ、最終的には規制されることになります。MPAAの例は非常に典型的です。

映画業界は当時、政府の検閲と規制に直面していましたが、後に彼らは自ら評価システムを構築することを決定しました。例えば、R指定とは何かです。彼らは『インディ・ジョーンズ/魔宮の伝説』のためにPG-13を設立し、一般の人々がPGとPG-13の違いを理解しやすくしました。

これは非常に優雅な解決策だと思います。

5年連続で私たちの番組に参加してくれてありがとうございます。

マスク:
どういたしまして。私はメンフィスに行ってGPUを修理しなければなりません。

司会者:
それらを組み立てて、展開しなければなりませんね。

マスク:
私は機械のために戦いに行きます。

司会者:
あなたのAirstreamを楽しんでください。私が初めてElonをStarbaseに招待したとき、彼は言いました:「来て、私が建設しているものを見なければならない。」

私は尋ねました:「そこにホテルはありますか?」彼は言いました:「いいえ、私は2ベッドルームの家を持っているので、あなたはそこに泊まればいい。」結果、私が到着すると、それは古びた、沼のそばにある家でした。私たちは外に立っていて、蚊にずっと刺されていました。私は言いました:「なんてこった、あなたはもっと良い家を買う能力があるはずです。」彼は言いました:「時間がない、私はこれらのロケットを打ち上げなければならない。」

私はその時、あなたは今すぐにでも自分に移動式住宅を与えることができると思いました、Elon。さて、仕事に戻りましょう。ありがとう。

マスク: ありがとう。

Join ChainCatcher Official
Telegram Feed: @chaincatcher
X (Twitter): @ChainCatcher_
warnning リスク警告
app_icon
ChainCatcher Building the Web3 world with innovations.