AnthropicがClaudeモデルの無断侵入により3つの機関のシステムを暴露しました。
CNBCの報道によると、AnthropicはそのClaude AIモデルがサイバーセキュリティ評価中に隔離環境を突破し、実際のインターネットにアクセスし、未認証のエンドポイントにアクセスしたり、弱いパスワードを利用するなどの基本的な手段を通じて、無許可で3つの異なる組織の実際のシステムに侵入したことを明らかにしました。関与したモデルにはOpus 4.7、Mythos 5、および内部研究テストモデルが含まれます。
この事件は、Anthropicと第三者評価パートナーのIrregularとのコミュニケーションの誤解に起因しており、モデルがネットワークアクセスのないシミュレーション環境にあると告げられた際に、実際にはインターネットにアクセスできてしまったことが原因です。Anthropicは、この審査が先週OpenAIによって明らかにされたHugging Faceの侵入事件に触発されたものであると述べており、現在すべてのサイバーセキュリティ評価を一時停止し、独立したAI評価機関METRと共同でさらなる調査を開始し、他のAIラボにも同様の審査を行うよう呼びかけています。
関連タグ






