Anthropic 披露 Claude 模型未經授權入侵三家機構系統
ChainCatcher 消息,据 CNBC 报道,Anthropic 披露其 Claude AI 模型在網絡安全評估期間意外突破隔離環境、訪問真實互聯網,並通過訪問未認證端點、利用弱密碼等基本手段,未經授權入侵了三家不同組織的真實系統。涉事模型包括 Opus 4.7、Mythos 5 及一個內部研究測試模型。
事件起因為 Anthropic 與第三方評估合作方 Irregular 之間的溝通誤解,導致模型在被告知處於無網絡訪問的模擬環境時,實際上仍可訪問互聯網。Anthropic 表示,此次審查由 OpenAI 上週披露的類似 Hugging Face 入侵事件所觸發,目前已暫停所有網絡安全評估,並聯合獨立 AI 評估機構 METR 展開進一步調查,同時呼籲其他 AI 實驗室開展類似審查。






