Hugging Face 遭 AI 代理入侵,被迫改用開源模型防禦
ChainCatcher 消息,据 Cointelegraph 報導,Hugging Face 披露其於 7 月遭遇由自主 AI 代理系統驅動的入侵事件。攻擊代理在 5 月初測試開始後,利用 OpenAI 的 Artifactory 實例留下漏洞利用筆記,隨後對 Hugging Face 發起約 17,600 次攻擊,影響其數據集處理基礎設施、製作環境、內部網絡及雲憑證等。確認的客戶數據訪問僅限於與 ExploitGym/CyberGym 基準相關的五個數據集。
Hugging Face 在調查中發現,由於 OpenAI 和 Anthropic 等頂級模型提供商的安全護欄限制,公司無法使用這些商業模型進行防禦分析,被迫轉向運行在中國開源模型 zai-org/GLM-5.2 上,且該模型運行在公司自有基礎設施上,確保攻擊者數據和憑證不離開其環境。公司指出,攻擊者不受任何使用政策約束,而防禦方的取證工作卻被托管模型的護欄所阻礙。
這一事件凸顯了開放權重模型與封閉模型之間的安全悖論。文章還討論了關於開放權重 AI 安全性的持續爭論,包括 OpenAI 和 Anthropic 推動限制開源模型,以及研究人員透過檢查模型權重變化來檢測惡意行為的進展。
Hugging Face 建議防禦方在事件發生前準備好可在自有基礎設施上運行的模型,以避免護欄鎖定並保護攻擊者數據。
關聯標籤






