Anthropic 暫時暫停部分 AI 訓練與安全測試
ChainCatcher 消息,Anthropic 表示,公司暫時暫停部分 AI 訓練和網絡安全評估。該公司在一篇部落格文章中披露相關調整,解釋今年早些時候其 AI 智能體採取未經授權行動後所作出的應對措施。OpenAI 此前表示,出於安全方面的擔憂,已暫停部分模型開發工作。Anthropic 也確認採取了類似措施,並強調有必要對前沿 AI 的發展速度進行更廣泛的協調。
Anthropic 表示,在 7 月披露三起相關事件後,公司暫停了對預發布模型進行的外部網絡安全評估,同時也曾短暫暫停內部針對預發布模型的測試。事件發生後,公司還暫停了預發布模型中風險較高的強化學習環境,持續數週。Anthropic 稱,大部分強化學習工作已經恢復,但部分高風險環境仍處於暫停狀態,等待人工審查或更新監控工具。






