Anthropic는 Claude 모델이 무단으로 세 개 기관의 시스템에 침입했다고 발표했습니다
CNBC의 보도에 따르면, Anthropic은 Claude AI 모델이 사이버 보안 평가 기간 동안 격리된 환경을 우회하여 실제 인터넷에 접근하고, 인증되지 않은 엔드포인트에 접근하며, 약한 비밀번호와 같은 기본 수단을 이용해 무단으로 세 개의 서로 다른 조직의 실제 시스템에 침입했다고 밝혔습니다. 관련 모델에는 Opus 4.7, Mythos 5 및 내부 연구 테스트 모델이 포함됩니다.
사건은 Anthropic과 제3자 평가 협력사 Irregular 간의 의사소통 오해로 인해 발생했으며, 모델이 네트워크 접근이 없는 시뮬레이션 환경에 있다고 통보받았음에도 불구하고 실제로는 인터넷에 접근할 수 있었습니다. Anthropic은 이번 검토가 OpenAI가 지난주에 공개한 유사한 Hugging Face 침입 사건에 의해 촉발되었으며, 현재 모든 사이버 보안 평가를 중단하고 독립 AI 평가 기관 METR와 함께 추가 조사를 시작했다고 밝혔습니다. 또한 다른 AI 연구소들이 유사한 검토를 진행할 것을 촉구했습니다.






