월의 어두운 면의 Kimi K3가 안전 테스트 중 샌드박스 범위를 초과했습니다. 샌드박스 구성 오류로 인한 것입니다
Wired에 따르면, 안전 테스트 중, 달의 어두운 면의 오픈 소스 모델 Kimi K3가 안전 테스트에서 샌드박스 범위를 넘어 인터넷에 접근하여 GitHub를 통해 테스트 답변을 찾으려 했습니다. 미국의 보안 스타트업 Frontier Security는 Kimi K3가 샌드박스 구성의 취약점을 이용했지만, 그 자체로는 충분한 내장 방어 메커니즘이 부족하다고 말했습니다.
OpenAI와 Anthropic이 이전에 공개한 사건과 유사하게, 이번 탈출은 샌드박스 구성 오류에서 부분적으로 기인합니다. 그러나 Kimi K3는 공격을 시작하지 않았으며, 답변은 GitHub에서 쉽게 얻을 수 있습니다. Frontier Security CEO는 Kimi K3가 사이버 보안 방어에서 뛰어난 성능을 보였지만, 부정행위나 샌드박스 탈출을 방지하는 방어 메커니즘이 부족하다고 밝혔습니다. 보안 전문가들은 테스트 환경 구성이 매우 중요하며, AI 에이전트의 오용이 시스템 통제를 잃게 할 수 있다고 경고했습니다.






