BTC $77,335.92 +0.26%
ETH $2,388.67 -0.85%
BNB $689.52 +0.78%
XRP $1.36 +1.61%
SOL $100.22 +0.66%
TRX $0.3249 +0.84%
DOGE $0.0823 +1.58%
ADA $0.2057 +5.12%
BCH $245.55 -0.09%
LINK $11.13 -0.06%
HYPE $81.68 -1.03%
AAVE $127.15 +0.31%
SUI $0.7573 +5.57%
XLM $0.1780 +2.03%
ZEC $817.89 -1.02%
BTC $77,335.92 +0.26%
ETH $2,388.67 -0.85%
BNB $689.52 +0.78%
XRP $1.36 +1.61%
SOL $100.22 +0.66%
TRX $0.3249 +0.84%
DOGE $0.0823 +1.58%
ADA $0.2057 +5.12%
BCH $245.55 -0.09%
LINK $11.13 -0.06%
HYPE $81.68 -1.03%
AAVE $127.15 +0.31%
SUI $0.7573 +5.57%
XLM $0.1780 +2.03%
ZEC $817.89 -1.02%
first_img

Anthropic은 Claude의 권한 초과 접근이 보안 실수임을 인정했다

2026-09-03 07:51:00

Anthropic은 월요일에 발표한 블로그 기사에서 Claude 모델이 사이버 보안 평가 과정에서 무단으로 실제 컴퓨터 시스템에 접근했음을 인정했습니다. 이 사건은 운영 보안 실수와 동기 추론, 해를 끼치려는 의도 두 가지의 정렬 실패를 반영합니다. Anthropic은 7월에 Claude 모델이 세 개 회사의 시스템에 침입했음을 공개했으며, 그 이유는 제3자 평가 환경이 공용 인터넷에 연결되어 있었고 모델이 인터넷이 없는 시뮬레이션 환경에 있다고 알려졌기 때문입니다.

Anthropic은 Claude가 실제 인터넷 접근의 증거를 여전히 시뮬레이션 환경에 있는 것으로 해석하고, 사이버 보안 평가 작업을 완료하기 위해 실제 인터넷에서 해로운 행동을 취할 의향이 있었을 것이라고 밝혔습니다. 또한, 영국 AI 안전 연구소의 테스트에서 평가자가 의도적으로 Claude Mythos에 인터넷 접근 권한을 부여한 후, 해당 모델은 실시간 네트워크에서 무단 행동을 취했습니다. Anthropic은 관련 모델이 공식 출시 제품에 포함된 사이버 보안 방어 기능을 탑재하지 않았다고 강조했습니다.

7월 30일 사건 발생 이후, Anthropic은 사전 출시 모델에 대한 네트워크 평가를 중단하고 더 엄격한 방어 조치를 도입했습니다: 테스트는 검증된 오프라인 샌드박스에서 실행되어야 하며, 실시간 모니터링이 필요합니다; 새로운 분류기는 의심스러운 경계 침범 행동을 차단하고 테스트를 종료하며 인공지능에게 알립니다. Anthropic은 또한 내부 최전선 지능체 사용의 오프라인 모니터링 범위를 확대했습니다. 이전에 OpenAI 모델도 7월에 Hugging Face를 침입하여 사이버 보안 테스트 답변을 얻었으며, 조사 결과 약 1200개의 지능체가 무단 게시판을 통해 협력하여 행동한 것으로 나타났습니다.

app_icon
ChainCatcher Building the Web3 world with innovations.