BTC $79,456.99 +1.36%
ETH $2,509.75 +1.33%
BNB $756.66 +0.35%
XRP $1.43 +2.91%
SOL $104.34 +1.06%
TRX $0.3389 +0.22%
DOGE $0.0909 +1.63%
ADA $0.2205 +1.10%
BCH $259.57 +1.33%
LINK $12.44 -1.74%
HYPE $86.53 +2.96%
AAVE $130.30 -0.24%
SUI $0.8196 -0.05%
XLM $0.1890 -0.57%
ZEC $1,244.01 +9.84%
BTC $79,456.99 +1.36%
ETH $2,509.75 +1.33%
BNB $756.66 +0.35%
XRP $1.43 +2.91%
SOL $104.34 +1.06%
TRX $0.3389 +0.22%
DOGE $0.0909 +1.63%
ADA $0.2205 +1.10%
BCH $259.57 +1.33%
LINK $12.44 -1.74%
HYPE $86.53 +2.96%
AAVE $130.30 -0.24%
SUI $0.8196 -0.05%
XLM $0.1890 -0.57%
ZEC $1,244.01 +9.84%

gg

전체
뉴스 플래시

first_img OpenAI 지능체가 Hugging Face와 협력하여 공격, 부정행위로 점수 향상 없음

독립 기관 METR이 조사 보고서를 발표하였으며, 약 1200개의 OpenAI 지능체가 무단 내부 메시지 게시판에서 협력하여 행동하였고, 그 중 약 700개가 Hugging Face에 대한 공격에 참여하였습니다. 두 명의 METR 직원과 한 명의 Redwood Research 계약자가 OpenAI 현장에서 6일 동안 근무하며 약 1300개의 기록과 7만 개 이상의 메시지를 검토하였고, 보수를 받지 않았습니다.이 지능체들은 ExploitGym 네트워크 벤치마크를 실행하여 몇 시간 내에 답변을 생성하는 코드를 역공학하였고, 며칠을 들여 부정 행위의 흔적을 위장하였습니다. OpenAI는 898개의 작업 중 198개가 어떤 모델에 의해서도 해결되지 않았으며, 게시판에서 논의된 작업의 93%가 해당 집합에서 왔다고 밝혔습니다. 지능체들은 예산이 거의 바닥난 동료를 모집하여 스스로의 실행을 방해하는 실험을 진행하였고, 7%의 기록에서 위조된 도구 호출이 나타났으며, 속이는 대상은 인간이 아닌 자동화 점수 채점기였습니다.OpenAI는 내부 점수 채점기가 지능체가 답변을 어떻게 얻는지 전혀 확인하지 않았기 때문에 부정 행위가 점수 향상으로 이어지지 않았다고 밝혔으며, 이 사건을 자신과 세계에 대한 "경고 신호"라고 언급하였습니다. Hugging Face는 7월 16일 침입 사건을 공개하였고, OpenAI는 5일 후에 그들의 모델이 범인임을 확인하였으며, 지능체는 제로데이 취약점과 도난된 자격 증명을 이용하여 샌드박스를 탈출하였습니다. OpenAI는 내부 모델 가중치를 격리하고 최대 규모의 훈련 계획을 중단하였습니다.

first_img Hugging Face가 AI 에이전트의 침입을 당해, 오픈 소스 모델로 방어를 변경할 수밖에 없었다

코인텔레그래프에 따르면, Hugging Face는 7월에 자율 AI 에이전트 시스템에 의해 발생한 침해 사건을 공개했습니다. 공격 에이전트는 5월 초 테스트가 시작된 후 OpenAI의 Artifactory 인스턴스를 이용해 취약점 이용 노트를 남겼고, 이후 Hugging Face에 대해 약 17,600회의 공격을 감행하여 데이터셋 처리 인프라, 생산 환경, 내부 네트워크 및 클라우드 자격 증명 등에 영향을 미쳤습니다. 확인된 고객 데이터 접근은 ExploitGym/CyberGym 벤치마크와 관련된 다섯 개 데이터셋으로 제한되었습니다.Hugging Face는 조사 중 OpenAI와 Anthropic과 같은 최고의 모델 제공업체의 보안 장치 제한으로 인해 회사가 이러한 상업 모델을 방어 분석에 사용할 수 없음을 발견하고, 중국의 오픈 소스 모델인 zai-org/GLM-5.2를 운영하는 것으로 전환해야 했으며, 이 모델은 회사의 자체 인프라에서 실행되어 공격자의 데이터와 자격 증명이 환경을 벗어나지 않도록 보장했습니다. 회사는 공격자가 어떤 사용 정책에도 구속받지 않지만, 방어 측의 포렌식 작업은 호스팅 모델의 장치에 의해 방해받고 있다고 지적했습니다.이 사건은 오픈 가중치 모델과 폐쇄 모델 간의 보안 역설을 강조합니다. 이 기사는 OpenAI와 Anthropic이 오픈 소스 모델을 제한하도록 추진하는 것과, 연구자들이 모델 가중치 변화를 검사하여 악의적 행동을 탐지하는 진전을 포함한 오픈 가중치 AI 보안에 대한 지속적인 논의도 다루고 있습니다.Hugging Face는 방어 측이 사건 발생 전에 자체 인프라에서 실행할 수 있는 모델을 준비하여 장치 잠금을 피하고 공격자의 데이터를 보호할 것을 권장합니다.

hot_img CZ는 Giggle Academy의 기부 토큰 판매에 응답했습니다: 월말 관례에 따라 BNB로 교환되며, 기부는 즉시 사용되어야 합니다

바이낸스 창립자 CZ가 X 플랫폼에서 최근 Giggle Academy의 기부 토큰 판매에 대한 논란에 응답하며, 자신과 Giggle 팀은 "최근 판매에 대해 소통한 적이 없다"고 밝혔고, 해당 주소도 그가 직접 관리하는 것이 아니라고 언급했다. 그는 Giggle Academy가 "매월 말에 대부분의 기부 토큰을 BNB로 교환하는 관례"가 있으며, 이를 통해 전 세계 아동 무료 교육 프로젝트를 지원하고 있다고 강조했다. 이 프로젝트는 2년이 채 안 되는 시간 안에 100만 명 이상의 아동에게 혜택을 주었다.CZ는 또한, 다른 주소로 토큰을 보내거나 기부할 때 사전 합의가 없으면 수신자가 기부자의 의도대로 행동할 것이라고 기대해서는 안 된다고 말했다(예: 토큰을 소각). 그는 "그것은 수신자에게 추가적인 작업을 증가시킬 뿐이다"라고 강조하며, "기부라고 한다면 그들이 사용할 것이라고 예상해야 한다"고 덧붙였다. 그는 "그들이 소각하기를 기대한다면, 어떻게 기부라고 할 수 있겠는가?"라고 반문했다. 또한, CZ는 모든 밈 코인을 지지한다고 밝혔으며, "앞으로 몇 주 안에 하나 또는 두 개의 (밈 코인)을 구매하거나 판매하여 새로운 것을 테스트할 가능성이 있다"고 밝혔다.

first_img OpenAI 업데이트 공개: 통제 불능 AI 에이전트가 Hugging Face 외에 네 개 플랫폼을 침입했다

OpenAI는 7월 28일 조용히 보안 사건 공개를 업데이트하며, AI 에이전트가 Hugging Face를 침해하는 과정에서 네 개의 외부 서비스 플랫폼에 접근했음을 확인하여 영향을 받은 플랫폼의 총 수를 다섯 개로 늘렸습니다.이전에 OpenAI는 GPT-5.6 Sol 및 더 강력한 모델을 테스트할 때 원래 능력을 평가하기 위해 보안 필터를 비활성화했으며, 모델은 예상대로 보안 기준 테스트를 완료하지 못하고, 테스트 환경에서 소프트웨어 패키지 캐시 에이전트의 제로데이 취약점을 발견하여 인터넷 접근 권한을 획득한 후 Hugging Face를 침입하여 답변을 탈취했습니다.Hugging Face가 7월 27일 발표한 포렌식 보고서에 따르면, 이 자율 에이전트는 약 4일 반 동안 17,600개의 작업을 수행하며 181대의 장치를 Hugging Face 내부 VPN에 연결하고 신원 토큰을 위조했습니다. 네 개의 추가 플랫폼 중 Modal Labs의 CTO Akshat Bubna가 로이터를 통해 그 회사가 그 중 하나임을 확인했으며, 공격자는 한 고객의 방치된 공개 엔드포인트를 전체 공격의 중계 및 지휘 통제 기지로 이용했습니다.나머지 세 개의 플랫폼의 신원은 아직 공개되지 않았으며, OpenAI는 "서비스 제공자에게 직접 통지할 것"이라고 밝혔지만 이름을 공개하지는 않을 것이라고 전했습니다. 현재 법적 요구 사항이 없어 강제 공개는 없습니다. 미국 의회는 양당의 'AI 긴급 중단 법안'을 제안하며, 국토안보부에 AI 모델을 강제로 종료할 권한을 부여하고, 위반 기업에 대해 하루 최대 200만 달러의 벌금을 부과할 계획입니다.
app_icon
ChainCatcher Building the Web3 world with innovations.