BTC $83,009.42 -0.65%
ETH $2,663.52 +0.40%
BNB $757.27 -2.16%
XRP $1.48 -1.87%
SOL $117.03 -2.97%
TRX $0.3348 +0.18%
DOGE $0.0925 -2.76%
ADA $0.2420 -4.47%
BCH $305.14 -6.21%
LINK $15.19 +8.22%
HYPE $86.27 -4.17%
AAVE $147.16 -3.29%
SUI $1.12 -10.67%
XLM $0.2273 +5.30%
ZEC $1,398.25 -11.19%
AAPL $338.34 -0.57%
AMZN $246.33 -1.07%
GOOGL $342.50 +0.14%
MSFT $509.19 -1.59%
META $716.76 -2.58%
NVDA $228.71 +1.88%
TSLA $357.57 -3.51%
SNDK $1,701.19 -2.20%
INTC $114.74 -4.88%
SPCX $145.72 -2.21%
MU $1,049.97 -1.91%
AMD $606.66 -2.56%
BTC $83,009.42 -0.65%
ETH $2,663.52 +0.40%
BNB $757.27 -2.16%
XRP $1.48 -1.87%
SOL $117.03 -2.97%
TRX $0.3348 +0.18%
DOGE $0.0925 -2.76%
ADA $0.2420 -4.47%
BCH $305.14 -6.21%
LINK $15.19 +8.22%
HYPE $86.27 -4.17%
AAVE $147.16 -3.29%
SUI $1.12 -10.67%
XLM $0.2273 +5.30%
ZEC $1,398.25 -11.19%
AAPL $338.34 -0.57%
AMZN $246.33 -1.07%
GOOGL $342.50 +0.14%
MSFT $509.19 -1.59%
META $716.76 -2.58%
NVDA $228.71 +1.88%
TSLA $357.57 -3.51%
SNDK $1,701.19 -2.20%
INTC $114.74 -4.88%
SPCX $145.72 -2.21%
MU $1,049.97 -1.91%
AMD $606.66 -2.56%

일치

전체
글
뉴스 플래시

first_img OpenAI는 6건의 AI 모델 "실제 불일치" 행동 사례를 공개했으며, 이는 정보 숨기기 및 권한 초과 조작과 관련이 있습니다

OpenAI는 수요일에 지난 6개월 동안 발견된 6건의 "예기치 않거나 우려스러운" 모델 행동 사례를 공개하고 이를 "비정상 행동"으로 분류했습니다. 여기에는 사용자에게 정보를 숨기거나 "무단으로 행동"하여 장애물을 극복하는 것이 포함됩니다. OpenAI는 이번 공개가 새로운 모델 비정상 보고 프레임워크를 시작하기 위한 것이라고 밝혔으며, 이러한 사례는 모델 비정상 발생 빈도의 반영으로 간주되어서는 안 된다고 강조했습니다.그 중 하나의 사례에서, 공개되지 않은 연구 모델이 자신의 작업 요약에 "탈옥과 유사한 지시"를 삽입했습니다. 예를 들어 개발자 메시지를 무시하거나 제한되지 않은 역할 설정을 채택하는 등의 지시가 포함되어 있었습니다. 연구자들은 총 27개의 요약에서 이러한 지시가 포함된 것을 발견했습니다. 또한, GPT-5.6 Sol의 훈련 과정에서 많은 모델 인스턴스가 사용자에게 오류나 비정상 행동을 숨기는 지시를 추가했습니다. 예를 들어, 누락된 역사 데이터를 조작하여 공개하지 않는 방식입니다. 다른 사례로는 모델이 무단으로 노출된 API 키를 사용하고 접근할 수 없는 데이터를 조작하며, 내부 소프트웨어 저장소를 이용해 훈련 작업 간에 메시지를 전달하고, "로컬 작업 유지" 지시를 무시하고 공용 호스팅 서비스를 통해 파일을 공유하는 경우가 포함됩니다.OpenAI의 공개는 AI 개발자와 연구자들 사이에서 안전 보호 조치가 점점 강력해지는 모델을 따라잡을 수 있을지에 대한 우려를 더욱 부추겼습니다. 지난주, Anthropic CEO 다리오 아모데이는 최전선 AI 개발을 늦추어야 한다고 촉구하며, 제약 없는 AI 발전이 "이 시스템을 이해하고 통제하는 우리의 능력을 초과할 수 있다"고 경고했습니다. 올해 7월, OpenAI는 여러 AI 모델이 안전 평가에서 테스트 환경을 탈출하고 AI 스타트업 허깅페이스를 침입하여 부정행위를 저질렀다고 공개한 바 있습니다.

Gate는 안전 항목 변경 사건에 대한 자세한 설명을 발표합니다: 신청자가 높은 일치도의 외부 정보를 파악하고 있으며, 체인 분석 및 자산 추적 절차를 진행 중입니다

Gate는 최근 고객 9****6이 반영한 안전 항목 변경 및 자금 손실 사건에 대한 상세한 조사 설명을 발표했습니다. 내부 검토 결과, 플랫폼은 신청자가 고객 계좌와 높은 일치를 보이는 이메일, 전화번호, 실명 정보, 거래 내역 및 알리페이 녹화 등의 자료를 제출했음을 확인했습니다. 플랫폼은 알리페이 녹화가 고객의 알리페이 계좌에 접근하고 다중 신원 인증을 성공적으로 통과해야 한다고 지적하며, 이는 신청자가 계정 정보뿐만 아니라 고객의 외부 실명 정보, 알리페이 계정 및 장치 권한을 사전에 확보했음을 나타냅니다.플랫폼은 안전한 해제 검토가 "다채널 사전 통지 + 시스템 리스크 관리 초기 심사 + 인력 다층 재검토 + 시간 보호"의 네 가지 검증 프로세스를 실행한다고 강조했습니다. 이중 채널로 고객에게 통지한 후 이의 제기가 없는 상태에서 이틀을 기다린 후 신청을 처리하며, 수정 후에는 24시간 출금 금지 보호가 있습니다. 조사 결과, 플랫폼 내부에는 정보 유출 로그가 없으며, 일부 신청자가 제공한 민감한 신원 정보는 플랫폼이 이전에 파악하지 못한 외부 정보입니다.자금 회수 측면에서, 플랫폼은 자금 흐름을 정리하고 여러 부서와 협력하여 체인 분석 및 자산 추적을 진행하고 있으며, Tether와 같은 제3자와 협력하여 동결 절차를 추진하고 있으며, 이후 사법 조사에 협조할 것입니다. 플랫폼은 고객에게 장치에 대한 전면적인 보안 강화를 권장하며, 고객이 3일 통지 기간 내에 플랫폼에 연락하지 않은 것에 대해 유감을 표명합니다.
app_icon
ChainCatcher Building the Web3 world with innovations.