BTC $83,968.47 +1.26%
ETH $2,714.17 +2.67%
BNB $767.70 +0.88%
XRP $1.50 +2.13%
SOL $119.32 +0.92%
TRX $0.3358 +0.78%
DOGE $0.0948 +2.35%
ADA $0.2509 +3.22%
BCH $310.70 +1.23%
LINK $15.16 +10.80%
HYPE $88.25 -0.88%
AAVE $159.61 +8.00%
SUI $1.13 -3.06%
XLM $0.2277 +9.59%
ZEC $1,419.11 -7.89%
AAPL $337.70 -0.88%
AMZN $246.48 -0.84%
GOOGL $342.60 +0.30%
MSFT $507.65 -1.69%
META $718.09 -2.00%
NVDA $230.41 +3.26%
TSLA $358.84 -2.69%
SNDK $1,733.76 +0.87%
INTC $116.38 -2.28%
SPCX $146.66 -1.50%
MU $1,073.46 +1.38%
AMD $611.88 -0.36%
BTC $83,968.47 +1.26%
ETH $2,714.17 +2.67%
BNB $767.70 +0.88%
XRP $1.50 +2.13%
SOL $119.32 +0.92%
TRX $0.3358 +0.78%
DOGE $0.0948 +2.35%
ADA $0.2509 +3.22%
BCH $310.70 +1.23%
LINK $15.16 +10.80%
HYPE $88.25 -0.88%
AAVE $159.61 +8.00%
SUI $1.13 -3.06%
XLM $0.2277 +9.59%
ZEC $1,419.11 -7.89%
AAPL $337.70 -0.88%
AMZN $246.48 -0.84%
GOOGL $342.60 +0.30%
MSFT $507.65 -1.69%
META $718.09 -2.00%
NVDA $230.41 +3.26%
TSLA $358.84 -2.69%
SNDK $1,733.76 +0.87%
INTC $116.38 -2.28%
SPCX $146.66 -1.50%
MU $1,073.46 +1.38%
AMD $611.88 -0.36%
first_img

OpenAI: Перед передовым обучением с подкреплением необходимо представить обоснование безопасности

2026-09-29 15:00:27

OpenAI опубликовала статью по безопасности 28 сентября 2026 года, в которой утверждается, что перед продолжением любых передовых тренировок с подкреплением необходимо предоставить структурированные документы по безопасности. В идеале такие документы должны соответствовать уровню структурированных рисковых обоснований на основе доказательств, используемым в критически важных отраслях, таких как авиация и ядерная энергетика. OpenAI рассматривает это как направление своих усилий, одновременно признавая, что из-за сложности, возникающей из возможностей ИИ, достичь такого же уровня строгости сложно.

Статья сосредоточена на передовых тренировках с подкреплением и не охватывает более широкие атрибуты согласования, необходимые для внутренних и внешних развертываний. В статье предлагаются текущие практики, которые, как ожидается, будут продолжать развиваться и уже внедряются внутри OpenAI. Технические меры защиты должны охватывать согласование моделей, изоляцию и мониторинг, включая предотвращение спекуляций на положительных подкреплениях, оценку согласования в оффлайне и стресс-тестирование, недопущение автоматических оценщиков к цепочкам размышлений, а также безопасность многоуровневой инфраструктуры, красные команды в песочнице, ограничение высокоскоростной межвыборочной связи и неизменяемое сохранение записей агентов.

Операционные принципы включают предварительные разногласия между командами, возможность вето со стороны старшего руководства, ответственность руководителя тренировки за обоснование безопасности и реагирование на инциденты, а также приостановку в случае сбоя, внутренний контроль, аудит доступа и эскалацию по степени серьезности. В отношении серьезных инцидентов OpenAI предлагает контролируемый доступ к оригинальным записям, анализ коренных причин, обзор операций и культуры, а также оценку, вытекающую из инцидента, как регрессионное тестирование; после завершения расследования результаты, обзор и изменения в операциях должны быть опубликованы, а затронутые третьи стороны должны быть уведомлены как можно скорее.

app_icon
ChainCatcher Building the Web3 world with innovations.