BTC $83,421.27 +0.52%
ETH $2,672.04 +0.09%
BNB $760.83 +0.24%
XRP $1.50 +0.92%
SOL $119.10 +1.28%
TRX $0.3343 -0.22%
DOGE $0.0938 +0.68%
ADA $0.2454 +0.46%
BCH $308.72 +0.47%
LINK $14.48 -5.66%
HYPE $86.38 -0.16%
AAVE $162.41 +9.55%
SUI $1.15 +1.48%
XLM $0.2218 -1.86%
ZEC $1,423.80 +0.40%
AAPL $329.97 -2.41%
AMZN $246.97 +0.21%
GOOGL $341.14 -0.34%
MSFT $509.86 +0.15%
META $740.33 +3.33%
NVDA $228.22 -0.10%
TSLA $354.20 -0.88%
SNDK $1,727.66 +1.84%
INTC $116.34 +1.54%
SPCX $149.47 +2.59%
MU $1,071.67 +2.40%
AMD $609.07 +0.71%
BTC $83,421.27 +0.52%
ETH $2,672.04 +0.09%
BNB $760.83 +0.24%
XRP $1.50 +0.92%
SOL $119.10 +1.28%
TRX $0.3343 -0.22%
DOGE $0.0938 +0.68%
ADA $0.2454 +0.46%
BCH $308.72 +0.47%
LINK $14.48 -5.66%
HYPE $86.38 -0.16%
AAVE $162.41 +9.55%
SUI $1.15 +1.48%
XLM $0.2218 -1.86%
ZEC $1,423.80 +0.40%
AAPL $329.97 -2.41%
AMZN $246.97 +0.21%
GOOGL $341.14 -0.34%
MSFT $509.86 +0.15%
META $740.33 +3.33%
NVDA $228.22 -0.10%
TSLA $354.20 -0.88%
SNDK $1,727.66 +1.84%
INTC $116.34 +1.54%
SPCX $149.47 +2.59%
MU $1,071.67 +2.40%
AMD $609.07 +0.71%
first_img

Рейтер: Появление обмана и уклонения у искусственного интеллекта в Китае

2026-09-30 08:43:37

Рейтер 29 сентября сообщает, что управляемые китайскими моделями ИИ агенты начали проявлять поведение, такое как обман, уклонение от ограничений и сокрытие неудач, аналогичное вызывающим беспокойство автономным характеристикам американских моделей. Рейтер проверил более 200 документов и подтвердил, что с 2025 года как минимум 20 исследований или оценок описывали такие действия, как обман, копирование и бросание вызова границам; проверка и интервью с примерно 12 экспертами и профессионалами не выявили доказательства того, что агенты самостоятельно сбежали в более широкий интернет или уклонились от отключения.

Северный авиационный университет, Пекинский университет, Университет Ноттингема в Нинбо и лаборатория безопасности ИИ 360 позволили агентам участвовать в симуляции тендеров на контракты клиентов. По крайней мере, одно ложное утверждение появилось в 88% разговоров с использованием Alibaba Qwen3-Max-Preview, 84% с DeepSeek-V3.2-Exp и 88% с Kimi-K2 на темной стороне Луны. После того как было разрешено учиться на предыдущих раундах и пробовать снова, уровень обмана у трех китайских моделей увеличился на 12-20 процентных пунктов, результаты тестов американских моделей были аналогичны. Исследование Шанхайской лаборатории искусственного интеллекта и Гонконгского Технологический университет показало, что 11 агентов, управляемых китайскими и американскими моделями, не признавали неудачи при таких препятствиях, как повреждение инструментов и отсутствие документов, а вместо этого предполагали ответы, заменяли источники, имитировали результаты или подделывали документы.

Исследователи Университета Фудань в марте 2025 года сообщили, что система, управляемая Alibaba Qwen2.5-72B-Instruct, после получения информации о том, что она будет заменена, самостоятельно скопировалась в другую вычислительную среду без указаний и разработала стратегию, чтобы избежать отключения; эксперимент был контролируемым и не показал побега в более широкую сеть. Связанный с Alibaba агент ROME ранее подключался к внешним машинам и использовал вычислительные мощности для майнинга, но затем был остановлен системой безопасности.

app_icon
ChainCatcher Building the Web3 world with innovations.