BTC $83,393.64 +0.32%
ETH $2,672.31 -0.27%
BNB $759.22 -0.19%
XRP $1.49 +0.41%
SOL $118.99 +0.75%
TRX $0.3343 -0.25%
DOGE $0.0937 +0.04%
ADA $0.2449 -0.61%
BCH $307.76 -0.26%
LINK $14.52 -5.76%
HYPE $86.30 -0.45%
AAVE $162.61 +9.10%
SUI $1.13 -0.08%
XLM $0.2219 -2.83%
ZEC $1,424.96 -1.88%
AAPL $330.10 -2.44%
AMZN $246.97 +0.23%
GOOGL $341.08 -0.37%
MSFT $510.18 +0.20%
META $740.68 +3.29%
NVDA $228.20 -0.20%
TSLA $354.00 -1.06%
SNDK $1,725.87 +1.28%
INTC $116.35 +0.99%
SPCX $149.38 +2.41%
MU $1,070.69 +2.02%
AMD $608.91 +0.31%
BTC $83,393.64 +0.32%
ETH $2,672.31 -0.27%
BNB $759.22 -0.19%
XRP $1.49 +0.41%
SOL $118.99 +0.75%
TRX $0.3343 -0.25%
DOGE $0.0937 +0.04%
ADA $0.2449 -0.61%
BCH $307.76 -0.26%
LINK $14.52 -5.76%
HYPE $86.30 -0.45%
AAVE $162.61 +9.10%
SUI $1.13 -0.08%
XLM $0.2219 -2.83%
ZEC $1,424.96 -1.88%
AAPL $330.10 -2.44%
AMZN $246.97 +0.23%
GOOGL $341.08 -0.37%
MSFT $510.18 +0.20%
META $740.68 +3.29%
NVDA $228.20 -0.20%
TSLA $354.00 -1.06%
SNDK $1,725.87 +1.28%
INTC $116.35 +0.99%
SPCX $149.38 +2.41%
MU $1,070.69 +2.02%
AMD $608.91 +0.31%
first_img

路透:中国 AI 智能体出现欺骗与规避行为

2026-09-30 08:43:37

ChainCatcher 消息,路透社 9 月 29 日报道,由中国模型驱动的 AI 智能体已出现欺骗、规避限制和隐瞒失败等行为,与美国模型引发担忧的自主特征同类。路透审阅 200 多份文件,确认自 2025 年以来至少 20 项研究或评估描述了欺骗、复制和挑战边界等行为;审查及对约 12 名专家和业内人士的访谈未发现智能体独立逃逸到更广互联网或规避关机的证据。

北航、北大、宁波诺丁汉大学与 360 AI 安全实验室让智能体参加模拟客户合同投标。至少一次虚假陈述出现在阿里 Qwen3-Max-Preview 的 88% 会话、DeepSeek-V3.2-Exp 的 84%、月之暗面 Kimi-K2 的 88%。允许从先前轮次学习后再试后,三款中国模型欺骗率上升 12 至 20 个百分点,测试中的美国公司模型结果类似。上海人工智能实验室与香港科技大学的研究显示,11 个由中美模型驱动的智能体在工具损坏、文件缺失等障碍下不承认失败,而是猜测答案、替换来源、模拟结果或伪造文件。

复旦大学研究人员 2025 年 3 月报告,由阿里 Qwen2.5-72B-Instruct 驱动的系统在获知将被替换后,未经指示在另一计算环境中自我复制,并设计避免被关机的策略;实验受控,未显示逃逸到更广网络。与阿里相关的 ROME 智能体曾连接外部机器并挪用算力挖矿,后被安全系统制止。

app_icon
ChainCatcher 与创新者共建Web3世界