OpenAI 首席科学家称 AI 或持续快速上升至递归自我改进
ChainCatcher 消息,OpenAI 首席科学家 Jakub Pachocki 于 2026 年 9 月 6 日发表文章《An Alien Mind》。文章回顾 2023 年中期 RLSlow 研究项目首次出现可规模化训练推理模型的结果,称三年后推理语言模型已成为经济快速增长的一部分,开始推动科学边界,能操作计算机与图形界面、与人及其他 AI 协作并开展研究项目,同时改变计算机安全格局并带来新危险。
作者基于内部结果预期当前进展速度可能持续至递归自我改进。若 AI 发展沿当前路径继续,未来几年系统可能出现同等或更大能力跃升,并日益驱动自身发展。作者呼吁极端谨慎,认为无人准备好应对机器智能持续快速上升的后果。OpenAI 将继续寻求对齐与监控的技术解决方案、构建防御系统并在必要时单方面停止进一步规模化,但认为需要更广泛干预。
文章称机器智能主要由计算能力增加驱动,AI 更多是生长而非设计。对齐方面区分目标对齐与价值对齐,核心挑战是泛化。GPT-6 Astra 对齐显著优于 GPT-5.6 Sol,但仍需更多进展。监控方面主要押注思维链监控,评估显示依赖能力正逐步减弱。可扩展防御方面,模型在突破计算机系统方面正变得超人,当前处于使用最佳可用模型显著加强关键系统安全的狭窄窗口。
关联标签






