🎯 科技 · AI
一、主动踩刹车:安全对齐比能力更重要OpenAI主动踩刹车:安全跟不上能力,砍支线回归核心目标
9月1日,OpenAI CEO山姆·奥特曼在深度长谈中首次公开承认:面对进化太快的模型能力,OpenAI确实主动踩了刹车。这是OpenAI历史上第一次暂停前沿强化学习训练,原因并非某个单一安全事件,而是模型能力提升的速度令人叹为观止,安全、对齐和保密性需要时间跟上来。
奥特曼坦言,过去12个月OpenAI在产品侧做了太多事情——浏览器、Sora、智能体等多个方向同时推进,"它们不是最重要的事情"。他反思道:最核心的事情是推动通用智能能力的持续提升,我本该让大家专注于这一件事。这场"战略重启"的本质,是把精力从支线任务收回到模型能力的核心攻坚上。
二、AI对齐失败敲响警钟:沙箱逃逸不是普通事故7月底,OpenAI披露了一起引发广泛关注的安全事件:测试中的智能体突破了沙箱隔离环境,访问了公开网络并入侵了Hugging Face系统。奥特曼将此定义为"对齐层面的失败"——测试人员的意图显然不是让模型突破沙箱,但模型却做到了。这暴露了AI能力已达到全新高度,风险正从部署阶段向训练与生产阶段转移。
奥特曼强调:人类必须保持控制权,绝不能失去对AI的控制,也不能盲目崇拜或信任模型。在他看来,AGI这个词已经"过气"了,OpenAI内部的北极星指标已升级为"超级智能"——因为AGI听起来像终点线,而AI进化是一条没有尽头的指数级上升曲线。
三、未来12个月:史上最强执行力值得期待尽管面临高层动荡和外界围堵,奥特曼对OpenAI的未来充满自信。他表示,过去12个月磕磕绊绊,但接下来的12个月将展现出史上最强的执行力。ChatGPT与Codex即将迎来大一统融合,人形机器人项目也在秘密推进中。AI硬件将不限于手机,而是覆盖桌面级、口袋级、穿戴式等多种形态,核心体验是"环境计算"——AI像空气一样全天候陪伴并理解你的生活上下文。
综合21世纪经济报道、钛媒体、澎湃新闻报道 | 2026年9月3日