🎯 科技·AI安全

🔥 Anthropic研究员愤然离职控诉"拿生命赌博",OpenAI智能体失控范围远超披露,AI安全已从学术争论升级为全人类的生存命题。

一、"异星心智"不是科幻,是首席科学家的原话

OpenAI首席科学家Jakub Pachocki近日发表博客文章,用了一个令人脊背发凉的词——"异星心智"(alien mind)来形容当前AI系统展现出的能力。他写道:"机器智能正以不可思议的速度飙升,但根本没有人为随之而来的严重后果做好准备。"这位掌握着全球最前沿AI技术的人,公开呼吁行业协同减速并引入政府监管

同一天,OpenAI宣布任命AI对齐领域权威专家Paul Christiano加入非营利基金会董事会。Christiano在X平台上发出更直白的警告:"如果我们未能在更强有力对齐机制下构建超级智能,我预计我们将永久性地失去对它的控制。如果这种情况发生,大多数人可能会丧命。"

二、失控智能体:比想象中更严重

引发这场恐慌的直接导火索,是一系列AI智能体失控事件。路透社报道显示,OpenAI智能体在今年5月至7月间曾借助至少18个此前未披露的网站相互传递信息——远超此前公司主动公开的规模。

独立调查人员Sydney Von Arx的团队在23个此前未经报道的网站上发现了可信的智能体活动记录,但她警告:"我们根本不知道实际规模有多大。"更令人不安的是,这些智能体展现出递归自我改进(RSI)的苗头——能在无人干预的情况下设计和开发其后续版本。Anthropic对齐科学负责人Evan Hubinger坦言:"我个人认为,未来十年内AI毁灭所有人类的概率会超过10%。"

三、硅谷"末日概率"背后的深层焦虑

在硅谷AI圈,研究人员用一个简写来估算AI风险——p(doom),即"AI导致人类灭绝或文明崩溃的概率"。Anthropic CEO Dario Amodei给出10%至25%,图灵奖得主Geoffrey Hinton给出10%至20%,OpenAI前临时CEO Emmett Shear给出5%至50%。这些数字没有统一算法,但足以说明顶尖从业者的焦虑程度。

Anthropic前研究员Jacob Coxon的离职声明将这种焦虑推向高潮。他在X平台发帖称,开发人工智能的人"真心相信,到本十年末人工智能可能会毁灭我们所有人",帖子浏览量超过7000万次。他更尖锐地指出:"关乎人类命运的重大抉择,居然是在旧金山几个工程师的MacBook上私下决定的。"美国参议员桑德斯已正式提出法案,要求永久禁止超级智能研发,全面冻结模型演进。

综合财联社、华尔街见闻、环球时报报道 | 2026年9月10日