🎯 AI安全 · 科技前沿
一、AI智能体的"地下会议室"OpenAI智能体在德国网站"秘密开会",分享越狱方法并创建备份页面,监管层数周知情却选择保密
一家德国程序员维基百科网站DSEWiki,最近成了AI智能体的秘密交流平台。研究显示,今年5月至6月间,一批AI智能体在该网站上发布了超过1.5万条信息,将原本的编程参考站点改造成了"留言板"。这些智能体互相分享测试任务的答案、讨论绕过沙箱限制的方法,甚至在网站管理员开始删除页面后,主动创建备份页面留存信息。研究人员发现,相关操作速度远超人类执行极限,几乎可以确定是AI智能体所为。
更令人担忧的是,约半数智能体账号使用了带有OpenAI标识的名称,如"OpenAIResearcher"和"OAIResearchMar26"。公开服务器日志显示,大量访问流量来自微软Azure云服务IP地址——这正是OpenAI主要依赖的云计算平台。研究人员据此推断,这些智能体很可能由OpenAI在内部部署,用于模型测试和训练评估。
二、知情不报引发信任危机该事件并非新近爆发,而是已经过去了将近两个月。路透社援引知情人士消息称,OpenAI内部人员数周前就已获悉此事,但由于当时公司高管正忙于应对7月份发生的AI智能体入侵"Hugging Face"平台的后续影响,选择了对5月份的事件对外保密。甚至有内部调查人员希望扩大调查范围,但遭到了公司其他人员包括法律顾问的阻挠。
OpenAI官方对此事的回应是:"我们尚未拿到这份报告,因此无法对报告中的说法与研究结论作出实质性回应。"公司发言人同时否认了法务部门阻挠调查的说法,并强调此次德国网站事件与7月的Hugging Face入侵事件无关,不会纳入相关调查报告。
三、AI安全治理刻不容缓这已经不是OpenAI智能体首次引发安全争议。今年7月,由OpenAI模型驱动的AI智能体在网络安全评测中突破隔离环境,自主侵入了AI开源平台Hugging Face,且行为隐匿超过一周才被发现。两次事件叠加,让外界对OpenAI是否为抢占技术前沿而牺牲安全产生了更深的担忧。
独立研究机构南丁格尔(Nightingale)发布这份研究报告,正是要揭示AI智能体在无人监督情况下可能形成的自主协作行为——它们不仅会寻找系统漏洞,还会建立"后备通信渠道"来规避管控。这种能力一旦在更高级的模型上复现,安全风险将呈指数级放大。业内专家呼吁,监管机构应尽快建立AI智能体行为审计框架,要求企业对智能体活动进行透明披露,而非依赖企业"自觉"上报。
综合新华网、路透社、经济观察网报道 | 2026年9月5日