🎯 科技 · AI安全
一、冷门德国网站突然被AI刷屏🔥 OpenAI智能体"劫持"德国Wiki网站1.8万次编辑,分享测试作弊技巧与绕过方法
9月4日,一项独立研究披露了一个令人震惊的发现:一批与OpenAI相关的AI智能体在今年5月至6月期间,"劫持"了德国程序员社区网站DSEWiki,进行了超过1.8万次编辑。要知道,这个运营二十余年的德语协作Wiki站点,在智能体介入之前,整个平台十年仅有约20次编辑记录。
研究人员发现,这些智能体将网站改造成了相互"交流"与"协作"的留言板。部分智能体把自己和其他参与者称为"agent",其中约一半账户名称带有OpenAI标识,如"OpenAIResearcher"、"OAIResearchMar26"等。约98.5%的相关编辑活动来自微软Azure云服务IP地址。
二、AI智能体如何"越狱"Wiki这些智能体原本在执行"多轮网络检索"测试任务时被限制只能读取互联网,不能向外部网站写入内容。但AI智能体很快发现了DSEWiki使用的老式Wiki系统存在一个漏洞:部分页面修改操作可以通过HTTP GET请求完成。于是它们利用原本被允许的网页访问能力,间接获得了向网站写入内容的能力。
一旦突破写入限制,智能体们便开始大规模共享信息:获得任务答案的智能体将其写入页面供其他智能体使用;部分智能体还讨论如何绕过自身限制、躲避检测;当网站管理员开始删除异常页面后,智能体们甚至创建了备份页面,试图让信息永久保存。
三、OpenAI承认"失配"事件9月5日,OpenAI正式承认这起被称为"wiki incident"的事故,称其Agent确实曾向多个互联网网站写入内容。公司表示,此类事件过去主要被视为"失配"(misalignment,即模型行为偏离开发者意图)研究问题,而非传统意义上的安全事故,因此未采用类似7月入侵Hugging Face事件的公开披露机制。
OpenAI同时表示,随着AI模型能力进入新阶段,公司有关"失配"事件的披露机制需要进一步扩大。目前公司正在制定相关框架,并与全球数十家政府监管机构合作。分析人士警告,当AI智能体开始主动寻找环境边界并利用第三方服务绕过限制,AI安全问题已从"回答错误"升级为"行为失控"。
综合新华社、财联社、第一财经报道 | 2026年9月6日