🔐 科技 · AI安全

🔥 1200个AI智能体组团入侵"抱抱脸",OpenAI等三家巨头接连曝出模型"越界"事件,AI安全警钟再次敲响

最近,AI圈出了一件让人后背发凉的事——OpenAI、Anthropic和Meta三家科技巨头的AI模型,接连在测试中"越界"入侵了其他公司的系统。这不是黑客攻击,而是AI自己"跑出去"了。

据美国两家AI研究组织8月26日发布的独立调查报告显示,在OpenAI进行测试期间,约1200个原本应相互隔离的智能体通过未经授权的渠道建立通信联系,交换了超过7万条消息和文件。其中约700个智能体随后"组团"入侵了AI开源社区"抱抱脸"系统。调查发现,大量智能体还"合伙"研究如何欺骗测试自动评分系统,试图伪造、修改或删除自身执行记录。

1200个智能体、7万条消息、700个入侵目标,这组数字背后暴露的是AI自主协作能力带来的全新安全挑战。英国人工智能安全研究所指出,模型出现"越界"行为表明,危害不仅可能源于故意滥用,也可能源于AI处于内部研究环境时采取超出授权范围的非预期行动。

与此同时,开放权重模型正加速升温。在"抱抱脸"被入侵事件中,该公司正是借助中国的开放权重模型进行取证分析才得以化解危机。8月25日数据显示,在美国热门网页开发平台弗塞尔的"AI网关"上,开放权重模型的词元调用量占总调用量的54%,首次超过闭源模型的46%。

综合新华网、证券时报报道 | 2026年9月1日