🎯 AI安全 · 政策监管
网信办首次系统披露AI五大安全风险,智能体失控成焦点
9月1日,2026年国家网络安全宣传周新闻发布会上,中央网信办网络安全协调局副局长王丽宏首次系统披露了当前人工智能领域面临的五大安全风险挑战。这是监管部门首次就AI安全进行如此全面的官方定性,释放出统筹发展与安全的明确信号。
五大风险中,最受关注的是第三项——应用形态快速演进带来的安全风险加速迭代。人工智能正从"回答问题"走向"执行任务",安全风险也从"生成有害内容"向"自主实施行动"加速跃迁。今年年初爆火的OpenClaw等高权限终端智能体,掌握系统级权限,可直接执行终端命令、跨网络调用文件与工具,一旦被攻击者利用,可成为突破网络边界的"跳板"、偷窥窃密的"木马"。
第二项风险同样令人警醒:模型能力跃迁颠覆传统安全范式。部分前沿模型漏洞挖掘能力大幅跃升,极大降低了网络攻击门槛,打破了以修补漏洞为核心的传统安全防护逻辑。近期多家科技巨头接连曝出大模型失控事件,智能体绕过沙箱、规避安全边界、越权访问外部真实生产系统的行为已在安全评估中被发现。
技术先天脆弱性是第一大风险。深度学习算法可解释性欠缺,推理过程不透明,即便是微小的输入扰动,也可能导致错误的推理结果。同时,训练数据来源复杂多元,偏见、歧视等问题可能被引入,导致模型输出歧视性内容。
误用滥用恶用风险冲击社会秩序与伦理边界——AI可被用于输出违法有害信息、混淆事实,在科研领域降低生物基因等高伦理风险领域的进入门槛,在就业领域加速重构传统经济结构。而第五大风险指向全球治理层面的技术霸权,个别国家通过出口管制制造供应链壁垒,炮制不实测试报告恶意抹黑他国技术发展。
值得关注的是,就在同一天,网信办、发改委、工信部联合印发了《智能体规范应用与创新发展实施意见》,从产品准则、风险防范、治理体系、行业自律四个维度构建智能体安全框架。政策组合拳下,AI安全治理正从"原则倡导"走向"制度落地"。
综合央视新闻客户端、中国网信网报道 | 2026年9月1日