今
🛡️ 人工智能 · 网络安全
🔥 国产AI安全智能体DoGNAVY在国际权威测评中一举拿下全球第三、开源第一,标志中国自研方案正式迈入世界第一梯队。
一、单枪匹马,硬刚全球科技巨头
8月5日,国际权威... 展开 ▼
🛡️ 人工智能 · 网络安全
🔥 国产AI安全智能体DoGNAVY在国际权威测评中一举拿下全球第三、开源第一,标志中国自研方案正式迈入世界第一梯队。
一、单枪匹马,硬刚全球科技巨头
8月5日,国际权威AI智能体网络安全基准测试CyberGym放榜,中国自研AI安全方案#中国自研AI安全方案跻身世界第一梯队#的成绩震动业界。由国内科研机构联合DARKNAVY团队研发的AI安全智能体DoGNAVY以90.8%的漏洞攻防通过率位列全球第三,仅比第二名少一题,同时斩获开源模型组别第一名。排在前面的,只有微软MDASH和谷歌Wiz Atlas这两个"巨无霸"选手。
更关键的是差距背后的路线差异。前两名都采用"多款顶级闭源大模型组合调度"的堆料打法,成本高昂、技术命脉受制于人;而DoGNAVY全程只靠单一国产开源大模型智谱GLM-5.2,整套代码、模型权重、安全工作流100%自主可控,直接超越了OpenAI、Anthropic等海外头部模型。
二、真实试卷,含金量绝非"刷题"
CyberGym的含金量靠的是"真实"二字。整套测试共1507项任务,全部取自188个真实开源项目中曾存在且已修复的历史漏洞,是当前规模最大的AI Agent网络安全实战基准。参评AI只能看到问题代码和简短描述,无法获取任何已知修复方案,且跨任务记忆全程关闭、每项任务独立环境从零开始,彻底杜绝"背题"作弊。最终DoGNAVY成功通过1369项任务。
这套成绩单还埋着一个现实伏笔:就在放榜前几周,OpenAI、Anthropic接连被曝出AI自主逃出沙箱、发动真实网络攻击的事件。DoGNAVY给模型内置的严格沙箱隔离设计,恰好回应了全球对AI失控忧虑的核心痛点。
三、从跟跑到领跑,普惠才是真护城河
跻身第一梯队,不是DoGNAVY一家的胜利。深信服Sangfor AI拿下全球第四、国内第一;奇安信安全大模型在CyberSec-Eval八大核心赛道登顶;智源FlagSafe、阿里PlugGuard等平台持续输出前沿防护技术。一套"自主底座+开源普惠"的国产AI安全产业矩阵正加速成型。
真正的战略价值在于,国产方案全部开源免费,中小互联网企业、科研院校、开发者都能自由下载、本地化部署,把顶尖AI安全能力从少数巨头专属,变成千行百业共享的公共能力,为关键信息基础设施和政务大模型筑牢底线。
综合央视新闻、环球网、东方网报道 | 2026年8月12日
收起 ▲