9月1日,OpenAI宣布新一代旗舰模型Astra在Preparedness Framework(前沿风险应对框架)下被评定为"Critical"网络安全能力等级,是业界首款达到该级别的AI模型。
关键信息:
• Astra能自主发现未知漏洞并构建完整利用链,在ExploitBench漏洞利用基准上取得满分
• 成功串联两个此前未公开的V8浏览器零日漏洞,并具备浏览器沙箱逃逸与本地提权攻击能力
• 采用"循环深度"(recurrent depth)新架构,让内部表征反复经过相同模型层获得更强推理能力
• 受此影响,OpenAI调整了Astra发布计划,推迟全量上线,最强网络能力工作流先向内测用户及Daybreak Blue防御团队开放
Redwood Research首席科学家评价此为"AI安全与安保领域迄今为止最糟糕的进展",OpenAI回应已对该技术使用加以限制以保证模型仍可产出可监控的推理过程。
来源:The Information / TechCrunch / Axio · 2026-09-03