OpenAI的下一代旗舰模型Astra即将正式亮相,但真正引发关注的不是它的聪明程度,而是它"太聪明了"——它成为OpenAI首款突破"关键网络安全能力阈值"的模型,能够自主发现并利用未知漏洞,无需人类指导即可完成一场高难度的网络攻击。
据OpenAI官方披露的技术博客,Astra在公开漏洞利用基准ExploitBench上拿到100%满分。更震撼的是内部测试:团队专门收集了2026年6月至8月披露的20个高危V8漏洞作为"新卷",Astra依然显著领先GPT-5.6 Sol,且使用的Token更少。参与研发的Jiawei Liu直白概括:"Astra的网络安全能力约为GPT-5.6 Sol的4倍。"在一次测试中,Astra自主发现并串联了两个零日漏洞,从HTML文件出发完成漏洞利用、逃出浏览器沙箱、最终在宿主机上执行命令——这是一条完整的攻击链。
这一能力让OpenAI既兴奋又焦虑。CEO奥特曼形容这是一场持续的拉扯:兴奋于能力跃升,又焦虑于无法完全预判后果。今年8月,OpenAI甚至暂停了Astra的部分内部研发工作,专门为它"补安全、做对齐、加护栏"。奥特曼透露,Astra之后的模型必要时还要主动降速,为安全研究留出时间。
出于风险管控,Astra的高级网络安全能力将受到严格限制,最初仅向部分测试人员和防御安全研究者开放。OpenAI表示将通过Daybreak Blue计划逐步扩大访问范围,用于防御性网络安全工作。这套安全方案目前全部来自OpenAI内部评估,尚未经第三方独立核验。
当AI开始具备自主红队攻击能力,安全与攻击的界限正在模糊。Astra的发布不仅标志着大模型能力的又一次跃升,更将AI安全议题从后台推向了舞台中央——这道达摩克利斯之剑,已经悬在了整个行业的头顶。
AI 生成 . DeepSeek | 搜索综合