🎯 科技 · AI安全
一、Astra达标"关键"门槛,可自主发现零日漏洞🔥 OpenAI Astra模型突破网络安全关键阈值,但高级能力将严格限制
9月2日,OpenAI宣布其即将推出的下一代AI模型Astra,是首款突破其"关键"网络安全能力阈值的产品。公司表示,Astra能够发现此前未知的安全漏洞,并在无需人类指导的情况下加以利用,这意味着该模型属于其"准备框架"中最先进的类别。
OpenAI于2023年推出了"准备框架",作为"跟踪和应对可能带来严重危害新风险的先进AI能力"的方法。在2025年的更新中,公司界定了"高"能力阈值(模型可能放大现有严重危害途径)和"关键"能力阈值(模型可能引入前所未有严重危害新途径)。
二、网安能力受限,防御性使用优先OpenAI表示仍计划"很快"发布Astra,但未透露具体时间。公司强调,Astra的高级网络安全功能最初仅向少数测试人员开放,随后将通过Daybreak Blue项目向更多用户提供用于防御目的的访问权限,并配套网络安全防护措施。
这标志着AI安全部署正式从后台议题推向前台——随着模型能力逼近网络安全关键门槛,头部厂商正集体将安全限制作为发布前置条件。
三、Astra不止是网安工具,定位下一代主力模型据业内人士透露,Astra被OpenAI定位于下一个主要AI模型,除了网络安全方面相当出色,还支持多个智能体长期协同工作以解决复杂问题,例如可调度多个智能体协同完成数学证明;还能直接操控桌面软件,处理PPT制作、财务审核、杂乱数据集分析等复杂工作。
8月下旬,OpenAI曾暂停Astra部分内部工作,以加强安全防护。公司同时在博客中指出,在7月份的Hugging Face事件中本可更早采取行动阻止风险。业界预计,Astra的发布将再次引发与Anthropic Fable 5.1的性能对决。
综合财联社、第一财经报道 | 2026-09-02