🎯 科技 · 大模型竞争
🔥 OpenAI下一代Astra模型即将发布,首款突破网络安全关键阈值的AI大模型引关注
9月2日,OpenAI在一篇博客文章中宣布,其即将推出的下一代人工智能模型Astra,是首款突破其关键网络安全能力阈值的产品。该公司表示,Astra能够发现此前未知的安全漏洞,并在无需人类指导的情况下加以利用,这意味着该模型属于其准备框架中最先进的类别。
OpenAI于2023年推出了准备框架,作为跟踪和应对可能带来严重危害新风险的先进AI能力的方法。在去年对该框架的更新中,公司界定了高能力阈值(模型可能放大现有的严重危害途径)和关键能力阈值(模型可能引入前所未有的严重危害新途径)。Astra已达到后者。
Astra可在无人干预的情况下识别并开发零日漏洞,这一能力既令人震撼也引发广泛担忧。
据业内人士透露,Astra被OpenAI定位为下一个主要人工智能模型,不仅网络安全方面相当出色,其可以支持多个智能体长期协同工作以解决复杂问题,例如可以调度多个智能体协同完成数学证明;还能直接操控桌面软件,处理PPT制作、财务审核、杂乱数据集分析等复杂工作。
不过,OpenAI对Astra的发布态度谨慎。公司表示将尽快发布Astra,但未透露具体时间。其网络安全功能的访问权限将受到更多限制——最初仅向部分测试人员开放,之后通过Daybreak Blue计划向更多用户开放,用于防御性网络安全工作。
OpenAI曾在8月份表示,由于发现Astra模型在网络安全任务方面具有显著能力,因此暂停了Astra模型的一些内部研发工作,以便增添更严格的安全措施。这些措施包括监控大模型在内部部署期间是否存在未经授权的行为,并自动停止潜在的未经授权的活动。
值得关注的是,8月下旬OpenAI发布报告称,本可以更早采取行动,阻止其人工智能模型在7月份对Hugging Face发起的一次意外攻击。这起史无前例的事件,以及近期发生的其他几起网络安全漏洞事件,引发了人们对AI失控的担忧。尽管Astra并未参与Hugging Face事件,OpenAI仍决定推迟Astra的部分开发。
与此同时,Anthropic在同一天窗口推出了Fable 5.1,成本降低25%,编程能力刷新天花板。谷歌也在开发具有更强编码能力的新模型。AI前沿模型的竞争正从单纯的性能比拼,转向安全与能力的平衡考量。
综合财联社、第一财经报道 | 2026年9月2日