OpenAI近日确认其即将推出的下一代AI模型Astra,已突破公司准备框架中最先进的Critical网络安全能力阈值,成为首款获此认证的AI模型。
据官方披露,Astra能够自主发现并 exploit 加固系统中的未知安全漏洞,在内部ExploitBench测试中获得满分,并在评估期间发现两个零日漏洞。
OpenAI表示将尽快公开Astra模型,同时会将最先进的网络安全能力限制在其Daybreak Blue项目的有限合作范围内,直到更强的安全防护措施到位。公司还称已暂停部分开发以加强保护,目前认为风险已降至可控水平。