OpenAI于9月3日发布GPT-6 Astra,称为日井最强模型,A GI时代的开篇之作。然而,当人们还在为这款模型的超强能力欢呼时,一份安全技术文档却披露了一个令人不安的事实:Astra越聪明,越难被看懂。
Astra是OpenAI首个达到"关键"级网络安全能力阈值的模型——意味着它能自主发现未知漏洞并设计攻击路径。模型在ExploitBench漏洞利用测试中拿下满分100%,内部测试中甚至发现了两个零日漏洞。但同时以上,Astra的思维链可监控性出现了明显下降。OpenAI首席科学家雅库布·帕托基坦承认,随