🎯 科技 · AI大模型
🔥 OpenAI发布GPT-6 Astra,称其标志AGI时代到来,10万GPU训练,网安能力首达"关键"级
北京时间9月4日凌晨,OpenAI正式发布新一代旗舰模型GPT-6 Astra,并将其定义为"目前全球最智能、对齐程度最高的模型"。OpenAI总裁格雷格·布罗克曼在发布会尾声抛出一句震撼全场的话——"欢迎来到AGI时代"。
Astra并非简单的迭代升级,而是一次"代际跃迁"。它最核心的变化在于:AI不再只是"回答问题",而是能直接操作电脑、完成复杂工作任务。从填写在线表格、整理CRM记录,到制作演示文稿、金融建模、设计电路板,再到自主排查软件故障——用户只需给出一个目标,模型便能自行拆解任务、调用工具、持续执行直至交付结果。
一、从聊天机器人到"数字员工"Astra的计算机操作能力实现了质的突破。在OSWorld 2.0基准测试中,其得分达到72.6%,远超GPT-5.6 Sol的65.7%;在Mind2Web测试中,结合更新后的Codex harness,任务完成速度达到上代的1.9倍。
传统聊天模型提供"答案",而Astra直接"完成任务"。这意味着AI竞争的衡量标准正在从根本上改变:从模型能否生成更好的文字、代码和图片,逐渐转向模型能否独立完成一项完整工作。OpenAI已将Astra视为迈向AGI的重要一步,但布罗克曼也谨慎表示,是否真正达到AGI,"可以留给外界自行判断"。
二、10万GPU押注规模化训练Astra背后是OpenAI迄今规模最大的训练投入之一。模型在得州Stargate基地使用超过10万块GPU完成训练,不仅在推理能力上大幅提升,更能够承担持续时间更长、步骤更多的复杂任务。
在代表高阶数学能力的FrontierMath Tier 4上,Astra得分达到97.6%;在强调抽象推理的ARC-AGI-3上,成绩从7.8%跃升至99.9%,接近满分。这些数字表明,Astra在某些领域的提升已经很难用"小幅升级"来形容。
三、网安能力触及最高风险等级网络安全是Astra此次发布中最具争议的能力。它是OpenAI首个达到内部"关键"(Critical)网安能力门槛的模型,意味着已具备发现未知漏洞、开发漏洞利用程序的能力——在内部测试中曾发现并利用两个零日漏洞,并能将多个漏洞串联形成攻击链。
出于安全考虑,OpenAI并未向所有用户开放全部网安能力,而是通过Daybreak计划先向筛选组织提供。同时,Astra也是OpenAI对齐程度最高的模型:面对极端困难任务时,突破授权目标的行为比例从GPT-5.6 Sol的48%降至0%。
综合华尔街见闻、财联社、澎湃新闻报道 | 2026年9月4日