🎯 科技 · AI大模型

🔥 一次代际跃升:GPT-6 Astra在ARC-AGI-3上逼近满分,OpenAI总裁直言"AGI时代已至"

一、AI从"回答问题"到"替你干活"

北京时间9月3日凌晨,OpenAI正式发布GPT-6 Astra,称其为"目前全球最智能、且对齐程度最高的模型"。最引人注目的变化是——AI开始真正"干活"了。GPT-6 Astra不再只是给你答案,而是能直接操作计算机和软件,根据用户目标自主完成一系列此前需要人类在多个软件间切换执行的复杂任务,比如编程、研究、金融建模、制作演示文稿和电子表格等。

在OSWorld 2.0测试中,Astra平均任务完成时间由75分钟缩短至40分钟,效率提升近一倍;AutomationBench得分41.4%。更关键的是,Astra支持105万Token上下文窗口12.8万Token最大输出长度,能够处理极其复杂的长程任务。

二、一场"代际跃升"带来的AGI大讨论

OpenAI总裁格雷格·布罗克曼(Greg Brockman)在发布当天对媒体直言:"我个人认为公司可能已经到达AGI了",随后在社交平台宣布"欢迎来到AGI时代"。但CEO奥特曼随后给这场庆祝降温,称AGI是"无关紧要的营销术语"。总裁与CEO在AGI问题上的公开分歧,折射出这个术语背后的真实处境——它既是估值杠杆,也是定价权。

高盛Delta-One交易台主管Rich Privorotsky在周末研报中盛赞:"一款领先的大模型已真正脱颖而出——这正是AI牛市论调一直期待的情况"。软银因持股OpenAI股价飙升近8%,甲骨文大涨逾3%。

三、99.9%的分数与10万张GPU的豪赌

从评测结果看,Astra并非空喊口号。在代表高阶数学能力的FrontierMath Tier 4上,Astra得分97.6%;在强调陌生环境学习和抽象推理的ARC-AGI-3上,成绩从GPT-5.6 Sol的7.8%跃升至99.9%,接近满分。Astra也是OpenAI迄今规模最大的训练项目,管理层称公司使用超过10万张GPU进行了预训练。

然而,能力越强,安全担忧也越大。OpenAI安全技术文档显示,Astra是公司首个达到《防范准备框架》关键网络安全能力阈值的模型——已能在较少人类干预下识别未知软件漏洞并开发漏洞利用方式。因此OpenAI没有向所有用户开放全部能力,而是首先向受信任的网络安全组织开放,并针对高级网络安全任务设置限制。

综合财联社、第一财经、钛媒体报道 | 2026年9月6日