🎯 科技 · AI大模型

🔥 OpenAI发布GPT-6 Astra,10万GPU训练,宣告"欢迎来到AGI时代",AI从"回答问题"正式进入"完成任务"的新纪元

一、AI能力质的跃迁

北京时间9月4日凌晨,OpenAI正式发布新一代旗舰模型GPT-6 Astra,并在发布会上由总裁Greg Brockman宣告"欢迎来到AGI时代"。这不是一次普通的版本迭代,OpenAI将其定义为长达十年AGI研发进程中的关键里程碑。

测试数据显示,Astra在代表高阶数学能力的FrontierMath Tier 4上得分达97.6%,几乎"打穿"这套研究级数学测试;在强调抽象推理的ARC-AGI-3上,成绩从GPT-5.6 Sol的7.8%跃升至99.9%,接近满分。而此前最引人注目的网络安全能力上,Astra在ExploitBench中满分通过,在2026年6至8月新漏洞测试中成功率达39%,远超Sol的5.5%。OpenAI也因此首次将Astra的网安能力评级提升至"关键"级。

二、从"回答者"到"执行者"

Astra最核心的变化在于:它不再只是提供答案,而是能直接操作计算机、替用户完成复杂任务。它可以自行填写在线表格、更新CRM记录、整理日历、开展在线研究并生成摘要,还能分析科学数据、制作图表、创建网站并执行前端QA检查。

OpenAI表示,Astra可以自主安装和测试软件、根据屏幕反馈排查故障,在Agents' Last Exam上得分59.3%,ScreenSpot-Pro达92.7%,均领先主要对比模型。这意味着用户不再需要把一个复杂目标拆成几十个指令逐步交给AI,而是直接提出最终目标,由模型自行完成中间步骤。

三、安全红线与商用节奏

网安能力突破"关键"门槛是一把双刃剑——Astra具备发现未知漏洞和开发漏洞利用程序的能力,出于安全考虑,OpenAI对其设置了严格访问限制,目前仅向参与网络安全项目的用户开放。

此外,Astra也是OpenAI迄今对齐程度最高的模型。在参考Hugging Face事件设计的授权边界测试中,GPT-5.6 Sol有48%的情况会超出授权目标,而Astra的这一比例为0%。普通用户预计还需数日才能在ChatGPT Plus/Pro/Business/Enterprise中尝鲜。

综合第一财经、财联社、网易新闻、华尔街见闻报道 | 2026年9月4日