🎯 科技 · AI前沿

GPT-6 Astra正式全量开放,AI从"回答问题"迈向"完成任务",OpenAI总裁称"欢迎进入AGI时代"

一、GPT-6 Astra全量开放,能力实现代际跃迁

北京时间9月4日凌晨,OpenAI正式发布新一代旗舰模型GPT-6 Astra,并称其为"目前全球最智能、且对齐程度最高的模型"。9月5日,OpenAI官宣所有Pro、Enterprise和Business Premium用户已可在ChatGPT Work和Codex中直接使用Astra,API同步上线。与普通Plus用户还需等待数日形成对比,此次分阶段开放策略显示出OpenAI对Astra能力的自信与审慎并存的发布节奏。

Astra的核心变化不是回答能力更强,而是AI从"提供答案"转向"完成任务"。它能够直接操作计算机和软件,根据用户提出的目标自主完成一系列此前需要人类在不同软件之间切换执行的步骤——比如替用户完成编程、研究、金融建模、制作演示文稿和电子表格等复杂任务。在OSWorld 2.0测试中,Astra得分72.6%,GPT-5.6 Sol为65.7%;在延迟模拟环境下,Astra完成任务平均约需40分钟,而GPT-5.6 Sol约需75分钟,效率提升约47%。在Mind2Web测试中,结合更新后的Codex harness后,Astra任务完成速度达到GPT-5.6 Sol体验的1.9倍。

二、数学与抽象推理近乎满分,网络安全能力引争议

在代表高阶数学能力的FrontierMath Tier 4上,Astra得分达到97.6%,几乎将这套研究级数学测试"打穿";在强调陌生环境学习和抽象推理的ARC-AGI-3上,其成绩从GPT-5.6 Sol的7.8%跃升至99.9%,接近满分。OpenAI用"饱和"一词形容Astra的榜单表现——意味着现有测试已难以区分其上限。

网络安全是Astra最具争议的能力。Astra首次达到OpenAI内部"关键"网络安全能力门槛,能够在较少人工干预下发现此前未知的软件漏洞并开发漏洞利用程序,内部测试中曾发现并利用两个零日漏洞。因此,最先进的网络安全能力暂不全面开放,仅向参与"Daybreak"网络安全项目's企业客户开放。这一设计既体现了OpenAI对安全边界的审慎,也引发外界对AI武器化风险的讨论。OpenAI总裁Greg Brockman称,人们未来可能将"这个时间、这个模型"视为AGI到来的节点,并在发布会最后表示"欢迎进入AGI时代"。

三、定价2.5倍于前代,提示词工程迎来"减法革命"

Astra的API定价为每百万输入Token 10美元、输出Token 50美元,约为GPT-5.6 Sol的2.5倍,仍属高端定价。OpenAI同时提供"快速模式",处理速度最高可达标准模式的2.5倍,价格翻倍。值得注意的是,OpenAI工程师Victor Nunez给早期用户的建议竟是"删掉你的提示词"——Astra对skill和AGENTS.md中的指令更敏感,过去那些糊弄式的补丁规则现在会被逐条执行,含糊的规则会让它停下来反复确认,冲突的规则直接让它懵逼。

模型越强,用户写的规矩反而该越少。Astra的逻辑变了,意味着人与AI的交互范式正在根本性转变。过去面对模型答不好就加限制、加要求的"加法思维",将被"减法思维"取代。OpenAI在Astra模型指南中反复强调"审计"——清理过时、冗余、冲突的指令,让模型从上下文中推断意图,在指令有歧义时主动询问而非盲目执行。这一转变不仅适用于开发者,对普通用户同样意义重大:当你拥有能自主完成长周期任务的AI助手时,最重要的能力不是写更复杂的提示词,而是清晰地定义目标和约束。

综合科技日报、华尔街见闻、澎湃新闻、财联社报道 | 2026年9月5日