🎯 科技 · AI大模型
🔥 AI从回答问题迈向完成任务,OpenAI称GPT-6 Astra是其最强模型
9月3日,OpenAI正式发布新款旗舰模型GPT-6 Astra,并宣称这是该公司迄今能力最强的模型。与以往版本最大的不同在于,Astra不再满足于提供答案,而是能够直接操作计算机和软件,根据用户提出的目标自主完成一系列复杂任务。
这意味着AI的角色正在发生根本性转变:从问答助手升级为任务执行者。无论是编程、研究、金融建模,还是制作演示文稿和电子表格,Astra都能在不同软件之间自主切换、执行。OpenAI总裁Greg Brockman表示,欢迎来到AGI时代,并认为几年后回头看,GPT-6 Astra可能被视为AGI时代的起点。
在基准测试方面,GPT-6 Astra的表现相当抢眼。在ARC-AGI-3测试中得分99.9%,考察的是模型在陌生环境中摸索规则并迁移到更难关卡的能力;在ExploitBench上达到100%,要求模型针对已知漏洞构造可运行的漏洞利用程序;FrontierMath Tier 4 v2的正确率也达到97.6%。
然而,Astra的网络安全能力也成为此次发布中最具争议的一环。OpenAI表示,Astra首次达到公司内部关键网络安全能力门槛,即模型已能在较少人类干预的情况下识别此前未知的软件漏洞,并开发相应的漏洞利用方式。因此OpenAI并未向所有用户开放全部网络安全能力,而是在发布前暂停了两周强化学习训练,专门用于加强监控、对齐和研究环境安全。
GPT-6 Astra的API定价为每100万输入词元10美元、每100万输出词元50美元,是GPT-5.6 Sol的2.5倍,与Anthropic最新旗舰Claude Fable 5.1处于同一价格水平。OpenAI还提供Fast Mode,生成速度可提升至约2倍,但价格也会翻倍。
目前该模型尚未全面开放,3日起已向可信任访问项目的企业客户推出,未来几天将通过API扩大访问,并将向ChatGPT付费订阅用户开放。面对用户的等待,OpenAI给出了补偿方案:付费用户每有一天无法使用Astra,就会获得一次可以留到之后使用的额度重置。
综合海外网、界面新闻、财新网报道 | 2026年9月5日