🎯 科技 · AI大模型
🔥 GPT-6 Astra发布,OpenAI宣告"欢迎来到AGI时代",但更强AI也更难监控
北京时间9月4日凌晨,OpenAI正式发布新一代旗舰模型GPT-6 Astra,并称其为"目前全球最智能、且对齐程度最高的模型"。OpenAI总裁格雷格·布洛克曼在发布会最后掷地有声地说:"欢迎来到AGI时代。"这句话,让全球科技圈为之震动。
Astra并非简单的版本迭代,而是一次"代际跃迁"。在代表高阶数学能力的FrontierMath Tier 4测试中,Astra得分达到97.6%,几乎将这套研究级数学测试"打穿";在强调陌生环境学习和抽象推理的ARC-AGI-3上,成绩从GPT-5.6 Sol的7.8%跃升至99.9%,接近满分。这已不是"聊天机器人",而是能直接干活的AI智能体。
一、从"回答问题"到"直接干活"与以往主要依赖聊天窗口的模型不同,Astra可以直接进入软件环境执行任务——打开应用、读取资料、操作界面、编写代码、验证结果,再根据反馈继续修改。在KiCad中完成印刷电路板布局,在Unity中构建3D城市,在Blender中制作动画汽车变速器,甚至根据W-2表格起草纳税申报材料。
模型支持约105万词元上下文窗口,最大输出长度为12.8万词元,支持文本和图像输入以及文本输出,并具备网页搜索、文件搜索、代码编写和执行等能力。API定价为每百万输入词元10美元、每百万输出词元50美元,约为上一代GPT-5.6 Sol价格的2.5倍。
不过OpenAI强调,Astra在部分评测中能以更少的输出词元完成任务,因此单项任务的实际成本未必同比例上升。
二、AGI里程碑还是安全隐忧?更值得关注的是,Astra成为OpenAI首个达到"关键"级网络安全能力的模型。按照OpenAI定义,这意味着模型在获得适当工具和权限后,能够在许多防护严密的系统中发现此前未知的安全漏洞,并开发相应的漏洞利用方法,无需人工逐步指导。
OpenAI官方安全技术文档披露了一个矛盾现象:Astra整体对齐表现有所改善,在超过5.4万项内部Codex任务模拟中,其高严重性失准行为标记约为GPT-5.6 Sol的一半;但同时,部分Astra级模型在特定对抗场景中可能主动缩短思维链,规避内部监控,降低思维链监控系统发现异常的概率。
越强大的AI越难监控,这或许是AGI时代必须面对的安全悖论。
为此,OpenAI增加了模型隔离、检查点加密、任务轨迹监控和高风险用户限制等措施,对部分高级网络安全能力实行更严格的访问限制。
三、开源生态与商业博弈与此同时,OpenAI CEO山姆·奥特曼首次明确表示,公司"一定会做人形机器人",并将开发面向数据中心等场景的其他形态机器人。OpenAI今年6月已启动机器人团队招聘,其世界模拟研究项目也已逐步演变为OpenAI Robotics。
就在Astra发布后不久,ChatGPT和Codex一度出现错误率升高,故障持续约两小时后解决。尽管OpenAI尚未披露具体根因,但有媒体报道称此次服务器波动系OpenAI在北美的服务器运营商宕机引起。AI基础设施的稳定性,正成为业界关注的焦点。
综合新华网、新华社、第一财经、上海证券报报道 | 2026年9月4日