🎯 科技 · AI+数学
🔥 GPT-6 Astra一举将素数间距上界从246推至186,陶哲轩却发出AI告警
OpenAI的GPT-6 Astra模型最近干了件惊天动地的事——用形式化证明把孪生素数猜想的连续素数间距上界从246缩小到了186。这是数学界几十年来未解的重大突破,而这背后站着一个正在改变规则的人工智能。
孪生素数猜想是数论中最著名的开放问题之一:是否存在无穷多对间距为2的素数?2013年张益唐突破性证明了存在无穷多对间距不超过7000万的素数,震惊世界。此后数学家们不断压缩这个上界,2022年菲尔兹奖得主James Maynard将上界缩小到了600,2024年团队进一步压到了246。而现在,GPT-6 Astra用一道Lean形式化证明,把这个数字推到了186——一个人类团队花了数年才啃下的硬骨头。
一、AI写数学证明,到底有多强?GPT-6 Astra在Epoch AI联合曼彻斯特大学发布的 FrontierMath Erdős(FME)基准测试中,成为全场唯一交出有效答卷的大模型。在68道人类悬而未决的Erdős数学难题中,它一举攻克5道,其余GPT-5.6、Claude Fable 5.1等四款主流AI全部得0分。标准测试环节它解决了2道题,放宽算力预算的追加实验中又拿下3道,其中包括Erdős 18岁提出、自称"人生第一个正经问题"的1931年解离集猜想,以及极值图论赫赫有名的Erdős-Sós猜想。
这些题目数十年来困住了无数顶尖数学家。GPT-6 Astra完成五道题全部尝试合计消耗超22万美元算力,按300美元一次、3%成功率计算,解出一道重要开放问题的期望成本约为1万美元。这意味着,人类数学家穷尽一生攻不破的难题,AI用算力就能翻越。OpenAI总裁格雷格·布罗克曼宣称:"欢迎来到AGI时代。"
二、陶哲轩为何发出AI告警?然而,数学界最伟大的头脑之一陶哲轩却发出了一则AI告警——他对GPT-6在孪生素数猜想上的突破表达了复杂态度。一向积极拥抱AI的陶哲轩指出:AI解题太快、过程又太黑盒,这种能力反而可能掩盖了数学研究过程中那些宝贵的"失败"。
陶哲轩举了一个具体例子:纳维-斯托克斯方程全局正则性问题。如果AI直接吐出正确答案,那这个问题的答案可能由AI生成,但它出现的方式会"污染"这个问题,使其不再能够像过去那样成为推动后续数学进展的源泉。真正关键的是推进研究的过程——从历史上看,人们试图证明全局正则性或证明有限时间爆破的过程中,不断产生出流体力学、分析学领域最基础、最有影响力的一批思想和定理。Leray–Hopf弱解、Gagliardi–Nirenberg–Ladyzhenskaya不等式等里程碑式的成果,都诞生于这条探索之路。
陶哲轩的核心担忧是:一旦AI知道正确答案,它就会抑制对其他路线的探索。那些表面上看只是"死胡同"的路径,为什么会失败,本身往往极具启发性。
三、这不仅是数学问题GPT-6 Astra的发布本身就充满戏剧性——上线数小时内,CEO奥尔特曼就在X平台致歉,称"发布过程比较混乱"。原因是OpenAI采取了分阶段发布,优先向Daybreak网络安全平台的特定企业客户开放,其余Plus、Pro、Business及Enterprise订阅用户需等待"未来数天"。
更值得警惕的是,Astra首次达到OpenAI内部"关键"网络安全能力门槛——模型已能在较少人类干预下识别此前未知的软件漏洞并开发漏洞利用方式。API定价也引发热议:每百万Token输入10美元、输出50美元,是上代2.5倍。而OpenAI同步警告,这一模型的监控难度可能更高,正进一步加强安全"护栏"。
AI破解数学难题是里程碑,但陶哲轩的担忧同样不容忽视——当答案来得太容易,探索过程中的那些"死胡同"价值谁来衡量?GPT-6打破孪生素数猜想最新纪录,标志着AI辅助数学研究的新纪元开启,但如何在效率与深度之间取得平衡,仍是人类数学家需要回答的问题。
综合量子位、中新经纬、快科技报道 | 2026-09-06