🎯 AI产业 · 全球竞争

🔥 斯坦福AI指数报告:中美顶尖模型差距仅2.7%,AI竞争从模型比拼转向全体系博弈

一、中美AI差距缩小至2.7%,头部模型多次互换领先

9月3日,斯坦福大学以人为本人工智能研究院(HAI)正式发布《2026年人工智能指数报告》官方中文版。报告给出一个引人注目的数字:中美顶尖模型在Code Arena排行榜上的性能差距已收窄至2.7%,双方头部模型已多次互换领先位置。中国智谱GLM-5.2在全球百万用户参与的盲测中综合成绩位列第一,国产模型顺利完成从"可用"向"好用"的关键跃升。

报告同时指出,AI已脱离单纯的模型能力竞赛,正在向基础设施、组织流程与制度层面的系统性变革深化。全世界领先模型在软件工程基准SWE-bench上表现已接近人类100%水平,智能体在真实计算机环境的任务成功率从12%跃升至66%,AI正从"生成信息"向"执行任务"演进。

二、物理基础设施成AI发展核心约束

报告揭示了一个被很多人忽视的关键事实:全球AI数据中心电力容量已达29.6吉瓦,芯片、能源、水资源正成为AI发展的关键战略瓶颈。当模型能力逼近物理极限时,算力基础设施的争夺战才刚刚开始。

在中国,这一趋势同样清晰可见。2025年中国产出30款主流大模型,美国产出50款,创新体量稳步增长。更值得关注的是,在Hugging Face平台上,中国模型的下载量占比达到41%,首次超过美国的36.5%,中国成为该平台最大的开源模型供给方。OpenRouter平台上,中国开源模型的Token消耗占比在2026年5月已达约61%,平台周榜前五名全部来自中国机构。

三、从"能力溢价"到"经济理性":AI产业逻辑重构

2026年以来,大模型产业彻底告别单一能力竞赛,形成"能力为王、成本制胜"的双重竞争范式。DeepSeek V4 Flash每百万Token输入定价仅0.09美元,而OpenAI GPT-5.5输入定价为5美元,相差55倍。硅基数据指数显示,全球主流大模型Token支出已首次跌破每百万Token 1美元关口,创历史新低。

成本重构正在改写行业格局。旧金山AI创业公司Lindy将全生产环境流量从Anthropic切换至DeepSeek,年省数百万美元;加密货币交易所Coinbase将智谱GLM-5.2和月之暗面Kimi设为工程师默认模型,AI支出压缩近半。微软则在Excel、Outlook中以自研MAI模型逐步替代第三方模型。企业选型全面回归经济理性,开源低成本模型加速替代闭源高价模型。

综合科创板日报、新华社报道 | 2026年9月3日