🎯 科技 · AI报告
🔥 中美顶尖模型差距收窄至2.7%,AI竞争从模型比拼转向全体系博弈
9月3日,斯坦福大学以人为本人工智能研究院(HAI)正式发布《2026人工智能指数报告》官方中文版。报告揭示了一个重要信号:全球领先模型在软件工程基准SWE-bench上的表现已接近人类100%水平,而AI智能体在真实计算机环境中的任务成功率从2025年的12%跃升至66%,AI正从"生成信息"向"执行任务"加速演进。任务成功率提升5.5倍,标志着AI从辅助工具迈向独立执行者的关键转折。
更引人注目的是,中美顶尖模型差距已收窄至2.7%。双方头部模型在多项基准测试中已多次互换领先位置,技术代差持续抹平。智谱GLM-5.2在全球百万用户参与的Code Arena排行榜盲测中综合成绩位列全球第一,国产模型顺利完成从"可用"向"好用"的关键跃升。2025年,美国产出50款主流大模型,中国产出30款,创新体量稳步增长,推动全球AI竞争格局向均衡多元方向演进。
报告同时指出,物理基础设施正成为AI发展的核心约束。全球AI数据中心电力容量已达29.6吉瓦,芯片、能源、水资源正成为AI发展的关键战略瓶颈。按峰值FP16算力口径估算,2025年美国AI算力约为中国的16倍,这一差距到2027年可能扩大至约25倍。
中美两国面临的核心瓶颈并不位于同一层。中国主要约束来自先进AI芯片,受美国出口管制及本土芯片性能、产能、配套生态不足影响;美国则面临电力供应、并网审批和数据中心建设等基础设施约束。这些不同层面的约束,最终都会反映在AI数据中心的建设速度和有效算力的部署规模上。
低成本、高效率的模型供给能力,正从企业竞争力上升为国家层面的产业竞争力。OpenRouter数据显示,DeepSeek V4 Flash每百万词元输入定价仅0.09美元,而OpenAI GPT-5.5输入定价为5美元,输入端相差55倍,输出端相差166倍。性能差距持续收窄的同时,中国开源大模型定价低至每百万词元0.18美元,性价比优势驱动市场加速重构。
企业选型正全面回归经济理性。微软在Excel、Outlook中以自研MAI模型逐步替代第三方模型;加密货币交易所Coinbase将智谱GLM-5.2和月之暗面Kimi K2.7设为工程师默认模型,AI支出压缩近半。从科技巨头到初创企业,行业技术选型正从"唯性能论"转向"性能-成本综合权衡",开源低成本模型正在加速替代闭源高价模型。
综合科创板日报、人民网报道 | 2026年9月3日