🤖 人工智能 · 大模型

🔥 大模型迭代速度已从"年更"狂奔到"月更",一个月9款旗舰密集发布,AI行业正式进入"月抛时代"。

一、一个月9款,旗舰机变身快消品

2026年7月到8月初,大模型圈上演了一场史无前例的"旗舰机海战"。仅在2026世界人工智能大会期间,就有至少9款超节点产品发布或上市,涵盖昇腾950、真武M890等重磅选手。加上小米MiMo-V2.5、DeepSeek V4 Pro、智谱GLM-5.2、Kimi K3等头部模型的密集迭代——一个月内9款旗舰齐发,上一代还没捂热,下一代已经登场。#一个月9款旗舰,大模型进入月抛时代#不再是段子,而是2026年夏天最真实的产业写照。

这背后是产业链上下游的集体"军备竞赛"。供需两端都在加速:需求端,智能体(Agent)大规模落地,单次任务算力消耗可达普通对话的百倍,模型被"吃掉"的速度远超预期;供给端,国产芯片和算力基础设施持续加码,让模型迭代成本大幅降低。

二、词元经济爆发,涨价是"成长的烦恼"

模型迭代越快,算力吃得越狠。根据最新数据,中国大模型周调用量已达36.11万亿词元,连续十二周稳居全球首位。开源AI编程平台OpenCode数据显示,仅8月1日一天,DeepSeek-V4-Flash的Token处理量就冲到8万亿。调用量飙升的同时,成本压力也传导到了定价端——DeepSeek计划整体上调API定价,涨幅"较大";智谱年内已先后三次上调API价格;月之暗面Kimi K3新一代API定价较上代提升了3到4倍。

涨价不是坏事,恰恰说明行业从"烧钱换规模"进入了"价值回归"阶段。AI芯片公司曦望智能董事长徐斌直言,2026年上半年推理算力租赁价普遍上涨40%以上,市场从买方转向卖方。大模型不是一次性训练完就能低成本复制的,每一次调用都在消耗真金白银。

三、国产模型霸榜全球,开源力量重塑格局

OpenRouter最新月度榜单显示,全球大模型调用量前六名全部被中国开源模型包揽——小米MiMo-V2.5、DeepSeek V4 Flash、腾讯HY3、MiniMax M3、智谱GLM-5.2、DeepSeek V4 Pro。中国模型全球市场份额已超过美国,占据约三分之二。中国研发的开源模型下载量占全球总量的41%,超越美国位居世界第一。

综合中国经济网、长安街知事、中国企业家杂志、数字中国网报道 | 2026年8月10日