🎯 科技 · AI大模型

🔥 DeepSeek提价后调用量腰斩,但"热度过去"是假象——中国AI大模型正迎来新一轮价格战

一、峰值已过,但中国模型仍在领跑

8月16日,DeepSeek V4系列突然大幅调价,高峰时段涨幅最高达1100%。结果立竿见影:OpenCode上DeepSeek Flash的日Token消耗量从峰值18万亿骤降至不到一半,空出了接近10万亿Token的日需求。不少人因此得出一个结论:DeepSeek的热度这么快就过去了吗?答案或许没那么简单。

事实上,就在DeepSeek提价仅9天后,智谱AI以匿名模型"Ox Alpha"(昵称"牛来")身份上线OpenRouter,5天承接了50万亿Token调用量,一举终结DeepSeek连续56天霸榜的纪录。8月26日晚,智谱正式认领该模型,确认为GLM-5.3-Flash——总参数3200亿,每次调用仅激活约180亿参数,性能对标Claude Opus 4.8,定价却只有DeepSeek闲时价的六成。

这并非DeepSeek独占鳌头的时代落幕,而是中国AI大模型竞争进入新阶段的标志。据每日经济新闻8月31日报道,中国AI大模型周调用量已连续18周超过美国,稳居全球首位。

二、提价是退场还是洗牌?

DeepSeek的涨价逻辑并不复杂。8月1日V4-Flash正式版上线后,两周内日调用量从3万亿飙升至18万亿,增长6倍,相当于再造了一个OpenRouter。OpenCode CEO估算,这部分增量需要约1000块B300 GPU才能扛住。

但提价后,OpenCode上DeepSeek留下的每天约10万亿Token缺口,立刻成为所有模型厂商的机会。智谱用10万张国产芯片扛住这波流量,MiniMax上半年开放平台收入暴涨7倍,市场证明了一点:需求真实存在,只是等待更低的价格承接。

值得玩味的是,GLM-5.3-Flash的缓存命中价格(0.23元)远高于DeepSeek V4-Flash的谷时价(0.05元)。对于高缓存命中的Agent任务,DeepSeek依然更便宜。这意味着智谱"砍"到的,主要是DeepSeek的峰时用户,而非全部用户。

三、热度没有过去,只是换了一种玩法

回顾DeepSeek的崛起路径:2025年初以"价格屠夫"姿态席卷全球,2026年7月V4-Flash正式版登顶OpenRouter,8月中旬提价后短暂回调,随即被"牛来"接过接力棒。表面看是热度消退,实则是中国AI大模型从"一家独大"走向"多强并起"的必经之路。

中国模型周调用量连续18周领跑全球,这不是DeepSeek一个人的功劳,而是整个中国AI生态集体跃升的结果。当智谱、MiniMax、阶跃星辰等厂商同台竞技,"热度"不会过去——它只会从一个人手中,传递到更多人手中。

综合每日经济新闻、蓝鲸新闻、The Information报道 | 2026年8月31日