🤖 人工智能 · 大模型产业
一、8万亿Token背后:国产大模型的全球登顶时刻🔥 DeepSeek V4 Flash单日Token处理量突破8万亿,既是国产大模型登顶全球的里程碑,也是算力承压、免费红利终结的转折信号。
8月1日,开源AI编程平台OpenCode公布了一组令人震撼的数据:DeepSeek V4 Flash在其平台上单日处理Token总量达到8万亿,其中5万亿来自免费试用额度,3万亿为付费调用。与此同时,模型聚合平台OpenRouter最新周度榜单显示,DeepSeek V4 Flash以7.22万亿Token的周调用量登顶全球榜首,前五名全部被国产大模型包揽——小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro、智谱GLM5.2紧随其后。一个模型的单日消耗量,已超过容纳数百款模型的平台总量,这是中国AI产业从未有过的纪录。
OpenCode CEO贾亚库马尔发文称,DeepSeek V4 Flash上线后平台使用量单日增长30%,新订阅用户也同步增长30%。国产大模型正从"跟跑者"变为全球开发者首选,以极致性价比改写了全球AI调用版图。科技日报援引专家分析指出,这背后是国内企业在混合专家架构、稀疏注意力、长上下文压缩等全链路工程能力上的系统突破。
二、Agent爆发:算力消耗从"对话级"到"任务级"的质变8万亿Token的背后,不只是用户数量的增长,更关键的是调用结构发生了根本性变化。DeepSeek V4系列全面支持100万Token上下文窗口和深度思维链推理后,用户调用不再局限于简单问答。智能体(Agent)大规模落地,单次任务Token消耗从对话时代的不足2000个跃升至50万到100万个,实现了数量级的增长。传统对话模式下,用户问一句模型答一句;而Agent场景中,模型要经历多轮思考、工具调用、循环纠错,每条任务背后都是巨大的算力燃烧。
有业内人士测算,DeepSeek V4 Flash此前"输入1元/百万Token、输出2元/百万Token"的定价大概率低于真实成本,毛利率为负。模型越受欢迎,算力缺口和边际成本同步扩大,低价补贴模式走到了尽头。这一幕并非DeepSeek独有——今年以来智谱AI三次上调API定价、Kimi K3官方定价较上代涨了3到4倍、腾讯云混元系列部分接口最高涨幅超460%,全行业正在从"价格换份额"切换到"商业可持续"的轨道。
三、从价格屠夫到价值回归:国产大模型的成人礼过去两年,DeepSeek一直是国内大模型价格战最猛烈的推手。V4 Pro永久定价仅为原价的四分之一,每百万Token输入约0.44美元、输出约0.87美元,同期OpenAI GPT-5.5的价格分别是5美元和30美元——相差近百倍的价差让DeepSeek成为全球开发者眼里的"性价比之王"。然而8月6日,DeepSeek发布公告称"计划近期整体上调API服务定价,预计涨幅较大",叠加此前已落地的峰谷翻倍计费规则,这家"价格屠夫"正亲手终结自己开启的低价时代。
涨价引发的阵痛在开发者社区激起千层浪——有人感慨"便宜到我们敢把Agent真正跑起来,敢拿它做产品"的时代结束了,也有人理性指出这正是行业走向健康的必经之路。当8万亿Token单日处理量成为常态,单纯靠资本补贴压低价格已不现实,成本向下游传导是市场回归理性的必然选择。对于应用开发者而言,未来的竞争力不在于"接入了最强模型",而在于能否建立模型分层和动态路由策略,以最合适的成本完成最合适的任务。AI产业的下半场,拼的不再是谁更便宜,而是谁更可持续。
综合第一财经、中国经济网、科技日报、界面新闻报道 | 2026-08-10