🤖 AI大模型 · 算力经济

🔥 8万亿Token单日消耗,标志着大模型行业正式从"价格战"切换至"算力极限"的新竞争阶段。

一、8万亿Token是什么概念?全球模型调用量登顶

据海外开发者平台OpenCode披露,8月1日,DeepSeek V4 Flash单日处理Token总量达到8万亿,其中5万亿来自免费试用额度,3万亿来自付费调用。同期,OpenRouter平台周榜显示,该模型以7.22万亿Token的周调用量登顶全球模型调用榜首,超过平台上400多款模型的总调用量。

一个模型的单日消耗量,碾压了容纳数百款模型的平台总调度量。OpenCode CEO Jay发文称,DeepSeek V4 Flash正式版上线后,平台使用量单日增长30%,新增订阅用户也飙升30%。更值得注意的是,OpenAI核心产品负责人甚至在评论区打起了自家Luna模型的广告,却被开发者当场回怼:"我们只想要DeepSeek的价格。"

二、免费额度烧出行业天花板,算力代价谁来扛?

8万亿Token中,5万亿来自免费试用,意味着每日烧掉的是真金白银的算力成本。V4 Flash采用MoE架构,总参数284B,支持100万Token超长上下文和深度思维链推理。随着Agent类智能体应用爆发,单次任务Token消耗从对话时代不足2000个跃升至50万到100万个,推理成本呈指数级攀升。

有业内人士测算,V4 Flash此前"输入1元/百万Token、输出2元/百万Token"的定价大概率低于真实成本,毛利率为负。Artificial Analysis基准测试显示,V4 Flash单次任务成本仅约0.03美元,而GPT-5.6 Sol约1.86美元,Claude Fable 5高达3.15美元——DeepSeek的价格仅为Claude的1/105,这种极致性价比正在倒逼全行业重新定价

三、涨价信号密集释放,AI低价红利时代落幕

8月6日DeepSeek宣布近期整体上调API定价、预计涨幅较大;此前已落地峰谷翻倍计费;智谱年内三次调价累计涨83%却依然供不应求;Kimi K3输入价格涨超3倍、输出价格涨近4倍——国内大模型行业正在集体告别烧钱换份额的野蛮扩张,全面转向成本与价值匹配的商业化新阶段。

对大型企业来说,通过长协算力和多模型路由可以对冲涨价冲击;真正受冲击的是高度依赖第三方API的中小开发者。赛道竞争格局将被重塑:拥有自研轻量化模型、具备私有部署能力的企业将进一步放大竞争优势,而单纯靠倒卖API的中间商将加速出清。8万亿Token这道分水岭,传递出的最核心信号是:Agent时代真正到来后,算力不再是廉价的水电煤,而是一场关于效率与成本的精算游戏

综合第一财经、界面新闻、中国经济网报道 | 2026年8月10日