🤖 AI科技 · 大模型
一、8万亿Token意味着什么🔥 DeepSeek V4 Flash单日Token处理量突破8万亿,低价策略正在被指数级增长的需求"反噬"
8月1日,海外开发者平台OpenCode披露了一组惊人的数据:DeepSeek V4 Flash在平台上单日处理Token总量达到8万亿,其中5万亿来自免费试用额度,3万亿来自付费调用。就在同一周,模型聚合平台OpenRouter也录得DeepSeek V4 Flash以7.22万亿Token的周调用量登顶全球模型调用榜首——一个模型的调用量,超过了该平台400多款模型的总和。国家数据局此前公布的数据显示,2026年3月我国日均Token调用量已突破140万亿,较2024年初增长超千倍。单模型单日8万亿,已经不能用"火爆"来形容了,这是基础设施级别的流量压力。
更值得关注的是调用结构的质变。随着V4系列全面支持100万Token上下文窗口和深度思维链推理,用户调用的不再是简单问答,而是大量包含Agent循环的复杂任务。单次任务Token消耗从对话时代的不足2000个,跃升至50万到100万个。换句话说,机器在驱动机器,Token消耗正以指数级裂变。
二、低价红利的尽头DeepSeek一直以"价格屠夫"著称。V4 Flash输入1元/百万Token、输出2元/百万Token的定价,仅为Claude Fable 5的1/105,甚至比OpenAI降了80%之后的GPT-5.6 Luna还要便宜约60%。但低价也意味着亏损——有业内人士测算,这一价格大概率低于真实成本,毛利率为负。当单日调用量达到万亿级别,即使是边际成本极低的推理服务,硬件折旧、电力和运维费用的总量累积也是一笔天文数字。
8月6日,DeepSeek正式发布公告,计划近期整体上调API服务定价,预计涨幅较大。这已是年内至少第三次价格调整:从6月底引入峰谷双倍计费,到如今"整体上调"的明确预告,信号已经非常清晰——靠资本补贴换市场份额的烧钱时代正在终结。
三、全行业的价格"回归"涨价绝非DeepSeek一家的选择。2026年以来,国内大模型厂商迎来集体涨价潮:智谱AI年内多次上调定价,一季度调用定价较去年底提升约83%,但调用量仍增长400%,呈现"量价齐升";月之暗面Kimi K3输入价涨超3倍、输出价涨近4倍;阿里云、百度智能云也同步调整AI算力产品价格。海外方面,OpenAI的GPT-5.6 Luna降价80%之后仍然比DeepSeek贵,说明成本压力是全行业的共同课题。
核心矛盾在于:Agent智能体爆发带来的算力需求,已经超过了硬件供给和低价模式的承载极限。当全球高端GPU和HBM显存持续紧张,厂商必须做出选择——继续亏损换流量,还是回归商业健康。答案已经写在了8万亿Token这个数字里:不是不想卖得便宜,是实在扛不住了。
综合第一财经、中国企业家、上海证券报、经济参考网报道 | 2026年8月10日