🤖 AI大模型 · 科技前沿

🔥 DeepSeek-V4-Flash以"白菜价"拿下全球调用量冠军,但庞大的成本压力正倒逼国产大模型集体告别价格战。

一、一骑绝尘的调用量

全球模型分发平台OpenRouter最新周度榜单显示,7月27日至8月2日这一周,DeepSeek-V4-Flash以7.22万亿Token的周调用量登顶全球第一,超过了平台上400多款模型的总调用量。这是什么概念?杭州科技局官方披露的数据更直观:DeepSeek-V4-Flash已成为全球知名模型中运行成本最低的一款,其运行成本仅相当于Anthropic旗舰模型Claude Fable 5的不到1/100。

另一平台OpenCode的数据同样炸裂。8月1日单日处理Token总量达8万亿Token,其中5万亿来自免费试用额度,3万亿为付费调用。OpenCode CEO Jay发文称,DeepSeek-V4-Flash上线后使用量单日增长30%,新订阅用户也涨了30%。一个模型的单日消耗量,已经超过了容纳数百款模型的平台总量。

二、"性价比之王"的两难

低价策略让DeepSeek吃到了用户规模的红利,但也埋下了隐患。Artificial Analysis基准测试显示,V4-Flash单次调用成本约0.03美元,而Claude Fable 5要3.15美元,差距达到105倍。以当前定价"输入1元/百万Token、输出2元/百万Token"计算,有业内人士测算其毛利率已为负数——卖得越多亏得越多,堪称大模型界的"赔本赚吆喝"。

更深层的变化来自调用结构。随着V4系列全面支持100万Token上下文窗口和深度思维链推理,Agent类应用爆发使单次任务Token消耗从不足2000个跃升至50万到100万个。调用量暴涨叠加任务复杂度提升,算力压力可想而知。8月4日,DeepSeek官方一度因"前所未有的访问量"出现容量不足问题。

三、集体告别"价格战"

8月6日,DeepSeek在开放平台正式预告:计划近期整体上调API服务定价,预计涨幅较大。这并非孤例。今年以来国内大模型厂商已迎来集体调价潮:智谱AI年内三次上调API定价,一季度调用量仍增长400%;月之暗面Kimi K3发布时输入价格较前代涨超3倍,输出价格涨近4倍。

AI评测机构Artificial Analysis提出,V4-Flash已成新一代"斩杀线"——其智能指数50分、单次仅3美分的性价比,让约70%的大模型产品落入被替代的风险区。智谱CEO张鹏说得直接:"长期依赖低价竞争并不利于整个行业发展。"DeepSeek此番涨价,既是对冲算力成本压力,也是在为全行业拓宽容错缓冲空间——毕竟企业可以亏一阵子,不能亏一辈子。

综合中国经济网、第一财经、经济参考报、杭州市科技局报道 | 2026年8月10日