🤖 人工智能 · 大模型 · API服务
一、正式版上线,三大核心升级🔥 DeepSeek V4 Flash正式版API上线,智能体能力大幅增强、全球调用量断崖式登顶,国产大模型商业化进入"量价博弈"新阶段。
7月底,DeepSeek-V4-Flash正式版API正式面向开发者开放公测,取代此前的预览版。此次升级重点体现在三个方面:第一,智能体(Agent)能力显著增强,在多项智能体编程和代码任务中的表现较预览版有明显提升;第二,加入了推测解码(Speculative Decoding)模块,推理效率进一步优化;第三,全面兼容主流调用格式,降低开发者的迁移成本。用开发者的话说,这次更新"不是小修小补,是脱胎换骨"。
大模型评测机构SuperClUE的数据佐证了这一点。在其智能体终端编程中文测评中,#DeepSeek-V4-Flash正式版API上线公测# 的V4-Flash-0731版以0.64元/题的成本取得46.46分,虽然得分位列第三,但单位成本仅为前两名模型的1/30和1/36。每道测评题目需要模型经历50到110轮的多轮对话交互,完整运行时长约半小时到一个半小时——在这个维度上,V4 Flash的性价比堪称"降维打击"。
二、调用量暴增,服务器一度"扛不住"正式版上线后,市场反应迅速且猛烈。OpenRouter平台数据显示,从7月31日至8月5日,V4-Flash-0731的日调用量从1170亿Tokens猛增至近1.26万亿Tokens,增幅高达十倍。8月1日,OpenCode平台记录到V4 Flash单日处理Token总量达到8万亿,8月4日更因前所未有的访问量出现容量不足——服务器被开发者"挤爆了"。
调用量的飙升并非偶然。国家数据局今年3月披露,我国日均Token调用量已突破140万亿,较2024年初增长超过千倍。伴随智能体应用爆发,单次任务消耗的Token数远超传统聊天场景,Token需求正在以指数级速度攀升,而V4 Flash恰好踩在了这个浪潮的浪尖上。
三、低价策略迎拐点,行业进入"算力经济学"时代就在正式版上线后不久,8月6日DeepSeek发布公告,计划近期整体上调API服务定价,预计涨幅较大。目前V4 Flash缓存命中输入仅0.02元/百万Tokens,V4 Pro缓存未命中输入3元/百万Tokens,相比OpenAI GPT-5.5的定价仍有数量级差距。有业内人士分析,此次调价既是算力成本倒逼的结果,也是为行业"拓宽容错空间"——当一条"斩杀线"把70%的竞品都压在下面,适当提价反而有利于整个生态的可持续发展。
从更长的视角看,从4月发布预览版到5月永久降价,再到6月引入峰谷计价、7月正式版上线、8月预告涨价,DeepSeek在短短四个月内完成了"铺量-占位-变现"的三级跳。国产大模型的商业化路径正在从"烧钱换市场"走向"量价平衡",这是行业走向成熟的标志,也是所有开发者和企业用户需要重新算账的时刻。
综合经济参考网、上海证券报、OpenRouter数据报道 | 2025年8月8日