🤖 AI大模型 · DeepSeek · 科技前沿

🔥 DeepSeek V4-Flash正式版以不到旗舰竞品1%的运行成本,实现了Agent能力的跨越式提升,正在用"轻量级、低成本、高性能"三板斧重塑AI应用商业化格局。

一、Flash先行:Agent能力大幅跃升

7月31日,DeepSeek悄然上线了DeepSeek-V4-Flash正式版API公测。别被"Flash"这个轻量化名头骗了,这次升级一点都不"闪"。模型保持2840亿总参数、130亿激活参数的MoE架构不变,仅通过新一轮后训练实现能力跃迁——Terminal Bench 2.1得分82.7,Cybergym网络安全模拟得分76.7,Toolathlon工具调用综合测试70.3分,三项核心指标均远超预览版。翻译成人话就是:新模型在"自己动手干活"这件事上,已经从实习生升级成了熟练工。

更让开发者兴奋的是,正式版原生支持Responses API格式,并针对性适配了Codex生态。只需一次配置,就能在Codex CLI、ChatGPT桌面端和VS Code的Codex插件中直接调用V4-Flash。把它塞进开发流水线帮写代码、查Bug甚至搭建项目——这个场景已经落地了。

二、极致性价比:成本不足旗舰竞品1%

如果说Agent能力是DeepSeek的"软实力",那价格就是它真正的杀手锏。研究机构Artificial Analysis数据显示,V4-Flash定价为每百万输入Token仅0.14美元,输出Token 0.28美元,单次测试平均成本仅3美分。作为对比:月之暗面Kimi K3要86美分,OpenAI GPT-5.6要1.86美元,而Anthropic Claude Fable 5高达3.15美元——差距超过100倍

在智能指数评分中,V4-Flash拿到50分,与Google Gemini 3.6 Flash持平,性价比优势撑起了另一条竞争维度。与此同时,多家平台迅速跟进部署:国家超算互联网已上线V4-Flash API且1700余款AI模型可一键调用,中国联通京元平台基于国产算力完成部署并将推理速度提升到MTP方案的2倍,TPS达到60以上。轻量模型的低成本正在推动AI应用从"用得起"走向"铺得开"。

三、V4-Pro待发:商业化进入快车道

这次更新仅覆盖V4-Flash的API接口,普通用户用的DeepSeek App和Web端暂时没有变化。但DeepSeek官方明确表态:V4-Pro正式版将尽快发布。华尔街见闻援引知情人士消息称,DeepSeek正筹备潜在IPO,其AI模型API云服务年经常性收入已达4至5亿美元,毛利率超50%。Flash版先打头阵验证市场,Pro版蓄势冲击旗舰梯队——这套路数很有章法。

从行业视角看,国产大模型正在全球市场集体发力:OpenRouter最新周调用量榜单前五被中国模型包揽,Hugging Face上中国开源模型下载量全球第一。DeepSeek V4-Flash以MIT许可证开源权重,每百万Token仅1元人民币的成本,正在把AI能力变成像水电一样的基础设施。一个轻量模型追平三个月前旗舰性能的时代,已经来了。

综合新华网、潮新闻、上海证券报、通信世界网、金融界报道 | 2026年8月5日