🤖 AI · 大模型
一、正式版来了:Agent能力飙涨7倍🔥 DeepSeek V4-Flash正式版以不足旗舰竞品1%的运行成本,实现Agent能力飙升超7倍,国产大模型性价比再次刷新天花板。
7月31日,DeepSeek官宣#DeepSeek V4 flash 正式版发布#,API面向公众开启公测。此次更新延续2840亿总参数、130亿激活参数的MoE架构,100万Token超长上下文能力不变,但经过新一轮后训练,模型在关键基准测试上实现质的飞跃。DeepSWE软件工程基准从7.3飙升至54.4,Terminal Bench达82.7,已逼近Claude Opus 4.8水平。模型原生支持Responses API,极大降低了代码助手、工具调用和智能体应用的接入门槛。
更值得关注的是模型支持思考/非思考双模式,开发者可根据任务复杂度灵活切换,2000万Token的Agent任务折前成本仅约3.5美元,这对企业级应用堪称"白菜价"。
二、成本杀手:仅旗舰竞品1/105研究机构Artificial Analysis公布的基准数据显示,V4-Flash完成单次测试平均成本仅3美分,远低于月之暗面Kimi K3的86美分、OpenAI GPT-5.6的1.86美元和Claude Fable 5的3.15美元。整体运行成本不足Anthropic旗舰模型Claude Fable 5的1%,约为后者的1/105,被业界称为"成本杀手"。
在智能指数评分中,V4-Flash拿下50分,与Google Gemini 3.6 Flash持平。考虑到其定价优势,V4-Flash在性价比维度上几乎碾压所有主流竞品。目前中国联通北京分公司已基于国产算力服务器完成该模型部署,引入DSpark新一代推测解码加速框架,进一步提升推理效率。
三、商业化加速:年收入或达5亿美元据知情人士透露,V4-Flash发布正值DeepSeek商业化进程加速阶段,公司正筹备潜在IPO。通过AI模型API云服务,DeepSeek年度经常性收入已达4亿至5亿美元,毛利率超过50%。模型以MIT许可证开源权重,兼顾开源社区的生态建设和商业变现。
从产业角度看,推理成本大幅下降将加速AI应用规模化部署,进而拉动国产算力芯片及基础设施需求。国产大模型正从"追赶到平价超越"迈进,这条赛道的确定性正在持续强化。
综合新华网、界面新闻、金融界、Artificial Analysis报道 | 2026年8月5日