7月31日,AI圈上演了一出真正的"双雄会"。DeepSeek V4-Flash正式版API公测上线,性能直接原地起飞——Terminal Bench 2.1拿下82.7分(预览版才61.8),DeepSWE从7.3飙到54.4,9项Agent基准全面碾压自家V4-Pro预览版。另一边,OpenAI也不甘示弱,GPT-5.6 Luna降价80%,输入直接打到0.20美元/百万token,还推出最高提速2.5倍的Fast模式Sol。一个狂卷性能,一个猛砍价格,这场贴身肉搏比宫斗剧还精彩。

DeepSeek这波操作堪称"加量不加价"的教科书。284B总参/13B激活的MoE架构,纯靠后训练优化就实现了Agent能力的飞跃。实测同任务40秒搞定,而GPT-5.6 Sol要1分47秒——这速度差快赶上高铁对绿皮车了。更狠的是价格:输入1元/百万token,输出2元/百万token,51万token消耗仅0.53元,输出价格约为Claude的1/90。这哪是打价格战,简直是在做慈善。网易有道全线产品已经接入,动作快得像抢首发。

OpenAI显然坐不住了。Luna降价80%摆明了要抢回中小开发者市场,微软CEO纳德拉亲自下场强调"高性价比"。但明眼人都看得出,这次是DeepSeek在技术维度上先出了王炸——原生支持Responses API+Codex适配,还支持FP4/FP8低精度推理可部署国产芯片,这招直击算力卡脖子的痛点。谷歌本月也推出三款成本优势新模型,Gemini 3.6 Flash成本低于Kimi K3,整个市场被搅成一锅粥。

回头看这场混战的导火索,DeepSeek旧端点7月24日已停用,全面切换V4架构,V4-Pro正式版预计8月初推出——时间点卡得精准如手术刀。OpenAI的降价更像被动防御,毕竟当对手用1/90的价格实现2倍以上速度时,光靠品牌溢价已经撑不住场面了。这场技术战与价格战的全面升级,最大的受益者显然是开发者:以前用不起的顶级模型,现在白菜价随便跑。

大模型的军备竞赛正在进入新阶段:不再单拼参数,而是拼工程优化、拼部署效率、拼生态适配。DeepSeek用后训练技巧把MoE架构榨出极限性能,OpenAI则用降价换生态。但真正的胜负手,或许在8月初V4-Pro正式版发布那一刻。届时如果性能再上一个台阶,OpenAI的降价牌还能不能打?这场好戏,才刚刚开场。

AI 生成 · DeepSeek | 搜索综合