今
🤖 AI大模型 · 深度评测
🔥 V4-Flash正式版以不到Claude Fable 5百分之一的成本,实现了同等梯队的智能水平,正在重新定义"好用"的性价比边界。
一、性能跃迁:后训练优化的力量
... 展开 ▼
🤖 AI大模型 · 深度评测
🔥 V4-Flash正式版以不到Claude Fable 5百分之一的成本,实现了同等梯队的智能水平,正在重新定义"好用"的性价比边界。
一、性能跃迁:后训练优化的力量
DeepSeek-V4-Flash正式版最令人意外的一点在于:相比4月预览版,模型架构和2840亿参数规模完全没变,仅靠后训练优化就让Agent能力提升了6倍以上。最近#如何评价Deepseek-V4-Flash正式版#成为圈内热议话题,核心焦点正是这种"不靠堆参数、只靠炼内功"的迭代思路。
美国研究机构Artificial Analysis的独立评测显示,V4-Flash在"智能指数"上拿到50分,与谷歌Gemini 3.6 Flash持平,比智谱GLM-5.2仅低1分。虽然离GPT-5.6 Sol(约57分)和Kimi K3还有差距,但考虑到其每项智能任务的加权平均成本仅3美分,不到Claude Fable 5的百分之一,这个性价比可以说是碾压级别的。
二、价格屠夫:API定价的降维打击
V4-Flash的定价策略堪称激进:缓存命中输入仅0.02元/百万Token,未命中输入1元,输出2元。缓存命中价格仅为未命中的2%,远低于行业10%的平均水平,相当于在骨折价基础上又砍了一刀。
海通国际最新研报指出,DeepSeek V4与Kimi K3正在联手推动海外模型市场进入新一轮价格竞争。OpenAI近期已主动下调GPT-5.6价格,但V4-Flash仍将单位任务成本压至行业最低位。不过值得注意的是,DeepSeek API即将引入峰谷定价策略——高峰时段价格翻倍,这意味着极致低价背后是企业级服务成本管控的现实考量。
三、落地现实:便宜不等于能用
新加坡无限对齐创始人宋斐的提醒很实在:"同一模型换一套评测脚手架,可能就是另一张成绩单。"实测中,V4-Flash在超过128K上下文后性能开始明显下滑——塞进去100万token,不等于都能找回来。四张高端算力卡能跑起来,但并发一上来显存就吃紧,稳定服务是另一回事。
产业端反馈倒是积极的:头部金融科技厂商已启动内部技术评估,同行反馈"效果很好"。中文在线基于DeepSeek推理能力的"逍遥AI"平台已实现商业闭环,一季度营收同比增长33.1%。模型越便宜,AI应用的经济模型越容易跑通——杰文斯悖论在AI赛道正在应验。
综合21世纪经济报道、智通财经、海通国际研报、Artificial Analysis | 2026年8月6日
收起 ▲