🎯 人工智能 · 大模型动态
一、深夜无预告,从预览版到正式版🔥 DeepSeek V4 Pro 正式版核心改变在 Agent 后训练,架构没动,能力却暴涨近5倍,性价比依然是最大杀器。
8月12日深夜,DeepSeek 没有发布任何博客公告,只是悄悄把 API「模型与价格」页面上的 deepseek-v4-pro 版本号替换成了 DeepSeek-V4-Pro-0813。从4月24日预览版上线算起,整整111天后,这款旗舰模型终于转正。
有趣的是,官方更新日志至今最新一条仍停在7月31日的 Flash 版本,这更像一次「API 层面的静默上线」而非产品发布会。更让开发者警觉的是,定价页下方明确标注:计划近期整体上调 API 定价,预计涨幅较大,等于提前给重度用户打了预防针。
二、架构没变,能力为何暴涨正式版与预览版共用同一架构——1.6万亿总参数、490亿激活参数的 MoE 结构,1M 上下文、384K 最大输出都没有变,真正的变化来自后训练。最夸张的数字是自研软件工程基准 DeepSWE,从预览版的 12.8 飙到 62.7,涨了将近5倍;Cybergym 从 52.7 到 83.3,Terminal Bench 从 72.1 到 87.9,DSBench-Hard 翻了一倍多达到 67.2。
这些测试项的共同点,是都涉及长链路代码修改、环境操作与工具调用——恰是预览版最容易翻车的地方。换句话说,这轮升级把 DeepSeek 在编码 Agent 场景的短板补上了大半。此外正式版首次原生支持图像推理,从此告别纯文本模型的限制。
三、比性能更狠的是价格V4 Pro 维持预览版定价:输入每百万 token 3 元、输出 6 元,缓存命中输入仅 0.025 元。对比之下,根据 36氪与多家外媒的测算,国外同类旗舰的单任务成本差距可能高达数十倍甚至上百倍。能力处于同一梯队,成本却可能低一个数量级,这才是 DeepSeek 一贯的打法——把前沿能力往更低的成本区间压。
不过也有值得注意的细节:并发限制只有 500,且官方涨价预告悬在头顶,想锁定用量的开发者需要趁早。对普通用户而言,日常聊天、轻量编程用更便宜的 Flash 就够了,真正需要超长上下文和复杂 Agent 任务时才值得为 Pro 的三倍价格买单。回看从 2025 年的 R1 到今年的 V4,DeepSeek 一直在做同一件事:不追求「绝对最强」,而是让够用的前沿能力被更多人以更低代价触达。
综合 36氪、红星新闻、掘金、极客公园及 DeepSeek 官方 API 文档报道 | 2026-08-24