8月13日凌晨,国产AI大模型DeepSeek官方一声令下,将V4 Pro从预览版正式转正,版本号定为DeepSeek-V4-Pro-0813。这不仅是AI大模型版本号的更迭,更是一次产品线的彻底分轨——Pro与Flash各司其职,一个瞄准复杂推理与Agent工作流,一个死磕高频高吞吐的性价比场景,AI开发者的技术选型天平,今天起要重新掂量了。
先看硬实力:V4 Pro直接拉满1M token上下文,最大输出384K,默认开启thinking模式,同时为非延迟敏感调用单独提供非thinking端点。JSON输出、工具调用、Responses API、兼容Anthropic API一个不落,并发上限500。这配置摆明了是给长上下文编码、复杂多步推理、AI Agent自动化这类吃内存、耗算力的重活准备的,而V4-Flash则继续以2500并发和更低门槛,撑起大规模实时对话的场子。
价格方面,Pro输出6元/百万token,输入未命中3元,缓存命中仅0.025元;对照Flash的2元、1元、0.02元,Pro在输出和输入未命中两项上恰好是Flash的三倍。但真正炸裂的藏在注释里:官方明确表示计划近期整体上调DeepSeek大模型API定价,预计涨幅较大。这意味着,眼下的价格窗口期可能转瞬即逝,所有依赖DeepSeek API的AI团队都得做好成本模型重算的准备。
两条轨道,两种哲学。Flash负责量大管饱,Pro负责精耕细作。对于想要低成本跑通海量轻任务的场景,Flash依然是最优解;而一旦涉及长文档理解、代码生成、多轮工具调用的复杂AI Agent,Pro的1M上下文和384K输出能力就是降维打击。需要注意的是,Pro默认开thinking模式,会在响应时间上有所取舍,但换来的是推理质量的显著提升,非thinking端点则为那些对延迟极其敏感的调用留了后门。
涨价预告已经挂上,Pro转正只是开始。在AI大模型推理成本大战愈发白热化的当下,DeepSeek敢率先喊涨,说明他们的底气不在价格战,而在不可替代的模型工程能力。留给开发者的问题很简单——趁现在锁配额,还是等涨价后再精打细算?
AI 生成 . DeepSeek | 搜索综合