🎯 领域 · AI大模型

🔥 DeepSeek-V4-Pro正式版强化Agent能力,全球调用量跻身第四,开源模型再下一城

一、正式版上线:Agent能力跨越式提升

8月12日晚,DeepSeek正式推出DeepSeek-V4-Pro正式版,8月13日同步上线API服务。与4月24日发布的Preview版本相比,正式版在Agent能力上实现了跨越式提升——在Agentic Coding评测中达到行业开源模型最佳水平,并支持Responses API和Codex接入,多项评测指标接近Fable 5。

DeepSeek-V4-Pro采用MoE架构,总参数1.6T,在数学、STEM、竞赛型代码的测评中超越行业已公开评测的开源模型,取得堪比世界顶级闭源模型的成绩。世界知识测评中大幅领先其他开源模型,仅稍逊于顶尖闭源模型Gemini-Pro-3.1。

二、全球调用量进前四,价格策略显野心

8月3日,根据OpenRouter数据测算,DeepSeek-V4-Pro在7月27日至8月2日期间升至全球AI调用量第四位,周调用量达3.28万亿Token,环比增长3%。这一数据标志着国产开源大模型在全球AI基础设施中的地位显著提升。

与此同时,DeepSeek在8月13日调整API价格,采用峰谷定价策略。高峰时段每百万tokens输入9元、输出27元;空闲时段输入4.5元、输出13.5元,缓存命中输入低至0.15元。这一价格策略既覆盖了高负载时段的算力成本,又以极低价格吸引长尾开发者,展现了开源模型商业化的高效路径。

三、国产开源模型加速全球渗透

据Hugging Face发布的2026年春季报告,过去一年该平台41%的大模型下载量来自中国研发的模型。DeepSeek-V4系列的成功并非孤例——昆仑芯、昇腾、寒武纪等国产算力平台均在V4开源当日完成"Day 0"适配,形成"开源模型+国产芯片"的协同生态。国家数据局数据显示,我国日均Token调用量已从2024年初的1000亿跃升至2026年6月的500万亿,应用量的指数级增长正将算力需求重心由训练转向高频分散的推理负载。

综合百度百科、DeepSeek官网、OpenRouter数据报道 | 2026年9月4日