🚀 AI大模型 · 科技前沿
一、时隔15个月的重量级发布🔥 等待15个月,DeepSeek V4 Pro 终于正式落地,Agent编程能力显著增强,但距离全球顶尖模型仍有差距。
距离去年初发布R1已经过去15个月,DeepSeek V4 及 V4 Pro 终于正式亮相。这一年多时间里,全球AI赛道城头变幻大王旗,海外巨头与国内Kimi、GLM、MiniMax等对手都在飞速迭代,因此这次发布的期待值被拉得极高。
官方在发布说明中强调,相比前代模型,V4 Pro的Agent能力显著增强。在Agentic Coding评测中,V4 Pro已达到当前开源模型最佳水平,并已作为公司内部员工日常使用的Agentic Coding模型。
二、编程与推理实测:有惊喜也有差距从公开榜单看,DeepSeek V4在arena.ai的文本能力位列20名,Code编程能力位列14;在vals.ai榜单中则是开源第一、全球第九的水平。内部评测反馈,其使用体验优于Sonnet 4.5,交付质量接近Opus 4.6非思考模式。
不过网友实测中,V4 Pro在部分场景表现甚至不及GLM-5.1,与TOP3顶尖模型仍有明显差距,尤其在Opus 4.6思考模式下仍追不上。整体而言,V4编程能力确有提升,但谈不上惊喜。
三、压力与担当并存过去15个月,DeepSeek一方面面对海外的持续制裁封锁,算力资源与头部玩家差距巨大;另一方面还肩负起适配国产AI算力的重任,这都影响了开发进度。即便如此,V4仍以不俗性能如期落地,Pro定价低于海外对手,Flash则保持了性价比优势。
对用户而言,V4 Pro在开源模型里已是标杆级存在,尤其在Agent编程场景表现亮眼。但面对飞速前进的全球AI竞赛,它要坐稳第一梯队,仍需继续追赶。
综合快科技、china.com报道 | 2026-08-28