🤖 AI大模型 · DeepSeek · 技术突破

🔥 552B参数仅激活8B输入,DeepSeek用"非对称架构"把成本打下来了

一、发布详情:比旗舰更强,比上代更省

9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型。这是全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。该模型采用创新的Causal-Encoder-Decoder非对称架构,总参数552B,但输入激活仅8B、输出激活16B,成本显著低于同尺寸模型。

更关键的是,V4.1 Flash在基准测试中成功超越了包括DeepSeek V4 Pro在内的一众旗舰模型。一个"小弟"干翻"大哥",这在AI行业并不常见——说明架构创新的红利远未见顶。

二、技术突破:KV Cache压缩437倍

新一代模型大幅减少了KV Cache缓存大小,与上一代相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。从初代模型至今,KV Cache已经缩小了437倍。这意味着什么?在Agent使用场景中,缓存命中的费用往往占大头,压缩缓存直接砍掉了大量成本。

DeepSeek同步下调了V4.1 Flash的API定价,采用峰谷定价策略,闲时价格为高峰时段的一半。新价格于9月10日12:00生效。腾讯WorkBuddy、CodeBuddy和OpenCode作为官方合作伙伴已全量接入。此外,V4 Pro计划有序下线,9月14日后访问deepseek-v4-pro的请求将全部路由到V4.1 Flash。

三、行业格局:中国大模型的"降维打击"

DeepSeek这步棋下得漂亮——用更小的激活参数打出更强的性能,同时把价格压下来。这不仅是技术胜利,更是商业策略的胜利。当海外大模型还在卷参数规模时,DeepSeek已经转向架构效率的比拼。在AI应用加速落地的2026年,谁能以更低成本提供更强能力,谁就能抢占开发者生态。

V4.1 Flash的发布,也标志着DeepSeek从"追赶者"正式变为"规则制定者"。非对称架构、极致缓存压缩、峰谷定价——这些创新正在重新定义大模型的成本结构。

综合财联社、DeepSeek官方报道 | 2026年9月10日