🎯 AI · 大模型

🔥 DeepSeek用552B参数做出了超越自家旗舰Pro的"小模型",输入激活仅8B,成本暴降

一、全新架构:非对称设计颠覆传统

9月10日,DeepSeek正式发布V4.1 Flash模型。这是其全新模型结构系列中的最小尺寸模型,却在基准测试中成功超越了包括DeepSeek V4 Pro在内的一众旗舰模型。#如何评价正式发布的DeepSeek V4.1 Flash# 这个话题迅速引爆AI圈。

核心突破在于全新的Causal-Encoder-Decoder架构,输入和输出完全不对称——总参数552B的MoE模型,输入激活仅8B,输出激活16B。这意味着用极低的计算成本就能处理海量输入,"小成本大智能"不再是口号。

二、成本碾压:KV Cache缩小437倍

对开发者来说,最实际的利好是成本大幅下降。与上一代相比,V4.1 Flash对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent场景中,缓存命中费用往往占大头,KV Cache的压缩直接砍掉了这块成本。

DeepSeek同步下调了API定价:空闲时段缓存命中输入价格降至每百万Token 0.02元,降幅高达60%。高峰时段价格为空闲时段的两倍。考虑到V4.1 Flash已全面超越V4 Pro,公司计划9月14日后将V4 Pro请求全部路由至V4.1 Flash,实质上下架了旧旗舰。

三、生态落地:腾讯、OpenCode全量接入

发布当日,腾讯WorkBuddy、CodeBuddy和OpenCode作为官方合作伙伴已全量接入。原生多模态视觉理解能力意味着开发者无需额外适配,改个模型名(deepseek-flash)就能调用最新版本。

更值得关注的是资本层面。同日有消息称DeepSeek已聘请中信证券筹备科创板IPO,今年6月完成首轮交割募资超500亿元,投后估值超3500亿元,两轮累计募资超1000亿元。技术突破与资本运作双线并进,这家"中国版OpenAI"正站在新阶段上。

综合DeepSeek官方公众号、科创板日报、第一财经报道 | 2026年9月11日