🎯 科技 · AI大模型

🔥 DeepSeek V4.1 Flash中间版本9月8日开启内测,新架构+原生多模态加持,开发者实测速度提升3.9至6倍

一、全新架构内测,原生多模态不再外挂

9月8日,DeepSeek在官方交流群内发布通知,正式开启DeepSeek V4.1 Flash中间版本内测。这是继7月底V4-Flash正式版API上线公测后,DeepSeek在大模型领域的又一次重要迭代。V4.1 Flash采用全新模型结构,原生支持多模态输入输出,不再需要额外挂载视觉扩展包,开发者只需将模型名改为"deepseek-v4.1-flash-expires-on-0910"即可直接调用,迁移成本几乎为零。内测有效期截止到9月10日,过期后接口自动下线。当前计费与DeepSeek-V4-Flash保持一致:空闲时段每百万Tokens缓存命中输入0.05元、缓存未命中1.5元、输出4.5元;高峰时段分别为0.1元、3元和9元,每账号限流20并发。官方同步发出的反馈问卷中询问"能否全面替换线上DeepSeek V4 Pro",暗示若内测效果达标,V4.1 Flash有望成为主力模型。

二、实测速度碾压,开发者反馈积极

从首批开发者实测反馈来看,V4.1 Flash最直观的变化是速度大幅提升。同一任务端到端,V4.1 Flash相比V4-Flash-Vision-Exp,SVG代码生成快6倍,长上下文检索快5.2倍,部分场景端到端速度提升达3.9至6倍。有开发者测得400 token/s的生成速度,比Gemini 3.8 Flash还要快。不过针对"成本更低"的官方描述,部分开发者表示并未在账单上直接感受到降价,"5分钟10块钱"、"瞬间几十块没了"的反馈说明速度提升也带来了token消耗加速。官方所称"成本更低"更可能指底层推理效率提高或完成相同任务所需token数量下降。AI基准测试机构Artificial Analysis数据显示,DeepSeek当前智能指数36分排第15位,前两名由Claude和GPT-6占据,国内智谱和Kimi分别排第7和第9位,这也让外界对V4.1 Flash抱有期待。

三、不到40天密集迭代,DeepSeek补齐产品矩阵

回溯DeepSeek近期产品节奏,V4系列迭代明显提速。7月31日V4 Flash正式版上线,8月13日V4 Pro正式版发布并大幅调整API价格,8月19日Harness开发者预览版开源,8月21日V4 Flash Vision-Exp上线,到9月8日V4.1 Flash进入内测。不到40天内围绕模型、原生多模态和Agent开发工具连续更新,这种节奏表明DeepSeek正在补齐从底层模型到Agent基础设施的完整产品体系。如果V4.1 Flash正式版真能做到接近Pro的综合能力、Flash级别的低廉成本、加上原生多模态支持,那么DeepSeek大量To-C应用、智能体和多模态产品有望从高价旗舰模型迁移,AI大规模商业化落地速度或将加快。综合上海证券报、第一财经、机器之心报道 | 2026年9月9日