🎯 科技 · AI大模型
一、限时内测:两天窗口,开放即调用DeepSeek V4.1 Flash限时内测开启,新结构+原生多模态+速度碾压,或成V4 Pro继任者
9月8日下午3点,DeepSeek官方社区突然宣布开启V4.1 Flash中间版本内测。与往年"保密-预热-官宣"的节奏不同,这次内测几乎没有门槛——开发者只需在现有API基础上将模型名改为"deepseek-v4.1-flash-expires-on-0910",即可直接调用,内测截止时间9月10日,留给开发者的体验窗口仅有48小时。
虽然官方标注为"内测",但从接口、模型名称和价格均已公开的情况来看,这更接近一次面向开发者的小范围公开测试。业内普遍认为,DeepSeek正在以"快速试错-快速迭代"的节奏,追赶全球大模型更新速度。
二、性能跃升:速度碾压前代,原生多模态成标配首批开发者反馈显示,V4.1 Flash最直观的变化是速度大幅提升——在相同任务下,相比V4-Flash-Vision-Exp版本,长上下文检索快5.2倍、SVG代码生成快6倍,端到端速度提升3.9至6倍,部分用户实测达到400 token/s,超越Gemini 3.8 Flash。
更关键的升级在于原生多模态支持。此前的V4-Flash-Vision-Exp仅支持图片输入描述和图表识别,属于实验性功能;而V4.1 Flash将多模态能力从"外挂式扩展"升级为"原生架构内置",意味着模型在底层就能同时处理文本、图像、代码等多种输入,Agent任务和复杂工作流效率将显著提升。
在随内测一同发放的反馈问卷中,DeepSeek直接向用户询问"V4.1 Flash能否全面替换线上V4 Pro"——这一措辞暗示,若内测效果达到预期,V4.1 Flash有望取代现役V4 Pro成为DeepSeek主力模型。
三、成本争议:价格未降,但效率或成关键计费方面,V4.1 Flash与V4-Flash保持一致:空闲时段每百万Tokens缓存命中输入0.05元、缓存未命中输入1.5元、输出4.5元;高峰时段则翻倍。有开发者反馈"5分钟10块钱",质疑"成本更低"的承诺。
但DeepSeek官方所称"成本更低",更可能指底层推理效率提升——完成相同任务所需计算量和token数量下降,而非单价直接下调。随着内测数据积累,若新版本在单位成本上的表现优于V4 Pro,开发者账单有望实质性减少。
近40天连发三代模型的节奏,印证了DeepSeek在激烈竞争中的加速策略。V4.1 Flash能否从"限时内测"走向"主力机型",9月10日的内测数据将是关键试金石。
综合上海证券报、第一财经、机器之心Pro报道 | 2026-09-08