🎯 科技 · AI大模型
一、V4.1 Flash正式转正,定价大幅下调🔥 DeepSeek V4.1 Flash转正并大幅降价,空闲时段输入缓存命中价降至0.02元/百万Token,降幅达60%,同时筹备科创板IPO。
9月10日,DeepSeek宣布V4.1 Flash模型正式发布并转正,同时对Flash系列模型定价进行大幅调整。新价格于当日12:00起生效,采用峰谷定价模式:空闲时段缓存命中输入0.02元/百万Token、未命中输入1元、输出4元;高峰时段价格翻倍,分别为0.04元、2元和8元。
与此前价格相比,缓存命中输入价格降幅达60%,未命中输入降33%,输出降11%。高峰时段限定为工作日周一至周五9-12点、14-18点,其余时间均算空闲,一周168小时中空闲时段占比约79%。官方表示,V4.1 Flash在性能、费用、速度和任务总用时等指标上均已超过V4 Pro,9月14日后V4 Pro请求将全部路由至V4.1 Flash。
二、架构创新支撑降本,智能体产品同步迭代此次降价得益于模型架构的多项创新。V4.1 Flash具备原生多模态视觉理解能力,新结构设计目标为能力上限更高、推理速度更快、吞吐更大。据技术报告披露,新架构对HBM(高带宽内存)需求降至原来的四分之一,对SSD需求降至八分之一,KV Cache压缩技术直接降低了智能体等应用的部署成本。
同日,DeepSeek旗下智能体产品Harness更新至v0.1.5版本,与V4.1 Flash训练深度结合,模型针对不同配置接受了专项优化。Harness提出"一切皆插件"理念,将模型、工具、技能等Agent能力拆分为可自由组合的插件,后续版本将加入内置插件管理面板。团队同步放出约150个工程师岗位招聘名额。
三、资本动作频频,科创板IPO筹备中在产品迭代的同时,DeepSeek的资本动向持续引发关注。9月9日有报道称,DeepSeek已委托中信证券筹备科创板IPO,目前双方已进入尽职调查阶段,尚未签订正式辅导协议。今年6月DeepSeek完成首轮融资交割后,市场消息称其启动第二轮融资,计划募资500亿元,投前估值约5000亿元。
从大幅降价抢占市场份额到加速资本化布局,DeepSeek正在用"低价+开源+IPO"的组合拳,为AI大模型赛道的下半场竞争加码。对于开发者和企业用户而言,模型推理成本的持续下降,意味着更多AI应用的规模化落地将变得可行。
综合第一财经、经济观察报、中新网报道 | 2026年9月10日