🎯 科技 · AI大模型

DeepSeek V4 flash正式版API公测上线,价格仅为GPT系列的几十分之一,多模态能力直接拉满

9月2日,DeepSeek官方宣布V4 flash正式版API公测正式上线,同时V4 Pro正式版也将尽快发布。这款被称作"性价比之王"的模型,正在以极低的价格重新定义大模型市场格局。DeepSeek V4 flash正式版API公测上线,意味着开发者可以直接调用这款多模态能力强劲的模型,而成本仅为GPT-5.6的几十分之一。

从技术架构来看,V4 flash支持超过100万Token的超长上下文,能够容纳非常长的任务轨迹。其核心亮点之一是多模态Agent能力——Responses API原生支持图文输入和工具调用,让模型能够像人类一样"边看边操作"。浏览器Agent就是一个典型场景:模型先读取网页截图,根据任务点击按钮,页面变化后再截新图,如此循环执行复杂操作。

DeepSeek V4 flash的视觉链路并非简单的图片描述,而是深度整合了32层ViT(视觉Transformer)和43层主干Transformer,配合256个专家模块和稀疏注意力机制。每张图片占用384个Token的语言侧预算,在超长上下文任务中仍能保持高效推理。南京大学计算机学院已将deepseek-v4-flash引入《生成式软件工程》新课,要求学生自费购买Token完成实训,以此打破"零成本思维",建立成本、质量、延迟三大核心意识。

价格方面更是震撼。据业内人士透露,V4 flash的API定价不到GPT-5.6的二十分之一,学生个人购买Token的开销极低,彻底打消了"高价算力劝退"的顾虑。这也解释了为何南大教授蒋炎岩敢在课堂上喊出"没有token的CS学生应该立即退学"的硬核口号——因为现在token真的便宜到可以随便用了。

更值得关注的是,V4 flash在编程能力上也有显著提升。有测试数据显示,在代码生成、调试和优化任务中,其表现已逼近甚至在某些场景超越同类付费模型。对于中小开发者和创业团队来说,这意味着用极低的成本就能获得顶级AI编程助手的能力。

综合网易科技、快科技报道 | 2026年9月2日