🤖 AI大模型 · 国产算力

🔥 国家超算互联网正式接入DeepSeek-V4-Flash正式版API,企业开发者免配置一键调用,国产大模型落地门槛再降一档。

一、DeepSeek最强Flash上线,性能直逼闭源旗舰

7月31日,DeepSeek官宣DeepSeek-V4-Flash正式版(DeepSeek-V4-Flash-0731)API开启公测。国家超算互联网随即跟进,正式上线该模型的API调用服务与模型文件,面向企业和开发者提供零环境配置、一键接入的调用体验。用户登录超算互联网官网PC端,通过首页「服务」菜单进入「模型服务」专区即可直达调用页面。

据官方介绍,V4-Flash-0731在参数和架构不变的前提下,通过大量后训练工作,智能体能力和指令遵循能力大幅增强。在多项基准测试中,其性能已可与当前最强的闭源模型相媲美,堪称Flash系列迄今为止最具竞争力的一代产品。

二、调用量6天暴增10倍,性价比碾压同行

AI平台OpenRouter数据显示,从7月31日发布至8月5日,V4-Flash-0731的日调用量从1170亿词元飙升至近1.26万亿词元,六天增长超10倍,推动DeepSeek整体词元日调用量增幅达57%。如此爆发式增长背后,是其惊人的成本效率。

SuperClUE智能体终端编程测评中,V4-Flash-0731以仅0.64元/题的代价取得46.46分,单位成本仅为前两名旗舰模型的1/30和1/36。AI评测机构ArtificialAnalysis更将其定位为新一代"斩杀线"——128款主流模型对比中,约70%的产品落在该线以下,面临被替代风险。

三、涨价预告背后:算力不够用了

就在Flash正式版调用量狂飙之际,DeepSeek于8月6日罕见发布涨价预告,计划近期整体上调API服务定价,预计涨幅较大。当前V4 Flash缓存命中输入仅0.02元/百万Tokens,价格远低于行业平均水平。调用量暴增导致算力吃紧,是此次预告涨价的核心推手

业内分析认为,DeepSeek此次提价除对冲算力成本外,更深层的意图在于为全行业留出容错缓冲空间——过低的定价正在压缩其他厂商的生存空间。目前超算互联网AI社区已汇集1700余款开源大模型,覆盖DeepSeek、GLM、Qwen、Kimi等主流系列,全面上线了多款国产大模型API接口。

综合通信世界网、经济参考网、SuperClUE报告 | 2026年8月8日