🤖 科技 · AI大模型

🔥 DeepSeek-V4-Flash正式版上线即登顶全球调用量第一,用不到Claude百分之一的价格跑出国际一线性能。

一、正式版上线,Token调用量飙到全球榜首

7月31日,DeepSeek正式宣布DeepSeek-V4-Flash正式版API开启公测,消息一出开发者圈直接沸腾。#DeepSeek-V4-Flash正式版API上线#后不到一周,全球知名模型分发平台OpenRouter数据显示,该模型以7.22万亿Token的周调用量登顶全球第一,超过平台上400多款模型的总调用量,堪称"屠榜级"表现。

更夸张的是,在聚焦开发者的OpenCode平台上,V4-Flash单日处理Token量飙到8万亿,其中5万亿来自免费试用。这种恐怖的调用热情直接导致服务器容量告急,官方不得不公开承认"前所未有的访问量"让服务一度接近不可用。开发者一边骂响应超时,一边疯狂调用——这场面放在任何一家AI公司身上都算"甜蜜的烦恼"。

二、价格卷到地板,性能却能跟闭源掰手腕

DeepSeek的定价策略一直是行业"价格屠夫"。V4-Flash正式版输入仅1元/百万Token、输出2元/百万Token,按Artificial Analysis的基准测试,单次调用成本约0.03美元。做一组对比就清楚了:Google Gemini 3.6 Flash的智能指数得分与V4-Flash相当(50分),Kimi K3单次调用约0.86美元、GPT-5.6 Sol更高。同样的智能水平,DeepSeek的运行成本不到Claude Fable 5的百分之一——这个"性价比"三个字已经被DeepSeek重新定义。

性能方面,正式版V4-Flash-0731经过大量后训练,智能体能力和指令遵循能力大幅增强。在SuperCLUE智能体终端编程中文测评中,它以0.64元/题的代价取得46.46分——排名第三但单位成本仅为前两名的1/30和1/36。花三十分之一的钱干差不多的活儿,这就是DeepSeek的"钞能力级"核心竞争力

三、价格屠夫也要涨价了?算力撑不住

热闹背后藏着隐忧。8月6日,DeepSeek突然发布公告:计划近期整体上调API服务定价,预计涨幅较大。这消息像一盆冷水浇下来——那个把AI打到地板价的"屠夫"也要涨价了?业内人士分析,核心原因就三个字:算力不够。万亿级Token的日均调用量、深度Agent循环带来的单次50万-100万Token消耗,让推理成本压力爆表。有测算显示,V4-Flash现有定价大概率低于真实成本,毛利率为负

从"贴钱换规模"到"涨价求生存",DeepSeek的这一步会不会动摇其核心竞争力?粉丝已经吵翻了,有人喊"梁圣降级为牢梁",也有人理解:免费午餐吃久了,总得买单。但无论如何,V4-Flash正式版用实打实的性能和调用量证明了一件事——中国大模型已经不需要靠低价标签刷存在感了。

综合通信世界网、上海证券报、经济参考网、杭州市科技局报道 | 2026年8月10日