🤖 人工智能 · 大模型 · 科技产业
一、全球榜单被中国产品包揽,调用量说明一切🔥 国产大模型在全球调用量排行榜上霸占前五,DeepSeek V4 Flash以断崖式优势登顶,标志着中国AI正式从"跟跑"切换到"领跑"模式。
8月第一周,人工智能模型聚合平台OpenRouter公布的最新数据显示,全球大语言模型调用量排行榜前五名全部被中国自主研发的开源大模型占据,分别为小米MiMo-V2.5、DeepSeek-V4-Flash、腾讯Hy3、MiniMax M3、智谱GLM-5.2以及DeepSeek-V4-Pro。这已经是国产大模型连续第十四周在调用量上领跑全球,从"追随者"到"领跑者"的角色切换不再是口号,而是铁打的数据。
其中DeepSeek V4 Flash的表现尤为瞩目。据OpenRouter周度榜单显示,本周DeepSeek V4 Flash 0423以6.6万亿Tokens的调用量位居榜首,而8月1日该模型在OpenCode平台单日处理Token总量更是达到惊人的8万亿,面对如此体量的调用压力甚至一度出现容量不足。这不是"有点火",这是"烧到服务器都要冒烟了"。
二、V4 Flash正式版上线,性能与性价比双重碾压7月底,DeepSeek-V4-Flash正式版发布,取代预览版,重点增强了智能体能力并加入推测解码模块。在SuperClUE的智能体终端编程中文测评中,V4-Flash-0731以0.64元/题的代价取得46.46分,得分排名第三但单位成本仅为前两名的1/30和1/36。这就像拿煎饼果子的预算吃出了米其林的体验。
AI评测机构ArtificialAnalysis的研究更加直观:对比128款主流模型,V4-Flash-0731的智能指数达到50分,单次任务成本仅约3美分,测算显示约70%的大模型产品落在这条"斩杀线"以下,面临被快速替代的风险。这就不是卷了,这是掀桌子——开源、低价、性能强三张牌同时出,全球同行集体感受到了什么叫"中国速度"。
三、调用量暴涨背后的商业化拐点调用量暴增的另一面是算力成本压力。8月6日,DeepSeek在开放平台发布公告,计划近期整体上调API服务定价,预计涨幅较大。当前V4 Flash缓存命中输入仅0.02元/百万Tokens,V4 Pro缓存未命中输入3元/百万Tokens,对比OpenAI GPT-5.5的定价仍有巨大价格优势,但"低价策略"的拐点可能正在到来。
从行业格局看,智谱AI提价后仍供不应求,豆包推出阶梯订阅,Kimi因请求量超限暂停C端新用户订阅——头部厂商集体转向更务实的商业化路线。此次DeepSeek预告涨价,除了对冲自身算力成本,更可能是在为整个行业拓宽市场容量与容错缓冲空间。大模型的终局不是比谁便宜,而是比谁能活到终局。
综合经济参考网、中国证券报、上海证券报报道 | 2025年8月8日