🤖 科技 · 人工智能
一、国产大模型首次包揽全球调用前五🔥 DeepSeek V4 Flash以7.22万亿Token周调用量登顶全球榜首,中国大模型包揽前五,标志着国产AI从"能用"迈向"首选"。
据全球模型聚合平台OpenRouter最新统计,2026年7月27日至8月2日当周,DeepSeek V4 Flash以7.22万亿Token的周调用量登顶全球模型调用榜榜首,超过平台上400多款模型的总调用量。更令人瞩目的是,榜单前五名全部被中国大模型包揽:DeepSeek V4 Flash位居第一,小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro、智谱GLM 5.2依次位列第二至第五名。这是国产大模型首次在调用量维度实现对全球市场的全面覆盖。
杭州深度求索公司于7月31日正式发布V4 Flash正式版API后,单日使用量和合作平台新订阅用户均增长约30%。科技日报采访专家指出,正式版上线触发了存量用户的迁移需求,而极致性价比叠加智能体Agent类应用的爆发,则将需求持续放大。在中国大模型调用量连续十五周超过美国的背景下,这一登顶并非偶然。
二、"极致性价比"背后的技术突围V4 Flash凭什么赢了?答案藏在三个字里:性价比。该模型每百万Token输入仅1元、输出2元,按汇率换算约合0.28美元。横向对比,OpenAI GPT-5.6 Luna为1.2美元,Anthropic Claude Fable 5高达3.15美元——DeepSeek的价格仅为Claude Fable 5的不到百分之一,而智能指数评分却达到50分,与Google Gemini 3.6 Flash持平。
低价不意味着低能。V4 Flash总参数2840亿、激活参数仅130亿,远低于V4 Pro的1.6万亿,但通过后训练阶段的算法优化,Agent智能体能力与代码能力反而实现反超。Artificial Analysis评测显示,正式版智能指数比预览版高出10分,甚至超过了1.6万亿参数的V4 Pro。核心秘诀在于MoE混合专家架构——每次任务只"激活"最擅长的少数专家,实现有效降本。
三、甜蜜的烦恼:调用暴增倒逼涨价登顶全球第一的同时,V4 Flash也遭遇了"幸福的烦恼"。8月初,平台因访问量过大多次出现响应超时,官方公告直言"前所未有的访问量"导致容量不足。在OpenCode平台,单日处理Token总量达8万亿,其中5万亿来自免费试用额度。DeepSeek已在8月6日宣布计划整体上调API定价,预计涨幅较大——"价格屠夫"终于也要涨价了。
分析人士指出,当前定价大概率低于真实成本,毛利率为负。随着Agent类应用爆发,单次任务Token消耗从对话时代不足2000个飙升至50万至100万个,亿万级调用背后的算力成本已不可忽视。不过这也从侧面证明:当全球开发者用脚投票选中你的模型,涨价反而是实力的证明。中国电子信息产业发展研究院专家钟新龙认为,国产模型在海外推理成本上的优势,正在为整个产业打开新空间。
综合科技日报、中国企业家、经济参考报、杭州市科技局报道 | 2026年8月11日