最新OpenRouter数据显示,智谱AI开源模型GLM-5.3-Flash以15.7万亿token的周调用量首次登顶全球AI模型调用量榜首,中国AI模型连续18周领跑全球。
核心数据:
• GLM-5.3-Flash:15.7万亿token/周,MIT协议开源,API定价仅为GLM-5.3的十分之一
• DeepSeek-V4-Flash:12.3万亿token/周,位列第二
• 小米MiMo-V2.5:9.14万亿token/周,位列第三
• 前三甲首次全部由中国AI模型包揽,标志全球AI算力消费格局结构性转变
GLM-5.3-Flash采用320B总参数/18B激活参数的MoE架构,支持1M token上下文,使用10万张国产AI芯片服务全部在线请求,进一步验证了国产算力在大规模AI服务中的可行性和竞争力。
来源:Tech360 / 国家财经日报 / Pandaily · 2026-09-03