🎯 AI大模型 · 开源
🔥 智谱GLM-5.3-Flash开源,3200亿参数模型激活成本仅旗舰版十分之一,国产芯片集群撑起百万Token推理
国产大模型赛道再扔出一颗重磅炸弹。9月3日,智谱AI正式发布GLM-5.3-Flash原生多模态大模型,并同步开源。这款模型采用3200亿总参数、180亿激活参数的MoE架构,价格在旗舰版GLM-5.3基础上直接砍到十分之一,在限时折扣期间甚至低至二十分之一。单位Token推理成本较年初下降80%,这个降幅在行业里堪称史诗级。
更值得关注的是,GLM-5.3-Flash是智谱首款在超大规模真实流量下全面依托国产芯片集群提供服务的模型。日处理100万亿Token的庞大流量,完全运行在超过10万张国产AI加速芯片组成的集群之上,通过搭配SGLang推理引擎与编码、预填充、解码分离的并行架构,端到端服务性能提升3倍。国产算力不再是"能不能跑"的问题,而是"跑得多快"的问题。
从智谱最新半年报来看,上半年总收入9.54亿元,同比增长399.7%,是去年同期的整整五倍。以ARR(年度经常性收入)口径计算,截至8月末已达到16亿美元,按周度年化口径已超过20亿美元。大模型六小龙里,智谱已经跑出了一个明确的头羊。GLM-5.3-Flash的发布,不仅是技术迭代,更是商业模式的一次降维打击——用十分之一的价格,提供相近的体验。
在开源策略上,智谱选择了更加开放的路线。中科大等高校的大模型公共服务平台已同步完成升级,将glm-5.2替换为glm-5.3-flash。业内分析认为,开源+低价的组合拳正在加速国产大模型在科研、教育、中小企业场景的渗透。当大模型从"奢侈品"变成"日用品",国产AI的产业化进程又往前迈了一大步。
综合智谱AI官方文档、每日经济新闻、钛媒体报道 | 2026年9月3日