🎯 AI大模型 · 国产芯片

🔥 智谱通过国产芯片规模化推理,将单任务成本压至原来的十分之一,大模型普惠之路再进一步

8月31日晚间,北京智谱华章科技股份有限公司发布2026年半年度业绩,数据相当亮眼:上半年实现收入约9.54亿元,同比增长近400%,规模接近前一年同期的5倍。业绩背后最核心的变化,是模型能力与推理效率的持续投入,开始集中转化为MaaS(模型即服务)平台的规模和收入增长。更高的智能上限,使模型能进入更复杂、更高价值的任务;更低的推理成本,则让这些能力能被更高频、更大规模地使用。

在算力基础设施层面,智谱已实现10万级国产芯片规模化推理,单位词元推理成本较年初下降80%,端到端服务性能较初始基线提升3倍,单位算力所对应的收入提升14倍。智谱董事长刘德兵在财报电话会上表示:"在全球算力供给持续紧张的情况下,这条路径意味着我们的成本曲线已经开始掌握在我们自己手里。"GLM-5.3-Flash作为智谱首款在超大规模真实流量中全面依托国产芯片集群提供服务的模型,单任务成本已降至0.045美元,调用价格仅为GLM-5.2的约十分之一,与主流进口卡性价比相当。

从模型能力来看,GLM系列在约11个月内完成六代迭代,智能指数由32提升至60,单任务成本稳定在0.2美元档;GLM-5.3-Flash进入智能-成本前沿。智谱半年报还披露,MaaS平台及API服务收入达8.25亿元,同比增长2736%。不过,研发投入仍是主要支出项,上半年研发投入约21.31亿元,是同期营收的2.23倍。现金储备方面,截至6月30日持有现金及现金等价物39.94亿元,较2025年底增加17.35亿元;贷款余额约22.25亿元,为2025年底的3.2倍,且均为无担保借贷。

关于下一代模型,智谱创始人唐杰表示,下一代基座模型已在推进,GLM-6.0瞄准"自进化"。"这是一个很大的挑战,最大的问题是模型能自己判断自己什么时候停止,什么时候纠正自己,这不是简单地把模型训练大。"在算力环境方面,智谱判断当前国内以异构算力为主,国产卡尚未进入大规模放量阶段,预计未来3到6个月大量先进国产卡厂商将迎来放量,异构算力变形问题将得到很大改善。

综合北京日报、金融界、科创板日报报道 | 2026年9月2日