🎯 科技 · AI大模型

🔥 智谱ARR突破16亿美元,国产芯片规模化推理成本较年初下降80%,AGI商业化拐点临近

一、半年营收超去年全年,收入结构发生质变

8月31日,"全球大模型第一股"智谱(02513.HK)披露2026年上半年财报,数据引发市场广泛关注。上半年公司实现营业收入9.54亿元,同比增长399.7%,收入规模已超过2025年全年;毛利2.52亿元,同比增长163.7%。更关键的变化在于收入结构——开放平台及API业务收入8.25亿元,占总收入86.5%,而曾经撑起七成收入的本地化部署业务,上半年仅收入1.62亿元,同比下降20.5%。一家过去靠政企项目吃饭的公司,半年内完成了从"卖项目"到"卖调用"的转型。MaaS平台Token调用量较年初增长超40倍,付费日活用户增长603%,这是收入结构质变的核心数据支撑。

从商业模式来看,智谱走的是一条从卖工具到卖结果的演进路径。早期本地化部署阶段,客户购买的是需要集成定制的工具;2025年起进入Coding阶段,编程能力提升推动API与订阅制Coding Plan快速增长;今年迈入Agent与Co-work阶段,模型从调用走向任务交付。这种转变意味着,智谱不再只是提供AI能力的"供应商",而是正在成为企业工作流的"执行者"。

二、10万卡级国产芯片:AI推理的成本革命

智谱上半年最核心的结构性突破,是推理侧不再依赖海外高端GPU作为唯一规模化路径。通过收购基础设施公司、自研推理引擎与全栈算法优化,公司已实现10万卡级国产芯片的规模化低成本推理。自2026年初实施"All-in-Infra"战略以来,单位Token推理成本较年初下降80%,端到端服务性能较初始基线提升3倍,单位算力(含训练和推理)所对应的收入提升14倍。GLM-5.3 Flash正是首款在超大规模真实流量中全面采用国产芯片集群提供服务的模型,62万亿Token调用峰值完全由国产算力承载,这标志着国产AI算力已从"可用"走向"好用"。国产芯片承载百万Token级推理,是AI算力自主可控的里程碑事件

三、ARR 16亿美元背后:AGI商业价值公式

截至8月末,智谱ARR(年度经常性收入)按月度收入年化计算达16亿美元,若按周度数据年化口径则超过20亿美元。这个规模在中国大模型公司中位居前列。智谱董事长刘德兵在财报电话会上提出了AGI商业价值公式:AGI商业价值=智能上界×Token消耗规模——智能上界决定模型可处理的任务边界与单位Token价值密度,Token消耗规模反映智能应用的广度与深度。过去11个月,智谱连续迭代GLM-4.6至GLM-5.3六代旗舰模型,智能指数从32提升至60。下一步,智谱计划推动模型从单一Agent走向多Agent分工协作,探索数天量级、可验证、可审计的完整业务流程执行。当模型能独立完成数小时量级的长程任务时,AGI的商业化临界点便不再遥远。

综合上海证券报、科创板日报、澎湃新闻报道 | 2026年9月1日