🎯 科技 · AI芯片
🔥 国产芯片推理成本打下来80%,智谱用半年证明了一条不依赖英伟达的路
8月31日,智谱(02513.HK)发布2026年上半年财报,营收9.54亿元,同比增长399.7%,收入规模已超过去年全年。更引人注目的是,公司宣布已实现10万卡级国产芯片的规模化低成本推理,单位Token推理成本较年初下降80%。这是中国AI公司首次在大规模真实流量中全面使用国产芯片集群提供推理服务。
财报数据显示,智谱上半年毛利2.52亿元,同比增长163.7%;归母净亏损20.7亿元,同比收窄12.1%。按8月月度收入年化计算的ARR(年度经常性收入)达16亿美元,若按周度数据年化口径则超过20亿美元。MaaS平台Token调用量较年初增长超40倍,付费日活用户增长603%,前十大用户日均调用量增长98倍。
API业务毛利率是关键拐点。开放平台及API业务毛利率由去年同期的-0.4%提升至24.6%,实现转正。这背后是国产芯片推理成本的断崖式下降——通过自研推理引擎与全栈算法优化,智谱将多模态编码、Prompt预填充和逐Token解码拆分为独立工作池,端到端服务性能提升3倍,在编程场景中单Token推理性价比已与主流进口GPU相当。
一、国产芯片逆袭:从依赖到主力
过去中国大模型推理几乎完全依赖英伟达高端GPU,这在一开始就注定了成本压力。智谱自2026年初全面实施All-in-Infra策略,将国产芯片纳入主力推理算力,从训练端到推理端同时投入。公司称,芯片之间通过自研高带宽网络连接,由GLM-5.3驱动的基础设施智能体协助工程师优化算子、诊断性能瓶颈,算子开发周期缩短一半。
不过挑战依然存在。国产芯片在内存容量和带宽方面仍有约束,支持100万Token上下文尤其困难。智谱在SGLang基础上构建专用推理引擎,通过集群层面拆分工作池的方式,将性能提升3倍。这一路径的核心意义在于:推理成本曲线掌握在了自己手里。
二、收入结构大换血:政企项目让位云端调用
更值得关注的结构性变化是收入来源的置换。上半年开放平台及API业务收入8.25亿元,占总收入的86.5%;曾经撑起七成收入的本地化部署业务,收入1.62亿元,同比下降20.5%。一家过去靠政企项目吃饭的公司,在半年内把收入重心从项目制切换到了按调用计费的云端模式。
API平均售价较年初提升约101%,显示收入增长并非单纯依赖价格下调换取规模。GLM系列11个月迭代六代,MaaS平台企业和开发者用户超过740万,覆盖233个国家和地区。智谱董事长刘德兵在财报电话会上提出:AGI商业价值=智能上界×Token消耗规模,两者缺一不可。
三、亏损收窄但盈利仍远,研发仍是最大支出
尽管毛利率持续改善,智谱距离整体盈利仍有距离。上半年研发投入21.31亿元,同比增长33.6%,相当于同期收入的2.23倍,也是毛利的8.47倍。公司管理层表示,亏损收窄主要是因为收入翻了近五倍,亏损率被大幅摊薄,而非成本控制所致。
团队方面,截至6月底公司共有981名正式员工,较2025年末减少10.3%。半年人均收入从约22万元提升至约97万元。智谱首席科学家唐杰透露,下一代基座模型已在推进中,最大难点不是把参数做大,而是让模型学会自我停止、自我纠错。
综合澎湃新闻、科创板日报、大河财立方报道 | 2026-09-01