🎯 AI大模型 · 国产模型
一、收入暴增400%背后的"能力兑现"逻辑智谱上半年收入近10亿暴增396%,GLM-5.3-Flash单任务成本降至0.045美元,国产模型商业化进入兑现期
8月31日,北京智谱华章科技股份有限公司发布2026年中期业绩报告。数据显示,2026年上半年智谱实现收入约9.54亿元,同比增长近400%,收入规模接近前一年同期的5倍。其中,MaaS平台及API服务收入达到8.25亿元,同比增长2736%,毛利率提升至24.6%,较去年同期提升约25个百分点。从"烧钱训练"到"盈利兑现",智谱正在证明国产大模型的商业可行性。
截至8月底,智谱平台用户超过740万,词元调用量增长超过27倍,编程套餐调用量增长超过15倍,前十大客户日均调用量增长98倍。财报显示,智谱持续投入训练及推理基础设施,已形成10万级国产芯片规模化推理能力,单位词元推理成本较年初下降80%,端到端服务性能较初始基线提升3倍,单位算力所对应的收入提升14倍。董事长刘德兵在财报电话会上表示:"如果说去年公司发展的关键词是'智能上界',那么今年上半年关键词则是'能力兑现'。"
二、GLM-5.3-Flash:用架构创新打破成本天花板本次业绩最核心的催化剂,是GLM-5.3-Flash模型的发布。这是GLM-5系列首个原生多模态模型,采用320B总参数、18B激活参数的MoE架构,引入稀疏注意力与线性注意力混合架构,相比前代注意力计算量降低3.01倍、KV缓存大小降低4.44倍。单任务成本降至0.045美元,调用价格仅为GLM-5.2的约十分之一。
GLM-5.3-Flash原生支持图像、视频理解,可主动观察界面、渲染结果与交互反馈并持续改进,在代码生成、浏览器操作与图形界面之间协同完成任务。模型上下文窗口达1M tokens,最大输出128K,可自主拆解目标、调用工具并优化输出,交付PPTX、PDF、DOCX、XLSX等高质量成品。智谱方面表示,下一代将进一步延长模型持续执行任务的周期,推动从单一智能体走向多智能体分工协作,探索数天量级、可验证、可审计的完整业务流程执行。
三、国产芯片集群撑起真实流量,商业化路径清晰智谱的成功并非偶然。不久前,GLM-5.3-Flash在海外平台测试时迅速登顶调用榜,正式发布后全部线上流量均由10万张国产芯片集群承载,单token成本已与主流英伟达GPU相当。这一里程碑事件标志着国产芯片首次在大规模真实流量中得到验证,也意味着国产大模型不再依赖进口算力,成本控制主动权回归国产厂商手中。当'能用国产芯片'变成'用国产芯片比用进口芯片更便宜',国产AI的商业化闭环才算真正打通。
行业分析指出,智谱的收入结构已从早期的模型训练投入为主,转向MaaS服务收入驱动,毛利率大幅改善。随着GLM-5.3-Flash的推广和更多企业客户的接入,智谱有望在2026年下半年继续维持高增长态势。在国产大模型竞争日趋白热化的背景下,智谱用业绩证明了:只有把技术能力转化为可规模化的商业价值,才能真正走在AI产业化的前沿。
综合北京日报、智谱AI开放文档、科创板日报报道 | 2026年9月2日