🎯 科技 · AI芯片
一、推理收入超过训练,AI算力结构悄然生变🔥 AI从"训练驱动"迈入"推理为王"时代,英伟达用一场三方合作补上最后一块拼图
9月3日,英伟达宣布与全球最大数据中心托管商Equinix及AI推理平台Together AI达成战略合作,联合推出分布式AI推理服务"Equinix Inference Exchange",计划于2027年一季度正式商用。这标志着英伟达在AI基础设施领域的布局,从训练侧全面延伸至推理侧,补上了从模型训练到推理部署的最后一环。
约18个月前,英伟达的训练与推理收入大致各占一半;如今推理收入已超过训练,且这一差距预计将继续扩大。这一转变并非偶然——智能体的普及是核心驱动力。智能体在推理、规划与解决问题的每一步都在生成token,随着其被部署到更多工作流与行业,算力需求随之放大。英伟达创始人黄仁勋在投资者会议中明确表示:"智能体AI的拐点已经到来"。
二、三方分工:算力、托管与平台的精密协作此次合作采用"三方分工作业"模式:Equinix负责数据中心托管,Together AI提供推理平台,英伟达提供GPU及软件栈。三方把硬件、软件与托管能力打包,直接切入企业级AI应用的推理环节。这种分工模式的创新之处在于,企业客户无需在多家供应商之间协调,一站式即可获得从物理基础设施到软件栈的完整推理解决方案。
新兴云服务商贡献的AI计算基础设施收入已超过50%,增长动力正从传统超大规模云厂商向更广泛的AI算力生态扩散。这意味着,AI算力的"金主"正在从少数科技巨头向更广泛的企业群体延伸,推理需求的"民主化"趋势愈发明显。
三、押注开源模型:英伟达的长期战略考量英伟达此次联手Equinix与Together AI,背后是其对开源AI的坚定押注。黄仁勋近期发表公开文章阐述开源AI的重要性,获得几乎所有主要AI公司联署。在其看来,AI模型和应用是英伟达GPU的互补品,开源模型的繁荣意味着更准确、更广泛的算力需求。
麦肯锡测算显示,到2030年推理将占AI算力的一半以上、占数据中心总需求的三成至四成。AI推理负载将由2025年的20.9吉瓦升至2030年的93.3吉瓦,年复合增速达35%,而同期AI训练负载增速仅为22%。两类负载对基础设施的要求截然不同:训练需要高密度大型园区,推理则更倾向布局在低时延、网络连接强的城域及近城域站点——这正是Equinix这类互联型数据中心运营商的主场。
综合华尔街见闻、21世纪经济报道、科创板日报报道 | 2026年9月3日