🎯 领域 · 科技

英伟达重启Rubin CPX项目,AI推理芯片竞赛进入第二赛段

AI芯片圈又有一个大消息。据天风国际证券分析师郭明錤发布的产业调查,英伟达已重启人工智能推理预填充加速GPU"Rubin CPX"项目,设计得到大幅度调整,预计2027年Q1开始生产。

这个Rubin CPX可不是普通的产品迭代。在新Rubin CPX的芯片级别,它拥有接近标准Rubin GPU的算力,预填充性能进一步提升,单体最高功耗同为2300W,配备168GB HBM4内存。这意味着什么?意味着英伟达在推理端的"卡位战"正式打响。

一、推理时代,预填充才是关键战场

AI推理和训练是两种完全不同的算力需求。训练追求的是吞吐量,推理追求的是响应速度。而预填充(prefill)阶段正是决定响应速度的核心环节——模型在生成第一个token之前,需要处理全部输入的上下文信息,这一步的计算量极其庞大。

随着Agent、长上下文和AI应用大规模落地,模型调用量激增,Token越烧越快,从"交互式用量"进阶到"生产级用量"。预填充性能直接决定了用户感知的延迟体验,这也是为什么各大厂商都在疯狂优化这一环节。

二、英伟达的下一步棋

回顾英伟达的布局,2027财年第二季度业绩已全面超预期,数据中心业务收入同比大增117%。公司新发布的Vera Rubin平台将成为明年核心增长引擎,而全球首款专为智能体AI设计的CPU则开辟了约2000亿美元的新市场。

Rubin CPX的重启,说明英伟达在推理预填充这个细分领域并没有放松警惕。尽管设计得到大幅调整,但其目标很明确:在2027年Q1之前,用新的推理芯片锁定AI推理市场的份额

三、国产芯片的机遇与挑战

就在英伟达加速布局的同时,国产AI芯片也在快速迭代。燧原科技、寒武纪、海光信息等厂商纷纷推出面向推理场景的AI芯片,且在腾讯、百度等头部互联网厂商的规模化商用中已经积累了丰富经验。

招商证券指出,国内厂商陆续完成对主流大模型的适配,卡位优势明确。但随着英伟达新一代推理芯片的逼近,国产芯片如何在性能、生态和成本之间找到最优解,将是未来两年最大的看点。

综合界面新闻、财联社报道 | 2026年9月2日