🎯 科技 · AI芯片
一、从"两年一代"到"一年两代",谷歌TPU加速狂飙谷歌TPU迭代节奏从两年一代提速至每年两款,训练推理拆分双芯设计,性能首次追平英伟达旗舰
9月2日,谷歌AI基础设施负责人Amin Vahdat在Hot Chips 2026大会上披露,谷歌正大幅加快定制AI芯片TPU的研发迭代速度,将芯片更新周期从原先的两年一代缩短至每年推出两款,未来甚至可能进一步增加发布频率。这一决策标志着谷歌在AI算力军备竞赛中正式进入"快车道"。
此前,TPU每代产品的迭代周期约为18至24个月,主要受制于设计、流片、验证的完整周期。如今谷歌决定将节奏提速一倍,背后是AI大模型训练需求呈指数级增长的现实压力——OpenAI、Anthropic等头部玩家的模型参数量已突破万亿量级,算力需求远超现有芯片的供给速度。
二、训练推理拆分双芯,架构大革新本次大会披露的最核心看点是第八代TPU家族的架构革新:谷歌首次将TPU拆分为两款物理上完全不同的专用芯片——面向训练的TPU 8t与面向推理的TPU 8i。这一设计彻底颠覆了此前"一代一芯"兼顾训练与推理的传统思路。
值得关注的是,面向推理的TPU 8i在物理尺寸上比面向训练的TPU 8t更大。谷歌选择将训练负载和推理负载分别交由两款芯片专属负责,而非让同一款芯片两头兼顾,这反映了AI推理需求爆发式增长后的务实选择——推理侧的算力瓶颈正在成为制约大模型落地的关键因素。
博通CEO同期确认,本季度已开始向谷歌量产交付下一代TPU 8I版本产品,全新谷歌TPU性能与英伟达Vera Rubin持平或更优。这是谷歌自研芯片首次在性能上正面追平英伟达旗舰产品,意义非凡。
三、AI芯片军备竞赛白热化,谷歌不再掉队谷歌TPU的加速迭代正值AI芯片竞争最激烈的时刻。OpenAI已与博通联合研发首款推理芯片Jalapeño并公布测试成绩;Anthropic曾讨论以约70亿美元收购芯片初创公司MatX;微软、亚马逊等云厂商也纷纷加大自研芯片投入。
谷歌引入Marvell、AMD、Alchip、GUC等多方合作伙伴,打破了以往单一供应商依赖。摩根大通报告指出,博通2026财年AI收入预计超过560亿美元,谷歌TPU生态的多元化合作正在重塑AI芯片产业链格局。
随着Gemini 3.8 Flash的同步发布(支持100万token上下文窗口、6.4万输出token),谷歌在"芯片+模型"双轮驱动的战略下,正试图挽回此前在前沿模型领域的追赶压力。
综合科创板日报、财联社、金融界报道 | 2026年9月3日