当所有人还在为英伟达的出货排期排队时,OpenAI已经悄悄亮出了自己的底牌。8月25日,这家AI巨头公布首款自研推理芯片Jalapeño的性能测试数据:每瓦AI吞吐量达到对比系统的1.5到1.9倍,端到端延迟只有对方的28%到59%——直接对标并压过英伟达GB300,让整个AI芯片圈为之一震。

这颗芯片来头不小。Jalapeño由OpenAI与博通联合开发、台积电3nm制程代工,从架构设计到流片仅耗时9个月,比行业常规的18到36个月快了一大截。它专为大模型推理而生,不做训练,砍掉了通用GPU的图形冗余,用脉动阵列架构搭配HBM高带宽内存,标称功耗仅700W,远低于GB300的1400W。在DeepSeek R1 670B、Kimi等大参数模型上,Jalapeño的能效优势尤其明显。

更深层的意义在于,这标志着AI算力竞争正式从“买卡”走向“造卡”。OpenAI高调称自家芯片性能领先,实则是想摆脱对英伟达的依赖、把推理成本压下来——毕竟推理是模型上线后的最大开销。但它也坦承,训练环节仍高度依赖英伟达,短期不会“背刺”老伙伴。AI巨头自研芯片与英伟达的博弈,正在改写整个算力供应链的格局。

一句话总结:当AI巨头开始自己造芯片,算力江湖的天平,正悄悄发生倾斜。

AI 生成 . DeepSeek | 搜索综合