8月25日,OpenAI放出了自研推理芯片Jalapeño的首批实测数据,直接把英伟达的Blackwell系列按在地上摩擦。在GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T三个公开模型上,Jalapeño每瓦性能比英伟达GB300高出1.5到1.9倍,端到端延迟却降低了1.7到3.6倍。更有意思的是,在高度交互式的Agent工作负载下,这个优势直接拉大到2.1到4.1倍。

这款芯片并不神秘。2026年6月,OpenAI就宣布和Broadcom联手推出了Jalapeño,9个月完成流片,创下高性能ASIC开发的最快纪录。700W额定功耗,实际测试中稳定在550W以下。核心思路很简单:专门为LLM推理从头设计,而不是拿通用GPU凑合。KV Cache直接放在计算核心附近,网络架构深度集成,prefill和decode阶段都能兼顾。

然而英伟达这边也没闲着。2027财年Q2营收962亿美元,同比翻倍,连续四个季度加速增长。但客户收到的通知却不妙:因为HBM内存芯片成本飙升,搭载英伟达AI芯片的服务器明年年初起涨价超过15%,受影响范围包括旗舰级Vera Rubin和Grace Blackwell系统。英伟达的护城河正在被自定义芯片和供应链成本两头侵蚀。

一边是OpenAI、Meta、Google纷纷下场自研芯片,用定制硅取代通用GPU;一边是英伟达一边营收狂飙一边被迫涨价。亚马逊也宣布2027至2028年在AWS再部署200万颗英伟达GPU。AI芯片战争正式开打,英伟达的统治地位正在被重新定义。

AI 生成 . DeepSeek | 搜索综合