🎯 科技 · AI芯片
一、掀桌之作:Jalapeño凭什么让英伟达"破防"了?🔥 OpenAI首款自研推理芯片Jalapeño性能碾压英伟达旗舰,每瓦吞吐量最高达1.9倍,推理延迟低至1/3.6,9个月完成流片刷新半导体开发速度纪录
2026年8月25日,科隆游戏展开幕夜,OpenAI在Hot Chips 2026大会上抛出了一枚重磅炸弹:首款自研AI推理芯片Jalapeño(墨西哥辣椒)的首批实测数据正式公布。结论只有一个——在多个主流大模型上,Jalapeño全面击败了英伟达当前最顶级的Blackwell系统。SemiAnalysis受邀进入OpenAI实验室现场验证,给出了"在所有测试过的Nvidia、AMD和Google芯片上,OpenAI在多个顶级开源模型上的表现都优于它们"的评价。这不是公关稿里的"显著优于",而是实打实的跑分碾压。
为什么这颗芯片如此引人注目?关键在于它打破了AI芯片行业的"不可能三角":此前的高性能推理要么追求吞吐量牺牲延迟,要么追求低延迟牺牲能效,而Jalapeño用同一套架构同时做到了每瓦吞吐量最高达对比系统的1.9倍,同时推理延迟低至对比系统的1/3.6。以GPT-OSS 120B模型为例,Jalapeño每千瓦峰值吞吐约8.54万token/s,GB200仅约4.5万token/s;单用户生成速度更是达到约1459 token/s,约为GB200的2.7倍。
二、9个月流片:从"天方夜谭"到"行业纪录"Jalapeño最让人瞠目的不只是性能,还有开发速度。从初始设计到完成流片仅用了9个月——这是OpenAI官方宣称的"高性能先进半导体领域有史以来最快的ASIC开发周期"。作为对比,传统高性能芯片从设计到流片通常需要18到24个月,甚至更长。
这9个月不是靠堆人堆出来的。OpenAI与博通(Broadcom)深度协同开发,使用了OpenAI自己的模型加速部分设计和优化流程——也就是说,服务用户的模型反过来帮助设计了服务用户的芯片,形成了一个完美的闭环。在GPT-OSS的部分attention和MoE模块中,由AI生成的kernel比人工专家编写的版本快1.5至1.8倍。这种"AI设计AI芯片"的范式,正在重新定义整个半导体行业的创新节奏。
三、不只是OpenAI的武器:行业格局正在被重写Jalapeño的发布,意味着AI算力自主权的游戏规则正在改变。长期以来,英伟达GPU几乎垄断了AI推理市场,其65%到70%的毛利率也让依赖算力的AI公司深感"被卡脖子"。OpenAI的选择很明确:不再把命脉交给别人。Jalapeño虽然目前只做推理、不做训练,但推理市场的规模远大于训练——ChatGPT每天数亿次请求消耗的算力,才是真正的大头。
更值得警惕的是,OpenAI的目标远不止于此。按照规划,Jalapeño将在2026年底开始部署,2027年快速爬坡,2028年全面量产,远期规划总耗电量高达10吉瓦。这是一个足以改变区域电力基础设施规模的算力集群。第二代产品已经进入制造阶段(采用台积电N3P工艺,MXFP4理论算力13.4 PFLOPS),第三代也已开始规划。
综合OpenAI官方博客、SemiAnalysis、DeepTech深科技、电子工程专辑报道 | 2026年8月31日