行业机会 2026-09-13

OpenAI 自研推理芯片 Jalapeño 跑分出炉:功耗仅 700W,据称比英伟达 GB300 更快更省电

OpenAI 自研推理芯片 Jalapeño 跑分出炉:功耗仅 700W,据称比英伟达 GB300 更快更省电

发生了什么

9 月 13 日(Hot Chips 2026 大会期间),OpenAI 首次公开了它与博通(Broadcom)联合研发的自研 AI 推理芯片 Jalapeño 的完整架构与实测跑分。

几个关键数字:

  • 整封装功耗约 700W,配 6 颗 HBM4 高带宽内存,带宽 15.4 TB/s;
  • 在第三方机构 SemiAnalysis 的公开基准 InferenceX 上,Jalapeño 的每千瓦吞吐量比英伟达 GB200/GB300 高约 1.5–1.9 倍,端到端延迟低约 1.7–3.6 倍;
  • 它只负责「推理」——也就是模型训练好后回答用户请求这一步,不参与训练;OpenAI 计划 2026 年底起在自家数据中心小批量上线,2027 年扩大部署。

对我有什么用

过去大模型推理几乎全靠英伟达 GPU。OpenAI 自己下场造芯片,意味着头部实验室开始把「算力成本」这件事攥回自己手里:芯片专为低延迟、低功耗推理设计,目标是在同样的电费下多干几倍的活。对行业来说,这是「大模型公司不想只当英伟达客户」的明确信号。

不过要冷静看:英伟达下一代 Vera Rubin 平台已经开始出货,且训练芯片仍是英伟达的天下;Jalapeño 的对比对象主要是上一代 Blackwell,并不等于全面超越。

我可以怎么做

  • 你暂时用不到这块芯片本身,但它直接影响你用的产品:ChatGPT、API 调用如果跑在更省电的芯片上,响应更快、单次成本更低,未来可能体现为新功能更便宜、高峰期不那么卡。
  • 关注「推理芯片」这件事,能帮你理解为什么有些 AI 产品突然降价——底层算力成本下来了。

温馨提醒

  • 这是 OpenAI 自己公布的跑分,第三方 SemiAnalysis 到场见证了测试,但对比用的是英伟达「上一代」旗舰,并非最新平台,结论别过度 extrapolate。
  • 芯片 2026 年底才小规模上线,距离大规模影响你的日常体验还有时间。
  • 它不训练模型,所以「模型变聪明」和这块芯片无关,别混淆。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发