桃子桃子快讯
返回首页
行业动态

OpenAI 自研推理芯片 Jalapeño 首测曝光:能效优于英伟达 Blackwell

OpenAI 在 Hot Chips 大会公布 Jalapeño 推理芯片首份 benchmark,性能与能效均超英伟达…

2026.08.25 · 周二3 分钟阅读

OpenAI 在当地时间周二举办的 Hot Chips 大会上,首次公开了自研推理芯片 Jalapeño 的详细设计与 benchmark 结果。在第三方基准测试机构 Semianalysis 的 InferenceX 测试中,Jalapeño 在单用户 token 吞吐量和每千瓦吞吐量两项指标上,均优于当前业内顶尖的推理处理器。OpenAI 硬件负责人 Richard Ho 在媒体电话会上表示:「结果显示,Jalapeño 相对当前最先进水平实现了非常显著的性能跃升,每单位功耗可承载更多 AI 工作负载,响应速度也更快。」

关键 benchmark:直接对标英伟达 Blackwell

值得注意的是,OpenAI 在对比中选取的参照对象是英伟达的 Blackwell 系统——后者正是目前 AI 推理市场的主流硬件。不过 Ho 也坦言,等到 Jalapeño 全面部署时,对手大概率也会继续迭代。他给出的时间表是:2026 年底以「极小规模」上线,2027 年才会进入更大规模的部署。

  • 测试基准:Semianalysis InferenceX
  • 性能维度:单用户 token 数、每千瓦吞吐量
  • 对比对象:英伟达 Blackwell(当前主流推理芯片)

技术路径:优化 prefill 与通信瓶颈

Jalapeño 并非一款孤立的加速卡,而是 OpenAI 全栈战略的一部分。该芯片由 OpenAI 与博通(Broadcom)紧密合作研发,开发过程中 OpenAI 自家模型也参与了辅助设计。OpenAI 将 Jalapeño 定义为「多代际平台」,使其与模型、产品、芯片和内存能够协同演进。

官方在博客中写道:「Jalapeño 的设计目标是最大化减少数据搬运与通信延迟。」具体而言,芯片针对推理流程中常见的两个瓶颈——prefill 阶段和通信阶段——做了优化。在推理过程中,KV cache 等模型状态可以被显式放置并保持在本地,系统会按需调用对应的算力、内存和网络资源,从而降低延迟、提升吞吐。

影响与展望

OpenAI 早在去年 10 月便首次披露 Jalapeño 计划,但直到此次 Hot Chips 才公开性能数据。这一里程碑意味着 OpenAI 已从「自研芯片」的概念阶段,进入可量化、可对比的工程落地阶段。若 Jalapeño 后续规模化顺利,将对英伟达在 AI 推理硬件领域的主导地位构成实质性挑战;但鉴于 2027 年前产能有限,短期内的市场冲击仍有限,更多意义在于 OpenAI 对算力供应链的长期掌控力。

信源