桃子桃子快讯
返回首页
行业动态

OpenAI 公布自研推理芯片 Jalapeño:主打更低延迟与更高吞吐

OpenAI 发布博文,称与 Broadcom 合作开发的推理 ASIC Jalapeño 在延迟与吞吐上优于竞品。

2026.08.25 · 周二2 分钟阅读

OpenAI 在本周二发布的官方博文中表示,其自研 AI 推理芯片 Jalapeño 在完成任务时比同类系统更高效,响应速度也更快。OpenAI 硬件副总裁 Richard Ho 在与记者的简报会上表示,Jalapeño 在延迟(latency)和吞吐量(throughput)两项指标上做到了兼顾,提供「两全其美」的选择——而传统的 AI 系统通常不得不在二者之间做取舍。

芯片定位:专攻 AI 推理

Jalapeño 是一款面向 AI 推理场景的专用集成电路(Application-Specific Integrated Circuit,ASIC),用于在模型训练完成后实际执行任务或部署智能体(agent)。推理环节是模型上线后被用户高频调用的阶段,对响应速度和并发能力有较高要求,因此芯片设计的目标与训练芯片并不相同。

性能主张:兼顾低延迟与高吞吐

据 OpenAI 介绍,Jalapeño 的设计目标是同时压低单次请求的响应时间、并维持高并发处理能力。在简报中,Ho 强调 AI 系统长期面临「延迟与吞吐的权衡」——提升吞吐量往往意味着延迟上升,反之亦然——而 Jalapeño 据称打破了这一两难。原文并未给出具体的基准测试数字或对比对象,相关数据有待 OpenAI 在后续博文中进一步披露。

合作背景:从 6 月首次亮相到本次更新

Jalapeño 最早于今年 6 月公开亮相,由 OpenAI 与芯片设计厂商 Broadcom 联合开发。ASIC 路线意味着 OpenAI 正沿着与通用 GPU 不同的方向自研专用硬件,与行业内多家大模型公司布局自研芯片的趋势一致。本次博文和简报属于对该芯片的阶段性更新,重点强调其在推理负载上的效率优势。

注:原文在「To mea…」处截断,部分性能细节与对比基准未在已抽取的文本中呈现,读者如需完整数据可参考 OpenAI 官方博文与 The Verge 后续报道。

信源