OpenAI 与 Broadcom 联合发布 LLM 推理芯片 Jalapeño
OpenAI and Broadcom unveil LLM-optimized inference chip
OpenAI 与 Broadcom 发布首款自研推理加速器 Jalapeño,专为当前及未来 LLM 从头设计。早期测试显示,其性能功耗比大幅优于现有 SOTA。工程样片已在实验室以目标频率和功耗运行 GPT‑5.3‑Codex‑Spark 等负载。芯片从设计到流片仅用 9 个月,并利用 OpenAI 模型加速部分流程。OpenAI 计划从 2026 年起与 Microsoft 等合作伙伴部署千兆瓦级数据中心,推出多代计算平台。
OpenAI 首次亲自设计芯片,和 Broadcom 联手推出专为 LLM 推理优化的 Jalapeño,从设计到流片仅 9 个月。虽然还只是早期测试,但性能功耗比大幅领先,一旦大规模部署,推理成本可能跳水,用 ChatGPT 的每个人都能感知到更快更便宜。
- 早期测试表明,第一代加速器的每瓦性能将大幅优于当前最先进的水平
- 从底层开始,专为业界当前及未来的 LLM 打造
- 从设计到量产仅用九个月,并借助 OpenAI 的模型加速完成
- 扩展了 OpenAI 的全栈平台,从产品到模型,如今延伸到芯片
- 将与数据中心合作伙伴一起,跨越多个代际,以吉瓦级规模部署
OpenAI 与 Broadcom(NASDAQ: AVGO)今日揭晓了 Jalapeño,这是 OpenAI 的首款智能处理器:一款围绕 OpenAI 对 LLM 推理未来的构想而设计的加速器,也是两家公司共同打造的多代际算力平台中的首款 AI 加速器,旨在让先进 AI 更快、更可靠,并惠及更多人。

Broadcom 总裁兼 CEO Hock Tan 与总裁 Charlie Kawwas 将 Jalapeño 交付给 OpenAI CEO Sam Altman 和总裁 Greg Brockman,这标志着 OpenAI 在其模型与产品背后构建全栈的战略上迈出了重要一步。
OpenAI 从零开始设计这款芯片,围绕其对 LLM 基本原理的深刻理解,并以自身在模型、kernel、服务系统和产品需求方面的路线图为依据,携手合作伙伴 Broadcom 和 Celestica,通过芯片实现、板卡、机架系统集成、高性能网络和可扩展生产系统,帮助将该平台产业化。Jalapeño 在设计上具备灵活性,可适配所有 LLM,这得益于 OpenAI 对当前及未来全行业 AI 模型推理需求的洞察。Jalapeño 芯片的工程样片正在实验室中以量产目标频率和功耗运行 ML 工作负载,其中包括 GPT‑5.3‑Codex‑Spark。
虽然 OpenAI 仍在测量最终性能,但早期测试显示,Jalapeño 的每瓦性能将大幅优于当前最先进水平。一份关于性能的详细技术报告将在未来几个月内发布。该架构减少了数据搬运,并平衡了计算、内存和网络资源,从而实现远更接近理论峰值性能的实际利用率。Broadcom 的芯片实现和网络技术,包括 Tomahawk 网络芯片,帮助该平台实现大规模量产。
“世界正在迈向算力驱动的经济,”OpenAI 总裁兼联合创始人 Greg Brockman 表示。“Jalapeño 是我们长期全栈基础设施战略的一部分,旨在让算力更加充裕,从而带来更快、更可靠、对个人和企业更可负担的 AI,并可用于解决更多重要问题。通过自行设计更多技术栈,我们能够以更高效率提供更多智能,并持续推动先进 AI 走向更广泛的普及。”
“Jalapeño 从底层开始就是专为 LLM 推理而设计的,依据的是我们与 OpenAI 研究人员密切合作所获得的详尽洞察,”负责领导 OpenAI 硬件项目的 Richard Ho 表示。“我们围绕对前沿 AI 模型最为关键的 kernel、内存搬运、网络和服务模式来优化架构。基于早期测试,Jalapeño 将能以接近硬件理论极限的效率执行我们最重要的工作负载。”
“我们与 OpenAI 的合作,代表了对扩展未来十年 AI 所需物理基础设施的一项根本性承诺,”Broadcom 总裁兼首席执行官 Hock Tan 表示。“这只是多代路线图的开始。通过直接与 OpenAI 共同开发我们业界领先的芯片,我们正在促成与 Microsoft 及其他合作伙伴从 2026 年开始部署吉瓦级数据中心。”
旨在成为 LLM 的最佳推理平台
Jalapeño 是针对现代 LLM 推理的全新空白设计,而不是从早期 AI 工作负载改造而来的通用加速器。它借鉴了 OpenAI 每天在 ChatGPT、Codex、API 以及未来智能体产品中运行的系统经验,同时也面向全行业当前和未来的 LLM 而设计。目标是融合当今领先 AI 加速器的算力与吞吐量,并将延迟压低到更接近最快的专用推理系统,使 Jalapeño 非常适合大规模交互式 LLM 产品。
这就是全栈优势。OpenAI 不仅在开发前沿模型,或在其之上构建产品;它还在设计模型底层的基础设施:芯片架构、内核、内存系统、网络、调度、部署系统以及产品体验。由于 OpenAI 横跨整个技术栈运营,每一层都可以围绕同一个目标进行优化:让它的模型对用户来说更快、更可靠、更实惠。
Jalapeño 强化了 OpenAI 进步背后的飞轮。更好的基础设施驱动算力效率提升。更高的算力效率使更好的训练和推理服务成为可能,最终支撑起能力更强的 AI 模型。更好的模型成为面向用户、开发者和企业更好的产品。更好的产品带来更多使用量、更多客户和更多收入,让 OpenAI 得以再投资于下一代基础设施。随着时间推移,这一循环帮助智能对每个人来说都变得更有能力、更可靠、更便宜。
九个月流片,由 OpenAI 模型加速
Jalapeño 从初始设计到制造流片仅用九个月便完成联合开发,这一定制 AI 加速器项目代表着我们所认为的高性能先进半导体领域有史以来实现的最快 ASIC 开发周期。这一速度体现了与 OpenAI 工程团队的深度软硬件协同开发、Broadcom 的芯片实现专长,以及利用 OpenAI 模型加速部分设计与优化流程。
服务于用户的同一批模型,也在帮助改进用于运行未来模型的基础设施。如果 AI 能帮助工程师更快地设计出更好的芯片,就能降低整个行业的算力成本,并帮助先进 AI 的获取更加普惠。
与合作伙伴共同打造多代平台
Jalapeño 是多代算力平台的第一步,该平台计划于 2026 年底完成首次部署,并在未来数年持续扩展,它将 OpenAI 设计的加速器与 Broadcom 的芯片实现、网络与连接技术,以及 Celestica 的板卡、机架和系统专长结合在一起。
让先进 AI 更广泛地可及
这项工作的意义很简单:推理是 AI 触达人们的地方。成本、速度和可靠性上的每一分改进,都能体现为更快的 ChatGPT 回答、一个能以更少等待完成更多步骤的 Codex 任务、一个构建成本更低的 API 产品,或在需求高涨时更可靠的访问。
让 AI 普惠,意味着让先进模型足够可用、可靠且负担得起,使更多人能够每天使用。Jalapeño 帮助 OpenAI 将其更多基础设施转化为有用的智能,服务于学生、开发者、小企业、研究人员、企业,以及任何试图学习、创造或解决难题的人。
来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · openai.com