# OpenAI 与 Broadcom 联合发布 LLM 推理芯片 Jalapeño

- 来源：OpenAI：官网动态（RSS · 排除企业/客户案例）
- 发布时间：2026-06-24 14:00
- AIHOT 分数：61
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmqs319vw0qkcslp52gzwr77q
- 原文链接：https://openai.com/index/openai-broadcom-jalapeno-inference-chip

## 精选理由

OpenAI 首次亲自设计芯片，和 Broadcom 联手推出专为 LLM 推理优化的 Jalapeño，从设计到流片仅 9 个月。虽然还只是早期测试，但性能功耗比大幅领先，一旦大规模部署，推理成本可能跳水，用 ChatGPT 的每个人都能感知到更快更便宜。

## AI 摘要

OpenAI 与 Broadcom 发布首款自研推理加速器 Jalapeño，专为当前及未来 LLM 从头设计。早期测试显示，其性能功耗比大幅优于现有 SOTA。工程样片已在实验室以目标频率和功耗运行 GPT‑5.3‑Codex‑Spark 等负载。芯片从设计到流片仅用 9 个月，并利用 OpenAI 模型加速部分流程。OpenAI 计划从 2026 年起与 Microsoft 等合作伙伴部署千兆瓦级数据中心，推出多代计算平台。

## 正文

早期测试表明，第一代加速器在每瓦性能上将显著优于当前最先进水平。

该加速器从头开始构建，旨在服务于行业内当前及未来的大语言模型。

从设计到生产仅用九个月完成，开发过程由 OpenAI 的模型加速推进。

扩展了 OpenAI 的全栈平台，从产品到模型，如今延伸至芯片领域。

将与数据中心合作伙伴一起，以吉瓦级规模部署，并覆盖多代产品。

OpenAI 与博通（纳斯达克：AVGO）今日共同发布了 Jalapeño——OpenAI 的首款智能处理器。这是一款围绕 OpenAI 对未来大语言模型推理的愿景而设计的加速器，也是双方共同打造的多代计算平台中的首款 AI 加速器，旨在让先进 AI 更快、更可靠，并让更多人能够使用。

博通总裁兼首席执行官 Hock Tan 与总裁 Charlie Kawwas 将 Jalapeño 交付给 OpenAI 首席执行官 Sam Altman 和总裁 Greg Brockman，这标志着 OpenAI 构建模型与产品背后全栈技术战略迈出了重要一步。

OpenAI 基于自身对大语言模型基本原理的深刻理解，结合其模型路线图、内核、服务系统及产品需求，从零开始设计了这款芯片，并与合作伙伴博通和 Celestica 共同推动平台工业化，涵盖芯片实现、板卡、机架系统集成、高性能网络及可扩展生产系统。Jalapeño 的设计具备灵活性，能够适配所有大语言模型，其设计思路源于 OpenAI 对行业内当前及未来 AI 模型推理需求的洞察。Jalapeño 芯片的工程样品已在实验室中以生产目标频率和功耗运行机器学习工作负载，其中包括 GPT‑5.3‑Codex‑Spark。

虽然 OpenAI 仍在测量最终性能，但早期测试显示，Jalapeño 的每瓦性能将显著优于当前最先进水平。一份详细的技术性能报告将在未来几个月内发布。该架构减少了数据移动，并平衡了计算、内存和网络资源，从而使实际利用率更接近理论峰值性能。博通的芯片实现和网络技术（包括 Tomahawk 网络芯片）有助于将该平台推向大规模生产。

“世界正在向计算驱动的经济转型，”OpenAI 总裁兼联合创始人 Greg Brockman 表示。“Jalapeño 是我们长期全栈基础设施战略的一部分，旨在让计算资源更加充裕，从而使 AI 更快、更可靠、对个人和企业更实惠，并能够用于解决更重要的难题。通过自行设计更多技术栈环节，我们能够以更高效率提供更多智能，并持续推动先进 AI 走向更广泛的普及。”

“Jalapeño 是基于我们与 OpenAI 研究人员密切合作所获得的深刻洞察，从头开始为 LLM 推理设计的，”负责 OpenAI 硬件项目的 Richard Ho 说道。“我们围绕对前沿 AI 模型最重要的内核、内存移动、网络和服务模式优化了架构。根据早期测试，Jalapeño 将能够在接近硬件理论极限的情况下高效执行我们最重要的负载。”

“我们与 OpenAI 的合作代表着对扩展未来十年 AI 所需物理基础设施的根本性承诺，”博通总裁兼首席执行官 Hock Tan 表示。“这只是一个多代路线图的开始。通过与 OpenAI 直接共同开发我们业界领先的芯片，我们正与微软及其他合作伙伴一起，从 2026 年开始实现吉瓦级数据中心的部署。”

专为 LLM 设计的最佳推理平台

Jalapeño 是为现代大语言模型推理设计的白板式架构，并非从早期 AI 工作负载改造而来的通用加速器。它的设计灵感来源于 OpenAI 每天在 ChatGPT、Codex、API 以及未来智能体产品中运行的各类系统，同时也面向行业内当前及未来的大语言模型进行设计。其目标是将当今领先 AI 加速器的强大算力与吞吐量，与接近最快专用推理系统的低延迟相结合，使 Jalapeño 非常适合大规模交互式大语言模型产品。

这就是全栈优势。OpenAI 不仅开发前沿模型或在模型之上构建产品，更在为其设计底层基础设施：芯片架构、内核、内存系统、网络、调度、部署系统以及产品体验。由于 OpenAI 在整个技术栈上运作，每一层都可以围绕同一个目标进行优化：让模型对用户来说更快、更可靠、更实惠。

Jalapeño 强化了 OpenAI 进步背后的飞轮效应。更好的基础设施推动计算效率提升。更高的计算效率带来更优的训练和推理服务，最终支撑起更强大的 AI 模型。更好的模型为用户、开发者和企业打造出更出色的产品。更好的产品带来更多使用量、更多客户和更多收入，使 OpenAI 能够对下一代基础设施进行再投资。随着时间的推移，这一循环有助于让智能变得更强大、更可靠，并且对每个人来说都更便宜。

九个月流片，由 OpenAI 模型加速

Jalapeño 从初始设计到制造流片仅用时九个月便协同开发完成，这个定制 AI 加速器项目代表了我们认为在高性能先进半导体领域有史以来最快的 ASIC 开发周期。这一速度体现了 OpenAI 工程团队与博通硅实现专业知识的深度软硬件协同开发，以及利用 OpenAI 模型来加速部分设计与优化流程。

面向用户提供的同一批模型，也在帮助改进用于运行未来模型的基础设施。如果人工智能能够帮助工程师更快地设计出更好的芯片，就能降低整个行业的计算成本，并有助于推动先进人工智能的普及。

与合作伙伴共同构建多代平台

Jalapeño 是一个多代计算平台的第一步，计划于 2026 年底前完成初步部署，并在未来几年持续扩展。该平台结合了 OpenAI 设计的加速器与博通的芯片实现、网络及连接技术，并融入了天弘在电路板、机架及系统方面的专业能力。

让先进人工智能更广泛地可用

这项工作的目的很简单：推理是人工智能触达用户的环节。成本、速度和可靠性方面的每一项改进，都可能体现为更快的 ChatGPT 回答、能够执行更多步骤且等待时间更短的 Codex 任务、构建成本更低的 API 产品，或是在高需求时段更稳定的访问体验。

让人工智能民主化，意味着让先进模型足够可用、可靠且价格合理，以便更多人能够日常使用。Jalapeño 帮助 OpenAI 将更多基础设施转化为有用的智能，服务于学生、开发者、小企业、研究人员、企业，以及任何试图学习、创造或解决难题的人。
