OpenAI 与 Broadcom 发布面向 LLM 优化的推理芯片
- 早期测试显示,第一代加速器的每瓦性能将显著优于当前最先进水平
- 从零开始为业界当前和未来的 LLM 打造
- 在 OpenAI 模型助力下,从设计到量产仅用九个月完成开发
- 扩展 OpenAI 的全栈平台,从产品到模型,如今延伸至芯片
- 将与数据中心合作伙伴共同部署至吉瓦级规模,并覆盖多代产品
OpenAI 与 Broadcom(纳斯达克代码:AVGO)今日发布 Jalapeño,这是 OpenAI 的首款智能处理器:一款围绕 OpenAI 对 LLM 推理未来愿景而架构设计的加速器,也是双方正在共同构建的多代计算平台中的首款 AI 加速器,旨在让先进 AI 更快速、更可靠,并让更多人更容易获得。

Broadcom 总裁兼首席执行官 Hock Tan 和总裁 Charlie Kawwas 将 Jalapeño 交付给 OpenAI 首席执行官 Sam Altman 及总裁 Greg Brockman,这标志着 OpenAI 在为其模型和产品构建底层全栈能力的战略上迈出重要一步。
OpenAI 基于自身对 LLM 基础原理的深刻理解,从零开始设计这款芯片,并参考其模型、内核、服务系统和产品需求路线图;合作伙伴 Broadcom 和 Celestica 则通过芯片实现、电路板、机架系统集成、高性能网络以及可扩展的生产系统,帮助推动该平台走向产业化。Jalapeño 具备灵活设计,可适配所有 LLM,其设计基于 OpenAI 对业界当前和未来 AI 模型推理需求的洞察。Jalapeño 芯片的工程样片已在实验室以量产目标频率和功耗运行机器学习工作负载,包括 GPT‑5.3‑Codex‑Spark。
尽管 OpenAI 仍在测量最终性能,但早期测试显示,Jalapeño 的每瓦性能将显著优于当前最先进水平。有关性能的详细技术报告将在未来数月发布。该架构减少数据搬移,并平衡计算、内存和网络资源,使实际利用率更接近理论峰值性能。Broadcom 的硅实现与网络技术,包括 Tomahawk 网络芯片,有助于将该平台推向大规模生产。
“世界正在迈向由计算驱动的经济,”OpenAI 总裁兼联合创始人 Greg Brockman 表示。“Jalapeño 是我们长期全栈基础设施战略的一部分,目标是让计算更加充裕,从而为人们和企业带来更快、更可靠、更实惠的 AI,并用于解决更多重要问题。通过自行设计更多技术栈,我们可以以更高效率提供更多智能,并持续推动先进 AI 走向更广泛的可及性。”
“Jalapeño 从零开始为 LLM 推理而设计,并利用了我们与 OpenAI 研究人员紧密合作所获得的详细洞察,”负责 OpenAI 硬件项目的 Richard Ho 表示。“我们围绕对前沿 AI 模型最关键的内核、内存搬移、网络和服务模式优化了架构。根据早期测试,Jalapeño 将能高效执行我们最重要的工作负载,并接近硬件的理论极限。”
“我们与 OpenAI 的合作,体现了我们对扩展未来十年 AI 所需物理基础设施的根本承诺,”Broadcom 总裁兼首席执行官 Hock Tan 表示。“这只是多代路线图的开端。通过与 OpenAI 直接共同开发我们业界领先的硅技术,我们正支持从 2026 年开始与 Microsoft 及其他合作伙伴部署吉瓦级数据中心。”
Jalapeño 是面向现代 LLM 推理从零开始设计的产品,而不是从早期 AI 工作负载改造而来的通用加速器。它的设计参考了 OpenAI 每天在 ChatGPT、Codex、API 以及未来智能体产品中运行的系统,同时也面向业界当前和未来的 LLM。其目标是将当今领先 AI 加速器的算力和吞吐量,与接近最快专用推理系统的延迟结合起来,使 Jalapeño 非常适合大规模交互式 LLM 产品。
这就是全栈优势。OpenAI 不仅在开发前沿模型或基于这些模型构建产品;它还在设计其底层基础设施:芯片架构、内核、内存系统、网络、调度、部署系统和产品体验。由于 OpenAI 贯穿整个技术栈开展工作,每一层都可以围绕同一个目标进行优化:让其模型对用户而言更快、更可靠、更实惠。
Jalapeño 强化了推动 OpenAI 进步的飞轮。更好的基础设施提升计算效率。更高的计算效率带来更好的训练与服务,最终驱动能力更强的 AI 模型。更好的模型会转化为面向个人、开发者和企业的更好产品。更好的产品带来更多使用量、更多客户和更多收入,使 OpenAI 能够再投资于下一代基础设施。随着时间推移,这一循环将帮助每个人以更低成本获得能力更强、更可靠的智能。
Jalapeño 从初始设计到制造流片仅用九个月便完成共同开发;我们认为,这一定制 AI 加速器项目创下了高性能先进半导体领域有史以来最快的 ASIC 开发周期。这一速度体现了 OpenAI 工程团队深入的软件硬件协同开发、Broadcom 的硅实现专业能力,以及使用 OpenAI 模型加速部分设计和优化流程的成果。
服务于用户的同一批模型,正在帮助改进用于运行未来模型的基础设施。如果 AI 能帮助工程师更快设计出更好的芯片,它就能降低整个行业的计算成本,并帮助先进 AI 的可及性走向大众化。
Jalapeño 是多代计算平台的第一步,该平台计划于 2026 年底前初步部署,并在未来几年持续扩展;它将 OpenAI 设计的加速器,与 Broadcom 的硅实现、网络和连接技术,以及 Celestica 在电路板、机架和系统方面的专长结合起来。
这项工作的要点很简单:推理是 AI 触达人的环节。成本、速度和可靠性上的每一点改进,都可能体现为更快的 ChatGPT 回复、能够用更少等待完成更多步骤的 Codex 任务、更低成本即可构建的 API 产品,或在需求高峰期更可靠的访问体验。
让 AI 走向大众,意味着让先进模型足够可用、可靠且经济实惠,使更多人能够每天使用。Jalapeño 帮助 OpenAI 将更多基础设施转化为有用的智能,服务于学生、开发者、小企业、研究人员、企业,以及任何想要学习、创造或解决难题的人。


