跳到主要內容
OpenAI

2026年6月24日

公司

OpenAI 與 Broadcom 發佈針對 LLM 優化的推理晶片

正在載入...
  • 早期測試顯示,第一代加速器的每瓦效能將大幅超越現時最先進水平
  • 從頭開始為業界現有及未來的 LLM 而設計
  • 由 OpenAI 模型加速,九個月內從設計推進至投產
  • 進一步擴充 OpenAI 的全棧平台,從產品到模型,如今延伸至晶片
  • 將與數據中心合作夥伴跨多代部署,規模達吉瓦級

OpenAI 與 Broadcom(NASDAQ: AVGO)今日發佈 Jalapeño,這是 OpenAI 首款 Intelligence Processor(智能處理器):一款按 OpenAI 對 LLM 推理未來願景而設計的加速器,也是兩家公司共同建立的多代運算平台中首款 AI 加速器,旨在讓先進 AI 更快速、更可靠,並讓更多人更易取得。

OpenAI 與 Broadcom 領導層展示 Jalapeño 推理晶片。

Broadcom 總裁兼行政總裁 Hock Tan 及總裁 Charlie Kawwas 將 Jalapeño 交付予 OpenAI 行政總裁 Sam Altman 和總裁 Greg Brockman,標誌着 OpenAI 在建立支撐其模型與產品的全棧策略上邁出重要一步。

OpenAI 基於對 LLM 基礎原理的深入理解,並參考其模型、運算內核、服務系統和產品需求路線圖,由基礎重新設計這款晶片;合作夥伴 Broadcom 和 Celestica 則透過晶片實施、板卡、機架系統整合、高效能網絡及可規模化的生產系統,協助平台走向工業化。Jalapeño 的設計具備靈活性,可配合所有 LLM 運作,並以 OpenAI 對業界現有及未來 AI 模型推理需求的分析見解為指引。Jalapeño 晶片的工程樣本已在實驗室以量產目標頻率與功耗運行機器學習(ML)工作負載,包括 GPT‑5.3‑Codex‑Spark。

雖然 OpenAI 仍在評估最終效能,但早期測試顯示,Jalapeño 的每瓦效能將大幅超越現時最先進水平。關於效能的詳細技術報告將於未來數月發表。該架構減少數據移動,並平衡運算、記憶體與網絡資源,使實際利用率更接近理論峰值效能。Broadcom 的矽晶片實現與網絡技術,包括 Tomahawk 網絡晶片,有助將該平台推向大規模生產。

「世界正邁向由運算驅動的經濟,」OpenAI 總裁兼共同創辦人 Greg Brockman 表示。「Jalapeño 是我們長期全棧基礎設施策略的一部分,目標是讓運算更充裕,從而帶來更快速、更可靠、成本更低、可供用戶和企業使用的 AI,並可用於解決更多重要問題。透過自行設計更多技術棧,我們能以更高效率提供更多智能,並持續推動先進 AI 走向更廣泛使用。」

「Jalapeño 從頭開始為 LLM 推理而設計,當中運用了我們與 OpenAI 研究人員緊密合作所得的深入洞察,」OpenAI 硬件項目負責人 Richard Ho 表示。「我們圍繞對前沿 AI 模型最關鍵的運算內核、記憶體移動、網絡和模型服務模式來優化架構。根據早期測試,Jalapeño 將能高效執行我們最重要的工作負載,接近硬件的理論極限。」

「我們與 OpenAI 的合作,代表着對擴展未來十年 AI 所需實體基礎設施的一項重要承諾,」Broadcom 總裁兼行政總裁 Hock Tan 表示。「這只是多代路線圖的開端。透過與 OpenAI 直接共同開發我們業界領先的矽晶片,我們正推動與 Microsoft 及其他合作夥伴自 2026 年起部署吉瓦級數據中心。」

旨在成為 LLM 最佳推理平台

Jalapeño 是為現代 LLM 推理從零設計的方案,而不是由早期 AI 工作負載改造而成的通用加速器。其設計參考了 OpenAI 每日運行於 ChatGPT、Codex、API 及未來具智能代理能力的產品的系統,同時也面向業界現有及未來的 LLM。目標是結合當今領先 AI 加速器的運算能力與吞吐量,以及接近最快專用推理系統的延遲表現,使 Jalapeño 非常適合大規模互動式 LLM 產品。

這就是全棧優勢。OpenAI 不只是開發前沿模型,或者依據模型建立產品;同時也在設計底層基礎設施:晶片架構、運算內核、記憶體系統、網絡、排程、部署系統和產品體驗。由於 OpenAI 橫跨整個技術棧運作,每一層都可圍繞同一目標優化:令模型對用戶而言更快、更可靠,成本亦更低。

Jalapeño 強化了推動 OpenAI 進步的飛輪。更好的基礎設施推動運算效率提升。更高的運算效率帶來更好的訓練與模型服務,最終支撐能力更強的 AI 模型。更好的模型會成為面向用戶、開發人員和企業的更佳產品。更好的產品帶來更多使用量、更多客戶和更多收入,使 OpenAI 能再投資於下一代基礎設施。長遠而言,這個循環有助讓智能對所有人而言能力更強、更可靠,而且成本更低。

由 OpenAI 模型加速,九個月完成流片

Jalapeño 從初步設計到製造流片僅用九個月便共同開發完成;我們相信,這項自訂 AI 加速器計劃創下了高效能先進半導體領域有史以來最快的 ASIC 開發週期。這樣的速度反映了 OpenAI 工程團隊深入的軟硬件共同開發、Broadcom 的矽晶片實現專長,以及運用 OpenAI 模型加速部分設計與優化流程。

向用戶提供服務的同一批模型,正協助改善未來模型運行所需的基礎設施。如果 AI 能協助工程師更快設計出更好的晶片,就能降低整個業界的運算成本,並協助普及先進 AI 的使用。

與合作夥伴建立多代平台

Jalapeño 是多代運算平台的第一步,該平台計劃於 2026 年底前初步部署,並在其後數年擴展;它結合 OpenAI 設計的加速器、Broadcom 的矽晶片實現、網絡與連接技術,以及 Celestica 在板卡、機架和系統方面的專長。

讓先進 AI 更廣泛可用

這項工作的重點很簡單:推理是 AI 真正觸達用戶的環節。成本、速度和可靠性的每一項改善,都可能體現為 ChatGPT 回答更快、Codex 任務可在更少等待下執行更多步驟、API 產品開發成本更低,或在需求高企時提供更可靠的服務可用性。

普及 AI 意味着讓先進模型變得易於取得、可靠,而且價格足以負擔,讓更多人能夠每天使用。Jalapeño 幫助 OpenAI 將更多基礎設施轉化為有用的智能,服務學生、開發人員、小型企業、研究人員、企業,以及任何正在學習、創作或解決難題的人。

作者

OpenAI