跳至主要內容
OpenAI

2026年6月24日

公司

OpenAI 與博通發表專為 LLM 打造的推論晶片

載入中…
  • 早期測試顯示,第一代加速器的每瓦效能將大幅優於目前最先進水準
  • 從零開始打造,專為整個產業現有與未來的 LLM 而設計
  • 在 OpenAI 模型加速下,僅用九個月便完成從設計到量產
  • 擴展 OpenAI 的完整技術堆疊,從產品、模型到如今的晶片
  • 將與資料中心合作夥伴合作,以吉瓦級規模部署,並在未來數個世代持續擴大應用

OpenAI 與博通 (Broadcom, NASDAQ: AVGO) 今日發表 Jalapeño,這是 OpenAI 首款智慧處理器:一款依據 OpenAI 對 LLM 推論未來願景所打造的加速器,也是雙方共同建構的多世代運算平台中的首款 AI 加速器,旨在讓先進 AI 更快速、更可靠,並讓更多人容易取得。

OpenAI 與博通領導人展示 Jalapeño 推論晶片。

博通總裁暨執行長 Hock Tan 與總裁 Charlie Kawwas 將 Jalapeño 交付給 OpenAI 執行長 Sam Altman 和總裁 Greg Brockman,這標誌著 OpenAI 在建構支撐其模型與產品的完整技術堆疊策略上邁出重要一步。

OpenAI 根據自身對 LLM 基礎原理的深刻理解,並參考模型、核心程式、服務系統與產品需求路線圖,從零開始設計這款晶片;合作夥伴博通和 Celestica 則透過晶片實作、板卡、機櫃系統整合、高效能網路和可擴充生產系統,協助將平台推向產業化。Jalapeño 採用具彈性的設計,可搭配所有 LLM 運作;其設計依循 OpenAI 對整個產業現有與未來 AI 模型推論需求的洞察。Jalapeño 晶片的工程樣品已在實驗室以量產目標頻率與功耗執行機器學習工作負載,包括 GPT‑5.3‑Codex‑Spark。

雖然 OpenAI 仍在測量最終效能,但早期測試顯示,Jalapeño 的每瓦效能將大幅優於目前最先進水準。未來數月將發表一份詳細的效能技術報告。此架構減少資料移動,並平衡運算、記憶體與網路資源,使實際利用率更接近理論峰值效能。博通的晶片實作與網路技術,包括 Tomahawk 網路晶片,有助於將平台推向大規模生產。

「世界正邁向由運算驅動的經濟,」OpenAI 總裁暨共同創辦人 Greg Brockman 表示。「Jalapeño 是我們長期完整堆疊基礎設施策略的一部分,目標是讓運算資源更加充裕,進而帶來更快速、更可靠、個人與企業更負擔得起的 AI,並可用於解決更多重要問題。透過自行設計更多技術堆疊,我們能以更高效率提供更多智慧,並持續推動先進 AI 讓更多人取得。」

「Jalapeño 從一開始就為 LLM 推論而設計,採用了我們與 OpenAI 研究人員密切合作所獲得的詳細洞察,」OpenAI 硬體計畫負責人 Richard Ho 表示。「我們根據前沿 AI 模型最關鍵的核心程式、記憶體資料流,以及網路與服務模式,對架構進行最佳化。根據早期測試,Jalapeño 將能接近硬體理論極限,高效率執行我們最重要的工作負載。」

「我們與 OpenAI 的合作,代表我們對擴展未來十年 AI 所需實體基礎設施的根本承諾,」博通總裁暨執行長 Hock Tan 表示。「這只是多世代路線圖的開端。透過與 OpenAI 直接共同開發我們業界領先的矽晶片,我們將自 2026 年起,與 Microsoft 和其他合作夥伴一起部署吉瓦級資料中心。」

打造最適合 LLM 的推論平台

Jalapeño 是專為現代 LLM 推論從零開始設計的產品,並非從早期 AI 工作負載延伸改造的通用加速器。它的設計參考了 OpenAI 每天在 ChatGPT、Codex、API 和未來智慧體產品中運行的系統,同時也面向整個產業現有與未來的 LLM。目標是兼具頂尖 AI 加速器的效能與吞吐量,並提供接近最快專用推論系統的低延遲,以支援大規模互動式 LLM 產品。

這就是完整技術堆疊的優勢。OpenAI 不只是在開發前沿模型或在其上打造產品;它也在設計支撐這些模型的基礎設施:晶片架構、核心程式、記憶體系統、網路、排程、部署系統和產品體驗。由於 OpenAI 橫跨整個技術堆疊運作,每一層都能圍繞同一目標最佳化:讓其模型對使用者而言更快速、更可靠,也更負擔得起。

Jalapeño 強化了推動 OpenAI 進步的飛輪效應。更好的基礎設施會提升運算效率。更高的運算效率能帶來更好的訓練與服務,最終推動能力更強的 AI 模型。更好的模型會成為面向個人、開發者與企業的更好產品。更好的產品會帶來更多使用量、更多客戶和更多收入,讓 OpenAI 能再投資於下一代基礎設施。長期而言,這個循環有助於讓每個人都能享有能力更強、更可靠且成本更低的智慧。

OpenAI 模型加速,九個月完成流片

Jalapeño 從初始設計到完成流片僅用九個月共同開發完成;我們認為,這項客製 AI 加速器計畫創下高效能先進半導體史上最快的 ASIC 開發週期。這樣的速度,來自 OpenAI 工程團隊深入的軟硬體共同開發、博通的晶片實作專業,以及運用 OpenAI 模型加速部分設計與最佳化流程。

同樣服務使用者的模型,也正在協助改進用於運行未來模型的基礎設施。如果 AI 能協助工程師更快設計出更好的晶片,就能降低整個產業的運算成本,促進先進 AI 的普及。

與合作夥伴共同打造多世代平台

Jalapeño 是多世代運算平台的第一步,預計於 2026 年底前啟動初期部署,並在未來數年持續擴展;該平台結合 OpenAI 設計的加速器、博通的晶片實作、網路與連接技術,以及 Celestica 在板卡、機櫃和系統方面的專業。

讓先進 AI 更普及

這項工作的核心其實很簡單:推論是 AI 真正觸及使用者的環節。成本、速度和可靠性的每一項改善,都可能體現為 ChatGPT 更快的回答、Codex 任務能以更少等待完成更多步驟、API 產品建置成本更低,或在需求高峰時仍能提供更穩定可靠的存取體驗。

普及 AI,意味著讓更多人每天都能使用既先進、又可靠且負擔得起的模型。Jalapeño 幫助 OpenAI 將更多基礎設施能力轉化為實用智慧,供學生、開發者、小型企業、研究人員、企業,以及任何想學習、創作或解決難題的人使用。

作者

OpenAI