Az OpenAI és a Broadcom bemutatja LLM-re optimalizált inferenciachipjét
- A korai tesztek szerint az első generációs gyorsító wattonkénti teljesítménye jóval meghaladja majd a jelenlegi csúcstechnológia szintjét
- Az alapoktól a jelenlegi és jövőbeli, iparágszerte használt LLM-ekhez készült
- A tervezéstől a gyártásig kilenc hónap alatt készült el, az OpenAI modelljeinek segítségével felgyorsítva
- Kibővíti az OpenAI teljes körű platformját: a termékektől a modelleken át immár a chipekig
- Több generáción át, adatközponti partnerekkel, gigawattos léptékben kerül bevezetésre
Az OpenAI és a Broadcom (NASDAQ: AVGO) ma bemutatta a Jalapeñót, az OpenAI első Intelligence Processorát: egy olyan gyorsítót, amelyet az OpenAI LLM-inferencia jövőjére vonatkozó víziója köré terveztek, és amely az első AI-gyorsító abban a többgenerációs számítási platformban, amelyet a vállalatok közösen építenek, hogy a fejlett AI gyorsabbá, megbízhatóbbá és több ember számára hozzáférhetőbbé váljon.

A Jalapeñót a Broadcom elnöke és vezérigazgatója, Hock Tan, valamint elnöke, Charlie Kawwas adta át Sam Altmannak, az OpenAI vezérigazgatójának, és Greg Brockmannek, az OpenAI elnökének; ez fontos lépés az OpenAI azon stratégiájában, hogy kiépítse a modelljei és termékei mögötti teljes körű technológiát.
Az OpenAI a chipet az alapoktól tervezte meg az LLM-ek alapjainak mély ismeretére építve, modelljei, kernelei, kiszolgálórendszerei és termékigényei ütemtervéből kiindulva, a Broadcommal és a Celesticával együttműködésben; partnerei a chipmegvalósítás, a kártya- és rackszintű rendszerintegráció, a nagy teljesítményű hálózatkezelés és a skálázható gyártási rendszerek révén segítik a platform ipari léptékűvé tételét. A Jalapeñót rugalmas működésre tervezték minden LLM-mel, az OpenAI azon meglátásai alapján, amelyek a jelenlegi és jövőbeli, iparágszerte használt AI-modellek inferenciaigényeire vonatkoznak. A Jalapeño chip mérnöki mintái a laborban már ML-terheléseket futtatnak a gyártási célfrekvencián és célfogyasztással, köztük a GPT‑5.3‑Codex‑Sparkot.
Bár az OpenAI még méri a végleges teljesítményt, a korai tesztek azt mutatják, hogy a Jalapeño wattonkénti teljesítménye jóval meghaladja majd a jelenlegi csúcstechnológia szintjét. A teljesítményről szóló részletes műszaki jelentést a következő hónapokban mutatják be. Az architektúra csökkenti az adatmozgatást, és egyensúlyba hozza a számítási, memória- és hálózati erőforrásokat, hogy a tényleges kihasználtság sokkal közelebb kerüljön az elméleti csúcsteljesítményhez. A Broadcom szilíciummegvalósítási és hálózati technológiái, köztük a Tomahawk hálózati szilícium, segítenek a platform nagy léptékű gyártásba vitelében.
„A világ egy számítási kapacitásra épülő gazdaság felé halad” – mondta Greg Brockman, az OpenAI elnöke és társalapítója. „A Jalapeño része hosszú távú, teljes vertikumú infrastruktúra-stratégiánknak, amelynek célja a számítási kapacitás bőségesebbé tétele, hogy az AI gyorsabb, megbízhatóbb és megfizethetőbb legyen az emberek és a vállalatok számára, és fontosabb problémák megoldására lehessen használni. Azzal, hogy a technológiai vertikum nagyobb részét magunk tervezzük, hatékonyabban tudunk több intelligenciát kiszolgálni, és tovább vihetjük a fejlett AI-t a szélesebb hozzáférés felé.”
„A Jalapeñót az alapoktól LLM-inferenciára terveztük, az OpenAI kutatóival folytatott szoros együttműködésünk részletes tanulságaira építve” – mondta Richard Ho, az OpenAI hardverprogramjának vezetője. „Az architektúrát azokhoz a kernelekhez, memóriamozgásokhoz, hálózati és kiszolgálási mintákhoz optimalizáltuk, amelyek a legfontosabbak a határterületi AI-modellek számára. A korai tesztek alapján a Jalapeño a legfontosabb munkaterheléseinket hatékonyan, a hardver elméleti korlátaihoz közel hajtja majd végre.”
„Az OpenAI-jal folytatott együttműködésünk alapvető elköteleződést jelent az AI következő évtizedéhez szükséges fizikai infrastruktúra skálázása mellett” – mondta Hock Tan, a Broadcom elnöke és vezérigazgatója. „Ez még csak egy többgenerációs ütemterv kezdete. Azzal, hogy iparágvezető szilíciumtechnológiánkat közvetlenül az OpenAI-jal közösen fejlesztjük, 2026-tól lehetővé tesszük gigawattos léptékű adatközpontok üzembe állítását a Microsofttal és más partnerekkel.”
A Jalapeño tiszta lappal készült konstrukció a modern LLM-inferenciához, nem pedig korábbi AI-munkaterhelésekből átalakított, általános célú gyorsító. Az OpenAI által nap mint nap működtetett rendszerek tapasztalataira épül a ChatGPT, a Codex, az API és a jövőbeli ügynökalapú termékek terén, miközben a jelenlegi és jövőbeli, iparágszerte használt LLM-ekhez is készült. A cél, hogy a mai vezető AI-gyorsítók erejét és adatátviteli egységét a leggyorsabb specializált inferenciarendszerekhez közelebb álló késleltetéssel ötvözze, így a Jalapeño nagy léptékben is jól illeszkedik az interaktív LLM-termékekhez.
Ez a teljes körű technológia előnye. Az OpenAI nemcsak élvonalbeli modelleket fejleszt vagy ezekre épülő termékeket készít; az alattuk lévő infrastruktúrát is tervezi: a chiparchitektúrát, a kerneleket, a memóriarendszereket, a hálózatkezelést, az ütemezést, a telepítési rendszereket és a termékélményt. Mivel az OpenAI a teljes stackben jelen van, minden réteg ugyanarra a célra optimalizálható: hogy modelljei gyorsabbak, megbízhatóbbak és megfizethetőbbek legyenek a felhasználók számára.
A Jalapeño erősíti az OpenAI fejlődését hajtó lendkereket. A jobb infrastruktúra javítja a számítási hatékonyságot. A nagyobb számítási hatékonyság jobb tanítást és kiszolgálást tesz lehetővé, ami végső soron képességesebb AI-modelleket hajt. A jobb modellek jobb termékekké válnak az emberek, a fejlesztők és a vállalatok számára. A jobb termékek több használatot, több ügyfelet és nagyobb bevételt hoznak, ami lehetővé teszi az OpenAI számára, hogy újra befektessen az infrastruktúra következő generációjába. Idővel ez a körforgás segít abban, hogy az intelligencia mindenki számára képességesebb, megbízhatóbb és olcsóbb legyen.
A Jalapeñót a kezdeti tervezéstől a gyártási tape-outig mindössze kilenc hónap alatt fejlesztették közösen, és az egyedi AI-gyorsítóprogram szerintünk a valaha elért leggyorsabb ASIC-fejlesztési ciklust jelenti a nagy teljesítményű, fejlett félvezetők körében. Ez a gyorsaság az OpenAI mérnöki csapataival végzett mély szoftver-hardver együttfejlesztést, a Broadcom szilíciummegvalósítási szakértelmét, valamint az OpenAI modelljeinek használatát tükrözi, amelyek a tervezési és optimalizálási folyamat egyes részeit gyorsították fel.
Ugyanazok a modellek, amelyeket a felhasználók használnak, segítenek javítani a jövőbeli modellek futtatásához készült infrastruktúrát. Ha az AI segíthet a mérnököknek jobb chipeket gyorsabban tervezni, akkor csökkentheti a számítási kapacitás költségét az egész iparágban, és elősegítheti a fejlett AI-hoz való hozzáférés demokratizálását.
A Jalapeño az első lépés egy többgenerációs számítási platformban, amelynek kezdeti bevezetését 2026 végére tervezik, majd a következő években bővítik; a platform az OpenAI által tervezett gyorsítókat a Broadcom szilíciummegvalósítási, hálózati és kapcsolódási technológiáival, valamint a Celestica kártya-, rack- és rendszerszakértelmével ötvözi.
Ennek a munkának egyszerű a lényege: az inferencia az a pont, ahol az AI eljut az emberekhez. A költség, a sebesség és a megbízhatóság minden javulása megjelenhet gyorsabb ChatGPT‑válaszként, olyan Codex-feladatként, amely kevesebb várakozással több lépést tud megtenni, olcsóbban építhető API-termékként, vagy megbízhatóbb hozzáférésként nagy kereslet idején.
Az AI demokratizálása azt jelenti, hogy a fejlett modellek elég elérhetővé, megbízhatóvá és megfizethetővé válnak ahhoz, hogy többen használhassák őket nap mint nap. A Jalapeño segít az OpenAI-nak abban, hogy infrastruktúrájának nagyobb részét hasznos intelligenciává alakítsa diákok, fejlesztők, kisvállalkozások, kutatók, nagyvállalatok és mindenki számára, aki tanulni, alkotni vagy nehéz problémákat megoldani szeretne.


