OpenAI a Broadcom predstavili inferenčný čip optimalizovaný pre LLM
Prvé testy ukazujú, že akcelerátor prvej generácie poskytne výrazne lepší výkon na watt než súčasná špička
Od základu navrhnutý pre súčasné aj budúce LLM v celom odvetví
Vyvinutý od návrhu po výrobu za deväť mesiacov, s urýchlením vďaka modelom OpenAI
Rozširuje full-stack platformu OpenAI – od produktov cez modely až po čipy
Nasadenie v gigawattovom rozsahu s partnermi dátových centier počas viacerých generácií
OpenAI a Broadcom (NASDAQ: AVGO) dnes predstavili Jalapeño, prvý procesor inteligencie spoločnosti OpenAI: akcelerátor navrhnutý podľa vízie OpenAI pre budúcnosť inferencie LLM a prvý AI akcelerátor vo viacgeneračnej výpočtovej platforme, ktorú spoločnosti budujú spoločne, aby bola pokročilá AI rýchlejšia, spoľahlivejšia a dostupnejšia väčšiemu počtu ľudí.

Jalapeño odovzdali generálnemu riaditeľovi OpenAI Samovi Altmanovi a prezidentovi Gregovi Brockmanovi prezident a generálny riaditeľ Broadcomu Hock Tan a prezident Charlie Kawwas, čím sa potvrdil dôležitý krok v stratégii OpenAI vybudovať celý technologický stack za svojimi modelmi a produktmi.
OpenAI navrhla čip úplne od začiatku na základe svojho hlbokého porozumenia základom LLM a s ohľadom na plán vývoja modelov, kernelov, systémov obsluhy a potrieb produktov. Partneri Broadcom a Celestica pomohli industrializovať platformu implementáciou čipu, integráciou dosiek a rackových systémov, vysokovýkonnými sieťami a škálovateľnými výrobnými systémami. Jalapeño je navrhnuté flexibilne tak, aby fungovalo so všetkými LLM, na základe poznatkov OpenAI o inferenčných potrebách súčasných aj budúcich AI modelov v celom odvetví. Technické vzorky čipu Jalapeño spúšťajú v laboratóriu pracovné záťaže ML pri cieľovej výrobnej frekvencii a spotrebe vrátane GPT‑5.3‑Codex‑Spark.
Hoci OpenAI ešte meria konečný výkon, prvé testy ukazujú, že Jalapeño poskytne výrazne lepší výkon na watt než súčasná špička. Podrobná technická správa o výkone bude predstavená v najbližších mesiacoch. Architektúra znižuje presuny dát a vyvažuje výpočtové, pamäťové a sieťové zdroje, aby dosiahla skutočné využitie oveľa bližšie k teoretickému špičkovému výkonu. Čipová implementácia a sieťové technológie Broadcomu vrátane sieťového čipu Tomahawk pomáhajú uviesť platformu do veľkosériovej výroby.
„Svet smeruje k ekonomike poháňanej výpočtovou kapacitou,“ povedal Greg Brockman, prezident a spoluzakladateľ OpenAI. „Jalapeño je súčasťou našej dlhodobej full-stack infraštruktúrnej stratégie, ktorej cieľom je rozšíriť dostupnosť výpočtovej kapacity. Výsledkom bude AI, ktorá je pre ľudí a firmy rýchlejšia, spoľahlivejšia a cenovo dostupnejšia a dá sa použiť na riešenie dôležitejších problémov. Keď si sami navrhujeme väčšiu časť stacku, dokážeme poskytovať viac inteligencie s vyššou efektivitou a ďalej posúvať pokročilú AI k širšej dostupnosti.“
„Jalapeño bolo od základu navrhnuté na inferenciu LLM s využitím podrobných poznatkov z našej úzkej spolupráce s výskumníkmi OpenAI,“ povedal Richard Ho, ktorý vedie hardvérový program OpenAI. „Architektúru sme optimalizovali okolo kernelov, pohybu pamäte, sietí a vzorcov obsluhy, ktoré sú pre najpokročilejšie AI modely najdôležitejšie. Na základe prvých testov bude Jalapeño efektívne vykonávať naše najdôležitejšie záťaže blízko teoretických limitov hardvéru.“
„Naša spolupráca s OpenAI predstavuje zásadný záväzok škálovať fyzickú infraštruktúru potrebnú pre ďalšie desaťročie AI,“ povedal Hock Tan, prezident a generálny riaditeľ Broadcomu. „Toto je len začiatok viacgeneračného plánu. Spoločným vývojom nášho špičkového čipového riešenia priamo s OpenAI umožňujeme od roku 2026 nasadzovanie dátových centier gigawattového rozsahu s Microsoftom a ďalšími partnermi.“
Jalapeño je návrh od čistého stola pre modernú inferenciu LLM, nie univerzálny akcelerátor prispôsobený zo starších AI záťaží. Vychádza zo systémov, ktoré OpenAI denne prevádzkuje v službách ChatGPT, Codex, API a budúcich agentových produktoch, no zároveň je navrhnuté pre súčasné aj budúce LLM naprieč odvetvím. Cieľom je spojiť výkon a priepustnosť dnešných popredných AI akcelerátorov s latenciou bližšou najrýchlejším špecializovaným inferenčným systémom, vďaka čomu je Jalapeño vhodné pre interaktívne LLM produkty vo veľkom rozsahu.
To je výhoda full-stack prístupu. OpenAI nevyvíja len najpokročilejšie modely ani nestavia produkty nad nimi; navrhuje aj infraštruktúru pod nimi: architektúru čipov, kernely, pamäťové systémy, siete, plánovanie, systémy nasadzovania a používateľskú skúsenosť produktov. Keďže OpenAI pôsobí naprieč celým stackom, každú vrstvu možno optimalizovať podľa rovnakého cieľa: aby boli jej modely pre používateľov rýchlejšie, spoľahlivejšie a cenovo dostupnejšie.
Jalapeño posilňuje zotrvačník pokroku OpenAI. Lepšia infraštruktúra zvyšuje efektivitu výpočtov. Vyššia efektivita výpočtov umožňuje lepší tréning a obsluhu, čo napokon poháňa schopnejšie AI modely. Lepšie modely sa menia na lepšie produkty pre ľudí, vývojárov a firmy. Lepšie produkty prinášajú vyššie používanie, viac zákazníkov a vyššie príjmy, čo OpenAI umožňuje reinvestovať do ďalšej generácie infraštruktúry. Postupom času tento cyklus pomáha robiť inteligenciu schopnejšou, spoľahlivejšou a lacnejšou pre všetkých.
Jalapeño bolo spoločne vyvinuté od úvodného návrhu po výrobný tape-out za iba deväť mesiacov a program vlastného AI akcelerátora predstavuje podľa nás najrýchlejší vývojový cyklus ASIC, aký sa kedy podarilo dosiahnuť pri vysokovýkonných pokročilých polovodičoch. Táto rýchlosť odráža hlboký spoločný vývoj softvéru a hardvéru s inžinierskymi tímami OpenAI, expertízu Broadcomu v implementácii čipov a využitie modelov OpenAI na urýchlenie častí procesu návrhu a optimalizácie.
Tie isté modely, ktoré slúžia používateľom, pomáhajú zlepšovať infraštruktúru používanú na prevádzku budúcich modelov. Ak AI dokáže pomôcť inžinierom navrhovať lepšie čipy rýchlejšie, môže znížiť náklady na výpočty v celom odvetví a pomôcť demokratizovať prístup k pokročilej AI.
Jalapeño je prvým krokom vo viacgeneračnej výpočtovej platforme navrhnutej na počiatočné nasadenie do konca roka 2026 a rozširovanie v ďalších rokoch. Spája akcelerátory navrhnuté OpenAI s čipovou implementáciou Broadcomu, sieťovými a konektivitnými technológiami a odbornými znalosťami Celesticy v oblasti dosiek, rackov a systémov.
Zmysel tejto práce je jednoduchý: inferencia je miesto, kde sa AI dostáva k ľuďom. Každé zlepšenie nákladov, rýchlosti a spoľahlivosti sa môže prejaviť ako rýchlejšia odpoveď v ChatGPT, úloha v produkte Codex, ktorá zvládne viac krokov s kratším čakaním, API produkt, ktorý je lacnejšie vybudovať, alebo spoľahlivejší prístup pri vysokom dopyte.
Demokratizovať AI znamená sprístupniť pokročilé modely tak, aby boli k dispozícii, spoľahlivé a dostatočne cenovo dostupné na každodenné používanie pre viac ľudí. Jalapeño pomáha OpenAI premieňať väčšiu časť svojej infraštruktúry na užitočnú inteligenciu pre študentov, vývojárov, malé firmy, výskumníkov, podniky a každého, kto sa chce učiť, tvoriť alebo riešiť náročné problémy.


