OpenAI a Broadcom predstavili inferenčný čip optimalizovaný pre LLM
- Prvé testy ukazujú, že akcelerátor prvej generácie poskytne výrazne lepší výkon na watt než súčasná špička
- Od základu navrhnutý pre súčasné aj budúce LLM v celom odvetví
- Vyvinutý od návrhu po výrobu za deväť mesiacov, s urýchlením vďaka modelom OpenAI
- Rozširuje full-stack platformu OpenAI – od produktov cez modely až po čipy
- Nasadenie v gigawattovom rozsahu s partnermi dátových centier počas viacerých generácií
OpenAI a Broadcom (NASDAQ: AVGO) dnes predstavili Jalapeño, prvý procesor inteligencie spoločnosti OpenAI: akcelerátor navrhnutý podľa vízie OpenAI pre budúcnosť inferencie LLM a prvý AI akcelerátor vo viacgeneračnej výpočtovej platforme, ktorú spoločnosti budujú spoločne, aby bola pokročilá AI rýchlejšia, spoľahlivejšia a dostupnejšia väčšiemu počtu ľudí.

Jalapeño odovzdali generálnemu riaditeľovi OpenAI Samovi Altmanovi a prezidentovi Gregovi Brockmanovi prezident a generálny riaditeľ Broadcomu Hock Tan a prezident Charlie Kawwas, čím sa potvrdil dôležitý krok v stratégii OpenAI vybudovať celý technologický stack za svojimi modelmi a produktmi.
OpenAI navrhla čip úplne od začiatku na základe svojho hlbokého porozumenia základom LLM a s ohľadom na plán vývoja modelov, kernelov, systémov obsluhy a potrieb produktov. Partneri Broadcom a Celestica pomohli industrializovať platformu implementáciou čipu, integráciou dosiek a rackových systémov, vysokovýkonnými sieťami a škálovateľnými výrobnými systémami. Jalapeño je navrhnuté flexibilne tak, aby fungovalo so všetkými LLM, na základe poznatkov OpenAI o inferenčných potrebách súčasných aj budúcich AI modelov v celom odvetví. Technické vzorky čipu Jalapeño spúšťajú v laboratóriu pracovné záťaže ML pri cieľovej výrobnej frekvencii a spotrebe vrátane GPT‑5.3‑Codex‑Spark.
Hoci OpenAI ešte meria konečný výkon, prvé testy ukazujú, že Jalapeño poskytne výrazne lepší výkon na watt než súčasná špička. Podrobná technická správa o výkone bude predstavená v najbližších mesiacoch. Architektúra znižuje presuny dát a vyvažuje výpočtové, pamäťové a sieťové zdroje, aby dosiahla skutočné využitie oveľa bližšie k teoretickému špičkovému výkonu. Čipová implementácia a sieťové technológie Broadcomu vrátane sieťového čipu Tomahawk pomáhajú uviesť platformu do veľkosériovej výroby.
„Svet smeruje k ekonomike poháňanej výpočtovou kapacitou,“ povedal Greg Brockman, prezident a spoluzakladateľ OpenAI. „Jalapeño je súčasťou našej dlhodobej full-stack infraštruktúrnej stratégie, ktorej cieľom je rozšíriť dostupnosť výpočtovej kapacity. Výsledkom bude AI, ktorá je pre ľudí a firmy rýchlejšia, spoľahlivejšia a cenovo dostupnejšia a dá sa použiť na riešenie dôležitejších problémov. Keď si sami navrhujeme väčšiu časť stacku, dokážeme poskytovať viac inteligencie s vyššou efektivitou a ďalej posúvať pokročilú AI k širšej dostupnosti.“
„Jalapeño bolo od základu navrhnuté na inferenciu LLM s využitím podrobných poznatkov z našej úzkej spolupráce s výskumníkmi OpenAI,“ povedal Richard Ho, ktorý vedie hardvérový program OpenAI. „Architektúru sme optimalizovali okolo kernelov, pohybu pamäte, sietí a vzorcov obsluhy, ktoré sú pre najpokročilejšie AI modely najdôležitejšie. Na základe prvých testov bude Jalapeño efektívne vykonávať naše najdôležitejšie záťaže blízko teoretických limitov hardvéru.“
„Naša spolupráca s OpenAI predstavuje zásadný záväzok škálovať fyzickú infraštruktúru potrebnú pre ďalšie desaťročie AI,“ povedal Hock Tan, prezident a generálny riaditeľ Broadcomu. „Toto je len začiatok viacgeneračného plánu. Spoločným vývojom nášho špičkového čipového riešenia priamo s OpenAI umožňujeme od roku 2026 nasadzovanie dátových centier gigawattového rozsahu s Microsoftom a ďalšími partnermi.“
Jalapeño je návrh od čistého stola pre modernú inferenciu LLM, nie univerzálny akcelerátor prispôsobený zo starších AI záťaží. Vychádza zo systémov, ktoré OpenAI denne prevádzkuje v službách ChatGPT, Codex, API a budúcich agentových produktoch, no zároveň je navrhnuté pre súčasné aj budúce LLM naprieč odvetvím. Cieľom je spojiť výkon a priepustnosť dnešných popredných AI akcelerátorov s latenciou bližšou najrýchlejším špecializovaným inferenčným systémom, vďaka čomu je Jalapeño vhodné pre interaktívne LLM produkty vo veľkom rozsahu.
To je výhoda full-stack prístupu. OpenAI nevyvíja len najpokročilejšie modely ani nestavia produkty nad nimi; navrhuje aj infraštruktúru pod nimi: architektúru čipov, kernely, pamäťové systémy, siete, plánovanie, systémy nasadzovania a používateľskú skúsenosť produktov. Keďže OpenAI pôsobí naprieč celým stackom, každú vrstvu možno optimalizovať podľa rovnakého cieľa: aby boli jej modely pre používateľov rýchlejšie, spoľahlivejšie a cenovo dostupnejšie.
Jalapeño posilňuje zotrvačník pokroku OpenAI. Lepšia infraštruktúra zvyšuje efektivitu výpočtov. Vyššia efektivita výpočtov umožňuje lepší tréning a obsluhu, čo napokon poháňa schopnejšie AI modely. Lepšie modely sa menia na lepšie produkty pre ľudí, vývojárov a firmy. Lepšie produkty prinášajú vyššie používanie, viac zákazníkov a vyššie príjmy, čo OpenAI umožňuje reinvestovať do ďalšej generácie infraštruktúry. Postupom času tento cyklus pomáha robiť inteligenciu schopnejšou, spoľahlivejšou a lacnejšou pre všetkých.
Jalapeño bolo spoločne vyvinuté od úvodného návrhu po výrobný tape-out za iba deväť mesiacov a program vlastného AI akcelerátora predstavuje podľa nás najrýchlejší vývojový cyklus ASIC, aký sa kedy podarilo dosiahnuť pri vysokovýkonných pokročilých polovodičoch. Táto rýchlosť odráža hlboký spoločný vývoj softvéru a hardvéru s inžinierskymi tímami OpenAI, expertízu Broadcomu v implementácii čipov a využitie modelov OpenAI na urýchlenie častí procesu návrhu a optimalizácie.
Tie isté modely, ktoré slúžia používateľom, pomáhajú zlepšovať infraštruktúru používanú na prevádzku budúcich modelov. Ak AI dokáže pomôcť inžinierom navrhovať lepšie čipy rýchlejšie, môže znížiť náklady na výpočty v celom odvetví a pomôcť demokratizovať prístup k pokročilej AI.
Jalapeño je prvým krokom vo viacgeneračnej výpočtovej platforme navrhnutej na počiatočné nasadenie do konca roka 2026 a rozširovanie v ďalších rokoch. Spája akcelerátory navrhnuté OpenAI s čipovou implementáciou Broadcomu, sieťovými a konektivitnými technológiami a odbornými znalosťami Celesticy v oblasti dosiek, rackov a systémov.
Zmysel tejto práce je jednoduchý: inferencia je miesto, kde sa AI dostáva k ľuďom. Každé zlepšenie nákladov, rýchlosti a spoľahlivosti sa môže prejaviť ako rýchlejšia odpoveď v ChatGPT, úloha v produkte Codex, ktorá zvládne viac krokov s kratším čakaním, API produkt, ktorý je lacnejšie vybudovať, alebo spoľahlivejší prístup pri vysokom dopyte.
Demokratizovať AI znamená sprístupniť pokročilé modely tak, aby boli k dispozícii, spoľahlivé a dostatočne cenovo dostupné na každodenné používanie pre viac ľudí. Jalapeño pomáha OpenAI premieňať väčšiu časť svojej infraštruktúry na užitočnú inteligenciu pre študentov, vývojárov, malé firmy, výskumníkov, podniky a každého, kto sa chce učiť, tvoriť alebo riešiť náročné problémy.


