OpenAI i Broadcom otkrivaju čip za LLM inferenciju
- Rana testiranja pokazuju da će akcelerator prve generacije isporučiti znatno bolje performanse po vatu od trenutno najsavremenijih rješenja
- Od temelja napravljen za sadašnje i buduće LLM-ove u cijeloj industriji
- Razvijen od dizajna do proizvodnje za devet mjeseci, uz ubrzanje pomoću OpenAI modela
- Proširuje OpenAI platformu punog steka, od proizvoda do modela, a sada i do čipova
- Bit će uveden na gigavatnoj razmjeri s partnerima za data centre, kroz više generacija
OpenAI i Broadcom (NASDAQ: AVGO) danas su predstavili Jalapeño, prvi OpenAI procesor inteligencije: akcelerator projektovan oko OpenAI vizije budućnosti LLM inferencije i prvi AI akcelerator u višegeneracijskoj računarskoj platformi koju kompanije zajedno grade kako bi napredna AI bila brža, pouzdanija i dostupnija većem broju ljudi.

Jalapeño su izvršnom direktoru OpenAI-ja Samu Altmanu i predsjedniku Gregu Brockmanu uručili predsjednik i izvršni direktor Broadcoma Hock Tan i predsjednik Charlie Kawwas, što označava važan korak u OpenAI strategiji izgradnje cijelog steka iza svojih modela i proizvoda.
OpenAI je čip dizajnirao od nule, oslanjajući se na duboko razumijevanje osnova LLM-ova, uz uvide iz svoje mape razvoja modela, kernela, sistema za opsluživanje i potreba proizvoda, s partnerima Broadcomom i Celesticom, koji pomažu da se platforma uvede u industrijsku proizvodnju kroz implementaciju čipa, integraciju ploča, rack sistema, visokoperformansnog umrežavanja i skalabilnih proizvodnih sistema. Jalapeño je dizajniran dovoljno fleksibilno da radi sa svim LLM-ovima, vođen OpenAI uvidima u potrebe inferencije sadašnjih i budućih AI modela širom industrije. Inženjerski uzorci čipa Jalapeño u laboratoriji pokreću ML radna opterećenja na ciljnoj proizvodnoj frekvenciji i snazi, uključujući GPT‑5.3‑Codex‑Spark.
Iako OpenAI još mjeri konačne performanse, rana testiranja pokazuju da će Jalapeño isporučiti znatno bolje performanse po vatu od trenutno najsavremenijih rješenja. Detaljan tehnički izvještaj o performansama bit će predstavljen u narednim mjesecima. Arhitektura smanjuje pomjeranje podataka i uravnotežuje računarske, memorijske i mrežne resurse kako bi stvarna iskorištenost bila mnogo bliža teorijskom maksimumu performansi. Broadcomova implementacija čipa i mrežne tehnologije, uključujući mrežne čipove Tomahawk, pomažu da platforma dođe do proizvodnje u velikom obimu.
„Svijet prelazi na ekonomiju koju pokreću računarski kapaciteti“, rekao je Greg Brockman, predsjednik i suosnivač OpenAI-ja. „Jalapeño je dio naše dugoročne strategije infrastrukture punog steka za povećanje dostupnosti računarskih kapaciteta, što donosi AI koja je brža, pouzdanija i pristupačnija ljudima i kompanijama te se može koristiti za rješavanje važnijih problema. Time što sami dizajniramo veći dio steka, možemo pružati više inteligencije uz veću efikasnost i nastaviti širiti pristup naprednoj AI.“
„Jalapeño je od temelja dizajniran za LLM inferenciju, koristeći detaljne uvide iz naše bliske saradnje s istraživačima OpenAI-ja“, rekao je Richard Ho, koji vodi OpenAI hardverski program. „Optimizirali smo arhitekturu oko kernela, kretanja memorije, umrežavanja i obrazaca opsluživanja koji su najvažniji za najsavremenije AI modele. Na osnovu ranih testiranja, Jalapeño će efikasno izvršavati naša najvažnija radna opterećenja blizu teorijskih granica hardvera.“
„Naša saradnja s OpenAI-jem predstavlja temeljnu posvećenost širenju fizičke infrastrukture potrebne za narednu deceniju AI-ja“, rekao je Hock Tan, predsjednik i izvršni direktor Broadcoma. „Ovo je tek početak višegeneracijske mape razvoja. Zajedničkim razvojem našeg vodećeg silicija u industriji direktno s OpenAI-jem omogućavamo uvođenje data centara gigavatne razmjere s Microsoftom i drugim partnerima počevši od 2026.“
Jalapeño je dizajn od praznog lista za modernu LLM inferenciju, a ne višenamjenski akcelerator prilagođen iz ranijih AI radnih opterećenja. Zasnovan je na sistemima koje OpenAI svakodnevno pokreće kroz ChatGPT, Codex, API i buduće agentske proizvode, dok je istovremeno dizajniran za sadašnje i buduće LLM-ove širom industrije. Cilj je spojiti snagu i protok današnjih vodećih AI akceleratora s latencijom bližom najbržim specijaliziranim sistemima za inferenciju, čime je Jalapeño dobro prilagođen za interaktivne LLM proizvode u velikoj razmjeri.
To je prednost punog steka. OpenAI ne razvija samo najsavremenije modele niti samo gradi proizvode na njima; dizajnira i infrastrukturu ispod njih: arhitekturu čipova, kernele, memorijske sisteme, umrežavanje, raspoređivanje, sisteme implementacije i korisničko iskustvo proizvoda. Budući da OpenAI djeluje kroz cijeli stek, svaki sloj može biti optimiziran oko istog cilja: da njegovi modeli budu brži, pouzdaniji i pristupačniji korisnicima.
Jalapeño jača zamašnjak koji stoji iza napretka OpenAI-ja. Bolja infrastruktura povećava efikasnost računarskih kapaciteta. Veća efikasnost računarskih kapaciteta omogućava bolje treniranje i opsluživanje, što na kraju pokreće sposobnije AI modele. Bolji modeli postaju bolji proizvodi za ljude, developere i kompanije. Bolji proizvodi donose veću upotrebu, više kupaca i više prihoda, što OpenAI-ju omogućava da ponovo ulaže u sljedeću generaciju infrastrukture. Vremenom taj ciklus pomaže da inteligencija za sve postane sposobnija, pouzdanija i jeftinija.
Jalapeño je zajednički razvijen od početnog dizajna do proizvodnog tape-outa za samo devet mjeseci, a program prilagođenog AI akceleratora predstavlja, prema našem uvjerenju, najbrži razvojni ciklus ASIC-a ikada ostvaren u naprednim visokoperformansnim poluprovodnicima. Ta brzina odražava dubok zajednički razvoj softvera i hardvera s inženjerskim timovima OpenAI-ja, Broadcomovu stručnost u implementaciji čipova i korištenje OpenAI modela za ubrzavanje dijelova procesa dizajna i optimizacije.
Isti modeli koji se poslužuju korisnicima pomažu u poboljšanju infrastrukture koja će pokretati buduće modele. Ako AI može pomoći inženjerima da brže dizajniraju bolje čipove, može smanjiti troškove računarskih kapaciteta širom industrije i pomoći u demokratizaciji pristupa naprednoj AI.
Jalapeño je prvi korak u višegeneracijskoj računarskoj platformi dizajniranoj za početno uvođenje do kraja 2026. i širenje u godinama koje slijede, spajajući akceleratore koje je dizajnirao OpenAI s Broadcomovom implementacijom silicija, mrežnim i povezivnim tehnologijama te Celesticinom stručnošću za ploče, rackove i sisteme.
Suština ovog rada je jednostavna: inferencija je mjesto gdje AI dopire do ljudi. Svako poboljšanje troškova, brzine i pouzdanosti može se pokazati kao brži odgovor u ChatGPT‑u, Codex zadatak koji može napraviti više koraka uz manje čekanja, API proizvod koji je jeftiniji za izgradnju ili pouzdaniji pristup kada je potražnja velika.
Demokratizacija AI znači učiniti napredne modele dovoljno dostupnim, pouzdanim i pristupačnim da ih više ljudi može koristiti svakog dana. Jalapeño pomaže OpenAI-ju da veći dio svoje infrastrukture pretvori u korisnu inteligenciju za studente, developere, mala preduzeća, istraživače, velike kompanije i svakoga ko pokušava učiti, stvarati ili rješavati teške probleme.


