Preskočite na glavni sadržaj
OpenAI

24. lipnja 2026.

Tvrtka

OpenAI i Broadcom predstavljaju čip za LLM inferenciju

Učitavanje…
  • Rana testiranja pokazuju da će akcelerator prve generacije pružati znatno bolji omjer performansi po vatu od današnjih najnaprednijih rješenja
  • Od temelja izrađen za sadašnje i buduće LLM-ove u cijeloj industriji
  • Razvijen od dizajna do proizvodnje u devet mjeseci, uz pomoć OpenAI-jevih modela
  • Proširuje OpenAI-jevu full-stack platformu, od proizvoda do modela, a sada i do čipova
  • Bit će uveden u gigavatnim razmjerima s partnerima za podatkovne centre, tijekom više generacija

OpenAI i Broadcom (NASDAQ: AVGO) danas su predstavili Jalapeño, prvi OpenAI-jev Intelligence Processor: akcelerator osmišljen u skladu s OpenAI-jevom vizijom budućnosti inferencije LLM-ova i prvi AI akcelerator u višegeneracijskoj računalnoj platformi koju tvrtke zajedno grade kako bi napredni AI bio brži, pouzdaniji i dostupniji većem broju ljudi.

Čelnici OpenAI-ja i Broadcoma pokazuju čip Jalapeño za inferenciju.

Jalapeño su izvršnom direktoru OpenAI-ja Samu Altmanu i predsjedniku Gregu Brockmanu predali predsjednik i izvršni direktor Broadcoma Hock Tan te predsjednik Charlie Kawwas, što označava važan korak u OpenAI-jevoj strategiji izgradnje cjelokupnog tehnološkog sloja iza njegovih modela i proizvoda.

OpenAI je čip osmislio od nule, oslanjajući se na svoje duboko razumijevanje osnova LLM-ova te na plan razvoja modela, kernela, sustava za posluživanje modela i potreba proizvoda, zajedno s partnerima Broadcomom i Celesticom, koji pomažu industrijalizirati platformu kroz implementaciju čipa, ploče, integraciju sustava u rackove, mrežno povezivanje visokih performansi i skalabilne proizvodne sustave. Jalapeño je fleksibilno dizajniran za rad sa svim LLM-ovima, u skladu s OpenAI-jevim uvidima u potrebe inferencije sadašnjih i budućih AI modela u cijeloj industriji. Inženjerski uzorci čipa Jalapeño u laboratoriju izvode ML radna opterećenja na ciljnoj proizvodnoj frekvenciji i potrošnji, uključujući GPT‑5.3‑Codex‑Spark.

Iako OpenAI još mjeri konačne performanse, rana testiranja pokazuju da će Jalapeño pružati znatno bolji omjer performansi po vatu od današnjih najnaprednijih rješenja. Detaljno tehničko izvješće o performansama bit će predstavljeno u nadolazećim mjesecima. Arhitektura smanjuje kretanje podataka i uravnotežuje računalne, memorijske i mrežne resurse kako bi ostvarena iskorištenost bila mnogo bliža teorijskim vršnim performansama. Broadcomova implementacija čipa i mrežne tehnologije, uključujući mrežne čipove Tomahawk, pomažu dovesti platformu do proizvodnje velikih razmjera.

„Svijet prelazi na gospodarstvo pokretano računalnim kapacitetima”, rekao je Greg Brockman, predsjednik i suosnivač OpenAI-ja. „Jalapeño je dio naše dugoročne infrastrukturne strategije cjelovitog tehnološkog sloja za povećanje dostupnosti računalnih kapaciteta, kako bi AI bio brži, pouzdaniji i pristupačniji ljudima i tvrtkama te se mogao koristiti za rješavanje važnijih problema. Budući da sami dizajniramo veći dio tehnološkog sloja, možemo učinkovitije pružati više inteligencije i nastaviti širiti pristup naprednom AI-ju.”

„Jalapeño je od temelja dizajniran za inferenciju LLM-ova na temelju detaljnih uvida iz naše bliske suradnje s istraživačima OpenAI-ja”, rekao je Richard Ho, koji vodi OpenAI-jev hardverski program. „Arhitekturu smo optimizirali oko kernela, kretanja podataka u memoriji, mrežnog povezivanja i obrazaca posluživanja koji su najvažniji za najnaprednije AI modele. Na temelju ranih testiranja, Jalapeño će učinkovito izvršavati naša najvažnija radna opterećenja blizu teorijskih granica hardvera.”

„Naša suradnja s OpenAI-jem predstavlja temeljnu predanost skaliranju fizičke infrastrukture potrebne za sljedeće desetljeće AI-ja”, rekao je Hock Tan, predsjednik i izvršni direktor Broadcoma. „Ovo je tek početak višegeneracijskog plana razvoja. Zajedničkim razvojem naših vodećih silicijskih rješenja izravno s OpenAI-jem omogućujemo uvođenje podatkovnih centara gigavatnih razmjera s Microsoftom i drugim partnerima počevši od 2026.”

Osmišljen kao najbolja platforma za inferenciju LLM-ova

Jalapeño je potpuno novo rješenje za modernu inferenciju LLM-ova, a ne općenamjenski akcelerator preuzet iz ranijih AI radnih opterećenja i prilagođen novoj namjeni. Oblikovan je prema sustavima koje OpenAI svakodnevno pokreće u ChatGPT‑u, Codexu, API-ju i budućim agentskim proizvodima, a istodobno je dizajniran za sadašnje i buduće LLM-ove u cijeloj industriji. Cilj je spojiti snagu i propusnost današnjih vodećih AI akceleratora s latencijom bližom najbržim specijaliziranim sustavima za inferenciju, što Jalapeño čini prikladnim za interaktivne LLM proizvode u velikim razmjerima.

To je prednost cjelovitog tehnološkog sloja. OpenAI ne razvija samo najnaprednije modele niti samo gradi proizvode na njima; dizajnira infrastrukturu ispod njih: arhitekturu čipova, kernele, memorijske sustave, mrežno povezivanje, raspoređivanje, sustave uvođenja i korisničko iskustvo proizvoda. Budući da OpenAI djeluje kroz cijeli tehnološki sloj, svaki se sloj može optimizirati oko istog cilja: da njegovi modeli budu brži, pouzdaniji i pristupačniji korisnicima.

Jalapeño jača zamašnjak koji pokreće OpenAI-jev napredak. Bolja infrastruktura povećava učinkovitost računalnih kapaciteta. Veća učinkovitost računalnih kapaciteta omogućuje bolje treniranje i posluživanje modela, što naposljetku pokreće sposobnije AI modele. Bolji modeli postaju bolji proizvodi za ljude, razvojne programere i tvrtke. Bolji proizvodi donose veću upotrebu, više korisnika i više prihoda, što OpenAI-ju omogućuje ponovno ulaganje u sljedeću generaciju infrastrukture. S vremenom taj ciklus pomaže da inteligencija postane sposobnija, pouzdanija i jeftinija za sve.

Tape-out nakon devet mjeseci, ubrzan OpenAI-jevim modelima

Jalapeño je zajednički razvijen od početnog dizajna do proizvodnog tape-outa u samo devet mjeseci, a program prilagođenog AI akceleratora predstavlja, prema našem mišljenju, najbrži ciklus razvoja ASIC-a ikad postignut u naprednim poluvodičima visokih performansi. Ta brzina odražava duboki zajednički razvoj softvera i hardvera s OpenAI-jevim inženjerskim timovima, Broadcomovu stručnost u implementaciji čipa te upotrebu OpenAI-jevih modela za ubrzavanje dijelova procesa dizajna i optimizacije.

Isti modeli dostupni korisnicima pomažu poboljšati infrastrukturu koja će se koristiti za pokretanje budućih modela. Ako AI može pomoći inženjerima da brže dizajniraju bolje čipove, može smanjiti trošak računalnih kapaciteta u cijeloj industriji i pomoći demokratizirati pristup naprednom AI-ju.

Izgradnja višegeneracijske platforme s partnerima

Jalapeño je prvi korak u višegeneracijskoj računalnoj platformi osmišljenoj za početno uvođenje do kraja 2026. i širenje u godinama koje slijede, koja kombinira akceleratore koje je dizajnirao OpenAI s Broadcomovom implementacijom čipa te tehnologijama mrežnog povezivanja i povezivosti, kao i Celesticinom stručnošću za ploče, sustave u rackovima i integraciju sustava

Šira dostupnost naprednog AI-ja

Svrha ovog rada jednostavna je: inferencija je način na koji AI dopire do ljudi. Svako poboljšanje troška, brzine i pouzdanosti može se očitovati kao brži odgovor u ChatGPT‑u, zadatak u Codexu koji može napraviti više koraka uz manje čekanja, API proizvod koji je jeftinije izgraditi ili pouzdaniji pristup kada je potražnja velika.

Demokratizacija AI-ja znači učiniti napredne modele dovoljno dostupnima, pouzdanima i pristupačnima da ih više ljudi može svakodnevno upotrebljavati. Jalapeño pomaže OpenAI-ju da veći dio svoje infrastrukture pretvori u korisnu inteligenciju za studente, razvojne programere, mala poduzeća, istraživače, velike tvrtke i sve koji pokušavaju učiti, stvarati ili rješavati teške probleme.

Autor

OpenAI