OpenAI en Broadcom onthullen LLM-geoptimaliseerde inferentiechip
- Vroege tests tonen aan dat de accelerator van de eerste generatie aanzienlijk betere prestaties per watt levert dan de huidige toptechnologie
- Vanaf de basis gebouwd voor huidige en toekomstige LLM’s in de hele sector
- Van ontwerp tot productie ontwikkeld in negen maanden, versneld door OpenAI’s modellen
- Breidt OpenAI’s full-stackplatform uit, van producten naar modellen en nu chips
- Wordt op gigawattschaal uitgerold met datacenterpartners, over meerdere generaties
OpenAI en Broadcom (NASDAQ: AVGO) hebben vandaag Jalapeño onthuld, OpenAI’s eerste Intelligence Processor: een accelerator ontworpen rond OpenAI’s visie op de toekomst van LLM-inferentie, en de eerste AI-accelerator in een computeplatform voor meerdere generaties dat de bedrijven samen bouwen om geavanceerde AI sneller, betrouwbaarder en toegankelijker te maken voor meer mensen.

Jalapeño werd aan OpenAI-CEO Sam Altman en president Greg Brockman overhandigd door Broadcom-president en CEO Hock Tan en president Charlie Kawwas. Daarmee markeert het een belangrijke stap in OpenAI’s strategie om de volledige stack achter zijn modellen en producten te bouwen.
OpenAI ontwierp de chip vanaf nul, gebaseerd op zijn diepgaande inzicht in de fundamenten van LLM's en op zijn roadmap voor modellen, kernels, serving-systemen en productbehoeften. Partners Broadcom en Celestica helpen het platform te industrialiseren via chipimplementatie, board- en racksysteemintegratie, high-performance networking en schaalbare productiesystemen. Jalapeño is flexibel ontworpen om met alle LLM’s te werken, gestuurd door OpenAI’s inzichten in de inferentiebehoeften van huidige en toekomstige AI-modellen in de hele sector. Engineering samples van de Jalapeño-chip draaien ML-workloads in het lab op de beoogde productiefrequentie en het beoogde productievermogen, waaronder GPT‑5.3‑Codex‑Spark.
Hoewel OpenAI de uiteindelijke prestaties nog meet, tonen vroege tests aan dat Jalapeño aanzienlijk betere prestaties per watt zal leveren dan de huidige toptechnologie. Een gedetailleerd technisch rapport over de prestaties wordt in de komende maanden gepresenteerd. De architectuur vermindert dataverplaatsing en brengt rekenkracht, geheugen- en netwerkresources in balans om een gerealiseerde benutting te bereiken die veel dichter bij de theoretische piekprestaties ligt. Broadcoms siliciumimplementatie en netwerktechnologieën, waaronder Tomahawk-netwerksilicium, helpen het platform naar grootschalige productie te brengen.
“De wereld beweegt naar een economie die draait op rekenkracht,” zei Greg Brockman, president en medeoprichter van OpenAI. “Jalapeño is onderdeel van onze langetermijnstrategie voor full-stackinfrastructuur om rekenkracht ruimer beschikbaar te maken. Dat leidt tot AI die sneller, betrouwbaarder en betaalbaarder is voor mensen en bedrijven, en kan worden gebruikt om belangrijkere problemen op te lossen. Door meer van de stack zelf te ontwerpen, kunnen we meer intelligentie met hogere efficiëntie leveren en geavanceerde AI steeds toegankelijker maken.”
“Jalapeño is vanaf de basis ontworpen voor LLM-inferentie met behulp van gedetailleerde inzichten uit onze nauwe samenwerking met OpenAI-onderzoekers,” zei Richard Ho, die leiding geeft aan OpenAI’s hardwareprogramma. “We hebben de architectuur geoptimaliseerd rond de kernels, geheugenverplaatsing, networking en serving-patronen die het belangrijkst zijn voor frontier-AI-modellen. Op basis van vroege tests zal Jalapeño onze belangrijkste workloads efficiënt uitvoeren, dicht bij de theoretische grenzen van de hardware.”
“Onze samenwerking met OpenAI getuigt van een fundamentele toewijding om de fysieke infrastructuur op te schalen die nodig is voor het volgende decennium van AI,” zei Hock Tan, president en CEO van Broadcom. “Dit is nog maar het begin van een roadmap voor meerdere generaties. Door ons toonaangevende silicium rechtstreeks met OpenAI te ontwikkelen, maken we de uitrol mogelijk van datacenters op gigawattschaal met Microsoft en andere partners, vanaf 2026.”
Jalapeño is een volledig nieuw ontwerp voor moderne LLM-inferentie, geen algemene accelerator die is aangepast van eerdere AI-workloads. Het is gebaseerd op de systemen die OpenAI dagelijks gebruikt voor ChatGPT, Codex, de API en toekomstige agentische producten, en is tegelijk ontworpen voor huidige en toekomstige LLM’s in de hele sector. Het doel is de kracht en doorvoer van de huidige toonaangevende AI-accelerators te combineren met latentie die dichter bij de snelste gespecialiseerde inferentiesystemen ligt, waardoor Jalapeño zeer geschikt is voor interactieve LLM-producten op schaal.
Dat is het full-stackvoordeel. OpenAI ontwikkelt niet alleen frontiermodellen of bouwt producten daarop; het ontwerpt ook de onderliggende infrastructuur: chiparchitectuur, kernels, geheugensystemen, networking, planning, implementatiesystemen en productervaring. Omdat OpenAI over de hele stack werkt, kan elke laag rond hetzelfde doel worden geoptimaliseerd: zijn modellen sneller, betrouwbaarder en betaalbaarder maken voor gebruikers.
Jalapeño versterkt het vliegwiel achter OpenAI’s vooruitgang. Betere infrastructuur verhoogt de efficiëntie van rekenkracht. Grotere efficiëntie van rekenkracht maakt betere training en serving mogelijk, waardoor uiteindelijk krachtigere AI-modellen worden aangedreven. Betere modellen worden betere producten voor mensen, ontwikkelaars en bedrijven. Betere producten zorgen voor meer gebruik, meer klanten en meer omzet, waardoor OpenAI kan herinvesteren in de volgende generatie infrastructuur. Na verloop van tijd helpt die cyclus intelligentie capabeler, betrouwbaarder en goedkoper te maken voor iedereen.
Jalapeño werd in slechts negen maanden mede ontwikkeld van het eerste ontwerp tot de productietape-out, en het programma voor aangepaste AI-accelerators vertegenwoordigt wat volgens ons de snelste ASIC-ontwikkelcyclus is die ooit is bereikt in geavanceerde high-performance halfgeleiders. Die snelheid weerspiegelt diepgaande co-ontwikkeling van software en hardware met OpenAI’s engineeringteams, Broadcoms expertise in siliciumimplementatie en het gebruik van OpenAI-modellen om delen van het ontwerp- en optimalisatieproces te versnellen.
Dezelfde modellen die aan gebruikers worden geleverd, helpen de infrastructuur te verbeteren waarop toekomstige modellen draaien. Als AI ingenieurs kan helpen sneller betere chips te ontwerpen, kan dat de kosten van rekenkracht in de hele sector verlagen en de toegang tot geavanceerde AI helpen democratiseren.
Jalapeño is de eerste stap in een computeplatform voor meerdere generaties, ontworpen voor eerste uitrol tegen eind 2026 en voor uitbreiding in de jaren daarna. Het combineert door OpenAI ontworpen accelerators met Broadcoms technologieën voor siliciumimplementatie, networking en connectiviteit, plus Celestica’s expertise in boards, racks en systemen.
Het doel van dit werk is eenvoudig: inferentie is waar AI mensen bereikt. Elke verbetering in kosten, snelheid en betrouwbaarheid kan zichtbaar worden als een sneller antwoord van ChatGPT, een Codex-taak die meer stappen kan zetten met minder wachten, een API-product dat goedkoper is om te bouwen, of betrouwbaardere toegang wanneer de vraag hoog is.
AI democratiseren betekent geavanceerde modellen beschikbaar, betrouwbaar en betaalbaar genoeg maken zodat meer mensen ze elke dag kunnen gebruiken. Jalapeño helpt OpenAI meer van zijn infrastructuur om te zetten in nuttige intelligentie voor studenten, ontwikkelaars, kleine bedrijven, onderzoekers, ondernemingen en iedereen die wil leren, iets wil maken of moeilijke problemen wil oplossen.


