Hopp til hovedinnhold
OpenAI

24. juni 2026

Selskap

OpenAI og Broadcom avduker LLM-optimalisert inferensbrikke

Laster inn …
  • Tidlige tester viser at førstegenerasjons akseleratoren vil levere vesentlig bedre ytelse per watt enn dagens mest avanserte løsninger
  • Bygget fra grunnen av for dagens og fremtidens LLM-er i hele bransjen
  • Utviklet fra design til produksjon på ni måneder, akselerert av OpenAIs modeller
  • Utvider OpenAIs fullstack-plattform, fra produkter til modeller og nå til brikker
  • Skal tas i bruk i gigawatt-skala med datasenterpartnere, over flere generasjoner

OpenAI og Broadcom (NASDAQ: AVGO) avduket i dag Jalapeño, OpenAIs første Intelligence Processor: en akselerator bygget rundt OpenAIs visjon for fremtidens LLM-inferens, og den første AI-akseleratoren i en flergenerasjons databehandlingsplattform selskapene bygger sammen for å gjøre avansert AI raskere, mer pålitelig og mer tilgjengelig for flere mennesker.

Ledere fra OpenAI og Broadcom viser frem Jalapeño-inferensbrikken.

Jalapeño ble overlevert til OpenAI-sjef Sam Altman og president Greg Brockman av Broadcoms president og CEO Hock Tan og president Charlie Kawwas, og markerer et viktig steg i OpenAIs strategi for å bygge hele stacken bak modellene og produktene sine.

OpenAI designet brikken fra bunnen av med utgangspunkt i sin dype forståelse av LLM-grunnprinsipper, formet av veikartet for modeller, kjerner, leveringssystemer og produktbehov, sammen med partnerne Broadcom og Celestica, som bidrar til å industrialisere plattformen gjennom brikkeimplementering, kort, integrering av racksystemer, høyytelsesnettverk og skalerbare produksjonssystemer. Jalapeño er fleksibelt utformet for å fungere med alle LLM-er, basert på OpenAIs innsikt i inferensbehovene til dagens og fremtidens AI-modeller i hele bransjen. Tekniske prøver av Jalapeño-brikken kjører ML-arbeidslaster i laboratoriet ved målfrekvens og effekt for produksjon, inkludert GPT‑5.3‑Codex‑Spark.

Selv om OpenAI fortsatt måler den endelige ytelsen, viser tidlige tester at Jalapeño vil levere vesentlig bedre ytelse per watt enn dagens mest avanserte løsninger. En detaljert teknisk rapport om ytelsen vil bli presentert i månedene som kommer. Arkitekturen reduserer dataflytting og balanserer databehandlings-, minne- og nettverksressurser for å oppnå faktisk utnyttelse mye nærmere teoretisk toppytelse. Broadcoms silisiumimplementering og nettverksteknologier, inkludert Tomahawk-nettverkssilisium, bidrar til å bringe plattformen over i storskala produksjon.

«Verden beveger seg mot en datakraftdrevet økonomi», sa Greg Brockman, president og medgrunnlegger av OpenAI. «Jalapeño er en del av vår langsiktige fullstack-infrastrukturstrategi for å gjøre datakraft mer tilgjengelig, noe som gir AI som er raskere, mer pålitelig og rimeligere for mennesker og virksomheter, og som kan brukes til å løse flere viktige problemer. Ved å designe mer av stacken selv kan vi levere mer intelligens med høyere effektivitet og fortsette å gjøre avansert AI tilgjengelig for flere.»

«Jalapeño ble designet fra grunnen av for LLM-inferens ved hjelp av detaljert innsikt fra vårt nære samarbeid med OpenAI-forskere», sa Richard Ho, som leder OpenAIs maskinvareprogram. «Vi optimaliserte arkitekturen rundt kjernene, minneflyttingen, nettverket og leveringsmønstrene som betyr mest for frontier-AI-modeller. Basert på tidlige tester vil Jalapeño effektivt kjøre de viktigste arbeidslastene våre nær maskinvarens teoretiske grenser.»

«Samarbeidet vårt med OpenAI representerer en grunnleggende forpliktelse til å skalere den fysiske infrastrukturen som kreves for det neste tiåret med AI», sa Hock Tan, president og CEO i Broadcom. «Dette er bare begynnelsen på et flergenerasjons veikart. Ved å samutvikle vårt bransjeledende silisium direkte med OpenAI legger vi til rette for utrulling av datasentre i gigawatt-skala med Microsoft og andre partnere fra og med 2026.»

Utformet for å være den beste inferensplattformen for LLM-er

Jalapeño er et blankt-ark-design for moderne LLM-inferens, ikke en generell akselerator tilpasset fra tidligere AI-arbeidslaster. Den bygger på systemene OpenAI kjører hver dag på tvers av ChatGPT, Codex, API-et og fremtidige agentbaserte produkter, samtidig som den er designet for dagens og fremtidens LLM-er i hele bransjen. Målet er å kombinere kraften og gjennomstrømmingen i dagens ledende AI-akseleratorer med latenstid nærmere de raskeste spesialiserte inferenssystemene, slik at Jalapeño egner seg godt for interaktive LLM-produkter i stor skala.

Det er fordelen med fullstack. OpenAI utvikler ikke bare frontier-modeller eller bygger produkter oppå dem; selskapet designer infrastrukturen under dem: brikkearkitektur, kjerner, minnesystemer, nettverk, planlegging, utrullingssystemer og produktopplevelse. Fordi OpenAI opererer på tvers av stacken, kan hvert lag optimaliseres rundt samme mål: å gjøre modellene raskere, mer pålitelige og rimeligere for brukerne.

Jalapeño styrker svinghjulet bak OpenAIs fremgang. Bedre infrastruktur gir mer effektiv databehandling. Høyere databehandlingseffektivitet muliggjør bedre trening og utlevering, og driver til slutt frem mer kapable AI-modeller. Bedre modeller blir til bedre produkter for mennesker, utviklere og virksomheter. Bedre produkter gir mer bruk, flere kunder og høyere inntekter, noe som lar OpenAI reinvestere i neste generasjon infrastruktur. Over tid bidrar denne syklusen til å gjøre intelligens mer kapabel, mer pålitelig og rimeligere for alle.

Ni måneders ferdigstilling, akselerert av OpenAI-modeller

Jalapeño ble samutviklet fra innledende design til produksjonsklar ferdigstilling på bare ni måneder, og programmet for den tilpassede AI-akseleratoren representerer det vi mener er den raskeste ASIC-utviklingssyklusen som noen gang er oppnådd innen avanserte høyytelseshalvledere. Denne hastigheten gjenspeiler tett samutvikling av programvare og maskinvare med OpenAIs ingeniørteam, Broadcoms ekspertise innen silisiumimplementering og bruken av OpenAI-modeller til å akselerere deler av design- og optimaliseringsprosessen.

De samme modellene som leveres til brukere, bidrar til å forbedre infrastrukturen som skal kjøre fremtidige modeller. Hvis AI kan hjelpe ingeniører med å designe bedre brikker raskere, kan det senke kostnaden for datakraft i hele bransjen og bidra til å demokratisere tilgangen til avansert AI.

Bygger en flergenerasjons plattform med partnere

Jalapeño er det første steget i en flergenerasjons databehandlingsplattform som er utformet for innledende utrulling innen utgangen av 2026 og videre utvidelse i årene fremover, og som kombinerer OpenAI-designede akseleratorer med Broadcoms silisiumimplementering, nettverks- og tilkoblingsteknologier samt Celesticas ekspertise på kort, rack og systemer.

Gjør avansert AI mer allment tilgjengelig

Poenget med dette arbeidet er enkelt: Inferens er der AI når ut til mennesker. Hver forbedring i kostnad, hastighet og pålitelighet kan vise seg som et raskere ChatGPT‑svar, en Codex-oppgave som kan ta flere steg med mindre venting, et API-produkt som er billigere å bygge, eller mer pålitelig tilgang når etterspørselen er høy.

Å demokratisere AI betyr å gjøre avanserte modeller tilgjengelige, pålitelige og rimelige nok til at flere kan bruke dem hver dag. Jalapeño hjelper OpenAI med å gjøre mer av infrastrukturen sin om til nyttig intelligens for studenter, utviklere, småbedrifter, forskere, større virksomheter og alle som prøver å lære, skape eller løse vanskelige problemer.

Forfatter

OpenAI