OpenAI og Broadcom lancerer LLM-optimeret inferenschip
- Tidlige tests viser, at førstegenerationsacceleratoren vil levere ydeevne pr. watt, der er markant bedre end den nuværende state of the art
- Bygget fra bunden til nuværende og fremtidige LLM'er på tværs af branchen
- Udviklet fra design til produktion på ni måneder, accelereret af OpenAI's modeller
- Udvider OpenAI's full-stack-platform fra produkter til modeller og nu til chips
- Skal udrulles i gigawatt-skala med datacenterpartnere over flere generationer
OpenAI og Broadcom (NASDAQ: AVGO) præsenterede i dag Jalapeño, OpenAI's første intelligensprocessor: en accelerator, der er udformet omkring OpenAI's vision for fremtiden for LLM-inferens, og den første AI-accelerator i en computingsplatform over flere generationer, som virksomhederne bygger sammen for at gøre avanceret AI hurtigere, mere pålidelig og mere tilgængelig for flere mennesker.

Jalapeño blev overdraget til OpenAI's CEO Sam Altman og President Greg Brockman af Broadcoms President og CEO Hock Tan og President Charlie Kawwas, hvilket markerer et vigtigt skridt i OpenAI's strategi om at bygge hele stakken bag sine modeller og produkter.
OpenAI designede chippen fra bunden med afsæt i sin dybe forståelse af grundprincipperne for LLM'er, informeret af sin køreplan for modeller, kernels, serving-systemer og produktbehov, sammen med partnerne Broadcom og Celestica, som hjælper med at industrialisere platformen gennem chipimplementering, kort, integration af racksystemer, højtydende netværk og skalerbare produktionssystemer. Jalapeño er designet med fleksibilitet til at fungere med alle LLM'er, styret af OpenAI's indsigt i inferensbehovene for nuværende og fremtidige AI-modeller på tværs af branchen. Tekniske prøver af Jalapeño-chippen kører ML-arbejdsbelastninger i laboratoriet ved den planlagte produktionsfrekvens og effekt, herunder GPT‑5.3‑Codex‑Spark.
Selvom OpenAI stadig måler den endelige ydeevne, viser tidlige tests, at Jalapeño vil levere ydeevne pr. watt, der er markant bedre end den nuværende state of the art. En detaljeret teknisk rapport om ydeevnen vil blive præsenteret i de kommende måneder. Arkitekturen reducerer dataflytning og balancerer compute-, hukommelses- og netværksressourcer for at opnå en faktisk udnyttelse, der ligger langt tættere på den teoretiske topydelse. Broadcoms siliciumimplementering og netværksteknologier, herunder Tomahawk-netværkssilicium, hjælper med at bringe platformen i produktion i stor skala.
»Verden bevæger sig mod en økonomi drevet af compute,« sagde Greg Brockman, President og medstifter af OpenAI. »Jalapeño er en del af vores langsigtede full-stack-infrastrukturstrategi for at gøre compute mere rigeligt, hvilket resulterer i AI, der er hurtigere, mere pålidelig og mere økonomisk overkommelig for mennesker og virksomheder, og som kan bruges til at løse flere vigtige problemer. Ved selv at designe mere af stakken kan vi levere mere intelligens med højere effektivitet og fortsætte med at gøre avanceret AI mere bredt tilgængelig.«
»Jalapeño blev designet fra bunden til LLM-inferens ved hjælp af detaljeret indsigt fra vores tætte samarbejde med OpenAI's forskere,« sagde Richard Ho, der leder OpenAI's hardwareprogram. »Vi optimerede arkitekturen omkring de kernels, hukommelsesbevægelser, netværk og serving-mønstre, der betyder mest for frontier AI-modeller. Baseret på tidlige tests vil Jalapeño effektivt køre vores vigtigste arbejdsbelastninger tæt på hardwarens teoretiske grænser.«
»Vores samarbejde med OpenAI repræsenterer en grundlæggende forpligtelse til at skalere den fysiske infrastruktur, der kræves til det næste årti med AI,« sagde Hock Tan, President og CEO, Broadcom. »Dette er kun begyndelsen på en køreplan over flere generationer. Ved at medudvikle vores brancheførende silicium direkte med OpenAI muliggør vi udrulning af datacentre i gigawatt-skala med Microsoft og andre partnere fra 2026.«
Jalapeño er et design fra blankt papir til moderne LLM-inferens, ikke en generel accelerator tilpasset fra tidligere AI-arbejdsbelastninger. Den bygger på de systemer, OpenAI driver hver dag på tværs af ChatGPT, Codex, API'et og fremtidige agentbaserede produkter, samtidig med at den er designet til nuværende og fremtidige LLM'er i hele branchen. Målet er at kombinere kraften og gennemløbet fra nutidens førende AI-acceleratorer med latenstid tættere på de hurtigste specialiserede inferenssystemer, så Jalapeño egner sig godt til interaktive LLM-produkter i stor skala.
Det er full-stack-fordelen. OpenAI udvikler ikke kun frontier-modeller eller bygger produkter oven på dem; virksomheden designer infrastrukturen under dem: chiparkitektur, kernels, hukommelsessystemer, netværk, planlægning, udrulningssystemer og produktoplevelse. Fordi OpenAI arbejder på tværs af stakken, kan hvert lag optimeres omkring det samme mål: at gøre virksomhedens modeller hurtigere, mere pålidelige og mere økonomisk overkommelige for brugerne.
Jalapeño styrker det svinghjul, der driver OpenAI's fremdrift. Bedre infrastruktur øger compute-effektiviteten. Større compute-effektivitet muliggør bedre træning og serving og driver i sidste ende mere kapable AI-modeller. Bedre modeller bliver til bedre produkter for mennesker, udviklere og virksomheder. Bedre produkter skaber mere brug, flere kunder og større omsætning, hvilket gør det muligt for OpenAI at geninvestere i næste generation af infrastruktur. Over tid bidrager den cyklus til at gøre intelligens mere kapabel, mere pålidelig og billigere for alle.
Jalapeño blev medudviklet fra det indledende design til manufacturing tape-out på kun ni måneder, og programmet for den specialbyggede AI-accelerator repræsenterer det, vi mener er den hurtigste ASIC-udviklingscyklus, der nogensinde er opnået inden for højtydende avancerede halvledere. Den hastighed afspejler dyb samudvikling af software og hardware med OpenAI's softwareingeniørteams, Broadcoms ekspertise i siliciumimplementering og brugen af OpenAI-modeller til at accelerere dele af design- og optimeringsprocessen.
De samme modeller, der leveres til brugerne, hjælper med at forbedre den infrastruktur, der skal køre fremtidige modeller. Hvis AI kan hjælpe softwareingeniører med at designe bedre chips hurtigere, kan det sænke omkostningerne til compute i hele branchen og hjælpe med at demokratisere adgangen til avanceret AI.
Jalapeño er første skridt i en computingsplatform over flere generationer, der er designet til den første udrulning inden udgangen af 2026 og til at blive udbygget i årene derefter. Den kombinerer OpenAI-designede acceleratorer med Broadcoms siliciumimplementering, netværks- og forbindelsesteknologier samt Celesticas ekspertise inden for kort, racks og systemer.
Pointen med dette arbejde er enkel: Inferens er der, hvor AI når ud til mennesker. Enhver forbedring af omkostninger, hastighed og pålidelighed kan vise sig som et hurtigere ChatGPT‑svar, en Codex-opgave, der kan tage flere skridt med mindre ventetid, et API-produkt, der er billigere at bygge, eller mere stabil adgang, når efterspørgslen er høj.
At demokratisere AI betyder at gøre avancerede modeller tilgængelige, pålidelige og økonomisk overkommelige nok til, at flere mennesker kan bruge dem hver dag. Jalapeño hjælper OpenAI med at omsætte mere af sin infrastruktur til nyttig intelligens for studerende, udviklere, små virksomheder, forskere, store virksomheder og alle, der prøver at lære, skabe eller løse svære problemer.


