OpenAI i Broadcom presenten un xip d’inferència optimitzat per a LLM
- Les primeres proves mostren que l’accelerador de primera generació oferirà un rendiment per watt substancialment superior al de la tecnologia més avançada actual
- Creat des de zero per als models de llenguatge a gran escala (LLM) actuals i futurs de tot el sector
- Desenvolupat en nou mesos del disseny a la producció, i accelerat pels models d’OpenAI
- Amplia la plataforma full-stack d’OpenAI, que va des dels productes als models, i ara als xips
- S'implementarà a escala de gigawatts amb socis de centres de dades, al llarg de diverses generacions
OpenAI i Broadcom (NASDAQ: AVGO) han presentat avui Jalapeño, el primer Processador d’Intel·ligència d’OpenAI: un accelerador dissenyat al voltant de la visió d’OpenAI sobre el futur de la inferència dels models de llenguatge a gran escala, i el primer accelerador d’IA d’una plataforma de còmput multigeneracional que les empreses estan construint conjuntament per fer que la IA avançada sigui més ràpida, més fiable i més accessible per a més persones.

Hock Tan, president i CEO de Broadcom, i Charlie Kawwas, president de la companyia, van entregar Jalapeño al CEO d’OpenAI, Sam Altman, i al president Greg Brockman, en un pas important dins l’estratègia d’OpenAI de construir tota la pila tecnològica que hi ha darrere dels seus models i productes.
OpenAI va dissenyar el xip des de zero a partir del seu coneixement profund dels fonaments dels LLM, guiat pel seu full de ruta de models, nuclis, sistemes de servei i necessitats de producte, amb els socis Broadcom i Celestica, que ajuden a industrialitzar la plataforma mitjançant la implementació del xip, la placa, la integració de sistemes en rack, les xarxes d’alt rendiment i els sistemes de producció escalables. Jalapeño està dissenyat amb la flexibilitat necessària per funcionar amb tots els LLM, basant-se en els coneixements d’OpenAI sobre les necessitats d’inferència dels models d’IA actuals i futurs de tot el sector. Les mostres d’enginyeria del xip Jalapeño executen càrregues de treball d’ML al laboratori a la freqüència i potència objectiu de producció, incloent-hi GPT‑5.3‑Codex‑Spark.
Tot i que OpenAI encara està mesurant el rendiment final, les primeres proves mostren que Jalapeño oferirà un rendiment per watt substancialment superior al de la tecnologia més avançada actual. En els pròxims mesos es presentarà un informe tècnic detallat sobre el rendiment. L’arquitectura redueix el moviment de dades i equilibra els recursos de còmput, memòria i xarxa per aconseguir una utilització real molt més propera al rendiment màxim teòric. La implementació dels xips i les tecnologies de xarxa de Broadcom, inclòs el xip de xarxa Tomahawk, ajuden a fer que la plataforma passi a la producció a gran escala.
«El món avança cap a una economia impulsada pel còmput», va dir Greg Brockman, president i cofundador d’OpenAI. «Jalapeño forma part de la nostra estratègia d’infraestructura full-stack a llarg termini per fer que el còmput sigui més abundant, cosa que donarà lloc a una IA més ràpida, més fiable i més assequible per a persones i empreses, i que es podrà utilitzar per resoldre problemes més importants. Dissenyant nosaltres mateixos més parts de l'stack, podem oferir més intel·ligència amb més eficiència i continuar impulsant la IA avançada perquè sigui accessible per a un públic més ampli».
«Jalapeño es va dissenyar des de zero per a la inferència de LLM a partir d’informació detallada de la nostra estreta col·laboració amb investigadors d’OpenAI», va afirmar Richard Ho, responsable del programa de maquinari d’OpenAI. «Vam optimitzar l’arquitectura al voltant dels nuclis, el moviment de memòria, les xarxes i els patrons de servei més importants per als models d’IA d’avantguarda. Segons les primeres proves, Jalapeño executarà de manera eficient les nostres càrregues de treball més importants prop dels límits teòrics del maquinari».
«La nostra col·laboració amb OpenAI representa un compromís fonamental per ampliar la infraestructura física necessària per a la pròxima dècada de la IA», va afirmar Hock Tan, president i CEO de Broadcom. «Això és només l’inici d’un full de ruta multigeneracional. En desenvolupar conjuntament el nostre xip líder del sector directament amb OpenAI, fem possible el desplegament de centres de dades a escala de gigawatts amb Microsoft i altres socis a partir del 2026».
Jalapeño és un disseny de full en blanc per a la inferència LLM moderna, no un accelerador de propòsit general adaptat de càrregues de treball de la IA anteriors. Es basa en els sistemes que OpenAI executa cada dia a ChatGPT, Codex, l’API i futurs productes amb agents, alhora que també està dissenyat per als LLM actuals i futurs de tot el sector. L’objectiu és combinar la potència i el rendiment dels acceleradors d’IA líders d’avui amb una latència més propera a la dels sistemes d’inferència especialitzats més ràpids, de manera que Jalapeño sigui molt adequat per a productes LLM interactius a escala.
Aquest és l’avantatge de fer servir una solució integral (full-stack). OpenAI no només desenvolupa models d’avantguarda o crea productes sobre aquests models; també dissenya la infraestructura que els sosté: arquitectura de xips, nuclis, sistemes de memòria, xarxes, planificació, sistemes de desplegament i experiència de producte. Com que OpenAI opera a tota l'stack, cada capa es pot optimitzar al voltant del mateix objectiu: fer que els seus models siguin més ràpids, més fiables i més assequibles per als usuaris.
Jalapeño reforça el volant d’inèrcia que impulsa el progrés d’OpenAI. Una infraestructura millor impulsa l’eficiència del còmput. Una eficiència de computació més elevada permet millorar l’entrenament i el servei, i en última instància impulsa models d’AI més capaços. Els millors models es converteixen en millors productes per a persones, desenvolupadors i empreses. Els millors productes impulsen més ús, més clients i més ingressos, cosa que permet a OpenAI reinvertir en la pròxima generació d’infraestructura. Amb el temps, aquest cicle ajuda a fer que la intel·ligència sigui més capaç, més fiable i menys costosa per a tothom.
Jalapeño es va codesenvolupar des del disseny inicial fins al tape-out de fabricació en només nou mesos, i el programa d’acceleradors d’IA personalitzats representa el que creiem que és el cicle de desenvolupament d’ASIC més ràpid aconseguit mai en semiconductors avançats d’alt rendiment. Aquesta rapidesa reflecteix un codesenvolupament profund de programari i maquinari amb els equips d’enginyeria d’OpenAI, l’expertesa de Broadcom en implementació de xips i l’ús de models d’OpenAI per accelerar parts del procés de disseny i optimització.
Els mateixos models que se serveixen als usuaris ajuden a millorar la infraestructura utilitzada per executar models futurs. Si la IA pot ajudar els enginyers a dissenyar millors xips més de pressa, pot reduir el cost de la computació a tot el sector i ajudar a democratitzar l’accés a la IA avançada.
Jalapeño és el primer pas d’una plataforma de computació multigeneracional dissenyada per a un desplegament inicial abans de finals del 2026 i per expandir-se en els anys següents, combinant acceleradors dissenyats per OpenAI amb la implementació de xips, xarxes i tecnologies de connectivitat de Broadcom, i l’expertesa de Celestica en plaques, racks i sistemes.
El propòsit d’aquesta feina és senzill: la inferència és el punt on a IA arriba a les persones. Cada millora en cost, velocitat i fiabilitat es pot traduir en una resposta més ràpida de ChatGPT, una tasca de Codex que pot fer més passos amb menys espera, un producte d’API més barat de construir o un accés més fiable quan la demanda és alta.
Democratitzar la IA vol dir fer que els models avançats siguin prou disponibles, fiables i assequibles perquè més persones els puguin utilitzar cada dia. Jalapeño ajuda OpenAI a convertir una part més gran de la seva infraestructura en intel·ligència útil per a estudiants, desenvolupadors, petites empreses, investigadors, grans empreses i qualsevol persona que intenti aprendre, crear o resoldre problemes difícils.


