Vai al contenuto principale
OpenAI

24 giugno 2026

Azienda

OpenAI e Broadcom svelano un chip di inferenza ottimizzato per LLM

Caricamento in corso...
  • I primi test mostrano che l’acceleratore di prima generazione offrirà prestazioni per watt nettamente superiori allo stato dell’arte attuale
  • Progettato da zero per gli LLM attuali e futuri in tutto il settore
  • Sviluppato dalla progettazione alla produzione in nove mesi, con l’accelerazione dei modelli di OpenAI
  • Estende la piattaforma full-stack di OpenAI, dai prodotti ai modelli e ora ai chip
  • Sarà distribuito su scala gigawatt con partner per i data center, nell’arco di più generazioni

OpenAI e Broadcom (NASDAQ: AVGO) hanno presentato oggi Jalapeño, il primo Intelligence Processor di OpenAI: un acceleratore progettato attorno alla visione di OpenAI per il futuro dell’inferenza LLM e il primo acceleratore IA di una piattaforma di calcolo multi-generazione che le aziende stanno costruendo insieme per rendere l’IA avanzata più veloce, più affidabile e più accessibile a un maggior numero di persone.

I leader di OpenAI e Broadcom mostrano il chip di inferenza Jalapeño.

Jalapeño è stato consegnato al CEO di OpenAI Sam Altman e al presidente Greg Brockman dal presidente e CEO di Broadcom Hock Tan e dal presidente Charlie Kawwas, segnando un passo importante nella strategia di OpenAI per costruire l’intero stack alla base dei suoi modelli e prodotti.

OpenAI ha progettato il chip da zero sulla base della sua profonda comprensione dei fondamenti degli LLM, guidata dalla roadmap di modelli, kernel, sistemi di serving ed esigenze di prodotto, con i partner Broadcom e Celestica, contribuendo a industrializzare la piattaforma tramite implementazione del chip, schede, integrazione dei sistemi rack, networking ad alte prestazioni e sistemi di produzione scalabili. Jalapeño è progettato con la flessibilità necessaria per funzionare con tutti gli LLM, guidato dalle conoscenze di OpenAI sulle esigenze di inferenza dei modelli IA attuali e futuri in tutto il settore. Campioni ingegneristici del chip Jalapeño stanno eseguendo carichi di lavoro ML in laboratorio alla frequenza e alla potenza previste per la produzione, incluso GPT‑5.3‑Codex‑Spark.

Sebbene OpenAI stia ancora misurando le prestazioni finali, i primi test mostrano che Jalapeño offrirà prestazioni per watt nettamente superiori allo stato dell’arte attuale. Un rapporto tecnico dettagliato sulle prestazioni sarà presentato nei prossimi mesi. L’architettura riduce lo spostamento dei dati e bilancia risorse di calcolo, memoria e networking per ottenere un utilizzo effettivo molto più vicino al picco teorico di prestazioni. L’implementazione in silicio e le tecnologie di networking di Broadcom, incluso il silicio di networking Tomahawk, aiutano a portare la piattaforma alla produzione su larga scala.

«Il mondo si sta spostando verso un’economia alimentata dal calcolo», ha dichiarato Greg Brockman, presidente e cofondatore di OpenAI. «Jalapeño fa parte della nostra strategia infrastrutturale full-stack di lungo periodo per rendere il calcolo più abbondante, con un’IA più veloce, più affidabile, più accessibile per persone e aziende, e utilizzabile per risolvere problemi più importanti. Progettando internamente una parte maggiore dello stack, possiamo offrire più intelligenza con maggiore efficienza e continuare a spingere l’IA avanzata verso un accesso più ampio».

«Jalapeño è stato progettato da zero per l’inferenza LLM usando conoscenze dettagliate tratte dalla nostra stretta collaborazione con i ricercatori di OpenAI», ha dichiarato Richard Ho, responsabile del programma hardware di OpenAI. «Abbiamo ottimizzato l’architettura attorno a kernel, movimento della memoria, networking e pattern di serving più importanti per i modelli IA di frontiera. Sulla base dei primi test, Jalapeño eseguirà in modo efficiente i nostri carichi di lavoro più importanti, avvicinandosi ai limiti teorici dell’hardware».

«La nostra collaborazione con OpenAI rappresenta un impegno fondamentale per ampliare l’infrastruttura fisica necessaria al prossimo decennio dell’IA», ha dichiarato Hock Tan, presidente e CEO di Broadcom. «Questo è solo l’inizio di una roadmap multi-generazione. Co-sviluppando il nostro silicio leader di settore direttamente con OpenAI, rendiamo possibile la distribuzione di data center su scala gigawatt con Microsoft e altri partner a partire dal 2026».

Progettato per essere la migliore piattaforma di inferenza per LLM

Jalapeño è un progetto su base completamente nuova per l’inferenza dei moderni LLM, non un acceleratore general-purpose adattato da precedenti carichi di lavoro IA. Si basa sui sistemi che OpenAI gestisce ogni giorno in ChatGPT, Codex, nell’API e nei futuri prodotti agentici, pur essendo progettato per gli LLM attuali e futuri in tutto il settore. L’obiettivo è combinare la potenza e la capacità di elaborazione dei principali acceleratori IA di oggi con una latenza più vicina a quella dei sistemi di inferenza specializzati più veloci, rendendo Jalapeño particolarmente adatto a prodotti LLM interattivi su larga scala.

Questo è il vantaggio del full stack. OpenAI non sviluppa soltanto modelli di frontiera o prodotti costruiti su di essi; progetta anche l’infrastruttura sottostante: architettura dei chip, kernel, sistemi di memoria, networking, scheduling, sistemi di distribuzione ed esperienza di prodotto. Poiché OpenAI opera lungo tutto lo stack, ogni livello può essere ottimizzato attorno allo stesso obiettivo: rendere i suoi modelli più veloci, più affidabili e più convenienti per gli utenti.

Jalapeño rafforza il volano alla base dei progressi di OpenAI. Un’infrastruttura migliore aumenta l’efficienza del calcolo. Una maggiore efficienza del calcolo consente training e serving migliori, alimentando in ultima analisi modelli IA più capaci. Modelli migliori diventano prodotti migliori per persone, sviluppatori e aziende. Prodotti migliori generano più utilizzo, più clienti e più ricavi, permettendo a OpenAI di reinvestire nella prossima generazione di infrastruttura. Nel tempo, questo ciclo contribuisce a rendere l’intelligenza più capace, più affidabile e meno costosa per tutti.

Tape-out in nove mesi, accelerato dai modelli OpenAI

Jalapeño è stato co-sviluppato dal progetto iniziale al tape-out per la produzione in soli nove mesi, e il programma di acceleratori IA personalizzati rappresenta, a nostro avviso, il ciclo di sviluppo ASIC più rapido mai raggiunto nei semiconduttori avanzati ad alte prestazioni. Questa velocità riflette una profonda co-progettazione software-hardware con i team di ingegneria di OpenAI, l’esperienza di Broadcom nell’implementazione in silicio e l’uso dei modelli OpenAI per accelerare parti del processo di progettazione e ottimizzazione.

Gli stessi modelli serviti agli utenti stanno contribuendo a migliorare l’infrastruttura usata per eseguire i modelli futuri. Se l’IA può aiutare gli ingegneri a progettare chip migliori più rapidamente, può ridurre il costo del calcolo in tutto il settore e contribuire a democratizzare l’accesso all’IA avanzata.

Costruire una piattaforma multi-generazione con i partner

Jalapeño è il primo passo di una piattaforma di calcolo multi-generazione progettata per una distribuzione iniziale entro la fine del 2026 e destinata a espandersi negli anni successivi, combinando acceleratori progettati da OpenAI con l’implementazione in silicio, il networking e le tecnologie di connettività di Broadcom, oltre alle competenze di Celestica in schede, rack e sistemi.

Rendere l’IA avanzata più ampiamente disponibile

Il punto di questo lavoro è semplice: l’inferenza è il modo in cui l’IA raggiunge le persone. Ogni miglioramento di costi, velocità e affidabilità può tradursi in una risposta più rapida di ChatGPT, in un’attività di Codex capace di compiere più passaggi con meno attesa, in un prodotto API meno costoso da realizzare o in un accesso più affidabile quando la domanda è elevata.

Democratizzare l’IA significa rendere i modelli avanzati disponibili, affidabili e abbastanza convenienti da permettere a più persone di usarli ogni giorno. Jalapeño aiuta OpenAI a trasformare una parte maggiore della sua infrastruttura in intelligenza utile per studenti, sviluppatori, piccole imprese, ricercatori, aziende e chiunque cerchi di imparare, creare o risolvere problemi difficili.

Autore

OpenAI