OpenAI și Broadcom prezintă cipul de inferență optimizat LLM
- Testele inițiale arată că acceleratorul de primă generație va oferi o performanță per watt considerabil mai bună decât soluțiile de vârf actuale
- Construit de la zero pentru LLM-urile actuale și viitoare din întreaga industrie
- Dezvoltat de la proiectare la producție în nouă luni, accelerat de modelele OpenAI
- Extinde platforma integrată a OpenAI, de la produse la modele și acum la cipuri
- Urmează să fie implementat la scară de gigawați împreună cu parteneri de centre de date, pe parcursul mai multor generații
OpenAI și Broadcom (NASDAQ: AVGO) au prezentat astăzi Jalapeño, primul procesor de inteligență al OpenAI: un accelerator proiectat în jurul viziunii OpenAI pentru viitorul inferenței LLM și primul accelerator AI dintr-o platformă de calcul multigenerațională pe care companiile o construiesc împreună pentru a face AI avansată mai rapidă, mai fiabilă și mai accesibilă pentru mai mulți oameni.

Jalapeño a fost livrat directorului general al OpenAI, Sam Altman, și președintelui Greg Brockman de către președintele și directorul general al Broadcom, Hock Tan, și președintele Charlie Kawwas, marcând un pas important în strategia OpenAI de a construi întreaga infrastructură din spatele modelelor și produselor sale.
OpenAI a proiectat cipul de la zero pe baza înțelegerii sale profunde a fundamentelor LLM, ghidat de foaia sa de parcurs pentru modele, kerneluri, sisteme de servire și nevoi de produs, împreună cu partenerii Broadcom și Celestica, care contribuie la industrializarea platformei prin implementarea cipului, integrarea plăcilor, a sistemelor de rack, rețele de înaltă performanță și sisteme de producție scalabile. Jalapeño este proiectat flexibil pentru a funcționa cu toate LLM-urile, ghidat de perspectivele OpenAI asupra nevoilor de inferență ale modelelor AI actuale și viitoare din întreaga industrie. Mostrele de inginerie ale cipului Jalapeño rulează sarcini ML în laborator la frecvența și puterea țintă pentru producție, inclusiv GPT‑5.3‑Codex‑Spark.
Deși OpenAI încă măsoară performanța finală, testele inițiale arată că Jalapeño va oferi o performanță per watt considerabil mai bună decât soluțiile de vârf actuale. Un raport tehnic detaliat privind performanța va fi prezentat în lunile următoare. Arhitectura reduce mișcarea datelor și echilibrează resursele de calcul, memorie și rețea pentru a obține o utilizare efectivă mult mai apropiată de performanța teoretică maximă. Implementarea pe tehnologia noastră de cipuri și tehnologiile de rețea ale Broadcom, inclusiv cipuri de rețea Tomahawk, ajută la aducerea platformei în producție la scară largă.
„Lumea se îndreaptă către o economie alimentată de puterea de calcul”, a declarat Greg Brockman, președinte și cofondator al OpenAI. „Jalapeño face parte din strategia noastră pe termen lung privind infrastructura integrată completă, menită să facă puterea de calcul mai abundentă, rezultând într-o AI mai rapidă, mai fiabilă, mai accesibilă pentru oameni și companii și care poate fi folosită pentru a rezolva probleme mai importante. Proiectând noi înșine o parte mai mare din stack, putem furniza mai multă inteligență cu o eficiență mai mare și putem continua să împingem AI-ul avansat către un acces mai larg.”
„Jalapeño a fost proiectat de la zero pentru inferență LLM, folosind perspective detaliate din colaborarea noastră strânsă cu cercetătorii OpenAI”, a spus Richard Ho, care conduce programul hardware al OpenAI. „Am optimizat arhitectura în jurul kernelurilor, mișcării datelor în memorie, rețelelor și tiparelor de servire care contează cel mai mult pentru modelele AI de vârf. Pe baza testelor inițiale, Jalapeño va executa eficient cele mai importante sarcini de lucru ale noastre, aproape de limitele teoretice ale hardware-ului.”
„Colaborarea noastră cu OpenAI reprezintă un angajament fundamental pentru scalarea infrastructurii fizice necesare următorului deceniu al AI”, a spus Hock Tan, președinte și CEO, Broadcom. „Acesta este doar începutul unei foi de parcurs pe mai multe generații. Prin dezvoltarea în comun a tehnologiei noastre de cipuri de vârf în industrie direct cu OpenAI, facem posibilă implementarea centrelor de date la scară de gigawați împreună cu Microsoft și alți parteneri, începând din 2026.”
Jalapeño este un design pornit de la o pagină albă pentru inferența LLM modernă, nu un accelerator de uz general adaptat din sarcini AI anterioare. Este ghidat de sistemele pe care OpenAI le rulează zilnic în ChatGPT, Codex, API și viitoarele produse agentive, fiind în același timp proiectat pentru LLM-urile actuale și viitoare din întreaga industrie. Obiectivul este să combine puterea și randamentul acceleratoarelor AI de top de astăzi cu o latență mai apropiată de cele mai rapide sisteme specializate de inferență, făcând Jalapeño potrivit pentru produse LLM interactive la scară largă.
Acesta este avantajul unei abordări integrate pe toate nivelurile. OpenAI nu dezvoltă doar modele de vârf sau produse construite pe baza lor; proiectează și infrastructura care le susține: arhitectura cipurilor, kerneluri, sisteme de memorie, rețele, programare, sisteme de implementare și experiența de produs. Deoarece OpenAI operează pe întregul stack, fiecare nivel poate fi optimizat în jurul aceluiași obiectiv: să facă modelele sale mai rapide, mai fiabile și mai accesibile pentru utilizatori.
Jalapeño consolidează cercul virtuos din spatele progresului OpenAI. O infrastructură mai bună crește eficiența calculului. O eficiență mai mare a calculului permite antrenare și servire mai bune, alimentând în cele din urmă modele AI mai capabile. Modelele mai bune devin produse mai bune pentru oameni, dezvoltatori și companii. Produsele mai bune generează mai multă utilizare, mai mulți clienți și venituri mai mari, ceea ce permite OpenAI să reinvestească în următoarea generație de infrastructură. În timp, acest ciclu ajută inteligența să devină mai capabilă, mai fiabilă și mai puțin costisitoare pentru toți.
Jalapeño a fost codezvoltat de la proiectarea inițială până la tape-out-ul pentru fabricație în doar nouă luni, iar programul de accelerator AI personalizat reprezintă ceea ce considerăm a fi cel mai rapid ciclu de dezvoltare ASIC realizat vreodată în domeniul semiconductorilor avansați de înaltă performanță. Această viteză reflectă o codezvoltare software-hardware profundă cu echipele de inginerie ale OpenAI, expertiza Broadcom în implementarea pe tehnologia noastră de cipuri și utilizarea modelelor OpenAI pentru a accelera părți ale procesului de proiectare și optimizare.
Aceleași modele servite utilizatorilor ajută la îmbunătățirea infrastructurii folosite pentru a rula modelele viitoare. Dacă AI îi poate ajuta pe ingineri să proiecteze mai rapid cipuri mai bune, poate reduce costul calculului în întreaga industrie și poate contribui la democratizarea accesului la AI avansată.
Jalapeño este primul pas într-o platformă de calcul pe mai multe generații, proiectată pentru implementare inițială până la sfârșitul anului 2026 și extindere în anii următori, combinând acceleratoare proiectate de OpenAI cu implementarea pe tehnologia noastră de cipuri, rețelele și tehnologiile de conectivitate ale Broadcom, precum și expertiza Celestica în plăci, rackuri și sisteme.
Scopul acestei activități este simplu: inferența este locul în care AI ajunge la oameni. Fiecare îmbunătățire a costului, vitezei și fiabilității se poate traduce într-un răspuns ChatGPT mai rapid, o sarcină Codex care poate parcurge mai mulți pași cu mai puțină așteptare, un produs API mai ieftin de construit sau un acces mai sigur atunci când cererea este ridicată.
Democratizarea AI înseamnă ca modelele avansate să fie disponibile, fiabile și suficient de accesibile pentru ca mai mulți oameni să le poată folosi zilnic. Jalapeño ajută OpenAI să transforme o parte mai mare din infrastructura sa în inteligență utilă pentru studenți, dezvoltatori, întreprinderi mici, cercetători, companii și orice persoană care încearcă să învețe, să creeze sau să rezolve probleme dificile.


