Jäta vahele ja mine põhisisu juurde
OpenAI

24. juuni 2026

Ettevõte

OpenAI ja Broadcom esitlevad LLM-optimeeritud inferentsikiipi

Laadimine…
  • Varased testid näitavad, et esimese põlvkonna kiirendi pakub vati kohta märksa paremat jõudlust kui praegune tipptehnoloogia
  • Algusest peale loodud valdkonna praeguste ja tulevaste LLM-ide jaoks
  • Arendati disainist tootmiseni üheksa kuuga, OpenAI mudelite toel
  • Laiendab OpenAI tervikplatvormi toodetest mudeliteni ja nüüd kiipideni
  • Võetakse mitme põlvkonna jooksul andmekeskuse partneritega kasutusele gigavatise mastaabiga

OpenAI ja Broadcom (NASDAQ: AVGO) esitlesid täna Jalapeñot, OpenAI esimest Intelligence Processorit: kiirendit, mis on arhitektuurselt loodud OpenAI nägemuse järgi LLM-inferentsi tulevikust, ning esimest AI-kiirendit mitme põlvkonna arvutusplatvormis, mida ettevõtted koos ehitavad, et teha arenenud AI kiiremaks, töökindlamaks ja rohkematele inimestele kättesaadavamaks.

OpenAI ja Broadcomi juhid näitavad Jalapeño inferentsikiipi.

Jalapeño andsid OpenAI tegevjuhile Sam Altmanile ja presidendile Greg Brockmanile üle Broadcomi president ja tegevjuht Hock Tan ning president Charlie Kawwas, tähistades olulist sammu OpenAI strateegias ehitada üles oma mudelite ja toodete aluseks olev tehnoloogiline taristu.

OpenAI kujundas kiibi nullist, tuginedes oma sügavale arusaamale LLM-ide põhialustest ning oma mudelite, kernelite, teenindussüsteemide ja tootevajaduste teekaardile. Partnerid Broadcom ja Celestica aitavad platvormi tööstuslikuks muuta kiibi juurutuse, plaadi- ja riiulisüsteemide integratsiooni, suure jõudlusega võrgunduse ning skaleeritavate tootmissüsteemide kaudu. Jalapeño on loodud paindlikuks, et töötada kõigi LLM-idega, lähtudes OpenAI teadmistest praeguste ja tulevaste AI mudelite inferentsivajaduste kohta kogu valdkonnas. Jalapeño kiibi insenerinäidised käitavad laboris ML-töökoormusi tootmiseks sihitud sagedusel ja võimsusel, sealhulgas GPT‑5.3‑Codex‑Spark.

Kuigi OpenAI mõõdab veel lõplikku jõudlust, näitavad varased testid, et Jalapeño pakub vati kohta märksa paremat jõudlust kui praegune tipptehnoloogia. Üksikasjalik tehniline aruanne jõudluse kohta esitatakse lähikuudel. Arhitektuur vähendab andmete liigutamist ning tasakaalustab arvutus-, mälu- ja võrguressursse, et saavutada tegelik kasutusaste, mis on teoreetilisele tippjõudlusele palju lähemal. Broadcomi ränilahendused ja võrgutehnoloogiad, sealhulgas Tomahawki võrgukiibid, aitavad viia platvormi suuremahulisse tootmisse.

„Maailm liigub arvutusvõimsusel põhineva majanduse poole,“ ütles Greg Brockman, OpenAI president ja kaasasutaja. „Jalapeño on osa meie pikaajalisest tervikliku taristu strateegiast, mille eesmärk on muuta arvutusvõimsus külluslikumaks, mille tulemusel on AI inimeste ja ettevõtete jaoks kiirem, töökindlam ja soodsam ning seda saab kasutada olulisemate probleemide lahendamiseks. Kujundades suurema osa taristust ise, saame pakkuda rohkem intelligentsust suurema tõhususega ja jätkata arenenud AI viimist laiema kättesaadavuseni.“

„Jalapeño loodi algusest peale LLM-inferentsi jaoks, kasutades üksikasjalikke teadmisi meie tihedast koostööst OpenAI teadlastega,“ ütles OpenAI riistvaraprogrammi juht Richard Ho. „Optimeerisime arhitektuuri kernelite, mälu liikumise, võrgunduse ja teenindusmustrite ümber, mis on eesliini AI mudelite jaoks kõige olulisemad. Varaste testide põhjal täidab Jalapeño meie tähtsamaid töökoormusi tõhusalt, riistvara teoreetiliste piiride lähedal.“

„Meie koostöö OpenAI-ga väljendab põhimõttelist pühendumust füüsilise taristu skaleerimisele, mida on vaja järgmiseks AI kümnendiks,“ ütles Broadcomi president ja tegevjuht Hock Tan. „See on alles mitme põlvkonna teekaardi algus. Arendades oma valdkonna juhtivaid kiibitehnoloogiaid otse koos OpenAI-ga, võimaldame alates 2026. aastast koos Microsofti ja teiste partneritega kasutusele võtta gigavatise võimsusega andmekeskusi.“

Loodud parimaks inferentsiplatvormiks LLM-ide jaoks

Jalapeño on puhtalt lehelt loodud lahendus tänapäevase LLM-inferentsi jaoks, mitte varasematest AI töökoormustest kohandatud üldotstarbeline kiirendi. See tugineb süsteemidele, mida OpenAI iga päev käitab ChatGPT‑s, Codexis, API-s ja tulevastes agentipõhistes toodetes, kuid on samal ajal loodud ka kogu valdkonna praeguste ja tulevaste LLM-ide jaoks. Eesmärk on ühendada tänaste juhtivate AI-kiirendite võimsus ja läbilase latentsusega, mis on lähemal kiireimatele spetsialiseeritud inferentsisüsteemidele, muutes Jalapeño hästi sobivaks mastaapsete interaktiivsete LLM-toodete jaoks.

See on tervikliku taristu eelis. OpenAI ei arenda üksnes eesliini mudeleid ega ehita nende peale tooteid; ta kujundab ka nende aluseks olevat taristut: kiibiarhitektuuri, kerneleid, mälusüsteeme, võrgundust, ajastamist, juurutussüsteeme ja tootekogemust. Kuna OpenAI tegutseb kogu taristus, saab iga kihti optimeerida sama eesmärgi ümber: muuta selle mudelid kasutajate jaoks kiiremaks, töökindlamaks ja soodsamaks.

Jalapeño tugevdab OpenAI edusamme vedavat hooratast. Parem taristu suurendab arvutustõhusust. Suurem arvutustõhusus võimaldab paremat treenimist ja teenindamist ning annab lõpuks jõu võimekamatele AI mudelitele. Paremad mudelid muutuvad paremaks toodeteks inimestele, arendajatele ja ettevõtetele. Paremad tooted toovad rohkem kasutust, rohkem kliente ja rohkem tulu, mis võimaldab OpenAI-l investeerida järgmise põlvkonna taristusse. Aja jooksul aitab see tsükkel muuta intelligentsuse kõigi jaoks võimekamaks, töökindlamaks ja odavamaks.

Üheksakuuline tape-out, kiirendatud OpenAI mudelitega

Jalapeño arendati koostöös algsest disainist tootmisse mineva tape-out’ini vaid üheksa kuuga ning kohandatud AI-kiirendi programm esindab meie hinnangul kiireimat ASIC-arendustsüklit, mis on suure jõudlusega arenenud pooljuhtides kunagi saavutatud. See kiirus peegeldab sügavat tarkvara ja riistvara ühisarendust OpenAI inseneritiimidega, Broadcomi kiibilahenduste juurutamise eksperditeadmisi ning OpenAI mudelite kasutamist disaini- ja optimeerimisprotsessi osade kiirendamiseks.

Samad mudelid, mida kasutajatele pakutakse, aitavad parandada taristut, millel tulevasi mudeleid käitatakse. Kui AI aitab inseneridel kujundada paremaid kiipe kiiremini, võib see vähendada arvutusvõimsuse kulu kogu valdkonnas ja aidata demokratiseerida ligipääsu arenenud AI-le.

Mitme põlvkonna platvormi ehitamine koos partneritega

Jalapeño on esimene samm mitme põlvkonna arvutusplatvormis, mis on loodud esmaseks kasutuselevõtuks 2026. aasta lõpuks ja laienemiseks järgmistel aastatel, ühendades OpenAI loodud kiirendid Broadcomi kiibilahenduste, võrgunduse ja ühenduvustehnoloogiatega ning Celestica plaadi-, riiuli- ja süsteemiekspertiisiga.

Arenenud AI laiemalt kättesaadavaks tegemine

Selle töö mõte on lihtne: inferents on koht, kus AI inimesteni jõuab. Iga kulude, kiiruse ja töökindluse paranemine võib avalduda kiirema ChatGPT vastusena, Codexi ülesandena, mis saab teha rohkem samme väiksema ootamisega, API-tootena, mida on odavam ehitada, või usaldusväärsema ligipääsuna suure nõudluse ajal.

AI demokratiseerimine tähendab, et arenenud mudelid tehakse piisavalt kättesaadavaks, töökindlaks ja taskukohaseks, et rohkem inimesi saaks neid iga päev kasutada. Jalapeño aitab OpenAI-l muuta suurema osa oma taristust kasulikuks intelligentsuseks õpilastele, arendajatele, väikeettevõtetele, teadlastele, suurettevõtetele ja kõigile, kes püüavad õppida, luua või raskeid probleeme lahendada.

Autor

OpenAI