Pāriet uz galveno saturu
OpenAI

2026. gada 24. jūnijs

Uzņēmums

OpenAI un Broadcom atklāj LVM optimizētu inferenču mikroshēmu

Notiek ielāde…
  • Sākotnējie testi uzrrāda, ka pirmās paaudzes paātrinātājs nodrošinās būtiski labāku veiktspēju uz vatu nekā pašreizējie modernākie risinājumi
  • No pašiem pamatiem veidots pašreizējiem un nākotnes LVM visā nozarē
  • Izstrādāts no projektēšanas līdz ražošanai deviņos mēnešos, pateicoties OpenAI modeļiem
  • Paplašina OpenAI pilna steka platformu — no produktiem līdz modeļiem un tagad arī mikroshēmām
  • Tiks izvērsts gigavatu mērogā kopā ar datu centru partneriem vairākās paaudzēs

OpenAI un Broadcom (NASDAQ: AVGO) šodien atklāja Jalapeño, OpenAI pirmo Intelligence Processor: paātrinātāju, kas izstrādāts, balstoties uz OpenAI redzējumu par LVM inferenču nākotni, un pirmo MI paātrinātāju vairāku paaudžu skaitļošanas platformā, ko uzņēmumi kopīgi veido, lai progresīvu MI padarītu ātrāku, uzticamāku un pieejamāku lielākam cilvēku lokam.

OpenAI un Broadcom vadītāji demonstrē Jalapeño inferenču mikroshēmu.

Jalapeño OpenAI izpilddirektoram Semam Altmanam un prezidentam Gregam Brokmanam nodeva Broadcom prezidents un izpilddirektors Hoks Tans un prezidents Čārlijs Kavvass, iezīmējot svarīgu soli OpenAI stratēģijā veidot pilnu steku, kas ir tās modeļu un produktu pamatā.

OpenAI izstrādāja mikroshēmu no nulles, balstoties uz padziļinātu izpratni par LVM pamatiem un ņemot vērā savu modeļu, kodolu, apkalpošanas sistēmu un produktu vajadzību ceļvedi; partneri Broadcom un Celestica palīdz industrializēt platformu ar mikroshēmas ieviešanu, plates, statņu sistēmu integrāciju, augstas veiktspējas tīklošanu un mērogojamām ražošanas sistēmām. Jalapeño ir izstrādāts elastīgam darbam ar visiem LVM, izmantojot OpenAI atziņas par pašreizējo un nākotnes MI modeļu inferenču vajadzībām visā nozarē. Jalapeño mikroshēmas inženiertehniskie paraugi laboratorijā darbina ML darba slodzes ar ražošanas mērķa frekvenci un jaudu, tostarp GPT‑5.3‑Codex‑Spark.

Lai gan OpenAI vēl mēra galīgo veiktspēju, sākotnējie testi uzrāda, ka Jalapeño nodrošinās būtiski labāku veiktspēju uz vatu nekā pašreizējie modernākie risinājumi. Detalizēts tehniskais ziņojums par veiktspēju tiks prezentēts tuvākajos mēnešos. Arhitektūra samazina datu pārvietošanu un līdzsvaro skaitļošanas, atmiņas un tīkla resursus, lai panāktu faktisko noslodzi, kas ir daudz tuvāka teorētiskajai maksimālajai veiktspējai. Broadcom silīcija ieviešana un tīklošanas tehnoloģijas, tostarp Tomahawk tīkla silīcijs, palīdz ieviest platformu liela mēroga ražošanā.

„Pasaule virzās uz ekonomiku, ko darbina skaitļošanas jauda,” sacīja Gregs Brokmans, OpenAI prezidents un līdzdibinātājs. „Jalapeño ir daļa no mūsu ilgtermiņa pilna steka infrastruktūras stratēģijas — padarīt skaitļošanas jaudu daudz plašāk pieejamu, lai MI cilvēkiem un uzņēmumiem būtu ātrāks, uzticamāks, pieejamāks cenas ziņā un spētu risināt svarīgākas problēmas. Pašiem izstrādājot lielāku steka daļu, mēs varam nodrošināt vairāk intelekta ar lielāku efektivitāti un turpināt virzīt progresīvu MI uz plašāku pieejamību.”

„Jalapeño no pašiem pamatiem tika izstrādāts LVM inferencei, izmantojot detalizētas atziņas no mūsu ciešās sadarbības ar OpenAI pētniekiem,” sacīja Ričards Ho, kurš vada OpenAI aparatūras programmu. „Mēs optimizējām arhitektūru ap kodoliem, atmiņas pārvietošanu, tīklošanu un apkalpošanas modeļiem, kas ir vissvarīgākie progresīviem MI modeļiem. Pamatojoties uz sākotnējiem testiem, Jalapeño efektīvi izpildīs mūsu svarīgākās darba slodzes tuvu aparatūras teorētiskajām robežām.”

„Mūsu sadarbība ar OpenAI apliecina būtisku apņemšanos mērogot fizisko infrastruktūru, kas vajadzīga nākamajai MI desmitgadei,” sacīja Hoks Tans, Broadcom prezidents un izpilddirektors. „Tas ir tikai sākums vairāku paaudžu ceļvedim. Kopīgi ar OpenAI izstrādājot mūsu nozarē vadošo silīciju, mēs no 2026. gada kopā ar Microsoft un citiem partneriem padarām iespējamu gigavatu mēroga datu centru izvēršanu.”

Izstrādāta kā labākā inferenču platforma LVM vajadzībām

Jalapeño ir no nulles veidots dizains mūsdienu LVM inferencei, nevis universāls paātrinātājs, kas pielāgots no agrākām MI darba slodzēm. Tajā ņemtas vērā sistēmas, ko OpenAI ik dienu darbina ChatGPT, Codex, API un nākotnes aģentiskajos produktos, vienlaikus to izstrādājot arī pašreizējiem un nākotnes LVM visā nozarē. Mērķis ir apvienot mūsdienu vadošo MI paātrinātāju jaudu un caurlaidspēju ar aizturi, kas ir tuvāka ātrākajām specializētajām inferenču sistēmām, padarot Jalapeño labi piemērotu interaktīviem LVM produktiem lielā mērogā.

Tā ir pilna steka priekšrocība. OpenAI ne tikai izstrādā progresīvākos modeļus vai veido produktus uz to pamata; tas projektē arī infrastruktūru zem tiem: mikroshēmu arhitektūru, kodolus, atmiņas sistēmas, tīklošanu, plānošanu, izvēršanas sistēmas un produkta pieredzi. Tā kā OpenAI darbojas visā stekā, katru slāni var optimizēt vienam un tam pašam mērķim: padarīt tā modeļus ātrākus, uzticamākus un lietotājiem pieejamākus cenas ziņā.

Jalapeño stiprina spararatu, kas virza OpenAI progresu. Labāka infrastruktūra palielina skaitļošanas efektivitāti. Lielāka skaitļošanas efektivitāte ļauj labāk trenēt un apkalpot sistēmas, galu galā darbinot spējīgākus MI modeļus. Labāki modeļi kļūst par labākiem produktiem cilvēkiem, izstrādātājiem un uzņēmumiem. Labāki produkti veicina plašāku lietojumu, vairāk klientu un lielākus ieņēmumus, kas ļauj OpenAI atkārtoti ieguldīt nākamās paaudzes infrastruktūrā. Laika gaitā šis cikls palīdz padarīt intelektu spējīgāku, uzticamāku un lētāku ikvienam.

Tape-out deviņos mēnešos, paātrināts ar OpenAI modeļiem

Jalapeño no sākotnējā dizaina līdz ražošanas tape-out posmam tika kopīgi izstrādāts tikai deviņos mēnešos, un pielāgotā MI paātrinātāja programma, mūsuprāt, ir ātrākais ASIC izstrādes cikls, kāds jebkad sasniegts augstas veiktspējas progresīvo pusvadītāju jomā. Šis ātrums atspoguļo ciešu programmatūras un aparatūras kopizstrādi ar OpenAI inženieru komandām, Broadcom silīcija ieviešanas ekspertīzi un OpenAI modeļu izmantošanu, lai paātrinātu daļas no projektēšanas un optimizācijas procesa.

Tie paši modeļi, kas tiek nodrošināti lietotājiem, palīdz uzlabot infrastruktūru, ko izmantos nākotnes modeļu darbināšanai. Ja MI var palīdzēt inženieriem ātrāk izstrādāt labākas mikroshēmas, tas var samazināt skaitļošanas izmaksas visā nozarē un palīdzēt demokratizēt piekļuvi progresīvam MI.

Vairāku paaudžu platformas veidošana kopā ar partneriem

Jalapeño ir pirmais solis vairāku paaudžu skaitļošanas platformā, kas paredzēta sākotnējai izvēršanai līdz 2026. gada beigām un paplašināšanai nākamajos gados, apvienojot OpenAI izstrādātus paātrinātājus ar Broadcom silīcija ieviešanas, tīklošanas un savienojamības tehnoloģijām, kā arī Celestica kompetenci plašu, statņu un sistēmu jomā.

Padarīt progresīvu MI plašāk pieejamu

Šī darba jēga ir vienkārša: inference ir vieta, kur MI sasniedz cilvēkus. Ikviens izmaksu, ātruma un uzticamības uzlabojums var izpausties kā ātrāka ChatGPT atbilde, Codex uzdevums, kas ar mazāku gaidīšanu spēj veikt vairāk soļu, API produkts, kuru ir lētāk veidot, vai uzticamāka piekļuve liela pieprasījuma laikā.

MI demokratizācija nozīmē padarīt progresīvus modeļus pietiekami pieejamus, uzticamus un cenas ziņā sasniedzamus, lai vairāk cilvēku tos varētu lietot ikdienā. Jalapeño palīdz OpenAI lielāku daļu savas infrastruktūras pārvērst noderīgā intelektā studentiem, izstrādātājiem, mazajiem uzņēmumiem, pētniekiem, lieluzņēmumiem un ikvienam, kurš cenšas mācīties, radīt vai risināt sarežģītas problēmas.

Autors

OpenAI