OpenAI ir Broadcom pristato LLM optimizuotą išvedimo lustą
- Ankstyvieji bandymai rodo, kad pirmosios kartos spartintuvas užtikrins gerokai geresnį našumą vienam vatui nei dabartiniai pažangiausi sprendimai
- Nuo pagrindų sukurtas dabartiniams ir būsimiems LLM visoje industrijoje
- Nuo projektavimo iki gamybos sukurtas per devynis mėnesius, pasitelkiant OpenAI modelius
- Išplečia OpenAI viso technologijų paketo platformą: nuo produktų iki modelių, o dabar ir iki lustų
- Bus diegiamas gigavatų mastu su duomenų centrų partneriais, per kelias kartas
OpenAI ir Broadcom (NASDAQ: AVGO) šiandien pristatė Jalapeño – pirmąjį OpenAI intelekto procesorių: spartintuvą, suprojektuotą pagal OpenAI ateities LLM išvedimo viziją, ir pirmąjį AI spartintuvą kelių kartų skaičiavimo platformoje, kurią įmonės kuria drauge, kad pažangi AI taptų spartesnė, patikimesnė ir prieinamesnė daugiau žmonių.

Jalapeño OpenAI generaliniam direktoriui Samui Altmanui ir prezidentui Gregui Brockmanui perdavė Broadcom prezidentas ir generalinis direktorius Hockas Tanas bei prezidentas Charlie Kawwasas; tai žymi svarbų žingsnį OpenAI strategijoje kurti visą technologijų paketą, kuriuo remiasi jos modeliai ir produktai.
OpenAI lustą nuo nulio sukūrė remdamasi giliu LLM pagrindų supratimu, atsižvelgdama į savo modelių, branduolių, aptarnavimo sistemų ir produktų poreikių planą, kartu su partneriais Broadcom ir Celestica, kurie padeda industrializuoti platformą per lusto įgyvendinimą, plokštes, stovų sistemų integraciją, didelio našumo tinklus ir mastelio gamybos sistemas. Jalapeño sukurtas lanksčiai veikti su visais LLM, remiantis OpenAI įžvalgomis apie dabartinių ir būsimų AI modelių išvedimo poreikius visoje industrijoje. Jalapeño lusto inžineriniai pavyzdžiai laboratorijoje vykdo ML darbo krūvius gamybai numatytu dažniu ir galia, įskaitant GPT‑5.3‑Codex‑Spark.
Nors OpenAI dar matuoja galutinį našumą, ankstyvieji bandymai rodo, kad Jalapeño užtikrins gerokai geresnį našumą vienam vatui nei dabartiniai pažangiausi sprendimai. Išsami techninė našumo ataskaita bus pristatyta artimiausiais mėnesiais. Architektūra sumažina duomenų judėjimą ir subalansuoja skaičiavimo, atminties bei tinklo išteklius, kad realus panaudojimas būtų daug artimesnis teoriniam didžiausiam našumui. Broadcom silicio įgyvendinimas ir tinklo technologijos, įskaitant Tomahawk tinklo silicį, padeda parengti platformą didelio masto gamybai.
„Pasaulis pereina prie skaičiavimo galia grindžiamos ekonomikos“, – sakė OpenAI prezidentas ir vienas iš įkūrėjų Gregas Brockmanas. „Jalapeño yra mūsų ilgalaikės viso technologijų paketo infrastruktūros strategijos dalis, skirta didinti skaičiavimo išteklių gausą, kad AI žmonėms ir įmonėms būtų spartesnė, patikimesnė, įperkamesnė ir galėtų būti naudojama svarbesnėms problemoms spręsti. Patys projektuodami didesnę technologijų paketo dalį, galime efektyviau teikti daugiau intelekto ir toliau stumti pažangią AI platesnės prieigos link.“
„Jalapeño nuo pagrindų sukurtas LLM išvedimui, naudojant išsamias įžvalgas, gautas glaudžiai bendradarbiaujant su OpenAI tyrėjais“, – sakė Richardas Ho, vadovaujantis OpenAI aparatinės įrangos programai. „Architektūrą optimizavome pagal branduolius, atminties judėjimą, tinklus ir aptarnavimo modelius, kurie yra svarbiausi pažangiausiems AI modeliams. Remiantis ankstyvaisiais bandymais, Jalapeño efektyviai vykdys svarbiausius mūsų darbo krūvius arti aparatinės įrangos teorinių ribų.“
„Mūsų bendradarbiavimas su OpenAI reiškia esminį įsipareigojimą plėsti fizinę infrastruktūrą, reikalingą kitam AI dešimtmečiui“, – sakė Broadcom prezidentas ir generalinis direktorius Hockas Tanas. „Tai tik kelių kartų plano pradžia. Kurdami savo industrijoje pirmaujantį silicį tiesiogiai su OpenAI, sudarome sąlygas nuo 2026 m. kartu su Microsoft ir kitais partneriais diegti gigavatų masto duomenų centrus.“
Jalapeño yra nuo švaraus lapo sukurtas šiuolaikinio LLM išvedimo sprendimas, o ne bendros paskirties spartintuvas, pritaikytas iš ankstesnių AI darbo krūvių. Jis remiasi sistemomis, kurias OpenAI kasdien naudoja ChatGPT, Codex, API ir būsimuose agentiniuose produktuose, kartu yra kuriamas dabartiniams ir būsimiems LLM visoje industrijoje. Tikslas – sujungti šiandieninių pirmaujančių AI spartintuvų galią ir pralaidumą su delsa, artimesne greičiausioms specializuotoms išvedimo sistemoms, todėl Jalapeño itin tinka interaktyviems LLM produktams dideliu mastu.
Tai ir yra viso technologijų paketo pranašumas. OpenAI ne tik kuria pažangiausius modelius ar produktus jų pagrindu; ji projektuoja ir juos palaikančią infrastruktūrą: lustų architektūrą, branduolius, atminties sistemas, tinklus, planavimą, diegimo sistemas ir produkto patirtį. Kadangi OpenAI veikia visame technologijų pakete, kiekvieną sluoksnį galima optimizuoti tam pačiam tikslui: padaryti jos modelius spartesnius, patikimesnius ir prieinamesnius naudotojams.
Jalapeño sustiprina OpenAI pažangą skatinantį smagratį. Geresnė infrastruktūra didina skaičiavimo efektyvumą. Didesnis skaičiavimo efektyvumas leidžia geriau mokyti ir aptarnauti modelius, galiausiai suteikdamas galios pajėgesniems AI modeliams. Geresni modeliai tampa geresniais produktais žmonėms, kūrėjams ir įmonėms. Geresni produktai skatina didesnį naudojimą, daugiau klientų ir daugiau pajamų, o tai leidžia OpenAI reinvestuoti į naujos kartos infrastruktūrą. Ilgainiui šis ciklas padeda padaryti intelektą pajėgesnį, patikimesnį ir pigesnį visiems.
Jalapeño buvo bendrai sukurtas nuo pradinio projekto iki perdavimo gamybai vos per devynis mėnesius, o ši individualaus AI spartintuvo programa, mūsų nuomone, yra sparčiausias kada nors pasiektas ASIC kūrimo ciklas didelio našumo pažangiuose puslaidininkiuose. Šį greitį lėmė glaudus programinės ir aparatinės įrangos bendrakūrimas su OpenAI inžinerijos komandomis, Broadcom silicio įgyvendinimo kompetencija ir OpenAI modelių naudojimas kai kurioms projektavimo bei optimizavimo proceso dalims paspartinti.
Tie patys naudotojams teikiami modeliai padeda tobulinti infrastruktūrą, kuri bus naudojama būsimiems modeliams vykdyti. Jei AI gali padėti inžinieriams greičiau kurti geresnius lustus, ji gali sumažinti skaičiavimo išteklių kainą visoje industrijoje ir padėti demokratizuoti prieigą prie pažangios AI.
Jalapeño yra pirmasis žingsnis kelių kartų skaičiavimo platformoje, skirtoje pradiniam diegimui iki 2026 m. pabaigos ir plėtrai ateinančiais metais, sujungiant OpenAI sukurtus spartintuvus su Broadcom silicio įgyvendinimo, tinklo ir junglumo technologijomis bei Celestica plokščių, stovų ir sistemų kompetencija.
Šio darbo esmė paprasta: išvedimas yra ta vieta, kur AI pasiekia žmones. Kiekvienas kainos, greičio ir patikimumo pagerinimas gali virsti greitesniu ChatGPT atsakymu, Codex užduotimi, kuri gali atlikti daugiau žingsnių mažiau laukiant, API produktu, kurį pigiau kurti, arba patikimesne prieiga, kai paklausa didelė.
AI demokratizavimas reiškia, kad pažangūs modeliai turi būti pakankamai prieinami, patikimi ir įperkami, kad daugiau žmonių galėtų juos naudoti kasdien. Jalapeño padeda OpenAI didesnę savo infrastruktūros dalį paversti naudingu intelektu studentams, kūrėjams, mažoms įmonėms, tyrėjams, didelėms organizacijoms ir visiems, kurie bando mokytis, kurti ar spręsti sudėtingas problemas.


