OpenAI u Broadcom jiżvelaw ċippa tal-inferenza ottimizzata għal LLM
- Testijiet bikrin juru li l-aċċelleratur tal-ewwel ġenerazzjoni se jagħti prestazzjoni għal kull watt ħafna aħjar mill-aqwa teknoloġija attwali
- Mibni mill-bidu għal LLMs attwali u futuri fl-industrija kollha
- Żviluppat mid-disinn sal-produzzjoni f’disa’ xhur, aċċellerat mill-mudelli ta’ OpenAI
- Jespandi l-pjattaforma full-stack ta’ OpenAI, mill-prodotti għall-mudelli u issa għaċ-ċipep
- Se jiġi skjerat fuq skala ta’ gigawatt ma’ sħab ta’ ċentri tad-data, fuq diversi ġenerazzjonijiet
OpenAI u Broadcom (NASDAQ: AVGO) illum żvelaw Jalapeño, l-ewwel Intelligence Processor ta’ OpenAI: aċċelleratur mibni madwar il-viżjoni ta’ OpenAI għall-futur tal-inferenza tal-LLM, u l-ewwel aċċelleratur AI f’pjattaforma ta’ komputazzjoni b’diversi ġenerazzjonijiet li l-kumpaniji qed jibnu flimkien biex jagħmlu AI avvanzata aktar veloċi, aktar affidabbli u aktar aċċessibbli għal aktar nies.

Jalapeño ġie ppreżentat lis-CEO ta’ OpenAI Sam Altman u lill-President Greg Brockman mill-President u CEO ta’ Broadcom Hock Tan u l-President Charlie Kawwas, u dan jimmarka pass importanti fl-istrateġija ta’ OpenAI biex tibni l-full stack wara l-mudelli u l-prodotti tagħha.
OpenAI iddisinjat iċ-ċippa mill-bidu, fuq il-fehim profond tagħha tal-prinċipji bażiċi tal-LLM, iggwidata mill-pjanijiet tagħha għal mudelli, kernels, sistemi ta’ serving u ħtiġijiet tal-prodotti, mas-sħab Broadcom u Celestica, li jgħinu fl-industrijalizzazzjoni tal-pjattaforma permezz tal-implimentazzjoni taċ-ċippa, bordijiet, integrazzjoni ta’ sistemi rack, netwerking ta’ prestazzjoni għolja u sistemi ta’ produzzjoni skalabbli. Jalapeño huwa ddisinjat b’flessibbiltà biex jaħdem mal-LLMs kollha, iggwidat mill-għarfien ta’ OpenAI dwar il-ħtiġijiet tal-inferenza tal-mudelli AI attwali u futuri fl-industrija kollha. Kampjuni tal-inġinerija taċ-ċippa Jalapeño qed iħaddmu workloads ML fil-laboratorju bil-frekwenza u l-qawwa mmirati għall-produzzjoni, inkluż GPT‑5.3‑Codex‑Spark.
Filwaqt li OpenAI għadha qed tkejjel il-prestazzjoni finali, testijiet bikrin juru li Jalapeño se jagħti prestazzjoni għal kull watt ħafna aħjar mill-aqwa teknoloġija attwali. Rapport tekniku dettaljat dwar il-prestazzjoni se jiġi ppreżentat fix-xhur li ġejjin. L-arkitettura tnaqqas il-moviment tad-data u tibbilanċja r-riżorsi tal-komputazzjoni, tal-memorja u tan-netwerking biex tikseb użu reali ħafna eqreb lejn il-prestazzjoni massima teoretika. L-implimentazzjoni tas-silicon u t-teknoloġiji tan-netwerking ta’ Broadcom, inkluż is-silicon tan-netwerking Tomahawk, jgħinu biex il-pjattaforma tasal għal produzzjoni fuq skala kbira.
“Id-dinja qed timxi lejn ekonomija mħaddma bil-komputazzjoni,” qal Greg Brockman, President u Ko-Fundatur ta’ OpenAI. “Jalapeño huwa parti mill-istrateġija fit-tul tagħna għall-infrastruttura full-stack biex nagħmlu l-komputazzjoni aktar abbundanti, u b’hekk AI tkun aktar veloċi, aktar affidabbli, aktar affordabbli għan-nies u n-negozji, u tista’ tintuża biex issolvi problemi aktar importanti. Billi niddisinjaw aktar mill-stack aħna stess, nistgħu nservu aktar intelliġenza b’effiċjenza akbar u nkomplu nimbuttaw AI avvanzata lejn aċċess usa’.”
“Jalapeño ġie ddisinjat mill-bidu għall-inferenza tal-LLM permezz ta’ għarfien dettaljat mill-kollaborazzjoni mill-qrib tagħna mar-riċerkaturi ta’ OpenAI,” qal Richard Ho, li jmexxi l-programm tal-hardware ta’ OpenAI. “Ottimizzajna l-arkitettura madwar il-kernels, il-moviment tal-memorja, in-netwerking u x-xejriet ta’ serving li huma l-aktar importanti għall-mudelli AI fruntiera. Skont testijiet bikrin, Jalapeño se jesegwixxi b’effiċjenza l-aktar workloads importanti tagħna qrib il-limiti teoretiċi tal-hardware.”
“Il-kollaborazzjoni tagħna ma’ OpenAI tirrappreżenta impenn fundamentali biex niskalaw l-infrastruttura fiżika meħtieġa għall-għaxar snin li ġejjin ta’ AI,” qal Hock Tan, President u CEO, Broadcom. “Dan huwa biss il-bidu ta’ pjan direzzjonali b’diversi ġenerazzjonijiet. Billi niżviluppaw flimkien is-silicon ewlieni fl-industrija tagħna direttament ma’ OpenAI, qed nippermettu l-iskjerament ta’ ċentri tad-data fuq skala ta’ gigawatt ma’ Microsoft u sħab oħra mill-2026.”
Jalapeño huwa disinn minn karta vojta għall-inferenza moderna tal-LLM, mhux aċċelleratur ġenerali adattat minn workloads AI preċedenti. Huwa ggwidat mis-sistemi li OpenAI tħaddem kuljum f’ChatGPT, Codex, l-API u prodotti aġentiċi futuri, filwaqt li huwa wkoll iddisinjat għal LLMs attwali u futuri fl-industrija kollha. L-għan huwa li jingħaqdu l-qawwa u t-throughput tal-aċċelleraturi AI ewlenin tal-lum ma’ latency eqreb lejn l-aktar sistemi ta’ inferenza speċjalizzati veloċi, biex Jalapeño jkun adattat ħafna għal prodotti LLM interattivi fuq skala.
Dan huwa l-vantaġġ tal-full stack. OpenAI mhux biss qed tiżviluppa mudelli fruntiera jew tibni prodotti fuqhom; qed tiddisinja l-infrastruttura ta’ taħthom: arkitettura taċ-ċipep, kernels, sistemi tal-memorja, netwerking, skedar, sistemi ta’ skjerament u esperjenza tal-prodott. Minħabba li OpenAI topera tul l-istack kollu, kull saff jista’ jiġi ottimizzat madwar l-istess għan: li tagħmel il-mudelli tagħha aktar veloċi, aktar affidabbli u aktar affordabbli għall-utenti.
Jalapeño jsaħħaħ iċ-ċiklu virtwuż wara l-progress ta’ OpenAI. Infrastruttura aħjar tmexxi l-effiċjenza tal-komputazzjoni. Effiċjenza akbar tal-komputazzjoni tippermetti taħriġ u serving aħjar, u fl-aħħar tħaddem mudelli AI aktar kapaċi. Mudelli aħjar isiru prodotti aħjar għan-nies, għall-iżviluppaturi u għan-negozji. Prodotti aħjar iwasslu għal aktar użu, aktar klijenti u aktar dħul, li jħallu lil OpenAI terġa’ tinvesti fil-ġenerazzjoni li jmiss ta’ infrastruttura. Maż-żmien, dak iċ-ċiklu jgħin biex l-intelliġenza ssir aktar kapaċi, aktar affidabbli u inqas għalja għal kulħadd.
Jalapeño ġie kożviluppat mid-disinn inizjali sat-tape-out għall-manifattura f’disa’ xhur biss, u l-programm tal-aċċelleratur AI apposta jirrappreżenta dak li nemmnu li hu l-aktar ċiklu mgħaġġel ta’ żvilupp ASIC li qatt inkiseb f’semikondutturi avvanzati ta’ prestazzjoni għolja. Dik il-veloċità tirrifletti kożvilupp profond bejn software u hardware mat-timijiet tal-inġinerija ta’ OpenAI, l-għarfien espert ta’ Broadcom fl-implimentazzjoni tas-silicon, u l-użu tal-mudelli ta’ OpenAI biex jaċċelleraw partijiet mill-proċess tad-disinn u l-ottimizzazzjoni.
L-istess mudelli moqdija lill-utenti qed jgħinu jtejbu l-infrastruttura użata biex jitħaddmu mudelli futuri. Jekk AI tista’ tgħin lill-inġiniera jiddisinjaw ċipep aħjar aktar malajr, tista’ tnaqqas l-ispiża tal-komputazzjoni fl-industrija kollha u tgħin tiddemokratizza l-aċċess għal AI avvanzata.
Jalapeño huwa l-ewwel pass f’pjattaforma ta’ komputazzjoni b’diversi ġenerazzjonijiet, iddisinjata għal skjerament inizjali sal-aħħar tal-2026 u biex tespandi fis-snin ta’ wara, billi tgħaqqad aċċelleraturi ddisinjati minn OpenAI mal-implimentazzjoni tas-silicon, in-netwerking u t-teknoloġiji tal-konnettività ta’ Broadcom; u l-għarfien espert ta’ Celestica fil-bordijiet, ir-racks u s-sistemi.
Il-punt ta’ dan ix-xogħol huwa sempliċi: l-inferenza hija fejn AI tasal għand in-nies. Kull titjib fl-ispiża, fil-veloċità u fl-affidabbiltà jista’ jidher bħala tweġiba aktar mgħaġġla minn ChatGPT, kompitu ta’ Codex li jista’ jieħu aktar passi b’inqas stennija, prodott API irħas biex jinbena, jew aċċess aktar affidabbli meta d-domanda tkun għolja.
Id-demokratizzazzjoni ta’ AI tfisser li mudelli avvanzati jsiru disponibbli, affidabbli u affordabbli biżżejjed biex aktar nies jużawhom kuljum. Jalapeño jgħin lil OpenAI tbiddel aktar mill-infrastruttura tagħha f’intelliġenza utli għall-istudenti, l-iżviluppaturi, in-negozji żgħar, ir-riċerkaturi, l-intrapriżi u kull min qed jipprova jitgħallem, joħloq jew isolvi problemi diffiċli.


