OpenAI e Broadcom prezantojnë çip inference të optimizuar për LLM
- Testimet e hershme tregojnë se përshpejtuesi i gjeneratës së parë do të ofrojë performancë për vat ndjeshëm më të mirë se teknologjia më e avancuar aktuale
- I ndërtuar nga themeli për LLM-të e sotme dhe të ardhshme në të gjithë industrinë
- I zhvilluar nga projektimi deri në prodhim për nëntë muaj, i përshpejtuar nga modelet e OpenAI
- Zgjeron platformën e plotë të OpenAI, nga produktet te modelet dhe tani te çipat
- Do të zbatohet në shkallë gigavati me partnerë të qendrave të të dhënave, përgjatë disa gjeneratave
OpenAI dhe Broadcom (NASDAQ: AVGO) prezantuan sot Jalapeño, procesorin e parë të inteligjencës të OpenAI: një përshpejtues i projektuar sipas vizionit të OpenAI për të ardhmen e inferimit të LLM, dhe përshpejtuesi i parë i IA-së në një platformë kompjuterike shumëgjeneratëshe që kompanitë po ndërtojnë së bashku për ta bërë IA-në e avancuar më të shpejtë, më të besueshme dhe më të arritshme për më shumë njerëz.

Jalapeño iu dorëzua CEO-s së OpenAI, Sam Altman, dhe Presidentit Greg Brockman nga Presidenti dhe CEO i Broadcom, Hock Tan, dhe Presidenti Charlie Kawwas, duke shënuar një hap të rëndësishëm në strategjinë e OpenAI për të ndërtuar të gjithë infrastrukturën teknologjike që mbështet modelet dhe produktet e saj.
OpenAI e projektoi çipin nga e para, mbi bazën e kuptimit të thellë të themeleve të LLM-ve, të udhëhequr nga udhërrëfyesi i saj për modelet, kernelët, sistemet e shërbimit dhe nevojat e produkteve, me partnerët Broadcom dhe Celestica, që ndihmojnë në industrializimin e platformës përmes implementimit të çipit, integrimit të pllakave, sistemit të rafteve, rrjetëzimit me performancë të lartë dhe sistemeve të prodhimit të shkallëzueshëm. Jalapeño është projektuar me fleksibilitet për të punuar me të gjitha LLM-të, i udhëhequr nga njohuritë e OpenAI mbi nevojat e inferimit të modeleve AI të sotme dhe të ardhshme në të gjithë industrinë. Mostrat inxhinierike të çipit Jalapeño po ekzekutojnë ngarkesa pune ML në laborator me frekuencën dhe fuqinë e synuar për prodhim, përfshirë GPT‑5.3‑Codex‑Spark.
Ndërsa OpenAI ende po mat performancën përfundimtare, testimet e hershme tregojnë se Jalapeño do të ofrojë performancë për vat ndjeshëm më të mirë se teknologjia më e avancuar aktuale. Një raport teknik i detajuar mbi performancën do të paraqitet në muajt e ardhshëm. Arkitektura ul lëvizjen e të dhënave dhe balancon burimet e llogaritjes, memories dhe rrjetëzimit për të arritur një shfrytëzim real shumë më afër performancës maksimale teorike. Implementimi në silikon dhe teknologjitë e rrjetëzimit të Broadcom, përfshirë silikonin e rrjetëzimit Tomahawk, ndihmojnë në sjelljen e platformës në prodhim në shkallë të gjerë.
“Bota po kalon drejt një ekonomie të fuqizuar nga llogaritja,” tha Greg Brockman, President dhe Bashkëthemelues i OpenAI. “Jalapeño është pjesë e strategjisë sonë afatgjatë të infrastrukturës me shtresë të plotë për ta bërë fuqinë llogaritëse më të bollshme, duke sjellë AI më të shpejtë, më të besueshme dhe më të përballueshme për njerëzit dhe bizneset, si dhe të përdorshme për zgjidhjen e më shumë problemeve të rëndësishme. Duke projektuar vetë një pjesë më të madhe të shtresës teknologjike, mund të ofrojmë më shumë inteligjencë me efikasitet më të lartë dhe të vazhdojmë ta shtyjmë AI të avancuar drejt qasjes më të gjerë.”
“Jalapeño u projektua nga themeli për inferimin LLM duke përdorur njohuri të hollësishme nga bashkëpunimi ynë i ngushtë me studiuesit e OpenAI,“ tha Richard Ho, i cili drejton programin e harduerit të OpenAI. “E optimizuam arkitekturën rreth kernelëve, lëvizjes së memories, rrjetëzimit dhe modeleve të shërbimit që kanë rëndësinë më të madhe për modelet avangardë të IA-së. Bazuar në testimet e hershme, Jalapeño do t’i ekzekutojë me efikasitet ngarkesat tona më të rëndësishme të punës pranë kufijve teorikë të harduerit.”
“Bashkëpunimi ynë me OpenAI përfaqëson një angazhim themelor për shkallëzimin e infrastrukturës fizike të nevojshme për dekadën e ardhshme të AI,“ tha Hock Tan, President dhe CEO, Broadcom. „Ky është vetëm fillimi i një udhërrëfyesi shumëgjeneratash. Duke bashkëzhvilluar silikonin tonë udhëheqës në industri drejtpërdrejt me OpenAI, po mundësojmë vendosjen e qendrave të të dhënave në shkallë gigavati me Microsoft dhe partnerë të tjerë duke nisur nga viti 2026.”
Jalapeño është një projektim nga e para për inferimin modern LLM, jo një përshpejtues me përdorim të përgjithshëm i përshtatur nga ngarkesa të mëparshme pune të IA-së. Ai bazohet në sistemet që OpenAI vë në punë çdo ditë në ChatGPT, Codex, API dhe produktet e ardhshme agjentike, ndërkohë që është projektuar edhe për LLM-të e sotme dhe të ardhshme në të gjithë industrinë. Synimi është të kombinohet fuqia dhe kapaciteti i përpunimit i përshpejtuesve kryesorë të sotëm të IA-së me vonesë më të afërt me sistemet më të shpejta të specializuara për inferim, duke e bërë Jalapeño të përshtatshëm për produkte interaktive LLM në shkallë të gjerë.
Ky është avantazhi i shtresës së plotë teknologjike. OpenAI nuk po zhvillon vetëm modele avangardë apo nuk po ndërton vetëm produkte mbi to; ajo po projekton edhe infrastrukturën poshtë tyre: arkitekturën e çipeve, kernelët, sistemet e memories, rrjetëzimin, planifikimin, sistemet e vendosjes në përdorim dhe përvojën e produktit. Meqë OpenAI operon në të gjithë shtresat e sistemit, çdo nivel mund të optimizohet rreth të njëjtit qëllim: t’i bëjë modelet e saj më të shpejta, më të besueshme dhe më të përballueshme për përdoruesit.
Jalapeño forcon ciklin e zhvillimit që qëndron pas përparimit të OpenAI. Një infrastrukturë më e mirë rrit efikasitetin e kapacitetit kompjuterik. Efikasiteti më i lartë mundëson trajnim dhe ofrim më të mirë të modeleve, duke fuqizuar modele të inteligjencës artificiale gjithnjë e më të avancuara. Modelet më të mira shndërrohen në produkte më të mira për përdoruesit, zhvilluesit dhe bizneset. Produktet më të mira sjellin më shumë përdorim, më shumë klientë dhe më shumë të ardhura, duke i mundësuar OpenAI të riinvestojë në gjeneratën e ardhshme të infrastrukturës. Me kalimin e kohës, ky cikël ndihmon që inteligjenca të bëhet më e aftë, më e besueshme dhe më pak e kushtueshme për të gjithë.
Jalapeño u zhvillua bashkërisht nga faza fillestare e dizajnit deri te finalizimi i dizajnit për prodhim brenda vetëm nëntë muajsh, dhe programi i përshpejtuesit të personalizuar të IA-së përfaqëson atë që ne besojmë se është cikli më i shpejtë i zhvillimit të një ASIC-u i arritur ndonjëherë në gjysmëpërçuesit e avancuar me performancë të lartë. Kjo shpejtësi pasqyron bashkëzhvillimin e thellë softuer-harduer me ekipet inxhinierike të OpenAI, ekspertizën e Broadcom në implementimin e çipeve prej silikoni dhe përdorimin e modeleve të OpenAI për të përshpejtuar pjesë të procesit të dizajnit dhe optimizimit.
Të njëjtat modele që u ofrohen përdoruesve po ndihmojnë gjithashtu në përmirësimin e infrastrukturës që do të përdoret për të ekzekutuar modelet e ardhshme. Nëse inteligjenca artificiale mund t’i ndihmojë inxhinierët të projektojnë çipe më të mira dhe më shpejt, ajo mund të ulë koston e kapacitetit kompjuterik në të gjithë industrinë dhe të ndihmojë në demokratizimin e qasjes në inteligjencën artificiale të avancuar.
Jalapeño është hapi i parë në një platformë kompjuterike shumëgjeneratëshe, e projektuar për zbatimin fillestar deri në fund të vitit 2026 dhe zgjerimin në vitet në vijim, duke kombinuar përshpejtues të projektuar nga OpenAI me implementimin e silikonit, rrjetëzimin dhe teknologjitë e lidhshmërisë të Broadcom; si dhe ekspertizën e Celestica në pllaka, rafte dhe sisteme.
Qëllimi i kësaj pune është i thjeshtë: inferenca është mënyra se si inteligjenca artificiale arrin te njerëzit. Çdo përmirësim në kosto, shpejtësi dhe besueshmëri mund të përkthehet në një përgjigje më të shpejtë nga ChatGPT, një detyrë në Codex që mund të kryejë më shumë hapa me më pak pritje, një produkt API më ekonomik për t’u ndërtuar ose qasje më të besueshme kur kërkesa është e lartë.
Demokratizimi i inteligjencës artificiale do të thotë t’i bësh modelet e avancuara të disponueshme, të besueshme dhe mjaftueshëm të përballueshme që më shumë njerëz t’i përdorin çdo ditë. Jalapeño e ndihmon OpenAI të shndërrojë më shumë nga infrastruktura e saj në inteligjencë të dobishme për studentët, zhvilluesit, bizneset e vogla, studiuesit, ndërmarrjet dhe këdo që dëshiron të mësojë, të krijojë ose të zgjidhë probleme të vështira.


