OpenAI lan Broadcom ngenalake chip inferensi dioptimalake LLM
- Uji awal nuduhake akselerator generasi kapisan iki bakal menehi kinerja saben watt sing luwih apik tinimbang teknologi paling maju saiki
- Dibangun saka dhasar kanggo LLM saiki lan mangsa ngarep ing saindenging industri
- Dikembangake saka desain nganti produksi sajrone sangang sasi, dicepetake dening model-model OpenAI
- Ngembangake platform full-stack OpenAI, saka produk menyang model lan saiki nganti chip
- Bakal digelar ing skala gigawatt karo mitra pusat data, liwat pirang-pirang generasi
OpenAI lan Broadcom (NASDAQ: AVGO) dina iki ngenalake Jalapeño, Prosesor Kecerdasan kapisan OpenAI: akselerator sing arsitekture dirancang adhedhasar visi OpenAI kanggo masa depan inferensi LLM, lan akselerator AI kapisan ing platform komputasi multi-generasi sing dibangun bareng dening loro perusahaan kanggo nggawe AI canggih luwih cepet, luwih andal, lan luwih gampang diakses dening luwih akeh wong.

Jalapeño diserahake marang CEO OpenAI Sam Altman lan Presiden Greg Brockman dening Presiden lan CEO Broadcom Hock Tan lan Presiden Charlie Kawwas, minangka tandha langkah penting ing strategi OpenAI kanggo mbangun full stack ing mburi model lan produke.
OpenAI ngrancang chip iki saka nol adhedhasar pangerten jero babagan dhasar LLM, kanthi pandhuan saka roadmap model, kernel, sistem panyajian, lan kabutuhan produk, bebarengan karo mitra Broadcom lan Celestica, sing mbantu ngindustrianake platform liwat implementasi chip, integrasi board lan sistem rack, jaringan kinerja dhuwur, lan sistem produksi sing bisa diskalakake. Jalapeño dirancang fleksibel supaya bisa digunakake karo kabeh LLM, dipandu dening wawasan OpenAI babagan kabutuhan inferensi model AI saiki lan ing mangsa ngarep ing saindenging industri. Sampel rekayasa chip Jalapeño wis mbukak beban kerja ML ing laboratorium kanthi frekuensi lan daya target produksi, kalebu GPT‑5.3‑Codex‑Spark.
Sanajan OpenAI isih ngukur kinerja final, uji awal nuduhake manawa Jalapeño bakal menehi kinerja saben watt sing luwih apik tinimbang teknologi paling maju saiki. Laporan teknis rinci babagan kinerja bakal disajekake ing sasi-sasi sabanjure. Arsitektur iki nyuda perpindahan data lan nyeimbangake sumber daya komputasi, memori, lan jaringan kanggo nggayuh pemanfaatan nyata sing luwih cedhak karo puncak kinerja teoretis. Implementasi silikon lan teknologi jaringan Broadcom, kalebu silikon jaringan Tomahawk, mbantu nggawa platform iki menyang produksi skala gedhe.
“Donya lagi pindhah menyang ekonomi sing didhukung komputasi,” ujare Greg Brockman, Presiden lan Salah siji Pendiri OpenAI. “Jalapeño minangka bagean saka strategi infrastruktur full-stack jangka panjang kanggo nggawe komputasi luwih melimpah, supaya AI dadi luwih cepet, luwih andal, luwih terjangkau kanggo wong lan bisnis, lan bisa digunakake kanggo ngrampungi luwih akeh masalah penting. Kanthi ngrancang luwih akeh bagean saka stack dhewe, kita bisa nyedhiyakake luwih akeh kecerdasan kanthi efisiensi luwih gedhe lan terus nyurung AI canggih supaya luwih jembar aksesé.”
“Jalapeño dirancang saka dhasar kanggo inferensi LLM nganggo wawasan rinci saka kolaborasi cedhak karo peneliti OpenAI,” ujare Richard Ho, sing mimpin program hardware OpenAI. “Kita ngoptimalake arsitektur iki adhedhasar kernel, perpindahan memori, jaringan, lan pola panyajian sing paling penting kanggo model AI tercanggih. Adhedhasar uji awal, Jalapeño bakal nglakokake beban kerja paling penting kanthi efisien, cedhak karo wates teoretis hardware.”
“Kolaborasi kita karo OpenAI nggambarake komitmen dhasar kanggo nggedhekake infrastruktur fisik sing dibutuhake kanggo dasawarsa AI sabanjure,” ujare Hock Tan, Presiden lan CEO, Broadcom. “Iki mung wiwitan saka roadmap multi-generasi. Kanthi ngembangake bareng silikon unggulan industri langsung karo OpenAI, kita mbukak dalan kanggo gelaran pusat data skala gigawatt karo Microsoft lan mitra liyane wiwit taun 2026.”
Jalapeño iku desain saka kertas kosong kanggo inferensi LLM modern, dudu akselerator serbaguna sing diadaptasi saka beban kerja AI sadurunge. Desain iki dipandu dening sistem sing saben dina dioperasikake OpenAI ing ChatGPT, Codex, API, lan produk berbasis agen ing mangsa ngarep, sekaligus dirancang kanggo LLM saiki lan mangsa ngarep ing saindenging industri. Tujuane yaiku nggabungake daya lan kapasitas pangolahan akselerator AI unggulan saiki karo latensi sing luwih cedhak karo sistem inferensi khusus paling cepet, supaya Jalapeño cocog kanggo produk LLM interaktif ing skala gedhe.
Ya iku kaluwihan full-stack. OpenAI ora mung ngembangake model tercanggih utawa mbangun produk ing ndhuwure; OpenAI uga ngrancang infrastruktur ing sangisore: arsitektur chip, kernel, sistem memori, jaringan, penjadwalan, sistem gelaran, lan pengalaman produk. Amarga OpenAI makarya ing kabeh stack, saben lapisan bisa dioptimalake kanggo tujuan sing padha: nggawe model-modelé luwih cepet, luwih andal, lan luwih terjangkau kanggo pangguna.
Jalapeño nguwatake flywheel ing mburi kemajuan OpenAI. Infrastruktur sing luwih apik nyurung efisiensi komputasi. Efisiensi komputasi sing luwih gedhe ndadekake pelatihan lan panyajian luwih apik, sing pungkasane nguwatake model AI sing luwih mumpuni. Model sing luwih apik dadi produk sing luwih apik kanggo wong, pangembang, lan bisnis. Produk sing luwih apik nyurung panggunaan luwih akeh, pelanggan luwih akeh, lan pendapatan luwih gedhe, sing ngidini OpenAI nandur modal maneh ing infrastruktur generasi sabanjure. Suwe-suwe, siklus kasebut mbantu nggawe kecerdasan luwih mumpuni, luwih andal, lan luwih murah kanggo kabeh wong.
Jalapeño dikembangake bareng saka desain awal nganti tape-out manufaktur mung sajrone sangang sasi, lan program akselerator AI kustom iki nggambarake apa sing kita yakini minangka siklus pangembangan ASIC paling cepet sing tau digayuh ing semikonduktor canggih kinerja dhuwur. Kacepetan iki nuduhake ko-pangembangan software-hardware sing jero karo tim rekayasa OpenAI, keahlian implementasi silikon Broadcom, lan panggunaan model OpenAI kanggo nyepetake bagean saka proses desain lan optimisasi.
Model sing padha karo sing disajekake marang pangguna uga mbantu ningkatake infrastruktur sing digunakake kanggo nglakokake model mangsa ngarep. Yen AI bisa mbantu insinyur ngrancang chip sing luwih apik kanthi luwih cepet, AI bisa nyuda biaya komputasi ing saindenging industri lan mbantu demokratisasi akses menyang AI canggih.
Jalapeño minangka langkah kapisan ing platform komputasi multi-generasi sing dirancang kanggo gelaran awal ing pungkasan 2026 lan bakal dikembangake ing taun-taun sabanjure, nggabungake akselerator rancangan OpenAI karo implementasi silikon, jaringan, lan teknologi konektivitas Broadcom; uga keahlian board, rack, lan sistem saka Celestica.
Inti saka karya iki prasaja: inferensi iku papan AI tekan wong. Saben paningkatan ing biaya, kacepetan, lan keandalan bisa katon minangka wangsulan ChatGPT sing luwih cepet, tugas Codex sing bisa njupuk luwih akeh langkah kanthi wektu ngenteni luwih sithik, produk API sing luwih murah kanggo dibangun, utawa akses sing luwih bisa dipercaya nalika panjaluk dhuwur.
Demokratisasi AI tegese nggawe model canggih cukup kasedhiya, andal, lan terjangkau supaya luwih akeh wong bisa nggunakake saben dina. Jalapeño mbantu OpenAI ngowahi luwih akeh infrastrukturne dadi kecerdasan sing migunani kanggo siswa, pangembang, bisnis cilik, peneliti, perusahaan, lan sapa wae sing nyoba sinau, nggawe, utawa ngrampungi masalah angel.


