OpenAI dan Broadcom perkenal cip inferens yang dioptimumkan untuk LLM
- Ujian awal menunjukkan pemecut generasi pertama ini akan memberikan prestasi per watt yang jauh lebih baik berbanding teknologi tercanggih semasa
- Dibina dari asas untuk LLM semasa dan masa depan di seluruh industri
- Dibangunkan daripada reka bentuk hingga pengeluaran dalam sembilan bulan, dipercepat oleh model OpenAI
- Memperluas platform full-stack OpenAI, daripada produk kepada model dan kini kepada cip
- Akan dilaksanakan pada skala gigawatt bersama rakan kongsi pusat data, merentas beberapa generasi
OpenAI dan Broadcom (NASDAQ: AVGO) hari ini memperkenalkan Jalapeño, Pemproses Kecerdasan pertama OpenAI: pemecut yang direka bentuk berdasarkan visi OpenAI untuk masa depan inferens LLM, serta pemecut AI pertama dalam platform komputasi berbilang generasi yang sedang dibina bersama oleh kedua-dua syarikat untuk menjadikan AI canggih lebih pantas, lebih andal dan lebih mudah diakses oleh lebih ramai orang.

Jalapeño diserahkan kepada Ketua Pegawai Eksekutif OpenAI Sam Altman dan Presiden Greg Brockman oleh Presiden dan Ketua Pegawai Eksekutif Broadcom Hock Tan serta Presiden Charlie Kawwas, menandakan langkah penting dalam strategi OpenAI untuk membina keseluruhan stack di sebalik model dan produknya.
OpenAI mereka bentuk cip ini dari awal berdasarkan pemahaman mendalamnya tentang asas LLM, dipandu oleh hala tuju model, kernel, sistem penyajian dan keperluan produk, bersama rakan kongsi Broadcom dan Celestica, yang membantu mengindustrikan platform ini melalui pelaksanaan cip, penyepaduan papan, sistem rak, rangkaian berprestasi tinggi dan sistem pengeluaran berskala. Jalapeño direka bentuk dengan fleksibiliti untuk berfungsi dengan semua LLM, berpandukan cerapan OpenAI tentang keperluan inferens model AI semasa dan masa depan di seluruh industri. Sampel kejuruteraan cip Jalapeño sedang menjalankan beban kerja ML di makmal pada frekuensi dan kuasa sasaran pengeluaran, termasuk GPT‑5.3‑Codex‑Spark.
Walaupun OpenAI masih mengukur prestasi akhir, ujian awal menunjukkan Jalapeño akan memberikan prestasi per watt yang jauh lebih baik berbanding teknologi tercanggih semasa. Laporan teknikal terperinci tentang prestasi akan dibentangkan dalam beberapa bulan akan datang. Seni bina ini mengurangkan pergerakan data dan mengimbangi sumber komputasi, memori dan rangkaian untuk mencapai penggunaan sebenar yang jauh lebih hampir kepada prestasi puncak teorinya. Pelaksanaan silikon dan teknologi rangkaian Broadcom, termasuk silikon rangkaian Tomahawk, membantu membawa platform ini kepada pengeluaran berskala besar.
“Dunia sedang bergerak ke arah ekonomi yang dikuasakan komputasi,” kata Greg Brockman, Presiden dan Pengasas Bersama OpenAI. “Jalapeño ialah sebahagian daripada strategi infrastruktur full-stack jangka panjang kami untuk menjadikan komputasi lebih melimpah, menghasilkan AI yang lebih pantas, lebih andal, lebih mampu milik untuk orang ramai dan perniagaan, serta boleh digunakan untuk menyelesaikan lebih banyak masalah penting. Dengan mereka bentuk lebih banyak bahagian stack sendiri, kami dapat menyediakan lebih banyak kecerdasan dengan kecekapan lebih tinggi dan terus mendorong AI canggih ke arah akses yang lebih meluas.”
“Jalapeño direka bentuk dari asas untuk inferens LLM menggunakan cerapan terperinci daripada kerjasama rapat kami dengan penyelidik OpenAI,” kata Richard Ho, yang mengetuai program perkakasan OpenAI. “Kami mengoptimumkan seni bina ini berdasarkan kernel, pergerakan memori, rangkaian dan corak penyajian yang paling penting untuk model AI termaju. Berdasarkan ujian awal, Jalapeño akan menjalankan beban kerja terpenting kami dengan cekap, hampir kepada had teori perkakasan.”
“Kerjasama kami dengan OpenAI mencerminkan komitmen asas untuk menskalakan infrastruktur fizikal yang diperlukan bagi dekad AI yang seterusnya,” kata Hock Tan, Presiden dan Ketua Pegawai Eksekutif, Broadcom. “Ini hanyalah permulaan kepada hala tuju berbilang generasi. Dengan membangunkan bersama silikon peneraju industri kami secara langsung dengan OpenAI, kami membolehkan pelaksanaan pusat data berskala gigawatt dengan Microsoft dan rakan kongsi lain bermula pada 2026.”
Jalapeño ialah reka bentuk bermula dari kosong untuk inferens LLM moden, bukan pemecut serba guna yang diadaptasi daripada beban kerja AI terdahulu. Ia dipandu oleh sistem yang dijalankan OpenAI setiap hari merentas ChatGPT, Codex, API dan produk agen masa depan, sambil turut direka bentuk untuk LLM semasa dan masa depan di seluruh industri. Matlamatnya adalah menggabungkan kuasa dan daya pemprosesan pemecut AI terkemuka hari ini dengan kependaman yang lebih hampir kepada sistem inferens khusus terpantas, menjadikan Jalapeño sangat sesuai untuk produk LLM interaktif pada skala besar.
Itulah kelebihan full-stack. OpenAI bukan sahaja membangunkan model termaju atau membina produk di atasnya; OpenAI mereka bentuk infrastruktur di bawahnya: seni bina cip, kernel, sistem memori, rangkaian, penjadualan, sistem pelaksanaan dan pengalaman produk. Oleh sebab OpenAI beroperasi merentas keseluruhan stack, setiap lapisan boleh dioptimumkan untuk matlamat yang sama: menjadikan modelnya lebih pantas, lebih andal dan lebih mampu milik untuk pengguna.
Jalapeño mengukuhkan kitaran penggerak di sebalik kemajuan OpenAI. Infrastruktur yang lebih baik memacu kecekapan komputasi. Kecekapan komputasi yang lebih tinggi membolehkan latihan dan penyajian yang lebih baik, sekali gus menggerakkan model AI yang lebih berkeupayaan. Model yang lebih baik menjadi produk yang lebih baik untuk orang ramai, pembangun dan perniagaan. Produk yang lebih baik mendorong lebih banyak penggunaan, lebih ramai pelanggan dan lebih banyak hasil, yang membolehkan OpenAI melabur semula dalam infrastruktur generasi seterusnya. Dari masa ke masa, kitaran itu membantu menjadikan kecerdasan lebih berkeupayaan, lebih andal dan lebih murah untuk semua orang.
Jalapeño dibangunkan bersama daripada reka bentuk awal hingga tape-out pembuatan dalam hanya sembilan bulan, dan program pemecut AI tersuai ini mewakili apa yang kami percaya sebagai kitaran pembangunan ASIC terpantas yang pernah dicapai dalam semikonduktor canggih berprestasi tinggi. Kelajuan itu mencerminkan pembangunan bersama perisian-perkakasan yang mendalam dengan pasukan kejuruteraan OpenAI, kepakaran pelaksanaan silikon Broadcom, serta penggunaan model OpenAI untuk mempercepat sebahagian proses reka bentuk dan pengoptimuman.
Model yang sama yang disediakan kepada pengguna turut membantu menambah baik infrastruktur yang digunakan untuk menjalankan model masa depan. Jika AI dapat membantu jurutera mereka bentuk cip yang lebih baik dengan lebih pantas, ia boleh menurunkan kos komputasi di seluruh industri dan membantu mendemokrasikan akses kepada AI canggih.
Jalapeño ialah langkah pertama dalam platform komputasi berbilang generasi yang direka untuk pelaksanaan awal menjelang akhir 2026 dan pengembangan pada tahun-tahun berikutnya, menggabungkan pemecut yang direka oleh OpenAI dengan pelaksanaan silikon, rangkaian dan teknologi kesambungan Broadcom; serta kepakaran papan, rak dan sistem Celestica.
Tujuan kerja ini mudah: inferens ialah tempat AI sampai kepada manusia. Setiap peningkatan dalam kos, kelajuan dan kebolehpercayaan boleh muncul sebagai jawapan ChatGPT yang lebih pantas, tugas Codex yang boleh mengambil lebih banyak langkah dengan kurang menunggu, produk API yang lebih murah untuk dibina, atau akses yang lebih boleh diharap apabila permintaan tinggi.
Mendemokrasikan AI bermakna menjadikan model canggih cukup tersedia, boleh diharap dan mampu milik untuk digunakan oleh lebih ramai orang setiap hari. Jalapeño membantu OpenAI menukar lebih banyak infrastrukturnya menjadi kecerdasan berguna untuk pelajar, pembangun, perniagaan kecil, penyelidik, perusahaan dan sesiapa sahaja yang ingin belajar, mencipta atau menyelesaikan masalah sukar.


