Langsung ke konten utama
OpenAI

24 Juni 2026

Perusahaan

OpenAI dan Broadcom memperkenalkan chip inferensi yang dioptimalkan untuk LLM

Memuat…
  • Pengujian awal menunjukkan akselerator generasi pertama ini akan memberikan kinerja per watt yang jauh lebih baik daripada teknologi tercanggih saat ini
  • Dibangun dari awal untuk LLM masa kini dan masa depan di seluruh industri
  • Dikembangkan dari desain hingga produksi dalam sembilan bulan, dipercepat oleh model OpenAI
  • Memperluas platform full-stack OpenAI, dari produk ke model dan kini ke chip
  • Akan diterapkan pada skala gigawatt bersama mitra pusat data, dalam beberapa generasi

OpenAI dan Broadcom (NASDAQ: AVGO) hari ini memperkenalkan Jalapeño, Intelligence Processor pertama OpenAI: akselerator yang dirancang berdasarkan visi OpenAI untuk masa depan inferensi LLM, sekaligus akselerator AI pertama dalam platform komputasi multigenerasi yang dibangun bersama oleh kedua perusahaan untuk menjadikan AI canggih lebih cepat, lebih andal, dan lebih mudah diakses lebih banyak orang.

Para pemimpin OpenAI dan Broadcom menampilkan chip inferensi Jalapeño.

Jalapeño diserahkan kepada CEO OpenAI Sam Altman dan Presiden Greg Brockman oleh Presiden sekaligus CEO Broadcom Hock Tan dan Presiden Charlie Kawwas, menandai langkah penting dalam strategi OpenAI untuk membangun full stack di balik model dan produknya.

OpenAI merancang chip ini dari nol berdasarkan pemahamannya yang mendalam tentang dasar-dasar LLM, dipandu oleh peta jalan model, kernel, sistem penyajian, dan kebutuhan produknya, bersama mitra Broadcom dan Celestica, yang membantu mengindustrialisasi platform melalui implementasi chip, integrasi board dan sistem rack, jaringan berkinerja tinggi, serta sistem produksi yang dapat diskalakan. Jalapeño dirancang fleksibel agar dapat bekerja dengan semua LLM, berpedoman pada wawasan OpenAI tentang kebutuhan inferensi model AI masa kini dan masa depan di seluruh industri. Sampel rekayasa chip Jalapeño menjalankan beban kerja ML di laboratorium pada frekuensi dan daya target produksi, termasuk GPT‑5.3‑Codex‑Spark.

Meski OpenAI masih mengukur kinerja akhir, pengujian awal menunjukkan Jalapeño akan memberikan kinerja per watt yang jauh lebih baik daripada teknologi tercanggih saat ini. Laporan teknis terperinci tentang kinerja akan dipresentasikan dalam beberapa bulan mendatang. Arsitektur ini mengurangi perpindahan data dan menyeimbangkan sumber daya komputasi, memori, dan jaringan untuk mencapai utilisasi nyata yang jauh lebih mendekati kinerja puncak teoretis. Implementasi silikon dan teknologi jaringan Broadcom, termasuk silikon jaringan Tomahawk, membantu membawa platform ini ke produksi berskala besar.

“Dunia sedang bergerak menuju ekonomi yang ditenagai komputasi,” kata Greg Brockman, Presiden dan Co-Founder OpenAI. “Jalapeño adalah bagian dari strategi infrastruktur full-stack jangka panjang kami untuk membuat komputasi lebih melimpah, menghasilkan AI yang lebih cepat, lebih andal, lebih terjangkau bagi masyarakat dan bisnis, serta dapat digunakan untuk memecahkan lebih banyak masalah penting. Dengan merancang lebih banyak bagian stack sendiri, kami dapat menyajikan lebih banyak kecerdasan dengan efisiensi lebih tinggi dan terus mendorong AI canggih agar dapat diakses lebih luas.”

“Jalapeño dirancang dari awal untuk inferensi LLM dengan menggunakan wawasan terperinci dari kolaborasi erat kami dengan para peneliti OpenAI,” kata Richard Ho, yang memimpin program perangkat keras OpenAI. “Kami mengoptimalkan arsitektur berdasarkan kernel, perpindahan memori, jaringan, dan pola penyajian yang paling penting bagi model AI frontier. Berdasarkan pengujian awal, Jalapeño akan menjalankan beban kerja terpenting kami secara efisien, mendekati batas teoretis perangkat keras.”

“Kolaborasi kami dengan OpenAI mencerminkan komitmen mendasar untuk menskalakan infrastruktur fisik yang dibutuhkan bagi satu dekade AI berikutnya,” kata Hock Tan, Presiden dan CEO Broadcom. “Ini baru awal dari peta jalan multigenerasi. Dengan mengembangkan bersama silikon terdepan di industri kami secara langsung dengan OpenAI, kami memungkinkan penerapan pusat data berskala gigawatt bersama Microsoft dan mitra lainnya mulai 2026.”

Dirancang menjadi platform inferensi terbaik untuk LLM

Jalapeño adalah desain dari nol untuk inferensi LLM modern, bukan akselerator serbaguna yang diadaptasi dari beban kerja AI sebelumnya. Desain ini dipandu oleh sistem yang dijalankan OpenAI setiap hari di ChatGPT, Codex, API, dan produk agen masa depan, sekaligus dirancang untuk LLM masa kini dan masa depan di seluruh industri. Tujuannya adalah menggabungkan daya dan throughput akselerator AI terdepan saat ini dengan latensi yang lebih mendekati sistem inferensi khusus tercepat, sehingga Jalapeño sangat cocok untuk produk LLM interaktif dalam skala besar.

Itulah keunggulan full-stack. OpenAI tidak hanya mengembangkan model frontier atau membangun produk di atasnya; OpenAI juga merancang infrastruktur di bawahnya: arsitektur chip, kernel, sistem memori, jaringan, penjadwalan, sistem penerapan, dan pengalaman produk. Karena OpenAI beroperasi di seluruh stack, setiap lapisan dapat dioptimalkan untuk tujuan yang sama: membuat modelnya lebih cepat, lebih andal, dan lebih terjangkau bagi pengguna.

Jalapeño memperkuat roda penggerak di balik kemajuan OpenAI. Infrastruktur yang lebih baik mendorong efisiensi komputasi. Efisiensi komputasi yang lebih tinggi memungkinkan pelatihan dan penyajian yang lebih baik, yang pada akhirnya mendukung model AI yang lebih mumpuni. Model yang lebih baik menjadi produk yang lebih baik bagi masyarakat, pengembang, dan bisnis. Produk yang lebih baik mendorong penggunaan, pelanggan, dan pendapatan yang lebih besar, sehingga OpenAI dapat berinvestasi kembali pada infrastruktur generasi berikutnya. Seiring waktu, siklus itu membantu menjadikan kecerdasan lebih mumpuni, lebih andal, dan lebih murah bagi semua orang.

Tape-out sembilan bulan, dipercepat oleh model OpenAI

Jalapeño dikembangkan bersama dari desain awal hingga tape-out manufaktur hanya dalam sembilan bulan, dan program akselerator AI khusus ini mewakili apa yang kami yakini sebagai siklus pengembangan ASIC tercepat yang pernah dicapai dalam semikonduktor canggih berkinerja tinggi. Kecepatan itu mencerminkan pengembangan bersama perangkat lunak dan perangkat keras yang mendalam dengan tim rekayasa OpenAI, keahlian implementasi silikon Broadcom, serta penggunaan model OpenAI untuk mempercepat sebagian proses desain dan optimasi.

Model yang sama yang disajikan kepada pengguna membantu meningkatkan infrastruktur yang digunakan untuk menjalankan model masa depan. Jika AI dapat membantu para insinyur merancang chip yang lebih baik dengan lebih cepat, AI dapat menurunkan biaya komputasi di seluruh industri dan membantu memeratakan akses ke AI canggih.

Membangun platform multigenerasi bersama mitra

Jalapeño adalah langkah pertama dalam platform komputasi multigenerasi yang dirancang untuk penerapan awal pada akhir 2026 dan akan diperluas pada tahun-tahun berikutnya, menggabungkan akselerator rancangan OpenAI dengan implementasi silikon, jaringan, dan teknologi konektivitas Broadcom; serta keahlian board, rack, dan sistem dari Celestica.

Membuat AI canggih tersedia lebih luas

Inti dari pekerjaan ini sederhana: inferensi adalah tempat AI menjangkau manusia. Setiap peningkatan biaya, kecepatan, dan keandalan dapat terasa sebagai jawaban ChatGPT yang lebih cepat, tugas Codex yang dapat mengambil lebih banyak langkah dengan waktu tunggu lebih singkat, produk API yang lebih murah untuk dibangun, atau akses yang lebih andal saat permintaan tinggi.

Memeratakan akses AI berarti membuat model canggih cukup tersedia, andal, dan terjangkau agar dapat digunakan lebih banyak orang setiap hari. Jalapeño membantu OpenAI mengubah lebih banyak infrastrukturnya menjadi kecerdasan yang berguna bagi pelajar, pengembang, usaha kecil, peneliti, perusahaan, dan siapa pun yang ingin belajar, berkreasi, atau memecahkan masalah sulit.

Penulis

OpenAI