Lumaktaw sa pangunahing content
OpenAI

Hunyo 24, 2026

Kumpanya

OpenAI at Broadcom, inilunsad ang LLM-optimized inference chip

Naglo-load…
  • Ipinapakita ng maagang pagsubok na ang unang henerasyong accelerator ay maghahatid ng performance kada watt na higit na mas mahusay kaysa sa kasalukuyang pinakabagong teknolohiya
  • Binuo mula sa simula para sa kasalukuyan at hinaharap na mga LLM sa buong industriya
  • Nadebelop mula disenyo hanggang produksyon sa loob ng siyam na buwan, pinabilis ng mga modelo ng OpenAI
  • Pinalalawak ang full-stack platform ng OpenAI, mula sa mga produkto hanggang sa mga modelo at ngayon ay sa mga chip
  • Ide-deploy sa gigawatt scale kasama ang mga partner sa data center, sa maraming henerasyon

Ipinakilala ngayon ng OpenAI at Broadcom (NASDAQ: AVGO) ang Jalapeño, ang unang Intelligence Processor ng OpenAI: isang accelerator na inarkitekto ayon sa pananaw ng OpenAI para sa hinaharap ng LLM inference, at ang unang AI accelerator sa isang multi-generation compute platform na magkasamang binubuo ng mga kumpanya upang gawing mas mabilis, mas maaasahan, at mas naaabot ng mas maraming tao ang advanced AI.

Ipinapakita ng mga lider ng OpenAI at Broadcom ang Jalapeño inference chip.

Ibinigay ang Jalapeño kay OpenAI CEO Sam Altman at President Greg Brockman nina Broadcom President at CEO Hock Tan at President Charlie Kawwas, na nagmarka ng mahalagang hakbang sa estratehiya ng OpenAI na buuin ang buong stack sa likod ng mga modelo at produkto nito.

Dinisenyo ng OpenAI ang chip mula sa simula batay sa malalim nitong pag-unawa sa mga pundasyon ng LLM, na hinubog ng roadmap nito para sa mga modelo, kernel, serving system, at pangangailangan ng produkto, kasama ang mga partner na Broadcom at Celestica, na tumutulong gawing industriyalisado ang platform sa pamamagitan ng chip implementation, board, rack system integration, high-performance networking, at scalable production systems. Idinisenyo ang Jalapeño nang may flexibility upang gumana sa lahat ng LLM, gabay ang mga insight ng OpenAI sa mga pangangailangan sa inference ng kasalukuyan at hinaharap na mga AI modelo sa buong industriya. Ang mga engineering sample ng Jalapeño chip ay nagpapatakbo ng mga ML workload sa lab sa target frequency at power para sa produksyon, kabilang ang GPT‑5.3‑Codex‑Spark.

Habang sinusukat pa ng OpenAI ang pinal na performance, ipinapakita ng maagang pagsubok na maghahatid ang Jalapeño ng performance kada watt na higit na mas mahusay kaysa sa kasalukuyang pinakabagong teknolohiya. Ilalahad sa mga darating na buwan ang detalyadong teknikal na ulat tungkol sa performance. Binabawasan ng arkitektura ang paggalaw ng data at binabalanse ang mga resource sa compute, memory, at networking upang makamit ang realized utilization na mas malapit sa teoretikal na peak performance. Tumutulong ang silicon implementation at networking technologies ng Broadcom, kabilang ang Tomahawk networking silicon, na dalhin ang platform sa large-scale production.

“Lumilipat ang mundo sa isang ekonomiyang pinapagana ng compute,” sabi ni Greg Brockman, President at Co-Founder ng OpenAI. “Bahagi ang Jalapeño ng aming pangmatagalang full-stack infrastructure strategy upang gawing mas sagana ang compute, na magreresulta sa AI na mas mabilis, mas maaasahan, mas abot-kaya para sa mga tao at negosyo, at magagamit upang lutasin ang mas mahahalagang problema. Sa pagdidisenyo namin mismo ng mas malaking bahagi ng stack, makapaghahatid kami ng mas maraming intelligence nang mas mahusay at maipagpapatuloy ang pagtulak sa advanced AI tungo sa mas malawak na access.”

“Idinisenyo ang Jalapeño mula sa simula para sa LLM inference gamit ang detalyadong mga insight mula sa malapit naming pakikipagtulungan sa mga researcher ng OpenAI,” sabi ni Richard Ho, na namumuno sa hardware program ng OpenAI. “In-optimize namin ang arkitektura batay sa mga kernel, paggalaw ng memory, networking, at serving pattern na pinakamahalaga para sa mga frontier AI modelo. Batay sa maagang pagsubok, mahusay na mapapatakbo ng Jalapeño ang aming pinakamahahalagang workload nang malapit sa mga teoretikal na limitasyon ng hardware.”

“Ang pakikipagtulungan namin sa OpenAI ay kumakatawan sa pundamental na pangako sa pagpapalawak ng pisikal na imprastrakturang kailangan para sa susunod na dekada ng AI,” sabi ni Hock Tan, President at CEO, Broadcom. “Simula pa lamang ito ng isang multi-generation roadmap. Sa direktang pakikipag-co-develop ng aming nangunguna-sa-industriyang silicon sa OpenAI, pinapagana namin ang deployment ng mga data center sa gigawatt scale kasama ang Microsoft at iba pang partner simula sa 2026.”

Dinisenyo upang maging pinakamahusay na inference platform para sa mga LLM

Ang Jalapeño ay isang blank-slate na disenyo para sa modernong LLM inference, hindi isang general-purpose accelerator na inangkop mula sa mas naunang mga AI workload. Hinubog ito ng mga system na araw-araw na pinapatakbo ng OpenAI sa ChatGPT, Codex, API, at mga produktong agentic sa hinaharap, habang idinidisenyo rin para sa kasalukuyan at hinaharap na mga LLM sa buong industriya. Layunin nitong pagsamahin ang lakas at throughput ng nangungunang AI accelerators ngayon sa latency na mas malapit sa pinakamabibilis na specialized inference systems, kaya ang Jalapeño ay angkop para sa interactive na mga produktong LLM sa malakihang paggamit.

Iyan ang bentahe ng full stack. Hindi lamang nagdedebelop ang OpenAI ng mga frontier na modelo o bumubuo ng mga produkto sa ibabaw ng mga ito; dinidisenyo rin nito ang imprastrakturang nasa ilalim ng mga ito: chip architecture, kernels, memory systems, networking, scheduling, deployment systems, at product experience. Dahil gumagana ang OpenAI sa buong stack, maaaring i-optimize ang bawat layer tungo sa iisang layunin: gawing mas mabilis, mas maaasahan, at mas abot-kaya para sa mga user ang mga modelo nito.

Pinapalakas ng Jalapeño ang flywheel sa likod ng pag-usad ng OpenAI. Ang mas mahusay na imprastraktura ay nagtutulak ng compute efficiency. Ang mas mataas na compute efficiency ay nagbibigay-daan sa mas mahusay na training at serving, na sa huli ay nagpapatakbo ng mas may-kakayahang mga AI modelo. Ang mas mahuhusay na modelo ay nagiging mas magagandang produkto para sa mga tao, developer, at negosyo. Ang mas magagandang produkto ay nagdudulot ng mas maraming paggamit, mas maraming customer, at mas malaking kita, na nagbibigay-daan sa OpenAI na muling mamuhunan sa susunod na henerasyon ng imprastraktura. Sa paglipas ng panahon, nakatutulong ang siklong iyon na gawing mas may kakayahan, mas maaasahan, at mas mura para sa lahat ang intelligence.

Siyam na buwang tape-out, pinabilis ng mga modelo ng OpenAI

Magkasamang dinebelop ang Jalapeño mula paunang disenyo hanggang manufacturing tape-out sa loob lamang ng siyam na buwan, at ang custom AI accelerator program ay kumakatawan sa pinaniniwalaan naming pinakamabilis na ASIC development cycle na kailanman nakamit sa high-performance advanced semiconductors. Ipinapakita ng bilis na iyon ang malalim na software-hardware co-development kasama ang mga engineering team ng OpenAI, ang kadalubhasaan ng Broadcom sa silicon implementation, at ang paggamit ng mga modelo ng OpenAI upang pabilisin ang ilang bahagi ng proseso ng disenyo at optimization.

Ang parehong mga modelo na inihahatid sa mga user ay tumutulong na mapahusay ang imprastrakturang gagamitin upang patakbuhin ang mga modelo sa hinaharap. Kung matutulungan ng AI ang mga engineer na magdisenyo ng mas mahuhusay na chip nang mas mabilis, mapapababa nito ang halaga ng compute sa buong industriya at makatutulong na gawing mas demokratiko ang access sa advanced AI.

Bumubuo ng multi-generation na platform kasama ang mga partner

Ang Jalapeño ang unang hakbang sa isang multi-generation compute platform na idinisenyo para sa paunang deployment sa pagtatapos ng 2026 at palalawakin sa mga susunod na taon, pinagsasama ang mga accelerator na dinisenyo ng OpenAI sa silicon implementation, networking, at connectivity technologies ng Broadcom; at ang kadalubhasaan ng Celestica sa board, rack, at system.

Ginagawang mas malawak na available ang advanced AI

Simple ang punto ng gawaing ito: sa inference naaabot ng AI ang mga tao. Ang bawat pagpapahusay sa gastos, bilis, at pagiging maaasahan ay maaaring lumabas bilang mas mabilis na sagot ng ChatGPT, isang task sa Codex na makagagawa ng mas maraming hakbang nang mas kaunti ang paghihintay, isang API product na mas murang buuin, o mas maaasahang access kapag mataas ang demand.

Ang pagdemokratisa ng AI ay nangangahulugang gawing available, maaasahan, at sapat na abot-kaya ang mga advanced na modelo para magamit araw-araw ng mas maraming tao. Tinutulungan ng Jalapeño ang OpenAI na gawing kapaki-pakinabang na intelligence ang mas malaking bahagi ng imprastraktura nito para sa mga estudyante, developer, maliliit na negosyo, researcher, enterprise, at sinumang nagsisikap matuto, lumikha, o lumutas ng mahihirap na problema.

May-akda

OpenAI