Přeskoč na hlavní obsah
OpenAI

24. června 2026

Společnost

OpenAI a Broadcom uvádějí inferenční čip optimalizovaný pro LLM

Načítání…
  • První testy ukazují, že akcelerátor první generace nabídne výrazně lepší výkon na watt než dnešní špička
  • Od základu navržený pro současné i budoucí LLM v celém odvětví
  • Vyvinutý od návrhu po výrobu za devět měsíců s využitím modelů OpenAI
  • Rozšiřuje full-stack platformu OpenAI od produktů přes modely až po čipy
  • Bude nasazován v gigawattovém měřítku s partnery pro datová centra napříč generacemi

OpenAI a Broadcom (NASDAQ: AVGO) dnes představily Jalapeño, první Intelligence Processor společnosti OpenAI: akcelerátor navržený podle vize OpenAI pro budoucnost inference LLM a první AI akcelerátor ve vícegenerační výpočetní platformě, kterou firmy společně budují, aby byla pokročilá AI rychlejší, spolehlivější a dostupnější více lidem.

Lídři OpenAI a Broadcomu ukazují inferenční čip Jalapeño.

Hock Tan, prezident a CEO Broadcomu, a Charlie Kawwas, prezident Broadcomu, předali Jalapeño Samu Altmanovi, CEO OpenAI, a Gregu Brockmanovi, prezidentu OpenAI. Jde o důležitý krok ve strategii OpenAI vybudovat celý stack za svými modely a produkty.

OpenAI navrhla čip od nuly podle hlubokého porozumění základům LLM a s ohledem na roadmapu modelů, kernelů, systémů obsluhy i produktových potřeb. Partneři Broadcom a Celestica pomáhají platformu industrializovat implementací čipu, deskami, integrací rackových systémů, výkonnými sítěmi a škálovatelnou výrobou. Jalapeño je navrženo flexibilně pro práci se všemi LLM a vychází z poznatků OpenAI o potřebách inference současných i budoucích AI modelů napříč odvětvím. Technické vzorky čipu Jalapeño běží v laboratoři s ML úlohami, včetně GPT‑5.3‑Codex‑Spark, s cílovou výrobní frekvencí a spotřebou.

Finální výkon OpenAI teprve měří, ale první testy ukazují, že Jalapeño nabídne výrazně lepší výkon na watt než dnešní špička. Podrobná technická zpráva o výkonu bude představena v nadcházejících měsících. Architektura omezuje přesuny dat a vyvažuje výpočetní, paměťové i síťové zdroje, aby se reálné využití mnohem více blížilo teoretickému špičkovému výkonu. K velkosériové výrobě platformy přispívají implementace křemíku a síťové technologie Broadcomu, včetně síťového křemíku Tomahawk.

„Svět směřuje k ekonomice poháněné výpočetním výkonem,“ řekl Greg Brockman, prezident a spoluzakladatel OpenAI. „Jalapeño je součástí naší dlouhodobé full-stack infrastrukturní strategie, která má rozšířit dostupný výpočetní výkon a přinést AI rychlejší, spolehlivější a dostupnější lidem i firmám, aby mohla řešit důležitější problémy. Když si větší část stacku navrhujeme sami, dokážeme poskytovat více inteligence efektivněji a dál rozšiřovat přístup k pokročilé AI.“

„Jalapeño bylo od základu navrženo pro inferenci LLM na základě detailních poznatků z úzké spolupráce s výzkumníky OpenAI,“ řekl Richard Ho, který vede hardwarový program OpenAI. „Architekturu jsme optimalizovali pro kernely, přesuny v paměti, sítě a vzorce obsluhy, které jsou pro hraniční AI modely nejdůležitější. Podle prvních testů bude Jalapeño efektivně vykonávat naše nejdůležitější zátěže blízko teoretickým limitům hardwaru.“

„Naše spolupráce s OpenAI je zásadním závazkem škálovat fyzickou infrastrukturu potřebnou pro příští dekádu AI,“ řekl Hock Tan, prezident a CEO společnosti Broadcom. „Je to teprve začátek vícegenerační roadmapy. Společným vývojem špičkového křemíku přímo s OpenAI umožňujeme nasazování datových center v měřítku gigawattů s Microsoftem a dalšími partnery od roku 2026.“

Jalapeño je zcela nový návrh pro moderní inferenci LLM, nikoli univerzální akcelerátor upravený ze starších úloh AI. Vychází ze systémů, které OpenAI denně provozuje v ChatGPT, Codexu, API a budoucích agentních produktech, a zároveň je navržen pro současné i budoucí LLM napříč odvětvím. Cílem je spojit výkon a výkonovou propustnost dnešních předních AI akcelerátorů s latencí blízkou nejrychlejším specializovaným inferenčním systémům, takže Jalapeño dobře vyhovuje interaktivním LLM produktům ve velkém měřítku.

V tom je výhoda full-stack přístupu. OpenAI nevyvíjí jen hraniční modely ani na nich pouze nestaví produkty; navrhuje také infrastrukturu pod nimi: architekturu čipů, kernely, paměťové systémy, sítě, plánování, systémy nasazení a produktovou zkušenost. Protože OpenAI působí napříč stackem, lze každou vrstvu optimalizovat ke stejnému cíli: aby její modely byly pro uživatele rychlejší, spolehlivější a levnější.

Jalapeño posiluje setrvačník pokroku OpenAI. Lepší infrastruktura zvyšuje efektivitu výpočetního výkonu. Vyšší efektivita výpočetního výkonu umožňuje lepší trénování a obsluhu, což nakonec pohání schopnější AI modely. Lepší modely se mění v lepší produkty pro lidi, vývojáře a firmy. Lepší produkty přinášejí větší využití, více zákazníků a vyšší tržby, což OpenAI umožňuje reinvestovat do další generace infrastruktury. Časem tento cyklus pomáhá dělat inteligenci schopnější, spolehlivější a levnější pro všechny.

Tape-out za devět měsíců díky modelům OpenAI

Jalapeño bylo společně vyvinuto od prvního návrhu po výrobní tape-out za pouhých devět měsíců. Program zakázkového AI akcelerátoru podle nás představuje nejrychlejší vývojový cyklus ASIC, jakého kdy bylo u výkonných pokročilých polovodičů dosaženo. Tato rychlost odráží hluboký společný vývoj softwaru a hardwaru s inženýrskými týmy OpenAI, expertizu Broadcomu v implementaci křemíku a využití modelů OpenAI k urychlení částí návrhu a optimalizace.

Ty samé modely, které slouží uživatelům, pomáhají zlepšovat infrastrukturu pro provoz budoucích modelů. Pokud AI pomůže inženýrům navrhovat lepší čipy rychleji, může snížit náklady na výpočetní výkon v celém odvětví a demokratizovat přístup k pokročilé AI.

Budování vícegenerační platformy s partnery

Jalapeño je prvním krokem ve vícegenerační výpočetní platformě, určené k prvnímu nasazení do konce roku 2026 a k rozšiřování v dalších letech. Spojuje akcelerátory navržené OpenAI s implementací křemíku, síťovými a konektivními technologiemi Broadcomu a expertizou Celesticy v deskách, rackových a systémových řešeních.

Zpřístupnění pokročilé AI širšímu okruhu lidí

Smysl této práce je prostý: právě prostřednictvím inferencí se AI dostává k lidem. Každé zlepšení nákladů, rychlosti a spolehlivosti se může projevit jako rychlejší odpověď ChatGPT, úloha v Codexu s více kroky a kratším čekáním, levnější vývoj API produktu nebo spolehlivější přístup při vysoké poptávce.

Demokratizovat AI znamená zpřístupnit pokročilé modely tak, aby byly dostatečně dostupné, spolehlivé a cenově přijatelné pro každodenní použití více lidmi. Jalapeño pomáhá OpenAI proměnit větší část infrastruktury v užitečnou inteligenci pro studenty, vývojáře, malé firmy, výzkumníky, podniky i kohokoli, kdo se chce učit, tvořit nebo řešit těžké problémy.

Autor

OpenAI