OpenAI і Broadcom представили LLM-оптимізований чип інференсу
- Перші випробування показують, що прискорювач першого покоління забезпечить значно кращу продуктивність на ват, ніж нинішні передові рішення
- Створений із нуля для нинішніх і майбутніх LLM у всій галузі
- Розроблений від проєктування до виробництва за дев’ять місяців за допомогою моделей OpenAI
- Розширює повностекову платформу OpenAI — від продуктів до моделей, а тепер і до чипів
- Буде розгортатися в гігаватному масштабі з партнерами з дата-центрів у кількох поколіннях
OpenAI і Broadcom (NASDAQ: AVGO) сьогодні представили Jalapeño — перший Intelligence Processor від OpenAI: прискорювач, спроєктований відповідно до бачення OpenAI майбутнього інференсу LLM, а також перший ШІ-прискорювач у обчислювальній платформі, розрахованої на кілька поколінь, яку компанії спільно будують, щоб зробити передовий ШІ швидшим, надійнішим і доступнішим для більшої кількості людей.

Президент і генеральний директор Broadcom Хок Тан, а також президент компанії Чарлі Кавасс офіційно передали Jalapeño генеральному директору OpenAI Сему Альтману та президенту компанії Грегу Брокману. Ця подія стала важливим кроком у реалізації стратегії OpenAI зі створення повного технологічного стеку для своїх моделей і продуктів.
OpenAI спроєктувала чип із нуля, спираючись на глибоке розуміння основ LLM і враховуючи свій план розвитку моделей, ядер, систем обслуговування, а також потреб продуктів. Партнери Broadcom і Celestica допомогли індустріалізувати платформу завдяки впровадженню чипа, інтеграції плат, стійкових систем, високопродуктивних мереж і масштабованих виробничих систем. Jalapeño спроєктований гнучким для роботи з усіма LLM з урахуванням висновків OpenAI щодо потреб інференсу нинішніх і майбутніх ШІ-моделей у всій галузі. Інженерні зразки чипа Jalapeño вже виконують ML-навантаження в лабораторії на цільових для виробництва частоті й потужності, зокрема GPT‑5.3‑Codex‑Spark.
Хоча OpenAI ще вимірює остаточну продуктивність, перші випробування показують, що Jalapeño забезпечить значно кращу продуктивність на ват, ніж нинішні передові рішення. Докладний технічний звіт про продуктивність буде представлено в найближчі місяці. Архітектура чипа мінімізує обсяг передавання даних і забезпечує збалансоване використання обчислювальних ресурсів, пам'яті та мережевих ресурсів, завдяки чому фактична ефективність їх використання значно наближається до теоретичної пікової продуктивності. Технології Broadcom у сфері розроблення мікросхем і мережевих рішень, зокрема мережеві мікросхеми сімейства Tomahawk, сприяють масштабному виробництву цієї платформи.
«Світ переходить до економіки, що працює на обчислювальних потужностях», — сказав Грег Брокман, президент і співзасновник OpenAI. «Jalapeño є частиною нашої довгострокової стратегії зі створення повної технологічної інфраструктури, спрямованої на збільшення доступності обчислювальних потужностей. У результаті ШІ стане швидшим, надійнішим і доступнішим за ціною для людей і бізнесу та зможе допомагати розв’язувати важливіші проблеми. Розробляючи дедалі більше компонентів цієї інфраструктури власними силами, ми можемо ефективніше масштабувати обчислення для ШІ та й надалі робити передові технології штучного інтелекту доступнішими для ширшого кола користувачів».
«Jalapeño було спроєктовано з нуля для інференсу LLM на основі докладних висновків із нашої тісної співпраці з дослідниками OpenAI», — сказав Річард Хо, який очолює програму OpenAI з розроблення апаратного забезпечення. «Ми оптимізували архітектуру з урахуванням обчислювальних ядер, переміщення пам’яті, мережевих взаємодій і патернів обслуговування, що є найважливішими для передових моделей ШІ. За результатами перших випробувань, Jalapeño ефективно виконуватиме наші найважливіші навантаження близько до теоретичних меж можливостей апаратного забезпечення».
«Наша співпраця з OpenAI — це фундаментальне зобов’язання масштабувати фізичну інфраструктуру, необхідну для розвитку ШІ впродовж наступного десятиліття», — сказав Хок Тан, президент і генеральний директор Broadcom. «Це лише початок плану розвитку, розрахованого на кілька поколінь технологій. Спільно з OpenAI ми розробляємо наші провідні в галузі мікросхеми, що дасть змогу вже з 2026 року розгортати дата-центри гігаватного масштабу разом із Microsoft та іншими партнерами».
Jalapeño — це проєкт із чистого аркуша для сучасного інференсу LLM, а не універсальний прискорювач, адаптований із попередніх ШІ-навантажень. Його створено з урахуванням систем, які OpenAI щодня запускає в ChatGPT, Codex, API та майбутніх агентних продуктах, і водночас спроєктовано для нинішніх і майбутніх LLM у всій галузі. Мета — поєднати потужність і пропускну здатність провідних сучасних ШІ-прискорювачів із затримкою, ближчою до найшвидших спеціалізованих систем інференсу, завдяки чому Jalapeño добре підходить для масштабного розгортання інтерактивних LLM-продуктів.
У цьому й полягає перевага повного стеку. OpenAI не лише розробляє передові моделі чи будує продукти на їх основі, а й проєктує інфраструктуру, на якій вони працюють: архітектуру чипів, ядра, системи пам’яті, мережі, планування, системи розгортання та користувацький досвід. Оскільки OpenAI працює на всіх рівнях стеку, кожен рівень можна оптимізувати навколо однієї мети: зробити моделі швидшими, надійнішими й доступнішими за ціною для користувачів.
Jalapeño посилює цикл безперервного розвитку OpenAI. Краща інфраструктура підвищує ефективність обчислень. Вища ефективність обчислень забезпечує краще навчання й обслуговування, зрештою живлячи потужніші ШІ-моделі. Кращі моделі стають кращими продуктами для людей, розробників і бізнесу. Кращі продукти стимулюють більше використання, більше клієнтів і більше доходу, що дає OpenAI змогу реінвестувати в наступне покоління інфраструктури. З часом цей цикл допомагає робити інтелект потужнішим, надійнішим і дешевшим для всіх.
Jalapeño було спільно розроблено, від початкового проєктування до передання фінального проєкту у виробництво, лише за дев'ять місяців, і ця програма кастомного ШІ-прискорювача, на нашу думку, є найшвидшим циклом розробки ASIC, будь-коли досягнутим у сфері високопродуктивних передових напівпровідників. Такої швидкості вдалося досягти завдяки тісній спільній роботі команд OpenAI над програмним і апаратним забезпеченням, експертизі Broadcom у фізичній реалізації мікросхем, а також використанню моделей OpenAI для прискорення окремих етапів проєктування й оптимізації.
Ті самі моделі, що обслуговують користувачів, допомагають покращувати інфраструктуру, на якій працюватимуть майбутні моделі. Якщо ШІ може допомогти інженерам швидше проєктувати кращі чипи, він може знизити вартість обчислень у всій галузі й зробити передовий ШІ доступнішим для ширшого кола користувачів.
Jalapeño — це перший крок до створення обчислювальної платформи, розрахованої на кілька поколінь розвитку. Її перше розгортання заплановано до кінця 2026 року з подальшим масштабуванням у наступні роки. Вона поєднує прискорювачі, розроблені OpenAI, із технологіями Broadcom у сфері реалізації мікросхем, мережевих рішень і міжз'єднань, а також із досвідом Celestica у розробленні плат, стійкових систем і комплексних апаратних рішень.
Мета цієї роботи проста: саме під час інференсу можливості ШІ стають доступними людям. Кожне покращення вартості, швидкості й надійності може проявитися як швидша відповідь ChatGPT, завдання Codex, здатне виконати більше кроків із меншим очікуванням, API-продукт, який дешевше створювати, або надійніший доступ під час високого попиту.
Розширити доступ до ШІ означає зробити передові моделі доступними, надійними й достатньо недорогими, щоб більше людей могли користуватися ними щодня. Jalapeño допомагає OpenAI перетворювати більшу частину своєї інфраструктури на корисний інтелект для студентів, розробників, малого бізнесу, дослідників, підприємств і всіх, хто прагне вчитися, творити або розв’язувати складні проблеми.


