OpenAI и Broadcom представили чип инференса для LLM
- Ранние испытания показывают, что ускоритель первого поколения обеспечит существенно лучшую производительность на ватт, чем современные передовые решения
- Создан с нуля для нынешних и будущих LLM во всей отрасли
- Разработан от проектирования до производства за девять месяцев с ускорением за счет моделей OpenAI
- Расширяет полноуровневую платформу OpenAI: от продуктов к моделям, а теперь и к чипам
- Будет развернут в гигаваттном масштабе вместе с партнерами по дата-центрам на протяжении нескольких поколений
OpenAI и Broadcom (NASDAQ: AVGO) сегодня представили Jalapeño — первый процессор интеллекта OpenAI: ускоритель, спроектированный вокруг видения OpenAI будущего инференса LLM, и первый AI-ускоритель в многопоколенческой вычислительной платформе, которую компании совместно создают, чтобы сделать передовой AI быстрее, надежнее и доступнее для большего числа людей.

Jalapeño был передан генеральному директору OpenAI Сэму Альтману и президенту Грегу Брокману президентом и генеральным директором Broadcom Хоком Таном и президентом Чарли Каввасом, что стало важным шагом в стратегии OpenAI по созданию полного стека для своих моделей и продуктов.
OpenAI спроектировала чип с нуля, опираясь на глубокое понимание основ LLM, дорожную карту моделей, ядер, систем обслуживания и потребностей продуктов. Партнеры Broadcom и Celestica помогают вывести платформу на промышленный уровень через реализацию чипа, платы, интеграцию стоечных систем, высокопроизводительные сети и масштабируемые производственные системы. Jalapeño спроектирован гибко, чтобы работать со всеми LLM, с учетом представлений OpenAI о потребностях инференса нынешних и будущих ИИ-моделей во всей отрасли. Инженерные образцы чипа Jalapeño выполняют ML-нагрузки в лаборатории на целевой для производства частоте и мощности, включая GPT‑5.3‑Codex‑Spark.
Хотя OpenAI еще измеряет итоговую производительность, ранние испытания показывают, что Jalapeño обеспечит существенно лучшую производительность на ватт, чем современные передовые решения. Подробный технический отчет о производительности будет представлен в ближайшие месяцы. Архитектура сокращает перемещение данных и балансирует вычислительные, сетевые ресурсы и ресурсы памяти, чтобы фактическая утилизация была гораздо ближе к теоретической пиковой производительности. Кремниевая реализация Broadcom и сетевые технологии, включая сетевой кремний Tomahawk, помогают вывести платформу в крупномасштабное производство.
«Мир переходит к экономике, основанной на вычислениях», — сказал Грег Брокман, президент и сооснователь OpenAI. «Jalapeño — часть нашей долгосрочной инфраструктурной стратегии полного стека, цель которой — сделать вычислительные ресурсы более доступными, а значит, сделать ИИI быстрее, надежнее и дешевле для людей и компаний, чтобы его можно было применять для решения более важных задач. Проектируя больше уровней стека самостоятельно, мы можем обслуживать больше интеллекта с большей эффективностью и дальше расширять доступ к передовому ИИ».
«Jalapeño был с нуля спроектирован для инференса LLM с использованием подробных знаний, полученных в тесном сотрудничестве с исследователями OpenAI», — сказал Ричард Хо, руководящий аппаратной программой OpenAI. «Мы оптимизировали архитектуру вокруг ядер, перемещения памяти, сетей и паттернов обслуживания, которые наиболее важны для передовых ИИ-моделей. Судя по ранним испытаниям, Jalapeño будет эффективно выполнять наши самые важные нагрузки близко к теоретическим пределам аппаратного обеспечения».
«Наше сотрудничество с OpenAI — это фундаментальное обязательство масштабировать физическую инфраструктуру, необходимую для следующего десятилетия AI», — сказал Хок Тан, президент и генеральный директор Broadcom. «Это лишь начало дорожной карты на несколько поколений. Совместно разрабатывая наш ведущий в отрасли кремний напрямую с OpenAI, мы обеспечиваем развертывание дата-центров гигаваттного масштаба вместе с Microsoft и другими партнерами, начиная с 2026 года».
Jalapeño изначально спроектирован для современного инференса LLM, а не представляет собой универсальный ускоритель, адаптированный под более ранние ИИ-нагрузки. Он учитывает системы, которые OpenAI ежедневно запускает в ChatGPT, Codex, API и будущих агентных продуктах, и при этом рассчитан на нынешние и будущие LLM во всей отрасли. Цель — объединить мощность и пропускную способность ведущих современных ИИ-ускорителей с задержкой, близкой к самым быстрым специализированным системам инференса, благодаря чему Jalapeño хорошо подходит для интерактивных LLM-продуктов в масштабе.
В этом и состоит преимущество полного стека. OpenAI не только разрабатывает передовые модели или строит продукты поверх них; она проектирует инфраструктуру под ними: архитектуру чипов, ядра, системы памяти, сети, планирование, системы развертывания и продуктовый опыт. Поскольку OpenAI работает на всех уровнях стека, каждый уровень можно оптимизировать вокруг одной цели: сделать ее модели быстрее, надежнее и доступнее для пользователей.
Jalapeño усиливает маховик прогресса OpenAI. Более качественная инфраструктура повышает эффективность вычислений. Более высокая эффективность вычислений обеспечивает лучшее обучение и обслуживание, в итоге питая более способные ИИ-модели. Более качественные модели становятся более качественными продуктами для людей, разработчиков и компаний. Более качественные продукты стимулируют рост использования, числа клиентов и выручки, что позволяет OpenAI реинвестировать в инфраструктуру следующего поколения. Со временем этот цикл помогает сделать интеллект более способным, надежным и недорогим для всех.
Jalapeño был совместно разработан всего за девять месяцев: от первоначального проектирования до передачи финальных данных в производство на этапе tape-out. По нашей оценке, программа создания этого специализированного ИИ-ускорителя стала самым быстрым циклом разработки ASIC в истории современных высокопроизводительных полупроводников.Такая скорость отражает глубокую совместную разработку программного и аппаратного обеспечения с инженерными командами OpenAI, экспертизу Broadcom в кремниевой реализации и использование моделей OpenAI для ускорения частей процесса проектирования и оптимизации.
Те же модели, которые обслуживают пользователей, помогают совершенствовать инфраструктуру для запуска будущих моделей. Если ИИ может помогать инженерам быстрее проектировать более совершенные чипы, он способен снизить стоимость вычислений во всей отрасли и помочь демократизировать доступ к передовому ИИ.
Jalapeño — первый шаг в создании вычислительной платформы на несколько поколений, рассчитанной на первоначальное развертывание к концу 2026 года и расширение в последующие годы. Она объединяет разработанные OpenAI ускорители с кремниевой реализацией, сетевыми и коммуникационными технологиями Broadcom, а также экспертизой Celestica в платах, стойках и системах.
Смысл этой работы прост: именно через инференс ИИ доходит до людей. Каждое улучшение стоимости, скорости и надежности может проявиться как более быстрый ответ ChatGPT, задача Codex, способная выполнить больше шагов с меньшим ожиданием, API-продукт, который дешевле создавать, или более надежный доступ при высоком спросе.
Демократизация ИИ означает, что передовые модели должны стать достаточно доступными, надежными и недорогими, чтобы больше людей могли пользоваться ими каждый день. Jalapeño помогает OpenAI превращать большую часть своей инфраструктуры в полезный интеллект для студентов, разработчиков, малого бизнеса, исследователей, предприятий и всех, кто стремится учиться, создавать или решать сложные задачи.


