Ir al contenido principal
OpenAI

24 de junio de 2026

Empresa

OpenAI y Broadcom presentan un chip de inferencia óptimo para LLM

Cargando…
  • Las primeras pruebas muestran que el acelerador de primera generación ofrecerá un rendimiento por vatio muy superior al de la tecnología más avanzada actual
  • Diseñado desde cero para los LLM actuales y futuros de todo el sector
  • Desarrollado desde el diseño hasta la producción en nueve meses, acelerado por los modelos de OpenAI
  • Amplía toda la plataforma tecnológica de OpenAI, que abarca desde productos hasta modelos y, ahora, también chips
  • Se implementará a escala de gigavatios en colaboración con socios de centros de datos, durante varias generaciones

OpenAI y Broadcom (NASDAQ: AVGO) han presentado hoy Jalapeño, el primer procesador de inteligencia de OpenAI: un acelerador diseñado en torno a la visión de OpenAI sobre el futuro de la inferencia de LLM, y el primer acelerador de IA de una plataforma de computación multigeneracional que ambas empresas están creando juntas para que la IA avanzada sea más rápida, fiable y accesible para más personas.

Los líderes de OpenAI y Broadcom muestran el chip de inferencia Jalapeño.

Jalapeño fue entregado al CEO de OpenAI, Sam Altman, y al presidente, Greg Brockman, por Hock Tan, presidente y CEO de Broadcom, y Charlie Kawwas, presidente, lo que marca un paso importante en la estrategia de OpenAI para desarrollar toda la tecnología que sustenta sus modelos y productos.

OpenAI diseñó el chip desde cero a partir de su profundo conocimiento de los fundamentos de los LLM, teniendo en cuenta su hoja de ruta en materia de modelos, kernels, sistemas de servicio y necesidades de producto, con los socios Broadcom y Celestica, que ayudan a industrializar la plataforma mediante la implementación del chip, la placa, la integración de sistemas en rack, redes de alto rendimiento y sistemas de producción ampliables. Jalapeño se ha diseñado con la flexibilidad necesaria para funcionar con todos los LLM, guiado por los conocimientos de OpenAI sobre las necesidades de inferencia de los modelos de IA actuales y futuros de todo el sector. Las muestras de ingeniería del chip Jalapeño están ejecutando cargas de trabajo de aprendizaje automático en el laboratorio con la frecuencia y la potencia objetivo de producción, incluido GPT‑5.3‑Codex‑Spark.

Aunque OpenAI aún está midiendo el rendimiento final, las primeras pruebas muestran que Jalapeño ofrecerá un rendimiento por vatio muy superior al de la tecnología más avanzada actual. En los próximos meses se presentará un informe técnico detallado sobre el rendimiento. La arquitectura reduce el movimiento de datos y equilibra los recursos de computación, memoria y redes para lograr una utilización real mucho más cercana al rendimiento máximo teórico. La implementación de circuitos integrados y las tecnologías de red de Broadcom, incluido el silicio de red Tomahawk, ayudan a llevar la plataforma a la producción a gran escala.

«El mundo avanza hacia una economía impulsada por la computación», asegura Greg Brockman, presidente y cofundador de OpenAI. «Jalapeño forma parte de nuestra estrategia de infraestructura tecnológica integral a largo plazo para hacer que la computación sea más abundante, lo que dará como resultado una IA más rápida, fiable y asequible para personas y empresas, y capaz de utilizarse para resolver problemas más importantes. Al diseñar nosotros mismos más partes de la plataforma tecnológica, podemos ofrecer más inteligencia con mayor eficiencia y seguir impulsando una IA avanzada hacia un acceso más amplio».

«Jalapeño se ha diseñado desde cero para la inferencia de LLM utilizando conocimientos detallados derivados de nuestra estrecha colaboración con los investigadores de OpenAI», afirma Richard Ho, responsable del programa de hardware de OpenAI. «Hemos optimizado la arquitectura en torno a los kernels, el movimiento de memoria, las redes y los patrones de servicio que más importan para los modelos de IA de vanguardia. Según las primeras pruebas, Jalapeño ejecutará de forma eficiente nuestras cargas de trabajo más importantes cerca de los límites teóricos del hardware».

«Nuestra colaboración con OpenAI representa un compromiso fundamental para ampliar la infraestructura física necesaria para la próxima década de la IA», señala Hock Tan, presidente y CEO de Broadcom. «Esto es solo el comienzo de una hoja de ruta multigeneracional. Al desarrollar conjuntamente nuestros circuitos integrados líderes del sector directamente con OpenAI, estamos haciendo posible la implementación de centros de datos a escala de gigavatios con Microsoft y otros socios a partir de 2026».

Diseñado para ser la mejor plataforma de inferencia para LLM

Jalapeño es un diseño desde cero para la inferencia de LLM moderno, no un acelerador de uso general adaptado a las cargas de trabajo de IA anteriores. Se basa en los sistemas que OpenAI ejecuta a diario en ChatGPT, Codex, la API y futuros productos basados en agentes, y al mismo tiempo está diseñado para los LLM actuales y futuros de todo el sector. El objetivo es combinar la potencia y el rendimiento de los principales aceleradores de IA actuales con una latencia más cercana a la de los sistemas de inferencia especializados más rápidos, lo que hace que Jalapeño sea idóneo para productos LLM interactivos a gran escala.

Esa es la ventaja de una plataforma tecnológica integral. OpenAI no solo desarrolla modelos de vanguardia o crea productos sobre ellos; también diseña la infraestructura que los sustenta: arquitectura de chips, kernels, sistemas de memoria, redes, planificación, sistemas de implementación y experiencia del producto. Como OpenAI opera en toda la plataforma tecnológica, cada capa puede optimizarse en torno al mismo objetivo: hacer que sus modelos sean más rápidos, fiables y asequibles para los usuarios.

Jalapeño refuerza el motor que impulsa el progreso de OpenAI. Una infraestructura mejor incrementa la eficiencia de la computación. Una mayor eficiencia de la computación permite mejorar el entrenamiento y el servicio, lo que, en última instancia, contribuye a que los modelos de IA sean más capaces. Mejores modelos se traducen en mejores productos para personas, desarrolladores y empresas. Mejores productos generan más uso, más clientes y más ingresos, lo que permite a OpenAI reinvertir en la próxima generación de infraestructura. Con el tiempo, ese ciclo hace que la inteligencia sea más capaz, más fiable y más asequible para todos.

Finalización del diseño en nueve meses, acelerado por modelos de OpenAI

Jalapeño se desarrolló conjuntamente, desde el diseño inicial hasta la finalización del diseño para fabricación, en tan solo nueve meses, y el programa del acelerador de IA a medida representa lo que, en nuestra opinión, es el ciclo de desarrollo de ASIC más rápido jamás logrado en el ámbito de los semiconductores avanzados de alto rendimiento. Esa rapidez es fruto de una estrecha colaboración en el desarrollo conjunto de software y hardware con los equipos de ingeniería de OpenAI, la experiencia de Broadcom en la implementación de circuitos integrados y el uso de modelos de OpenAI para acelerar determinadas fases del proceso de diseño y optimización.

Los mismos modelos que se sirven a los usuarios están ayudando a mejorar la infraestructura utilizada para ejecutar modelos futuros. Si la IA puede ayudar a los ingenieros a diseñar mejores chips con más rapidez, puede reducir el coste de la computación en todo el sector y ayudar a democratizar el acceso a la IA avanzada.

Crear una plataforma multigeneracional con socios

Jalapeño constituye el primer paso de una plataforma de computación multigeneracional diseñada para su implementación inicial a finales de 2026 y cuya expansión está prevista para los próximos años, y que combina los aceleradores diseñados por OpenAI con la implementación de circuitos integrados de Broadcom, así como sus tecnologías de redes y conectividad. Además, cuenta con la experiencia de Celestica en placas, racks y sistemas.

Hacer que la IA avanzada esté disponible en mayor medida

El objetivo de este trabajo es sencillo: la inferencia es el punto en el que la IA llega a las personas. Cada mejora en coste, velocidad y fiabilidad puede traducirse en una respuesta de ChatGPT más rápida, una tarea de Codex que puede dar más pasos con menos espera, un producto de API más barato de crear o un acceso más fiable cuando la demanda es alta.

Democratizar la IA significa hacer que los modelos avanzados estén disponibles y sean lo bastante fiables y asequibles para que más personas los utilicen a diario. Jalapeño ayuda a OpenAI a convertir una mayor parte de su infraestructura en inteligencia útil para estudiantes, desarrolladores, pequeñas empresas, investigadores, grandes compañías y cualquier persona que intente aprender, crear o resolver problemas difíciles.

Autor

OpenAI