Pasar al contenido principal
OpenAI

24 de junio de 2026

Empresa

OpenAI y Broadcom presentan un chip de inferencia optimizado para los LLM

Cargando...
  • Las primeras pruebas muestran que el acelerador de primera generación ofrecerá un rendimiento por vatio sustancialmente mejor que el estado del arte actual.
  • Diseñado desde cero para los LLM actuales y futuros de toda la industria.
  • Desarrollado desde el diseño hasta la producción en nueve meses, acelerado por los modelos de OpenAI.
  • Amplía la plataforma integral de OpenAI, desde productos hasta modelos y ahora chips.
  • Se implementará a escala de gigavatios con socios de centros de datos, durante varias generaciones.

OpenAI y Broadcom (NASDAQ: AVGO) presentaron hoy Jalapeño, el primer procesador de OpenAI: un acelerador diseñado a partir de la visión de OpenAI para el futuro de la inferencia de LLM y la primera pieza de una plataforma de cómputo multigeneracional que ambas empresas están construyendo para hacer que la IA avanzada sea más rápida, más confiable y más accesible para más personas.

Líderes de OpenAI y Broadcom muestran el chip de inferencia Jalapeño.

El presidente y CEO de Broadcom, Hock Tan, y el presidente Charlie Kawwas entregaron Jalapeño al CEO de OpenAI, Sam Altman, y a su presidente, Greg Brockman, lo que marca un paso importante en la estrategia de OpenAI para construir toda la infraestructura que sostiene sus modelos y productos.

OpenAI diseñó el chip desde cero a partir de su profundo conocimiento de los fundamentos de los LLM, tomando como base su hoja de ruta de modelos, kernels, sistemas de inferencia y necesidades de producto, junto con sus socios Broadcom y Celestica, que ayudan a industrializar la plataforma mediante la implementación del chip, la integración de placas y sistemas en rack, redes de alto rendimiento y sistemas de producción escalables. Jalapeño está diseñado con la flexibilidad necesaria para ser compatible con todos los LLM, a partir de la experiencia de OpenAI en las necesidades de inferencia de los modelos de IA actuales y futuros en toda la industria. Las muestras de ingeniería del chip Jalapeño ya ejecutan cargas de trabajo de ML en el laboratorio a la frecuencia y la potencia previstas para producción, incluido GPT‑5.3‑Codex‑Spark.

Aunque OpenAI todavía está midiendo el rendimiento final, las primeras pruebas muestran que Jalapeño ofrecerá un rendimiento por vatio sustancialmente superior al de las soluciones más avanzadas de la actualidad. En los próximos meses se presentará un informe técnico detallado sobre el rendimiento. La arquitectura reduce la transferencia de datos y equilibra los recursos de cómputo, memoria y redes para lograr una utilización real mucho más cercana al rendimiento máximo teórico. La experiencia de Broadcom en implementación de silicio y sus tecnologías de redes, incluida la tecnología Tomahawk, ayudan a llevar la plataforma a producción a gran escala.

"El mundo está avanzando hacia una economía impulsada por el cómputo", dijo Greg Brockman, presidente y cofundador de OpenAI. "Jalapeño forma parte de nuestra estrategia de infraestructura integral a largo plazo para hacer que el cómputo sea más abundante, lo que permite una IA más rápida, más confiable y más asequible para personas y empresas, capaz de resolver problemas más importantes. Al diseñar nosotros mismos una mayor parte de la infraestructura, podemos ofrecer más inteligencia con mayor eficiencia y seguir ampliando el acceso a la IA avanzada".

"Jalapeño fue diseñado desde cero para la inferencia de LLM a partir del conocimiento obtenido gracias a nuestra estrecha colaboración con los investigadores de OpenAI", dijo Richard Ho, quien lidera el programa de hardware de OpenAI. "Optimizamos la arquitectura en torno a los kernels, el movimiento de memoria, las redes y los patrones de inferencia que más importan para los modelos de IA de vanguardia. Según las primeras pruebas, Jalapeño ejecutará de manera eficiente nuestras cargas de trabajo más importantes cerca de los límites teóricos del hardware".

"Nuestra colaboración con OpenAI representa un compromiso fundamental para escalar la infraestructura física que requerirá la próxima década de la IA", dijo Hock Tan, presidente y CEO de Broadcom. "Esto es apenas el comienzo de una hoja de ruta multigeneracional. Al desarrollar junto con OpenAI nuestro silicio líder en la industria, posibilitamos la implementación de centros de datos a escala de gigavatios con Microsoft y otros socios a partir de 2026".

Diseñado para ser la mejor plataforma de inferencia para LLM

Jalapeño es un diseño desde cero para la inferencia moderna de LLM, no un acelerador de uso general adaptado a partir de cargas de trabajo de IA anteriores. Su diseño se basa en los sistemas que OpenAI opera todos los días en ChatGPT, Codex, la API y futuros productos basados en agentes, y al mismo tiempo está pensado para los LLM actuales y futuros de toda la industria. El objetivo es combinar la potencia y el rendimiento de los principales aceleradores de IA actuales con una latencia más cercana a la de los sistemas especializados de inferencia más rápidos, lo que hace que Jalapeño sea especialmente adecuado para productos LLM interactivos a escala.

Esa es la ventaja de una plataforma integral. OpenAI no solo desarrolla modelos de vanguardia o crea productos sobre ellos; también diseña la infraestructura que los sostiene: arquitectura de chips, kernels, sistemas de memoria, redes, planificación, sistemas de implementación y experiencia de producto. Como OpenAI controla toda esa infraestructura, cada capa puede optimizarse en torno al mismo objetivo: hacer que sus modelos sean más rápidos, más confiables y más asequibles para los usuarios.

Jalapeño fortalece el círculo virtuoso que impulsa el progreso de OpenAI. Una mejor infraestructura impulsa la eficiencia del cómputo. Esa mayor eficiencia permite mejorar el entrenamiento y la inferencia, lo que en última instancia potencia modelos de IA más capaces. Mejores modelos se convierten en mejores productos para personas, desarrolladores y empresas. Mejores productos impulsan un mayor uso, más clientes y más ingresos, lo que permite a OpenAI reinvertir en la próxima generación de infraestructura. Con el tiempo, ese ciclo ayuda a que la inteligencia sea más capaz, más confiable y más asequible para todos.

Diseño completado en nueve meses, acelerado por los modelos de OpenAI

Jalapeño se codesarrolló desde el diseño inicial hasta la finalización del diseño en solo nueve meses, y este programa de aceleradores de IA personalizados representa, según creemos, el ciclo de desarrollo de ASIC más rápido jamás logrado en semiconductores avanzados de alto rendimiento. Esa velocidad refleja un profundo codesarrollo de software y hardware con los equipos de ingeniería de OpenAI, la experiencia de Broadcom en implementación física de chips y el uso de modelos de OpenAI para acelerar partes del proceso de diseño y optimización.

Los mismos modelos que se ofrecen a los usuarios están ayudando a mejorar la infraestructura que se usará para ejecutar los modelos del futuro. Si la IA puede ayudar a los ingenieros a diseñar mejores chips más rápido, puede reducir el costo del cómputo en toda la industria y ayudar a democratizar el acceso a la IA avanzada.

Construir una plataforma multigeneracional con socios

Jalapeño es el primer paso de una plataforma de cómputo multigeneracional diseñada para su implementación inicial a fines de 2026 y para expandirse en los años siguientes. La plataforma combina aceleradores diseñados por OpenAI con las tecnologías de implementación física de chips, redes y conectividad de Broadcom, y la experiencia de Celestica en placas, racks y sistemas.

Ampliar el acceso a la IA avanzada

El objetivo de este trabajo es simple: la inferencia es el punto donde la IA llega a las personas. Cada mejora en costo, velocidad y confiabilidad puede traducirse en una respuesta más rápida de ChatGPT, una tarea de Codex que puede dar más pasos con menos espera, un producto de API cuyo desarrollo cuesta menos o un acceso más confiable cuando la demanda es alta.

Democratizar la IA significa hacer que los modelos avanzados estén disponibles, sean confiables y asequibles para que más personas los usen todos los días. Jalapeño ayuda a OpenAI a transformar una mayor parte de su infraestructura en inteligencia útil para estudiantes, desarrolladores, pequeñas empresas, investigadores, compañías y cualquier persona que intente aprender, crear o resolver problemas difíciles.

Autor

OpenAI