Passer au contenu principal
OpenAI

24 juin 2026

Entreprise

OpenAI et Broadcom dévoilent une puce d’inférence optimisée pour les LLM

Chargement...
  • Les premiers tests montrent que l’accélérateur de première génération offrira un rapport performance par watt nettement supérieur à l’état de l’art actuel
  • Conçu de A à Z pour les LLM actuels et futurs dans l’ensemble du secteur
  • Développé de la conception à la production en neuf mois, avec l’accélération des modèles d’OpenAI
  • Étend la plateforme full-stack d’OpenAI, des produits aux modèles, et désormais aux puces
  • Déploiement prévu à l’échelle du gigawatt avec des partenaires de centres de données, sur plusieurs générations

OpenAI et Broadcom (NASDAQ: AVGO) ont dévoilé aujourd’hui Jalapeño, le premier processeur d’intelligence d’OpenAI : un accélérateur architecturé autour de la vision d’OpenAI pour l’avenir de l’inférence LLM, et le premier accélérateur IA d’une plateforme de calcul multigénération que les deux entreprises construisent ensemble afin de rendre l’IA avancée plus rapide, plus fiable et plus accessible à un plus grand nombre de personnes.

Des dirigeants d’OpenAI et de Broadcom présentent la puce d’inférence Jalapeño.

Jalapeño a été remis au CEO d’OpenAI, Sam Altman, et à son président, Greg Brockman, par Hock Tan, président et CEO de Broadcom, et Charlie Kawwas, président, marquant une étape importante dans la stratégie d’OpenAI visant à bâtir toute la pile qui sous-tend ses modèles et ses produits.

OpenAI a conçu la puce à partir de zéro, en s’appuyant sur sa compréhension approfondie des fondamentaux des LLM, éclairée par sa feuille de route en matière de modèles, de kernels, de systèmes de service et de besoins produits, avec ses partenaires Broadcom et Celestica, qui contribuent à industrialiser la plateforme via la mise en œuvre de la puce, les cartes, l’intégration des systèmes en rack, les réseaux haute performance et les systèmes de production évolutifs. Jalapeño est conçu avec la flexibilité nécessaire pour fonctionner avec tous les LLM, guidé par les enseignements d’OpenAI sur les besoins d’inférence des modèles d’IA actuels et futurs dans l’ensemble du secteur. Des échantillons d’ingénierie de la puce Jalapeño exécutent des charges de travail ML en laboratoire à la fréquence et à la puissance cibles de production, notamment GPT‑5.3‑Codex‑Spark.

Bien qu’OpenAI mesure encore les performances finales, les premiers tests montrent que Jalapeño offrira un rapport performance par watt nettement supérieur à l’état de l’art actuel. Un rapport technique détaillé sur les performances sera présenté dans les prochains mois. L’architecture réduit les déplacements de données et équilibre les ressources de calcul, de mémoire et de réseau afin d’atteindre un taux d’utilisation réel beaucoup plus proche des performances de pointe théoriques. La mise en œuvre silicium et les technologies réseau de Broadcom, notamment le silicium réseau Tomahawk, contribuent à porter la plateforme vers une production à grande échelle.

« Le monde se dirige vers une économie propulsée par le calcul », a déclaré Greg Brockman, président et cofondateur d’OpenAI. « Jalapeño s’inscrit dans notre stratégie d’infrastructure full-stack à long terme visant à rendre le calcul plus abondant, pour une IA plus rapide, plus fiable, plus abordable pour les particuliers et les entreprises, et capable de servir à résoudre des problèmes plus importants. En concevant nous-mêmes une plus grande partie de la pile, nous pouvons fournir davantage d’intelligence avec plus d’efficacité et continuer à rendre l’IA avancée accessible plus largement. »

« Jalapeño a été conçu de A à Z pour l’inférence LLM grâce aux enseignements détaillés issus de notre étroite collaboration avec les chercheurs d’OpenAI », a déclaré Richard Ho, qui dirige le programme matériel d’OpenAI. « Nous avons optimisé l’architecture autour des kernels, des mouvements de mémoire, des réseaux et des schémas de service les plus déterminants pour les modèles d’IA de pointe. D’après les premiers tests, Jalapeño exécutera efficacement nos charges de travail les plus importantes, près des limites théoriques du matériel. »

« Notre collaboration avec OpenAI traduit un engagement fondamental à faire passer à l’échelle l’infrastructure physique nécessaire à la prochaine décennie de l’IA », a déclaré Hock Tan, président et CEO de Broadcom. « Ce n’est que le début d’une feuille de route multigénération. En co-développant directement avec OpenAI notre silicium de pointe, nous rendons possible le déploiement de centres de données à l’échelle du gigawatt avec Microsoft et d’autres partenaires à partir de 2026. »

Conçu pour être la meilleure plateforme d’inférence pour les LLM

Jalapeño est une conception entièrement nouvelle pour l’inférence des LLM modernes, et non un accélérateur généraliste adapté à partir de charges de travail IA antérieures. Il s’appuie sur les systèmes qu’OpenAI exploite chaque jour pour ChatGPT, Codex, l’API et les futurs produits agentiques, tout en étant conçu pour les LLM actuels et futurs dans l’ensemble du secteur. L’objectif est de combiner la puissance et le débit des principaux accélérateurs IA actuels avec une latence plus proche de celle des systèmes d’inférence spécialisés les plus rapides, ce qui rend Jalapeño particulièrement adapté aux produits LLM interactifs à grande échelle.

C’est l’avantage de l’approche full-stack. OpenAI ne se contente pas de développer des modèles de pointe ni de créer des produits qui s’appuient sur eux ; elle conçoit aussi l’infrastructure sous-jacente : architecture de puce, kernels, systèmes de mémoire, réseaux, ordonnancement, systèmes de déploiement et expérience produit. Parce qu’OpenAI opère sur l’ensemble de la pile, chaque couche peut être optimisée autour d’un même objectif : rendre ses modèles plus rapides, plus fiables et plus abordables pour les utilisateurs.

Jalapeño renforce le cercle vertueux qui soutient les progrès d’OpenAI. Une meilleure infrastructure améliore l’efficacité du calcul. Une plus grande efficacité du calcul permet d’améliorer l’entraînement et le service, et alimente au final des modèles d’IA plus performants. De meilleurs modèles deviennent de meilleurs produits pour les particuliers, les développeurs et les entreprises. De meilleurs produits entraînent davantage d’usage, plus de clients et plus de revenus, ce qui permet à OpenAI de réinvestir dans la prochaine génération d’infrastructure. Au fil du temps, ce cycle contribue à rendre l’intelligence plus performante, plus fiable et moins coûteuse pour tous.

Tape-out en neuf mois, accéléré par les modèles d’OpenAI

Jalapeño a été co-développé depuis la conception initiale jusqu’au tape-out de fabrication en seulement neuf mois, et le programme d’accélérateur IA personnalisé représente ce que nous estimons être le cycle de développement d’ASIC le plus rapide jamais réalisé dans les semi-conducteurs avancés haute performance. Cette rapidité reflète une co-conception logicielle et matérielle approfondie avec les équipes d’ingénierie d’OpenAI, l’expertise de Broadcom dans la mise en œuvre du silicium, ainsi que l’utilisation des modèles d’OpenAI pour accélérer certaines parties du processus de conception et d’optimisation.

Les mêmes modèles servis aux utilisateurs contribuent à améliorer l’infrastructure qui fera fonctionner les futurs modèles. Si l’IA peut aider les ingénieurs à concevoir plus vite de meilleures puces, elle peut réduire le coût du calcul dans tout le secteur et contribuer à démocratiser l’accès à l’IA avancée.

Construire une plateforme multigénération avec des partenaires

Jalapeño est la première étape d’une plateforme de calcul multigénération conçue pour un premier déploiement d’ici la fin 2026, puis une extension dans les années suivantes, combinant les accélérateurs conçus par OpenAI avec les technologies de mise en œuvre silicium, de réseau et de connectivité de Broadcom, ainsi que l’expertise de Celestica en matière de cartes, de racks et de systèmes.

Rendre l’IA avancée plus largement disponible

L’objectif de ce travail est simple : l’inférence est le point de contact entre l’IA et les personnes. Chaque amélioration du coût, de la vitesse et de la fiabilité peut se traduire par une réponse plus rapide de ChatGPT, une tâche Codex capable d’enchaîner davantage d’étapes avec moins d’attente, un produit API moins coûteux à créer, ou un accès plus fiable lorsque la demande est forte.

Démocratiser l’IA, c’est rendre les modèles avancés suffisamment disponibles, fiables et abordables pour que davantage de personnes puissent les utiliser chaque jour. Jalapeño aide OpenAI à transformer une plus grande part de son infrastructure en intelligence utile pour les étudiants, les développeurs, les petites entreprises, les chercheurs, les grandes organisations et toute personne qui cherche à apprendre, créer ou résoudre des problèmes difficiles.

Auteur

OpenAI