Aperçu du mode Ultrafast : GPT‑5.6 Sol jusqu’à 14× plus vite
Une nouvelle catégorie de vitesse pour l’intelligence de pointe, qui transforme la rapidité en avantage concurrentiel.
Aujourd’hui, nous dévoilons en avant-première Ultrafast, une nouvelle offre qui exécute GPT‑5.6 Sol jusqu’à 14 fois plus vite que le traitement Standard et sera d’abord lancée dans l’API OpenAI. Propulsé par Cerebras, Ultrafast génère jusqu’à 750 jetons de sortie par seconde, mettant notre modèle le plus intelligent au service des produits et processus où chaque seconde compte.
Avec GPT‑5.6, nous repoussons les limites de ce que nos modèles peuvent accomplir et améliorons leur efficacité à chaque niveau de notre pile technologique. Ces améliorations ont rendu l’intelligence avancée plus abordable et plus utile à davantage de personnes. Jusqu’à présent, obtenir une vitesse en temps réel impliquait généralement de choisir un modèle plus petit ou plus spécialisé. Ultrafast ouvre une nouvelle voie de progrès : plus de travail utile par seconde.
Lorsque la vitesse n’impose plus de sacrifier l’intelligence, l’IA peut intervenir dans les activités les plus urgentes d’une entreprise et rendre possibles de nouvelles formes de travail. Nous avons déjà observé des scénarios prometteurs pour Ultrafast :
- Réponse aux incidents et fiabilité : lorsqu’un système critique tombe en panne, analyser les journaux d’application, les récentes modifications du code et les rapports des ingénieurs afin d’identifier la cause probable et d’aider à préparer un correctif pendant que l’incident est encore en cours.
- Recherche financière et sécurité : analyser les signaux du marché, évaluer les transactions et repérer les activités suspectes alors que la situation évolue encore.
- Service client et interactions vocales : résoudre en temps réel les problèmes complexes des clients sans interrompre la conversation, même lorsque trouver la réponse nécessite plusieurs étapes ou systèmes.
- Commerce : répondre aux questions sur les produits, vérifier les stocks, personnaliser les recommandations et résoudre les problèmes de paiement pendant que l’acheteur hésite encore, avant que cette hésitation ne mène à l’abandon du panier.
- Recherche et expérimentation en direct : transformer une recherche qui nécessitait auparavant une exécution nocturne en séance de travail interactive, permettant aux équipes de tester une idée, d’examiner les résultats, d’ajuster leur approche et de lancer une nouvelle expérience sans interrompre leur élan.
Pendant la période d’avant-première, nous collaborons avec un premier groupe de clients afin de comprendre où cette vitesse fait la plus grande différence et comment ces enseignements pourront orienter nos produits au fil du temps. Si votre entreprise a besoin d’une intelligence de pointe à la vitesse maximale, vous pouvez vous inscrire pour être informé de l’élargissement de l’accès.
Les modes Ultrafast et standard de GPT‑5.6 Sol créent côte à côte un simulateur d’entrepôt 3D fonctionnel à partir du même prompt textuel.
Nous testons GPT‑5.6 Sol en mode Ultrafast avec un premier groupe d’entreprises dans les domaines du code, du commerce, de la recherche financière, de l’assistance et d’autres applications interactives. Commencer par les processus métier nous permet d’étudier ces conditions dans de véritables environnements de production. Leurs premiers travaux nous aident à comprendre où un changement d’un ordre de grandeur en matière de vitesse crée le plus de valeur et comment les produits évoluent lorsque le modèle peut suivre le rythme de son utilisateur. Nous utiliserons ces résultats pour guider le déploiement à mesure que la capacité augmentera.
Au sein d’OpenAI, un groupe de développeurs teste GPT‑5.6 Sol en mode Ultrafast afin de déterminer quels processus bénéficient d’une intelligence de pointe capable de répondre en temps réel.
La réponse aux incidents est un exemple d’utilisation d’Ultrafast par notre équipe. Lorsqu’une alerte se déclenche, les ingénieurs doivent établir une vue précise de la situation alors que le système et les éléments disponibles évoluent encore. Les équipes l’utilisent pour lire rapidement les journaux, analyser les traces, synthétiser les conversations, déterminer les prochaines vérifications et aider à préparer ou valider un correctif, le tout en une fraction du temps grâce à l’intelligence de Sol. Il réduit le délai entre l’observation d’un signal, le test d’une hypothèse et le choix de l’action suivante, tandis que les ingénieurs restent responsables du discernement et du déploiement.
Pour la recherche, notre équipe utilise Ultrafast afin d’explorer rapidement des sources de connaissances, d’interroger des données, ainsi que de recueillir, organiser et résumer des informations dans différents outils connectés. Dans un processus de recherche courant, les membres de notre équipe lancent une série d’expériences pendant la nuit, puis examinent les résultats le matin. Avec Ultrafast, cette boucle se resserre pour permettre plusieurs itérations au cours de la journée de travail.
Ultrafast marque la prochaine étape de notre partenariat avec Cerebras visant à apporter une inférence à latence ultra-faible à la plateforme d’OpenAI. Désormais, avec GPT‑5.6 Sol en mode Ultrafast, Cerebras prend en charge le modèle le plus intelligent d’OpenAI et fournit jusqu’à 750 jetons de sortie par seconde, permettant aux entreprises de créer des produits plus réactifs, de prendre des décisions plus rapides et d’intégrer directement une IA puissante à leurs processus les plus exigeants.
GPT‑5.6 Sol en mode Ultrafast est disponible dès aujourd’hui en avant-première limitée pour un groupe restreint de clients. Nous élargirons l’accès à mesure que la capacité augmentera. Inscrivez-vous pour recevoir les dernières informations.


