Aperçu du mode Ultrafast : GPT‑5.6 Sol jusqu’à 14× plus vite
Une nouvelle classe de vitesse pour l’intelligence de pointe, qui transforme la vitesse en avantage concurrentiel.
Aujourd’hui, nous présentons en avant-première Ultrafast, une nouvelle offre qui exécute GPT‑5.6 Sol jusqu’à 14× plus vite que le traitement Standard et qui sera d’abord lancée dans l’API OpenAI. Propulsé par Cerebras, Ultrafast génère jusqu’à 750 jetons de sortie par seconde, rendant notre modèle le plus intelligent accessible aux produits et aux flux de travail où chaque seconde compte.
Avec GPT‑5.6, nous repoussons les limites de ce que nos modèles peuvent accomplir et les rendons plus efficaces à chaque niveau de notre infrastructure. Ces améliorations ont rendu l’intelligence avancée plus abordable et plus utile à davantage de personnes. Jusqu’à présent, obtenir une vitesse en temps réel signifiait généralement choisir un modèle plus petit ou plus spécialisé. Ultrafast ouvre une nouvelle voie : plus de travail utile par seconde.
Lorsque la vitesse n’exige plus de sacrifier l’intelligence, l’IA peut s’intégrer aux activités les plus urgentes d’une entreprise et rendre possibles de nouvelles formes de travail. Nous avons déjà observé des scénarios prometteurs pour Ultrafast :
- Intervention en cas d’incident et fiabilité : Lorsqu’un système critique tombe en panne, analyser les journaux d’application, les changements de code récents et les rapports des ingénieurs afin de cerner la cause probable et d’aider à préparer un correctif pendant que la panne est toujours en cours.
- Recherche financière et sécurité : Analyser les signaux du marché, évaluer les transactions et détecter les activités suspectes pendant que les conditions évoluent encore.
- Soutien à la clientèle et voix : Résoudre en temps réel les problèmes complexes des clients sans interrompre la conversation, même lorsque trouver la réponse exige plusieurs étapes ou systèmes.
- Commerce : Répondre aux questions sur les produits, vérifier les stocks, personnaliser les recommandations et résoudre les problèmes de paiement pendant que la personne magasine encore, avant que son hésitation ne mène à l’abandon du panier.
- Recherche et expérimentation en direct : Transformer une recherche qui exigeait auparavant une exécution nocturne en séance de travail interactive, afin que les équipes puissent tester une idée, examiner les résultats, ajuster leur approche et mener une autre expérience sans interrompre leur élan.
Pendant la période d’aperçu, nous collaborons avec un premier groupe de clients pour comprendre où cette vitesse fait la plus grande différence et comment ces apprentissages peuvent orienter nos produits au fil du temps. Si votre entreprise a besoin d’une intelligence de pointe à la vitesse la plus élevée, vous pouvez vous inscrire pour être avisé lorsque l’accès sera élargi.
GPT‑5.6 Sol en modes Ultrafast et standard crée côte à côte un simulateur fonctionnel d’entrepôt 3D à partir de la même invite textuelle.
Nous testons GPT‑5.6 Sol en mode Ultrafast avec un premier groupe d’entreprises dans les domaines de la programmation, du commerce, de la recherche financière, du soutien et d’autres applications interactives. Commencer par les flux de travail d’entreprise nous permet d’étudier ces conditions dans de véritables environnements de production. Leurs premiers travaux nous aident à comprendre où un changement d’un ordre de grandeur de la vitesse crée le plus de valeur et comment les produits évoluent lorsque le modèle peut suivre le rythme de la personne qui l’utilise. Nous utiliserons ces conclusions pour orienter le déploiement à mesure que la capacité augmentera.
Au sein d’OpenAI, un groupe de développeurs teste GPT‑5.6 Sol en mode Ultrafast afin de déterminer quels flux de travail bénéficient d’une intelligence de pointe capable de répondre en temps réel.
L’intervention en cas d’incident est un exemple d’utilisation d’Ultrafast par notre équipe. Lorsqu’une alerte se déclenche, les ingénieurs doivent établir un portrait précis pendant que le système et les données probantes évoluent encore. Les équipes l’utilisent pour lire rapidement les journaux, analyser les traces, synthétiser les conversations, déterminer les prochaines vérifications et aider à préparer ou à valider un correctif, le tout en une fraction du temps grâce à l’intelligence de Sol. Il réduit le délai entre l’observation d’un signal, la vérification d’une hypothèse et le choix de l’action suivante, tandis que les ingénieurs demeurent responsables du jugement et du déploiement.
Pour la recherche, notre équipe utilise Ultrafast afin de parcourir rapidement des sources de connaissances, d’interroger des données ainsi que de recueillir, d’organiser et de résumer rapidement l’information provenant d’outils connectés. Un flux de travail courant en recherche consiste, pour les membres de notre équipe, à lancer une série d’expériences durant la nuit, puis à examiner les résultats le matin. Avec Ultrafast, nous voyons cette boucle se resserrer pour permettre plutôt plusieurs itérations pendant la journée de travail.
Ultrafast marque la prochaine étape de notre partenariat avec Cerebras visant à offrir une inférence à latence ultrafaible sur la plateforme d’OpenAI. Maintenant, avec GPT‑5.6 Sol en mode Ultrafast, Cerebras prend en charge le modèle le plus intelligent d’OpenAI et produit jusqu’à 750 jetons de sortie par seconde, permettant aux entreprises de créer des produits plus réactifs, de prendre des décisions plus rapidement et d’intégrer directement une IA puissante à leurs flux de travail les plus exigeants.
GPT‑5.6 Sol en mode Ultrafast est offert dès aujourd’hui en aperçu limité à un groupe sélectionné de clients. Nous élargirons l’accès à mesure que la capacité augmentera. Inscrivez-vous aux mises à jour.


