Anteprima di Ultrafast: GPT‑5.6 Sol fino a 14 volte più veloce
Una nuova classe di velocità per l'intelligenza di frontiera, che trasforma la rapidità in un vantaggio competitivo.
Oggi presentiamo in anteprima Ultrafast, un nuovo livello di servizio che esegue GPT‑5.6 Sol fino a 14 volte più velocemente rispetto all'elaborazione Standard e che sarà inizialmente disponibile nell'API di OpenAI. Basato su Cerebras, Ultrafast genera fino a 750 token di output al secondo, portando il nostro modello più intelligente nei prodotti e nei flussi di lavoro in cui ogni secondo conta.
Con GPT‑5.6 stiamo ampliando la frontiera delle capacità dei nostri modelli e li stiamo rendendo più efficienti a ogni livello del nostro stack. Questi miglioramenti hanno reso l'intelligenza avanzata più accessibile e più utile per più persone. Finora, per ottenere una velocità in tempo reale era generalmente necessario scegliere un modello più piccolo o più specializzato. Ultrafast indica una nuova direzione di sviluppo: più lavoro utile al secondo.
Quando la velocità non richiede più di rinunciare all'intelligenza, l'IA può entrare nelle aree aziendali in cui il tempo è più critico, rendendo possibili nuovi tipi di lavoro. Abbiamo già osservato alcuni scenari promettenti per Ultrafast:
- Risposta agli incidenti e affidabilità: quando un sistema critico si guasta, analizzare i log delle applicazioni, le modifiche recenti al codice e i rapporti degli ingegneri per individuare la probabile causa e contribuire a preparare una correzione mentre l'interruzione è ancora in corso.
- Ricerca finanziaria e sicurezza: analizzare i segnali di mercato, valutare le transazioni e individuare attività sospette mentre le condizioni continuano a cambiare.
- Assistenza clienti e voce: risolvere in tempo reale problemi complessi dei clienti senza interrompere la conversazione, anche quando trovare la risposta richiede più passaggi o sistemi.
- Commercio: rispondere alle domande sui prodotti, controllare le scorte, personalizzare i consigli e risolvere i problemi di pagamento mentre il cliente sta ancora decidendo, prima che un'esitazione si trasformi in un carrello abbandonato.
- Ricerca e sperimentazione in tempo reale: trasformare una ricerca che in precedenza richiedeva un'elaborazione notturna in una sessione di lavoro interattiva, consentendo ai team di verificare un'idea, esaminare i risultati, modificare l'approccio ed eseguire un altro esperimento senza interrompere il flusso di lavoro.
Durante il periodo di anteprima, collaboriamo con un primo gruppo di clienti per capire dove questa velocità faccia la differenza maggiore e come queste indicazioni possano orientare nel tempo lo sviluppo dei nostri prodotti. Se la tua azienda richiede intelligenza di frontiera alla massima velocità, puoi registrarti per ricevere una notifica quando l'accesso verrà esteso.
GPT‑5.6 Sol in modalità Ultrafast e Standard realizzano fianco a fianco un simulatore 3D funzionante di un magazzino a partire dallo stesso prompt testuale.
Abbiamo testato GPT‑5.6 Sol in modalità Ultrafast con un primo gruppo di aziende attive nella programmazione, nel commercio, nella ricerca finanziaria, nell'assistenza e in altre applicazioni interattive. Partire dai flussi di lavoro aziendali ci consente di studiare queste condizioni in ambienti di produzione reali. I loro primi progetti ci stanno aiutando a capire dove un aumento di velocità di un ordine di grandezza generi più valore e come cambino i prodotti quando il modello riesce a tenere il passo con chi lo utilizza. Useremo questi risultati per orientare la distribuzione con l'aumento della capacità.
All'interno di OpenAI, un gruppo di sviluppatori sta testando GPT‑5.6 Sol in modalità Ultrafast per capire quali flussi di lavoro traggano vantaggio da un'intelligenza di frontiera in grado di rispondere in tempo reale.
La risposta agli incidenti è uno degli ambiti in cui il nostro team utilizza Ultrafast. Quando scatta un avviso, gli ingegneri devono ricostruire un quadro accurato mentre il sistema e le evidenze continuano a cambiare. I team lo usano per leggere rapidamente i log, analizzare le tracce, sintetizzare le conversazioni, individuare i controlli successivi e contribuire a preparare o convalidare una correzione, il tutto in una frazione del tempo e con l'intelligenza di Sol. Riduce il tempo tra l'osservazione di un segnale, la verifica di un'ipotesi e la scelta dell'azione successiva, mentre la valutazione e la distribuzione restano responsabilità degli ingegneri.
Per la ricerca, il nostro team usa Ultrafast per consultare rapidamente fonti di conoscenza e dati, nonché per raccogliere, organizzare e riassumere informazioni attraverso strumenti connessi. Un flusso di lavoro comune nella ricerca prevede che i membri del nostro team avviino una serie di esperimenti durante la notte e ne esaminino i risultati al mattino. Con Ultrafast, questo ciclo si accorcia e può invece supportare più iterazioni nel corso della giornata lavorativa.
Ultrafast segna il passo successivo della nostra collaborazione con Cerebras per portare l'inferenza a latenza ultrabassa sulla piattaforma di OpenAI. Ora, con GPT‑5.6 Sol in modalità Ultrafast, Cerebras supporta il modello più intelligente di OpenAI, fornendo fino a 750 token di output al secondo e consentendo alle aziende di creare prodotti più reattivi, prendere decisioni più rapidamente e integrare una potente IA direttamente nei flussi di lavoro più impegnativi.
GPT‑5.6 Sol in modalità Ultrafast è disponibile da oggi in anteprima limitata per un gruppo selezionato di clienti. Estenderemo l'accesso con l'aumento della capacità. Registrati per ricevere aggiornamenti.


