Vai al contenuto principale
OpenAI

30 luglio 2026

Prodotto

Nuovi traguardi nel rapporto prezzo-prestazioni con GPT‑5.6

Rendendo più efficiente ogni livello, OpenAI offre più prestazioni per ogni dollaro investito in un maggior numero di carichi di lavoro aziendali.

Caricamento in corso...

Ieri abbiamo spiegato come GPT‑5.6 abbia contribuito a rendere più efficiente la propria esecuzione. Oggi trasferiamo questi vantaggi ai clienti, riducendo i prezzi di GPT‑5.6 Luna(si apre in una nuova finestra) e Terra(si apre in una nuova finestra) e aumentando la velocità di GPT‑5.6 Sol nell’API. Nel complesso, questi aggiornamenti consentono ai clienti di ottenere più valore da ogni dollaro investito nell’IA e di procedere più rapidamente quando il tempo è determinante.

Da oggi, GPT‑5.6 Luna, il nostro modello più veloce e conveniente, costerà l’80% in meno, mentre GPT‑5.6 Terra, il nostro modello bilanciato per il lavoro quotidiano, costerà il 20% in meno. I prezzi più bassi di Luna e Terra si riflettono anche nel conteggio dell’utilizzo rispetto agli abbonamenti a pagamento quando si usano Codex e ChatGPT Work. Luna offre alle aziende un modo molto più conveniente di gestire grandi volumi di lavoro mantenendo livelli qualitativi molto elevati. Può usare strumenti e completare flussi di lavoro in più passaggi, rendendo praticabile su larga scala una gamma più ampia di applicazioni di IA.

Rendere l’intelligenza avanzata più abbondante e accessibile è fondamentale per la missione di OpenAI: garantire che l’AGI porti benefici a tutta l’umanità. Queste modifiche traducono tale impegno in azioni concrete. Sono il risultato di anni di miglioramenti nel modo in cui sviluppiamo, distribuiamo e mettiamo al lavoro i nostri modelli.

Introduciamo inoltre la Modalità rapida nell’API, che sostituisce la nostra offerta Priority Processing. Per GPT‑5.6 Sol, la Modalità rapida offre ora velocità fino a 2,5 volte superiori rispetto all’elaborazione Standard, al doppio del prezzo e senza alcuna variazione del livello di ragionamento. La Modalità rapida è retrocompatibile: le richieste contrassegnate come priority la utilizzeranno automaticamente.

1 di 6
GPT‑5.6 Luna è quanto di più vicino abbiamo visto a un’intelligenza così economica da non richiedere neppure di misurarne il consumo. Non avevo mai visto un modello così conveniente essere anche così potente: sta rendendo possibili per Replit casi d’uso che non pensavamo di poter realizzare ancora per molto tempo.
Michele Catasta, Presidente & Head of AI, Replit

Adattare il livello di ragionamento al risultato

Usare l’IA in modo efficiente significa partire dal risultato. La rilevanza, il costo degli errori, l’urgenza e la scala determinano il giusto equilibrio tra livello di ragionamento, velocità, affidabilità e costo. Questo equilibrio può cambiare da un passaggio all’altro del flusso di lavoro.

GPT‑5.6 offre alle aziende molta più flessibilità per ottimizzare questa equazione. Luna offre prestazioni paragonabili a quelle dei modelli considerati di frontiera un anno fa, a un costo per attività pari a circa 6 centesimi per ogni dollaro e a una velocità quasi nove volte superiore. Nelle attività professionali misurate da Agents’ Last Exam, Luna supera Fable 5 con un costo stimato per attività inferiore di quasi il 99%.

In pratica, le aziende possono definire il risultato e lo standard qualitativo necessari, quindi usare le valutazioni per stabilire dove un livello di ragionamento superiore migliori concretamente il risultato e dove un’elaborazione più rapida ed economica possa offrire la stessa qualità. Un flusso di sviluppo software, per esempio, potrebbe usare Sol per risolvere le incertezze e definire il piano, quindi Luna per implementare modifiche ben specificate, scrivere ed eseguire test e valutare i risultati. Un altro flusso di lavoro potrebbe richiedere un equilibrio diverso.

La famiglia GPT‑5.6 amplia la gamma di possibilità disponibili. Le aziende possono applicare il massimo livello di ragionamento utile in ogni fase, pagando un prezzo commisurato al valore creato.

Per offrire questa flessibilità, occorre innanzitutto rendere più efficiente ogni livello alla base dei modelli.

Come facciamo avanzare la frontiera dell'efficienza

Il nostro vantaggio in termini di efficienza nasce dal miglioramento dei modelli, dei sistemi di inferenza che li eseguono e dell’infrastruttura agentica che li collega a strumenti e contesto. I modelli GPT‑5.6 seguono un percorso più diretto nello svolgimento delle attività. Un instradamento migliore mantiene produttivo l’hardware, il software di produzione ottimizzato genera token in modo più efficiente e una gestione più intelligente del contesto evita agli agenti di ripetere attività già completate. Nel complesso, questi miglioramenti ci permettono di svolgere più lavoro utile con la stessa capacità di calcolo, riducendo il tempo, i token e il costo necessari per ogni risultato.

GPT‑5.6 Sol ci aiuta sempre più a individuare e realizzare la prossima serie di miglioramenti. Nell’ambito di un processo guidato da persone, Sol ha riscritto e ottimizzato autonomamente kernel di produzione, progettato e condotto centinaia di esperimenti per migliorare la generazione di token e monitorato l’addestramento, intervenendo in caso di problemi. Il lavoro sui kernel ha contribuito a ridurre del 20% il costo end-to-end di erogazione del modello, mentre gli esperimenti hanno aumentato di oltre il 15% l’efficienza della generazione di token. Questo lavoro prosegue, creando un ciclo di feedback sempre più stretto: con il miglioramento dei nostri modelli e la loro crescente autonomia, aumenta anche la nostra capacità di accelerare i progressi in termini di efficienza. Scopri di più sull’ingegneria alla base di GPT‑5.6.

Una strategia di calcolo pensata per la scalabilità

Soddisfare la domanda di un’intelligenza sempre più disponibile richiede sia maggiore capacità di calcolo sia un suo impiego più produttivo. Stiamo costruendo un portafoglio infrastrutturale resiliente e assegnando ogni carico di lavoro ai sistemi più adatti a eseguirlo. Questo approccio sostiene entrambe le estremità della curva prezzo-prestazioni. Nella fascia più economica, i nuovi prezzi di Luna e Terra rendono conveniente gestire grandi volumi di lavoro su una scala molto più ampia. Nella fascia di frontiera, la Modalità rapida offre ai clienti API un accesso più veloce a Sol quando i tempi di risposta sono importanti.

Le aziende possono integrare maggiormente l’IA nelle operazioni quotidiane senza rinunciare alla velocità per le attività più importanti. L’analisi su larga scala dei documenti, la classificazione delle interazioni con i clienti e le implementazioni di routine possono diventare convenienti da eseguire su vasta scala, mentre i carichi di lavoro complessi di Sol possono procedere più rapidamente quando il sovrapprezzo è giustificato.

I vantaggi possono sommarsi. All’interno di un processo guidato da persone, modelli più capaci aiutano il nostro team tecnico a individuare la prossima generazione di miglioramenti, abbreviando il percorso verso prestazioni superiori e costi inferiori. La nostra strategia resta incentrata sul progresso congiunto di capacità ed efficienza, affinché ogni generazione di intelligenza possa svolgere più lavoro a un costo inferiore.

Disponibilità e prezzi

GPT‑5.6 Terra e Luna restano disponibili in ChatGPT Work, Codex e nell’API OpenAI. In ChatGPT Work e Codex, gli utenti Free e ChatGPT Go possono accedere a Terra, mentre gli utenti ChatGPT Plus, ChatGPT Pro, Business ed Enterprise possono scegliere Terra e Luna.

Dal 30 luglio, per Terra i prezzi dell’API saranno di 2 USD per milione di token di input e 12 USD per milione di token di output; per Luna saranno di 0,20 USD per milione di token di input e 1,20 USD per milione di token di output. Il prezzo di Sol resta invariato. I prezzi degli abbonamenti e le quote di utilizzo di ChatGPT e Codex restano invariati, mentre l’uso di Terra e Luna ora consuma meno crediti. Le variazioni dei prezzi inizieranno a essere applicate in AWS nel corso della giornata.

La Modalità rapida per GPT‑5.6 Sol sostituisce Priority Processing nell’API ed è allineata a /fast in Codex. Le richieste API esistenti contrassegnate come priority continueranno a funzionare. Consulta tutti i dettagli sui prezzi dell’API.

Autore

OpenAI