Salta al contingut principal
OpenAI

Mode ràpid per als clients de l'API

El mode ràpid ofereix un rendiment fiable i d'alta velocitat amb la flexibilitat de pagar quan es vulgui. Per al nostre model d’avantguarda més recent, gpt-5.6-sol, pots accedir a velocitats fins a 2,5 vegades més ràpides amb el mode ràpid.

Triant el mode ràpid, pots desbloquejar:

  • Latència baixa previsible: el mode ràpid genera segments amb més rapidesa i a una velocitat més constant que el servei de processament estàndard, fins i tot durant els pics de demanda.
  • Flexibilitat fàcil d’utilitzar: igual que amb el processament estàndard, pots accedir al mode ràpid de manera flexible i amb pagament per ús, en comptes d'haver de recórrer a un aprovisionament previ.

Nota: el processament prioritari va passar a anomenar-se "mode ràpid" el 30 de juliol de 2026. Pots utilitzar tant service_tier: priority com service_tier: fast a les teves sol·licituds d’API.

Preu per milió de segments d'entradaPreu per milió de segments d'entrada (a la memòria cau)Preu per un milió de segments de sortidaSLA de temps d'activitat3SLA de latència3
GPT-5.6 Sol
exclou el context llarg1
10,00 USD1,00 USD60,00 USD99,9 %99 % > 80 segments per segon2
GPT-5.6 Terra
exclou el context llarg1
4,00 USD0,40 USD24,00 USD99,9 %99 % > 70 segments per segon2
GPT-5.6 Luna
exclou el context llarg1
0,40 USD0,04 USD2,40 USD99,9 %99 % > 100 segments per segon2
GPT-5.5
exclou el context llarg1
12,50 USD1,250 USD75,00 USD99,9 %99 % > 50 segments per segon2
GPT-5.4 mini
exclou el context llarg1
1,50 USD0,150 USD9,00 USD99,9 %99 % > 100 segments per segon2
GPT-5.4
exclou el context llarg1
5,00 USD0,500 USD30,00 USD99,9 %99 % > 50 segments per segon2
GPT-5.2
3,50 USD0,350 USD28,00 USD99,9 %99 % > 50 segments per segon2
GPT-5.1
2,50 USD0,250 USD20,00 USD99,9 %99 % > 50 segments per segon2
GPT-5
2,50 USD0,250 USD20,00 USD99,9 %99 % > 50 segments per segon2
GPT-5 mini
0,45 USD0,045 USD3,60 USD99,9 %99 % > 80 segments per segon2
GPT-5.1 codex
2,50 USD0,250 USD20,00 USD99,9 %99 % > 50 segments per segon2
GPT-5 codex
2,50 USD0,250 USD20,00 USD99,9 %99 % > 50 segments per segon2
GPT-4.1
3,50 USD0,875 USD14,00 USD99,9 %99 % > 80 segments per segon2
GPT-4.1 mini
0,70 USD0,175 USD2,80 USD99,9 %99 % > 90 segments per segon2
GPT-4.1 nano
0,20 USD0,050 USD0,80 USD99,9 %99 % > 100 segments per segon2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
4,25 USD2,125 USD17,00 USD99,9 %99 % > 80 segments per segon2
gpt-4o-2024-05-13
8,75 USD26,25 USD99,9 %99 % > 80 segments per segon2
GPT-4o mini
0,25 USD0,125 USD1,00 USD99,9 %99 % > 90 segments per segon2
o3
3,50 USD0,875 USD14,00 USD99,9 %99 % > 80 segments per segon2
o4-mini
2,00 USD0,500 USD8,00 USD99,9 %99 % > 90 segments per segon2
1Sol·licituds estimades a >272.000 segments d'indicació
2Calculat com a latència de sol·licitud p50 per cada període de 5 minuts. Per als clients amb acords d'empresa existents que tenen SLA de latència calculats com la latència de sol·licitud p50 per minut, els SLA anteriors també continuen sent aplicables.
3Això només s'aplica als clients Enterprise

Com funciona

Pots dirigir el trànsit al mode ràpid per a cada sol·licitud mitjançant el paràmetre existent service_tier, amb l’opció service_tier = "fast".

Els segments servits pel mode ràpid es facturaran per segment, amb un preu superior respecte de les tarifes del processament estàndard.

A més de configurar-ho al nivell de la sol·licitud, també pots establir un projecte en mode ràpid de manera predeterminada a Configuració del projecte > Nivell de servei predeterminat: Ràpid. Ho podràs continuar sobreescrivint per a cada sol·licitud. Seleccionar Ràpid a la configuració del projecte equival a seleccionar Prioritat.

Limitacions

  • Els límits de peticions del mode ràpid es comparteixen amb altres nivells de servei.
  • En casos poc freqüents, els augments ràpids dels segments per minut del mode ràpid poden provocar que s’arribi als límits de peticions d’increment progressiu. Si se supera el límit de la taxa d'increment, el trànsit addicional es pot enviar al processament estàndard.

Preguntes freqüents

Preus

Models

Límit de peticions

Fiabilitat

Polítiques