Hurtig tilstand for API-kunder
Hurtig tilstand tilbyder pålidelig ydeevne med høj hastighed og fleksibilitet til at betale efter forbrug. For vores nyeste banebrydende model, gpt-5.6-sol, kan du få adgang til hastigheder, der er op til 2,5 gange hurtigere, med hurtig tilstand.
Ved at vælge hurtig tilstand kan du låse op for:
- Forudsigelig lav latenstid: Hurtig tilstand genererer tokens hurtigere og ved en mere stabil hastighed sammenlignet med standardbehandlingstjenesten, selv i perioder med stor efterspørgsel.
- Brugervenlig fleksibilitet: Som med standardbehandling kan hurtig tilstand bruges fleksibelt på en betal efter forbrug-basis i stedet for at kræve forudgående ibrugtagning.
Bemærk: Prioritetsbehandling blev omdøbt til hurtig tilstand den 30.07.2026. Du kan bruge enten service_tier: priority eller service_tier: fast i dine API-anmodninger.
| Short context | Long context | Serviceniveauaftale for oppetid3 | Serviceniveauaftale for latenstid3 | |||||
|---|---|---|---|---|---|---|---|---|
| Pris pr. 1 mio. input-tokens | Pris pr. 1 mio. input-tokens (cachelagret) | Pris pr. 1 mio. output-tokens | Pris pr. 1 mio. input-tokens | Pris pr. 1 mio. input-tokens (cachelagret) | Pris pr. 1 mio. output-tokens | |||
GPT-5.6 Sol | 10,00 US$ | 1,00 US$ | 60,00 US$ | 20,00 US$ | 2,00 US$ | 90,00 US$ | 99,9 % | 99 % > 80 tokens pr. sekund2 |
GPT-5.6 Terra | 4,00 US$ | 0,40 US$ | 24,00 US$ | 8,00 US$ | 0,80 US$ | 36,00 US$ | 99,9 % | 99 % > 70 tokens pr. sekund2 |
GPT-5.6 Luna | 0,40 US$ | 0,04 US$ | 2,40 US$ | 0,80 US$ | 0,08 US$ | 3,60 US$ | 99,9 % | 99 % > 100 tokens pr. sekund2 |
GPT-5.5 udelukker lang kontekst1 | 12,50 US$ | 1,250 US$ | 75,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens pr. sekund2 |
GPT-5.4 mini udelukker lang kontekst1 | 1,50 US$ | 0,150 US$ | 9,00 US$ | — | — | — | 99,9 % | 99 % > 100 tokens pr. sekund2 |
GPT-5.4 udelukker lang kontekst1 | 5,00 US$ | 0,500 US$ | 30,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens pr. sekund2 |
GPT-5.2 | 3,50 US$ | 0,350 US$ | 28,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens pr. sekund2 |
GPT-5.1 | 2,50 US$ | 0,250 US$ | 20,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens pr. sekund2 |
GPT-5 | 2,50 US$ | 0,250 US$ | 20,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens pr. sekund2 |
GPT-5 mini | 0,45 US$ | 0,045 US$ | 3,60 US$ | — | — | — | 99,9 % | 99 % > 80 tokens pr. sekund2 |
GPT-5.1 codex | 2,50 US$ | 0,250 US$ | 20,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens pr. sekund2 |
GPT-5 codex | 2,50 US$ | 0,250 US$ | 20,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens pr. sekund2 |
GPT-4.1 | 3,50 US$ | 0,875 US$ | 14,00 US$ | — | — | — | 99,9 % | 99 % > 80 tokens pr. sekund2 |
GPT-4.1 mini | 0,70 US$ | 0,175 US$ | 2,80 US$ | — | — | — | 99,9 % | 99 % > 90 tokens pr. sekund2 |
GPT-4.1 nano | 0,20 US$ | 0,050 US$ | 0,80 US$ | — | — | — | 99,9 % | 99 % > 100 tokens pr. sekund2 |
GPT-4o gpt-4o-2024-11-20 gpt-4o-2024-08-06 | 4,25 US$ | 2,125 US$ | 17,00 US$ | — | — | — | 99,9 % | 99 % > 80 tokens pr. sekund2 |
gpt-4o-2024-05-13 | 8,75 US$ | — | 26,25 US$ | — | — | — | 99,9 % | 99 % > 80 tokens pr. sekund2 |
GPT-4o mini | 0,25 US$ | 0,125 US$ | 1,00 US$ | — | — | — | 99,9 % | 99 % > 90 tokens pr. sekund2 |
o3 | 3,50 US$ | 0,875 US$ | 14,00 US$ | — | — | — | 99,9 % | 99 % > 80 tokens pr. sekund2 |
o4-mini | 2,00 US$ | 0,500 US$ | 8,00 US$ | — | — | — | 99,9 % | 99 % > 90 tokens pr. sekund2 |
Sådan fungerer det
Kunder kan føre trafik til hurtig tilstand på basis af efterspørgsel ved brug af den eksisterende service_tier-parameter, med valgmuligheden service_tier = “fast”.
Tokens, der leveres af hurtig tilstand, vil blive faktureret på pr. token-basis og prissættes til en højere pris end priserne for standardbehandling.
Udover at være konfigureret på anmodningsniveau kan du også indstille et projekt til hurtig tilstand i Projektindstillinger → Standardserviceniveau: Hurtig. Du kan stadig tilsidesætte for hver anmodning. At vælge hurtig i dine projektindstillinger svarer til at vælge prioritet.
Begrænsninger
- Brugsgrænserne for hurtig tilstand deles med andre serviceniveauer.
- I sjældne tilfælde kan en hurtig stigning i antal tokens pr. minut for hurtig tilstand føre til, at brugshastighedsgrænserne nås. Hvis du overskrider denne brugshastighedsgrænse, kan yderligere trafik blive sendt til standardbehandling i stedet.