Gå til hovedindhold
OpenAI

Hurtig tilstand for API-kunder

Hurtig tilstand tilbyder pålidelig ydeevne med høj hastighed og fleksibilitet til at betale efter forbrug. For GPT‑5.6 Sol kan du få adgang til hastigheder, der er op til 2,5 gange højere, med Hurtig tilstand.

Ved at vælge hurtig tilstand kan du låse op for:

  • Forudsigelig lav latenstid: Hurtig tilstand genererer tokens hurtigere og ved en mere stabil hastighed sammenlignet med standardbehandlingstjenesten, selv i perioder med stor efterspørgsel.

  • Brugervenlig fleksibilitet: Som med standardbehandling kan hurtig tilstand bruges fleksibelt på en betal efter forbrug-basis i stedet for at kræve forudgående ibrugtagning.

Bemærk: Prioritetsbehandling blev omdøbt til hurtig tilstand den 30.07.2026. Du kan bruge enten service_tier: priority eller service_tier: fast i dine API-anmodninger.

Kort kontekstLang kontekstServiceniveauaftale for oppetid3Serviceniveauaftale for latenstid3
Pris pr. 1 mio. input-tokensPris pr. 1 mio. input-tokens (cachelagret)Pris pr. 1 mio. output-tokensPris pr. 1 mio. input-tokensPris pr. 1 mio. input-tokens (cachelagret)Pris pr. 1 mio. output-tokens
GPT-6 Astra
20,00 US$2,00 US$100,00 US$40,00 US$4,00 US$150,00 US$——
GPT-6.1 Sol
4,00 US$0,20 US$20,00 US$8,00 US$0,40 US$30,00 US$——
GPT-6 Sol
4,00 US$0,40 US$20,00 US$8,00 US$0,80 US$30,00 US$——
GPT-6 Luna
0,20 US$0,02 US$1,00 US$0,40 US$0,04 US$1,50 US$——
GPT-5.6 Sol
8,00 US$0,80 US$40,00 US$16,00 US$1,60 US$60,00 US$99,9 %99 % > 80 tokens pr. sekund2
GPT-5.6 Terra
4,00 US$0,40 US$24,00 US$8,00 US$0,80 US$36,00 US$99,9 %99 % > 70 tokens pr. sekund2
GPT-5.6 Luna
0,40 US$0,04 US$2,40 US$0,80 US$0,08 US$3,60 US$99,9 %99 % > 100 tokens pr. sekund2
GPT-5.5
udelukker lang kontekst1
12,50 US$1,250 US$75,00 US$———99,9 %99 % > 50 tokens pr. sekund2
GPT-5.4 mini
udelukker lang kontekst1
1,50 US$0,150 US$9,00 US$———99,9 %99 % > 100 tokens pr. sekund2
GPT-5.4
udelukker lang kontekst1
5,00 US$0,500 US$30,00 US$———99,9 %99 % > 50 tokens pr. sekund2
GPT-5.2
3,50 US$0,350 US$28,00 US$———99,9 %99 % > 50 tokens pr. sekund2
GPT-5.1
2,50 US$0,250 US$20,00 US$———99,9 %99 % > 50 tokens pr. sekund2
GPT-5
2,50 US$0,250 US$20,00 US$———99,9 %99 % > 50 tokens pr. sekund2
GPT-5 mini
0,45 US$0,045 US$3,60 US$———99,9 %99 % > 80 tokens pr. sekund2
GPT-5.1 codex
2,50 US$0,250 US$20,00 US$———99,9 %99 % > 50 tokens pr. sekund2
GPT-5 codex
2,50 US$0,250 US$20,00 US$———99,9 %99 % > 50 tokens pr. sekund2
GPT-4.1
3,50 US$0,875 US$14,00 US$———99,9 %99 % > 80 tokens pr. sekund2
GPT-4.1 mini
0,70 US$0,175 US$2,80 US$———99,9 %99 % > 90 tokens pr. sekund2
GPT-4.1 nano
0,20 US$0,050 US$0,80 US$———99,9 %99 % > 100 tokens pr. sekund2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
4,25 US$2,125 US$17,00 US$———99,9 %99 % > 80 tokens pr. sekund2
gpt-4o-2024-05-13
8,75 US$—26,25 US$———99,9 %99 % > 80 tokens pr. sekund2
GPT-4o mini
0,25 US$0,125 US$1,00 US$———99,9 %99 % > 90 tokens pr. sekund2
o3
3,50 US$0,875 US$14,00 US$———99,9 %99 % > 80 tokens pr. sekund2
o4-mini
2,00 US$0,500 US$8,00 US$———99,9 %99 % > 90 tokens pr. sekund2
1Anmodninger anslået til >272.000 prompt-tokens
2Beregnet som p50 anmodningslatenstid pr. 5 minutter. For kunder med eksisterende virksomhedsaftaler, der har serviceniveauaftaler for latenstid beregnet som p50 anmodningslatens på minutbasis, gælder de tidligere serviceniveauaftaler også stadig.
3Dette gælder kun Enterprise-kunder

Sådan fungerer det

Kunder kan føre trafik til hurtig tilstand på basis af efterspørgsel ved brug af den eksisterende service_tier-parameter, med valgmuligheden service_tier = “fast”.

Tokens, der leveres af hurtig tilstand, vil blive faktureret på pr. token-basis og prissættes til en højere pris end priserne for standardbehandling.

Udover at være konfigureret på anmodningsniveau kan du også indstille et projekt til hurtig tilstand i Projektindstillinger → Standardserviceniveau: Hurtig. Du kan stadig tilsidesætte for hver anmodning. At vælge hurtig i dine projektindstillinger svarer til at vælge prioritet.

Begrænsninger

  • Brugsgrænserne for hurtig tilstand deles med andre serviceniveauer.

  • I sjældne tilfælde kan en hurtig stigning i antal tokens pr. minut for hurtig tilstand føre til, at brugshastighedsgrænserne nås. Hvis du overskrider denne brugshastighedsgrænse, kan yderligere trafik blive sendt til standardbehandling i stedet.

Ofte stillede spørgsmål

Priser

Modeller

Brugsgrænser

Driftssikkerhed

Politikker