Gå til hovedindhold
OpenAI

Hurtig tilstand for API-kunder

Hurtig tilstand tilbyder pålidelig ydeevne med høj hastighed og fleksibilitet til at betale efter forbrug. For vores nyeste banebrydende model, gpt-5.6-sol, kan du få adgang til hastigheder, der er op til 2,5 gange hurtigere, med hurtig tilstand.

Ved at vælge hurtig tilstand kan du låse op for:

  • Forudsigelig lav latenstid: Hurtig tilstand genererer tokens hurtigere og ved en mere stabil hastighed sammenlignet med standardbehandlingstjenesten, selv i perioder med stor efterspørgsel.
  • Brugervenlig fleksibilitet: Som med standardbehandling kan hurtig tilstand bruges fleksibelt på en betal efter forbrug-basis i stedet for at kræve forudgående ibrugtagning.

Bemærk: Prioritetsbehandling blev omdøbt til hurtig tilstand den 30.07.2026. Du kan bruge enten service_tier: priority eller service_tier: fast i dine API-anmodninger.

Short contextLong contextServiceniveauaftale for oppetid3Serviceniveauaftale for latenstid3
Pris pr. 1 mio. input-tokensPris pr. 1 mio. input-tokens (cachelagret)Pris pr. 1 mio. output-tokensPris pr. 1 mio. input-tokensPris pr. 1 mio. input-tokens (cachelagret)Pris pr. 1 mio. output-tokens
GPT-5.6 Sol
10,00 US$1,00 US$60,00 US$20,00 US$2,00 US$90,00 US$99,9 %99 % > 80 tokens pr. sekund2
GPT-5.6 Terra
4,00 US$0,40 US$24,00 US$8,00 US$0,80 US$36,00 US$99,9 %99 % > 70 tokens pr. sekund2
GPT-5.6 Luna
0,40 US$0,04 US$2,40 US$0,80 US$0,08 US$3,60 US$99,9 %99 % > 100 tokens pr. sekund2
GPT-5.5
udelukker lang kontekst1
12,50 US$1,250 US$75,00 US$99,9 %99 % > 50 tokens pr. sekund2
GPT-5.4 mini
udelukker lang kontekst1
1,50 US$0,150 US$9,00 US$99,9 %99 % > 100 tokens pr. sekund2
GPT-5.4
udelukker lang kontekst1
5,00 US$0,500 US$30,00 US$99,9 %99 % > 50 tokens pr. sekund2
GPT-5.2
3,50 US$0,350 US$28,00 US$99,9 %99 % > 50 tokens pr. sekund2
GPT-5.1
2,50 US$0,250 US$20,00 US$99,9 %99 % > 50 tokens pr. sekund2
GPT-5
2,50 US$0,250 US$20,00 US$99,9 %99 % > 50 tokens pr. sekund2
GPT-5 mini
0,45 US$0,045 US$3,60 US$99,9 %99 % > 80 tokens pr. sekund2
GPT-5.1 codex
2,50 US$0,250 US$20,00 US$99,9 %99 % > 50 tokens pr. sekund2
GPT-5 codex
2,50 US$0,250 US$20,00 US$99,9 %99 % > 50 tokens pr. sekund2
GPT-4.1
3,50 US$0,875 US$14,00 US$99,9 %99 % > 80 tokens pr. sekund2
GPT-4.1 mini
0,70 US$0,175 US$2,80 US$99,9 %99 % > 90 tokens pr. sekund2
GPT-4.1 nano
0,20 US$0,050 US$0,80 US$99,9 %99 % > 100 tokens pr. sekund2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
4,25 US$2,125 US$17,00 US$99,9 %99 % > 80 tokens pr. sekund2
gpt-4o-2024-05-13
8,75 US$26,25 US$99,9 %99 % > 80 tokens pr. sekund2
GPT-4o mini
0,25 US$0,125 US$1,00 US$99,9 %99 % > 90 tokens pr. sekund2
o3
3,50 US$0,875 US$14,00 US$99,9 %99 % > 80 tokens pr. sekund2
o4-mini
2,00 US$0,500 US$8,00 US$99,9 %99 % > 90 tokens pr. sekund2
1Anmodninger anslået til >272.000 prompt-tokens
2Beregnet som p50 anmodningslatenstid pr. 5 minutter. For kunder med eksisterende virksomhedsaftaler, der har serviceniveauaftaler for latenstid beregnet som p50 anmodningslatens på minutbasis, gælder de tidligere serviceniveauaftaler også stadig.
3Dette gælder kun Enterprise-kunder

Sådan fungerer det

Kunder kan føre trafik til hurtig tilstand på basis af efterspørgsel ved brug af den eksisterende service_tier-parameter, med valgmuligheden service_tier = “fast”.

Tokens, der leveres af hurtig tilstand, vil blive faktureret på pr. token-basis og prissættes til en højere pris end priserne for standardbehandling.

Udover at være konfigureret på anmodningsniveau kan du også indstille et projekt til hurtig tilstand i Projektindstillinger → Standardserviceniveau: Hurtig. Du kan stadig tilsidesætte for hver anmodning. At vælge hurtig i dine projektindstillinger svarer til at vælge prioritet.

Begrænsninger

  • Brugsgrænserne for hurtig tilstand deles med andre serviceniveauer.
  • I sjældne tilfælde kan en hurtig stigning i antal tokens pr. minut for hurtig tilstand føre til, at brugshastighedsgrænserne nås. Hvis du overskrider denne brugshastighedsgrænse, kan yderligere trafik blive sendt til standardbehandling i stedet.

Ofte stillede spørgsmål

Priser

Modeller

Brugsgrænser

Driftssikkerhed

Politikker