Snabbläge för API-kunder
Snabbläget erbjuder pålitlig höghastighetsprestanda och flexibiliteten att betala per användning. För vår senaste banbrytande modell gpt-5.6-sol kan du få tillgång till upp till 2,5 gånger snabbare hastigheter med Snabbläge.
Genom att välja Snabbläge får du tillgång till:
- Förutsägbar låg latens: Snabbläge genererar tokens snabbare och med en mer jämn hastighet än standardbearbetningstjänsten, även under perioder med hög efterfrågan.
- Användarvänlig flexibilitet: Precis som standardbehandling är användning av Snabbläge flexibel med betalning per användning utan krav på förhandsregistrering.
Obs: Prioriterad bearbetning bytte namn till Snabbläge den 30 juli 2026. Du kan använda antingen service_tier: priority eller service_tier: fast i dina API-förfrågningar.
| Short context | Long context | Drifttid SLA3 | Latens SLA3 | |||||
|---|---|---|---|---|---|---|---|---|
| Pris per 1 miljon indatatokens | Pris per 1 miljon indatatokens (cachade) | Pris per 1 miljon utdatatokens | Pris per 1 miljon indatatokens | Pris per 1 miljon indatatokens (cachade) | Pris per 1 miljon utdatatokens | |||
GPT-5.6 Sol | 10,00 US$ | 1,00 US$ | 60,00 US$ | 20,00 US$ | 2,00 US$ | 90,00 US$ | 99,9 % | 99 % > 80 tokens per sekund2 |
GPT-5.6 Terra | 4,00 US$ | 0,40 US$ | 24,00 US$ | 8,00 US$ | 0,80 US$ | 36,00 US$ | 99,9 % | 99 % > 70 tokens per sekund2 |
GPT-5.6 Luna | 0,40 US$ | 0,04 US$ | 2,40 US$ | 0,80 US$ | 0,08 US$ | 3,60 US$ | 99,9 % | 99 % > 100 tokens per sekund2 |
GPT-5.5 exkluderar lång kontext1 | 12,50 US$ | 1,250 US$ | 75,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens per sekund2 |
GPT-5.4 mini exkluderar lång kontext1 | 1,50 US$ | 0,150 US$ | 9,00 US$ | — | — | — | 99,9 % | 99 % > 100 tokens per sekund2 |
GPT-5.4 exkluderar lång kontext1 | 5,00 US$ | 0,500 US$ | 30,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens per sekund2 |
GPT-5.2 | 3,50 US$ | 0,350 US$ | 28,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens per sekund2 |
GPT-5.1 | 2,50 US$ | 0,250 US$ | 20,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens per sekund2 |
GPT-5 | 2,50 US$ | 0,250 US$ | 20,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens per sekund2 |
GPT-5 mini | 0,45 US$ | 0,045 US$ | 3,60 US$ | — | — | — | 99,9 % | 99 % > 80 tokens per sekund2 |
GPT-5.1 codex | 2,50 US$ | 0,250 US$ | 20,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens per sekund2 |
GPT-5 codex | 2,50 US$ | 0,250 US$ | 20,00 US$ | — | — | — | 99,9 % | 99 % > 50 tokens per sekund2 |
GPT-4.1 | 3,50 US$ | 0,875 US$ | 14,00 US$ | — | — | — | 99,9 % | 99 % > 80 tokens per sekund2 |
GPT-4.1 mini | 0,70 US$ | 0,175 US$ | 2,80 US$ | — | — | — | 99,9 % | 99 % > 90 tokens per sekund2 |
GPT-4.1 nano | 0,20 US$ | 0,050 US$ | 0,80 US$ | — | — | — | 99,9 % | 99 % > 100 tokens per sekund2 |
GPT-4o gpt-4o-2024-11-20 gpt-4o-2024-08-06 | 4,25 US$ | 2,125 US$ | 17,00 US$ | — | — | — | 99,9 % | 99 % > 80 tokens per sekund2 |
gpt-4o-2024-05-13 | 8,75 US$ | — | 26,25 US$ | — | — | — | 99,9 % | 99 % > 80 tokens per sekund2 |
GPT-4o mini | 0,25 US$ | 0,125 US$ | 1,00 US$ | — | — | — | 99,9 % | 99 % > 90 tokens per sekund2 |
o3 | 3,50 US$ | 0,875 US$ | 14,00 US$ | — | — | — | 99,9 % | 99 % > 80 tokens per sekund2 |
o4-mini | 2,00 US$ | 0,500 US$ | 8,00 US$ | — | — | — | 99,9 % | 99 % > 90 tokens per sekund2 |
Så här fungerar det
Kunder kan dirigera trafik till Snabbläge per begäran med hjälp av den befintliga parametern service_tier och alternativet service_tier = "fast".
Tokens som hanteras av Snabbläge debiteras per token med ett premiumpris i förhållande till de vanliga bearbetningspriserna.
Förutom att konfigureras på begärannivå kan du även ställa in ett projekt på Snabbläge som standard via "Projektinställningar" > "Standardtjänstnivå: Snabb". Du kan fortfarande åsidosätta för varje begäran. Att välja "Snabb" bland dina projektinställningar är detsamma som att välja "Prioritet".
Begränsningar
- Hastighetsgränser för Snabbläge delas med andra servicenivåer.
- I sällsynta fall kan en snabb ökning av tokens för Snabbläge per minut leda till att gränser för ökningsfrekvens överskrids. Om denna gräns överskrids kan ytterligare trafik skickas till standardbearbetning istället.