Siirry pääsisältöön
OpenAI

Nopea tila API-asiakkaille

Nopea tila tarjoaa luotettavaa ja nopeaa suorituskykyä sekä joustavuutta maksaa käytön mukaan. Uusimmalle edistyneelle mallillemme, gpt-5.6-sol, voit saada käyttöösi jopa 2,5 kertaa nopeammat nopeudet Nopea tila -toiminnon avulla.

Nopea tila avaa seuraavat ominaisuudet:

  • Ennustettavasti vähäinen viive: Nopea tila luo tokenit nopeammin ja tasaisemmalla nopeudella kuin vakiokäsittelypalvelu, jopa huippukysynnän aikana.
  • Helppokäyttöinen joustavuus: Kuten vakiokäsittelyä, myös nopeaa tilaa voidaan käyttää joustavasti ja maksuperusteisesti sen sijaan, että se edellyttäisi etukäteisvalmistelua.

Huomautus: Prioriteettikäsittelyn nimeksi muutettiin Nopea tila 30.7.2026. Voit käyttää API-pyynnöissäsi joko arvoa service_tier: priority tai service_tier: fast.

Short contextLong contextKäytettävyysajan palvelutasosopimus (SLA)3Viiveen palvelutasosopimus (SLA)3
Hinta per 1M syötetunnistettaHinta per 1M syötetunnistetta (välimuistissa olevaa)Hinta per 1M tuotostunnistettaHinta per 1M syötetunnistettaHinta per 1M syötetunnistetta (välimuistissa olevaa)Hinta per 1M tuotostunnistetta
GPT-5.6 Sol
10,00 $1,00 $60,00 $20,00 $2,00 $90,00 $99,9 %99 % > 80 tunnistetta sekunnissa2
GPT-5.6 Terra
4,00 $0,40 $24,00 $8,00 $0,80 $36,00 $99,9 %99 % > 70 tunnistetta sekunnissa2
GPT-5.6 Luna
0,40 $0,04 $2,40 $0,80 $0,08 $3,60 $99,9 %99 % > 100 tunnistetta sekunnissa2
GPT-5.5
ei sisällä pitkää kontekstia1
12,50 $1,250 $75,00 $99,9 %99 % > 50 tunnistetta sekunnissa2
GPT-5.4 mini
ei sisällä pitkää kontekstia1
1,50 $0,150 $9,00 $99,9 %99 % > 100 tunnistetta sekunnissa2
GPT-5.4
ei sisällä pitkää kontekstia1
5,00 $0,500 $30,00 $99,9 %99 % > 50 tunnistetta sekunnissa2
GPT-5.2
3,50 $0,350 $28,00 $99,9 %99 % > 50 tunnistetta sekunnissa2
GPT-5.1
2,50 $0,250 $20,00 $99,9 %99 % > 50 tunnistetta sekunnissa2
GPT-5
2,50 $0,250 $20,00 $99,9 %99 % > 50 tunnistetta sekunnissa2
GPT-5 mini
0,45 $0,045 $3,60 $99,9 %99 % > 80 tunnistetta sekunnissa2
GPT-5.1 codex
2,50 $0,250 $20,00 $99,9 %99 % > 50 tunnistetta sekunnissa2
GPT-5 codex
2,50 $0,250 $20,00 $99,9 %99 % > 50 tunnistetta sekunnissa2
GPT-4.1
3,50 $0,875 $14,00 $99,9 %99 % > 80 tunnistetta sekunnissa2
GPT-4.1 mini
0,70 $0,175 $2,80 $99,9 %99 % > 90 tunnistetta sekunnissa2
GPT-4.1 nano
0,20 $0,050 $0,80 $99,9 %99 % > 100 tunnistetta sekunnissa2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
4,25 $2,125 $17,00 $99,9 %99 % > 80 tunnistetta sekunnissa2
gpt-4o-2024-05-13
8,75 $26,25 $99,9 %99 % > 80 tunnistetta sekunnissa2
GPT-4o mini
0,25 $0,125 $1,00 $99,9 %99 % > 90 tunnistetta sekunnissa2
o3
3,50 $0,875 $14,00 $99,9 %99 % > 80 tunnistetta sekunnissa2
o4-mini
2,00 $0,500 $8,00 $99,9 %99 % > 90 tunnistetta sekunnissa2
1Pyyntöjä arviolta yli 272 000 kehotemerkkiä
2Lasketaan p50-pyynnön viiveenä 5 minuutin välein. Asiakkailla, joilla on voimassa oleva yrityssopimus, jossa viiveen SLA lasketaan p50-pyynnön viiveenä minuutin välein, aiemmat SLA-määritykset ovat yhä voimassa.
3Sovellettavissa vain Enterprise-asiakkaille

Miten se toimii

Asiakkaat voivat ohjata liikennettä nopeaan tilaan pyyntökohtaisesti käyttämällä olemassa olevaa service_tier-parametria, jossa on vaihtoehtona service_tier = "fast".

Nopean tilan kautta toimitetut tokenit laskutetaan tokenkohtaisesti, ja niiden hinta on korkeampi kuin vakiokäsittelyn.

Sen lisäksi, että voit määrittää sen pyyntökohtaisesti, voit myös asettaa projektin oletusasetukseksi nopean tilan valikossa Projektin asetukset → Oletuspalvelutaso: Nopea. Voit edelleen ohittaa pyyntökohtaisesti. Projektiasetuksissa Nopea-vaihtoehdon valitseminen vastaa Prioriteetti-vaihtoehdon valitsemista.

Rajoitukset

  • Nopean tilan pyyntörajat jaetaan muiden palvelutasojen kanssa.
  • Jos nopean tilan tokenien määrä minuutissa kasvaa nopeasti, se voi harvinaisissa tilanteissa ylittää nousun pyyntörajat. Jos ylität nousun pyyntörajan, ylimääräinen liikenne voidaan lähettää vakiokäsittelyyn.

Usein kysytyt kysymykset

Hinnoittelu

Mallit

Käyttörajoitukset

Luotettavuus

Käytännöt