Pāriet uz galveno saturu
OpenAI

Ātrais režīms API klientiem

Ātrais režīms piedāvā uzticamu, ātrdarbīgu veiktspēju ar elastīgu iespēju maksāt atbilstoši lietojumam. Mūsu jaunākajam robežšķirtnes modelim, gpt-5.6-sol, Tu vari piekļūt līdz pat 2,5× lielākam ātrumam, izmantojot Ātro režīmu.

Izvēloties Ātro režīmu, tu vari iegūt šādas priekšrocības:

  • Prognozējami zems latentums: Ātrais režīms ģenerē tekstvienības ātrāk un ar vienmērīgāku ātrumu nekā standarta apstrādes pakalpojums, pat pieprasījuma maksimuma laikā.
  • Ērta un elastīga lietošana: tāpat kā standarta apstrādei, arī Ātrais režīms ir pieejams elastīgi — maksā tikai par to, ko izmanto, bez iepriekšējas rezervēšanas.

Piezīme: Prioritārā apstrāde 2026. gada 30. jūlijā tika pārdēvēta par Ātro režīmu. Savos API pieprasījumos varat izmantot vai nu service_tier: priority, vai service_tier: fast.

Short contextLong contextDarbspējas laika pakalpojumu līmeņa nolīgums (SLA)3Latentuma pakalpojumu līmeņa nolīgums3
Cena par 1 miljonu ievades tekstvienībuCena par 1 miljonu ievades tekstvienību (kešatmiņā)Cena par 1<br/>miljonu izvades tekstvienībuCena par 1 miljonu ievades tekstvienībuCena par 1 miljonu ievades tekstvienību (kešatmiņā)Cena par 1<br/>miljonu izvades tekstvienību
GPT-5.6 Sol
10,00 $1,00 $60,00 $20,00 $2,00 $90,00 $99,9%99% > 80 tokeni sekundē2
GPT-5.6 Terra
4,00 $0,40 $24,00 $8,00 $0,80 $36,00 $99,9%99% > 70 tokeni sekundē2
GPT-5.6 Luna
0,40 $0,04 $2,40 $0,80 $0,08 $3,60 $99,9%99% > 100 tokeni sekundē2
GPT-5.5
izslēdz garo kontekstu1
12,50 $1,250 $75,00 $99,9%99% > 50 tokeni sekundē2
GPT-5.4 mini
izslēdz garo kontekstu1
1,50 $0,150 $9,00 $99,9%99% > 100 tokeni sekundē2
GPT-5.4
izslēdz garo kontekstu1
5,00 $0,500 $30,00 $99,9%99% > 50 tokeni sekundē2
GPT-5.2
3,50 $0,350 $28,00 $99,9%99% > 50 tokeni sekundē2
GPT-5.1
2,50 $0,250 $20,00 $99,9%99% > 50 tokeni sekundē2
GPT-5
2,50 $0,250 $20,00 $99,9%99% > 50 tokeni sekundē2
GPT-5 mini
0,45 $0,045 $3,60 $99,9%99% > 80 tokeni sekundē2
GPT-5.1 codex
2,50 $0,250 $20,00 $99,9%99% > 50 tokeni sekundē2
GPT-5 codex
2,50 $0,250 $20,00 $99,9%99% > 50 tokeni sekundē2
GPT-4.1
3,50 $0,875 $14,00 $99,9%99% > 80 tokeni sekundē2
GPT-4.1 mini
0,70 $0,175 $2,80 $99,9%99% > 90 tokeni sekundē2
GPT-4.1 nano
0,20 $0,050 $0,80 $99,9%99% > 100 tokeni sekundē2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
4,25 $2,125 $17,00 $99,9%99% > 80 tokeni sekundē2
gpt-4o-2024-05-13
8,75 $26,25 $99,9%99% > 80 tokeni sekundē2
GPT-4o mini
0,25 $0,125 $1,00 $99,9%99% > 90 tokeni sekundē2
o3
3,50 $0,875 $14,00 $99,9%99% > 80 tokeni sekundē2
o4-mini
2,00 $0,500 $8,00 $99,9%99% > 90 tokeni sekundē2
1Pieprasījumu aplēse ir > 272 000 uzvednes tekstvienību
2Aprēķināts kā p50 pieprasījuma latentums uz katrām 5 minūtēm. Klientiem, kuriem ir spēkā esoši uzņēmuma līgumi, kuros latentuma SLA aprēķināti kā p50 pieprasījuma latentums minūtes intervālā, joprojām ir spēkā iepriekšējie SLA.
3Tas attiecas tikai uz Enterprise klientiem

Kā tas darbojas

Tu vari novirzīt trafiku uz Ātro režīmu katra pieprasījuma pamatā, izmantojot esošo parametru service_tier ar opciju service_tier = "fast".

Ātrajā režīmā apstrādātās tekstvienības tiks apmaksātas par katru tekstvienību atsevišķi, un to cena būs augstāka nekā standarta apstrādes likmēm.

Papildus tam, ka konfigurāciju var veikt pieprasījuma līmenī, tu vari arī iestatīt projekta noklusējumu uz Ātro režīmu sadaļā Projekta iestatījumi > Noklusējuma pakalpojuma līmenis: ātrs. Joprojām var arī mainīt katru pieprasījumu atsevišķi. Opcijas “Ātri” atlasīšana projekta iestatījumos ir līdzvērtīga opcijas “Prioritāte” atlasīšanai.

Ierobežojumi.

  • Ātrā režīma darbības ierobežojumi tiek koplietoti ar citiem pakalpojuma līmeņiem.
  • Retos gadījumos straujš ātrā režīma tekstvienību skaita pieaugums minūtē var novest pie darbības ierobežojumu sasniegšanas. Ja tiek pārsniegts ātruma ierobežojums, tad papildu trafiks var tikt nosūtīts uz standarta apstrādi.

Bieži uzdotie jautājumi

Izcenojums

Modeļi

Ātruma ierobežojumi

Uzticamība

Politika