Ugrás a fő tartalomra
OpenAI

Gyors mód API-ügyfelek számára

Gyors mód megbízható, erős sebességű teljesítményt nyújt a Go-alapú fizetés rugalmasságával. Legújabb élvonalbeli modellünk, GPT‑5.6‑Sol esetében, Gyors móddal akár 2,5-szer nagyobb sebességet érhetsz el.

A Gyors mód kiválasztásával a következőket érheted el:

  • Kiszámíthatóan alacsony késés: a Gyors mód gyorsabban és egyenletesebb sebességgel generálja a tokeneket, mint a Standard feldolgozás, még csúcsidőszakokban is.
  • Könnyen használható rugalmasság: a gyors mód, akárcsak a standard feldolgozás, rugalmas, használatalapú fizetési alapon érhető el, előzetes rendelkezés nélkül.

Megjegyzés: a prioritásos feldolgozás neve 2026. 07. 30-án gyors mód lett. Az API-kéréseiben használhatod a service_tier: priority vagy a service_tier: fast beállítást.

Short contextLong contextUptime SLA3Késés SLA3
Ár 1M beviteli tokenenkéntÁr 1 millió beviteli tokenenként (gyorsítótárazott)Ár 1 millió kimeneti tokenenkéntÁr 1M beviteli tokenenkéntÁr 1 millió beviteli tokenenként (gyorsítótárazott)Ár 1 millió kimeneti tokenenként
GPT-5.6 Sol
10,00 USD1,00 USD60,00 USD20,00 USD2,00 USD90,00 USD99,9%99% > 80 token/másodperc2
GPT-5.6 Terra
4,00 USD0,40 USD24,00 USD8,00 USD0,80 USD36,00 USD99,9%99% > 70 token/másodperc2
GPT-5.6 Luna
0,40 USD0,04 USD2,40 USD0,80 USD0,08 USD3,60 USD99,9%99% > 100 token/másodperc2
GPT-5.5
kizárja a hosszú kontextust1
12,50 USD1,250 USD75,00 USD99,9%99% > 50 token/másodperc2
GPT-5.4 mini
kizárja a hosszú kontextust1
1,50 USD0,150 USD9,00 USD99,9%99% > 100 token/másodperc2
GPT-5.4
kizárja a hosszú kontextust1
5,00 USD0,500 USD30,00 USD99,9%99% > 50 token/másodperc2
GPT-5.2
3,50 USD0,350 USD28,00 USD99,9%99% > 50 token/másodperc2
GPT-5.1
2,50 USD0,250 USD20,00 USD99,9%99% > 50 token/másodperc2
GPT-5
2,50 USD0,250 USD20,00 USD99,9%99% > 50 token/másodperc2
GPT-5 mini
0,45 USD0,045 USD3,60 USD99,9%99% > 80 token/másodperc2
GPT-5.1 codex
2,50 USD0,250 USD20,00 USD99,9%99% > 50 token/másodperc2
GPT-5 codex
2,50 USD0,250 USD20,00 USD99,9%99% > 50 token/másodperc2
GPT-4.1
3,50 USD0,875 USD14,00 USD99,9%99% > 80 token/másodperc2
GPT-4.1 mini
0,70 USD0,175 USD2,80 USD99,9%99% > 90 token/másodperc2
GPT-4.1 nano
0,20 USD0,050 USD0,80 USD99,9%99% > 100 token/másodperc2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
4,25 USD2,125 USD17,00 USD99,9%99% > 80 token/másodperc2
gpt-4o-2024-05-13
8,75 USD26,25 USD99,9%99% > 80 token/másodperc2
GPT-4o mini
0,25 USD0,125 USD1,00 USD99,9%99% > 90 token/másodperc2
o3
3,50 USD0,875 USD14,00 USD99,9%99% > 80 token/másodperc2
o4-mini
2,00 USD0,500 USD8,00 USD99,9%99% > 90 token/másodperc2
1A kérések becsült mennyisége: > 272 000 token
2A kérések p50 késését 5 perces alapon számítják ki. Azoknak az ügyfeleknek, akik már rendelkeznek vállalati megállapodásokkal, amelyek késési SLA-kat tartalmaznak, és amelyeket percenkénti p50 kérés késés alapján számítanak, a korábbi SLA-k is továbbra is érvényesek.
3Kizárólag az Enterprise ügyfeleknek érvényes

Hogyan működik

Az ügyfelek a meglévő service_tier paraméter használatával kérésenként irányíthatják a forgalmat a Gyors módra, a service_tier = "fast" opcióval.

A Gyors módban kiszolgált tokeneket tokenenként számlázzuk, a díjszabás pedig magasabb a szokásos feldolgozási díjaknál.

A kérés szintjén történő konfigurálás mellett a projektet alapértelmezettként beállíthatod Gyors módra a Projektbeállítások > alapértelmezett szolgáltatási szint: gyors menüpontban. Továbbra is felülbírálhatod kérésenként. A projektbeállításokban a Gyors kiválasztása egyenértékű a prioritás kiválasztásával.

Korlátozások

  • A Gyors mód használati korlátai megosztottak a többi szolgáltatási szinttel.
  • Ritka esetekben a Gyors mód percenkénti tokenjeinek hirtelen növekedése a rámpa sebességkorlátok eléréséhez vezethet. Ha túlléped a rámpa sebességkorlátját, akkor további forgalom kerülhet a Standard feldolgozásba.

Gyakran ismételt kérdések

Árképzés

Modellek

Korlátozások az adatforgalomra

Megbízhatóság

Irányelvek