Liwati menyang isi utama
OpenAI

Mode Cepet kanggo Pelanggan API

Mode cepet nawakake kinerja sing andal lan kacepetan dhuwur kanthi keluwesan kanggo mbayar miturut panggunaan. Kanggo model frontier paling anyar saka kita, gpt-5.6-sol, njenengan bisa ngakses kacepetan nganti 2.5x luwih cepet nganggo mode cepet.

Kanthi milih mode Cepet, bisa mbukak akses menyang:

  • Latensi endhek sing bisa dipredhiksi: Mode Cepet ngasilaké token luwih cepet lan kanthi kacepetan sing luwih konsisten tinimbang layanan Pamrosesan Standar, sanajan nalika panjaluk puncak.
  • Fleksibilitas sing gampang digunakake: Kaya pamrosesan Standar, mode Cepet bisa diakses kanthi fleksibel kanthi model mbayar miturut panggunaan, tinimbang mbutuhake penyediaan luwih dhisik.

Pangeling: Pangolahan Prioritas diowahi jeneng dadi Mode Cepet tanggal 30 Juli 2026. Bisa nggunakake salah siji service_tier: priority utawa service_tier: fast ing panjaluk API.

Short contextLong contextSLA wektu aktif3SLA Latensi3
Rega saben 1 yuta token inputRega saben 1 yuta token input (cached)Rega saben 1 yuta token outputRega saben 1 yuta token inputRega saben 1 yuta token input (cached)Rega saben 1 yuta token output
GPT-5.6 Sol
US$ 10,00US$ 1,00US$ 60,00US$ 20,00US$ 2,00US$ 90,0099,9%99% > 80 token saben detik2
GPT-5.6 Terra
US$ 4,00US$ 0,40US$ 24,00US$ 8,00US$ 0,80US$ 36,0099,9%99% > 70 token saben detik2
GPT-5.6 Luna
US$ 0,40US$ 0,04US$ 2,40US$ 0,80US$ 0,08US$ 3,6099,9%99% > 100 token saben detik2
GPT-5.5
ora kalebu konteks dawa1
US$ 12,50US$ 1,250US$ 75,0099,9%99% > 50 token saben detik2
GPT-5.4 mini
ora kalebu konteks dawa1
US$ 1,50US$ 0,150US$ 9,0099,9%99% > 100 token saben detik2
GPT-5.4
ora kalebu konteks dawa1
US$ 5,00US$ 0,500US$ 30,0099,9%99% > 50 token saben detik2
GPT-5.2
US$ 3,50US$ 0,350US$ 28,0099,9%99% > 50 token saben detik2
GPT-5.1
US$ 2,50US$ 0,250US$ 20,0099,9%99% > 50 token saben detik2
GPT-5
US$ 2,50US$ 0,250US$ 20,0099,9%99% > 50 token saben detik2
GPT-5 mini
US$ 0,45US$ 0,045US$ 3,6099,9%99% > 80 token saben detik2
GPT-5.1 codex
US$ 2,50US$ 0,250US$ 20,0099,9%99% > 50 token saben detik2
GPT-5 codex
US$ 2,50US$ 0,250US$ 20,0099,9%99% > 50 token saben detik2
GPT-4.1
US$ 3,50US$ 0,875US$ 14,0099,9%99% > 80 token saben detik2
GPT-4.1 mini
US$ 0,70US$ 0,175US$ 2,8099,9%99% > 90 token saben detik2
GPT-4.1 nano
US$ 0,20US$ 0,050US$ 0,8099,9%99% > 100 token saben detik2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
US$ 4,25US$ 2,125US$ 17,0099,9%99% > 80 token saben detik2
gpt-4o-2024-05-13
US$ 8,75US$ 26,2599,9%99% > 80 token saben detik2
GPT-4o mini
US$ 0,25US$ 0,125US$ 1,0099,9%99% > 90 token saben detik2
o3
US$ 3,50US$ 0,875US$ 14,0099,9%99% > 80 token saben detik2
o4-mini
US$ 2,00US$ 0,500US$ 8,0099,9%99% > 90 token saben detik2
1Panjaluk sing diprakirakaké >272K prompt token
2Diitung minangka latensi panjalukan p50 adhedhasar saben 5 menit. Kanggo pelanggan sing nduwèni perjanjian enterprise sing wis ana lan nduwèni SLA latensi sing diitung minangka latensi panjaluk p50 adhedhasar saben menit, SLA sadurungé uga isih tetep ditrapaké.
3Iki mung ditrapake kanggo pelanggan Enterprise wae

Cara kerjane

Pelanggan bisa ngarahaké trafik menyang mode Fast adhedhasar saben panjaluk nganggo parameter service_tier sing wis ana, kanthi opsi service_tier = "fast".

Token-token sing dilayani nganggo mode Cepet bakal ditagih saben token, kanthi rega luwih dhuwur tinimbang tarif pamrosesan standar.

Saliyane dikonfigurasi ing tingkat panjaluk, uga bisa nggawe proyek dadi mode Cepet kanthi gawan ing Setelan proyek > Tingkat Layanan Gawan: Cepet. Njenengan isih bisa nimpa kanggo saben panjaluk. Milih Cepet ing setelan proyek uga padha karo milih Prioritas.

Watesan

  • Watesan laju mode cepet dienggo bareng karo tingkat layanan liyane.
  • Ing kasus sing arang kedadeyan, paningkatan kanthi cepet ing token saben menit mode cepet bisa nyebabake tekan watesan laju paningkatan. Yen njenengan ngluwihi watesan laju ramp, trafik tambahan bisa dikirim menyang pamrosesan Standar minangka gantine.

Pitakonan sing asring ditakokake

Regane

Model

Watesan laju

Keandalan

Kabijakan