Ana içeriğe atla
OpenAI

API müşterileri için Hızlı mod

Hızlı mod, kullandıkça ödeme esnekliğiyle güvenilir ve yüksek hızlı performans sunar. En yeni ve en üst seviye modelimiz gpt-5.6-sol için Hızlı mod ile 2,5 kata kadar daha yüksek hıza erişebilirsiniz.

Hızlı modu seçerek şunlardan yararlanabilirsiniz:

  • Öngörülebilir düşük gecikme süresi: Hızlı mod, yoğun talep dönemlerinde bile Standart işlem hizmetine kıyasla token'ları daha hızlı ve daha tutarlı bir hızda üretir.
  • Kullanımı kolay esneklik: Standart işlemde olduğu gibi Hızlı moda da önceden kapasite ayırmanız gerekmeden esnek kullandıkça ödeme modeliyle erişebilirsiniz.

Not: Öncelikli işlem adı, 30 Temmuz 2026'da Hızlı mod olarak değiştirildi. API taleplerinizde service_tier: priority veya service_tier: fast değerlerinden birini kullanabilirsiniz.

1 milyon girdi tokeni başına fiyat1 milyon girdi tokeni başına fiyat (önbelleğe alınmış)1 milyon çıktı tokeni başına fiyatÇalışma Süresi SLA’sı3Gecikme Süresi SLA’sı3
GPT-5.6 Sol
uzun bağlam hariç1
$10,00$1,00$60,00%99,9%99 > saniye başına 80 token2
GPT-5.6 Terra
uzun bağlam hariç1
$4,00$0,40$24,00%99,9%99 > saniye başına 70 token2
GPT-5.6 Luna
uzun bağlam hariç1
$0,40$0,04$2,40%99,9%99 > saniye başına 100 token2
GPT-5.5
uzun bağlam hariç1
$12,50$1,250$75,00%99,9%99 > saniye başına 50 token2
GPT-5.4 mini
uzun bağlam hariç1
$1,50$0,150$9,00%99,9%99 > saniye başına 100 token2
GPT-5.4
uzun bağlam hariç1
$5,00$0,500$30,00%99,9%99 > saniye başına 50 token2
GPT-5.2
$3,50$0,350$28,00%99,9%99 > saniye başına 50 token2
GPT-5.1
$2,50$0,250$20,00%99,9%99 > saniye başına 50 token2
GPT-5
$2,50$0,250$20,00%99,9%99 > saniye başına 50 token2
GPT-5 mini
$0,45$0,045$3,60%99,9%99 > saniye başına 80 token2
GPT-5.1 codex
$2,50$0,250$20,00%99,9%99 > saniye başına 50 token2
GPT-5 codex
$2,50$0,250$20,00%99,9%99 > saniye başına 50 token2
GPT-4.1
$3,50$0,875$14,00%99,9%99 > saniye başına 80 token2
GPT-4.1 mini
$0,70$0,175$2,80%99,9%99 > saniye başına 90 token2
GPT-4.1 nano
$0,20$0,050$0,80%99,9%99 > saniye başına 100 token2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
$4,25$2,125$17,00%99,9%99 > saniye başına 80 token2
gpt-4o-2024-05-13
$8,75$26,25%99,9%99 > saniye başına 80 token2
GPT-4o mini
$0,25$0,125$1,00%99,9%99 > saniye başına 90 token2
o3
$3,50$0,875$14,00%99,9%99 > saniye başına 80 token2
o4-mini
$2,00$0,500$8,00%99,9%99 > saniye başına 90 token2
1Tahmini talep 272.000 ve üzeri prompt token
25 dakika başına p50 talep gecikme süresi olarak hesaplanır. Dakika başına p50 talep gecikme süresi olarak hesaplanan gecikme SLA’larına sahip mevcut kurumsal sözleşmeleri olan müşteriler için önceki SLA’lar da hala geçerlidir.
3Bu sadece Enterprise müşterileri için geçerlidir

Çalışma biçimi

Müşteriler, mevcut service_tier parametresini kullanarak talep bazında trafiği Hızlı moda yönlendirebilir. Bunun için service_tier = "fast" seçeneği kullanılabilir.

Hızlı mod ile işlenen token'lar, Standart işlem ücretlerine kıyasla token başına daha yüksek bir fiyattan faturalandırılır.

Hızlı modu talep düzeyinde yapılandırmanın yanı sıra, Proje ayarları > Varsayılan Hizmet Kademesi: Hızlı bölümünde bir projeyi varsayılan olarak Hızlı moda ayarlayabilirsiniz. Gerektiğinde her bir talep için farklı bir ayar kullanabilirsiniz. Proje ayarlarınızda Hızlı'yi seçmek, Öncelik'i seçmekle aynı anlama gelir.

Sınırlamalar

  • Hızlı işlem limitleri diğer hizmet kademeleriyle paylaşılır.
  • Nadir durumlarda, Hızlı mod için Dakika Başına Token miktarınızın hızlı artması, işlem artış hızı limitlerine takılmanıza neden olabilir. İşlem artış hızı limitini aşarsanız ek trafik bunun yerine Standart işleme yönlendirilebilir.

Sık sorulan sorular

Fiyatlandırma

Modeller

Hız limitleri

Güvenilirlik

Politikalar