Langkau ke kandungan utama
OpenAI

Mod Pantas untuk Pelanggan API

Mod Pantas menawarkan prestasi yang boleh dipercayai dan berkelajuan tinggi dengan fleksibiliti untuk membayar mengikut penggunaan. Untuk model perbatasan terbaharu kami, gpt-5.6-sol, anda boleh mengakses kelajuan sehingga 2.5x lebih pantas dengan mod Pantas.

Dengan memilih mod Pantas, anda boleh membuka kunci:

  • Kependaman rendah yang boleh dijangka: Mod Pantas menjana token dengan lebih cepat dan pada kelajuan yang lebih konsisten berbanding perkhidmatan pemprosesan Standard, walaupun semasa permintaan memuncak.
  • Fleksibiliti yang mudah digunakan: Seperti pemprosesan standard, mod Pantas boleh diakses secara fleksibel, bayar-sambil-anda guna tanpa memerlukan peruntukan awal.

Nota: pemprosesan Keutamaan telah dinamakan semula kepada mod Pantas pada 30 Julai 2026. Anda boleh menggunakan sama ada `service_tier: priority` atau `service_tier: fast` dalam permintaan API.

Harga bagi setiap 1J token inputHarga bagi setiap 1J token input (yang di-cache)Harga setiap 1J token outputSLA Beroperasi3SLA Kependaman3
GPT-5.6 Sol
tidak termasuk konteks panjang1
USD 10.00USD 1.00USD 60.0099.9%99% > 80 token setiap saat2
GPT-5.6 Terra
tidak termasuk konteks panjang1
USD 4.00USD 0.40USD 24.0099.9%99% > 70 token setiap saat2
GPT-5.6 Luna
tidak termasuk konteks panjang1
USD 0.40USD 0.04USD 2.4099.9%99% > 100 token setiap saat2
GPT-5.5
tidak termasuk konteks panjang1
USD 12.50USD 1.250USD 75.0099.9%99% > 50 token setiap saat2
GPT-5.4 mini
tidak termasuk konteks panjang1
USD 1.50USD 0.150USD 9.0099.9%99% > 100 token setiap saat2
GPT-5.4
tidak termasuk konteks panjang1
USD 5.00USD 0.500USD 30.0099.9%99% > 50 token setiap saat2
GPT-5.2
USD 3.50USD 0.350USD 28.0099.9%99% > 50 token setiap saat2
GPT-5.1
USD 2.50USD 0.250USD 20.0099.9%99% > 50 token setiap saat2
GPT-5
USD 2.50USD 0.250USD 20.0099.9%99% > 50 token setiap saat2
GPT-5 mini
USD 0.45USD 0.045USD 3.6099.9%99% > 80 token setiap saat2
GPT-5.1 codex
USD 2.50USD 0.250USD 20.0099.9%99% > 50 token setiap saat2
GPT-5 codex
USD 2.50USD 0.250USD 20.0099.9%99% > 50 token setiap saat2
GPT-4.1
USD 3.50USD 0.875USD 14.0099.9%99% > 80 token setiap saat2
GPT-4.1 mini
USD 0.70USD 0.175USD 2.8099.9%99% > 90 token setiap saat2
GPT-4.1 nano
USD 0.20USD 0.050USD 0.8099.9%99% > 100 token setiap saat2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
USD 4.25USD 2.125USD 17.0099.9%99% > 80 token setiap saat2
gpt-4o-2024-05-13
USD 8.75USD 26.2599.9%99% > 80 token setiap saat2
GPT-4o mini
USD 0.25USD 0.125USD 1.0099.9%99% > 90 token setiap saat2
o3
USD 3.50USD 0.875USD 14.0099.9%99% > 80 token setiap saat2
o4-mini
USD 2.00USD 0.500USD 8.0099.9%99% > 90 token setiap saat2
1Permintaan dianggarkan >272,000 token prom
2Dikira sebagai kependaman permintaan p50 pada asas setiap 5 minit. Untuk pelanggan dengan perjanjian perusahaan sedia ada yang mempunyai SLA kependaman yang dikira sebagai kependaman permintaan p50 pada asas setiap minit, SLA sebelumnya juga masih terpakai.
3Ini hanya terpakai kepada pelanggan Enterprise

Bagaimana ia berfungsi

Pelanggan boleh mengarahkan trafik kepada mod Pantas berdasarkan setiap permintaan menggunakan parameter service_tier yang sedia ada, dengan pilihan service_tier = "fast".

Token yang diproses melalui Mod Pantas akan dicaj berdasarkan setiap token, dengan harga premium berbanding kadar pemprosesan Standard.

Selain dikonfigurasikan pada peringkat permintaan, projek juga boleh ditetapkan secara lalai kepada mod Pantas dalam Tetapan Projek > Peringkat Perkhidmatan Lalai: Pantas. Anda masih boleh mengatasi tetapan bagi setiap permintaan. Memilih Pantas dalam tetapan projek anda adalah bersamaan dengan memilih Keutamaan.

Had

  • Had kadar mod Pantas dikongsi dengan tahap perkhidmatan lain.
  • Dalam kes yang jarang berlaku, peningkatan ketara kepada token mod Pantas setiap Minit boleh menyebabkan had kadar kenaikan dicapai. Jika anda melebihi had kadar kenaikan, trafik tambahan mungkin akan dihantar kepada pemprosesan Standard.

Soalan lazim

Harga

Model-model

Had kadar

Kebolehpercayaan

Dasar