Fast mode para sa mga customer ng API
Nag-aalok ang Fast mode ng maaasahan at high-speed na performance nang may flexibility na mag-pay-as-you-go. Para sa aming pinakabagong frontier na modelo, ang gpt-5.6-sol, maa-access mo ang mga speed na hanggang 2.5× na mas mabilis gamit ang Fast mode.
Sa pagpili ng Fast mode, puwede mong ma-unlock ang:
- Napeprediktang mababang latency: Ang Fast mode ay nakakapag-generate ng mga token nang mas mabilis at sa consistent na speed kaysa sa serbisyong Standard processing, kahit sa oras ng pinakamataas na demand.
- Madaling gamitin na flexibility: Tulad ng Standard processing, maa-access ang Fast mode nang flexible at pay-as-you-go, sa halip na mag-require ng advance na provisioning.
Tandaan: Pinalitan ang pangalan ng Priority processing at ginawang Fast mode noong Hulyo 30, 2026. Puwede mong gamitin ang alinman sa service_tier: priority o service_tier: fast sa iyong mga request sa API.
| Short context | Long context | Uptime SLA3 | Latency SLA3 | |||||
|---|---|---|---|---|---|---|---|---|
| Presyo kada 1M input token | Presyo kada 1M input token (naka-cache) | Presyo kada 1M output token | Presyo kada 1M input token | Presyo kada 1M input token (naka-cache) | Presyo kada 1M output token | |||
GPT-5.6 Sol | $10.00 | $1.00 | $60.00 | $20.00 | $2.00 | $90.00 | 99.9% | 99% > 80 token kada segundo2 |
GPT-5.6 Terra | $4.00 | $0.40 | $24.00 | $8.00 | $0.80 | $36.00 | 99.9% | 99% > 70 token kada segundo2 |
GPT-5.6 Luna | $0.40 | $0.04 | $2.40 | $0.80 | $0.08 | $3.60 | 99.9% | 99% > 100 token kada segundo2 |
GPT-5.5 hindi kasama ang mahabang konteksto1 | $12.50 | $1.250 | $75.00 | — | — | — | 99.9% | 99% > 50 token kada segundo2 |
GPT-5.4 mini hindi kasama ang mahabang konteksto1 | $1.50 | $0.150 | $9.00 | — | — | — | 99.9% | 99% > 100 token kada segundo2 |
GPT-5.4 hindi kasama ang mahabang konteksto1 | $5.00 | $0.500 | $30.00 | — | — | — | 99.9% | 99% > 50 token kada segundo2 |
GPT-5.2 | $3.50 | $0.350 | $28.00 | — | — | — | 99.9% | 99% > 50 token kada segundo2 |
GPT-5.1 | $2.50 | $0.250 | $20.00 | — | — | — | 99.9% | 99% > 50 token kada segundo2 |
GPT-5 | $2.50 | $0.250 | $20.00 | — | — | — | 99.9% | 99% > 50 token kada segundo2 |
GPT-5 mini | $0.45 | $0.045 | $3.60 | — | — | — | 99.9% | 99% > 80 token kada segundo2 |
GPT-5.1 codex | $2.50 | $0.250 | $20.00 | — | — | — | 99.9% | 99% > 50 token kada segundo2 |
GPT-5 codex | $2.50 | $0.250 | $20.00 | — | — | — | 99.9% | 99% > 50 token kada segundo2 |
GPT-4.1 | $3.50 | $0.875 | $14.00 | — | — | — | 99.9% | 99% > 80 token kada segundo2 |
GPT-4.1 mini | $0.70 | $0.175 | $2.80 | — | — | — | 99.9% | 99% > 90 token kada segundo2 |
GPT-4.1 nano | $0.20 | $0.050 | $0.80 | — | — | — | 99.9% | 99% > 100 token kada segundo2 |
GPT-4o gpt-4o-2024-11-20 gpt-4o-2024-08-06 | $4.25 | $2.125 | $17.00 | — | — | — | 99.9% | 99% > 80 token kada segundo2 |
gpt-4o-2024-05-13 | $8.75 | — | $26.25 | — | — | — | 99.9% | 99% > 80 token kada segundo2 |
GPT-4o mini | $0.25 | $0.125 | $1.00 | — | — | — | 99.9% | 99% > 90 token kada segundo2 |
o3 | $3.50 | $0.875 | $14.00 | — | — | — | 99.9% | 99% > 80 token kada segundo2 |
o4-mini | $2.00 | $0.500 | $8.00 | — | — | — | 99.9% | 99% > 90 token kada segundo2 |
Paano ito gumagana
Puwedeng idirekta ng mga customer ang trapiko sa Fast mode kada request gamit ang existing na parameter na service_tier, nang may opsyon na service_tier = "fast".
Ang mga token na pinoproseso gamit ang Fast mode ay ibi-bill kada token, nang may premium na presyo kumpara sa mga rate ng Standard processing.
Dagdag pa sa pagkaka-configure sa antas ng request, puwede mo ring mag-default ng proyekto sa Fast mode sa mga setting ng proyekto > Default na Antas ng Serbisyo: Fast. Puwede ka pa ring mag-override kada request. Ang pag-select sa Fast sa mga setting ng iyong proyekto ay katumbas ng pagpili sa Priority.
Mga limitasyon
- Ang mga rate limit ng Fast mode ay naka-share sa iba pang antas ng serbisyo.
- Sa mga bihirang pagkakataon, ang mabilis na pagtaas ng iyong Mga Token kada Minuto sa Fast mode ay maaaring magresulta sa pag-abot sa mga rate limit ng ramp. Kung lalampas ka sa rate limit ng ramp, maaaring ipadala ang karagdagang trapiko sa Standard processing.