API ਗਾਹਕਾਂ ਲਈ ਫਾਸਟ ਮੋਡ
ਫਾਸਟ ਮੋਡ ਵਰਤੋਂ ਅਨੁਸਾਰ ਭੁਗਤਾਨ ਕਰਨ ਦੀ ਸਹੂਲਤ ਦੇ ਨਾਲ ਭਰੋਸੇਯੋਗ ਅਤੇ ਤੇਜ਼ ਰਫਤਾਰ ਕਾਰਗੁਜ਼ਾਰੀ ਦੀ ਪੇਸ਼ਕਸ਼ ਕਰਦਾ ਹੈ। ਸਾਡੇ ਨਵੀਨਤਮ ਅਤਿ-ਆਧੁਨਿਕ ਮਾਡਲ, gpt-5.6-sol, ਲਈ, ਤੁਸੀਂ ਫਾਸਟ ਮੋਡ ਨਾਲ 2.5 ਗੁਣਾ ਤੱਕ ਵਧੇਰੇ ਤੇਜ਼ ਗਤੀ ਪ੍ਰਾਪਤ ਕਰ ਸਕਦੇ ਹੋ।
ਫਾਸਟ ਮੋਡ ਨੂੰ ਚੁਣ ਕੇ, ਤੁਸੀਂ ਇਹ ਲਾਭ ਪ੍ਰਾਪਤ ਕਰ ਸਕਦੇ ਹੋ:
- ਅਨੁਮਾਨਯੋਗ ਤੌਰ 'ਤੇ ਘੱਟ ਲੇਟੈਂਸੀ: ਫਾਸਟ ਮੋਡ ਟੋਕਨ ਨੂੰ ਸਟੈਂਡਰਡ ਪ੍ਰੋਸੈਸਿੰਗ ਸੇਵਾ ਨਾਲੋਂ ਤੇਜ਼ ਅਤੇ ਹੋਰ ਇਕਸਾਰ ਗਤੀ ਨਾਲ ਜਨਰੇਟ ਕਰਦੀ ਹੈ, ਇੱਥੋਂ ਤੱਕ ਕਿ ਉੱਚ ਮੰਗ ਦੇ ਸਮੇਂ ਵੀ।
- ਵਰਤੋਂ ਵਿੱਚ ਸਰਲ ਅਤੇ ਸੁਵਿਧਾਜਨਕ: ਸਟੈਂਡਰਡ ਪ੍ਰੋਸੈਸਿੰਗ ਵਾਂਗ, ਫਾਸਟ ਮੋਡ ਨੂੰ ਪਹਿਲਾਂ ਤੋਂ ਪ੍ਰੋਵਿਜ਼ਨਿੰਗ ਦੀ ਲੋੜ ਤੋਂ ਬਿਨ੍ਹਾਂ ਵਰਤੋਂ ਅਨੁਸਾਰ ਭੁਗਤਾਨ ਦੇ ਆਧਾਰ 'ਤੇ ਐਕਸੈਸ ਕੀਤਾ ਜਾ ਸਕਦਾ ਹੈ।
ਨੋਟ: ਪ੍ਰਾਇਓਰਿਟੀ ਪ੍ਰੋਸੈਸਿੰਗ ਦਾ ਨਾਮ 30 ਜੁਲਾਈ, 2026 ਨੂੰ ਫਾਸਟ ਮੋਡ ਰੱਖਿਆ ਗਿਆ ਸੀ। ਤੁਸੀਂ ਆਪਣੀਆਂ API ਬੇਨਤੀਆਂ ਵਿੱਚ service_tier: ਪ੍ਰਾਇਓਰਿਟੀ ਜਾਂ service_tier: ਫਾਸਟ ਵਿੱਚੋਂ ਕੋਈ ਵੀ ਵਰਤ ਸਕਦੇ ਹੋ।
| Short context | Long context | ਅਪਟਾਈਮ SLA3 | ਲੇਟੈਂਸੀ SLA3 | |||||
|---|---|---|---|---|---|---|---|---|
| ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਇਨਪੁਟ ਟੋਕਨ ਕੀਮਤ | ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਇਨਪੁਟ ਟੋਕਨ ਕੀਮਤ (ਕੈਸ਼ਡ) | ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਆਉਟਪੁੱਟ ਟੋਕਨ ਕੀਮਤ | ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਇਨਪੁਟ ਟੋਕਨ ਕੀਮਤ | ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਇਨਪੁਟ ਟੋਕਨ ਕੀਮਤ (ਕੈਸ਼ਡ) | ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਆਉਟਪੁੱਟ ਟੋਕਨ ਕੀਮਤ | |||
GPT-5.6 Sol | US$10.00 | US$1.00 | US$60.00 | US$20.00 | US$2.00 | US$90.00 | 99.9% | 99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5.6 Terra | US$4.00 | US$0.40 | US$24.00 | US$8.00 | US$0.80 | US$36.00 | 99.9% | 99% > 70 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5.6 Luna | US$0.40 | US$0.04 | US$2.40 | US$0.80 | US$0.08 | US$3.60 | 99.9% | 99% > 100 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5.5 ਲੰਬੇ ਸੰਦਰਭ1 ਨੂੰ ਸ਼ਾਮਲ ਨਹੀਂ ਕਰਦਾ | US$12.50 | US$1.250 | US$75.00 | — | — | — | 99.9% | 99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5.4 mini ਲੰਬੇ ਸੰਦਰਭ1 ਨੂੰ ਸ਼ਾਮਲ ਨਹੀਂ ਕਰਦਾ | US$1.50 | US$0.150 | US$9.00 | — | — | — | 99.9% | 99% > 100 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5.4 ਲੰਬੇ ਸੰਦਰਭ1 ਨੂੰ ਸ਼ਾਮਲ ਨਹੀਂ ਕਰਦਾ | US$5.00 | US$0.500 | US$30.00 | — | — | — | 99.9% | 99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5.2 | US$3.50 | US$0.350 | US$28.00 | — | — | — | 99.9% | 99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5.1 | US$2.50 | US$0.250 | US$20.00 | — | — | — | 99.9% | 99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5 | US$2.50 | US$0.250 | US$20.00 | — | — | — | 99.9% | 99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5 mini | US$0.45 | US$0.045 | US$3.60 | — | — | — | 99.9% | 99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5.1 codex | US$2.50 | US$0.250 | US$20.00 | — | — | — | 99.9% | 99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-5 codex | US$2.50 | US$0.250 | US$20.00 | — | — | — | 99.9% | 99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-4.1 | US$3.50 | US$0.875 | US$14.00 | — | — | — | 99.9% | 99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-4.1 mini | US$0.70 | US$0.175 | US$2.80 | — | — | — | 99.9% | 99% > 90 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-4.1 nano | US$0.20 | US$0.050 | US$0.80 | — | — | — | 99.9% | 99% > 100 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-4o gpt-4o-2024-11-20 gpt-4o-2024-08-06 | US$4.25 | US$2.125 | US$17.00 | — | — | — | 99.9% | 99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
gpt-4o-2024-05-13 | US$8.75 | — | US$26.25 | — | — | — | 99.9% | 99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
GPT-4o mini | US$0.25 | US$0.125 | US$1.00 | — | — | — | 99.9% | 99% > 90 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
o3 | US$3.50 | US$0.875 | US$14.00 | — | — | — | 99.9% | 99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
o4-mini | US$2.00 | US$0.500 | US$8.00 | — | — | — | 99.9% | 99% > 90 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2 |
ਇਹ ਕਿਵੇਂ ਕੰਮ ਕਰਦਾ ਹੈ
ਗਾਹਕ ਮੌਜੂਦਾ service_tier ਪੈਰਾਮੀਟਰ ਦੀ ਵਰਤੋਂ ਕਰਕੇ, service_tier = "ਫਾਸਟ" ਵਿਕਲਪ ਦੇ ਨਾਲ, ਪ੍ਰਤੀ ਬੇਨਤੀ ਦੇ ਆਧਾਰ 'ਤੇ ਟ੍ਰੈਫਿਕ ਨੂੰ ਫਾਸਟ ਮੋਡ ਪ੍ਰੋਸੈਸਿੰਗ ਵੱਲ ਭੇਜ ਸਕਦੇ ਹਨ।
ਫਾਸਟ ਮੋਡ ਦੁਆਰਾ ਸੇਵਾ ਕੀਤੇ ਟੋਕਨ ਦਾ ਬਿਲ ਪ੍ਰਤੀ-ਟੋਕਨ ਆਧਾਰ 'ਤੇ ਕੀਤਾ ਜਾਵੇਗਾ, ਜਿਸਦੀ ਕੀਮਤ ਸਟੈਂਡਰਡ ਪ੍ਰੋਸੈਸਿੰਗ ਦਰਾਂ ਨਾਲੋਂ ਪ੍ਰੀਮੀਅਮ ਹੋਵੇਗੀ।
ਬੇਨਤੀ ਪੱਧਰ 'ਤੇ ਕੌਂਫਿਗਰ ਕੀਤੇ ਜਾਣ ਤੋਂ ਇਲਾਵਾ, ਤੁਸੀਂ ਪ੍ਰੋਜੈਕਟ ਸੈਟਿੰਗਾਂ → ਡਿਫੌਲਟ ਸਰਵਿਸ ਪੱਧਰ: ਫਾਸਟ ਵਿੱਚ ਕਿਸੇ ਪ੍ਰੋਜੈਕਟ ਲਈ ਡਿਫੌਲਟ ਨੂੰ ਫਾਸਟ ਮੋਡ ਵਜੋਂ ਵੀ ਸੈੱਟ ਕਰ ਸਕਦੇ ਹੋ। ਤੁਸੀਂ ਫਿਰ ਵੀ ਪ੍ਰਤੀ ਬੇਨਤੀ ਓਵਰਰਾਈਡ ਕਰ ਸਕਦੇ ਹੋ। ਤੁਹਾਡੇ ਪ੍ਰੋਜੈਕਟ ਸੈਟਿੰਗਾਂ ਵਿੱਚ ਫਾਸਟ ਚੁਣਨਾ ਪ੍ਰਾਇਓਰਿਟੀ ਚੁਣਨ ਦੇ ਬਰਾਬਰ ਹੈ।
ਸੀਮਾਵਾਂ
- ਫਾਸਟ ਮੋਡ ਦੀਆਂ ਰੇਟ ਲਿਮਿਟਾਂ ਹੋਰ ਸੇਵਾ ਪੱਧਰਾਂ ਨਾਲ ਸਾਂਝੀਆਂ ਹੁੰਦੀਆਂ ਹਨ।
- ਦੁਰਲੱਭ ਮਾਮਲਿਆਂ ਵਿੱਚ, ਜੇਕਰ ਤੁਹਾਡੇ ਫਾਸਟ ਮੋਡ ਦੇ ਟੋਕਨ ਪ੍ਰਤੀ ਮਿੰਟ ਵਿੱਚ ਬਹੁਤ ਤੇਜ਼ੀ ਨਾਲ ਵਾਧਾ ਹੁੰਦਾ ਹੈ, ਤਾਂ ਤੁਸੀਂ ਰੈਂਪ ਰੇਟ ਲਿਮਿਟਾਂ ਤੱਕ ਪਹੁੰਚ ਸਕਦੇ ਹੋ। ਜੇਕਰ ਤੁਸੀਂ ਰੈਂਪ ਰੇਟ ਲਿਮਿਟ ਨੂੰ ਪਾਰ ਕਰ ਜਾਂਦੇ ਹੋ, ਤਾਂ ਵਾਧੂ ਟ੍ਰੈਫਿਕ ਸਟੈਂਡਰਡ ਪ੍ਰੋਸੈਸਿੰਗ ਵੱਲ ਭੇਜਿਆ ਜਾ ਸਕਦਾ ਹੈ।