ਮੁੱਖ ਸਮੱਗਰੀ 'ਤੇ ਜਾਓ
OpenAI

API ਗਾਹਕਾਂ ਲਈ ਫਾਸਟ ਮੋਡ

ਫਾਸਟ ਮੋਡ ਵਰਤੋਂ ਅਨੁਸਾਰ ਭੁਗਤਾਨ ਕਰਨ ਦੀ ਸਹੂਲਤ ਦੇ ਨਾਲ ਭਰੋਸੇਯੋਗ ਅਤੇ ਤੇਜ਼ ਰਫਤਾਰ ਕਾਰਗੁਜ਼ਾਰੀ ਦੀ ਪੇਸ਼ਕਸ਼ ਕਰਦਾ ਹੈ। ਸਾਡੇ ਨਵੀਨਤਮ ਅਤਿ-ਆਧੁਨਿਕ ਮਾਡਲ, gpt-5.6-sol, ਲਈ, ਤੁਸੀਂ ਫਾਸਟ ਮੋਡ ਨਾਲ 2.5 ਗੁਣਾ ਤੱਕ ਵਧੇਰੇ ਤੇਜ਼ ਗਤੀ ਪ੍ਰਾਪਤ ਕਰ ਸਕਦੇ ਹੋ।

ਫਾਸਟ ਮੋਡ ਨੂੰ ਚੁਣ ਕੇ, ਤੁਸੀਂ ਇਹ ਲਾਭ ਪ੍ਰਾਪਤ ਕਰ ਸਕਦੇ ਹੋ:

  • ਅਨੁਮਾਨਯੋਗ ਤੌਰ 'ਤੇ ਘੱਟ ਲੇਟੈਂਸੀ: ਫਾਸਟ ਮੋਡ ਟੋਕਨ ਨੂੰ ਸਟੈਂਡਰਡ ਪ੍ਰੋਸੈਸਿੰਗ ਸੇਵਾ ਨਾਲੋਂ ਤੇਜ਼ ਅਤੇ ਹੋਰ ਇਕਸਾਰ ਗਤੀ ਨਾਲ ਜਨਰੇਟ ਕਰਦੀ ਹੈ, ਇੱਥੋਂ ਤੱਕ ਕਿ ਉੱਚ ਮੰਗ ਦੇ ਸਮੇਂ ਵੀ।
  • ਵਰਤੋਂ ਵਿੱਚ ਸਰਲ ਅਤੇ ਸੁਵਿਧਾਜਨਕ: ਸਟੈਂਡਰਡ ਪ੍ਰੋਸੈਸਿੰਗ ਵਾਂਗ, ਫਾਸਟ ਮੋਡ ਨੂੰ ਪਹਿਲਾਂ ਤੋਂ ਪ੍ਰੋਵਿਜ਼ਨਿੰਗ ਦੀ ਲੋੜ ਤੋਂ ਬਿਨ੍ਹਾਂ ਵਰਤੋਂ ਅਨੁਸਾਰ ਭੁਗਤਾਨ ਦੇ ਆਧਾਰ 'ਤੇ ਐਕਸੈਸ ਕੀਤਾ ਜਾ ਸਕਦਾ ਹੈ।

ਨੋਟ: ਪ੍ਰਾਇਓਰਿਟੀ ਪ੍ਰੋਸੈਸਿੰਗ ਦਾ ਨਾਮ 30 ਜੁਲਾਈ, 2026 ਨੂੰ ਫਾਸਟ ਮੋਡ ਰੱਖਿਆ ਗਿਆ ਸੀ। ਤੁਸੀਂ ਆਪਣੀਆਂ API ਬੇਨਤੀਆਂ ਵਿੱਚ service_tier: ਪ੍ਰਾਇਓਰਿਟੀ ਜਾਂ service_tier: ਫਾਸਟ ਵਿੱਚੋਂ ਕੋਈ ਵੀ ਵਰਤ ਸਕਦੇ ਹੋ।

Short contextLong contextਅਪਟਾਈਮ SLA3ਲੇਟੈਂਸੀ SLA3
ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਇਨਪੁਟ ਟੋਕਨ ਕੀਮਤਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਇਨਪੁਟ ਟੋਕਨ ਕੀਮਤ (ਕੈਸ਼ਡ)ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਆਉਟਪੁੱਟ ਟੋਕਨ ਕੀਮਤਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਇਨਪੁਟ ਟੋਕਨ ਕੀਮਤਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਇਨਪੁਟ ਟੋਕਨ ਕੀਮਤ (ਕੈਸ਼ਡ)ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਆਉਟਪੁੱਟ ਟੋਕਨ ਕੀਮਤ
GPT-5.6 Sol
US$10.00US$1.00US$60.00US$20.00US$2.00US$90.0099.9%99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5.6 Terra
US$4.00US$0.40US$24.00US$8.00US$0.80US$36.0099.9%99% > 70 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5.6 Luna
US$0.40US$0.04US$2.40US$0.80US$0.08US$3.6099.9%99% > 100 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5.5
ਲੰਬੇ ਸੰਦਰਭ1 ਨੂੰ ਸ਼ਾਮਲ ਨਹੀਂ ਕਰਦਾ
US$12.50US$1.250US$75.0099.9%99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5.4 mini
ਲੰਬੇ ਸੰਦਰਭ1 ਨੂੰ ਸ਼ਾਮਲ ਨਹੀਂ ਕਰਦਾ
US$1.50US$0.150US$9.0099.9%99% > 100 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5.4
ਲੰਬੇ ਸੰਦਰਭ1 ਨੂੰ ਸ਼ਾਮਲ ਨਹੀਂ ਕਰਦਾ
US$5.00US$0.500US$30.0099.9%99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5.2
US$3.50US$0.350US$28.0099.9%99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5.1
US$2.50US$0.250US$20.0099.9%99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5
US$2.50US$0.250US$20.0099.9%99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5 mini
US$0.45US$0.045US$3.6099.9%99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5.1 codex
US$2.50US$0.250US$20.0099.9%99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-5 codex
US$2.50US$0.250US$20.0099.9%99% > 50 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-4.1
US$3.50US$0.875US$14.0099.9%99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-4.1 mini
US$0.70US$0.175US$2.8099.9%99% > 90 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-4.1 nano
US$0.20US$0.050US$0.8099.9%99% > 100 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
US$4.25US$2.125US$17.0099.9%99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
gpt-4o-2024-05-13
US$8.75US$26.2599.9%99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
GPT-4o mini
US$0.25US$0.125US$1.0099.9%99% > 90 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
o3
US$3.50US$0.875US$14.0099.9%99% > 80 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
o4-mini
US$2.00US$0.500US$8.0099.9%99% > 90 ਟੋਕਨ ਪ੍ਰਤੀ ਸਕਿੰਟ2
1ਬੇਨਤੀਆਂ ਦਾ ਅਨੁਮਾਨ ਲਗਭਗ 272,000 ਪ੍ਰੌੰਪਟ ਟੋਕਨ ਹਨ
2ਇਸਦੀ ਗਣਨਾ ਪ੍ਰਤੀ 5 ਮਿੰਟ ਦੇ ਆਧਾਰ 'ਤੇ p50 ਬੇਨਤੀ ਲੈਟੈਂਸੀ ਵਜੋਂ ਕੀਤੀ ਜਾਂਦੀ ਹੈ। ਉਨ੍ਹਾਂ ਗਾਹਕਾਂ ਲਈ ਜਿਨ੍ਹਾਂ ਦੇ ਮੌਜੂਦਾ ਐਂਟਰਪ੍ਰਾਈਜ਼ ਸਮਝੌਤਿਆਂ ਵਿੱਚ ਲੈਟੈਂਸੀ SLA ਦੀ ਗਣਨਾ ਪ੍ਰਤੀ ਮਿੰਟ ਦੇ ਆਧਾਰ 'ਤੇ p50 ਬੇਨਤੀ ਲੈਟੈਂਸੀ ਵਜੋਂ ਕੀਤੀ ਗਈ ਹੈ, ਪਿਛਲੇ SLAs ਵੀ ਅਜੇ ਲਾਗੂ ਰਹਿਣਗੇ।
3ਇਹ ਸਿਰਫ਼ ਐਂਟਰਪ੍ਰਾਈਜ਼ ਗਾਹਕਾਂ ਲਈ ਲਾਗੂ ਹੈ

ਇਹ ਕਿਵੇਂ ਕੰਮ ਕਰਦਾ ਹੈ

ਗਾਹਕ ਮੌਜੂਦਾ service_tier ਪੈਰਾਮੀਟਰ ਦੀ ਵਰਤੋਂ ਕਰਕੇ, service_tier = "ਫਾਸਟ" ਵਿਕਲਪ ਦੇ ਨਾਲ, ਪ੍ਰਤੀ ਬੇਨਤੀ ਦੇ ਆਧਾਰ 'ਤੇ ਟ੍ਰੈਫਿਕ ਨੂੰ ਫਾਸਟ ਮੋਡ ਪ੍ਰੋਸੈਸਿੰਗ ਵੱਲ ਭੇਜ ਸਕਦੇ ਹਨ।

ਫਾਸਟ ਮੋਡ ਦੁਆਰਾ ਸੇਵਾ ਕੀਤੇ ਟੋਕਨ ਦਾ ਬਿਲ ਪ੍ਰਤੀ-ਟੋਕਨ ਆਧਾਰ 'ਤੇ ਕੀਤਾ ਜਾਵੇਗਾ, ਜਿਸਦੀ ਕੀਮਤ ਸਟੈਂਡਰਡ ਪ੍ਰੋਸੈਸਿੰਗ ਦਰਾਂ ਨਾਲੋਂ ਪ੍ਰੀਮੀਅਮ ਹੋਵੇਗੀ।

ਬੇਨਤੀ ਪੱਧਰ 'ਤੇ ਕੌਂਫਿਗਰ ਕੀਤੇ ਜਾਣ ਤੋਂ ਇਲਾਵਾ, ਤੁਸੀਂ ਪ੍ਰੋਜੈਕਟ ਸੈਟਿੰਗਾਂ → ਡਿਫੌਲਟ ਸਰਵਿਸ ਪੱਧਰ: ਫਾਸਟ ਵਿੱਚ ਕਿਸੇ ਪ੍ਰੋਜੈਕਟ ਲਈ ਡਿਫੌਲਟ ਨੂੰ ਫਾਸਟ ਮੋਡ ਵਜੋਂ ਵੀ ਸੈੱਟ ਕਰ ਸਕਦੇ ਹੋ। ਤੁਸੀਂ ਫਿਰ ਵੀ ਪ੍ਰਤੀ ਬੇਨਤੀ ਓਵਰਰਾਈਡ ਕਰ ਸਕਦੇ ਹੋ। ਤੁਹਾਡੇ ਪ੍ਰੋਜੈਕਟ ਸੈਟਿੰਗਾਂ ਵਿੱਚ ਫਾਸਟ ਚੁਣਨਾ ਪ੍ਰਾਇਓਰਿਟੀ ਚੁਣਨ ਦੇ ਬਰਾਬਰ ਹੈ।

ਸੀਮਾਵਾਂ

  • ਫਾਸਟ ਮੋਡ ਦੀਆਂ ਰੇਟ ਲਿਮਿਟਾਂ ਹੋਰ ਸੇਵਾ ਪੱਧਰਾਂ ਨਾਲ ਸਾਂਝੀਆਂ ਹੁੰਦੀਆਂ ਹਨ।
  • ਦੁਰਲੱਭ ਮਾਮਲਿਆਂ ਵਿੱਚ, ਜੇਕਰ ਤੁਹਾਡੇ ਫਾਸਟ ਮੋਡ ਦੇ ਟੋਕਨ ਪ੍ਰਤੀ ਮਿੰਟ ਵਿੱਚ ਬਹੁਤ ਤੇਜ਼ੀ ਨਾਲ ਵਾਧਾ ਹੁੰਦਾ ਹੈ, ਤਾਂ ਤੁਸੀਂ ਰੈਂਪ ਰੇਟ ਲਿਮਿਟਾਂ ਤੱਕ ਪਹੁੰਚ ਸਕਦੇ ਹੋ। ਜੇਕਰ ਤੁਸੀਂ ਰੈਂਪ ਰੇਟ ਲਿਮਿਟ ਨੂੰ ਪਾਰ ਕਰ ਜਾਂਦੇ ਹੋ, ਤਾਂ ਵਾਧੂ ਟ੍ਰੈਫਿਕ ਸਟੈਂਡਰਡ ਪ੍ਰੋਸੈਸਿੰਗ ਵੱਲ ਭੇਜਿਆ ਜਾ ਸਕਦਾ ਹੈ।

ਅਕਸਰ ਪੁੱਛੇ ਜਾਣ ਵਾਲੇ ਸਵਾਲ

ਕੀਮਤਾਂ

ਮਾਡਲ

ਰੇਟ ਲਿਮਿਟਾਂ

ਭਰੋਸੇਯੋਗਤਾ

ਨੀਤੀਆਂ