મુખ્ય વિષય-સામગ્રી પર જાવો
OpenAI

API ગ્રાહકો માટે ઝડપી મોડ

ઝડપી મોડ ભરોસાપાત્ર, હાઇ-સ્પીડ પરફોર્મન્સ આપે છે, જેમાં ઉપયોગ કરો એટલું ચુકવોની સુગમતા મળે છે. અમારા નવીનતમ અત્યાધુનિક મોડલ, gpt-5.6-sol માટે, તમે ઝડપી મોડ વડે 2.5 ગણી વધુ ઝડપી ગતિ મેળવી શકો છો.

ઝડપી મોડ પસંદ કરીને, તમે નીચેની સુવિધાઓ મેળવી શકો છો:

  • અનુમાનિત રીતે ઓછી લેટન્સી: ઝડપી મોડ સ્ટાન્ડર્ડ પ્રોસેસિંગ સેવાને કરતાં વધુ ઝડપથી અને વધુ સુસંગત ગતિએ ટોકનો બનાવે છે, પછી ભલે માંગ સૌથી વધુ હોય.
  • ઉપયોગમાં સરળ અને સુગમ: સ્ટાન્ડર્ડ પ્રોસેસિંગની જેમ, ઝડપી મોડને અગાઉથી પ્રોવિઝનિંગની જરૂરિયાત વિના, સુગમ, ઉપયોગ કરો એટલું ચુકવો આધારે ઍક્સેસ એક્સેસ કરી શકાય છે.

નોંધ: પ્રાયોરિટી પ્રોસેસિંગનું નામ 30 જુલાઈ 2026ના રોજ ઝડપી મોડ રાખવામાં આવ્યું હતું. તમે તમારી API વિનંતીઓમાં service_tier: priority અથવા service_tier: fast માંથી કોઈપણ એકનો ઉપયોગ કરી શકો છો.

Short contextLong contextઅપટાઇમ એસએલએ3લેટન્સી એસએલએ3
1M ઇનપુટ ટોકન દીઠ ભાવ1M ઇનપુટ ટોકન દીઠ ભાવ (કૅશ કરેલ)1M આઉટપુટ ટોકન દીઠ ભાવ1M ઇનપુટ ટોકન દીઠ ભાવ1M ઇનપુટ ટોકન દીઠ ભાવ (કૅશ કરેલ)1M આઉટપુટ ટોકન દીઠ ભાવ
GPT-5.6 Sol
US$10.00US$1.00US$60.00US$20.00US$2.00US$90.0099.9%99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5.6 Terra
US$4.00US$0.40US$24.00US$8.00US$0.80US$36.0099.9%99% > 70 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5.6 Luna
US$0.40US$0.04US$2.40US$0.80US$0.08US$3.6099.9%99% > 100 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5.5
લાંબા સંદર્ભને સમાવેશ કરશો નહીં1
US$12.50US$1.250US$75.0099.9%99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5.4 mini
લાંબા સંદર્ભને સમાવેશ કરશો નહીં1
US$1.50US$0.150US$9.0099.9%99% > 100 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5.4
લાંબા સંદર્ભને સમાવેશ કરશો નહીં1
US$5.00US$0.500US$30.0099.9%99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5.2
US$3.50US$0.350US$28.0099.9%99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5.1
US$2.50US$0.250US$20.0099.9%99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5
US$2.50US$0.250US$20.0099.9%99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5 mini
US$0.45US$0.045US$3.6099.9%99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5.1 codex
US$2.50US$0.250US$20.0099.9%99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-5 codex
US$2.50US$0.250US$20.0099.9%99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-4.1
US$3.50US$0.875US$14.0099.9%99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-4.1 mini
US$0.70US$0.175US$2.8099.9%99% > 90 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-4.1 nano
US$0.20US$0.050US$0.8099.9%99% > 100 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
US$4.25US$2.125US$17.0099.9%99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2
gpt-4o-2024-05-13
US$8.75US$26.2599.9%99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2
GPT-4o mini
US$0.25US$0.125US$1.0099.9%99% > 90 ટોકન્સ પ્રતિ સેકન્ડ2
o3
US$3.50US$0.875US$14.0099.9%99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2
o4-mini
US$2.00US$0.500US$8.0099.9%99% > 90 ટોકન્સ પ્રતિ સેકન્ડ2
1>272K પ્રોમ્પ્ટ ટોકન પર અંદાજિત વિનંતીઓ
2દર 5 મિનિટના આધારે પી50 વિનંતી લેટન્સી તરીકે ગણતરી કરવામાં આવે છે. જે ગ્રાહકો પાસે હાલના એન્ટરપ્રાઈઝ એગ્રિમેન્ટ્સ છે અને જેમના લેટેન્સી એસએલએ પ્રતિ મિનિટના આધારે પી50 વિનંતી લેટેન્સી તરીકે ગણવામાં આવે છે, તેમના માટે અગાઉના એસએલએ પણ હજુ લાગુ પડે છે.
3આ ફક્ત એન્ટરપ્રાઇઝ ગ્રાહકો માટે જ લાગુ પડે છે

આ કેવી રીતે કામ કરે છે

ગ્રાહકો હાલના service_tier પેરામીટરનો ઉપયોગ કરીને દરેક વિનંતી માટે ટ્રાફિકને ઝડપી મોડ તરફ દોરી શકે છે, વિકલ્પ તરીકે service_tier = "fast" પસંદ કરીને.

ઝડપી મોડ દ્વારા સેવા આપવામાં આવતા ટોકનોનું બિલ પ્રતિ ટોકનના લેવામાં આવશે, જે સ્ટાન્ડર્ડ પ્રોસેસિંગ દરોની તુલનામાં પ્રીમિયમ કિંમતે હશે.

વિનંતી સ્તરે કન્ફિગર કરવા ઉપરાંત, તમે પ્રોજેક્ટ સેટિંગ્સ > ડિફૉલ્ટ સેવાનું સ્તર: ઝડપીમાં પ્રોજેક્ટને ડિફૉલ્ટરૂપે પણ ઝડપી મોડ પર કરી શકો છો. તમે હજુ પણ દરેક વિનંતી માટે ઓવરરાઇડ કરી શકો છો. તમારા પ્રોજેક્ટ સેટિંગ્સમાં ઝડપી પસંદ કરવું એ પ્રાયોરિટી પસંદ કરવા સમાન છે.

મર્યાદા

  • ઝડપી મોડની દર મર્યાદા અન્ય સેવાનાં સ્તરો સાથે શેર કરવામાં આવે છે.
  • દુર્લભ કિસ્સાઓમાં, તમારા ઝડપી મોડ માટેના મિનિટ દીઠ ટોકનોમાં ઝડપી વધારો રેમ્પ દર મર્યાદા સુધી પહોંચવાની સ્થિતિ બની શકે છે. જો તમે રેમ્પ દર મર્યાદા ઓળંગી જાઓ, તો વધારાનો ટ્રાફિક તેના બદલે સ્ટાન્ડર્ડ પ્રોસેસિંગ પર મોકલવામાં આવી શકે છે.

વારંવાર પૂછાતા પ્રશ્નો

કિંમત

મોડલ્સ

દર મર્યાદાઓ

વિશ્વસનીયતા

નીતિઓ