API ગ્રાહકો માટે ઝડપી મોડ
ઝડપી મોડ ભરોસાપાત્ર, હાઇ-સ્પીડ પરફોર્મન્સ આપે છે, જેમાં ઉપયોગ કરો એટલું ચુકવોની સુગમતા મળે છે. અમારા નવીનતમ અત્યાધુનિક મોડલ, gpt-5.6-sol માટે, તમે ઝડપી મોડ વડે 2.5 ગણી વધુ ઝડપી ગતિ મેળવી શકો છો.
ઝડપી મોડ પસંદ કરીને, તમે નીચેની સુવિધાઓ મેળવી શકો છો:
- અનુમાનિત રીતે ઓછી લેટન્સી: ઝડપી મોડ સ્ટાન્ડર્ડ પ્રોસેસિંગ સેવાને કરતાં વધુ ઝડપથી અને વધુ સુસંગત ગતિએ ટોકનો બનાવે છે, પછી ભલે માંગ સૌથી વધુ હોય.
- ઉપયોગમાં સરળ અને સુગમ: સ્ટાન્ડર્ડ પ્રોસેસિંગની જેમ, ઝડપી મોડને અગાઉથી પ્રોવિઝનિંગની જરૂરિયાત વિના, સુગમ, ઉપયોગ કરો એટલું ચુકવો આધારે ઍક્સેસ એક્સેસ કરી શકાય છે.
નોંધ: પ્રાયોરિટી પ્રોસેસિંગનું નામ 30 જુલાઈ 2026ના રોજ ઝડપી મોડ રાખવામાં આવ્યું હતું. તમે તમારી API વિનંતીઓમાં service_tier: priority અથવા service_tier: fast માંથી કોઈપણ એકનો ઉપયોગ કરી શકો છો.
| Short context | Long context | અપટાઇમ એસએલએ3 | લેટન્સી એસએલએ3 | |||||
|---|---|---|---|---|---|---|---|---|
| 1M ઇનપુટ ટોકન દીઠ ભાવ | 1M ઇનપુટ ટોકન દીઠ ભાવ (કૅશ કરેલ) | 1M આઉટપુટ ટોકન દીઠ ભાવ | 1M ઇનપુટ ટોકન દીઠ ભાવ | 1M ઇનપુટ ટોકન દીઠ ભાવ (કૅશ કરેલ) | 1M આઉટપુટ ટોકન દીઠ ભાવ | |||
GPT-5.6 Sol | US$10.00 | US$1.00 | US$60.00 | US$20.00 | US$2.00 | US$90.00 | 99.9% | 99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5.6 Terra | US$4.00 | US$0.40 | US$24.00 | US$8.00 | US$0.80 | US$36.00 | 99.9% | 99% > 70 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5.6 Luna | US$0.40 | US$0.04 | US$2.40 | US$0.80 | US$0.08 | US$3.60 | 99.9% | 99% > 100 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5.5 લાંબા સંદર્ભને સમાવેશ કરશો નહીં1 | US$12.50 | US$1.250 | US$75.00 | — | — | — | 99.9% | 99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5.4 mini લાંબા સંદર્ભને સમાવેશ કરશો નહીં1 | US$1.50 | US$0.150 | US$9.00 | — | — | — | 99.9% | 99% > 100 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5.4 લાંબા સંદર્ભને સમાવેશ કરશો નહીં1 | US$5.00 | US$0.500 | US$30.00 | — | — | — | 99.9% | 99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5.2 | US$3.50 | US$0.350 | US$28.00 | — | — | — | 99.9% | 99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5.1 | US$2.50 | US$0.250 | US$20.00 | — | — | — | 99.9% | 99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5 | US$2.50 | US$0.250 | US$20.00 | — | — | — | 99.9% | 99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5 mini | US$0.45 | US$0.045 | US$3.60 | — | — | — | 99.9% | 99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5.1 codex | US$2.50 | US$0.250 | US$20.00 | — | — | — | 99.9% | 99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-5 codex | US$2.50 | US$0.250 | US$20.00 | — | — | — | 99.9% | 99% > 50 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-4.1 | US$3.50 | US$0.875 | US$14.00 | — | — | — | 99.9% | 99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-4.1 mini | US$0.70 | US$0.175 | US$2.80 | — | — | — | 99.9% | 99% > 90 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-4.1 nano | US$0.20 | US$0.050 | US$0.80 | — | — | — | 99.9% | 99% > 100 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-4o gpt-4o-2024-11-20 gpt-4o-2024-08-06 | US$4.25 | US$2.125 | US$17.00 | — | — | — | 99.9% | 99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2 |
gpt-4o-2024-05-13 | US$8.75 | — | US$26.25 | — | — | — | 99.9% | 99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2 |
GPT-4o mini | US$0.25 | US$0.125 | US$1.00 | — | — | — | 99.9% | 99% > 90 ટોકન્સ પ્રતિ સેકન્ડ2 |
o3 | US$3.50 | US$0.875 | US$14.00 | — | — | — | 99.9% | 99% > 80 ટોકન્સ પ્રતિ સેકન્ડ2 |
o4-mini | US$2.00 | US$0.500 | US$8.00 | — | — | — | 99.9% | 99% > 90 ટોકન્સ પ્રતિ સેકન્ડ2 |
આ કેવી રીતે કામ કરે છે
ગ્રાહકો હાલના service_tier પેરામીટરનો ઉપયોગ કરીને દરેક વિનંતી માટે ટ્રાફિકને ઝડપી મોડ તરફ દોરી શકે છે, વિકલ્પ તરીકે service_tier = "fast" પસંદ કરીને.
ઝડપી મોડ દ્વારા સેવા આપવામાં આવતા ટોકનોનું બિલ પ્રતિ ટોકનના લેવામાં આવશે, જે સ્ટાન્ડર્ડ પ્રોસેસિંગ દરોની તુલનામાં પ્રીમિયમ કિંમતે હશે.
વિનંતી સ્તરે કન્ફિગર કરવા ઉપરાંત, તમે પ્રોજેક્ટ સેટિંગ્સ > ડિફૉલ્ટ સેવાનું સ્તર: ઝડપીમાં પ્રોજેક્ટને ડિફૉલ્ટરૂપે પણ ઝડપી મોડ પર કરી શકો છો. તમે હજુ પણ દરેક વિનંતી માટે ઓવરરાઇડ કરી શકો છો. તમારા પ્રોજેક્ટ સેટિંગ્સમાં ઝડપી પસંદ કરવું એ પ્રાયોરિટી પસંદ કરવા સમાન છે.
મર્યાદા
- ઝડપી મોડની દર મર્યાદા અન્ય સેવાનાં સ્તરો સાથે શેર કરવામાં આવે છે.
- દુર્લભ કિસ્સાઓમાં, તમારા ઝડપી મોડ માટેના મિનિટ દીઠ ટોકનોમાં ઝડપી વધારો રેમ્પ દર મર્યાદા સુધી પહોંચવાની સ્થિતિ બની શકે છે. જો તમે રેમ્પ દર મર્યાદા ઓળંગી જાઓ, તો વધારાનો ટ્રાફિક તેના બદલે સ્ટાન્ડર્ડ પ્રોસેસિંગ પર મોકલવામાં આવી શકે છે.