API ഉപഭോക്താക്കൾക്കായുള്ള ഫാസ്റ്റ് മോഡ്
ഫാസ്റ്റ് മോഡ് ഉപയോഗിക്കുന്നതിലൂടെ, നിങ്ങളുടെ ഉപയോഗത്തിനനുസരിച്ച് മാത്രം പണം നൽകാനുള്ള സൗകര്യത്തോടൊപ്പം ഉയർന്ന വേഗതയും വിശ്വസനീയമായ പ്രകടനവും ഉറപ്പാക്കാൻ സാധിക്കുന്നു. ഞങ്ങളുടെ ഏറ്റവും പുതിയ അത്യാധുനിക മോഡലായ gpt-5.6-sol-ൽ, ഫാസ്റ്റ് മോഡ് ഉപയോഗിച്ച് നിങ്ങൾക്ക് 2.5 ഇരട്ടി വരെ കൂടുതൽ വേഗത നേടാനാകും.
ഫാസ്റ്റ് മോഡ് തിരഞ്ഞെടുക്കുന്നതിലൂടെ, നിങ്ങൾക്ക് ഇനിപ്പറയുന്നവ പ്രയോജനപ്പെടുത്താം:
- പ്രതീക്ഷിക്കാവുന്ന കുറഞ്ഞ ലേറ്റൻസി: തിരക്കേറിയ സമയങ്ങളിൽ പോലും, സ്റ്റാൻഡേർഡ് പ്രോസസ്സിംഗ് സേവനത്തേക്കാൾ വേഗത്തിലും ഒരേപോലെയുള്ള വേഗതയിലും ടോക്കണുകൾ നിർമ്മിക്കാൻ ഫാസ്റ്റ് മോഡിന് സാദികുന്നു.
- ഉപയോഗിക്കാൻ എളുപ്പമുള്ള സൗകര്യം: സാധാരണ പ്രോസസ്സിംഗ് പോലെ തന്നെ, മുൻകൂട്ടി പണം നൽകി സബ്സ്സ്ക്രൈബ് ചെയ്യുന്നതിന് പകരം, നിങ്ങളുടെ ആവശ്യാനുസരണം ഉപയോഗിക്കുന്നതിന് മാത്രം പണം നൽകുന്ന രീതിയിൽ ഫാസ്റ്റ് മോഡും ഉപയോഗിക്കാവുന്നതാണ്.
കുറിപ്പ്: 2026 ജൂലൈ 30-ന് മുൻഗണനാ പ്രോസസ്സിംഗ് എന്നത് ഫാസ്റ്റ് മോഡ് എന്ന് പേരുമാറ്റിയിട്ടുണ്ട്. നിങ്ങളുടെ API അഭ്യർത്ഥനകളിൽ `service_tier: priority` എന്നോ `service_tier: fast` എന്നോ ഉപയോഗിക്കാവുന്നതാണ്.
| Short context | Long context | അപ്ടൈം SLA3 | ലേറ്റൻസി SLA3 | |||||
|---|---|---|---|---|---|---|---|---|
| 1M ഇൻപുട്ട് ടോക്കൺ-കൾക്ക് വില | 1M ഇൻപുട്ട് ടോക്കൺ-കൾക്ക് (കാഷെയിൽ) വില | 1M ഔട്ട്പുട്ട് ടോക്കണുകൾക്ക് വില | 1M ഇൻപുട്ട് ടോക്കൺ-കൾക്ക് വില | 1M ഇൻപുട്ട് ടോക്കൺ-കൾക്ക് (കാഷെയിൽ) വില | 1M ഔട്ട്പുട്ട് ടോക്കണുകൾക്ക് വില | |||
GPT-5.6 Sol | $10.00 | $1.00 | $60.00 | $20.00 | $2.00 | $90.00 | 99.9% | 99% > 80 tokens സെക്കൻഡിൽ2 |
GPT-5.6 Terra | $4.00 | $0.40 | $24.00 | $8.00 | $0.80 | $36.00 | 99.9% | 99% > 70 tokens സെക്കൻഡിൽ2 |
GPT-5.6 Luna | $0.40 | $0.04 | $2.40 | $0.80 | $0.08 | $3.60 | 99.9% | 99% > 100 tokens സെക്കൻഡിൽ2 |
GPT-5.5 ദീർഘമായ സന്ദർഭം ഒഴിവാക്കുന്നു1 | $12.50 | $1.250 | $75.00 | — | — | — | 99.9% | 99% > 50 tokens സെക്കൻഡിൽ2 |
GPT-5.4 mini ദീർഘമായ സന്ദർഭം ഒഴിവാക്കുന്നു1 | $1.50 | $0.150 | $9.00 | — | — | — | 99.9% | 99% > 100 tokens സെക്കൻഡിൽ2 |
GPT-5.4 ദീർഘമായ സന്ദർഭം ഒഴിവാക്കുന്നു1 | $5.00 | $0.500 | $30.00 | — | — | — | 99.9% | 99% > 50 tokens സെക്കൻഡിൽ2 |
GPT-5.2 | $3.50 | $0.350 | $28.00 | — | — | — | 99.9% | 99% > 50 tokens സെക്കൻഡിൽ2 |
GPT-5.1 | $2.50 | $0.250 | $20.00 | — | — | — | 99.9% | 99% > 50 tokens സെക്കൻഡിൽ2 |
GPT-5 | $2.50 | $0.250 | $20.00 | — | — | — | 99.9% | 99% > 50 tokens സെക്കൻഡിൽ2 |
GPT-5 mini | $0.45 | $0.045 | $3.60 | — | — | — | 99.9% | 99% > 80 tokens സെക്കൻഡിൽ2 |
GPT-5.1 codex | $2.50 | $0.250 | $20.00 | — | — | — | 99.9% | 99% > 50 tokens സെക്കൻഡിൽ2 |
GPT-5 codex | $2.50 | $0.250 | $20.00 | — | — | — | 99.9% | 99% > 50 tokens സെക്കൻഡിൽ2 |
GPT-4.1 | $3.50 | $0.875 | $14.00 | — | — | — | 99.9% | 99% > 80 tokens സെക്കൻഡിൽ2 |
GPT-4.1 mini | $0.70 | $0.175 | $2.80 | — | — | — | 99.9% | 99% > 90 tokens സെക്കൻഡിൽ2 |
GPT-4.1 nano | $0.20 | $0.050 | $0.80 | — | — | — | 99.9% | 99% > 100 tokens സെക്കൻഡിൽ2 |
GPT-4o gpt-4o-2024-11-20 gpt-4o-2024-08-06 | $4.25 | $2.125 | $17.00 | — | — | — | 99.9% | 99% > 80 tokens സെക്കൻഡിൽ2 |
gpt-4o-2024-05-13 | $8.75 | — | $26.25 | — | — | — | 99.9% | 99% > 80 tokens സെക്കൻഡിൽ2 |
GPT-4o mini | $0.25 | $0.125 | $1.00 | — | — | — | 99.9% | 99% > 90 tokens സെക്കൻഡിൽ2 |
o3 | $3.50 | $0.875 | $14.00 | — | — | — | 99.9% | 99% > 80 tokens സെക്കൻഡിൽ2 |
o4-mini | $2.00 | $0.500 | $8.00 | — | — | — | 99.9% | 99% > 90 tokens സെക്കൻഡിൽ2 |
ഇത് എങ്ങനെ പ്രവർത്തിക്കുന്നു
service_tier = "fast" എന്ന ഓപ്ഷൻ ഉപയോഗിച്ച് ഉപഭോക്താക്കൾക്ക്, തങ്ങൾക്കാവശ്യമുള്ള അഭ്യർത്ഥനകൾ മാത്രം ഫാസ്റ്റ് മോഡിലേക്ക് നൽകാൻ സാധിക്കും.
ഫാസ്റ്റ് മോഡ് വഴി നൽകുന്ന ടോക്കണുകൾക്ക്, സാധാരണ നിരക്കുകളെ അപേക്ഷിച്ച് ഉയർന്ന തുക ടോക്കൺ അടിസ്ഥാനത്തിൽ ഈടാക്കുന്നതാണ്.
ഓരോ അഭ്യർത്ഥനയും പ്രത്യേകം ക്രമീകരിക്കുന്നതിന് പുറമെ, Project settings > Default Service Tier: Fast എന്ന ഓപ്ഷൻ ഉപയോഗിച്ച് ഒരു പ്രോജക്റ്റിൻ്റെ സ്വതവേയുള്ള സർവീസ് ടയർ ഫാസ്റ്റ് മോഡായി സജ്ജീകരിക്കാനും കഴിയും. ആവശ്യമെങ്കിൽ ഓരോ അഭ്യർത്ഥനയിലും ഈ ക്രമീകരണങ്ങളിൽ മാറ്റം വരുത്താൻ സാധിക്കും. നിങ്ങളുടെ പ്രോജക്റ്റ് ക്രമീകരണങ്ങളിൽ Fast തിരഞ്ഞെടുക്കുന്നത് Priority തിരഞ്ഞെടുക്കുന്നതിന് തുല്യമാണ്.
പരിമിതികൾ
- ഫാസ്റ്റ് മോഡിൻ്റെ നിരക്ക് പരിധികൾ മറ്റ് സർവീസ് ടയറുകളുമായി പങ്കുവെക്കപ്പെടുന്നതാണ്.
- അപൂർവമായ സാഹചര്യങ്ങളിൽ, നിങ്ങളുടെ ഫാസ്റ്റ് മോഡ് ഒരു മിനിറ്റിൽ പ്രോസസ്സ് ചെയ്യുന്ന ടോക്കണുകളുടെ എണ്ണത്തിൽ പെട്ടെന്നുണ്ടാകുന്ന വർദ്ധനവ് റാമ്പ് നിരക്ക് പരിധി കവിയുന്നതിന് കാരണമായേക്കാം. നിങ്ങളുടെ റാമ്പ് നിരക്ക് പരിധി കവിയുകയാണെങ്കിൽ, ശേഷിക്കുന്ന അഭ്യർത്ഥന ഫാസ്റ്റ് മോഡിന് പകരം സാധാരണ പ്രോസസിംഗിലേക്ക് മാറ്റപ്പെട്ടേക്കാം.