പ്രധാന ഉള്ളടക്കത്തിലേക്ക് നീങ്ങുക
OpenAI

API ഉപഭോക്താക്കൾക്കായുള്ള ഫാസ്റ്റ് മോഡ്

ഫാസ്റ്റ് മോഡ് ഉപയോഗിക്കുന്നതിലൂടെ, നിങ്ങളുടെ ഉപയോഗത്തിനനുസരിച്ച് മാത്രം പണം നൽകാനുള്ള സൗകര്യത്തോടൊപ്പം ഉയർന്ന വേഗതയും വിശ്വസനീയമായ പ്രകടനവും ഉറപ്പാക്കാൻ സാധിക്കുന്നു. ഞങ്ങളുടെ ഏറ്റവും പുതിയ അത്യാധുനിക മോഡലായ gpt-5.6-sol-ൽ, ഫാസ്റ്റ് മോഡ് ഉപയോഗിച്ച് നിങ്ങൾക്ക് 2.5 ഇരട്ടി വരെ കൂടുതൽ വേഗത നേടാനാകും.

ഫാസ്റ്റ് മോഡ് തിരഞ്ഞെടുക്കുന്നതിലൂടെ, നിങ്ങൾക്ക് ഇനിപ്പറയുന്നവ പ്രയോജനപ്പെടുത്താം:

  • പ്രതീക്ഷിക്കാവുന്ന കുറഞ്ഞ ലേറ്റൻസി: തിരക്കേറിയ സമയങ്ങളിൽ പോലും, സ്റ്റാൻഡേർഡ് പ്രോസസ്സിംഗ് സേവനത്തേക്കാൾ വേഗത്തിലും ഒരേപോലെയുള്ള വേഗതയിലും ടോക്കണുകൾ നിർമ്മിക്കാൻ ഫാസ്റ്റ് മോഡിന് സാദികുന്നു.
  • ഉപയോഗിക്കാൻ എളുപ്പമുള്ള സൗകര്യം: സാധാരണ പ്രോസസ്സിംഗ് പോലെ തന്നെ, മുൻകൂട്ടി പണം നൽകി സബ്സ്സ്ക്രൈബ് ചെയ്യുന്നതിന് പകരം, നിങ്ങളുടെ ആവശ്യാനുസരണം ഉപയോഗിക്കുന്നതിന് മാത്രം പണം നൽകുന്ന രീതിയിൽ ഫാസ്റ്റ് മോഡും ഉപയോഗിക്കാവുന്നതാണ്.

കുറിപ്പ്: 2026 ജൂലൈ 30-ന് മുൻഗണനാ പ്രോസസ്സിംഗ് എന്നത് ഫാസ്റ്റ് മോഡ് എന്ന് പേരുമാറ്റിയിട്ടുണ്ട്. നിങ്ങളുടെ API അഭ്യർത്ഥനകളിൽ `service_tier: priority` എന്നോ `service_tier: fast` എന്നോ ഉപയോഗിക്കാവുന്നതാണ്.

Short contextLong contextഅപ്‌ടൈം SLA3ലേറ്റൻസി SLA3
1M ഇൻപുട്ട് ടോക്കൺ-കൾക്ക് വില1M ഇൻപുട്ട് ടോക്കൺ-കൾക്ക് (കാഷെയിൽ) വില1M ഔട്ട്പുട്ട് ടോക്കണുകൾക്ക് വില1M ഇൻപുട്ട് ടോക്കൺ-കൾക്ക് വില1M ഇൻപുട്ട് ടോക്കൺ-കൾക്ക് (കാഷെയിൽ) വില1M ഔട്ട്പുട്ട് ടോക്കണുകൾക്ക് വില
GPT-5.6 Sol
$10.00$1.00$60.00$20.00$2.00$90.0099.9%99% > 80 tokens സെക്കൻഡിൽ2
GPT-5.6 Terra
$4.00$0.40$24.00$8.00$0.80$36.0099.9%99% > 70 tokens സെക്കൻഡിൽ2
GPT-5.6 Luna
$0.40$0.04$2.40$0.80$0.08$3.6099.9%99% > 100 tokens സെക്കൻഡിൽ2
GPT-5.5
ദീർഘമായ സന്ദർഭം ഒഴിവാക്കുന്നു1
$12.50$1.250$75.0099.9%99% > 50 tokens സെക്കൻഡിൽ2
GPT-5.4 mini
ദീർഘമായ സന്ദർഭം ഒഴിവാക്കുന്നു1
$1.50$0.150$9.0099.9%99% > 100 tokens സെക്കൻഡിൽ2
GPT-5.4
ദീർഘമായ സന്ദർഭം ഒഴിവാക്കുന്നു1
$5.00$0.500$30.0099.9%99% > 50 tokens സെക്കൻഡിൽ2
GPT-5.2
$3.50$0.350$28.0099.9%99% > 50 tokens സെക്കൻഡിൽ2
GPT-5.1
$2.50$0.250$20.0099.9%99% > 50 tokens സെക്കൻഡിൽ2
GPT-5
$2.50$0.250$20.0099.9%99% > 50 tokens സെക്കൻഡിൽ2
GPT-5 mini
$0.45$0.045$3.6099.9%99% > 80 tokens സെക്കൻഡിൽ2
GPT-5.1 codex
$2.50$0.250$20.0099.9%99% > 50 tokens സെക്കൻഡിൽ2
GPT-5 codex
$2.50$0.250$20.0099.9%99% > 50 tokens സെക്കൻഡിൽ2
GPT-4.1
$3.50$0.875$14.0099.9%99% > 80 tokens സെക്കൻഡിൽ2
GPT-4.1 mini
$0.70$0.175$2.8099.9%99% > 90 tokens സെക്കൻഡിൽ2
GPT-4.1 nano
$0.20$0.050$0.8099.9%99% > 100 tokens സെക്കൻഡിൽ2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
$4.25$2.125$17.0099.9%99% > 80 tokens സെക്കൻഡിൽ2
gpt-4o-2024-05-13
$8.75$26.2599.9%99% > 80 tokens സെക്കൻഡിൽ2
GPT-4o mini
$0.25$0.125$1.0099.9%99% > 90 tokens സെക്കൻഡിൽ2
o3
$3.50$0.875$14.0099.9%99% > 80 tokens സെക്കൻഡിൽ2
o4-mini
$2.00$0.500$8.0099.9%99% > 90 tokens സെക്കൻഡിൽ2
1272K-ൽ കൂടുതൽ പ്രോംപ്റ്റ് ടോക്കണുകളിൽ അഭ്യർത്ഥനകൾ കണക്കാക്കുന്നു
25 മിനിറ്റ് അടിസ്ഥാനത്തിൽ p50 അഭ്യർത്ഥന ലേറ്റൻസി കണക്കാക്കപ്പെടുന്നു. മിനിറ്റിന് ഒരു അഭ്യർത്ഥന ലേറ്റൻസി p50 ആയി കണക്കാക്കുന്ന ലേറ്റൻസി SLAകൾ ഉള്ള നിലവിലുള്ള എന്റർപ്രൈസ് കരാറുകൾ ഉള്ള ഉപഭോക്താക്കൾക്ക്, മുൻ SLAകൾ ഇപ്പോഴും ബാധകമാണ്.
3ഇത് Enterprise ഉപഭോക്താക്കൾക്ക് മാത്രം ബാധകമാണ്

ഇത് എങ്ങനെ പ്രവർത്തിക്കുന്നു

service_tier = "fast" എന്ന ഓപ്ഷൻ ഉപയോഗിച്ച് ഉപഭോക്താക്കൾക്ക്, തങ്ങൾക്കാവശ്യമുള്ള അഭ്യർത്ഥനകൾ മാത്രം ഫാസ്റ്റ് മോഡിലേക്ക് നൽകാൻ സാധിക്കും.

ഫാസ്റ്റ് മോഡ് വഴി നൽകുന്ന ടോക്കണുകൾക്ക്, സാധാരണ നിരക്കുകളെ അപേക്ഷിച്ച് ഉയർന്ന തുക ടോക്കൺ അടിസ്ഥാനത്തിൽ ഈടാക്കുന്നതാണ്.

ഓരോ അഭ്യർത്ഥനയും പ്രത്യേകം ക്രമീകരിക്കുന്നതിന് പുറമെ, Project settings > Default Service Tier: Fast എന്ന ഓപ്ഷൻ ഉപയോഗിച്ച് ഒരു പ്രോജക്റ്റിൻ്റെ സ്വതവേയുള്ള സർവീസ് ടയർ ഫാസ്റ്റ് മോഡായി സജ്ജീകരിക്കാനും കഴിയും. ആവശ്യമെങ്കിൽ ഓരോ അഭ്യർത്ഥനയിലും ഈ ക്രമീകരണങ്ങളിൽ മാറ്റം വരുത്താൻ സാധിക്കും. നിങ്ങളുടെ പ്രോജക്റ്റ് ക്രമീകരണങ്ങളിൽ Fast തിരഞ്ഞെടുക്കുന്നത് Priority തിരഞ്ഞെടുക്കുന്നതിന് തുല്യമാണ്.

പരിമിതികൾ

  • ഫാസ്റ്റ് മോഡിൻ്റെ നിരക്ക് പരിധികൾ മറ്റ് സർവീസ് ടയറുകളുമായി പങ്കുവെക്കപ്പെടുന്നതാണ്.
  • അപൂർവമായ സാഹചര്യങ്ങളിൽ, നിങ്ങളുടെ ഫാസ്റ്റ് മോഡ് ഒരു മിനിറ്റിൽ പ്രോസസ്സ് ചെയ്യുന്ന ടോക്കണുകളുടെ എണ്ണത്തിൽ പെട്ടെന്നുണ്ടാകുന്ന വർദ്ധനവ് റാമ്പ് നിരക്ക് പരിധി കവിയുന്നതിന് കാരണമായേക്കാം. നിങ്ങളുടെ റാമ്പ് നിരക്ക് പരിധി കവിയുകയാണെങ്കിൽ, ശേഷിക്കുന്ന അഭ്യർത്ഥന ഫാസ്റ്റ് മോഡിന് പകരം സാധാരണ പ്രോസസിംഗിലേക്ക് മാറ്റപ്പെട്ടേക്കാം.

പതിവായി ചോദിക്കുന്ന ചോദ്യങ്ങൾ

വിലനിർണ്ണയം

മോഡലുകൾ

നിരക്ക് സംബന്ധിച്ച പരിധികൾ

വിശ്വാസ്യത

നയങ്ങൾ