ప్రధాన కంటెంట్‌కి దాటండి
OpenAI

API కస్టమర్ల కోసం వేగవంతమైన మోడ్

వేగవంతమైన మోడ్ నమ్మకమైన, హై-స్పీడ్ పనితీరును, అవసరానుసారం చెల్లించే విధానంతో సౌలభ్యంగా అందిస్తుంది. మా తాజా అత్యాధునిక మోడల్ అయిన gpt-5.6-sol కోసం, వేగవంతమైన మోడ్‌తో నువ్వు 2.5 రెట్ల వరకు వేగవంతమైన యాక్సెస్‌ను పొందవచ్చు.

వేగవంతమైన మోడ్ ఎంచుకుంటే, మీరు వీటిని అన్‌లాక్ చేయవచ్చు:

  • నిర్దిష్టంగా తక్కువ లేటెన్సీ: అత్యధిక డిమాండ్ ఉన్న సమయంలో కూడా స్టాండర్డ్ ప్రాసెసింగ్ సర్వీస్ కంటే వేగవంతమైన మోడ్ టోకెన్‌లను వేగంగా మరియు మరింత స్థిరమైన వేగంతో ఉత్పత్తి చేస్తుంది.
  • వాడటానికి సులభమైన ఫ్లెక్సిబిలిటీ: స్టాండర్డ్ ప్రాసెసింగ్‌లా, వేగవంతమైన మోడ్‌ను ముందస్తు ప్రావిజనింగ్ అవసరం లేకుండా, అవసరానుసారం చెల్లించే ఫ్లెక్సిబుల్ విధానంలో యాక్సెస్ చేయవచ్చు.

గమనిక: 30.07.2026న ప్రయారిటీ ప్రాసెసింగ్‌ను వేగవంతమైన మోడ్‌గా పేరు మార్చారు. మీ API అభ్యర్థనల్లో మీరు service_tier: priority లేదా service_tier: fast లో ఏదైనా ఉపయోగించవచ్చు.

Short contextLong contextఅప్‌టైమ్ SLA3లేటెన్సీ SLA3
ప్రతి 1 మిలియన్ ఇన్‌పుట్ టోకెన్లకు ధరప్రతి 1M ఇన్‌పుట్ టోకెన్ల ధర (క్యాష్ చేయబడినది)1M ఔట్‌పుట్ టోకెన్స్ ధరప్రతి 1 మిలియన్ ఇన్‌పుట్ టోకెన్లకు ధరప్రతి 1M ఇన్‌పుట్ టోకెన్ల ధర (క్యాష్ చేయబడినది)1M ఔట్‌పుట్ టోకెన్స్ ధర
GPT-5.6 Sol
$10.00$1.00$60.00$20.00$2.00$90.0099.9%99% > 80 టోకెన్లు ప్రతి సెకనుకు2
GPT-5.6 Terra
$4.00$0.40$24.00$8.00$0.80$36.0099.9%99% > 70 టోకెన్లు ప్రతి సెకనుకు2
GPT-5.6 Luna
$0.40$0.04$2.40$0.80$0.08$3.6099.9%99% > 100 టోకెన్లు ప్రతి సెకనుకు2
GPT-5.5
సుదీర్ఘ సందర్భం 1 మినహాయిస్తుంది
$12.50$1.250$75.0099.9%99% > 50 టోకెన్లు ప్రతి సెకనుకు2
GPT-5.4 mini
సుదీర్ఘ సందర్భం 1 మినహాయిస్తుంది
$1.50$0.150$9.0099.9%99% > 100 టోకెన్లు ప్రతి సెకనుకు2
GPT-5.4
సుదీర్ఘ సందర్భం 1 మినహాయిస్తుంది
$5.00$0.500$30.0099.9%99% > 50 టోకెన్లు ప్రతి సెకనుకు2
GPT-5.2
$3.50$0.350$28.0099.9%99% > 50 టోకెన్లు ప్రతి సెకనుకు2
GPT-5.1
$2.50$0.250$20.0099.9%99% > 50 టోకెన్లు ప్రతి సెకనుకు2
GPT-5
$2.50$0.250$20.0099.9%99% > 50 టోకెన్లు ప్రతి సెకనుకు2
GPT-5 mini
$0.45$0.045$3.6099.9%99% > 80 టోకెన్లు ప్రతి సెకనుకు2
GPT-5.1 codex
$2.50$0.250$20.0099.9%99% > 50 టోకెన్లు ప్రతి సెకనుకు2
GPT-5 codex
$2.50$0.250$20.0099.9%99% > 50 టోకెన్లు ప్రతి సెకనుకు2
GPT-4.1
$3.50$0.875$14.0099.9%99% > 80 టోకెన్లు ప్రతి సెకనుకు2
GPT-4.1 mini
$0.70$0.175$2.8099.9%99% > 90 టోకెన్లు ప్రతి సెకనుకు2
GPT-4.1 nano
$0.20$0.050$0.8099.9%99% > 100 టోకెన్లు ప్రతి సెకనుకు2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
$4.25$2.125$17.0099.9%99% > 80 టోకెన్లు ప్రతి సెకనుకు2
gpt-4o-2024-05-13
$8.75$26.2599.9%99% > 80 టోకెన్లు ప్రతి సెకనుకు2
GPT-4o mini
$0.25$0.125$1.0099.9%99% > 90 టోకెన్లు ప్రతి సెకనుకు2
o3
$3.50$0.875$14.0099.9%99% > 80 టోకెన్లు ప్రతి సెకనుకు2
o4-mini
$2.00$0.500$8.0099.9%99% > 90 టోకెన్లు ప్రతి సెకనుకు2
1రిక్వెస్ట్‌లు అంచనా > 272,000 ప్రాంప్ట్ టోకెన్
2ప్రతి 5 నిమిషాల ప్రాతిపదికన p50 రిక్వెస్ట్ జాప్యంగా లెక్కించబడింది. నిమిషానికి p50 అభ్యర్థన జాప్యం వలె లెక్కించబడిన జాప్యం SLAలను కలిగి ఉన్న ప్రస్తుత ఎంటర్‌ప్రైజ్ ఒప్పందాలు కలిగిన కస్టమర్‌లకు, మునుపటి SLAలు కూడా ఇప్పటికీ వర్తిస్తాయి.
3ఇది ఎంటర్‌ప్రైజ్ కస్టమర్లకు మాత్రమే వర్తిస్తుంది

ఇది ఎలా పనిచేస్తుంది

కస్టమర్‌లు service_tier = "fast"' అనే ఎంపికతో, ఇప్పటికే ఉన్న service_tier పారామీటర్‌ను ఉపయోగించి ప్రతి అభ్యర్థన ఆధారంగా ట్రాఫిక్‌ను వేగవంతమైన మోడ్‌కు మళ్లించవచ్చు.

వేగవంతమైన మోడ్ ద్వారా అందించబడే టోకెన్‌లకు ప్రతి-టోకెన్ ప్రాతిపదికన బిల్ చేయబడుతుంది, ఇవి ప్రామాణిక ప్రాసెసింగ్ ధరల కంటే అధిక ధరను కలిగి ఉంటాయి.

అభ్యర్థన స్థాయిలో కాన్ఫిగర్ చేయబడటమే కాకుండా, ప్రాజెక్ట్ సెట్టింగ్‌లు > డిఫాల్ట్ సర్వీస్ టియర్: ఫాస్ట్ విభాగంలో మీరు ప్రాజెక్ట్‌ను డిఫాల్ట్‌గా వేగవంతమైన మోడ్‌కు కూడా సెట్ చేయవచ్చు. మీరు ఇంకా ప్రతి అభ్యర్థనకు మినహాయింపు ఇవ్వవచ్చు. మీ ప్రాజెక్ట్ సెట్టింగ్‌లలో ఫాస్ట్‌ను ఎంచుకోవడం అనేది ప్రయారిటీని ఎంచుకోవడంతో సమానం.

పరిమితులు

  • వేగవంతమైన మోడ్ రేట్ లిమిట్‌లు ఇతర సర్వీస్ టియర్‌లతో పంచుకోబడతాయి.
  • కొన్ని అరుదైన సందర్భాల్లో, మీ వేగవంతమైన మోడ్ టోకెన్లు ప్రతి నిమిషానికి వేగంగా పెరగడం వల్ల ర్యాంప్ రేట్ లిమిట్‌లు చేరుకోవచ్చు. నువ్వు ర్యాంప్ రేట్ లిమిట్‌ని మించితే, అదనపు ట్రాఫిక్ స్టాండర్డ్ ప్రాసెసింగ్‌కు పంపబడవచ్చు.

తరచుగా అడిగే ప్రశ్నలు

ధరలు

మోడల్స్

రేటు పరిమితులు

విశ్వసనీయత

పాలిసీలు