मुख्य मजकूराकडे जा
OpenAI

API ग्राहकांसाठी फास्ट मोड

फास्ट मोड पे-ऍज-यू-गोच्या लवचिकतेसह विश्वासार्ह, उच्च-गती कार्यप्रदर्शन देतो. आमच्या नवीनतम अत्याधुनिक मॉडेल, gpt-5.6-sol, साठी फास्ट मोडसह तुम्ही 2.5x पर्यंत अधिक जलद गती मिळवू शकता.

फास्ट मोड निवडल्यास, तुम्ही अनलॉक करू शकता:

  • अंदाज करता येण्याजोगा कमी विलंब: फास्ट मोड स्टँडर्ड प्रक्रिया सेवेच्या तुलनेत टोकन अधिक जलद आणि अधिक सातत्यपूर्ण गतीने निर्माण करतो, अगदी कमाल मागणीच्या काळातही.
  • सोप्या वापरासाठी लवचिकता: स्टँडर्ड प्रोसेसिंगप्रमाणे, फास्ट मोड लवचिक, वापरानुसार पैसे देण्याच्या आधारावर उपलब्ध आहे, ज्यासाठी आगाऊ तरतूद करणे आवश्यक नाही.

टीप: 30 जुलै 2026 रोजी प्राधान्य प्रक्रिया याचे नाव बदलून फास्ट मोड करण्यात आले. तुम्ही तुमच्या API विनंत्यांमध्ये service_tier: priority किंवा service_tier: fast यापैकी कोणताही वापरू शकता.

Short contextLong contextअपटाइम SLA3प्रलंबित SLA3
1M इनपुट टोकन्ससाठी किंमतप्रति 1M इनपुट tokenची किंमत (कॅश केलेले)प्रति 1M आउटपुट टोकनसाठी किंमत1M इनपुट टोकन्ससाठी किंमतप्रति 1M इनपुट tokenची किंमत (कॅश केलेले)प्रति 1M आउटपुट टोकनसाठी किंमत
GPT-5.6 Sol
$१०.००$१.००$६०.००$२०.००$२.००$९०.००९९.९%९९% > ८० tokens प्रति सेकंद
GPT-5.6 Terra
$४.००$०.४०$२४.००$८.००$०.८०$३६.००९९.९%९९% > ७० tokens प्रति सेकंद
GPT-5.6 Luna
$०.४०$०.०४$२.४०$०.८०$०.०८$३.६०९९.९%९९% > १०० tokens प्रति सेकंद
GPT-5.5
दीर्घ संदर्भ वगळतो
$१२.५०$१.२५०$७५.००९९.९%९९% > ५० tokens प्रति सेकंद
GPT-5.4 mini
दीर्घ संदर्भ वगळतो
$१.५०$०.१५०$९.००९९.९%९९% > १०० tokens प्रति सेकंद
GPT-5.4
दीर्घ संदर्भ वगळतो
$५.००$०.५००$३०.००९९.९%९९% > ५० tokens प्रति सेकंद
GPT-5.2
$३.५०$०.३५०$२८.००९९.९%९९% > ५० tokens प्रति सेकंद
GPT-5.1
$२.५०$०.२५०$२०.००९९.९%९९% > ५० tokens प्रति सेकंद
GPT-5
$२.५०$०.२५०$२०.००९९.९%९९% > ५० tokens प्रति सेकंद
GPT-5 mini
$०.४५$०.०४५$३.६०९९.९%९९% > ८० tokens प्रति सेकंद
GPT-5.1 codex
$२.५०$०.२५०$२०.००९९.९%९९% > ५० tokens प्रति सेकंद
GPT-5 codex
$२.५०$०.२५०$२०.००९९.९%९९% > ५० tokens प्रति सेकंद
GPT-4.1
$३.५०$०.८७५$१४.००९९.९%९९% > ८० tokens प्रति सेकंद
GPT-4.1 mini
$०.७०$०.१७५$२.८०९९.९%९९% > ९० tokens प्रति सेकंद
GPT-4.1 nano
$०.२०$०.०५०$०.८०९९.९%९९% > १०० tokens प्रति सेकंद
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
$४.२५$२.१२५$१७.००९९.९%९९% > ८० tokens प्रति सेकंद
gpt-4o-2024-05-13
$८.७५$२६.२५९९.९%९९% > ८० tokens प्रति सेकंद
GPT-4o mini
$०.२५$०.१२५$१.००९९.९%९९% > ९० tokens प्रति सेकंद
o3
$३.५०$०.८७५$१४.००९९.९%९९% > ८० tokens प्रति सेकंद
o4-mini
$२.००$०.५००$८.००९९.९%९९% > ९० tokens प्रति सेकंद
>272K प्रॉम्प्ट टोकन्ससाठी अंदाजे विनंत्या
प्रत्येक 5 मिनिटांच्या आधारावर p50 विनंती प्रलंबित म्हणून गणना केली जाते. ज्या ग्राहकांकडे विद्यमान एंटरप्राइझ करार आहेत आणि ज्यामध्ये प्रति मिनिट p50 विनंती प्रलंबित म्हणून गणना केलेले प्रलंबित SLA आहेत, त्यांच्यासाठी पूर्वीचे SLA देखील लागू आहेत.
हे केवळ Enterprise ग्राहकांसाठी लागू आहे.

हे कसे कार्य करते

ग्राहक विद्यमान service_tier पॅरामीटर वापरून, service_tier = "fast" हा पर्याय निवडून प्रत्येक विनंतीसाठी फास्ट मोडकडे ट्रॅफिक निर्देशित करू शकतात.

फास्ट मोडद्वारे दिलेले टोकन प्रति-टोकन आधारावर बिल केले जातील, ज्यांची किंमत मानक प्रक्रिया दरांच्या तुलनेत प्रीमियम दराने असेल.

विनंती स्तरावर कॉन्फिगर केल्याशिवाय, तुम्ही प्रोजेक्ट सेटिंग्ज > डीफॉल्ट सेवा टियर: फास्ट मध्ये प्रोजेक्टसाठी फास्ट मोड डीफॉल्ट म्हणून देखील सेट करू शकता. तुम्ही अद्याप प्रत्येक विनंतीसाठी अधिलिखित करू शकता. तुमच्या प्रकल्प सेटिंग्जमध्ये "फास्ट" निवडणे हे "प्राधान्य" निवडण्यास समतुल्य आहे.

मर्यादा

  • फास्ट मोड रेट मर्यादा इतर सेवा टियरसह सामायिक केल्या जातात.
  • क्वचित प्रसंगी, तुमच्या फास्ट मोड टोकन प्रति मिनिटमध्ये जलद वाढ झाल्यास रॅम्प रेट मर्यादांवर पोहोचण्याची शक्यता असते. जर तुम्ही रॅम्प रेट मर्यादा ओलांडली, तर अतिरिक्त रहदारी मानक प्रक्रियेकडे पाठवली जाऊ शकते.

नेहमी विचारले जाणारे प्रश्न

किमती

मॉडेल्स

दर मर्यादा

विश्वसनीयता

धोरणे