मुख्य मजकूराकडे जा
OpenAI

API ग्राहकांसाठी फास्ट मोड

फास्ट मोड पे-ऍज-यू-गोच्या लवचिकतेसह विश्वासार्ह, उच्च-गती कार्यप्रदर्शन देतो. gpt-5.6-sol साठी, तुम्ही फास्ट मोडसह 2.5 पट वेगवान गतीपर्यंत प्रवेश करू शकता.

फास्ट मोड निवडल्यास, तुम्ही अनलॉक करू शकता:

  • अंदाज करता येण्याजोगा कमी विलंब: फास्ट मोड स्टँडर्ड प्रक्रिया सेवेच्या तुलनेत टोकन अधिक जलद आणि अधिक सातत्यपूर्ण गतीने निर्माण करतो, अगदी कमाल मागणीच्या काळातही.

  • सोप्या वापरासाठी लवचिकता: स्टँडर्ड प्रोसेसिंगप्रमाणे, फास्ट मोड लवचिक, वापरानुसार पैसे देण्याच्या आधारावर उपलब्ध आहे, ज्यासाठी आगाऊ तरतूद करणे आवश्यक नाही.

टीप: 30 जुलै 2026 रोजी प्राधान्य प्रक्रिया याचे नाव बदलून फास्ट मोड करण्यात आले. तुम्ही तुमच्या API विनंत्यांमध्ये service_tier: priority किंवा service_tier: fast यापैकी कोणताही वापरू शकता.

संक्षिप्त संदर्भलांब संदर्भअपटाइम SLA3प्रलंबित SLA3
1M इनपुट टोकन्ससाठी किंमतप्रति 1M इनपुट tokenची किंमत (कॅश केलेले)प्रति 1M आउटपुट टोकनसाठी किंमत1M इनपुट टोकन्ससाठी किंमतप्रति 1M इनपुट tokenची किंमत (कॅश केलेले)प्रति 1M आउटपुट टोकनसाठी किंमत
GPT-6 Astra
$२०.००$२.००$१००.००$४०.००$४.००$१५०.००——
GPT-6.1 Sol
$४.००$०.२०$२०.००$८.००$०.४०$३०.००——
GPT-6 Sol
$४.००$०.४०$२०.००$८.००$०.८०$३०.००——
GPT-6 Luna
$०.२०$०.०२$१.००$०.४०$०.०४$१.५०——
GPT-5.6 Sol
$८.००$०.८०$४०.००$१६.००$१.६०$६०.००९९.९%९९% > ८० tokens प्रति सेकंद२
GPT-5.6 Terra
$४.००$०.४०$२४.००$८.००$०.८०$३६.००९९.९%९९% > ७० tokens प्रति सेकंद२
GPT-5.6 Luna
$०.४०$०.०४$२.४०$०.८०$०.०८$३.६०९९.९%९९% > १०० tokens प्रति सेकंद२
GPT-5.5
दीर्घ संदर्भ वगळतो१
$१२.५०$१.२५०$७५.००———९९.९%९९% > ५० tokens प्रति सेकंद२
GPT-5.4 mini
दीर्घ संदर्भ वगळतो१
$१.५०$०.१५०$९.००———९९.९%९९% > १०० tokens प्रति सेकंद२
GPT-5.4
दीर्घ संदर्भ वगळतो१
$५.००$०.५००$३०.००———९९.९%९९% > ५० tokens प्रति सेकंद२
GPT-5.2
$३.५०$०.३५०$२८.००———९९.९%९९% > ५० tokens प्रति सेकंद२
GPT-5.1
$२.५०$०.२५०$२०.००———९९.९%९९% > ५० tokens प्रति सेकंद२
GPT-5
$२.५०$०.२५०$२०.००———९९.९%९९% > ५० tokens प्रति सेकंद२
GPT-5 mini
$०.४५$०.०४५$३.६०———९९.९%९९% > ८० tokens प्रति सेकंद२
GPT-5.1 codex
$२.५०$०.२५०$२०.००———९९.९%९९% > ५० tokens प्रति सेकंद२
GPT-5 codex
$२.५०$०.२५०$२०.००———९९.९%९९% > ५० tokens प्रति सेकंद२
GPT-4.1
$३.५०$०.८७५$१४.००———९९.९%९९% > ८० tokens प्रति सेकंद२
GPT-4.1 mini
$०.७०$०.१७५$२.८०———९९.९%९९% > ९० tokens प्रति सेकंद२
GPT-4.1 nano
$०.२०$०.०५०$०.८०———९९.९%९९% > १०० tokens प्रति सेकंद२
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
$४.२५$२.१२५$१७.००———९९.९%९९% > ८० tokens प्रति सेकंद२
gpt-4o-2024-05-13
$८.७५—$२६.२५———९९.९%९९% > ८० tokens प्रति सेकंद२
GPT-4o mini
$०.२५$०.१२५$१.००———९९.९%९९% > ९० tokens प्रति सेकंद२
o3
$३.५०$०.८७५$१४.००———९९.९%९९% > ८० tokens प्रति सेकंद२
o4-mini
$२.००$०.५००$८.००———९९.९%९९% > ९० tokens प्रति सेकंद२
१>272K प्रॉम्प्ट टोकन्ससाठी अंदाजे विनंत्या
२प्रत्येक 5 मिनिटांच्या आधारावर p50 विनंती प्रलंबित म्हणून गणना केली जाते. ज्या ग्राहकांकडे विद्यमान एंटरप्राइझ करार आहेत आणि ज्यामध्ये प्रति मिनिट p50 विनंती प्रलंबित म्हणून गणना केलेले प्रलंबित SLA आहेत, त्यांच्यासाठी पूर्वीचे SLA देखील लागू आहेत.
३हे केवळ Enterprise ग्राहकांसाठी लागू आहे.

हे कसे कार्य करते

ग्राहक विद्यमान service_tier पॅरामीटर वापरून, service_tier = "fast" हा पर्याय निवडून प्रत्येक विनंतीसाठी फास्ट मोडकडे ट्रॅफिक निर्देशित करू शकतात.

फास्ट मोडद्वारे दिलेले टोकन प्रति-टोकन आधारावर बिल केले जातील, ज्यांची किंमत मानक प्रक्रिया दरांच्या तुलनेत प्रीमियम दराने असेल.

विनंती स्तरावर कॉन्फिगर केल्याशिवाय, तुम्ही प्रोजेक्ट सेटिंग्ज > डीफॉल्ट सेवा टियर: फास्ट मध्ये प्रोजेक्टसाठी फास्ट मोड डीफॉल्ट म्हणून देखील सेट करू शकता. तुम्ही अद्याप प्रत्येक विनंतीसाठी अधिलिखित करू शकता. तुमच्या प्रकल्प सेटिंग्जमध्ये "फास्ट" निवडणे हे "प्राधान्य" निवडण्यास समतुल्य आहे.

मर्यादा

  • फास्ट मोड रेट मर्यादा इतर सेवा टियरसह सामायिक केल्या जातात.

  • क्वचित प्रसंगी, तुमच्या फास्ट मोड टोकन प्रति मिनिटमध्ये जलद वाढ झाल्यास रॅम्प रेट मर्यादांवर पोहोचण्याची शक्यता असते. जर तुम्ही रॅम्प रेट मर्यादा ओलांडली, तर अतिरिक्त रहदारी मानक प्रक्रियेकडे पाठवली जाऊ शकते.

नेहमी विचारले जाणारे प्रश्न

किमती

मॉडेल्स

दर मर्यादा

विश्वसनीयता

धोरणे