مرکزی مواد پر جائیں
OpenAI

API کسٹمرز کے لیے فاسٹ موڈ

فاسٹ موڈ قابل اعتماد, ہائی رفتار کارکردگی پیش کرتا ہے اور لچکدار استعمال کے مطابق ادائیگی کی سہولت فراہم کرتا ہے. ہمارے تازہ ترین جدید ترین ماڈل, gpt-5.6-sol, کے لیے, آپ فاسٹ موڈ کے ساتھ 2.5 × تک تیز رفتار حاصل کر سکتے ہیں.

فاسٹ موڈ کا انتخاب کر کے, آپ فعال کر سکتے ہیں:

  • متوقع طور پر کم تاخیر: فاسٹ موڈ, Standard پروسیسنگ سروس کے مقابلے میں زیادہ تیزی اور زیادہ مستقل رفتار سے ٹوکنز تیار کرتا ہے, حتیٰ کہ زیادہ ڈیمانڈ کے دوران بھی.
  • آسان استعمال کی لچک: Standard پروسیسنگ کی طرح, فاسٹ موڈ کو بھی لچکدار, استعمال کے مطابق ادائیگی کی بنیاد پر حاصل کیا جا سکتا ہے, بغیر پیشگی فراہمی کی ضرورت کے.

نوٹ: Priority پروسیسنگ کا نام 30.07.2026 کو بدل کر فاسٹ موڈ کر دیا گیا تھا. آپ اپنی API درخواستوں میں یا تو service_tier: priority یا service_tier: fast استعمال کر سکتے ہیں.

Short contextLong contextUptime SLA3تاخیر SLA3
1 ملین ان پٹ ٹوکن کی قیمت1M ان پٹ ٹوکنز (کیچڈ) کی قیمتفی 1 ملین آؤٹ پٹ ٹوکنز کی قیمت1 ملین ان پٹ ٹوکن کی قیمت1M ان پٹ ٹوکنز (کیچڈ) کی قیمتفی 1 ملین آؤٹ پٹ ٹوکنز کی قیمت
GPT-5.6 Sol
$۱۰٫۰۰$۱٫۰۰$۶۰٫۰۰$۲۰٫۰۰$۲٫۰۰$۹۰٫۰۰۹۹٫۹%۹۹% > ۸۰ ٹوکنز فی سیکنڈ۲
GPT-5.6 Terra
$۴٫۰۰$۰٫۴۰$۲۴٫۰۰$۸٫۰۰$۰٫۸۰$۳۶٫۰۰۹۹٫۹%۹۹% > ۷۰ ٹوکنز فی سیکنڈ۲
GPT-5.6 Luna
$۰٫۴۰$۰٫۰۴$۲٫۴۰$۰٫۸۰$۰٫۰۸$۳٫۶۰۹۹٫۹%۹۹% > ۱۰۰ ٹوکنز فی سیکنڈ۲
GPT-5.5
طویل سیاق و سباق کو خارج کرتا ہے۱
$۱۲٫۵۰$۱٫۲۵۰$۷۵٫۰۰۹۹٫۹%۹۹% > ۵۰ ٹوکنز فی سیکنڈ۲
GPT-5.4 mini
طویل سیاق و سباق کو خارج کرتا ہے۱
$۱٫۵۰$۰٫۱۵۰$۹٫۰۰۹۹٫۹%۹۹% > ۱۰۰ ٹوکنز فی سیکنڈ۲
GPT-5.4
طویل سیاق و سباق کو خارج کرتا ہے۱
$۵٫۰۰$۰٫۵۰۰$۳۰٫۰۰۹۹٫۹%۹۹% > ۵۰ ٹوکنز فی سیکنڈ۲
GPT-5.2
$۳٫۵۰$۰٫۳۵۰$۲۸٫۰۰۹۹٫۹%۹۹% > ۵۰ ٹوکنز فی سیکنڈ۲
GPT-5.1
$۲٫۵۰$۰٫۲۵۰$۲۰٫۰۰۹۹٫۹%۹۹% > ۵۰ ٹوکنز فی سیکنڈ۲
GPT-5
$۲٫۵۰$۰٫۲۵۰$۲۰٫۰۰۹۹٫۹%۹۹% > ۵۰ ٹوکنز فی سیکنڈ۲
GPT-5 mini
$۰٫۴۵$۰٫۰۴۵$۳٫۶۰۹۹٫۹%۹۹% > ۸۰ ٹوکنز فی سیکنڈ۲
GPT-5.1 codex
$۲٫۵۰$۰٫۲۵۰$۲۰٫۰۰۹۹٫۹%۹۹% > ۵۰ ٹوکنز فی سیکنڈ۲
GPT-5 codex
$۲٫۵۰$۰٫۲۵۰$۲۰٫۰۰۹۹٫۹%۹۹% > ۵۰ ٹوکنز فی سیکنڈ۲
GPT-4.1
$۳٫۵۰$۰٫۸۷۵$۱۴٫۰۰۹۹٫۹%۹۹% > ۸۰ ٹوکنز فی سیکنڈ۲
GPT-4.1 mini
$۰٫۷۰$۰٫۱۷۵$۲٫۸۰۹۹٫۹%۹۹% > ۹۰ ٹوکنز فی سیکنڈ۲
GPT-4.1 nano
$۰٫۲۰$۰٫۰۵۰$۰٫۸۰۹۹٫۹%۹۹% > ۱۰۰ ٹوکنز فی سیکنڈ۲
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
$۴٫۲۵$۲٫۱۲۵$۱۷٫۰۰۹۹٫۹%۹۹% > ۸۰ ٹوکنز فی سیکنڈ۲
gpt-4o-2024-05-13
$۸٫۷۵$۲۶٫۲۵۹۹٫۹%۹۹% > ۸۰ ٹوکنز فی سیکنڈ۲
GPT-4o mini
$۰٫۲۵$۰٫۱۲۵$۱٫۰۰۹۹٫۹%۹۹% > ۹۰ ٹوکنز فی سیکنڈ۲
o3
$۳٫۵۰$۰٫۸۷۵$۱۴٫۰۰۹۹٫۹%۹۹% > ۸۰ ٹوکنز فی سیکنڈ۲
o4-mini
$۲٫۰۰$۰٫۵۰۰$۸٫۰۰۹۹٫۹%۹۹% > ۹۰ ٹوکنز فی سیکنڈ۲
۱درخواستیں اندازاً 272K پرومپٹ ٹوکنز ہیں
۲پانچ منٹ کے وقفے پر p50 درخواست کی تاخیر کے طور پر حساب کیا جاتا ہے۔ ان صارفین کے لیے جن کے پاس پہلے سے ایسے انٹرپرائز معاہدے موجود ہیں جن میں لیٹنسی SLA فی منٹ بنیاد پر p50 ریکویسٹ لیٹنسی کے طور پر حساب کیے جاتے ہیں، سابقہ SLA اب بھی قابلِ اطلاق ہیں۔
۳یہ صرف Enterprise صارفین کے لیے لاگو ہوتا ہے

یہ کیسے کام کرتا ہے

کسٹمرزموجودہ service_tier پیرامیٹر کا استعمال کرتے ہوئے ہر درخواست کی بنیاد پر ٹریفک کو فاسٹ موڈ کی طرف بھیج سکتے ہیں, جس میں آپشن service_tier = "fast" شامل ہے.

فاسٹ موڈ کے ذریعے فراہم کردہ ٹوکن کو فی ٹوکن بنیاد پر بل کیا جائے گا, جو معیاری پروسیسنگ کی شرحوں کے مقابلے میں پریمیم قیمت پر ہوگا.

درخواست کی سطح پر کنفیگر کیے جانے کے علاوہ, آپ پروجیکٹ سیٹنگز > ڈیفالٹ سروس ٹیئر: فاسٹ میں جا کر پروجیکٹ کو بھی فاسٹ موڈ پر ڈیفالٹ طور پر سیٹ کر سکتے ہیں. آپ اب بھی ہر درخواست پر اسے اوور رائیڈ کر سکتے ہیں. اپنے پروجیکٹ سیٹنگز میں فاسٹ کو منتخب کرنا ترجیح کو منتخب کرنے کے برابر ہے.

حدود

  • فاسٹ موڈ کی ریٹ لمٹس دیگر سروس ٹیئرز کے ساتھ مشترک ہیں.
  • شاذ و نادر صورتوں میں, آپ کے فاسٹ موڈ ٹوکنز فی منٹ میں تیزی سے اضافہ ریمپ ریٹ لمٹس تک پہنچنے کا سبب بن سکتا ہے. اگر آپ ریمپ ریٹ لمٹ سے تجاوز کرتے ہیں, تو اضافی ٹریفک اس کے بجائے Standard پروسیسنگ پر بھیجی جا سکتی ہے.

اکثر پوچھے جانے والے سوالات

قیمتوں کا تعین کرنا

ماڈلز

ریٹ کی حدود

قابلیت اعتماد

پالیسیاں