پرش به محتوای اصلی
OpenAI

حالت سریع ویژهٔ مشتریان API

«حالت سریع» عملکردی قابل‌اعتماد و پرسرعت ارائه می‌دهد و امکان پرداخت به‌ازای میزان استفاده را نیز فراهم می‌کند. سرعت اجرای جدیدترین مدل پیشروی ما، gpt-5.6-sol، با استفاده از «حالت سریع» تا ۲.۵ برابر افزایش می‌یابد.

با انتخاب «حالت سریع»، به امکانات زیر دسترسی پیدا می‌کنید:

  • تأخیر کم و قابل‌پیش‌بینی: «حالت سریع» حتی در زمان اوج تقاضا، توکن‌ها را سریع‌تر و با سرعتی یکنواخت‌تر از سرویس پردازش استاندارد تولید می‌کند.
  • دسترسی آسان و انعطاف‌پذیر: مانند پردازش استاندارد، می‌توانید بدون نیاز به تخصیص ظرفیت از پیش، به‌صورت انعطاف‌پذیر و با پرداخت به‌ازای میزان استفاده به «حالت سریع» دسترسی داشته باشید.

توجه: در ۳۰ ژوئیهٔ ۲۰۲۶، نام «پردازش اولویت‌دار» به «حالت سریع» تغییر یافت. می‌توانید در درخواست‌های API خود از service_tier: priority یا service_tier: fast استفاده کنید.

Short contextLong contextSLA آپ‌تایم3SLA تأخیر3
قیمت به ازای هر ۱ میلیون توکن ورودیقیمت برای هر ۱ میلیون توکن ورودی (ذخیره‌شده در حافظه کش)قیمت به ازای هر ۱ میلیون توکن خروجیقیمت به ازای هر ۱ میلیون توکن ورودیقیمت برای هر ۱ میلیون توکن ورودی (ذخیره‌شده در حافظه کش)قیمت به ازای هر ۱ میلیون توکن خروجی
GPT-5.6 Sol
‎$۱۰٫۰۰‎$۱٫۰۰‎$۶۰٫۰۰‎$۲۰٫۰۰‎$۲٫۰۰‎$۹۰٫۰۰۹۹٫۹٪۹۹٪ > ۸۰ token در ثانیه۲
GPT-5.6 Terra
‎$۴٫۰۰‎$۰٫۴۰‎$۲۴٫۰۰‎$۸٫۰۰‎$۰٫۸۰‎$۳۶٫۰۰۹۹٫۹٪۹۹٪ > ۷۰ token در ثانیه۲
GPT-5.6 Luna
‎$۰٫۴۰‎$۰٫۰۴‎$۲٫۴۰‎$۰٫۸۰‎$۰٫۰۸‎$۳٫۶۰۹۹٫۹٪۹۹٪ > ۱۰۰ token در ثانیه۲
GPT-5.5
زمینه طولانی را مستثنی می‌کند۱
‎$۱۲٫۵۰‎$۱٫۲۵۰‎$۷۵٫۰۰۹۹٫۹٪۹۹٪ > ۵۰ token در ثانیه۲
GPT-5.4 mini
زمینه طولانی را مستثنی می‌کند۱
‎$۱٫۵۰‎$۰٫۱۵۰‎$۹٫۰۰۹۹٫۹٪۹۹٪ > ۱۰۰ token در ثانیه۲
GPT-5.4
زمینه طولانی را مستثنی می‌کند۱
‎$۵٫۰۰‎$۰٫۵۰۰‎$۳۰٫۰۰۹۹٫۹٪۹۹٪ > ۵۰ token در ثانیه۲
GPT-5.2
‎$۳٫۵۰‎$۰٫۳۵۰‎$۲۸٫۰۰۹۹٫۹٪۹۹٪ > ۵۰ token در ثانیه۲
GPT-5.1
‎$۲٫۵۰‎$۰٫۲۵۰‎$۲۰٫۰۰۹۹٫۹٪۹۹٪ > ۵۰ token در ثانیه۲
GPT-5
‎$۲٫۵۰‎$۰٫۲۵۰‎$۲۰٫۰۰۹۹٫۹٪۹۹٪ > ۵۰ token در ثانیه۲
GPT-5 mini
‎$۰٫۴۵‎$۰٫۰۴۵‎$۳٫۶۰۹۹٫۹٪۹۹٪ > ۸۰ token در ثانیه۲
GPT-5.1 codex
‎$۲٫۵۰‎$۰٫۲۵۰‎$۲۰٫۰۰۹۹٫۹٪۹۹٪ > ۵۰ token در ثانیه۲
GPT-5 codex
‎$۲٫۵۰‎$۰٫۲۵۰‎$۲۰٫۰۰۹۹٫۹٪۹۹٪ > ۵۰ token در ثانیه۲
GPT-4.1
‎$۳٫۵۰‎$۰٫۸۷۵‎$۱۴٫۰۰۹۹٫۹٪۹۹٪ > ۸۰ token در ثانیه۲
GPT-4.1 mini
‎$۰٫۷۰‎$۰٫۱۷۵‎$۲٫۸۰۹۹٫۹٪۹۹٪ > ۹۰ token در ثانیه۲
GPT-4.1 nano
‎$۰٫۲۰‎$۰٫۰۵۰‎$۰٫۸۰۹۹٫۹٪۹۹٪ > ۱۰۰ token در ثانیه۲
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
‎$۴٫۲۵‎$۲٫۱۲۵‎$۱۷٫۰۰۹۹٫۹٪۹۹٪ > ۸۰ token در ثانیه۲
gpt-4o-2024-05-13
‎$۸٫۷۵‎$۲۶٫۲۵۹۹٫۹٪۹۹٪ > ۸۰ token در ثانیه۲
GPT-4o mini
‎$۰٫۲۵‎$۰٫۱۲۵‎$۱٫۰۰۹۹٫۹٪۹۹٪ > ۹۰ token در ثانیه۲
o3
‎$۳٫۵۰‎$۰٫۸۷۵‎$۱۴٫۰۰۹۹٫۹٪۹۹٪ > ۸۰ token در ثانیه۲
o4-mini
‎$۲٫۰۰‎$۰٫۵۰۰‎$۸٫۰۰۹۹٫۹٪۹۹٪ > ۹۰ token در ثانیه۲
۱درخواست‌ها با تخمین بیش از ۲۷۲۰۰۰ توکن اعلان
۲محاسبه به عنوان تأخیر درخواست p50 بر اساس هر ۵ دقیقه. برای مشتریانی که توافق‌نامه‌های سازمانی فعلی دارند و SLAهای تأخیر به صورت تأخیر درخواست p50 در هر دقیقه محاسبه می‌شود، SLAهای قبلی نیز همچنان معتبر هستند.
۳این فقط برای مشتریان Enterprise قابل اعمال است

چگونگی عملکرد

مشتریان می‌توانند با استفاده از پارامتر موجود service_tier و انتخاب مقدار "fast"، حالت سریع را برای هر درخواست به‌طور جداگانه فعال کنند.

هزینهٔ توکن‌های پردازش‌شده در حالت سریع به‌ازای هر توکن محاسبه می‌شود و از نرخ پردازش استاندارد بالاتر است.

علاوه بر تنظیم حالت سریع در سطح هر درخواست، می‌توانید در مسیر «تنظیمات پروژه > ردهٔ خدمات پیش‌فرض»، گزینهٔ «سریع» را انتخاب کنید تا حالت سریع به‌طور پیش‌فرض برای پروژه فعال شود. همچنان می‌توانید این تنظیم را برای هر درخواست به‌طور جداگانه تغییر دهید. انتخاب گزینهٔ «سریع» در تنظیمات پروژه، همان تأثیر انتخاب گزینهٔ «اولویت» را دارد.

محدودیت‌ها

  • محدودیت‌های تعداد درخواست در «حالت سریع» با سایر رده‌های خدمات مشترک هستند.
  • در موارد نادر، اگر تعداد توکن‌های پردازش‌شده در دقیقه در «حالت سریع» به‌سرعت افزایش یابد، ممکن است محدودیت تعداد درخواست‌ها اعمال شود. اگر از محدودیت افزایش تعداد درخواست‌ها عبور کنید، ممکن است درخواست‌های اضافی به‌جای «حالت سریع» با روش «پردازش استاندارد» پردازش شوند.

سوالات رایج

تعرفه ها

مدل‌ها

محدودیت‌های نرخ

قابلیت اطمینان

سیاست‌ها