حالت سریع ویژهٔ مشتریان API
«حالت سریع» عملکردی قابلاعتماد و پرسرعت ارائه میدهد و امکان پرداخت بهازای میزان استفاده را نیز فراهم میکند. سرعت اجرای جدیدترین مدل پیشروی ما، gpt-5.6-sol، با استفاده از «حالت سریع» تا ۲.۵ برابر افزایش مییابد.
با انتخاب «حالت سریع»، به امکانات زیر دسترسی پیدا میکنید:
- تأخیر کم و قابلپیشبینی: «حالت سریع» حتی در زمان اوج تقاضا، توکنها را سریعتر و با سرعتی یکنواختتر از سرویس پردازش استاندارد تولید میکند.
- دسترسی آسان و انعطافپذیر: مانند پردازش استاندارد، میتوانید بدون نیاز به تخصیص ظرفیت از پیش، بهصورت انعطافپذیر و با پرداخت بهازای میزان استفاده به «حالت سریع» دسترسی داشته باشید.
توجه: در ۳۰ ژوئیهٔ ۲۰۲۶، نام «پردازش اولویتدار» به «حالت سریع» تغییر یافت. میتوانید در درخواستهای API خود از service_tier: priority یا service_tier: fast استفاده کنید.
| Short context | Long context | SLA آپتایم3 | SLA تأخیر3 | |||||
|---|---|---|---|---|---|---|---|---|
| قیمت به ازای هر ۱ میلیون توکن ورودی | قیمت برای هر ۱ میلیون توکن ورودی (ذخیرهشده در حافظه کش) | قیمت به ازای هر ۱ میلیون توکن خروجی | قیمت به ازای هر ۱ میلیون توکن ورودی | قیمت برای هر ۱ میلیون توکن ورودی (ذخیرهشده در حافظه کش) | قیمت به ازای هر ۱ میلیون توکن خروجی | |||
GPT-5.6 Sol | $۱۰٫۰۰ | $۱٫۰۰ | $۶۰٫۰۰ | $۲۰٫۰۰ | $۲٫۰۰ | $۹۰٫۰۰ | ۹۹٫۹٪ | ۹۹٪ > ۸۰ token در ثانیه۲ |
GPT-5.6 Terra | $۴٫۰۰ | $۰٫۴۰ | $۲۴٫۰۰ | $۸٫۰۰ | $۰٫۸۰ | $۳۶٫۰۰ | ۹۹٫۹٪ | ۹۹٪ > ۷۰ token در ثانیه۲ |
GPT-5.6 Luna | $۰٫۴۰ | $۰٫۰۴ | $۲٫۴۰ | $۰٫۸۰ | $۰٫۰۸ | $۳٫۶۰ | ۹۹٫۹٪ | ۹۹٪ > ۱۰۰ token در ثانیه۲ |
GPT-5.5 زمینه طولانی را مستثنی میکند۱ | $۱۲٫۵۰ | $۱٫۲۵۰ | $۷۵٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۵۰ token در ثانیه۲ |
GPT-5.4 mini زمینه طولانی را مستثنی میکند۱ | $۱٫۵۰ | $۰٫۱۵۰ | $۹٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۱۰۰ token در ثانیه۲ |
GPT-5.4 زمینه طولانی را مستثنی میکند۱ | $۵٫۰۰ | $۰٫۵۰۰ | $۳۰٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۵۰ token در ثانیه۲ |
GPT-5.2 | $۳٫۵۰ | $۰٫۳۵۰ | $۲۸٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۵۰ token در ثانیه۲ |
GPT-5.1 | $۲٫۵۰ | $۰٫۲۵۰ | $۲۰٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۵۰ token در ثانیه۲ |
GPT-5 | $۲٫۵۰ | $۰٫۲۵۰ | $۲۰٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۵۰ token در ثانیه۲ |
GPT-5 mini | $۰٫۴۵ | $۰٫۰۴۵ | $۳٫۶۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۸۰ token در ثانیه۲ |
GPT-5.1 codex | $۲٫۵۰ | $۰٫۲۵۰ | $۲۰٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۵۰ token در ثانیه۲ |
GPT-5 codex | $۲٫۵۰ | $۰٫۲۵۰ | $۲۰٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۵۰ token در ثانیه۲ |
GPT-4.1 | $۳٫۵۰ | $۰٫۸۷۵ | $۱۴٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۸۰ token در ثانیه۲ |
GPT-4.1 mini | $۰٫۷۰ | $۰٫۱۷۵ | $۲٫۸۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۹۰ token در ثانیه۲ |
GPT-4.1 nano | $۰٫۲۰ | $۰٫۰۵۰ | $۰٫۸۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۱۰۰ token در ثانیه۲ |
GPT-4o gpt-4o-2024-11-20 gpt-4o-2024-08-06 | $۴٫۲۵ | $۲٫۱۲۵ | $۱۷٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۸۰ token در ثانیه۲ |
gpt-4o-2024-05-13 | $۸٫۷۵ | — | $۲۶٫۲۵ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۸۰ token در ثانیه۲ |
GPT-4o mini | $۰٫۲۵ | $۰٫۱۲۵ | $۱٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۹۰ token در ثانیه۲ |
o3 | $۳٫۵۰ | $۰٫۸۷۵ | $۱۴٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۸۰ token در ثانیه۲ |
o4-mini | $۲٫۰۰ | $۰٫۵۰۰ | $۸٫۰۰ | — | — | — | ۹۹٫۹٪ | ۹۹٪ > ۹۰ token در ثانیه۲ |
چگونگی عملکرد
مشتریان میتوانند با استفاده از پارامتر موجود service_tier و انتخاب مقدار "fast"، حالت سریع را برای هر درخواست بهطور جداگانه فعال کنند.
هزینهٔ توکنهای پردازششده در حالت سریع بهازای هر توکن محاسبه میشود و از نرخ پردازش استاندارد بالاتر است.
علاوه بر تنظیم حالت سریع در سطح هر درخواست، میتوانید در مسیر «تنظیمات پروژه > ردهٔ خدمات پیشفرض»، گزینهٔ «سریع» را انتخاب کنید تا حالت سریع بهطور پیشفرض برای پروژه فعال شود. همچنان میتوانید این تنظیم را برای هر درخواست بهطور جداگانه تغییر دهید. انتخاب گزینهٔ «سریع» در تنظیمات پروژه، همان تأثیر انتخاب گزینهٔ «اولویت» را دارد.
محدودیتها
- محدودیتهای تعداد درخواست در «حالت سریع» با سایر ردههای خدمات مشترک هستند.
- در موارد نادر، اگر تعداد توکنهای پردازششده در دقیقه در «حالت سریع» بهسرعت افزایش یابد، ممکن است محدودیت تعداد درخواستها اعمال شود. اگر از محدودیت افزایش تعداد درخواستها عبور کنید، ممکن است درخواستهای اضافی بهجای «حالت سریع» با روش «پردازش استاندارد» پردازش شوند.