"الوضع السريع" لعملاء واجهة برمجة التطبيقات API
يوفّر "الوضع السريع" أداءً موثوقًا وعالي السرعة، مع مرونة الدفع حسب الاستخدام. بالنسبة إلى أحدث نماذجنا المتقدمة، gpt-5.6-sol، يمكنك الاستفادة من سرعات أعلى بما يصل إلى 2.5 مرة باستخدام "الوضع السريع".
عند اختيار "الوضع السريع"، يمكنك الاستفادة من:
- زمن استجابة منخفض يمكن التنبؤ به: ينشئ "الوضع السريع" الرموز بسرعة أكبر وبمعدل أكثر اتساقًا مقارنةً بخدمة المعالجة القياسية، حتى خلال فترات ذروة الطلب.
- مرونة سهلة الاستخدام: مثل المعالجة القياسية، يمكن الوصول إلى "الوضع السريع" بمرونة وبنظام الدفع حسب الاستخدام، من دون الحاجة إلى تخصيص السعة مسبقًا.
ملاحظة: تغيّر اسم "المعالجة ذات الأولوية" إلى "الوضع السريع" في 30 يوليو 2026. يمكنك استخدام إما `service_tier: priority` أو `service_tier: fast` في طلبات API.
| Short context | Long context | اتفاقية مستوى الخدمة (SLA) للتشغيل المستمر3 | اتفاقية زمن الاستجابة3 | |||||
|---|---|---|---|---|---|---|---|---|
| السعر لكل مليون رمز من رموز المدخلات. | السعر لكل مليون رمز إدخال (مخزن مؤقت) | السعر لكل مليون رمز من رموز المخرجات. | السعر لكل مليون رمز من رموز المدخلات. | السعر لكل مليون رمز إدخال (مخزن مؤقت) | السعر لكل مليون رمز من رموز المخرجات. | |||
GPT-5.6 Sol | 10.00 US$ | 1.00 US$ | 60.00 US$ | 20.00 US$ | 2.00 US$ | 90.00 US$ | 99.9% | 99% > 80 وحدة رموز في الثانية2 |
GPT-5.6 Terra | 4.00 US$ | 0.40 US$ | 24.00 US$ | 8.00 US$ | 0.80 US$ | 36.00 US$ | 99.9% | 99% > 70 وحدة رموز في الثانية2 |
GPT-5.6 Luna | 0.40 US$ | 0.04 US$ | 2.40 US$ | 0.80 US$ | 0.08 US$ | 3.60 US$ | 99.9% | 99% > 100 وحدة رموز في الثانية2 |
GPT-5.5 يستثني السياق الطويل1 | 12.50 US$ | 1.250 US$ | 75.00 US$ | — | — | — | 99.9% | 99% > 50 وحدة رموز في الثانية2 |
GPT-5.4 mini يستثني السياق الطويل1 | 1.50 US$ | 0.150 US$ | 9.00 US$ | — | — | — | 99.9% | 99% > 100 وحدة رموز في الثانية2 |
GPT-5.4 يستثني السياق الطويل1 | 5.00 US$ | 0.500 US$ | 30.00 US$ | — | — | — | 99.9% | 99% > 50 وحدة رموز في الثانية2 |
GPT-5.2 | 3.50 US$ | 0.350 US$ | 28.00 US$ | — | — | — | 99.9% | 99% > 50 وحدة رموز في الثانية2 |
GPT-5.1 | 2.50 US$ | 0.250 US$ | 20.00 US$ | — | — | — | 99.9% | 99% > 50 وحدة رموز في الثانية2 |
GPT-5 | 2.50 US$ | 0.250 US$ | 20.00 US$ | — | — | — | 99.9% | 99% > 50 وحدة رموز في الثانية2 |
GPT-5 mini | 0.45 US$ | 0.045 US$ | 3.60 US$ | — | — | — | 99.9% | 99% > 80 وحدة رموز في الثانية2 |
GPT-5.1 codex | 2.50 US$ | 0.250 US$ | 20.00 US$ | — | — | — | 99.9% | 99% > 50 وحدة رموز في الثانية2 |
GPT-5 codex | 2.50 US$ | 0.250 US$ | 20.00 US$ | — | — | — | 99.9% | 99% > 50 وحدة رموز في الثانية2 |
GPT-4.1 | 3.50 US$ | 0.875 US$ | 14.00 US$ | — | — | — | 99.9% | 99% > 80 وحدة رموز في الثانية2 |
GPT-4.1 mini | 0.70 US$ | 0.175 US$ | 2.80 US$ | — | — | — | 99.9% | 99% > 90 وحدة رموز في الثانية2 |
GPT-4.1 nano | 0.20 US$ | 0.050 US$ | 0.80 US$ | — | — | — | 99.9% | 99% > 100 وحدة رموز في الثانية2 |
GPT-4o gpt-4o-2024-11-20 gpt-4o-2024-08-06 | 4.25 US$ | 2.125 US$ | 17.00 US$ | — | — | — | 99.9% | 99% > 80 وحدة رموز في الثانية2 |
gpt-4o-2024-05-13 | 8.75 US$ | — | 26.25 US$ | — | — | — | 99.9% | 99% > 80 وحدة رموز في الثانية2 |
GPT-4o mini | 0.25 US$ | 0.125 US$ | 1.00 US$ | — | — | — | 99.9% | 99% > 90 وحدة رموز في الثانية2 |
o3 | 3.50 US$ | 0.875 US$ | 14.00 US$ | — | — | — | 99.9% | 99% > 80 وحدة رموز في الثانية2 |
o4-mini | 2.00 US$ | 0.500 US$ | 8.00 US$ | — | — | — | 99.9% | 99% > 90 وحدة رموز في الثانية2 |
كيف تعمل هذه الميزة
يمكن للعملاء توجيه حركة الطلبات إلى "الوضع السريع" لكل طلب على حدة باستخدام المعلمة الحالية service_tier، مع ضبطها على service_tier = "fast".
ستُحتسب رسوم الرموز التي تتم معالجتها عبر "الوضع السريع" على أساس كل رمز، بسعر أعلى من أسعار المعالجة القياسية.
إضافةً إلى ضبط "الوضع السريع" على مستوى كل طلب، يمكنك أيضًا تعيينه كخيار افتراضي للمشروع من خلال: إعدادات المشروع > مستوى الخدمة الافتراضي: سريع. ولا يزال بإمكانك تجاوز هذا الإعداد لكل طلب بشكل مستقل. يعادل اختيار "سريع" في إعدادات المشروع اختيار "الأولوية".
القيود
- حدود الاستخدام في "الوضع السريع" مشتركة مع مستويات الخدمة الأخرى.
- في حالات نادرة، قد تؤدي الزيادات السريعة في عدد الرموز في الدقيقة ضمن "الوضع السريع" إلى بلوغ حدود معدل الزيادة. إذا تجاوزت حد معدل الزيادة، فقد تُوجَّه حركة الطلبات الإضافية إلى المعالجة القياسية بدلًا من ذلك.