გადადით მთავარ შინაარსზე
OpenAI

სწრაფი რეჟიმი API-ის მომხმარებლებისთვის

Fast mode გთავაზობთ სტაბილურ, მაღალსიჩქარიან წარმადობას pay-as-you-go მოქნილი სისტემით. ჩვენი უახლესი მოწინავე მოდელისთვის, gpt-5.6-sol, სწრაფი რეჟიმის მეშვეობით შეგიძლიათ მიიღოთ წვდომა 2,5-ჯერ უფრო მაღალი სიჩქარით.

Fast mode-ის არჩევით, შეგიძლიათ მიიღოთ წვდომა შემდეგზე:

  • პროგნოზირებადად დაბალი დაყოვნება: Fast mode ტოკენებს წარმოქმნის უფრო სწრაფად და სტაბილური სიჩქარით, ვიდრე სტანდარტული დამუშავების სერვისი, პიკური დატვირთვის დროსაც კი.
  • მარტივად გამოსაყენებელი მოქნილობა: სტანდარტული რეჟიმის მსგავსად, Fast mode-ით სარგებლობთ მოქნილი Pay-as-you-go ტარიფით, წინასწარი რესურსების გამოყოფის საჭიროების გარეშე.

შენიშვნა: პრიორიტეტულ დამუშავებას 2026 წლის 30 ივლისს ეწოდა Fast mode . თქვენ შეგიძლიათ გამოიყენოთ ან service_tier: priority, ან service_tier: fast თქვენს API მოთხოვნებში.

Short contextLong contextSLA-ს უწყვეტი მუშაობის გარანტია3დაყოვნების SLA3
ფასი 1M შემავალი ტოკენისთვისფასი 1M შეყვანის ტოკენზე (cached)ფასი 1M გამომავალი ტოკენებისთვისფასი 1M შემავალი ტოკენისთვისფასი 1M შეყვანის ტოკენზე (cached)ფასი 1M გამომავალი ტოკენებისთვის
GPT-5.6 Sol
10,00 US$1,00 US$60,00 US$20,00 US$2,00 US$90,00 US$99,9%99% > 80 ტოკენი წამში2
GPT-5.6 Terra
4,00 US$0,40 US$24,00 US$8,00 US$0,80 US$36,00 US$99,9%99% > 70 ტოკენი წამში2
GPT-5.6 Luna
0,40 US$0,04 US$2,40 US$0,80 US$0,08 US$3,60 US$99,9%99% > 100 ტოკენი წამში2
GPT-5.5
გამორიცხავს ხანგრძლივ კონტექსტს1
12,50 US$1,250 US$75,00 US$99,9%99% > 50 ტოკენი წამში2
GPT-5.4 mini
გამორიცხავს ხანგრძლივ კონტექსტს1
1,50 US$0,150 US$9,00 US$99,9%99% > 100 ტოკენი წამში2
GPT-5.4
გამორიცხავს ხანგრძლივ კონტექსტს1
5,00 US$0,500 US$30,00 US$99,9%99% > 50 ტოკენი წამში2
GPT-5.2
3,50 US$0,350 US$28,00 US$99,9%99% > 50 ტოკენი წამში2
GPT-5.1
2,50 US$0,250 US$20,00 US$99,9%99% > 50 ტოკენი წამში2
GPT-5
2,50 US$0,250 US$20,00 US$99,9%99% > 50 ტოკენი წამში2
GPT-5 mini
0,45 US$0,045 US$3,60 US$99,9%99% > 80 ტოკენი წამში2
GPT-5.1 codex
2,50 US$0,250 US$20,00 US$99,9%99% > 50 ტოკენი წამში2
GPT-5 codex
2,50 US$0,250 US$20,00 US$99,9%99% > 50 ტოკენი წამში2
GPT-4.1
3,50 US$0,875 US$14,00 US$99,9%99% > 80 ტოკენი წამში2
GPT-4.1 mini
0,70 US$0,175 US$2,80 US$99,9%99% > 90 ტოკენი წამში2
GPT-4.1 nano
0,20 US$0,050 US$0,80 US$99,9%99% > 100 ტოკენი წამში2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
4,25 US$2,125 US$17,00 US$99,9%99% > 80 ტოკენი წამში2
gpt-4o-2024-05-13
8,75 US$26,25 US$99,9%99% > 80 ტოკენი წამში2
GPT-4o mini
0,25 US$0,125 US$1,00 US$99,9%99% > 90 ტოკენი წამში2
o3
3,50 US$0,875 US$14,00 US$99,9%99% > 80 ტოკენი წამში2
o4-mini
2,00 US$0,500 US$8,00 US$99,9%99% > 90 ტოკენი წამში2
1მოთხოვნები, რომლებიც ფასდება, როგორც >272K პრომპტის ტოკენი
2გამოითვლება p50 მოთხოვნის დაყოვნების მიხედვით ყოველ 5 წუთზე. იმ მომხმარებლებისთვის, რომლებსაც აქვთ მოქმედი კორპორაციული ხელშეკრულებები და რომელთა დაყოვნების SLA-ები გამოითვლება როგორც p50 მოთხოვნის დაყოვნება წუთობრივ ჭრილში, წინა SLA-ები კვლავ ძალაში რჩება.
3ეს ვრცელდება მხოლოდ კორპორაციულ მომხმარებლებზე

როგორ მუშაობს

მომხმარებლებს შეუძლიათ ტრაფიკი სწრაფ რეჟიმზე მიმართონ თითოეული მოთხოვნის დონეზე არსებული service_tier პარამეტრის გამოყენებით, შემდეგი ოფციით: service_tier = "fast".

Fast რეჟიმში მიწოდებული ტოკენების დაანგარიშება მოხდება თითოეული ტოკენის მიხედვით, სტანდარტულ ტარიფებთან შედარებით უფრო მაღალი ფასით.

მოთხოვნის დონეზე კონფიგურაციის გარდა, შეგიძლიათ პროექტისთვის Fast რეჟიმი ნაგულისხმევადაც დააყენოთ: Project settings > Default Service Tier: Fast. თქვენ კვლავ შეგიძლიათ მისი გადაფარვა თითოეული მოთხოვნის დონეზე. თქვენი პროექტის პარამეტრებში Fast-ის არჩევა Priority-ის არჩევის ტოლფასია.

შეზღუდვები

  • Fast mode-ის მოთხოვნების ლიმიტები გაზიარებულია (საერთოა) სერვისის სხვა ტარიფებთან/დონეებთან.
  • იშვიათ შემთხვევებში, თქვენი სწრაფი რეჟიმის წუთში token-ების რაოდენობის სწრაფმა ზრდამ შეიძლება გამოიწვიოს მოთხოვნების ლიმიტების გადაჭარბება. თუ მოთხოვნების ლიმიტს გადააჭარბებთ, დამატებითი ტრაფიკი შესაძლოა სტანდარტულ დამუშავებაზე გაიგზავნოს.

ხშირად დასმული კითხვები

ფასები

მოდელები

მოთხოვნების ლიმიტი

საიმედოობა

წესები