โหมด Fast สำหรับลูกค้า API
โหมด Fast มอบประสิทธิภาพที่รวดเร็วและเชื่อถือได้ พร้อมความยืดหยุ่นในการจ่ายตามการใช้งานจริง สำหรับโมเดลระดับแนวหน้าล่าสุดของเราอย่าง gpt-5.6-sol คุณสามารถเข้าถึงความเร็วที่เร็วขึ้นได้สูงสุด 2.5 เท่าด้วยโหมด Fast
เมื่อคุณเลือกโหมด Fast คุณจะสามารถปลดล็อก:
- ความหน่วงต่ำที่สามารถคาดการณ์ได้: โหมด Fast สร้างโทเค็นได้เร็วขึ้น และมีความสม่ำเสมอมากกว่าบริการประมวลผลมาตรฐานแม้ในช่วงที่มีการใช้งานหนาแน่น
- ความยืดหยุ่นที่ใช้งานง่าย: เช่นเดียวกับการประมวลผลแบบมาตรฐาน โหมด Fast สามารถใช้งานได้ในรูปแบบที่ยืดหยุ่น จ่ายตามการใช้งานจริง โดยไม่จำเป็นต้องมีการจัดสรรล่วงหน้า
หมายเหตุ: การประมวลผลแบบเร่งด่วนเปลี่ยนชื่อเป็นโหมด Fast เมื่อวันที่ 30 กรกฎาคม 2569 คุณสามารถใช้ `service_tier: priority` หรือ `service_tier: fast` ในคำขอ API ของคุณได้
| ราคาต่อ 1 ล้านโทเค็นอินพุต | ราคาต่อ 1 ล้านโทเค็นอินพุต (แคชไว้) | ราคาต่อ 1 ล้านโทเค็นเอาต์พุต | ข้อตกลงระดับการให้บริการเกี่ยวกับความพร้อมใช้งาน (Uptime SLA)3 | ข้อตกลงระดับการให้บริการเกี่ยวกับเวลาในการตอบสนอง3 | |
|---|---|---|---|---|---|
GPT-5.6 Sol ไม่รวมบริบทยาว1 | US$10.00 | US$1.00 | US$60.00 | 99.9% | 99% > 80 โทเค็นต่อวินาที2 |
GPT-5.6 Terra ไม่รวมบริบทยาว1 | US$4.00 | US$0.40 | US$24.00 | 99.9% | 99% > 70 โทเค็นต่อวินาที2 |
GPT-5.6 Luna ไม่รวมบริบทยาว1 | US$0.40 | US$0.04 | US$2.40 | 99.9% | 99% > 100 โทเค็นต่อวินาที2 |
GPT-5.5 ไม่รวมบริบทยาว1 | US$12.50 | US$1.250 | US$75.00 | 99.9% | 99% > 50 โทเค็นต่อวินาที2 |
GPT-5.4 mini ไม่รวมบริบทยาว1 | US$1.50 | US$0.150 | US$9.00 | 99.9% | 99% > 100 โทเค็นต่อวินาที2 |
GPT-5.4 ไม่รวมบริบทยาว1 | US$5.00 | US$0.500 | US$30.00 | 99.9% | 99% > 50 โทเค็นต่อวินาที2 |
GPT-5.2 | US$3.50 | US$0.350 | US$28.00 | 99.9% | 99% > 50 โทเค็นต่อวินาที2 |
GPT-5.1 | US$2.50 | US$0.250 | US$20.00 | 99.9% | 99% > 50 โทเค็นต่อวินาที2 |
GPT-5 | US$2.50 | US$0.250 | US$20.00 | 99.9% | 99% > 50 โทเค็นต่อวินาที2 |
GPT-5 mini | US$0.45 | US$0.045 | US$3.60 | 99.9% | 99% > 80 โทเค็นต่อวินาที2 |
GPT-5.1 codex | US$2.50 | US$0.250 | US$20.00 | 99.9% | 99% > 50 โทเค็นต่อวินาที2 |
GPT-5 codex | US$2.50 | US$0.250 | US$20.00 | 99.9% | 99% > 50 โทเค็นต่อวินาที2 |
GPT-4.1 | US$3.50 | US$0.875 | US$14.00 | 99.9% | 99% > 80 โทเค็นต่อวินาที2 |
GPT-4.1 mini | US$0.70 | US$0.175 | US$2.80 | 99.9% | 99% > 90 โทเค็นต่อวินาที2 |
GPT-4.1 nano | US$0.20 | US$0.050 | US$0.80 | 99.9% | 99% > 100 โทเค็นต่อวินาที2 |
GPT-4o gpt-4o-2024-11-20 gpt-4o-2024-08-06 | US$4.25 | US$2.125 | US$17.00 | 99.9% | 99% > 80 โทเค็นต่อวินาที2 |
gpt-4o-2024-05-13 | US$8.75 | — | US$26.25 | 99.9% | 99% > 80 โทเค็นต่อวินาที2 |
GPT-4o mini | US$0.25 | US$0.125 | US$1.00 | 99.9% | 99% > 90 โทเค็นต่อวินาที2 |
o3 | US$3.50 | US$0.875 | US$14.00 | 99.9% | 99% > 80 โทเค็นต่อวินาที2 |
o4-mini | US$2.00 | US$0.500 | US$8.00 | 99.9% | 99% > 90 โทเค็นต่อวินาที2 |
วิธีการทำงาน
ลูกค้าสามารถกำหนดทราฟฟิกไปยังโหมด Fast เป็นรายคำขอได้ โดยใช้พารามิเตอร์ service_tier ที่มีอยู่ พร้อมตัวเลือก service_tier = "fast"
โทเค็นที่ให้บริการโดยโหมด Fast จะถูกคิดราคาต่อโทเค็น โดยคิดราคาพิเศษเมื่อเทียบกับอัตราการประมวลผลมาตรฐาน
นอกจากการกำหนดค่าในระดับคำขอแล้ว คุณยังสามารถตั้งค่าโปรเจกต์ให้เป็นโหมด Fast ตามค่าเริ่มต้นได้ใน Project settings > Default Service Tier: Fast คุณยังสามารถปรับเปลี่ยนการทำงานได้เป็นรายคำขอ การเลือกโหมด Fast ในการตั้งค่าโปรเจกต์ของคุณจะเทียบเท่ากับการเลือกการประมวลผลแบบเร่งด่วน
ข้อจำกัด
- ลิมิตการใช้งานของโหมด Fast จะถูกแชร์ร่วมกับประเภทของแพ็กเกจอื่นๆ
- ในบางกรณีที่พบได้ยาก การเพิ่ม Tokens per Minute (TPM) ของโหมด Fast อย่างรวดเร็วอาจส่งผลให้เกินลิมิตการเพิ่มอัตราเร่งได้ หากคุณใช้งานเกินลิมิตการเพิ่มอัตราเร่ง ทราฟฟิกเพิ่มเติมอาจถูกส่งไปยังการประมวลผลแบบมาตรฐานแทน