ข้ามไปยังเนื้อหาหลัก
OpenAI

โหมด Fast สำหรับลูกค้า API

โหมด Fast มอบประสิทธิภาพที่รวดเร็วและเชื่อถือได้ พร้อมความยืดหยุ่นในการจ่ายตามการใช้งานจริง สำหรับโมเดลระดับแนวหน้าล่าสุดของเราอย่าง gpt-5.6-sol คุณสามารถเข้าถึงความเร็วที่เร็วขึ้นได้สูงสุด 2.5 เท่าด้วยโหมด Fast

เมื่อคุณเลือกโหมด Fast คุณจะสามารถปลดล็อก:

  • ความหน่วงต่ำที่สามารถคาดการณ์ได้: โหมด Fast สร้างโทเค็นได้เร็วขึ้น และมีความสม่ำเสมอมากกว่าบริการประมวลผลมาตรฐานแม้ในช่วงที่มีการใช้งานหนาแน่น
  • ความยืดหยุ่นที่ใช้งานง่าย: เช่นเดียวกับการประมวลผลแบบมาตรฐาน โหมด Fast สามารถใช้งานได้ในรูปแบบที่ยืดหยุ่น จ่ายตามการใช้งานจริง โดยไม่จำเป็นต้องมีการจัดสรรล่วงหน้า

หมายเหตุ: การประมวลผลแบบเร่งด่วนเปลี่ยนชื่อเป็นโหมด Fast เมื่อวันที่ 30 กรกฎาคม 2569 คุณสามารถใช้ `service_tier: priority` หรือ `service_tier: fast` ในคำขอ API ของคุณได้

ราคาต่อ 1 ล้านโทเค็นอินพุตราคาต่อ 1 ล้านโทเค็นอินพุต (แคชไว้)ราคาต่อ 1 ล้านโทเค็นเอาต์พุตข้อตกลงระดับการให้บริการเกี่ยวกับความพร้อมใช้งาน (Uptime SLA)3ข้อตกลงระดับการให้บริการเกี่ยวกับเวลาในการตอบสนอง3
GPT-5.6 Sol
ไม่รวมบริบทยาว1
US$10.00US$1.00US$60.0099.9%99% > 80 โทเค็นต่อวินาที2
GPT-5.6 Terra
ไม่รวมบริบทยาว1
US$4.00US$0.40US$24.0099.9%99% > 70 โทเค็นต่อวินาที2
GPT-5.6 Luna
ไม่รวมบริบทยาว1
US$0.40US$0.04US$2.4099.9%99% > 100 โทเค็นต่อวินาที2
GPT-5.5
ไม่รวมบริบทยาว1
US$12.50US$1.250US$75.0099.9%99% > 50 โทเค็นต่อวินาที2
GPT-5.4 mini
ไม่รวมบริบทยาว1
US$1.50US$0.150US$9.0099.9%99% > 100 โทเค็นต่อวินาที2
GPT-5.4
ไม่รวมบริบทยาว1
US$5.00US$0.500US$30.0099.9%99% > 50 โทเค็นต่อวินาที2
GPT-5.2
US$3.50US$0.350US$28.0099.9%99% > 50 โทเค็นต่อวินาที2
GPT-5.1
US$2.50US$0.250US$20.0099.9%99% > 50 โทเค็นต่อวินาที2
GPT-5
US$2.50US$0.250US$20.0099.9%99% > 50 โทเค็นต่อวินาที2
GPT-5 mini
US$0.45US$0.045US$3.6099.9%99% > 80 โทเค็นต่อวินาที2
GPT-5.1 codex
US$2.50US$0.250US$20.0099.9%99% > 50 โทเค็นต่อวินาที2
GPT-5 codex
US$2.50US$0.250US$20.0099.9%99% > 50 โทเค็นต่อวินาที2
GPT-4.1
US$3.50US$0.875US$14.0099.9%99% > 80 โทเค็นต่อวินาที2
GPT-4.1 mini
US$0.70US$0.175US$2.8099.9%99% > 90 โทเค็นต่อวินาที2
GPT-4.1 nano
US$0.20US$0.050US$0.8099.9%99% > 100 โทเค็นต่อวินาที2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
US$4.25US$2.125US$17.0099.9%99% > 80 โทเค็นต่อวินาที2
gpt-4o-2024-05-13
US$8.75US$26.2599.9%99% > 80 โทเค็นต่อวินาที2
GPT-4o mini
US$0.25US$0.125US$1.0099.9%99% > 90 โทเค็นต่อวินาที2
o3
US$3.50US$0.875US$14.0099.9%99% > 80 โทเค็นต่อวินาที2
o4-mini
US$2.00US$0.500US$8.0099.9%99% > 90 โทเค็นต่อวินาที2
1คำขอที่ประเมินไว้ที่มากกว่า 272,000 โทเค็นของพรอมต์
2คำนวณเป็นความหน่วงของคำขอ p50 ในทุกๆ 5 นาที สำหรับลูกค้าที่มีข้อตกลงองค์กรที่มีอยู่ซึ่งมี SLA เวลาในการตอบสนองคำนวณเป็น p50 ของคำขอต่อนาที ข้อตกลง SLA ก่อนหน้านี้ยังคงมีผลบังคับใช้
3ใช้ได้เฉพาะกับลูกค้า Enterprise เท่านั้น

วิธีการทำงาน

ลูกค้าสามารถกำหนดทราฟฟิกไปยังโหมด Fast เป็นรายคำขอได้ โดยใช้พารามิเตอร์ service_tier ที่มีอยู่ พร้อมตัวเลือก service_tier = "fast"

โทเค็นที่ให้บริการโดยโหมด Fast จะถูกคิดราคาต่อโทเค็น โดยคิดราคาพิเศษเมื่อเทียบกับอัตราการประมวลผลมาตรฐาน

นอกจากการกำหนดค่าในระดับคำขอแล้ว คุณยังสามารถตั้งค่าโปรเจกต์ให้เป็นโหมด Fast ตามค่าเริ่มต้นได้ใน Project settings > Default Service Tier: Fast คุณยังสามารถปรับเปลี่ยนการทำงานได้เป็นรายคำขอ การเลือกโหมด Fast ในการตั้งค่าโปรเจกต์ของคุณจะเทียบเท่ากับการเลือกการประมวลผลแบบเร่งด่วน

ข้อจำกัด

  • ลิมิตการใช้งานของโหมด Fast จะถูกแชร์ร่วมกับประเภทของแพ็กเกจอื่นๆ
  • ในบางกรณีที่พบได้ยาก การเพิ่ม Tokens per Minute (TPM) ของโหมด Fast อย่างรวดเร็วอาจส่งผลให้เกินลิมิตการเพิ่มอัตราเร่งได้ หากคุณใช้งานเกินลิมิตการเพิ่มอัตราเร่ง ทราฟฟิกเพิ่มเติมอาจถูกส่งไปยังการประมวลผลแบบมาตรฐานแทน

คำถามที่พบบ่อย

ค่าบริการ

โมเดล

ลิมิตการใช้งาน

ไว้วางใจได้

นโยบาย