ข้ามไปยังเนื้อหาหลัก
OpenAI

โหมด Fast สำหรับลูกค้า API

โหมด Fast มอบประสิทธิภาพที่รวดเร็วและเชื่อถือได้ พร้อมความยืดหยุ่นในการจ่ายตามการใช้งานจริง สำหรับ gpt-5.6-sol คุณสามารถใช้งานได้เร็วขึ้นสูงสุด 2.5 เท่าด้วยโหมด Fast

เมื่อคุณเลือกโหมด Fast คุณจะสามารถปลดล็อก:

  • ความหน่วงต่ำที่สามารถคาดการณ์ได้: โหมด Fast สร้างโทเค็นได้เร็วขึ้น และมีความสม่ำเสมอมากกว่าบริการประมวลผลมาตรฐานแม้ในช่วงที่มีการใช้งานหนาแน่น

  • ใช้งานง่ายและยืดหยุ่น: โหมด Fast เปิดให้ใช้งานแบบชำระเงินตามการใช้งานจริงเช่นเดียวกับการประมวลผลแบบ Standard โดยไม่ต้องสำรองทรัพยากรล่วงหน้า

หมายเหตุ: การประมวลผลแบบเร่งด่วนเปลี่ยนชื่อเป็นโหมด Fast เมื่อวันที่ 30 กรกฎาคม 2569 คุณสามารถใช้ `service_tier: priority` หรือ `service_tier: fast` ในคำขอ API ของคุณได้

บริบทสั้นบริบทยาวข้อตกลงระดับการให้บริการเกี่ยวกับความพร้อมใช้งาน (Uptime SLA)3ข้อตกลงระดับการให้บริการเกี่ยวกับเวลาในการตอบสนอง3
ราคาต่อ 1 ล้านโทเค็นอินพุตราคาต่อ 1 ล้านโทเค็นอินพุต (แคชไว้)ราคาต่อ 1 ล้านโทเค็นเอาต์พุตราคาต่อ 1 ล้านโทเค็นอินพุตราคาต่อ 1 ล้านโทเค็นอินพุต (แคชไว้)ราคาต่อ 1 ล้านโทเค็นเอาต์พุต
GPT-6 Astra
US$20.00US$2.00US$100.00US$40.00US$4.00US$150.00——
GPT-6.1 Sol
US$4.00US$0.20US$20.00US$8.00US$0.40US$30.00——
GPT-6 Sol
US$4.00US$0.40US$20.00US$8.00US$0.80US$30.00——
GPT-6 Luna
US$0.20US$0.02US$1.00US$0.40US$0.04US$1.50——
GPT-5.6 Sol
US$8.00US$0.80US$40.00US$16.00US$1.60US$60.0099.9%99% > 80 โทเค็นต่อวินาที2
GPT-5.6 Terra
US$4.00US$0.40US$24.00US$8.00US$0.80US$36.0099.9%99% > 70 โทเค็นต่อวินาที2
GPT-5.6 Luna
US$0.40US$0.04US$2.40US$0.80US$0.08US$3.6099.9%99% > 100 โทเค็นต่อวินาที2
GPT-5.5
ไม่รวมบริบทยาว1
US$12.50US$1.250US$75.00———99.9%99% > 50 โทเค็นต่อวินาที2
GPT-5.4 mini
ไม่รวมบริบทยาว1
US$1.50US$0.150US$9.00———99.9%99% > 100 โทเค็นต่อวินาที2
GPT-5.4
ไม่รวมบริบทยาว1
US$5.00US$0.500US$30.00———99.9%99% > 50 โทเค็นต่อวินาที2
GPT-5.2
US$3.50US$0.350US$28.00———99.9%99% > 50 โทเค็นต่อวินาที2
GPT-5.1
US$2.50US$0.250US$20.00———99.9%99% > 50 โทเค็นต่อวินาที2
GPT-5
US$2.50US$0.250US$20.00———99.9%99% > 50 โทเค็นต่อวินาที2
GPT-5 mini
US$0.45US$0.045US$3.60———99.9%99% > 80 โทเค็นต่อวินาที2
GPT-5.1 codex
US$2.50US$0.250US$20.00———99.9%99% > 50 โทเค็นต่อวินาที2
GPT-5 codex
US$2.50US$0.250US$20.00———99.9%99% > 50 โทเค็นต่อวินาที2
GPT-4.1
US$3.50US$0.875US$14.00———99.9%99% > 80 โทเค็นต่อวินาที2
GPT-4.1 mini
US$0.70US$0.175US$2.80———99.9%99% > 90 โทเค็นต่อวินาที2
GPT-4.1 nano
US$0.20US$0.050US$0.80———99.9%99% > 100 โทเค็นต่อวินาที2
GPT-4o
gpt-4o-2024-11-20
gpt-4o-2024-08-06
US$4.25US$2.125US$17.00———99.9%99% > 80 โทเค็นต่อวินาที2
gpt-4o-2024-05-13
US$8.75—US$26.25———99.9%99% > 80 โทเค็นต่อวินาที2
GPT-4o mini
US$0.25US$0.125US$1.00———99.9%99% > 90 โทเค็นต่อวินาที2
o3
US$3.50US$0.875US$14.00———99.9%99% > 80 โทเค็นต่อวินาที2
o4-mini
US$2.00US$0.500US$8.00———99.9%99% > 90 โทเค็นต่อวินาที2
1คำขอที่ประเมินไว้ที่มากกว่า 272,000 โทเค็นของพรอมต์
2คำนวณเป็นความหน่วงของคำขอ p50 ในทุกๆ 5 นาที สำหรับลูกค้าที่มีข้อตกลงองค์กรที่มีอยู่ซึ่งมี SLA เวลาในการตอบสนองคำนวณเป็น p50 ของคำขอต่อนาที ข้อตกลง SLA ก่อนหน้านี้ยังคงมีผลบังคับใช้
3ใช้ได้เฉพาะกับลูกค้า Enterprise เท่านั้น

วิธีการทำงาน

ลูกค้าสามารถกำหนดทราฟฟิกไปยังโหมด Fast เป็นรายคำขอได้ โดยใช้พารามิเตอร์ service_tier ที่มีอยู่ พร้อมตัวเลือก service_tier = "fast"

โทเค็นที่ให้บริการโดยโหมด Fast จะถูกคิดราคาต่อโทเค็น โดยคิดราคาพิเศษเมื่อเทียบกับอัตราการประมวลผลมาตรฐาน

นอกจากการกำหนดค่าในระดับคำขอแล้ว คุณยังสามารถตั้งค่าโปรเจกต์ให้เป็นโหมด Fast ตามค่าเริ่มต้นได้ใน Project settings > Default Service Tier: Fast คุณยังสามารถปรับเปลี่ยนการทำงานได้เป็นรายคำขอ การเลือกโหมด Fast ในการตั้งค่าโปรเจกต์ของคุณจะเทียบเท่ากับการเลือกการประมวลผลแบบเร่งด่วน

ข้อจำกัด

  • ลิมิตการใช้งานของโหมด Fast จะถูกแชร์ร่วมกับประเภทของแพ็กเกจอื่นๆ

  • ในบางกรณีซึ่งเกิดขึ้นไม่บ่อยนัก การเพิ่มจำนวนโทเค็นต่อนาทีในโหมด Fast อย่างรวดเร็วอาจทำให้ถึงขีดจำกัดของอัตราการเพิ่มการใช้งาน หากคุณใช้งานเกินลิมิตการเพิ่มอัตราเร่ง ทราฟฟิกเพิ่มเติมอาจถูกส่งไปยังการประมวลผลแบบมาตรฐานแทน

คำถามที่พบบ่อย

ค่าบริการ

โมเดล

ลิมิตการใช้งาน

ไว้วางใจได้

นโยบาย