ข้ามไปยังเนื้อหาหลัก
OpenAI

30 กรกฎาคม 2569

ผลิตภัณฑ์

ยกระดับขีดจำกัดด้านราคาและประสิทธิภาพด้วย GPT‑5.6

OpenAI เพิ่มประสิทธิภาพในทุกชั้น เพื่อมอบประสิทธิผลต่อเงินทุกดอลลาร์ที่สูงขึ้นสำหรับภาระงานระดับองค์กรที่หลากหลายกว่าเดิม

กำลังโหลด…

เมื่อวานนี้เราได้เผยแพร่เรื่องราวว่า GPT‑5.6 ช่วยพัฒนาตัวเองให้ทำงานได้อย่างมีประสิทธิภาพยิ่งขึ้นได้อย่างไร วันนี้เราส่งต่อประโยชน์ที่ได้รับเหล่านั้นให้แก่ลูกค้าด้วยการปรับลดราคาของ GPT‑5.6 Luna(เปิดในหน้าต่างใหม่) และ Terra(เปิดในหน้าต่างใหม่) พร้อมเพิ่มความเร็วในการทำงานของ GPT‑5.6 Sol ใน API การอัปเดตทั้งหมดนี้ช่วยให้ลูกค้าใช้เงินทุกดอลลาร์ที่ลงทุนใน AI ได้อย่างคุ้มค่ายิ่งขึ้น และทำงานได้รวดเร็วยิ่งขึ้นในช่วงเวลาสำคัญ

ตั้งแต่วันนี้เป็นต้นไป GPT‑5.6 Luna ซึ่งเป็นรุ่นที่เร็วและราคาถูกที่สุดของเรา จะมีราคาถูกลง 80% ขณะที่ GPT‑5.6 Terra โมเดลที่สมดุลสeหรับงานประจำวันของเรา จะมีต้นทุนลดลง 20% ราคาที่ปรับลดลงสำหรับ Luna และ Terra ยังมีผลต่อการคำนวณปริมาณการใช้งานตามสิทธิ์ของแพ็กเกจแบบชำระเงินใน Codex และ ChatGPT Work อีกด้วย Luna ช่วยให้ธุรกิจจัดการงานปริมาณมากโดยยังคงคุณภาพในระดับสูงได้อย่างคุ้มค่ากว่าเดิมอย่างมาก โดยสามารถใช้เครื่องมือต่างๆ และดำเนินเวิร์กโฟลว์หลายขั้นตอนได้ จึงช่วยให้สามารถนำแอปพลิเคชัน AI ที่หลากหลายยิ่งขึ้นไปใช้งานในวงกว้างได้จริง

การทำให้ความฉลาดล้ำหน้ามีอยู่ทั่วไปและมีราคาจับต้องได้ ถือเป็นศูนย์กลางพันธกิจ OpenAI ที่มุ่งมั่นดูแลให้ AGI เป็นประโยชน์ต่อมวลมนุษยชาติ การเปลี่ยนแปลงเหล่านี้ทำให้ความมุ่งมั่นนั้นเป็นรูปธรรม การปรับเปลี่ยนเหล่านี้สะท้อนให้เห็นว่าเรานำคำมั่นดังกล่าวมาปฏิบัติจริง

เรายังแนะนำโหมด Fast ใน API ซึ่งจะมาแทนที่ข้อเสนอการประมวลแบบเร่งด่วนของเรา สำหรับ GPT‑5.6 Sol ตอนนี้โหมด Fast ทำงานได้เร็วกว่าโหมด Standard สูงสุด 2.5 เท่า โดยมีราคาเป็นสองเท่าและยังคงระดับความฉลาดเท่าเดิม โหมด Fast ยังคงรองรับการใช้งานเดิม โดยคำขอที่ติดแท็ก priority จะเปลี่ยนไปใช้โหมด Fast โดยอัตโนมัติ

1 จาก 6
GPT‑5.6 Luna ทำให้เราเข้าใกล้ความสามารถทางปัญญาที่ราคาถูกจนแทบไม่ต้องวัดการใช้งานมากที่สุดเท่าที่เคยมีมา ผม'ไม่เคยเห็นโมเดลที่ราคาประหยัดขนาดนี้แต่ทรงพลังได้ถึงเพียงนี้มาก่อน — มันช่วยปลดล็อกกรณีการใช้งานสำหรับ Replit ที่เราไม่คิดว่าจะสร้างได้ในเร็ววัน
Michele Catasta ประธานบริษัทและหัวหน้าฝ่าย AI, Replit

เลือกระดับความฉลาดให้เหมาะกับผลลัพธ์ที่ต้องการ

การใช้ AI อย่างมีประสิทธิภาพเริ่มต้นจากผลลัพธ์ที่ต้องการ ระดับความเสี่ยง ต้นทุนจากความผิดพลาด ความเร่งด่วน และขนาดของงาน จะเป็นตัวกำหนดว่าควรสร้างสมดุลระหว่างความฉลาด ความเร็ว ความน่าเชื่อถือ และต้นทุนอย่างไร สมดุลที่เหมาะสมอาจแตกต่างกันไปในแต่ละขั้นตอนของเวิร์กโฟลว์

GPT‑5.6 เปิดโอกาสให้ธุรกิจปรับสมดุลระหว่างปัจจัยเหล่านี้ได้อย่างยืดหยุ่นมากขึ้น Luna มอบประสิทธิภาพในระดับใกล้เคียงกับโมเดลระดับแนวหน้าเมื่อหนึ่งปีก่อน โดยมีต้นทุนต่องานเพียงประมาณ 6 เซนต์ต่อทุก 1 ดอลลาร์ และทำงานได้เร็วกว่าเกือบ 9 เท่า สำหรับงานระดับมืออาชีพ เมื่อวัดผลด้วย Agents’ Last Exam พบว่า Luna ทำผลงานได้ดีกว่า Fable 5 โดยมีต้นทุนต่องานโดยประมาณต่ำกว่าเกือบ 99%

ในทางปฏิบัติ ธุรกิจสามารถกำหนดผลลัพธ์และมาตรฐานคุณภาพที่ต้องการ จากนั้นใช้การประเมินเพื่อพิจารณาว่างานส่วนใดจะได้ผลลัพธ์ที่ดีขึ้นอย่างชัดเจนเมื่อใช้ความฉลาดเพิ่มเติม และงานส่วนใดสามารถใช้การประมวลผลที่เร็วกว่าและมีต้นทุนต่ำกว่าโดยยังคงคุณภาพเท่าเดิม เวิร์กโฟลว์การเขียนโค้ดอาจเริ่มจากการใช้ Sol เพื่อหาคำตอบในส่วนที่ยังไม่ชัดเจนและกำหนดแผนงาน ก่อนใช้ Luna เพื่อแก้ไขโค้ดตามข้อกำหนดที่ชัดเจน เขียนและรันการทดสอบ และประเมินผลลัพธ์ เวิร์กโฟลว์อีกแบบหนึ่งอาจต้องการสมดุลที่แตกต่างกัน

ตระกูล GPT‑5.6 ขยายตัวเลือกเหล่านั้นให้มากขึ้น ธุรกิจสามารถเลือกใช้ความฉลาดระดับสูงสุดที่จำเป็นในทุกขั้นตอน พร้อมจ่ายในราคาที่เหมาะสมกับคุณค่าที่ได้รับ

การสร้างความยืดหยุ่นนี้เริ่มจากการทำให้ทุกองค์ประกอบเบื้องหลังโมเดลทำงานได้อย่างมีประสิทธิภาพยิ่งขึ้น

วิธีที่เราขยายขีดจำกัดด้านประสิทธิภาพ

ความได้เปรียบด้านประสิทธิภาพของเรามาจากการพัฒนาโมเดล ระบบอนุมานที่ใช้รันโมเดล และระบบเอเจนต์ที่เชื่อมต่อโมเดลเข้ากับเครื่องมือและบริบทให้ดียิ่งขึ้น โมเดล GPT‑5.6 ทำงานได้อย่างตรงจุดมากขึ้น การจัดเส้นทางการทำงานที่ดีขึ้นช่วยให้ฮาร์ดแวร์ทำงานได้อย่างเต็มประสิทธิภาพ ซอฟต์แวร์ที่ปรับแต่งมาสำหรับการใช้งานจริงช่วยสร้างโทเค็นได้อย่างมีประสิทธิภาพมากขึ้น และการจัดการบริบทที่ดีขึ้นช่วยป้องกันไม่ให้เอเจนต์ทำงานเดิมที่เสร็จแล้วซ้ำ เมื่อทำงานร่วมกัน การปรับปรุงเหล่านี้ช่วยให้เราทำงานที่เป็นประโยชน์ได้มากขึ้นด้วยทรัพยากรประมวลผลเท่าเดิม พร้อมลดเวลา จำนวนโทเค็น และต้นทุนที่ใช้เพื่อให้ได้ผลลัพธ์แต่ละครั้ง

GPT‑5.6 Sol มีบทบาทมากขึ้นเรื่อยๆ ในการช่วยเราค้นหาและสร้างการพัฒนาระลอกถัดไป ภายใต้กระบวนการที่มีมนุษย์เป็นผู้กำกับดูแล Sol สามารถเขียนและปรับแต่งเคอร์เนลที่ใช้ในระบบจริงใหม่ได้โดยอัตโนมัติ พร้อมออกแบบและทำการทดลองหลายร้อยครั้งเพื่อปรับปรุงการสร้างโทเค็น ตลอดจนติดตามการเทรนโมเดลและเข้าแทรกแซงเมื่อเกิดปัญหา การปรับปรุงเคอร์เนลช่วยลดต้นทุนรวมในการให้บริการโมเดลตั้งแต่ต้นจนจบลง 20% ขณะที่การทดลองต่างๆ ช่วยเพิ่มประสิทธิภาพในการสร้างโทเค็นได้มากกว่า 15% การดำเนินงานนี้ยังคงเดินหน้าต่อไปและก่อให้เกิดวงจรการเรียนรู้ที่รวดเร็วยิ่งขึ้น เพราะเมื่อโมเดลของเรามีความสามารถสูงขึ้นและทำงานได้ด้วยตนเองมากขึ้น เราก็ยิ่งเพิ่มประสิทธิภาพได้เร็วขึ้นเท่านั้น อ่านเพิ่มเติมเกี่ยวกับวิศวกรรมเบื้องหลัง GPT‑5.6

กลยุทธ์ด้านการประมวลผลที่สร้างขึ้นเพื่อรองรับการขยายขนาด

การรองรับความต้องการด้านขีดความสามารถในปริมาณมหาศาล ต้องอาศัยทั้งพลังประมวลผลที่เพิ่มขึ้นและการใช้พลังประมวลผลให้เกิดประสิทธิผลมากขึ้น เรากำลังสร้างพอร์ตโฟลิโอโครงสร้างพื้นฐานที่ยืดหยุ่นและพร้อมรับมือกับความเปลี่ยนแปลง พร้อมเลือกใช้ระบบที่เหมาะสมที่สุดสำหรับแต่ละเวิร์กโหลด แนวทางนี้ช่วยตอบโจทย์ได้ทั้งด้านราคาที่คุ้มค่าและด้านประสิทธิภาพระดับสูง ในกลุ่มตัวเลือกราคาประหยัด ราคาใหม่ของ Luna และ Terra ช่วยให้การรองรับงานปริมาณมากในระดับที่ใหญ่ขึ้นมีความคุ้มค่า ในกลุ่มตัวเลือกระดับแนวหน้า โหมด Fast ช่วยให้ลูกค้า API เข้าถึง Sol ได้รวดเร็วยิ่งขึ้นเมื่อต้องการการตอบสนองที่ฉับไว

องค์กรสามารถนำ AI มาใช้ในการดำเนินงานประจำวันได้มากขึ้น โดยยังคงความรวดเร็วในการจัดการงานที่สำคัญที่สุด การวิเคราะห์เอกสารจำนวนมาก การจัดหมวดหมู่การโต้ตอบกับลูกค้า และงานพัฒนาทั่วไปจะสามารถขยายการใช้งานได้อย่างคุ้มค่า ขณะที่งานซับซ้อนที่ใช้ Sol จะดำเนินการได้รวดเร็วยิ่งขึ้นเมื่อความคุ้มค่าของผลลัพธ์เหมาะสมกับค่าใช้จ่ายที่เพิ่มขึ้น

ประโยชน์ที่ได้รับสามารถทบต้นและเพิ่มพูนขึ้นเรื่อยๆ ในกระบวนการที่ขับเคลื่อนโดยมนุษย์ โมเดลที่มีความสามารถสูงขึ้นช่วยให้ทีมเทคนิคของเราค้นพบการปรับปรุงในระลอกถัดไป ซึ่งช่วยให้เรายกระดับประสิทธิภาพและลดต้นทุนได้รวดเร็วยิ่งขึ้น กลยุทธ์ของเรายังคงมุ่งเน้นการพัฒนาทั้งขีดความสามารถและประสิทธิภาพ เพื่อให้ขีดความสามารถด้านความฉลาดในแต่ละรุ่นทำงานได้มากขึ้นด้วยต้นทุนที่ต่ำลง

ความพร้อมใช้งานและราคา

GPT‑5.6 Terra และ Luna ยังคงมีให้ใช้งานใน ChatGPT Work, Codex และ OpenAI API ใน ChatGPT Work และ Codex ผู้ใช้ Free และ Go สามารถเข้าถึง Terra ได้ ขณะที่ผู้ใช้ Plus, Pro, Business และ Enterprise สามารถเลือกใช้ Terra และ Luna ได้

ตั้งแต่วันที่ 30 กรกฎาคม ราคา API สำหรับ Terra อยู่ที่ $2 ต่อล้านโทเค็นอินพุต และ $12 ต่อล้านโทเค็นเอาต์พุต และ $0.20 ต่อล้านโทเค็นอินพุต และ $1.20 ต่อล้านโทเค็นเอาต์พุตสำหรับ Luna ราคาของ Sol ยังคงไม่เปลี่ยนแปลง ราคาการสมัครสมาชิก ChatGPT และ Codex รวมถึงงบประมาณโควต้ายังคงไม่เปลี่ยนแปลง ขณะที่การใช้งาน Terra และ Luna ใช้เครดิตน้อยลง การเปลี่ยนแปลงด้านราคาจะเริ่มทยอยมีผลบน AWS ภายในวันนี้

โหมด Fast สำหรับ GPT‑5.6 Sol จะมาแทนที่การประมวลผลแบบเร่งด่วนใน API และทำงานในแนวทางเดียวกับ /fast ใน Codex คำขอ API ที่ติดแท็ก priority จะยังคงใช้งานได้ ดูรายละเอียดราคา API ฉบับสมบูรณ์

ผู้เขียน

OpenAI