GPT-6.1Sol
Near-Astra intelligence for a fifth of the price
เราขอแนะนำ GPT‑6.1 Sol รุ่นอัปเกรดของ GPT‑6 Sol ที่มีความสามารถโดดเด่นด้านการเขียนโค้ดแบบเอเจนต์ รวมถึงการใช้คอมพิวเตอร์และงานระดับมืออาชีพ สำหรับงานที่ซับซ้อน Sol ทำได้ใกล้เคียง GPT‑6 Astra มากขึ้น ขณะที่ราคาโทเค็นอินพุตและเอาต์พุตมาตรฐานเพียงหนึ่งในห้าของ Astra นักพัฒนาจึงมีงบสำหรับสร้างและใช้งานเอเจนต์ได้มากขึ้น
GPT‑6.1 Sol มีประสิทธิภาพใกล้เคียง Astra ในราคาของ Sol จึงเป็นโมเดลที่คุ้มค่าที่สุดเมื่อเทียบประสิทธิภาพกับราคาในขณะนี้ อินพุตที่แคชไว้มีราคาเพียงแค่ 0.10 ดอลลาร์ต่อล้านโทเค็น ถูกกว่าราคาอินพุตมาตรฐาน 95% ช่วยลดค่าใช้จ่ายของงานเอเจนต์ที่ต้องใช้ข้อมูลบริบทเดิมซ้ำในหลายคำขอ
GPT‑6 Astra ยังคงเป็นโมเดลระดับแนวหน้าที่มีความสามารถโดยรวมสูงที่สุดของเรา GPT‑6.1 Sol มอบสมดุลใหม่ระหว่างความสามารถกับค่าใช้จ่าย สำหรับงานสำคัญที่ผู้ใช้ต้องการทำให้บ่อยขึ้น และสำหรับลูกค้า API ที่สร้างและใช้งานแอปพลิเคชันในวงกว้าง

GPT‑6.1 Sol ทำงานระดับมืออาชีพที่ซับซ้อนได้ดีขึ้นมากเมื่อเทียบกับ GPT‑6 Sol ทั้งการเขียนและแก้บั๊กในโค้ด การทำความเข้าใจเอกสาร และการจัดการงานธุรกิจที่มีหลายขั้นตอน ในการประเมินหลายรายการ โมเดลนี้ทำได้ใกล้เคียง GPT‑6 Astra แต่มีค่าใช้จ่ายต่ำกว่ามาก
บน DeepSWE v1.1 ซึ่งประเมินงานวิศวกรรมซอฟต์แวร์ที่ซับซ้อนในโค้ดเบสจริง GPT‑6.1 Sol ทำได้เทียบเท่า GPT‑6 Astra ด้วยค่าใช้จ่ายราวหนึ่งในห้า ทั้งยังทำคะแนนสูงกว่าคะแนนที่ดีที่สุดของ GPT‑6 Sol ถึง 6.4 จุดเปอร์เซ็นต์ โดยใช้ความพยายามในการให้เหตุผลและค่าใช้จ่ายต่ำกว่า
ใน DeepSWE 1.1(เปิดในหน้าต่างใหม่) เอเจนต์ AI แก้โจทย์วิศวกรรมซอฟต์แวร์ที่สร้างขึ้นใหม่และต้องดำเนินงานต่อเนื่องหลายขั้นตอน
ในการทดสอบ GDP.pdf ซึ่งวัดความแม่นยำในการตอบคำถามระดับมืออาชีพจากเอกสาร PDF ที่ซับซ้อน ทั้งตาราง แผนภูมิ แผนภาพ และรายละเอียดในข้อความที่มีขนาดเล็ก GPT‑6.1 Sol ทำคะแนนสูงกว่า Opus 5.5 ที่ใช้โมเดลสำรองในทุกระดับการให้เหตุผลที่ทดสอบ โดยมีค่าใช้จ่ายต่องานไม่ถึงครึ่ง อีกทั้งยังทำได้ใกล้เคียง GPT‑6 Astra ซึ่งมีประสิทธิภาพระดับแนวหน้า ด้วยค่าใช้จ่ายต่องานราวหนึ่งในห้า
ใน GDP.pdf(เปิดในหน้าต่างใหม่) โมเดลต้องตอบพรอมต์จากการใช้งานจริงที่เกี่ยวกับไฟล์ PDF ซับซ้อน ซึ่งนำมาจากกระบวนการทำงานของผู้เชี่ยวชาญในสาขาการเงิน การดูแลสุขภาพ กฎหมาย และอีกเจ็ดสาขาวิชาชีพ
ในการทดสอบ AutomationBench ซึ่งวัดว่าเอเจนต์ทำงานธุรกิจที่มีหลายขั้นตอนได้ถูกต้องจนเสร็จหรือไม่ GPT‑6.1 Sol ทำคะแนนสูงกว่า Opus 5.5 อยู่ 2.2 จุดเปอร์เซ็นต์ เมื่อใช้ระดับการให้เหตุผลปานกลาง โดยมีค่าใช้จ่ายราวหนึ่งในสาม คะแนนนี้ยังสูงกว่า GPT‑6 Sol ที่ทดสอบด้วยการตั้งค่าเดียวกัน 4.8 จุดเปอร์เซ็นต์
In AutomationBench 1.0.6(เปิดในหน้าต่างใหม่), AI agents are tested on end-to-end workflows using 47 tools across sales, marketing, operations, support, finance, and HR. The datapoint for Claude Fable 5.1 understates its actual cost, as it omits the cost of fallbacks, which occurred on ~40% of tasks.
GPT‑6.1 Sol ยังทำงานที่ต้องใช้แอปบนคอมพิวเตอร์ได้ดีขึ้นมาก ในชุดทดสอบออฟไลน์ของ OSWorld 2.0 ซึ่งประเมินเอเจนต์ด้วยงานใช้คอมพิวเตอร์ที่ซับซ้อน GPT‑6.1 Sol ทำคะแนนสูงกว่า GPT‑6 Sol อยู่ 7 จุดเปอร์เซ็นต์ที่ระดับการให้เหตุผลสูงสุด โดยมีค่าใช้จ่ายไม่ถึงครึ่ง และทำคะแนนห่างจาก Astra เพียง 2.1 จุดเปอร์เซ็นต์ในระดับการให้เหตุผลสูงสุดเช่นกัน ด้วยค่าใช้จ่ายต่องานราวหนึ่งในเจ็ด
In OSWorld 2.0(เปิดในหน้าต่างใหม่), AI agents attempt long-horizon computer-use workflows spanning everyday and professional tasks. We report the partial reward on the offline set from the v2026.08.08 release.
ในการทดสอบ Terminal-Bench Science 0.1 ซึ่งครอบคลุมการวิเคราะห์ข้อมูล การจำลอง และการพิสูจน์ทฤษฎีบท GPT‑6.1 Sol ทำคะแนนสูงกว่า GPT‑6 Sol มากกว่าสองเท่าเมื่อใช้ระดับการให้เหตุผลสูงสุด แต่เสียค่าใช้จ่ายต่องานไม่ถึงครึ่ง ที่ระดับนี้ GPT‑6.1 Sol มีค่าใช้จ่ายเฉลี่ย 5.47 ดอลลาร์ต่องาน ส่วน Opus 5.5 อยู่ที่ 23.21 ดอลลาร์ และ Astra 23.80 ดอลลาร์ จึงได้ความสามารถด้านวิทยาศาสตร์ในค่าใช้จ่ายที่ต่ำกว่าทั้งสองรุ่นกว่า 75%
GPT‑6 Astra ยังคงทำคะแนนสูงสุดในบรรดาโมเดลที่ทดสอบที่ 68.1% และควรเลือกใช้สำหรับงานวิจัยทางวิทยาศาสตร์ที่ยากที่สุด
ใน Terminal-Bench Science 0.1(เปิดในหน้าต่างใหม่) เอเจนต์ดำเนินกระบวนการวิจัยทางวิทยาศาสตร์ให้เสร็จสมบูรณ์โดยใช้โค้ดและเครื่องมือเทอร์มินัล ซึ่งรวมถึงการวิเคราะห์ข้อมูล การรันการจำลอง และการปรับแบบจำลองให้เข้ากับข้อมูล
GPT‑6.1 Sol ตอบพรอมต์ยากได้ถูกต้องตามข้อเท็จจริงมากขึ้น เมื่อใช้ระดับการให้เหตุผลสูงพิเศษ อัตราคำตอบที่มีข้อผิดพลาดด้านข้อเท็จจริงอยู่ที่ 4.1% ต่ำกว่า GPT‑6 Sol ซึ่งอยู่ที่ 4.5% และใกล้เคียง Astra ที่ 4.0% ในระดับเดียวกัน โดยมีค่าใช้จ่ายต่องานต่ำกว่า Astra ประมาณ 83%
การประเมินนี้วัดสัดส่วนคำตอบที่มีข้อผิดพลาดด้านข้อเท็จจริงอย่างน้อยหนึ่งจุด โดยใช้บทสนทนาที่ลบข้อมูลระบุตัวตนแล้ว ซึ่งผู้ใช้เคยแจ้งว่าโมเดลรุ่นก่อนตอบผิด เราตั้งใจเลือกพรอมต์ที่ท้าทายเหล่านี้มาทดสอบ จึงไม่ใช่ตัวแทนของการใช้งานทั่วไป
เราประเมินความถูกต้องของข้อเท็จจริงโดยใช้บทสนทนา ChatGPT ที่ลบข้อมูลระบุตัวตนแล้ว และเป็นบทสนทนาที่ผู้ใช้เคยแจ้งว่าโมเดลรุ่นก่อนตอบผิด บทสนทนากลุ่มนี้คัดมาเพื่อทดสอบกรณีที่เกิดข้อผิดพลาด จึงไม่สะท้อนการใช้งานทั่วไป ซึ่งพบข้อผิดพลาดด้านข้อเท็จจริงน้อยกว่า
ผลการประเมินด้านการทำงานให้สอดคล้องกับเจตนาของผู้ใช้และข้อกำหนดด้านความปลอดภัยแสดงให้เห็นว่า GPT‑6.1 Sol ดีขึ้นจาก GPT‑6 Sol อย่างมาก และทำได้ใกล้เคียง GPT‑6 Astra มากขึ้น
GPT‑6.1 Sol แจ้งข้อจำกัดของตนเองได้ชัดเจนขึ้น และทำตามเจตนาของผู้ใช้กับข้อจำกัดด้านความปลอดภัยได้อย่างน่าเชื่อถือมากขึ้น ในการทดสอบที่ท้าทาย โมเดลนี้พลาดน้อยกว่า GPT‑6 Sol ทั้งเรื่องการแจ้งเมื่อเครื่องมือค้นหาขัดข้อง การทำตามข้อห้ามที่ระบุชัดเจน และการหลีกเลี่ยงผลลัพธ์ที่ไม่ได้รับอนุญาตระหว่างทำงานด้วยเอเจนต์ อีกทั้งไม่พบความพยายามเลี่ยงคำสั่งบล็อกของระบบตรวจสอบความปลอดภัยอัตโนมัติ เช่นเดียวกับ GPT‑6 Astra และ GPT‑6 Sol
การประเมินด้านล่างตั้งใจทดสอบสถานการณ์ที่ท้าทาย ไม่ได้วัดอัตราความล้มเหลวในการใช้งานทั่วไป
GPT‑6.1 Sol เปิดให้ผู้ใช้แพ็กเกจ Plus, Pro, Business, Enterprise และ Edu ทุกคนใช้งานใน ChatGPT Work และ Codex ได้ตั้งแต่วันนี้ แต่โมเดลเหล่านี้ยังไม่เปิดให้ใช้ใน Chat นักพัฒนาสามารถเรียกใช้ผ่าน OpenAI API ในชื่อ gpt-6.1-sol ราคา API มาตรฐานอยู่ที่ 2 ดอลลาร์ต่อโทเค็นอินพุต 1 ล้านโทเค็น, 0.10 ดอลลาร์ต่อโทเค็นอินพุตที่แคชไว้ 1 ล้านโทเค็น และ 10 ดอลลาร์ต่อโทเค็นเอาต์พุต 1 ล้านโทเค็น
พร้อมกันนี้ เราเปิดตัว GPT‑6 Astra Ultrafast โมเดลระดับแนวหน้าที่เร็วที่สุดในโลก โดยทำงานได้เร็วกว่า GPT‑6 Astra สูงสุด 8 เท่า และยังเปิดตัว GPT‑6.1 Sol Ultrafast ไปพร้อมกันด้วย ทั้งสองโมเดลใช้งานได้ผ่าน API รวมถึงใน ChatGPT Work และ Codex สำหรับผู้ใช้แพ็กเกจ Pro ระดับใหม่ที่ให้ปริมาณการใช้งานสูงสุดในราคา 500 ดอลลาร์ต่อเดือน GPT‑6.1 Sol Ultrafast ช่วยให้นักพัฒนาได้ความสามารถใกล้เคียง Astra พร้อมความเร็วสูงสุด 8 เท่า โดยมีค่าใช้จ่าย API ใกล้เคียงกับที่เคยจ่ายเพื่อใช้ GPT‑6 Astra

