Langkau ke kandungan utama
OpenAI

30 Julai 2026

Produk

Memajukan perbatasan harga-prestasi dengan GPT‑5.6

Dengan menjadikan setiap lapisan lebih cekap, OpenAI menawarkan prestasi lebih tinggi bagi setiap dolar merentas lebih banyak beban kerja perusahaan.

Memuat…

Semalam, kami berkongsi cara GPT‑5.6 membantu menjadikan pengendaliannya sendiri lebih cekap. Hari ini, kami menyalurkan manfaat tersebut kepada pelanggan melalui harga GPT‑5.6 Luna(dibuka dalam tetingkap baru) dan Terra(dibuka dalam tetingkap baru) yang lebih rendah serta prestasi GPT‑5.6 Sol yang lebih pantas dalam API. Secara bersama, kemas kini ini membantu pelanggan memperoleh lebih banyak manfaat daripada setiap dolar yang dilaburkan dalam AI dan bergerak lebih pantas apabila masa amat penting.

Mulai hari ini, kos GPT‑5.6 Luna, model kami yang terpantas dan paling mampu milik, akan turun 80%, manakala kos GPT‑5.6 Terra, model seimbang kami untuk kerja harian, akan turun 20%. Harga Luna dan Terra yang lebih rendah ini turut dicerminkan dalam cara penggunaan dikira bagi langganan berbayar apabila menggunakan Codex dan ChatGPT Work. Luna menawarkan cara yang jauh lebih menjimatkan kos kepada perniagaan untuk mengendalikan kerja berjumlah tinggi pada tahap kualiti yang amat tinggi. Ia boleh menggunakan alatan dan melengkapkan aliran kerja berbilang langkah, sekali gus menjadikan lebih banyak aplikasi AI praktikal untuk dikendalikan secara berskala.

Menjadikan kecerdasan canggih lebih meluas dan mampu milik merupakan teras misi OpenAI untuk memastikan AGI memberi manfaat kepada seluruh manusia. Perubahan ini menterjemahkan komitmen tersebut kepada tindakan. Perubahan ini mencerminkan penambahbaikan selama bertahun-tahun terhadap cara model kami dibina, disediakan dan digunakan.

Kami juga memperkenalkan Mod pantas dalam API, yang menggantikan tawaran Pemprosesan Keutamaan kami. Untuk GPT‑5.6 Sol, Mod pantas kini menawarkan kelajuan sehingga 2.5× lebih pantas daripada pemprosesan Standard pada harga dua kali ganda, tanpa perubahan pada kecerdasan. Mod pantas serasi dengan versi terdahulu: permintaan yang ditandai priority akan menggunakan Mod pantas secara automatik.

1 daripada 6
GPT‑5.6 Luna ialah model paling hampir yang pernah kami capai kepada kecerdasan yang terlalu murah untuk dihitung. Saya tidak pernah melihat model semampu milik ini begitu berkuasa — ia membuka kemungkinan penggunaan Replit yang tidak kami jangka dapat dibangunkan dalam masa terdekat.
Michele Catasta, Presiden & Ketua AI, Replit

Memadankan kecerdasan dengan hasil

Penggunaan AI yang cekap bermula dengan hasil yang ingin dicapai. Kepentingan, kos kesilapan, tahap kesegeraan dan skala menentukan keseimbangan yang tepat antara kecerdasan, kelajuan, kebolehpercayaan dan kos. Keseimbangan itu boleh berubah antara satu langkah aliran kerja dengan langkah seterusnya.

GPT‑5.6 memberi perniagaan lebih banyak ruang untuk mengoptimumkan persamaan tersebut. Luna menawarkan prestasi setanding dengan model bertaraf perbatasan setahun lalu pada kira-kira 6 sen bagi setiap dolar untuk setiap tugas, dengan kelajuan hampir sembilan kali ganda. Bagi kerja profesional, seperti yang diukur oleh Peperiksaan Terakhi Ejen, Luna mengatasi Fable 5 dengan anggaran kos setiap tugas yang hampir 99% lebih rendah.

Dalam amalan, perniagaan boleh menentukan hasil dan standard kualiti yang diperlukan, kemudian menggunakan penilaian untuk mengenal pasti bahagian yang kecerdasan tambahan dapat meningkatkan hasil dengan ketara serta bahagian yang pemprosesan lebih pantas dan berkos rendah dapat memberikan kualiti yang sama. Sebagai contoh, aliran kerja pengekodan boleh menggunakan Sol untuk menyelesaikan ketidakpastian dan menentukan rancangan, kemudian menggunakan Luna untuk melaksanakan perubahan yang ditetapkan dengan jelas, menulis dan menjalankan ujian serta menilai hasilnya. Aliran kerja lain mungkin memerlukan keseimbangan yang berbeza.

Keluarga GPT‑5.6 memperluas julat pilihan tersebut. Perniagaan boleh menerapkan tahap kecerdasan berguna yang maksimum pada setiap peringkat sambil membayar harga yang setimpal dengan nilai yang dihasilkan.

Untuk menawarkan fleksibiliti itu, setiap lapisan di sebalik model perlu dijadikan lebih cekap.

Cara kami memajukan perbatasan kecekapan

Kelebihan kecekapan kami terhasil daripada penambahbaikan model, sistem inferens yang menjalankannya dan harnes ejen yang menghubungkannya dengan alatan serta konteks. Model GPT‑5.6 mengambil laluan yang lebih langsung dalam melaksanakan kerja. Penghalaan yang lebih baik memastikan perkakasan kekal produktif, perisian pengeluaran yang dioptimumkan menjana token dengan lebih cekap, dan pengurusan konteks yang lebih pintar membantu ejen mengelakkan pengulangan kerja yang telah selesai. Secara bersama, penambahbaikan ini membolehkan kami menyelesaikan lebih banyak kerja berguna dengan kuasa pengkomputeran yang sama, sekali gus mengurangkan masa, token dan kos bagi setiap hasil.

GPT‑5.6 Sol semakin banyak membantu kami mengenal pasti dan melaksanakan penambahbaikan seterusnya. Dalam proses yang dipimpin manusia, Sol secara autonomi menulis semula dan mengoptimumkan kernel pengeluaran, mereka bentuk dan menjalankan ratusan eksperimen untuk meningkatkan penjanaan token, serta memantau latihan dan campur tangan apabila masalah timbul. Usaha pada kernel membantu mengurangkan kos menyeluruh penyediaan model sebanyak 20%, manakala eksperimennya meningkatkan kecekapan penjanaan token lebih daripada 15%. Usaha ini berterusan dan mewujudkan gelung maklum balas yang lebih rapat: apabila model kami bertambah baik dan mampu bekerja dengan lebih autonomi, keupayaan kami untuk meningkatkan kecekapan turut bertambah pantas. Baca selanjutnya tentang kejuruteraan di sebalik GPT‑5.6.

Strategi pengkomputeran yang dibina untuk skala besar

Memenuhi permintaan terhadap kecerdasan yang meluas memerlukan lebih banyak kuasa pengkomputeran yang turut lebih produktif. Kami sedang membina portfolio infrastruktur yang berdaya tahan dan memadankan setiap beban kerja dengan sistem yang paling sesuai untuk menjalankannya. Pendekatan itu menyokong kedua-dua hujung keluk harga-prestasi. Pada hujung berkos lebih rendah, harga baharu Luna dan Terra menjadikan kerja berjumlah tinggi berdaya maju pada skala yang jauh lebih besar. Pada hujung perbatasan, Mod pantas memberi pelanggan API akses lebih pantas kepada Sol apabila masa respons penting.

Perusahaan boleh menerapkan lebih banyak AI dalam operasi harian tanpa mengorbankan kelajuan bagi kerja yang paling penting. Analisis dokumen berskala besar, pengelasan interaksi pelanggan dan pelaksanaan rutin boleh dijalankan secara meluas dengan kos yang berdaya maju, manakala beban kerja Sol yang rumit boleh bergerak lebih pantas apabila kos premium berbaloi.

Manfaat ini boleh berganda. Dalam proses yang dipimpin manusia, model yang lebih berkeupayaan membantu pasukan teknikal kami mengenal pasti penambahbaikan generasi seterusnya, sekali gus memendekkan laluan menuju prestasi lebih baik dan kos lebih rendah. Strategi kami kekal tertumpu pada peningkatan keupayaan dan kecekapan agar setiap generasi kecerdasan dapat menyelesaikan lebih banyak kerja pada kos yang lebih rendah.

Ketersediaan dan harga

GPT‑5.6 Terra dan Luna kekal tersedia dalam ChatGPT Work, Codex dan API OpenAI. Dalam ChatGPT Work dan Codex, pengguna Free dan Go boleh mengakses Terra, manakala pengguna Plus, Pro, Business dan Enterprise boleh memilih Terra dan Luna.

Mulai 30 Julai, harga API ialah $2 bagi setiap sejuta token input dan $12 bagi setiap sejuta token output untuk Terra, serta $0.20 bagi setiap sejuta token input dan $1.20 bagi setiap sejuta token output untuk Luna. Harga Sol kekal tidak berubah. Harga langganan dan belanjawan kuota ChatGPT serta Codex kekal tidak berubah, manakala penggunaan Terra dan Luna kini menggunakan lebih sedikit kredit. Perubahan harga akan mula dilaksanakan secara berperingkat dalam AWS lewat hari ini.

Mod pantas untuk GPT‑5.6 Sol menggantikan Pemprosesan Keutamaan dalam API dan diselaraskan dengan /fast dalam Codex. Permintaan API sedia ada yang ditandai priority akan terus berfungsi. Lihat butiran lengkap harga API.

Penulis

OpenAI