Langsung ke konten utama
OpenAI

30 Juli 2026

Produk

Mendorong batas harga-kinerja dengan GPT‑5.6

Dengan meningkatkan efisiensi setiap lapisan, OpenAI menghadirkan performa lebih tinggi per dolar untuk lebih banyak beban kerja perusahaan.

Memuat…

Kemarin, kami membagikan bagaimana GPT‑5.6 membantu membuat dirinya sendiri lebih efisien untuk dijalankan. Hari ini, manfaat tersebut kami teruskan kepada pelanggan melalui harga GPT‑5.6 Luna(terbuka di jendela baru) dan Terra(terbuka di jendela baru) yang lebih rendah, serta performa GPT‑5.6 Sol yang lebih cepat di API. Secara keseluruhan, pembaruan ini membantu pelanggan memperoleh lebih banyak manfaat dari setiap dolar yang diinvestasikan dalam AI dan bergerak lebih cepat saat waktu menjadi faktor penting.

Mulai hari ini, biaya GPT‑5.6 Luna, model kami yang tercepat dan paling terjangkau, turun 80%, sedangkan biaya GPT‑5.6 Terra, model seimbang kami untuk pekerjaan sehari-hari, turun 20%. Harga Luna dan Terra yang lebih rendah ini juga tercermin dalam penghitungan penggunaan terhadap langganan berbayar saat menggunakan Codex dan ChatGPT Work. Luna memberi bisnis cara yang jauh lebih hemat biaya untuk menangani pekerjaan bervolume tinggi dengan kualitas yang sangat tinggi. Model ini dapat menggunakan alat dan menyelesaikan alur kerja bertahap, sehingga lebih banyak jenis aplikasi AI layak dijalankan dalam skala besar.

Membuat kecerdasan canggih makin tersedia luas dan terjangkau merupakan inti misi OpenAI untuk memastikan AGI bermanfaat bagi seluruh umat manusia. Perubahan ini mewujudkan komitmen tersebut dalam praktik. Perubahan ini mencerminkan penyempurnaan selama bertahun-tahun dalam cara model kami dibuat, disajikan, dan digunakan.

Kami juga memperkenalkan Mode Cepat di API untuk menggantikan layanan Pemrosesan Prioritas. Untuk GPT‑5.6 Sol, Mode Cepat kini menghadirkan kecepatan hingga 2,5× dibandingkan Pemrosesan Standar dengan harga dua kali lipat, tanpa perubahan kecerdasan. Mode Cepat kompatibel dengan versi sebelumnya: permintaan bertanda priority akan otomatis menggunakan Mode Cepat.

1 dari 6
GPT‑5.6 Luna adalah pencapaian terdekat kami menuju kecerdasan yang biayanya nyaris tak perlu diperhitungkan. Saya belum pernah melihat model semurah ini memiliki kemampuan sekuat ini—model ini membuka berbagai kasus penggunaan Replit yang sebelumnya kami kira baru dapat diwujudkan jauh di masa depan.
Michele Catasta, Presiden & Kepala AI, Replit

Menyesuaikan kecerdasan dengan hasil

Penggunaan AI secara efisien dimulai dari hasil yang ingin dicapai. Tingkat kepentingan, dampak kesalahan, urgensi, dan skala menentukan keseimbangan yang tepat antara kecerdasan, kecepatan, keandalan, dan biaya. Keseimbangan itu dapat berubah dari satu tahap alur kerja ke tahap berikutnya.

GPT‑5.6 memberi bisnis ruang yang jauh lebih luas untuk mengoptimalkan perhitungan tersebut. Luna menghadirkan performa yang sebanding dengan model terdepan setahun lalu dengan biaya per tugas sekitar 6 sen per dolar dan kecepatan hampir sembilan kali lipat. Dalam pekerjaan profesional yang diukur dengan Agents’ Last Exam, Luna mengungguli Fable 5 dengan estimasi biaya per tugas hampir 99% lebih rendah.

Dalam praktiknya, bisnis dapat menentukan hasil dan standar kualitas yang dibutuhkan, lalu menggunakan evaluasi untuk mengetahui kapan kecerdasan tambahan benar-benar meningkatkan hasil dan kapan pemrosesan yang lebih cepat serta lebih murah dapat menghasilkan kualitas yang sama. Sebagai contoh, alur kerja pemrograman dapat menggunakan Sol untuk mengatasi ketidakpastian dan menyusun rencana, lalu menggunakan Luna untuk menerapkan perubahan yang telah ditentukan dengan jelas, menulis dan menjalankan pengujian, serta mengevaluasi hasilnya. Alur kerja lain mungkin membutuhkan keseimbangan yang berbeda.

Keluarga GPT‑5.6 memperluas pilihan tersebut. Bisnis dapat menerapkan kecerdasan berguna secara maksimal pada setiap tahap, dengan membayar harga yang sesuai dengan nilai yang dihasilkan.

Fleksibilitas tersebut berawal dari peningkatan efisiensi setiap lapisan di balik model.

Cara kami mendorong batas efisiensi

Keunggulan efisiensi kami berasal dari penyempurnaan model, sistem inferensi yang menjalankannya, dan harness agentik yang menghubungkannya dengan alat serta konteks. Model GPT‑5.6 menempuh jalur yang lebih langsung dalam menyelesaikan pekerjaan. Perutean yang lebih baik menjaga produktivitas perangkat keras, perangkat lunak produksi yang dioptimalkan menghasilkan token secara lebih efisien, dan pengelolaan konteks yang lebih cerdas membantu agen menghindari pengulangan pekerjaan yang telah selesai. Secara keseluruhan, penyempurnaan ini memungkinkan kami menyelesaikan lebih banyak pekerjaan berguna dengan komputasi yang sama, sekaligus mengurangi waktu, token, dan biaya untuk setiap hasil.

GPT‑5.6 Sol makin membantu kami menemukan dan menghadirkan peningkatan berikutnya. Dalam proses yang dipimpin manusia, Sol secara mandiri menulis ulang dan mengoptimalkan kernel produksi, merancang dan menjalankan ratusan eksperimen untuk meningkatkan pembuatan token, serta memantau pelatihan dan melakukan intervensi ketika muncul masalah. Pekerjaan pada kernel membantu menurunkan biaya penyajian model secara menyeluruh sebesar 20%, sedangkan eksperimennya meningkatkan efisiensi pembuatan token lebih dari 15%. Pekerjaan ini terus berlanjut dan menciptakan siklus umpan balik yang makin erat: seiring peningkatan model dan kemampuannya bekerja lebih mandiri, kemampuan kami meningkatkan efisiensi pun makin cepat. Baca selengkapnya tentang rekayasa di balik GPT‑5.6.

Strategi komputasi yang dirancang untuk skala besar

Memenuhi permintaan akan kecerdasan yang tersedia luas membutuhkan komputasi yang lebih besar sekaligus lebih produktif. Kami membangun portofolio infrastruktur yang tangguh dan mencocokkan setiap beban kerja dengan sistem yang paling sesuai untuk menjalankannya. Pendekatan tersebut mendukung kedua ujung kurva harga-kinerja. Di sisi berbiaya rendah, harga baru Luna dan Terra membuat pekerjaan bervolume tinggi ekonomis dalam skala yang jauh lebih besar. Di sisi terdepan, Mode Cepat memberi pelanggan API akses yang lebih cepat ke Sol saat waktu respons menjadi faktor penting.

Perusahaan dapat mengintegrasikan lebih banyak AI ke dalam operasi sehari-hari tanpa mengorbankan kecepatan untuk pekerjaan terpenting mereka. Analisis dokumen berskala besar, klasifikasi interaksi pelanggan, dan implementasi rutin dapat dijalankan secara luas dengan biaya ekonomis, sedangkan beban kerja Sol yang kompleks dapat dipercepat ketika biaya tambahannya sepadan.

Manfaatnya dapat terus berlipat. Dalam proses yang dipimpin manusia, model yang lebih mumpuni membantu tim teknis kami menemukan peningkatan generasi berikutnya, sehingga memperpendek jalan menuju performa yang lebih baik dan biaya yang lebih rendah. Strategi kami tetap berfokus pada peningkatan kemampuan dan efisiensi agar setiap generasi kecerdasan dapat menyelesaikan lebih banyak pekerjaan dengan biaya lebih rendah.

Ketersediaan dan harga

GPT‑5.6 Terra dan Luna tetap tersedia di ChatGPT Work, Codex, dan API OpenAI. Di ChatGPT Work dan Codex, pengguna Free dan Go dapat mengakses Terra, sedangkan pengguna Plus, Pro, Business, dan Enterprise dapat memilih Terra dan Luna.

Mulai 30 Juli, harga API untuk Terra adalah $2 per satu juta token input dan $12 per satu juta token output, sedangkan untuk Luna adalah $0,20 per satu juta token input dan $1,20 per satu juta token output. Harga Sol tetap sama. Harga langganan dan batas kuota ChatGPT serta Codex tetap sama, sedangkan penggunaan Terra dan Luna kini menghabiskan lebih sedikit kredit. Perubahan harga akan mulai diluncurkan di AWS hari ini.

Mode Cepat untuk GPT‑5.6 Sol menggantikan Pemrosesan Prioritas di API dan selaras dengan /fast di Codex. Permintaan API lama yang bertanda priority akan tetap berfungsi. Lihat detail lengkap harga API.

Penulis

OpenAI