Ngenalake GPT‑6 Sol lan Luna
Luwih akeh cara kanggo nggunakake kecerdasan tercanggih ing pakaryan saben dina.
Ing wiwitan sasi iki, kita ngenalake GPT‑6 Astra, model paling cerdas lan selaras ing donya. Sanajan proyek sing paling abot lan wigati isih mbutuhake kabisan lengkap Astra, saben pakaryan nduweni skala, irama, lan anggaran sing beda-beda.
Mula, kita ngembangake jagad GPT‑6 nganggo GPT‑6 Sol lan GPT‑6 Luna. GPT‑6 Astra ngenalake generasi kecerdasan anyar—model-model iki mbantu nyebarake manfaate kanthi nyurung wates tercanggih ing efisiensi biaya. Kita nglatih GPT‑6 Sol lan Luna nganggo cara sing padha karo GPT‑6 Astra, supaya kemajuan ing balik kinerja Astra sing paling canggih kanggo pakaryan profesional, akurasi fakta, pamrograman, panggunaan komputer, lan keselarasan bisa diwujudake ing model sing luwih cepet lan luwih murah.
Model-model GPT‑6 dadi sing unggul ing saindhenging kurva biaya–kecerdasan, kanthi nggabungake kabisan istimewa ing saben tataran lan infrastruktur sing bisa nyedhiyakake kanthi efisien ing skala gedhe. Panyampurnan caching lan inferensi ndadekake kita bisa nyedhiyakake model-model iki kanthi biaya luwih murah. Penghematan iki langsung diterusake marang pangguna lan pelanggan kanthi nyuda rega API Sol lan Luna nganti 50% dibandhingake rega promo GPT‑5.6. Kanthi kabeh panyampurnan iki, AI canggih dadi praktis kanggo luwih akeh tugas saben dina lan aplikasi kanthi skala gedhe.
Model | Input | Output | Pengurangan rega |
GPT‑6 Sol | $4 → $2 | $20 → $10 | 50% luwih murah |
GPT‑6 Luna | $0.20 → $0.10 | $1.20 → $0.50 | 50% luwih murah |
Rega iki kanggo saben 1 yuta token.
GPT‑6 Astra tetep dadi model paling apik saka kita ing kabeh aspek. Pilih iki yen sampeyan kepengin asil paling apik lan pengalaman tanpa kompromi.
GPT‑6 Sol lan Luna menehi peningkatan kecerdasan lan efisiensi biaya marang model sing wis sampeyan kenal lan gunakake, mligine kanggo kabisan sing paling migunani kanggo ngrampungake pakaryan rumit.
GPT‑6 Sol bisa ngrampungake tugas angel lan menehi sampeyan luwih akeh ruang kanggo ngulang proses amarga wates panggunaan luwih dhuwur lan biaya luwih murah. Model iki nawakake kecerdasan lan asil sing luwih apik tinimbang model pesaing kanthi rega sing padha.
Ing AutomationBench, yaiku tes alur kerja bisnis ing maneka aplikasi, GPT‑6 Sol kanthi upaya dhuwur banget (dipikir nemen banget) ngungkuli Claude Opus 5 kanthi upaya maksimal (dipikir maksimal), nanging biayane saben tugas mung 9% saka biaya Opus 5. Kanthi upaya dhuwur (dipikir nemen), GPT‑6 Luna luwih apik 5,4 poin persentase tinimbang pendahulune, kanthi biaya saben tugas 58% luwih murah.
Ing AutomationBench 1.0.6(mbukak ing jendhela anyar), agen AI diuji ing alur kerja saka wiwitan nganti pungkasan nganggo 47 piranti kanggo penjualan, pemasaran, operasional, dhukungan, keuangan, lan SDM. Titik data Claude Fable 5.1 nuduhake biaya luwih endhek tinimbang biaya sejatine, amarga ora nyakup biaya panggunaan cadangan Opus 5 sing kedadeyan ing watara 40% tugas.
GPT‑6 Sol uga ngungkuli Claude Fable 5.1 kanthi biaya luwih murah banget, lan malah ngalahake GPT‑6 Astra kanthi upaya rendah.
Model (lan upaya) | Skor | Biaya saben tugas |
|---|---|---|
GPT‑6 Sol (dipikir nemen banget) | 33.2% | $0.27 |
GPT‑6 Astra (rendah) | 30.3% | 3.9x GPT‑6 Sol |
Claude Opus 5 (dipikir maksimal) | 26.9% | 11.1x GPT‑6 Sol |
Claude Fable 5.1 kanthi cadangan Opus 5 (dipikir maksimal) | 31.4% | >8.9x GPT‑6 Sol (biaya cadangan ora dilaporake) |
Ing Agents’ Last Exam, sing ngevaluasi agen sajrone alur kerja profesional sing rumit, GPT‑6 Sol kanthi upaya maksimal (dipikir maksimal) entuk skor 56,4%, ngungkuli skor paling dhuwur Claude Opus 5 ing evaluasi kasebut kanthi biaya saben tugas 60% luwih murah.
Ing Agents’ Last Exam V1(mbukak ing jendhela anyar), agen AI dievaluasi nganggo tugas berjangka dawa sing nduweni nilai ekonomi ing 55 subindustri, nyakup meh kabeh bidang utama pakaryan profesional sing ditindakake nganggo komputer.
Pigunane wangsulan gumantung marang kabeneran faktane, lan kita terus ningkatake linuwih fakta. Ing evaluasi internal babagan akurasi fakta, adhedhasar pacelathon nyata sing wis dibusak identitase lan pangguna nandhani kasalahan saka model kita, GPT‑6 Sol nggawe kasalahan watara separo saka pendahulune. Linuwihane nyedhaki Astra kanthi biaya luwih murah banget. GPT‑6 Luna uga saya apik kanthi nyata; ing tingkat upaya sing luwih dhuwur, kinerjane padha karo GPT‑5.6 Sol kanthi biaya watara saprasatus.
Ing kene kita ngevaluasi akurasi fakta saka pacelathon ChatGPT sing wis dibusak identitase, nalika pangguna nandhani kasalahan fakta saka model sadurunge. Pacelathon sing micu kasalahan iki ora nggambarake panggunaan lumrah, amarga kasalahan fakta luwih arang kedadeyan. Skor ora dikontrol adhedhasar dawa wangsulan; nanging, pengujian tingkat kerincian kita nuduhake meh ora ana sesambungan karo dawa wangsulan.
Taun iki, agen pamrograman wiwit nangani tugas kanthi kerumitan, cakupan, lan wektu pengerjaan sing ngungkuli sadurunge. Ing OpenAI, panggunaan internal kita mundhak kanthi eksponensial. Yen dietung adhedhasar rega API, panggunaan token saben dina wis ngluwihi $600 kanggo panaliti median lan $7.000 kanggo panaliti ing persentil kaping 90 (Percepatan riset: Kahanan ing njero OpenAI). Nalika agen pamrograman nangani tugas sing luwih suwe lan luwih abot, biaya panggunaan terus-terusan dadi saya wigati. GPT‑6 Sol lan Luna nggabungake kinerja pamrograman sing kuwat lan rega API luwih murah, supaya pangembang luwih bebas ngulang proses lan tim luwih yakin menehi tugas sing luwih ambisius marang Codex.
Ing FrontierCode, sing ngevaluasi apa agen pamrograman ngasilake owah-owahan sing siap digabungake menyang basis kode nyata, GPT‑6 Sol luwih apik kanthi nyata tinimbang GPT‑5.6 Sol lan bisa madhani Claude Fable 5.1 kanthi upaya dhuwur banget (dipikir nemen banget), nanging biayane luwih murah banget.
Ing FrontierCode 1.1 Main(mbukak ing jendhela anyar), agen AI nulis kode sing ora mung dinilai saka kabenerane, nanging uga saka “kesiapan digabungake”: kayata mutu tes, disiplin cakupan, gaya kode, lan kepatuhan marang standar basis kode.
Ing DeepSWE v1.1, sing nguji kinerja kanggo tugas rekayasa piranti lunak rumit ing basis kode nyata, GPT‑6 Sol kanthi upaya maksimal (dipikir maksimal) entuk skor 68,8%, mung beda 1,1 poin persentase saka skor paling dhuwur Claude Fable 5 ing evaluasi kasebut—69,9% kanthi upaya dhuwur banget (dipikir nemen banget)—kanthi biaya saben tugas watara 80% luwih murah.
GPT‑6 Luna kanthi upaya maksimal (dipikir maksimal) entuk skor 66,6%, saimbang karo Claude Opus 5 lan Fable 5 kanthi upaya standar (kecepatan standar). Ing pambandhingan iki, biaya Luna saben tugas 93% luwih murah tinimbang Opus 5 lan 96% luwih murah tinimbang Fable 5.
Ing DeepSWE 1.1(mbukak ing jendhela anyar), agen AI ngrampungake tugas rekayasa piranti lunak asli kanthi rentang wektu dawa.
Sanajan GPT‑6 Astra tetep dadi model paling apik ing donya kanggo panggunaan komputer, GPT‑6 Sol lan Luna menehi kinerja sing luwih irit biaya tinimbang pendahulune. Ing OSWorld 2.0 offline, GPT‑6 Sol kanthi upaya dhuwur banget (dipikir nemen banget) entuk skor sing padha karo Claude Opus 5 kanthi upaya standar (kecepatan standar)—60,5% lawan 60,3%—kanthi biaya saben tugas watara 80% luwih murah. GPT‑6 Luna (dipikir maksimal) bisa ngungkuli GPT‑5.6 Sol (kecepatan standar) kanthi biaya saprasepuluh.
Ing OSWorld 2.0(mbukak ing jendhela anyar), agen AI nyoba alur kerja panggunaan komputer kanthi rentang wektu dawa, kalebu tugas saben dina lan profesional. Kita nglaporake ganjaran parsial ing set offline saka rilis v2026.08.08.
Kita uga wis nggawa gaya komunikasi GPT‑6 Astra sing luwih apik menyang Sol lan Luna. Miturut kita, bedane bakal katon cetha mligine ing pacelathon teknis lan pamrograman. Sampeyan bakal nemokake panjelasan sing luwih cetha, luwih sithik jargon lan tetembungan sing aneh, luwih sithik rincian sing kurang migunani, lan wangsulan sing umume rada luwih cekak tanpa kelangan inti.
Sanajan gaya iku subjektif, kita luwih seneng wangsulane GPT‑6 Sol ing kene. Model iki ora kesusu njupuk dudutan, ora kakehan mbaleni rincian sing bisa uga wis cetha tumrap sing takon (kayata situs web kasebut duwe patang kaca), luwih sithik nggunakake basa samar (kayata “rasa bento” lan “mbentuk maneh… ngubengi sistem kasebut”), luwih blaka babagan apa sing wis lan durung dipriksa, lan ora nuduhake rincian implementasi sing ora perlu, kayata prompt kanggo piranti gambare.
Saliyane rega token sing luwih murah, kita mbantu pangembang sing nggawe aplikasi ing GPT‑6 supaya luwih ngirit biaya konteks sing digunakake maneh. Kita wis nyampurnakake panyimpenan pituduh (prompt) kanggo GPT‑6 supaya kanthi gawan menehi tingkat cache hit luwih dhuwur. Iki mbantu agen nggunakake maneh luwih akeh konteks, nanggapi luwih cepet, lan entuk diskon 90% kanggo maca token input saka cache.
Pangembang uga duwe luwih akeh cara kanggo ngukur lan ngoptimalake kinerja caching:
Pantau lan diagnosis. Dasbor Panyimpenan Pituduh(mbukak ing jendhela anyar) nuduhake sepira akeh input sing disimpen ing cache lan owah-owahane saka wektu ke wektu. Piranti diagnosis(mbukak ing jendhela anyar) mbantu nerangake kesempatan caching sing kliwatan lan apa sing kudu didandani.
Atur upaya nalar lan kasedhiyan piranti tanpa ngrusak cache. Tambah upaya nalar(mbukak ing jendhela anyar) kanggo tugas sing luwih angel utawa suda kanggo pitakon susulan sing luwih gampang, lan aktifake utawa pateni piranti(mbukak ing jendhela anyar) nalika kabutuhan agen sampeyan owah. Saiki, loro kontrol kasebut njaga konteks sadurunge supaya bisa digunakake maneh saka cache.
Optimalake prefiks sing disimpen ing cache. Titik pamisah eksplisit ngidini pangembang milih titik pungkasan prefiks prompt sing disimpen ing cache. Iki menehi pangembang kontrol luwih akeh tumrap panggunaan maneh cache lan bisa ningkatake kinerja.
GitHub nglaporake manawa sajrone sawetara sasi kepungkur, panyampurnan iki wis nyuda bagean token prompt sing mbutuhake pangolahan anyar luwih saka 50% ing milyaran panjaluk menyang model OpenAI, saengga Copilot bisa nanggapi luwih cepet.
GPT‑6 Sol lan Luna nerusake pakaryan keselarasan sing dikenalake ing Astra, model kita sing paling selaras nganti saiki. Ing evaluasi keselarasan, Sol lan Luna padha-padha luwih apik tinimbang versi GPT‑5.6 sing sepadan, kalebu tingkat pratelan sing nyasarke babagan pakaryan pamrogramane sing luwih endhek.
Evaluasi ing ngisor iki sengaja nguji kahanan angel lan ora ngukur tingkat kegagalan ing panggunaan lumrah. Deleng kertu sistem(mbukak ing jendhela anyar) kanggo asil lengkap.
GPT‑6 Sol lan GPT‑6 Luna wiwit dina iki kasedhiya ing ChatGPT Kerja lan Codex kanggo kabeh pangguna Plus, Pro, Business, Enterprise, lan Edu. Pangguna Free lan Go bisa ngakses GPT‑6 Luna ing aplikasi desktop. Model-model iki durung kasedhiya ing Ngobrol. Ing API OpenAI, model kasebut kasedhiya minangka gpt-6-sol lan gpt-6-luna.
Supaya layanan tetep stabil kanggo kabeh wong, kita ngrancang ngluncurake model-model iki kanthi bertahap ing ChatGPT sedina muput. Yen model anyar durung katon ing ChatGPT Kerja utawa Codex, coba maneh mengko.
Evaluasi GPT ditindakake ing lingkungan riset kita utawa liwat API, sing bisa ngasilake output rada beda saka ChatGPT produksi amarga bedane prompt sistem, piranti sing kasedhiya, lan liya-liyane. Evaluasi model pesaing dijupuk saka laporan sing kasedhiya kanggo umum. Skor Claude Fable 5 digunakake nalika skor Claude Fable 5.1 ora kasedhiya.


