Lumaktaw sa pangunahing content
OpenAI

Ipinapakilala ang GPT‑6 Sol at Luna

Mas maraming paraan para magamit ang frontier intelligence sa araw-araw mong trabaho.

Naglo-load…

Noong unang bahagi ng buwang ito, ipinakilala namin ang GPT‑6 Astra, ang pinakamatalino at pinakanaka-align na modelo sa mundo. Bagama’t kailangan pa rin ng pinakamabibigat at pinakamahahalagang proyekto ang buong kakayahan ng Astra, nagkakaiba-iba ang saklaw, bilis, at badyet ng trabaho.

Kaya pinalalawak namin ang mundo ng GPT‑6 sa pamamagitan ng GPT‑6 Sol at GPT‑6 Luna. Nagdala ang GPT‑6 Astra ng bagong henerasyon ng intelligence—pinalalawak ng mga modelong ito ang pakinabang nito sa pamamagitan ng pagsulong sa frontier ng kahusayan sa gastos. Sinanay namin ang GPT‑6 Sol at Luna gamit ang mga pamamaraang katulad ng sa GPT‑6 Astra, kaya naihatid sa mas mabilis at mas abot-kayang mga modelo ang mga pagsulong na nasa likod ng makabagong performance ng Astra sa propesyonal na trabaho, katumpakan ng impormasyon, coding, paggamit ng computer, at alignment.

Nangunguna ang mga modelo ng GPT‑6 sa buong ugnayan ng gastos at intelligence, na pinagsasama ang pambihirang kakayahan sa bawat antas at imprastrakturang mahusay na naghahatid ng mga ito sa malawakang paggamit. Dahil sa mga pagpapahusay sa caching at inference, maihahatid namin ang mga modelong ito sa mas mababang gastos. Direktang ipinapasa namin ang matitipid sa mga user at customer sa pamamagitan ng pagbabawas ng 50% sa presyo ng API para sa Sol at Luna kumpara sa pampromosyong presyo ng GPT‑5.6. Sa kabuuan, ginagawang praktikal ng mga pagpapahusay na ito ang advanced AI para sa mas marami pang pang-araw-araw na gawain at malawakang application.

Pagpepresyo ng GPT‑6 API

Modelo

Input

Output

Pagbaba ng presyo

GPT‑6 Sol
kumpara sa GPT‑5.6 Sol

$4 → $2

$20 → $10

50% na mas mura

GPT‑6 Luna
kumpara sa GPT‑5.6 Luna

$0.20 → $0.10

$1.20 → $0.50

50% na mas mura

Ang mga presyo ay para sa bawat 1 milyong token.

Nananatiling pinakamahusay naming modelo sa lahat ng aspeto ang GPT‑6 Astra. Piliin ito kung gusto mo ang pinakamahusay na resulta at karanasang walang kompromiso.

Mas mahusay ang buong pamilya ng modelo

Naghahatid ang GPT‑6 Sol at Luna ng mas mataas na intelligence at kahusayan sa gastos sa mga modelong kilala at ginagamit mo na, lalo na sa mga kakayahang pinakamahalaga sa pagtapos ng komplikadong trabaho.

Propesyonal na trabaho

Kayang pangasiwaan ng GPT‑6 Sol ang mahihirap na gawain habang nagbibigay ng mas malaking puwang para umulit at magpahusay dahil sa mas matataas na limitasyon sa paggamit at mas mababang gastos. Nagbibigay rin ito ng mas mataas na intelligence at mas magagandang resulta kaysa sa mga kakumpitensiyang modelong kapareho ang presyo.

Sa AutomationBench, isang pagsubok sa mga workflow ng negosyo sa iba’t ibang app, nahihigitan ng GPT‑6 Sol sa xhigh na effort ang Claude Opus 5 sa Max na effort sa 9% lamang ng gastos ng Opus 5 sa bawat gawain. Sa Mataas na effort, mas mahusay ang GPT‑6 Luna kaysa sa sinundan nito nang 5.4 na percentage point, habang 58% na mas mababa ang gastos sa bawat gawain.

Sa AutomationBench 1.0.6⁠(magbubukas sa bagong window), sinusubok ang mga AI agent sa mga end-to-end na workflow gamit ang 47 tool sa sales, marketing, operations, support, finance, at HR. Mas mababa kaysa sa tunay nitong gastos ang ipinapakitang datapoint para sa Claude Fable 5.1 dahil hindi nito kasama ang gastos ng mga Opus 5 fallback, na nangyari sa ~40% ng mga gawain.

Nahihigitan din ng GPT‑6 Sol ang Claude Fable 5.1 sa mas mababang gastos, at nalalampasan pa nito ang GPT‑6 Astra sa mababang effort.

Modelo (at effort)

Score

Gastos sa bawat gawain

GPT‑6 Sol (xhigh)

33.2%

$0.27

GPT‑6 Astra (mababa)

30.3%

3.9x ng GPT‑6 Sol

Claude Opus 5 (Max)

26.9%

11.1x ng GPT‑6 Sol

Claude Fable 5.1 na may Opus 5 fallback (Max)

31.4%

>8.9x ng GPT‑6 Sol

(hindi iniulat ang gastos ng fallback)

Sa Agents’ Last Exam, na sumusuri sa mga agent sa komplikadong propesyonal na workflow, nakakuha ang GPT‑6 Sol sa Max na effort ng 56.4%, mas mataas sa pinakamataas na score ng Claude Opus 5 sa pagsusuri, habang 60% na mas mababa ang gastos sa bawat gawain.

Sa Agents’ Last Exam V1⁠(magbubukas sa bagong window), sinusuri ang mga AI agent sa pangmatagalan at kapaki-pakinabang sa ekonomiyang mga gawain sa 55 sub-industry, na sumasaklaw sa karamihan ng pangunahing larangan ng propesyonal na trabahong ginagawa sa computer.

Katumpakan ng impormasyon

Nakadepende ang pakinabang ng isang sagot sa pagiging tama ng mga impormasyon, at patuloy kaming sumusulong sa pagiging maaasahan ng mga ito. Sa aming panloob na pagsusuri sa katumpakan ng impormasyon, na batay sa mga naka-de-identify na tunay na pag-uusap kung saan iniulat ng mga user ang mga pagkakamali ng aming mga modelo, humigit-kumulang kalahati ang dami ng pagkakamali ng GPT‑6 Sol kumpara sa sinundan nito. Malapit na ito sa pagiging maaasahan ng Astra sa mas mababang gastos. Malaki rin ang ipinahusay ng GPT‑6 Luna; sa mas matataas na antas ng effort, napapantayan nito ang GPT‑5.6 Sol sa humigit-kumulang isang sandaang bahagi ng gastos.

Dito, sinusuri namin ang katumpakan ng impormasyon sa mga naka-de-identify na pag-uusap sa ChatGPT kung saan iniulat ng mga user ang maling impormasyon mula sa naunang modelo. Hindi kumakatawan sa karaniwang paggamit ang mga pag-uusap na ito na nagdudulot ng mga pagkakamali, dahil mas bihira ang maling impormasyon sa karaniwang paggamit. Hindi kinontrol ang mga score ayon sa haba; gayunman, ipinakita ng aming mga pagsusuri sa antas ng detalye na halos walang kaugnayan ang score sa haba ng sagot.

Coding

Ngayong taon, nagsimula nang humawak ang mga coding agent ng mga gawaing mas komplikado, mas malawak, at mas matagal kaysa dati. Sa OpenAI, mabilis na lumaki ang aming panloob na paggamit. Batay sa mga presyo ng API, lumampas na sa $600 ang pang-araw-araw na paggamit ng token ng median na researcher at sa $7,000 naman para sa mga researcher na nasa ika-90 percentile (Pagpapabilis ng pananaliksik: Ang tanaw mula sa loob ng OpenAI⁠). Habang humahawak ang mga coding agent ng mas mahaba at mas mabibigat na gawain, lalong nagiging mahalaga ang gastos ng tuloy-tuloy na paggamit. Pinagsasama ng GPT‑6 Sol at Luna ang mahusay na performance sa coding at mas mababang presyo ng API, kaya mas maraming pagkakataon ang mga developer na umulit at magpahusay, at mas may kumpiyansa ang mga team na magbigay ng mas ambisyosong gawain sa Codex.

Sa FrontierCode, na sumusuri kung gumagawa ang mga coding agent ng mga pagbabagong handa nang i-merge sa mga tunay na codebase, malaki ang ipinahusay ng GPT‑6 Sol kumpara sa GPT‑5.6 Sol at kaya nitong pantayan ang Claude Fable 5.1 sa xhigh sa mas mababang gastos.

Sa FrontierCode 1.1 Main⁠(magbubukas sa bagong window), sumusulat ang mga AI agent ng code na sinusuri hindi lamang sa katumpakan kundi pati sa “kakayahang ma-merge”: hal., kalidad ng test, disiplina sa saklaw, estilo ng code, at pagsunod sa mga pamantayan ng codebase.

Sa DeepSWE v1.1, na sumusubok sa performance sa komplikadong software-engineering task sa mga tunay na codebase, nakakuha ang GPT‑6 Sol sa Max na effort ng 68.8%. Nasa loob ito ng 1.1 percentage point mula sa pinakamataas na score ng Claude Fable 5 sa pagsusuri—69.9% sa xhigh na effort—habang humigit-kumulang 80% na mas mababa ang gastos sa bawat gawain.

Nakakuha ang GPT‑6 Luna sa Max na effort ng 66.6%, na maihahambing sa Claude Opus 5 at Fable 5 sa Medium na effort. Sa mga paghahambing na ito, 93% na mas mababa ang gastos ng Luna sa bawat gawain kaysa sa Opus 5 at 96% na mas mababa kaysa sa Fable 5.

Sa DeepSWE 1.1⁠(magbubukas sa bagong window), nilulutas ng mga AI agent ang mga orihinal at pangmatagalang software-engineering task.

Paggamit ng computer

Bagama’t nananatiling pinakamahusay na modelo sa mundo para sa paggamit ng computer ang GPT‑6 Astra, mas mahusay sa gastos ang performance ng GPT‑6 Sol at Luna kaysa sa mga sinundan nito. Sa OSWorld 2.0 offline, halos kapareho ng score ng GPT‑6 Sol sa xhigh na effort ang Claude Opus 5 sa Medium na effort—60.5% kumpara sa 60.3%—habang humigit-kumulang 80% na mas mababa ang gastos sa bawat gawain. Kayang higitan ng GPT‑6 Luna (Max) ang GPT‑5.6 Sol (Medium) sa ikasampung bahagi ng gastos nito.

Sa OSWorld 2.0⁠(magbubukas sa bagong window), sinusubukan ng mga AI agent ang pangmatagalang workflow sa paggamit ng computer na sumasaklaw sa pang-araw-araw at propesyonal na mga gawain. Iniuulat namin ang partial reward sa offline set mula sa release na v2026.08.08.

Estilo ng pakikipagtulungan

Dinala rin namin sa Sol at Luna ang pinahusay na estilo ng komunikasyon ng GPT‑6 Astra, na sa palagay namin ay lalo nang mapapansin sa mga teknikal na usapan at usapan tungkol sa coding. Asahan ang mas malinaw na pananalita, mas kaunting jargon, mas kaunting di-karaniwang parirala, mas kaunting detalyeng mababa ang pakinabang, at bahagyang mas maiikling sagot sa pangkalahatan nang hindi nababawasan ang laman.

Prompt
Website’s looking clean! Could we use a Bento Box design style and add a slider between the pages in the top right? You may need to dive into the React..
GPT-5.6 Sol

Absolutely. I can get the bento feel and the top-right sliding page switcher without pulling in React—the interaction is small enough to stay fast and smooth in the current site. I’m reshaping all four pages around that system now.


Done — open the live site.

It now has a colorful bento-box layout across all four pages and an animated top-right Home / Play / Place / Taste slider. React wasn’t necessary; native page transitions keep it lightweight and smooth.

The built-in image tool created the food artwork. Prompt: “An energetic gouache-and-ink editorial illustration celebrating dumplings and spicy noodles, with bright colors, steam, spice, and no text or logos.”

GPT-6 Sol

I’ll reshape the pages into a bento grid and turn the top-right links into a sliding page switcher. I’ll keep the existing site and check whether that interaction needs React before changing its setup.


The updated site is live. Every page now has a playful bento layout, and the top-right page switcher slides between sections. I checked it on desktop and narrow mobile screens, including browser back navigation. The existing site didn’t need React for this.

Bagama’t pansariling pananaw ang estilo, mas gusto namin dito ang tugon ng GPT‑6 Sol. Hindi ito agad nagpapasya, mas kaunting oras ang ginugugol nito sa pag-uulit ng mga detalyeng maaaring halata na sa nagtatanong (hal., na may apat na page ang website), mas kaunti ang malalabong pahayag nito (hal., “bento feel,” “reshaping… around that system”), mas tapat ito tungkol sa mga sinuri at hindi nito sinuri, at hindi ito nagbabahagi nang hindi kailangan ng mga detalye ng implementation gaya ng prompt nito sa image tool.

Pagpapahusay ng caching para sa mga agent at mahahabang pag-uusap

Bukod sa mas mababang presyo ng token, tinutulungan naming mas makatipid ang mga developer na gumagamit ng GPT‑6 sa kontekstong muling ginagamit ng kanilang mga application. Pinahusay namin ang prompt caching para sa GPT‑6 upang magbigay ng mas matataas na cache hit rate bilang default. Dahil dito, mas marami pang konteksto ang muling magagamit ng mga agent, mas mabilis silang makakatugon, at makakakuha sila ng 90% diskuwento sa pagbasa ng mga naka-cache na input token.

Mas marami ring paraan ang mga developer para sukatin at i-optimize ang performance ng kanilang caching:

Iniulat ng GitHub na sa nakaraang ilang buwan, nabawasan ng mahigit 50% ng mga pagpapahusay na ito ang bahagi ng mga prompt token na kailangang bagong iproseso sa bilyun-bilyong request sa mga modelo ng OpenAI, kaya mas mabilis na nakakatugon ang Copilot.

Patuloy na pagpapahusay ng alignment

Nakabatay ang GPT‑6 Sol at Luna sa gawaing pang-alignment na ipinakilala sa Astra, ang pinakanaka-align naming modelo hanggang ngayon. Sa aming mga pagsusuri sa alignment, kapwa mas mahusay ang Sol at Luna kaysa sa mga katumbas nitong GPT‑5.6, kabilang ang mas mababang rate ng mga mapanlinlang na pahayag tungkol sa kanilang coding work.

Sadyang sumusubok ang mga pagsusuri sa ibaba ng mahihirap na sitwasyon at hindi sinusukat ang mga rate ng pagkabigo sa karaniwang paggamit. Tingnan ang card ng system⁠(magbubukas sa bagong window) para sa kumpletong resulta.

Availability

Simula ngayon, available na ang GPT‑6 Sol at GPT‑6 Luna sa ChatGPT Work at Codex para sa lahat ng user ng Plus, Pro, Business, Enterprise, at Edu. Maa-access ng mga user ng Free at Go ang GPT‑6 Luna sa desktop app. Hindi pa available ang mga modelong ito sa Chat. Sa OpenAI API, available ang mga ito bilang gpt-6-sol at gpt-6-luna.

Upang mapanatiling matatag ang serbisyo para sa lahat, plano naming unti-unting ilunsad ang mga modelong ito sa ChatGPT sa buong araw. Kung hindi mo nakikita ang mga bagong modelo sa ChatGPT Work o Codex, pakisubukang muli sa ibang pagkakataon.


Isinagawa ang mga pagsusuri sa GPT sa aming research environment o sa pamamagitan ng aming API, na maaaring magbigay ng bahagyang naiibang output mula sa production ChatGPT dahil sa mga pagkakaiba sa mga system prompt, available na tool, at iba pa. Kinuha ang mga pagsusuri sa mga modelo ng kakumpitensiya mula sa mga ulat na available sa publiko. Ginamit ang mga iniulat na score para sa Claude Fable 5 kapag walang available na score para sa Claude Fable 5.1.

May-akda

OpenAI