Pagsulong sa frontier ng presyo at performance gamit ang GPT‑5.6
Sa paggawang mas episyente sa bawat layer, naghahatid ang OpenAI ng mas mahusay na performance kada dolyar sa mas maraming enterprise workload.
Kahapon, ibinahagi namin kung paano nakatulong ang GPT‑5.6 upang maging mas episyente ang sarili nitong pagpapatakbo. Ngayon, ipinapasa namin sa mga customer ang mga benepisyong iyon sa pamamagitan ng mas mababang presyo para sa GPT‑5.6 Luna(magbubukas sa bagong window) at Terra(magbubukas sa bagong window), at mas mabilis na performance ng GPT‑5.6 Sol sa API. Sa kabuuan, tinutulungan ng mga update na ito ang mga customer na mas mapakinabangan ang bawat dolyar na ipinupuhunan nila sa AI at kumilos nang mas mabilis kapag mahalaga ang oras.
Simula ngayon, bababa nang 80% ang halaga ng GPT‑5.6 Luna, ang pinakamabilis at pinakaabot-kaya naming modelo, habang bababa nang 20% ang GPT‑5.6 Terra, ang balanse naming modelo para sa pang-araw-araw na trabaho. Makikita rin ang mas mababang presyo ng Luna at Terra sa paraan ng pagbilang ng paggamit laban sa mga bayad na subscription kapag ginagamit ang Codex at ChatGPT Work. Nagbibigay ang Luna sa mga negosyo ng mas matipid na paraan upang pangasiwaan ang maramihang trabaho nang napakataas ang kalidad. Maaari itong gumamit ng mga tool at kumumpleto ng mga workflow na maraming hakbang, kaya praktikal nang patakbuhin sa malawakang saklaw ang mas maraming uri ng AI application.
Mahalagang bahagi ng misyon ng OpenAI na gawing mas sagana at abot-kaya ang advanced intelligence upang matiyak na mapapakinabangan ng buong sangkatauhan ang AGI. Isinasakatuparan ng mga pagbabagong ito ang pangakong iyon. Bunga ang mga ito ng maraming taon ng pagpapahusay sa pagbuo, paghahatid, at paggamit sa trabaho ng aming mga modelo.
Ipinapakilala rin namin ang Fast mode sa API, na papalit sa aming alok na Priority Processing. Para sa GPT‑5.6 Sol, naghahatid na ngayon ang Fast mode ng hanggang 2.5× na mas mabilis na bilis kaysa sa Standard processing sa dobleng presyo, nang walang pagbabago sa intelligence. Backward compatible ang Fast mode: awtomatikong gagamit ng Fast mode ang mga request na may tag na priority.
Nagsisimula sa layuning resulta ang episyenteng paggamit ng AI. Ang kahalagahan, halaga ng pagkakamali, pagkaapurahan, at saklaw ang tumutukoy sa tamang balanse ng intelligence, bilis, pagiging maaasahan, at gastos. Maaaring magbago ang balanseng iyon sa bawat hakbang ng isang workflow.
Binibigyan ng GPT‑5.6 ang mga negosyo ng mas malaking puwang upang i-optimize ang balanseng iyon. Naghahatid ang Luna ng performance na maihahambing sa mga modelong frontier-class noong nakaraang taon sa humigit-kumulang 6 na sentimo kada dolyar bawat task, at sa bilis na halos siyam na beses. Sa propesyonal na trabaho, batay sa pagsukat ng Agents’ Last Exam, nahihigitan ng Luna ang Fable 5 sa tinatayang gastos bawat task na halos 99% na mas mababa.
Sa aktuwal na paggamit, maaaring tukuyin ng mga negosyo ang layuning resulta at pamantayan ng kalidad na kailangan nila, pagkatapos ay gumamit ng mga evaluation upang malaman kung saan talagang napapahusay ng karagdagang intelligence ang resulta at kung saan maihahatid ng mas mabilis at mas murang pagproseso ang parehong kalidad. Halimbawa, maaaring gamitin ng isang coding workflow ang Sol upang lutasin ang kawalan ng katiyakan at buuin ang plano, at pagkatapos ay gamitin ang Luna upang ipatupad ang malinaw na tinukoy na mga pagbabago, magsulat at magpatakbo ng mga test, at suriin ang mga resulta. Maaaring mangailangan ng ibang balanse ang isa pang workflow.
Pinalalawak ng pamilya ng GPT‑5.6 ang saklaw ng mga pagpipiliang iyon. Magagamit ng mga negosyo ang pinakamataas na kapaki-pakinabang na intelligence sa bawat yugto habang nagbabayad ng tamang halaga para sa nalilikha nitong pakinabang.
Nagsisimula ang pagbibigay ng gayong flexibility sa paggawang mas episyente sa bawat layer sa likod ng mga modelo.
Nagmumula ang aming kalamangan sa efficiency sa pagpapahusay ng mga modelo, mga inference system na nagpapatakbo sa mga ito, at agentic harness na nag-uugnay sa mga ito sa mga tool at konteksto. Mas direktang tinatapos ng mga modelo ng GPT‑5.6 ang trabaho. Pinananatiling produktibo ng mas mahusay na routing ang hardware, mas episyenteng bumubuo ng mga token ang na-optimize na production software, at tinutulungan ng mas matalinong pamamahala ng konteksto ang mga agent na maiwasang ulitin ang natapos nang trabaho. Sa kabuuan, hinahayaan kami ng mga pagpapahusay na ito na makatapos ng mas maraming kapaki-pakinabang na trabaho gamit ang parehong compute, kaya nababawasan ang oras, mga token, at gastos na kailangan para sa bawat resulta.
Lalo kaming tinutulungan ng GPT‑5.6 Sol na matukoy at maihatid ang susunod na hanay ng mga pagpapahusay. Sa isang prosesong pinamumunuan ng tao, awtonomong muling isinulat at in-optimize ng Sol ang mga production kernel, nagdisenyo at nagpatakbo ng daan-daang eksperimento upang pahusayin ang pagbuo ng token, at minanmanan ang training habang namamagitan kapag may problema. Nakatulong ang trabaho sa kernel na bawasan nang 20% ang kabuuang gastos sa paghahatid ng modelo, habang pinataas ng mga eksperimento nito nang mahigit 15% ang efficiency ng pagbuo ng token. Nagpapatuloy ang gawaing ito at lumilikha ng mas mahigpit na feedback loop: habang humuhusay at mas nakagagawa nang awtonomo ang aming mga modelo, mas bumibilis din ang aming kakayahang pahusayin ang efficiency. Magbasa pa tungkol sa engineering sa likod ng GPT‑5.6.
Upang matugunan ang pangangailangan para sa saganang intelligence, kailangan ang mas maraming compute at mas produktibong compute. Bumubuo kami ng matatag na portfolio ng infrastructure at itinutugma ang bawat workload sa mga system na pinakaangkop na magpatakbo nito. Sinusuportahan ng paraang iyon ang magkabilang dulo ng ugnayan ng presyo at performance. Sa mas murang dulo, ginagawang matipid ng mga bagong presyo ng Luna at Terra ang maramihang trabaho sa mas malawak na saklaw. Sa frontier na dulo, binibigyan ng Fast mode ang mga customer ng API ng mas mabilis na access sa Sol kapag mahalaga ang oras ng pagtugon.
Maisasama ng mga enterprise ang mas maraming AI sa pang-araw-araw na operasyon nang hindi isinasakripisyo ang bilis sa kanilang pinakamahahalagang gawain. Maaaring maging matipid na gamitin nang malawakan ang malakihang pagsusuri ng dokumento, pag-uuri ng mga pakikipag-ugnayan sa customer, at karaniwang implementation, habang maaaring mas mabilis na patakbuhin ang mga kumplikadong workload ng Sol kapag sulit ang dagdag na halaga.
Maaaring magsama-sama at lumaki ang mga pakinabang. Sa isang prosesong pinamumunuan ng tao, tinutulungan ng mas mahusay na mga modelo ang aming technical team na matukoy ang susunod na henerasyon ng mga pagpapahusay, kaya mas mabilis na nakakamit ang mas mahusay na performance at mas mababang gastos. Nananatiling nakatuon ang aming strategy sa pagsusulong ng kakayahan at efficiency upang mas maraming trabaho ang magawa ng bawat henerasyon ng intelligence sa mas mababang gastos.
Patuloy na available ang GPT‑5.6 Terra at Luna sa ChatGPT Work, Codex, at OpenAI API. Sa ChatGPT Work at Codex, maa-access ng mga user ng Free at Go ang Terra, habang mapipili ng mga user ng Plus, Pro, Business, at Enterprise ang Terra at Luna.
Simula Hulyo 30, ang presyo ng API para sa Terra ay $2 kada isang milyong input token at $12 kada isang milyong output token, at para sa Luna ay $0.20 kada isang milyong input token at $1.20 kada isang milyong output token. Hindi magbabago ang presyo ng Sol. Hindi magbabago ang mga presyo ng subscription at quota budget ng ChatGPT at Codex, habang mas kaunting credits na ngayon ang ginagamit ng Terra at Luna. Magsisimulang ilunsad sa AWS ang mga pagbabago sa presyo mamaya ngayong araw.
Papalitan ng Fast mode para sa GPT‑5.6 Sol ang Priority Processing sa API at iaayon ito sa /fast sa Codex. Patuloy na gagana ang mga kasalukuyang API request na may tag na priority. Tingnan ang kumpletong detalye ng presyo ng API.


