Jauna cenas un veiktspējas robežšķirtne ar GPT‑5.6
Uzlabojot katra slāņa efektivitāti, OpenAI par katru ieguldīto dolāru nodrošina lielāku veiktspēju plašākam uzņēmumu darba slodžu klāstam.
Vakar pastāstījām, kā GPT‑5.6 palīdzēja padarīt savu darbību efektīvāku. Šodien šos ieguvumus nododam klientiem: API vidē samazinām GPT‑5.6 Luna(atveras jaunā logā) un Terra(atveras jaunā logā) cenas un paātrinām GPT‑5.6 Sol darbību. Šie atjauninājumi palīdz klientiem gūt vairāk no katra mākslīgajā intelektā ieguldītā dolāra un rīkoties ātrāk, kad laiks ir svarīgs.
No šodienas mūsu ātrākais un cenas ziņā pieejamākais modelis GPT‑5.6 Luna maksās par 80% mazāk, savukārt ikdienas darbam līdzsvarotais GPT‑5.6 Terra — par 20% mazāk. Luna un Terra zemākās cenas ietekmē arī to, kā Codex un ChatGPT Work lietojums tiek ieskaitīts maksas abonementu limitos. Luna uzņēmumiem piedāvā daudz izdevīgāku veidu, kā ļoti augstā kvalitātē apstrādāt liela apjoma darbus. Tas spēj izmantot rīkus un izpildīt daudzpakāpju darbplūsmas, tāpēc plašāku MI lietojumu klāstu var praktiski darbināt lielā mērogā.
Attīstīta intelekta plašāka pieejamība par zemāku cenu ir būtiska OpenAI misijas daļa, lai AGI sniegtu labumu visai cilvēcei. Šīs izmaiņas pārvērš šo apņemšanos praktiskā rīcībā. Tās atspoguļo gadiem ilgus uzlabojumus mūsu modeļu izstrādē, nodrošināšanā un praktiskajā izmantošanā.
API vidē ieviešam arī Ātro režīmu, kas aizstāj mūsu prioritārās apstrādes piedāvājumu. GPT‑5.6 Sol Ātrais režīms tagad par divkāršu cenu nodrošina līdz pat 2,5 reizēm lielāku ātrumu nekā standarta apstrāde, nemainot intelekta līmeni. Ātrais režīms ir atpakaļsaderīgs: pieprasījumi ar atzīmi priority automātiski izmantos Ātro režīmu.
Efektīva MI izmantošana sākas ar vēlamo rezultātu. Pareizo intelekta, ātruma, uzticamības un izmaksu līdzsvaru nosaka uzdevuma nozīmīgums, kļūdas cena, steidzamība un mērogs. Šis līdzsvars dažādos darbplūsmas posmos var mainīties.
GPT‑5.6 uzņēmumiem sniedz daudz plašākas iespējas šo attiecību optimizēt. Luna nodrošina veiktspēju, kas pielīdzināma pirms gada robežšķirtnes klases modeļiem, taču viena uzdevuma izmaksas ir aptuveni 6 centi no dolāra un ātrums — gandrīz deviņas reizes lielāks. Profesionālos uzdevumos, ko mēra ar Agents’ Last Exam, Luna pārspēj Fable 5, un aplēstās izmaksas par uzdevumu ir gandrīz par 99% zemākas.
Praksē uzņēmumi var noteikt vajadzīgo rezultātu un kvalitātes standartu un pēc tam ar novērtējumiem noskaidrot, kur papildu intelekts būtiski uzlabo rezultātu un kur tādu pašu kvalitāti var panākt ar ātrāku un lētāku apstrādi. Piemēram, programmēšanas darbplūsmā Sol var novērst neskaidrības un izstrādāt plānu, bet Luna — ieviest precīzi definētas izmaiņas, rakstīt un izpildīt testus un novērtēt rezultātus. Citai darbplūsmai var būt vajadzīgs atšķirīgs līdzsvars.
GPT‑5.6 saime paplašina šo izvēļu klāstu. Uzņēmumi katrā posmā var izmantot maksimāli lietderīgo intelekta līmeni, maksājot tā radītajai vērtībai atbilstošu cenu.
Šādas elastības nodrošināšana sākas ar visu modeļu pamatā esošo slāņu efektivitātes uzlabošanu.
Mūsu efektivitātes priekšrocību rada modeļu un tos darbinošo inferenču sistēmu uzlabošana, kā arī aģentiskā izpildes ietvara pilnveide, kas tos savieno ar rīkiem un kontekstu. GPT‑5.6 modeļi darbu paveic tiešāk. Labāka maršrutēšana nodrošina aparatūras produktīvu izmantošanu, optimizēta produkcijas programmatūra efektīvāk ģenerē tekstvienības, bet pārdomātāka konteksta pārvaldība palīdz aģentiem neatkārtot jau paveikto. Kopā šie uzlabojumi ļauj ar tādu pašu skaitļošanas jaudu paveikt vairāk lietderīga darba, samazinot katram rezultātam vajadzīgo laiku, tekstvienību skaitu un izmaksas.
GPT‑5.6 Sol mums arvien vairāk palīdz atrast un ieviest nākamos uzlabojumus. Cilvēku vadītā procesā Sol autonomi pārrakstīja un optimizēja produkcijas kodolus, izstrādāja un veica simtiem eksperimentu tekstvienību ģenerēšanas uzlabošanai un uzraudzīja apmācību, iejaucoties problēmu gadījumā. Darbs ar kodoliem palīdzēja par 20% samazināt modeļa nodrošināšanas kopējās izmaksas, bet eksperimenti palielināja tekstvienību ģenerēšanas efektivitāti par vairāk nekā 15%. Šis darbs turpinās un veido ciešāku atgriezeniskās saites ciklu: mūsu modeļiem pilnveidojoties un spējot darboties autonomāk, arvien straujāk pieaug arī mūsu spēja uzlabot efektivitāti. Uzziniet vairāk par GPT‑5.6 pamatā esošajiem inženiertehniskajiem risinājumiem.
Lai apmierinātu pieprasījumu pēc plaši pieejama intelekta, vajag gan lielāku, gan produktīvāku skaitļošanas jaudu. Mēs veidojam noturīgu infrastruktūras portfeli un katrai darba slodzei piemeklējam tās izpildei piemērotākās sistēmas. Šī pieeja aptver abus cenas un veiktspējas līknes galus. Zemāko izmaksu galā Luna un Terra jaunās cenas padara liela apjoma darbus ekonomiski izdevīgus daudz plašākā mērogā. Robežšķirtnes galā Ātrais režīms API klientiem nodrošina ātrāku piekļuvi Sol, kad svarīgs ir atbildes laiks.
Uzņēmumi var plašāk ieviest MI ikdienas procesos, nezaudējot ātrumu vissvarīgākajos darbos. Plaša mēroga dokumentu analīzi, klientu mijiedarbības klasificēšanu un ikdienas ieviešanas darbus var ekonomiski izdevīgi izmantot daudz plašāk, savukārt sarežģītas Sol darba slodzes var izpildīt ātrāk, kad piemaksa ir pamatota.
Ieguvumi var summēties. Cilvēku vadītā procesā jaudīgāki modeļi palīdz mūsu tehniskajai komandai atrast nākamās paaudzes uzlabojumus, saīsinot ceļu līdz labākai veiktspējai un zemākām izmaksām. Mūsu stratēģija joprojām ir vērsta gan uz spēju, gan efektivitātes uzlabošanu, lai katra nākamā intelekta paaudze varētu paveikt vairāk par zemāku cenu.
GPT‑5.6 Terra un Luna joprojām ir pieejami pakalpojumos ChatGPT Work un Codex, kā arī OpenAI API. ChatGPT Work un Codex bezmaksas plāna un ChatGPT Go lietotāji var piekļūt Terra, savukārt ChatGPT Plus, ChatGPT Pro, Business un Enterprise lietotāji var izvēlēties Terra un Luna.
No 30. jūlija Terra API cena ir 2 ASV dolāri par miljonu ievades tekstvienību un 12 ASV dolāri par miljonu izvades tekstvienību, bet Luna — attiecīgi 0,20 un 1,20 ASV dolāri. Sol cena nemainās. ChatGPT un Codex abonementu cenas un kvotu apjomi nemainās, bet Terra un Luna lietojums tagad patērē mazāk kredītu. Cenu izmaiņas AWS vidē sāks ieviest vēlāk šodien.
GPT‑5.6 Sol Ātrais režīms aizstāj prioritāro apstrādi API vidē un atbilst /fast režīmam pakalpojumā Codex. Esošie API pieprasījumi ar atzīmi priority turpinās darboties. Skatiet pilnu informāciju par API cenām.


