Pereiti prie pagrindinio turinio
OpenAI

2026 m. liepos 30 d.

Produktas

Geriname GPT‑5.6 kainos ir našumo santykio ribas

Efektyvindama kiekvieną sluoksnį, OpenAI užtikrina didesnį našumą už kiekvieną dolerį atliekant įvairesnius įmonių darbus.

Įkeliama...

Vakar pasakojome, kaip GPT‑5.6 padėjo efektyviau vykdyti patį save. Šiandien šia pažanga dalijamės su klientais: mažiname GPT‑5.6 Luna(atsidaro naujame lange) ir Terra(atsidaro naujame lange) kainas, o GPT‑5.6 Sol API veiks sparčiau. Šie atnaujinimai padeda klientams gauti daugiau naudos iš kiekvieno į DI investuoto dolerio ir veikti greičiau, kai svarbi kiekviena akimirka.

Nuo šiandien GPT‑5.6 Luna, mūsų sparčiausias ir prieinamiausias modelis, kainuos 80 % mažiau, o GPT‑5.6 Terra, subalansuotas modelis kasdieniam darbui, – 20 % mažiau. Mažesnės Luna ir Terra kainos atsispindi ir skaičiuojant naudojimą pagal mokamas prenumeratas, kai naudojami Codex ir ChatGPT Work. Luna suteikia įmonėms daug ekonomiškesnį būdą itin kokybiškai atlikti didelės apimties darbus. Ji gali naudoti įrankius ir vykdyti kelių etapų darbo eigas, todėl platesnį DI programų spektrą praktiška naudoti dideliu mastu.

Pažangų intelektą padaryti plačiau prieinamą ir įperkamą – viena pagrindinių OpenAI misijos užtikrinti, kad AGI būtų naudinga visai žmonijai, dalių. Šie pokyčiai tą įsipareigojimą paverčia tikrove. Juos lėmė daugelį metų tobulinti mūsų modelių kūrimo, teikimo ir praktinio taikymo būdai.

API taip pat pristatome Spartųjį režimą, kuris pakeičia mūsų prioritetinio apdorojimo paslaugą. GPT‑5.6 Sol Spartusis režimas dabar veikia iki 2,5 karto greičiau nei standartinis apdorojimas, kainuoja dvigubai daugiau, o intelektas nesikeičia. Spartusis režimas yra suderinamas su ankstesnėmis versijomis: užklausos, pažymėtos „priority“, automatiškai naudos Spartųjį režimą.

1 iš 6
GPT‑5.6 Luna yra arčiausiai tokio pigaus intelekto, kad jo net nebeapsimokėtų skaičiuoti. Dar nesu matęs, kad toks prieinamas modelis būtų toks galingas – jis atveria „Replit“ naudojimo galimybes, kurių dar ilgai nesitikėjome kurti.
Michele Catasta, „Replit“ prezidentas ir DI vadovas

Rezultatui tinkamo intelekto parinkimas

Efektyvus DI naudojimas prasideda nuo siekiamo rezultato. Svarba, klaidos kaina, skuba ir mastas lemia tinkamą intelekto, spartos, patikimumo ir kainos pusiausvyrą. Ši pusiausvyra gali kisti kiekviename darbo eigos etape.

GPT‑5.6 suteikia įmonėms daug daugiau galimybių optimizuoti šį santykį. Luna užtikrina našumą, prilygstantį modeliams, kurie prieš metus priklausė priešakinei klasei, tačiau viena užduotis kainuoja maždaug 6 centus už kiekvieną jų kainos dolerį ir atliekama beveik devynis kartus greičiau. Atliekant profesines užduotis, vertinamas pagal „Agents’ Last Exam“, Luna pranoksta Fable 5, o numatoma vienos užduoties kaina yra beveik 99 % mažesnė.

Praktiškai įmonės gali apibrėžti reikiamą rezultatą ir kokybės standartą, o tada vertinimais nustatyti, kur papildomas intelektas reikšmingai pagerina rezultatą ir kur tą pačią kokybę gali užtikrinti spartesnis bei pigesnis apdorojimas. Pavyzdžiui, programavimo darbo eigoje Sol galėtų išsklaidyti neaiškumus ir sudaryti planą, o Luna – įgyvendinti aiškiai apibrėžtus pakeitimus, rašyti bei vykdyti testus ir įvertinti rezultatus. Kitai darbo eigai gali reikėti kitokios pusiausvyros.

GPT‑5.6 šeima išplečia šių pasirinkimų spektrą. Įmonės kiekviename etape gali pasitelkti maksimalų naudingą intelektą ir mokėti jo sukuriamą vertę atitinkančią kainą.

Norint suteikti tokį lankstumą, pirmiausia reikia efektyvinti kiekvieną modelius palaikantį sluoksnį.

Kaip plečiame efektyvumo ribas

Mūsų efektyvumo pranašumą lemia modelių, juos vykdančių išvedimo sistemų ir su įrankiais bei kontekstu juos jungiančios agentinės infrastruktūros tobulinimas. GPT‑5.6 modeliai užduotis atlieka tiesesniu keliu. Geresnis maršruto parinkimas užtikrina našų aparatinės įrangos naudojimą, optimizuota produkcinė programinė įranga efektyviau generuoja žetonus, o išmanesnis konteksto valdymas padeda agentams nekartoti jau atlikto darbo. Kartu šie patobulinimai leidžia tomis pačiomis skaičiavimo sąnaudomis atlikti daugiau naudingo darbo ir sumažinti kiekvienam rezultatui reikalingą laiką, žetonų skaičių bei kainą.

GPT‑5.6 Sol vis labiau padeda mums atrasti ir įgyvendinti kitus patobulinimus. Žmogaus vadovaujamame procese Sol savarankiškai perrašė ir optimizavo produkcinius branduolius, suplanavo bei atliko šimtus eksperimentų žetonų generavimui tobulinti ir stebėjo mokymą, o kilus problemoms įsikišdavo. Branduolių tobulinimas padėjo 20 % sumažinti bendrą modelio teikimo kainą, o eksperimentai daugiau nei 15 % padidino žetonų generavimo efektyvumą. Šis darbas tęsiamas ir kuria vis glaudesnį grįžtamojo ryšio ciklą: tobulėjant modeliams ir jiems gebant dirbti savarankiškiau, sparčiau didėja ir mūsų gebėjimas gerinti efektyvumą. Sužinokite daugiau apie GPT‑5.6 technologinius sprendimus.

Dideliam mastui pritaikyta skaičiavimo strategija

Norint patenkinti plačiai prieinamo intelekto paklausą, reikia ir daugiau, ir našiau naudojamų skaičiavimo išteklių. Kuriame atsparų infrastruktūros portfelį ir kiekvieną darbo krūvį nukreipiame į jam tinkamiausias sistemas. Toks požiūris apima abu kainos ir našumo kreivės galus. Mažesnių kainų gale naujos Luna ir Terra kainos leidžia ekonomiškai atlikti didelės apimties darbus kur kas didesniu mastu. Priešakiniame gale Spartusis režimas suteikia API klientams spartesnę prieigą prie Sol, kai svarbus atsako laikas.

Įmonės gali įtraukti daugiau DI į kasdienę veiklą neaukodamos spartos svarbiausiuose darbuose. Didelio masto dokumentų analizę, bendravimo su klientais klasifikavimą ir įprastus įgyvendinimo darbus galima ekonomiškai vykdyti plačiai, o sudėtingus Sol darbo krūvius – sparčiau, kai didesnė kaina yra pagrįsta.

Nauda gali augti eksponentiškai. Žmogaus vadovaujamame procese pajėgesni modeliai padeda mūsų techninei komandai atrasti naujos kartos patobulinimus ir sutrumpina kelią iki didesnio našumo bei mažesnių sąnaudų. Mūsų strategija ir toliau orientuota į pajėgumo bei efektyvumo didinimą, kad kiekviena nauja intelekto karta galėtų atlikti daugiau darbo mažesne kaina.

Prieinamumas ir kainos

GPT‑5.6 Terra ir Luna tebėra prieinami ChatGPT Work, Codex ir OpenAI API. ChatGPT Work ir Codex aplinkose Free bei ChatGPT Go naudotojai gali rinktis Terra, o ChatGPT Plus, ChatGPT Pro, Business ir Enterprise naudotojai – Terra arba Luna.

Nuo liepos 30 d. API Terra kaina bus 2 USD už milijoną įvesties žetonų ir 12 USD už milijoną išvesties žetonų, o Luna – atitinkamai 0,20 USD ir 1,20 USD. Sol kaina nesikeičia. ChatGPT ir Codex prenumeratų kainos bei kvotų biudžetai nesikeičia, tačiau naudojant Terra ir Luna dabar sunaudojama mažiau kreditų. AWS kainų pakeitimai bus pradėti diegti vėliau šiandien.

GPT‑5.6 Sol Spartusis režimas pakeičia prioritetinį apdorojimą API ir atitinka /fast režimą Codex. Esamos API užklausos, pažymėtos „priority“, ir toliau veiks. Peržiūrėkite išsamią API kainodarą.

Autorius

OpenAI