Preskočite na glavni sadržaj
OpenAI

30. srpnja 2026.

Proizvod

Pomicanje granice omjera cijene i performansi uz GPT‑5.6

Povećanjem učinkovitosti svakog sloja OpenAI pruža bolje performanse za svaki uloženi dolar u sve većem broju poslovnih radnih opterećenja.

Učitavanje…

Jučer smo objavili kako je GPT‑5.6 pridonio učinkovitijem vlastitom radu. Danas te uštede prenosimo korisnicima nižim cijenama modela GPT‑5.6 Luna(otvara se u novom prozoru) i Terra(otvara se u novom prozoru) te bržim radom modela GPT‑5.6 Sol u API-ju. Ova ažuriranja korisnicima omogućuju da dobiju više za svaki dolar uložen u AI i brže djeluju kada je vrijeme presudno.

Od danas će GPT‑5.6 Luna, naš najbrži i najpovoljniji model, stajati 80 % manje, a GPT‑5.6 Terra, naš uravnoteženi model za svakodnevni rad, 20 % manje. Niže cijene modela Luna i Terra odražavaju se i na obračun potrošnje u okviru plaćenih pretplata pri korištenju proizvoda Codex i ChatGPT Work. Luna tvrtkama nudi znatno isplativiji način obrade velikog opsega posla uz vrlo visoku razinu kvalitete. Može upotrebljavati alate i izvršavati višekoračne tijekove rada, zbog čega je širi raspon primjena umjetne inteligencije praktično izvodiv u velikom opsegu.

Veća dostupnost i pristupačnost napredne inteligencije ključne su za misiju tvrtke OpenAI da osigura dobrobit AGI-ja za cijelo čovječanstvo. Ovim promjenama tu predanost provodimo u djelo. One su rezultat višegodišnjih poboljšanja načina na koji izrađujemo, poslužujemo i primjenjujemo svoje modele.

U API uvodimo i Brzi način rada, koji zamjenjuje našu ponudu Priority Processing. Za GPT‑5.6 Sol Brzi način rada sada pruža do 2,5 puta veću brzinu od standardne obrade po dvostrukoj cijeni, bez promjene razine inteligencije. Brzi način rada unatrag je kompatibilan: zahtjevi označeni oznakom priority automatski će ga upotrebljavati.

1 od 6
GPT‑5.6 Luna dosad je najbliže inteligenciji toliko jeftinoj da potrošnju ne treba ni mjeriti. Nikad nisam vidio da ovako povoljan model bude toliko moćan — Replitu omogućuje primjene za koje nismo očekivali da ćemo ih još dugo moći razvijati.
Michele Catasta, predsjednik & voditelj odjela za AI, Replit

Prilagodba inteligencije željenom ishodu

Učinkovita upotreba umjetne inteligencije počinje od željenog ishoda. Važnost zadatka, cijena pogreške, hitnost i opseg određuju odgovarajuću ravnotežu inteligencije, brzine, pouzdanosti i cijene. Ta se ravnoteža može mijenjati iz jednog koraka tijeka rada u drugi.

GPT‑5.6 tvrtkama pruža mnogo više prostora za optimizaciju tog odnosa. Luna pruža performanse usporedive s modelima koji su prije godinu dana pripadali graničnoj klasi, uz cijenu po zadatku od približno šest centi za svaki dolar i gotovo devet puta veću brzinu. Na profesionalnim zadacima mjerenima testom Agents’ Last Exam Luna nadmašuje Fable 5 uz procijenjenu cijenu po zadatku koja je gotovo 99 % niža.

U praksi tvrtke mogu definirati željeni ishod i standard kvalitete, a zatim evaluacijama utvrditi gdje dodatna inteligencija bitno poboljšava rezultat, a gdje brža i jeftinija obrada može pružiti jednaku kvalitetu. Primjerice, tijek rada za programiranje može upotrijebiti Sol za otklanjanje nejasnoća i izradu plana, a zatim Lunu za provedbu jasno definiranih promjena, pisanje i pokretanje testova te evaluaciju rezultata. Drugi tijek rada može zahtijevati drukčiju ravnotežu.

Obitelj GPT‑5.6 proširuje raspon tih mogućnosti. Tvrtke u svakoj fazi mogu primijeniti najveću korisnu razinu inteligencije i pritom platiti cijenu primjerenu ostvarenoj vrijednosti.

Takva fleksibilnost počinje povećanjem učinkovitosti svakog sloja na kojem modeli počivaju.

Kako pomičemo granicu učinkovitosti

Naša prednost u učinkovitosti proizlazi iz poboljšanja modela, sustava za zaključivanje koji ih pokreću i agentskog testnog sklopa koji ih povezuje s alatima i kontekstom. Modeli GPT‑5.6 izravnije dolaze do rezultata. Bolje usmjeravanje održava produktivnost hardvera, optimizirani produkcijski softver učinkovitije generira tokene, a pametnije upravljanje kontekstom pomaže agentima da ne ponavljaju već dovršen posao. Ta nam poboljšanja omogućuju da s istim računalnim resursima obavimo više korisnog posla te smanjimo vrijeme, broj tokena i trošak potreban za svaki rezultat.

GPT‑5.6 Sol sve nam više pomaže pronaći i ostvariti sljedeći niz poboljšanja. U procesu pod ljudskim vodstvom Sol je autonomno preradio i optimizirao produkcijske jezgre, osmislio i proveo stotine eksperimenata za poboljšanje generiranja tokena te nadzirao obuku i intervenirao kada bi se pojavili problemi. Rad na jezgrama pomogao je smanjiti ukupan trošak posluživanja modela za 20 %, dok su eksperimenti povećali učinkovitost generiranja tokena za više od 15 %. Taj se rad nastavlja i stvara čvršću povratnu spregu: kako naši modeli napreduju i mogu raditi autonomnije, tako se ubrzava i naše povećavanje učinkovitosti. Saznajte više o inženjerskim rješenjima iza modela GPT‑5.6.

Strategija računalnih resursa osmišljena za veliki opseg

Zadovoljavanje potražnje za obiljem inteligencije zahtijeva više računalnih resursa, ali i njihovu veću produktivnost. Gradimo otporan portfelj infrastrukture i svako radno opterećenje povezujemo sa sustavima koji su najprikladniji za njegovo izvršavanje. Taj pristup podupire oba kraja krivulje cijene i performansi. Na cjenovno pristupačnijem kraju nove cijene modela Luna i Terra čine obradu velikog opsega posla isplativom u mnogo većim razmjerima. Na graničnom kraju Brzi način rada korisnicima API-ja pruža brži pristup modelu Sol kada je važno vrijeme odziva.

Velike organizacije mogu uvesti više umjetne inteligencije u svakodnevno poslovanje bez žrtvovanja brzine u najvažnijim zadacima. Opsežna analiza dokumenata, klasifikacija interakcija s korisnicima i rutinska implementacija mogu postati dovoljno isplative za široku primjenu, dok se složena radna opterećenja modela Sol mogu brže obrađivati kada je viša cijena opravdana.

Prednosti se mogu umnožavati. U procesu pod ljudskim vodstvom sposobniji modeli pomažu našem tehničkom timu pronaći novu generaciju poboljšanja, skraćujući put do boljih performansi i nižih troškova. Naša je strategija i dalje usmjerena na istodobno unapređivanje sposobnosti i učinkovitosti kako bi svaka generacija inteligencije mogla obaviti više posla uz niži trošak.

Dostupnost i cijene

GPT‑5.6 Terra i Luna i dalje su dostupni u proizvodima ChatGPT Work i Codex te u API-ju tvrtke OpenAI. U proizvodima ChatGPT Work i Codex korisnici planova Free i Go mogu pristupiti modelu Terra, dok korisnici planova Plus, Pro, Business i Enterprise mogu birati između modela Terra i Luna.

Od 30. srpnja cijena API-ja za Terru iznosi 2 USD po milijunu ulaznih tokena i 12 USD po milijunu izlaznih tokena, a za Lunu 0,20 USD po milijunu ulaznih tokena i 1,20 USD po milijunu izlaznih tokena. Cijena modela Sol ostaje nepromijenjena. Cijene pretplata i kvote za ChatGPT i Codex ostaju nepromijenjene, dok upotreba modela Terra i Luna sada troši manje kredita. Promjene cijena počet će se uvoditi u AWS-u kasnije tijekom današnjeg dana.

Brzi način rada za GPT‑5.6 Sol zamjenjuje Priority Processing u API-ju i usklađen je s naredbom /fast u proizvodu Codex. Postojeći zahtjevi API-ja označeni oznakom priority nastavit će raditi. Pogledajte sve pojedinosti o cijenama API-ja.

Autor

OpenAI