Pomjeranje granice omjera cijene i performansi uz GPT‑5.6
Povećanjem efikasnosti svakog sloja, OpenAI pruža bolje performanse za svaki uloženi dolar u sve većem broju poslovnih zadataka.
Jučer smo objavili kako je GPT‑5.6 pomogao da njegovo pokretanje bude efikasnije. Danas te uštede prenosimo na korisnike kroz niže cijene za GPT‑5.6 Luna(otvara se u novom prozoru) i Terra(otvara se u novom prozoru) te brže performanse modela GPT‑5.6 Sol u API-ju. Ova ažuriranja korisnicima omogućavaju da dobiju više za svaki dolar uložen u AI i da rade brže kada je vrijeme presudno.
Od danas će GPT‑5.6 Luna, naš najbrži i najpristupačniji model, koštati 80% manje, dok će GPT‑5.6 Terra, naš uravnoteženi model za svakodnevni rad, koštati 20% manje. Niže cijene za modele Luna i Terra odražavaju se i na obračun korištenja u okviru plaćenih pretplata na Codex i ChatGPT Work. Luna kompanijama nudi znatno isplativiji način obrade velikog obima posla uz izuzetno visok kvalitet. Može koristiti alate i izvršavati radne tokove u više koraka, čime omogućava praktičnu primjenu šireg raspona AI aplikacija u velikom obimu.
Veća dostupnost i pristupačnost napredne inteligencije ključne su za misiju kompanije OpenAI da osigura da AGI koristi cijelom čovječanstvu. Ove promjene tu posvećenost pretvaraju u djelo. One odražavaju višegodišnja poboljšanja načina na koji izrađujemo, pružamo i primjenjujemo naše modele.
U API uvodimo i Brzi mod, koji zamjenjuje našu ponudu prioritetne obrade. Za GPT‑5.6 Sol, Brzi mod sada pruža do 2,5 puta veću brzinu od standardne obrade po dvostrukoj cijeni, bez promjene inteligencije. Brzi mod je kompatibilan s prethodnim verzijama: zahtjevi označeni kao priority automatski će koristiti Brzi mod.
Efikasna upotreba AI-ja počinje od željenog rezultata. Važnost zadatka, cijena greške, hitnost i obim određuju pravi odnos inteligencije, brzine, pouzdanosti i troškova. Taj se odnos može mijenjati iz jednog koraka radnog toka u drugi.
GPT‑5.6 kompanijama pruža mnogo više prostora za optimizaciju tog odnosa. Luna pruža performanse uporedive s modelima koji su prije godinu dana pripadali graničnoj klasi, uz trošak po zadatku od približno šest centi na svaki dolar i gotovo devet puta veću brzinu. Na profesionalnim zadacima, mjereno testom Agents’ Last Exam, Luna nadmašuje Fable 5 uz procijenjeni trošak po zadatku koji je gotovo 99% niži.
U praksi, kompanije mogu definirati potreban rezultat i standard kvaliteta, a zatim evaluacijama utvrditi gdje dodatna inteligencija značajno poboljšava rezultat, a gdje brža i jeftinija obrada može pružiti isti kvalitet. Radni tok za programiranje, naprimjer, može koristiti Sol za otklanjanje nejasnoća i definiranje plana, a zatim Luna za implementaciju jasno definiranih izmjena, pisanje i pokretanje testova te procjenu rezultata. Drugi radni tok može zahtijevati drugačiji odnos.
Porodica GPT‑5.6 proširuje raspon tih mogućnosti. Kompanije u svakoj fazi mogu primijeniti najveći koristan nivo inteligencije i pritom platiti odgovarajuću cijenu za stvorenu vrijednost.
Takva fleksibilnost počinje povećanjem efikasnosti svakog sloja koji stoji iza modela.
Naša prednost u efikasnosti proizlazi iz poboljšavanja modela, sistema za inferenciju koji ih pokreću i agentskog harness sistema koji ih povezuje s alatima i kontekstom. Modeli GPT‑5.6 direktnije izvršavaju zadatke. Bolje usmjeravanje održava produktivnost hardvera, optimizirani produkcijski softver efikasnije generira tokene, a pametnije upravljanje kontekstom pomaže agentima da ne ponavljaju već završeni posao. Zajedno nam ova poboljšanja omogućavaju da s istim računarskim resursima obavimo više korisnog posla, uz manje vremena, tokena i troškova za svaki rezultat.
GPT‑5.6 Sol nam sve više pomaže da pronađemo i ostvarimo naredni niz poboljšanja. U procesu kojim upravljaju ljudi, Sol je samostalno preradio i optimizirao produkcijske kernele, osmislio i proveo stotine eksperimenata radi poboljšanja generiranja tokena te pratio obuku i intervenirao kada bi se pojavili problemi. Rad na kernelima pomogao je smanjiti ukupne troškove pružanja modela za 20%, dok su njegovi eksperimenti povećali efikasnost generiranja tokena za više od 15%. Taj se rad nastavlja i stvara čvršću povratnu spregu: kako se naši modeli poboljšavaju i postaju sposobni samostalnije raditi, tako se ubrzava i naše povećavanje efikasnosti. Saznajte više o inženjerskim rješenjima iza modela GPT‑5.6.
Zadovoljavanje potražnje za obiljem inteligencije zahtijeva i više i produktivnije računarske resurse. Gradimo otporan portfelj infrastrukture i svaki radni zadatak dodjeljujemo sistemima koji su najpogodniji za njegovo izvršavanje. Taj pristup podržava oba kraja krivulje cijene i performansi. Na jeftinijem kraju, nove cijene za modele Luna i Terra čine obradu velikog obima posla ekonomičnom u znatno većim razmjerama. Na graničnom kraju, Brzi mod korisnicima API-ja omogućava brži pristup modelu Sol kada je vrijeme odziva važno.
Velike kompanije mogu uvesti više AI-ja u svakodnevno poslovanje bez žrtvovanja brzine na najvažnijim zadacima. Analiza dokumenata velikog obima, klasifikacija interakcija s korisnicima i rutinska implementacija mogu postati dovoljno ekonomične za široku primjenu, dok se složeni zadaci modela Sol mogu izvršavati brže kada je viša cijena opravdana.
Koristi se mogu višestruko uvećavati. U procesu kojim upravljaju ljudi, sposobniji modeli pomažu našem tehničkom timu da pronađe novu generaciju poboljšanja, skraćujući put do boljih performansi i nižih troškova. Naša strategija ostaje usmjerena na unapređenje sposobnosti i efikasnosti kako bi svaka nova generacija inteligencije mogla obaviti više posla uz niže troškove.
GPT‑5.6 Terra i Luna i dalje su dostupni u uslugama ChatGPT Work, Codex i OpenAI API. U uslugama ChatGPT Work i Codex korisnici planova Free i ChatGPT Go mogu pristupiti modelu Terra, dok korisnici planova ChatGPT Plus, ChatGPT Pro, Business i Enterprise mogu birati između modela Terra i Luna.
Od 30. jula cijena API-ja iznosi 2 USD za milion ulaznih tokena i 12 USD za milion izlaznih tokena za model Terra, odnosno 0,20 USD za milion ulaznih tokena i 1,20 USD za milion izlaznih tokena za model Luna. Cijena modela Sol ostaje nepromijenjena. Cijene pretplata i ograničenja kvota za ChatGPT i Codex ostaju nepromijenjeni, dok korištenje modela Terra i Luna sada troši manje kredita. Promjene cijena počet će se uvoditi u AWS-u kasnije danas.
Brzi mod za GPT‑5.6 Sol zamjenjuje prioritetnu obradu u API-ju i usklađen je s opcijom /fast u Codexu. Postojeći API zahtjevi označeni kao priority nastavit će raditi. Pogledajte sve pojedinosti o cijenama API-ja.


