Premik meje pri razmerju med ceno in zmogljivostjo z modelom GPT‑5.6
Z učinkovitejšim delovanjem vseh plasti OpenAI pri več različnih poslovnih obremenitvah zagotavlja večjo zmogljivost za vsak vloženi dolar.
Včeraj smo predstavili, kako je model GPT‑5.6 pripomogel k učinkovitejšemu lastnemu izvajanju. Danes te pridobitve prenašamo na stranke v obliki nižjih cen za modela GPT‑5.6 Luna(odpre se v novem oknu) in Terra(odpre se v novem oknu) ter hitrejšega delovanja modela GPT‑5.6 Sol v API-ju. Te posodobitve strankam omogočajo, da iz vsakega dolarja, vloženega v UI, iztržijo več in hitreje napredujejo, ko je čas ključnega pomena.
Od danes bo GPT‑5.6 Luna, naš najhitrejši in cenovno najugodnejši model, stal 80 % manj, GPT‑5.6 Terra, naš uravnoteženi model za vsakodnevno delo, pa 20 % manj. Nižje cene za modela Luna in Terra se odražajo tudi v obračunavanju uporabe v okviru plačljivih naročnin pri uporabi Codexa in načina ChatGPT Work. Luna podjetjem omogoča precej stroškovno učinkovitejšo obdelavo obsežnih delovnih nalog ob ohranjanju zelo visoke kakovosti. Uporablja lahko orodja in izvaja večstopenjske delovne tokove, zato je obsežno izvajanje širšega nabora aplikacij UI praktično izvedljivo.
Večja razpoložljivost in cenovna dostopnost napredne inteligence sta osrednji del poslanstva družbe OpenAI, po katerem bo splošna umetna inteligenca (SUI) koristila vsemu človeštvu. Te spremembe to zavezo udejanjajo. So rezultat večletnih izboljšav pri izdelavi, zagotavljanju in uporabi naših modelov.
V API uvajamo tudi hitri način (Fast mode), ki nadomešča našo ponudbo prednostne obdelave. Hitri način pri modelu GPT‑5.6 Sol zdaj omogoča do 2,5-krat večjo hitrost kot standardna obdelava za dvakrat višjo ceno, brez spremembe v ravni inteligence. Hitri način je združljiv s prejšnjimi različicami modelov: zahteve s prednostno oznako »priority« ga bodo uporabile samodejno.
Učinkovita uporaba UI se začne pri želenem rezultatu. Pomen naloge, cena napake, nujnost in obseg določajo pravo ravnovesje med inteligenco, hitrostjo, zanesljivostjo in stroški. To ravnovesje se lahko spreminja med posameznimi koraki delovnega postopka.
GPT‑5.6 podjetjem omogoča veliko več možnosti za optimizacijo tega razmerja. Luna zagotavlja zmogljivost, primerljivo z modeli, ki so še pred letom dni veljali za prelomne, za približno šest centov na dolar na nalogo in pri skoraj devetkratni hitrosti. Pri strokovnih nalogah, merjenih s preizkusom Agents’ Last Exam, Luna prekaša Fable 5 ob ocenjenem skoraj 99 % nižjem strošku na nalogo.
V praksi lahko podjetja opredelijo želeni rezultat in standard kakovosti, nato pa z vrednotenji ugotovijo, kje dodatna inteligenca bistveno izboljša rezultat in kje lahko hitrejša, cenejša obdelava zagotovi enako kakovost. Delovni postopek programiranja bi lahko na primer uporabil model Sol za razjasnitev negotovosti in pripravo načrta, nato pa še model Luna za izvedbo jasno opredeljenih sprememb, pisanje in izvajanje testov ter vrednotenje rezultatov. Drug delovni postopek bi morda potreboval drugačno razmerje.
Družina GPT‑5.6 širi nabor teh možnosti. Podjetja lahko na vsaki stopnji uporabijo največjo smiselno raven inteligence in zanjo plačajo ceno, ki ustreza ustvarjeni vrednosti.
Zagotavljanje te prilagodljivosti se začne z učinkovitejšim delovanjem vseh plasti v ozadju modelov.
Naša prednost z vidika učinkovitosti izvira iz izboljševanja modelov, sistemov sklepanja, ki jih izvajajo, ter agentskega ogrodja, ki jih povezuje z orodji in kontekstom. Modeli GPT‑5.6 opravijo delo po bolj neposredni liniji. Boljše usmerjanje zagotavlja učinkovito uporabo strojne opreme, optimizirana produkcijska programska oprema učinkoviteje ustvarja žetone, pametnejše upravljanje konteksta pa agentom pomaga preprečiti ponavljanje že opravljenega dela. Te izboljšave nam omogočajo, da z enako računsko zmogljivostjo opravimo več koristnega dela ter skrajšamo čas in zmanjšamo število žetonov in stroške za vsak rezultat.
GPT‑5.6 Sol nam vse bolj pomaga odkrivati in uresničevati naslednji krog izboljšav. V procesu, ki so ga vodili ljudje, je model Sol samostojno prepisal in optimiziral produkcijska jedra, zasnoval in izvedel več sto poskusov za izboljšanje ustvarjanja žetonov ter spremljal učenje in posredoval ob težavah. Delo na jedrih je pripomoglo k 20-odstotnemu zmanjšanju skupnih stroškov zagotavljanja modela, poskusi pa so učinkovitost ustvarjanja žetonov povečali za več kot 15 %. To delo se nadaljuje in ustvarja tesnejšo povratno zanko: ko se naši modeli izboljšujejo in zmorejo delovati samostojneje, se povečuje tudi hitrost izboljševanja učinkovitosti. Preberite več o inženirskih rešitvah v ozadju modela GPT‑5.6.
Za zadovoljitev povpraševanja po široko dostopni inteligenci potrebujemo več računske zmogljivosti in njeno učinkovitejšo uporabo. Gradimo odporen portfelj infrastrukture in vsako delovno obremenitev usmerjamo v sisteme, ki so najprimernejši za njeno izvajanje. Ta pristop podpira oba konca krivulje razmerja med ceno in zmogljivostjo. Na cenovno ugodnejšem koncu nove cene modelov Luna in Terra omogočajo gospodarno izvajanje obsežnih nalog v veliko večjem merilu. Na prelomnem koncu hitri način strankam API-ja omogoča hitrejši dostop do modela Sol, kadar je odzivni čas pomemben.
Podjetja lahko UI vključijo v več vsakodnevnih postopkov, ne da bi pri najpomembnejšem delu žrtvovala hitrost. Obsežna analiza dokumentov, razvrščanje interakcij s strankami in rutinske izvedbene naloge se lahko gospodarno izvajajo širše, zapletene delovne obremenitve modela Sol pa hitreje, kadar je višja cena upravičena.
Koristi se lahko seštevajo. V procesu, ki ga vodijo ljudje, zmogljivejši modeli naši tehnični ekipi pomagajo odkrivati naslednjo generacijo izboljšav ter skrajšujejo pot do večje zmogljivosti in nižjih stroškov. Naša strategija ostaja usmerjena v hkratno izboljševanje zmogljivosti in učinkovitosti, da lahko vsaka generacija inteligence opravi več dela z nižjimi stroški.
Modela GPT‑5.6 Terra in Luna ostajata na voljo v načinu ChatGPT Work, Codexu in API-ju OpenAI. V načinu ChatGPT Work in Codexu lahko uporabniki paketov Free in Go dostopajo do modela Terra, uporabniki paketov Plus, Pro, Business in Enterprise pa lahko izbirajo med modeloma Terra in Luna.
Od 30. julija bo cena API-ja za model Terra znašala 2 USD na milijon vhodnih žetonov in 12 USD na milijon izhodnih žetonov, za model Luna pa 0,20 USD na milijon vhodnih žetonov in 1,20 USD na milijon izhodnih žetonov. Cena modela Sol ostaja nespremenjena. Cene naročnin in razpoložljive kvote za ChatGPT in Codex ostajajo nespremenjene, uporaba modelov Terra in Luna pa zdaj porabi manj točk. Spremembe cen se bodo v AWS začele uvajati pozneje danes.
Hitri način za GPT‑5.6 Sol v API-ju nadomešča prednostno obdelavo in je usklajen z ukazom /fast v Codexu. Obstoječe zahteve API-ja s prednostno oznako »priority« bodo še naprej delovale. Oglejte si vse podrobnosti o cenah API-ja.


