Posúvame hranice pomeru ceny a výkonu s GPT‑5.6
Zefektívnením každej vrstvy prináša OpenAI vyšší výkon za každý dolár v širšom spektre podnikových úloh.
Včera sme informovali, ako model GPT‑5.6 pomohol zefektívniť svoju prevádzku. Dnes tieto úspory prenášame na zákazníkov v podobe nižších cien modelov GPT‑5.6 Luna(otvorí sa v novom okne) a Terra(otvorí sa v novom okne) a vyššieho výkonu modelu GPT‑5.6 Sol v rozhraní API. Vďaka týmto aktualizáciám získajú zákazníci vyššiu hodnotu z každého dolára investovaného do AI a môžu postupovať rýchlejšie, keď záleží na čase.
Od dnešného dňa bude GPT‑5.6 Luna, náš najrýchlejší a cenovo najdostupnejší model, stáť o 80 % menej. GPT‑5.6 Terra, náš vyvážený model na každodennú prácu, bude lacnejší o 20 %. Nižšie ceny modelov Luna a Terra sa prejavia aj v započítavaní používania do platených predplatných služieb Codex a ChatGPT Work. Luna ponúka firmám výrazne úspornejší spôsob spracovania veľkých objemov práce pri zachovaní veľmi vysokej kvality. Dokáže používať nástroje a vykonávať viacstupňové pracovné postupy, vďaka čomu možno vo veľkom prakticky prevádzkovať širšie spektrum aplikácií AI.
Sprístupňovanie pokročilej inteligencie vo väčšom rozsahu a za dostupnejšiu cenu je ústrednou súčasťou poslania OpenAI zabezpečiť, aby AGI prinášala úžitok celému ľudstvu. Tieto zmeny premieňajú tento záväzok na prax. Sú výsledkom dlhoročného zlepšovania spôsobu, akým naše modely vytvárame, prevádzkujeme a nasadzujeme.
V rozhraní API tiež zavádzame rýchly režim, ktorý nahrádza našu ponuku prioritného spracovania. Rýchly režim modelu GPT‑5.6 Sol je teraz až 2,5-krát rýchlejší než štandardné spracovanie, stojí dvojnásobok a zachováva rovnakú úroveň inteligencie. Rýchly režim je spätne kompatibilný: požiadavky označené ako priority ho použijú automaticky.
Efektívne používanie AI sa začína pri požadovanom výsledku. Správnu rovnováhu medzi inteligenciou, rýchlosťou, spoľahlivosťou a nákladmi určujú význam úlohy, následky chyby, naliehavosť a rozsah. Táto rovnováha sa môže meniť medzi jednotlivými krokmi pracovného postupu.
GPT‑5.6 poskytuje firmám oveľa väčší priestor na optimalizáciu tejto rovnice. Luna ponúka výkon porovnateľný s modelmi, ktoré pred rokom patrili k prelomovej špičke, približne za 6 centov z každého dolára na úlohu a takmer deväťkrát rýchlejšie. Pri profesionálnych úlohách meraných testom Agents’ Last Exam prekonáva Luna model Fable 5 pri odhadovaných nákladoch na úlohu nižších takmer o 99 %.
Firmy môžu v praxi určiť požadovaný výsledok a štandard kvality a následne pomocou hodnotení zistiť, kde vyššia inteligencia výsledok podstatne zlepší a kde rovnakú kvalitu zabezpečí rýchlejšie a lacnejšie spracovanie. Pracovný postup pri programovaní môže napríklad použiť Sol na odstránenie neistoty a vytvorenie plánu a potom Luna na implementáciu presne určených zmien, písanie a spúšťanie testov a vyhodnotenie výsledkov. Iný pracovný postup si môže vyžadovať odlišnú rovnováhu.
Rodina GPT‑5.6 rozširuje škálu týchto možností. Firmy môžu v každej fáze využiť najvyššiu užitočnú mieru inteligencie a zaplatiť cenu zodpovedajúcu vytvorenej hodnote.
Takáto flexibilita sa začína zefektívnením každej vrstvy, ktorá stojí za modelmi.
Naša výhoda v efektivite pramení zo zlepšovania modelov, inferenčných systémov, ktoré ich prevádzkujú, a agentového harnessu, ktorý ich prepája s nástrojmi a kontextom. Modely GPT‑5.6 postupujú pri práci priamočiarejšie. Lepšie smerovanie udržiava hardvér produktívny, optimalizovaný produkčný softvér generuje tokeny efektívnejšie a inteligentnejšia správa kontextu pomáha agentom neopakovať už dokončenú prácu. Tieto zlepšenia nám umožňujú s rovnakým výpočtovým výkonom dokončiť viac užitočnej práce a skrátiť čas aj znížiť počet tokenov a náklady potrebné na každý výsledok.
GPT‑5.6 Sol nám čoraz viac pomáha nachádzať a zavádzať ďalšie zlepšenia. V rámci procesu vedeného ľuďmi Sol autonómne prepísal a optimalizoval produkčné jadrá, navrhol a vykonal stovky experimentov na zlepšenie generovania tokenov a monitoroval trénovanie, pričom zasiahol pri výskyte problémov. Práca na jadrách pomohla znížiť celkové náklady na prevádzku modelu o 20 %, zatiaľ čo experimenty zvýšili efektivitu generovania tokenov o viac než 15 %. Táto práca pokračuje a vytvára tesnejšiu spätnú väzbu: s rastúcou kvalitou a autonómnosťou našich modelov sa zrýchľuje aj naše zvyšovanie efektivity. Prečítajte si viac o technickom riešení modelu GPT‑5.6.
Na uspokojenie dopytu po široko dostupnej inteligencii potrebujeme viac výpočtového výkonu aj jeho produktívnejšie využitie. Budujeme odolné portfólio infraštruktúry a každú pracovnú záťaž priraďujeme systémom, ktoré sú na jej spracovanie najvhodnejšie. Tento prístup podporuje oba konce krivky ceny a výkonu. Na cenovo dostupnejšom konci umožňujú nové ceny modelov Luna a Terra hospodárne spracúvať veľké objemy práce v podstatne väčšom rozsahu. Na prelomovom konci ponúka rýchly režim zákazníkom API rýchlejší prístup k modelu Sol, keď záleží na čase odozvy.
Podniky môžu presunúť viac AI do každodennej prevádzky bez toho, aby pri najdôležitejších úlohách obetovali rýchlosť. Rozsiahla analýza dokumentov, klasifikácia interakcií so zákazníkmi a rutinná implementácia sa môžu hospodárne nasadiť vo veľkom, zatiaľ čo zložité úlohy modelu Sol možno zrýchliť, keď je vyššia cena opodstatnená.
Prínosy sa môžu násobiť. V rámci procesu vedeného ľuďmi pomáhajú schopnejšie modely nášmu technickému tímu objavovať ďalšiu generáciu zlepšení, čím skracujú cestu k vyššiemu výkonu a nižším nákladom. Naša stratégia sa naďalej zameriava na rozvoj schopností aj efektivity, aby každá generácia inteligencie zvládla viac práce s nižšími nákladmi.
GPT‑5.6 Terra a Luna zostávajú dostupné v službách ChatGPT Work, Codex a OpenAI API. V službách ChatGPT Work a Codex majú používatelia programov Free a ChatGPT Go prístup k modelu Terra, zatiaľ čo používatelia programov ChatGPT Plus, ChatGPT Pro, Business a Enterprise si môžu vybrať model Terra alebo Luna.
Od 30. júla bude cena API pre model Terra 2 USD za milión vstupných tokenov a 12 USD za milión výstupných tokenov a pre model Luna 0,20 USD za milión vstupných tokenov a 1,20 USD za milión výstupných tokenov. Cena modelu Sol zostáva nezmenená. Ceny predplatného a rozpočty kvót služieb ChatGPT a Codex zostávajú nezmenené, používanie modelov Terra a Luna však teraz spotrebuje menej kreditov. Zmeny cien sa v AWS začnú zavádzať ešte dnes.
Rýchly režim modelu GPT‑5.6 Sol nahrádza prioritné spracovanie v API a zodpovedá režimu /fast v službe Codex. Existujúce požiadavky API označené ako priority budú fungovať aj naďalej. Pozrite si úplné informácie o cenách API.


