Přeskoč na hlavní obsah
OpenAI

30. července 2026

Produkt

Posouváme hranice poměru ceny a výkonu s GPT‑5.6

Vyšší efektivitou všech vrstev přináší OpenAI lepší výkon za každý dolar v širší škále podnikových úloh.

Načítání…

Včera jsme popsali, jak se model GPT‑5.6 sám podílel na zefektivnění svého provozu. Dnes tyto úspory předáváme zákazníkům v podobě nižších cen modelů GPT‑5.6 Luna(otevře se v novém okně) a Terra(otevře se v novém okně) a vyššího výkonu modelu GPT‑5.6 Sol v API. Díky těmto aktualizacím získají zákazníci z každého dolaru investovaného do AI více a mohou postupovat rychleji, když záleží na čase.

Ode dneška bude GPT‑5.6 Luna, náš nejrychlejší a cenově nejdostupnější model, stát o 80 % méně. GPT‑5.6 Terra, náš vyvážený model pro každodenní práci, zlevní o 20 %. Nižší ceny modelů Luna a Terra se promítají také odrážejí v tom, jak se počítají do využití v placených předplatných pro Codex a ChatGPT Work. Luna nabízí firmám výrazně úspornější způsob zpracování velkých objemů práce při zachování velmi vysoké kvality. Dokáže používat nástroje a provádět vícekrokové pracovní postupy, takže lze ve velkém prakticky provozovat širší škálu AI aplikací.

Zajištění širší dostupnosti pokročilé inteligence za přijatelnější cenu je zásadní součástí poslání OpenAI: zajistit, aby AGI přinášela prospěch celému lidstvu. Tyto změny převádějí tento závazek do praxe. Odrážejí roky zdokonalování způsobu, jakým naše modely vytváříme, provozujeme a nasazujeme.

V API také zavádíme Rychlý režim, který nahrazuje naši nabídku Prioritního zpracování. Pro GPT‑5.6 Sol nyní Rychlý režim nabízí až 2,5krát vyšší rychlost než standardní zpracování za dvojnásobnou cenu, aniž by se změnila úroveň inteligence. Rychlý režim je zpětně kompatibilní: požadavky označené jako priority jej začnou používat automaticky.

1 z 6
GPT‑5.6 Luna nás zatím nejvíce přiblížila inteligenci tak levné, že se její spotřeba ani nemusí měřit. Ještě nikdy jsem neviděl takto cenově dostupný model s takovým výkonem — otevírá Replitu možnosti využití, u kterých jsme dlouho nečekali, že je budeme moci realizovat.
Michele Catasta, prezident & vedoucí AI ve společnosti Replit

Přizpůsobení inteligence požadovanému výsledku

Efektivní využití AI začíná u požadovaného výsledku. Význam úlohy, cena případné chyby, naléhavost a rozsah určují správnou rovnováhu mezi inteligencí, rychlostí, spolehlivostí a náklady. Tato rovnováha se může měnit s každým krokem pracovního postupu.

GPT‑5.6 dává firmám mnohem větší prostor tuto rovnici optimalizovat. Luna nabízí výkon srovnatelný s modely, které před rokem patřily k průkopnické špičce, přibližně za šest centů z každého dolaru na úlohu a téměř devítinásobnou rychlostí. Při profesionální práci měřené testem Agents’ Last Exam překonává Luna model Fable 5 s o téměř 99 % nižšími odhadovanými náklady na úlohu.

V praxi mohou firmy definovat požadovaný výsledek a standard kvality a poté vyhodnotit a rozhodnout, kde vyšší inteligence výsledek podstatně zlepší a kde stejné kvality dosáhne rychlejší a levnější zpracování. Pracovní postup programování může například využít Sol k odstranění nejasností a definování plánu a poté Lunu k implementaci vhodně specifikovaných změn, psaní a spouštění testů a vyhodnocení výsledků. Jiný pracovní postup může vyžadovat zase jinou rovnováhu.

Rodina GPT‑5.6 rozšiřuje škálu těchto možností. Firmy mohou v každé fázi využít nejvyšší smysluplnou úroveň inteligence a zaplatit cenu odpovídající vytvořené hodnotě.

Tato flexibilita začíná zvyšováním efektivity všech vrstev, na kterých modely stojí.

Jak posouváme hranice efektivity

Naše výhoda v efektivitě vychází ze zdokonalování modelů, inferenčních systémů, které je provozují, a agentního harnessu, jenž je propojuje s nástroji a kontextem. Modely GPT‑5.6 postupují při práci přímočařeji. Lepší směrování udržuje hardware produktivní, optimalizovaný produkční software generuje tokeny efektivněji a chytřejší správa kontextu pomáhá agentům neopakovat již dokončenou práci. Díky těmto zlepšením zvládneme se stejným výpočetním výkonem více užitečné práce a každý výsledek vyžaduje méně času, tokenů i nákladů.

GPT‑5.6 Sol nám stále více pomáhá hledat a zavádět další kolo zlepšení. V rámci procesu řízeného lidmi Sol autonomně přepsal a optimalizoval produkční kernely, navrhl a provedl stovky experimentů ke zlepšení generování tokenů a sledoval trénování, přičemž zasahoval při výskytu problémů. Práce na kernelech pomohla snížit celkové náklady na provoz modelu o 20 % a experimenty zvýšily efektivitu generování tokenů o více než 15 %. Tato práce pokračuje a vytváří stále těsnější zpětnovazebnou smyčku: s tím, jak se naše modely zlepšují a dokážou pracovat autonomněji, roste i rychlost, s níž zvyšujeme efektivitu. Přečtěte si více o technologiích, na kterých GPT‑5.6 stojí.

Výpočetní strategie navržená pro velké objemy

Uspokojení poptávky po široce dostupné inteligenci vyžaduje více výpočetního výkonu i jeho produktivnější využití. Budujeme odolné portfolio infrastruktury a každou pracovní zátěž přiřazujeme systémům, které jsou pro ni nejvhodnější. Tento přístup podporuje oba konce křivky ceny a výkonu. Na cenově dostupnějším konci umožňují nové ceny modelů Luna a Terra hospodárně zpracovávat velké objemy práce v mnohem větším měřítku. Na průkopnickém konci nabízí Rychlý režim zákazníkům API rychlejší přístup k modelu Sol, když záleží na rychlosti odezvy.

Firmy mohou přesunout více AI do každodenního provozu, aniž by u svých nejdůležitějších úloh obětovaly rychlost. Rozsáhlé analýzy dokumentů, klasifikace interakcí se zákazníky i rutinní implementace lze hospodárně provozovat ve velkém. Složité úlohy pro Sol mohou zase probíhat rychleji, když jsou výdaje navíc opodstatněné.

Přínosy se mohou násobit. V rámci procesu řízeného lidmi pomáhají schopnější modely našemu technickému týmu nacházet další generaci zlepšení a zkracují cestu k vyššímu výkonu a nižším nákladům. Naše strategie se nadále soustředí na rozvoj schopností i efektivity, aby každá generace inteligence dokázala odvést více práce s nižšími náklady.

Dostupnost a ceny

GPT‑5.6 Terra a Luna zůstávají dostupné v ChatGPT Work, Codexu a API OpenAI. V ChatGPT Work a Codexu mají uživatelé tarifů Free a Go přístup k modelu Terra, zatímco uživatelé tarifů Plus, Pro, Business a Enterprise si mohou vybrat mezi modely Terra a Luna.

Od 30. července činí cena v API u modelu Terra 2 USD za milion vstupních tokenů a 12 USD za milion výstupních tokenů a u modelu Luna 0,20 USD za milion vstupních tokenů a 1,20 USD za milion výstupních tokenů. Cena modelu Sol se nemění. Ceny předplatného a limity kvót služeb ChatGPT a Codex se nemění, využití modelů Terra a Luna však nyní spotřebovává méně kreditů. Změny cen se v AWS začnou zavádět ještě dnes.

Rychlý režim pro GPT‑5.6 Sol nahrazuje v API Prioritní zpracování a odpovídá režimu /fast v Codexu. Stávající požadavky API označené jako „priority“ budou fungovat i nadále. Zobrazit kompletní informace o cenách API.

Autor

OpenAI