Průvodce rodinou modelů GPT‑6
Praktické tipy, jak s modely GPT‑6 dosáhnout nejlepších výsledků a přitom mít čas i náklady pod kontrolou
GPT‑6 je naše dosud nejpokročilejší sada modelů a nabízí výběr modelů pro různé druhy práce.
Ať už měníte nápad ve funkční prototyp, vyvíjíte a testujete funkci, nebo koordinujete vícekrokové postupy napříč úložišti kódu, databázemi a externími API, tento průvodce vám vysvětlí, jak vybrat model GPT‑6, dávat mu účinné pokyny, řídit dlouhotrvající práci a připravit se na produkční provoz.

Zajistěte efektivní produkční provoz. Ke správě kontextu a nákladů využijte ukládání do mezipaměti(otevře se v novém okně) a kompakci(otevře se v novém okně). Měřte úspěšnost úkolů a latenci. Naplánujte monitorování a správu dat.
Vyberte model podle druhu práce. Najděte rovnováhu mezi schopnostmi, náklady a latencí: zvolte model, míru úsilí při uvažování(otevře se v novém okně) a rychlost podle úkolu.
Upravte prompty a dovednosti. Prompty, dovednosti a pokyny v úložišti musí shodně určovat, co má model dodat, co smí dělat samostatně a kdy je práce hotová.
Udržujte dlouhotrvající práci na správné cestě. Využívejte průběžné usměrňování(otevře se v novém okně), asynchronní nástroje(otevře se v novém okně) a delegování(otevře se v novém okně) ke zvládání změn a nezávislých úkolů. Jasně určete, kdy si má model vyžádat vaše vyjádření.
Před nasazením je vhodné zavést několik kontrol a osvědčených postupů.
Myslete na efektivitu. (otevře se v novém okně)Odstraňte kontext, který úkol nepotřebuje(otevře se v novém okně), ale zachovejte potřebné podklady. Pokud to aplikace podporuje, spouštějte nezávislé úkoly souběžně(otevře se v novém okně), aby jeden pomalý krok nezdržoval nesouvisející práci.
Při opakované práci využívejte společný kontext opakovaně díky ukládání promptů do mezipaměti(otevře se v novém okně). Vstupní tokeny v mezipaměti stojí podle modelu až o 95 % méně(otevře se v novém okně) než vstupní tokeny mimo mezipaměť. Stálé pokyny a referenční materiály umístěte před proměnlivé podrobnosti úkolu a zachovejte konzistentní definice nástrojů. Přehled ukládání do mezipaměti(otevře se v novém okně) a průvodce diagnostikou(otevře se v novém okně) vám pomohou zjistit, kde se opakované využití kontextu nedaří. Do odhadu nákladů celého postupu zahrňte zápisy do mezipaměti i případné sazby za dlouhý kontext.
U delších konverzací kompakce(otevře se v novém okně) zmenšuje kontext a přitom zachovává stav potřebný k pokračování.
Rozhodněte, jak budete monitorovat chování(otevře se v novém okně), a zkontrolujte nastavení správy dat(otevře se v novém okně) své aplikace.
Před nasazením testujte: spusťte reprezentativní úkoly a měřte úspěšnost, latenci a náklady na úspěšně dokončený úkol. Projděte si náš kontrolní seznam pro nasazení API(otevře se v novém okně).
Při výběru modelu a úrovně uvažování hledejte rovnováhu mezi inteligencí a cenou.
Model:
GPT‑6 Astra(otevře se v novém okně) pro nejnáročnější úkoly vyžadující uvažování a maximální inteligenci.
GPT‑6.1 Sol(otevře se v novém okně) pro složité programování, výzkum a ovládání počítače.
GPT‑6 Luna(otevře se v novém okně) pro úzce vymezené úkoly ve velkém měřítku a každodenní opakovanou práci s jasným cílem, jako je získávání údajů z faktur, třídění požadavků nebo tvorba strukturovaných shrnutí.
Při výběru nejlepšího modelu pro daný úkol porovnejte ceny(otevře se v novém okně) jednotlivých modelů.
Úroveň uvažování: V API zvolte, kolik úsilí má model úkolu věnovat.
Nízká: Běžné úkoly, například získávání faktů nebo drobné úpravy.
Střední: Práce vyžadující úsudek, například plánování funkce nebo porovnávání možností.
Vysoká: Náročné ladění, hlubší analýza nebo důkladná kontrola.
Velmi vysoká / Max: Vyzkoušejte je tam, kde jsou podporované a úroveň Vysoká nestačí. Ponechte je, jen pokud zlepšení stojí za čas a náklady navíc.
V API můžete měnit míru úsilí při uvažování během konverzace(otevře se v novém okně), aniž by se zneplatnila mezipaměť.
V Codexu začněte s výchozí úrovní uvažování daného modelu. Pro jednodušší úkoly ji snižte, pro hlubší analýzu zvyšte.
Rychlost:
V API použijte Rychlý režim(otevře se v novém okně), když záleží na době odezvy, například v chatovacích aplikacích nebo programovacích nástrojích. Nabízí rychlejší a stabilnější dobu odezvy za vyšší cenu za token než standardní zpracování.
V Codexu a API použijte Ultrarychlý režim(otevře se v novém okně), pokud rychlejší odezva stojí za příplatek, například při rychlých iteracích kódu. Zrychluje generování tokenů nezávisle na míře úsilí při uvažování. K dispozici pro GPT‑6 Astra(otevře se v novém okně).

— Eric Provencher, tým pro vývojářskou zkušenost v OpenAI
Začněte jasným zadáním: jaký výsledek chcete, pro koho je určen, jaký kontext a omezení jsou důležité a kdy je práce hotová. Pak projděte tyto čtyři oblasti shrnuté z článku Nový pohled na dovednosti a prompty pro GPT‑6 Astra(otevře se v novém okně), který aktualizaci pokynů rozebírá podrobněji:
Vytvářejte lepší dovednosti: Stručně a jasně popište, kdy se má která dovednost spustit. Podrobnosti načítejte jen podle potřeby a nepružné postupy nahraďte pokyny uzpůsobenými modelům, které váš tým používá.
Aktualizujte AGENTS.md: Vysvětlete, kdy jsou jednotlivé dokumenty a testy relevantní, a výslovně povolte bezpečné rutinní postupy, například lokální testy s jednorázovými daty bez přístupu do produkce.
Vymezte rozhodovací pravomoci: Určete, které kroky může model provést samostatně a které vyžadují schválení. Nahraďte plošná pravidla typu „vždy se zeptej“ jasnými hranicemi.
Jasně určete, jak práci dotáhnout: Definujte, co znamená „hotovo“ – provést změnu, spustit ji, zkontrolovat výsledek a opravit chyby. Uveďte také, která rozhodnutí musíte posoudit vy.
Další doporučení najdete v osvědčených postupech pro uvažování(otevře se v novém okně).
Ať už pracujete v Codexu, nebo vyvíjíte s API, určete, o čem smí model rozhodovat, kdy si má vyžádat vaše vyjádření a jak vypadá užitečná odpověď.
Dejte modelu dostatek pokynů, aby mohl pokračovat v práci a nemusel důležitá rozhodnutí odhadovat. (otevře se v novém okně)Řekněte mu, o čem smí rozhodovat a kdy vás má požádat o vyjádření(otevře se v novém okně). Může například zvolit uspořádání shrnutí, ale před změnou rozsahu projektu by se s vámi měl poradit. (otevře se v novém okně)Popište, jak vypadá užitečná odpověď(otevře se v novém okně): například srozumitelný jazyk, technické podrobnosti přiměřené cílovému publiku a stručný přehled toho, co se změnilo, co bylo ověřeno a co ještě vyžaduje pozornost.
S rodinou modelů GPT‑6 se nyní můžete pustit do úkolů, které trvají hodiny i dny. Následující funkce vám pomohou lépe řídit agenty při dlouhotrvajících úkolech.
V API využívejte průběžné usměrňování, asynchronní nástroje a souběžnou práci, aby dlouhotrvající úkoly postupovaly.
Aktualizujte pokyny za běhu: Usměrňování v průběhu tahu(otevře se v novém okně) umožňuje poslat upřesnění přes Responses WebSocket API(otevře se v novém okně), zatímco model pracuje. Aktualizace se řadí do fronty; neruší běžící nástroje ani nevracejí dokončené akce.
Pokračujte v práci, zatímco běží nástroj: Asynchronní volání nástrojů(otevře se v novém okně) umožňuje modelu pokračovat v nezávislé práci, zatímco vaše aplikace provádí pomalejší úkol, například testy. Aplikace vrátí výsledek, jakmile bude připravený. Než začnete s prací, která na tomto výsledku závisí, počkejte na něj.
Delegujte nezávislé dílčí úkoly: GPT‑6.1 Sol podporuje pracovní postupy s více agenty v Responses API(otevře se v novém okně). Může přidělit nezávislou práci dílčím agentům (například prozkoumání různých částí kódu) a spojit jejich zjištění do konečné odpovědi. Podpora více agentů je zatím v beta verzi.
Při dlouhotrvajících úkolech může vyvstat potřeba rozhodnutí, která jste v úvodním promptu nemuseli předvídat. Pomocí upřesňování a průběžného usměrňování udržujte práci na správné cestě.
Odpovídejte na otázky v průběhu práce: S GPT‑6 Astra může Codex žádat o upřesnění během práce(otevře se v novém okně). Vyřešte otázky, které ovlivňují další krok, a určete, jaká nezávislá práce může pokračovat, než se rozhodnete. Pokud nebudete k dispozici, řekněte Codexu, které úkoly mohou pokračovat a kdy má počkat na vaši odpověď.
Při změně požadavků změňte směr práce: Usměrněte probíhající úkol(otevře se v novém okně) novými informacemi a vysvětlete, co se má změnit a co má zůstat stejné. Nebudete tak ztrácet další čas přístupem, který už neodpovídá vašim potřebám.

Ovládání počítače(otevře se v novém okně) umožňuje modelům GPT‑6 Astra, GPT‑6.1 Sol a GPT‑6 Luna přímo pracovat s weby a desktopovými aplikacemi, a to i s těmi bez API. Můžete například model požádat, aby prozkoumal chybu, opravil kód a otevřel váš produkt v prohlížeči, kde ověří funkčnost opravy.
Pro každý krok zvolte nejjednodušší spolehlivý postup:
Použijte API nebo připojený nástroj, pokud dokáže úkol provést přímo.
Ovládání počítače využijte, když model potřebuje přečíst obsah obrazovky, klikat na tlačítka nebo za vás vyplnit formulář.
Pokud ovládání počítače začleňujete do vlastní aplikace, dejte modelu nástroj, který dokáže spouštět kód pro ovládání prohlížeče nebo plochy. Playwright pracuje s prohlížeči(otevře se v novém okně); PyAutoGUI s desktopovými aplikacemi.



