Sprievodca rodinou modelov GPT‑6
Praktické tipy, ako dosiahnuť najlepšie výsledky s modelmi GPT‑6 a zároveň mať čas aj náklady pod kontrolou
GPT‑6 je naša doposiaľ najpokročilejšia skupina modelov a ponúka výber modelov na rôzne druhy práce.
Či už meníte nápad na funkčný prototyp, vyvíjate a testujete funkciu alebo koordinujete viackrokové postupy naprieč repozitármi kódu, databázami a externými API, tento sprievodca vysvetľuje, ako vybrať model GPT‑6, zadávať mu účinné pokyny, riadiť dlhodobú prácu a pripraviť sa na produkčnú prevádzku.

Pracujte efektívne v produkcii. Na správu kontextu a nákladov využívajte ukladanie do vyrovnávacej pamäte(otvorí sa v novom okne) a kompakciu(otvorí sa v novom okne). Merajte úspešnosť úloh a latenciu. Naplánujte monitorovanie a správu údajov.
Vyberte model podľa pracovnej záťaže. Vyvážte schopnosti, náklady a latenciu výberom modelu, intenzity uvažovania(otvorí sa v novom okne) a rýchlosti podľa úlohy.
Upravte príkazy a zručnosti. Dbajte na to, aby príkazy, zručnosti a pokyny v repozitári jednotne určovali, čo má model dodať, čo môže robiť samostatne a kedy je práca hotová.
Udržujte dlhodobú prácu v správnom smere. Na zvládanie zmien a samostatnej práce využívajte usmerňovanie(otvorí sa v novom okne), asynchrónne nástroje(otvorí sa v novom okne) a delegovanie(otvorí sa v novom okne). Jasne určte, kedy si má model vyžiadať váš vstup.
Pred nasadením treba zaviesť niekoľko kontrol a osvedčených postupov.
Myslite na efektívnosť. (otvorí sa v novom okne)Odstráňte kontext, ktorý úloha nepotrebuje(otvorí sa v novom okne), no zachovajte potrebné podklady. Ak to aplikácia podporuje, spúšťajte nezávislé úlohy súbežne(otvorí sa v novom okne), aby jeden pomalý krok nebrzdil nesúvisiacu prácu.
Pri opakovaných úlohách využívajte spoločný kontext znova pomocou cachingu príkazov(otvorí sa v novom okne). Vstupné tokeny vo vyrovnávacej pamäti stoja podľa modelu až o 95 % menej(otvorí sa v novom okne) než tokeny mimo nej. Stále pokyny a referenčné materiály umiestnite pred meniace sa podrobnosti úlohy a zachovajte konzistentné definície nástrojov. Prehľad využitia vyrovnávacej pamäte(otvorí sa v novom okne) a sprievodca diagnostikou(otvorí sa v novom okne) vám pomôžu zistiť, kde opätovné využitie kontextu zlyháva. Pri odhade nákladov na celý pracovný postup zohľadnite zápisy do vyrovnávacej pamäte aj prípadné sadzby za dlhý kontext.
Pri dlhších konverzáciách kompakcia(otvorí sa v novom okne) zmenšuje kontext a zachováva stav potrebný na pokračovanie.
Rozhodnite sa, ako budete monitorovať správanie(otvorí sa v novom okne), a skontrolujte nastavenia správy údajov(otvorí sa v novom okne) pre svoju aplikáciu.
Pred nasadením testujte: spustite reprezentatívne úlohy a merajte ich úspešnosť, latenciu a náklady na úspešne dokončenú úlohu. Pozrite si náš kontrolný zoznam pre nasadenie API(otvorí sa v novom okne).
Pri výbere modelu a úrovne uvažovania hľadajte rovnováhu medzi inteligenciou a cenou.
Model:
GPT‑6 Astra(otvorí sa v novom okne) na najnáročnejšie úlohy vyžadujúce uvažovanie, pri ktorých je potrebná maximálna inteligencia.
GPT‑6.1 Sol(otvorí sa v novom okne) na zložité programovanie, výskum a používanie počítača.
GPT‑6 Luna(otvorí sa v novom okne) na úzko zamerané úlohy vo veľkom rozsahu a každodennú opakovanú prácu s jasným cieľom, napríklad extrakciu údajov z faktúr, klasifikáciu požiadaviek či tvorbu štruktúrovaných súhrnov.
Pri výbere najvhodnejšieho modelu pre úlohu porovnajte ceny(otvorí sa v novom okne) jednotlivých modelov.
Úroveň uvažovania: V API vyberte, koľko úsilia má model venovať úlohe.
Nízka: bežné úlohy, napríklad extrakcia faktov alebo drobné úpravy.
Stredná: práca vyžadujúca úsudok, napríklad plánovanie funkcie alebo porovnávanie možností.
Vysoká: náročné ladenie, hlbšia analýza alebo dôkladná kontrola.
Extra vysoká / Maximálna: vyskúšajte ich tam, kde sú podporované a úroveň Vysoká nestačí. Ponechajte ich, len ak zlepšenie stojí za čas a náklady navyše.
V API môžete zmeniť intenzitu uvažovania počas konverzácie(otvorí sa v novom okne) bez narušenia vyrovnávacej pamäte.
V nástroji Codex začnite s predvolenou úrovňou uvažovania daného modelu. Pri jednoduchších úlohách ju znížte a pri hlbšej analýze zvýšte.
Rýchlosť:
V API používajte rýchly režim(otvorí sa v novom okne), keď záleží na čase odozvy, napríklad v četových aplikáciách alebo programovacích nástrojoch. Poskytuje rýchlejšiu a stabilnejšiu odozvu za vyššiu cenu za token než štandardné spracovanie.
V nástroji Codex a v API využívajte ultrarýchly režim(otvorí sa v novom okne), keď sa oplatí priplatiť za rýchlejšiu odozvu, napríklad pri rýchlych iteráciách kódu. Zrýchľuje generovanie tokenov nezávisle od intenzity uvažovania. K dispozícii pre GPT‑6 Astra(otvorí sa v novom okne).

— Eric Provencher, tím pre vývojársku skúsenosť v OpenAI
Začnite jasným zadaním: aký výsledok chcete, pre koho je určený, aký kontext a obmedzenia sú relevantné a kedy je práca hotová. Potom si podrobnejšie prejdite tieto štyri oblasti úpravy pokynov, zhrnuté z článku Nový pohľad na zručnosti a príkazy pre GPT‑6 Astra(otvorí sa v novom okne):
Vytvárajte lepšie zručnosti: V stručných opisoch jasne určte, kedy sa má každá zručnosť spustiť. Podporné podrobnosti načítavajte len v prípade potreby a pevné postupy nahraďte pokynmi vhodnými pre modely vášho tímu.
Aktualizujte AGENTS.md: Vysvetlite, kedy sú konkrétne dokumenty a testy relevantné, a výslovne povoľte bezpečné bežné postupy, napríklad lokálne testy s jednorazovými údajmi a bez prístupu do produkcie.
Určte hranice rozhodovania: Uveďte, ktoré kroky možno vykonať samostatne a ktoré vyžadujú schválenie. Plošné pravidlá typu „vždy sa opýtaj“ nahraďte jasnými hranicami.
Jasne určte, kedy má model vytrvať: Definujte, čo znamená „hotovo“ — implementovať zmenu, spustiť ju, skontrolovať výsledok a opraviť chyby — a označte rozhodnutia, ktoré musíte preveriť.
Ďalšie odporúčania nájdete v osvedčených postupoch pre uvažovanie(otvorí sa v novom okne).
Či už pracujete v nástroji Codex, alebo vyvíjate pomocou API, určte, aké rozhodnutia môže model robiť, kedy si má vyžiadať váš vstup a ako vyzerá užitočná odpoveď.
Poskytnite modelu dostatok pokynov, aby práca napredovala bez hádania pri dôležitých rozhodnutiach. (otvorí sa v novom okne)Povedzte mu, o čom môže rozhodnúť a kedy si má vyžiadať váš vstup(otvorí sa v novom okne). Napríklad môže zvoliť štruktúru súhrnu, no pred zmenou rozsahu projektu by sa mal poradiť s vami. (otvorí sa v novom okne)Opíšte, ako vyzerá užitočná odpoveď(otvorí sa v novom okne): napríklad zrozumiteľný jazyk, technické podrobnosti prispôsobené publiku a stručné odovzdanie výsledkov s prehľadom zmien, vykonaných kontrol a bodov, ktoré si ešte vyžadujú pozornosť.
S rodinou modelov GPT‑6 sa teraz môžete pustiť do úloh, ktoré trvajú hodiny či dni. Pomocou nasledujúcich funkcií lepšie riaďte agentov pri dlhotrvajúcich úlohách.
V API využívajte usmerňovanie, asynchrónne nástroje a súbežnú prácu, aby dlhotrvajúce úlohy napredovali.
Aktualizujte pokyny počas behu: Usmerňovanie počas ťahu(otvorí sa v novom okne) umožňuje odoslať korekciu cez Responses WebSocket API(otvorí sa v novom okne), kým model pracuje. Aktualizácie sa zaradia do frontu; nezrušia spustené nástroje ani nevrátia späť dokončené kroky.
Pokračujte v práci, kým beží nástroj: Asynchrónne volanie nástrojov(otvorí sa v novom okne) umožňuje modelu pokračovať v nezávislej práci, kým aplikácia vykonáva pomalšiu úlohu, napríklad testy. Aplikácia vráti výsledok, keď bude pripravený. Pred začatím práce, ktorá od tohto výsledku závisí, naň počkajte.
Delegujte nezávislé čiastkové úlohy: GPT‑6.1 Sol podporuje pracovné postupy s viacerými agentmi v Responses API(otvorí sa v novom okne). Môže prideľovať nezávislú prácu podagentom (napríklad skúmanie rôznych častí kódovej základne) a spojiť ich zistenia do konečnej odpovede. Funkcia viacerých agentov je momentálne v beta verzii.
Pri dlhotrvajúcich úlohách môžu vzniknúť rozhodnutia, ktoré ste v úvodnom príkaze nemuseli predvídať. Pomocou objasňovania a usmerňovania udržujte prácu v správnom smere.
Odpovedajte na otázky v priebehu práce: S GPT‑6 Astra môže Codex žiadať o objasnenie počas práce(otvorí sa v novom okne). Vyriešte otázky ovplyvňujúce ďalší krok a určte, ktorá nezávislá práca môže pokračovať, kým sa rozhodnete. Ak budete preč, povedzte nástroju Codex, v ktorých úlohách môže pokračovať a kedy má počkať na vašu odpoveď.
Pri zmene požiadaviek zmeňte smer práce: Usmernite prebiehajúcu úlohu(otvorí sa v novom okne) novými informáciami a vysvetlite, čo sa má zmeniť a čo má zostať rovnaké. Vyhnete sa tak ďalšiemu času strávenému prístupom, ktorý už nezodpovedá vašim potrebám.

Ovládanie počítača(otvorí sa v novom okne) umožňuje modelom GPT‑6 Astra, GPT‑6.1 Sol a GPT‑6 Luna priamo pracovať s webmi a počítačovými aplikáciami, aj s tými bez API. Model môžete napríklad požiadať, aby preskúmal chybu, opravil kód a otvoril váš produkt v prehliadači na overenie funkčnosti opravy.
Pre každý krok zvoľte najjednoduchší spoľahlivý spôsob:
Použite API alebo pripojený nástroj, ak dokáže úlohu vykonať priamo.
Ovládanie počítača využite, keď model potrebuje čítať obrazovku, klikať na tlačidlá alebo za vás vyplniť formulár.
Ak ovládanie počítača integrujete do vlastnej aplikácie, dajte modelu nástroj, ktorý dokáže spúšťať kód na ovládanie prehliadača alebo pracovnej plochy. Playwright pracuje s prehliadačmi(otvorí sa v novom okne); PyAutoGUI s počítačovými aplikáciami.



