Vodnik po družini modelov GPT‑6
Praktični nasveti za najboljše rezultate z modeli GPT‑6 ob obvladovanju časa in stroškov
GPT‑6 je naša doslej najnaprednejša zbirka modelov, ki ponuja izbiro modelov za različne vrste dela.
Ne glede na to, ali zamisel pretvarjate v delujoč prototip, razvijate in testirate funkcijo ali usklajujete večstopenjske poteke dela med repozitoriji kode, podatkovnimi bazami in zunanjimi API-ji, ta vodnik pojasnjuje, kako izbrati model GPT‑6, mu dati učinkovita navodila, upravljati dolgotrajno delo in se pripraviti na produkcijo.

Poskrbite za učinkovito delovanje v produkciji. Za upravljanje konteksta in stroškov uporabite predpomnjenje(odpre se v novem oknu) in kompaktiranje(odpre se v novem oknu). Merite uspešnost nalog in zakasnitev ter načrtujte spremljanje in nadzor nad podatki.
Izberite model glede na delovno obremenitev. Uravnotežite zmogljivost, stroške in zakasnitev z izbiro modela, intenzivnosti sklepanja(odpre se v novem oknu) in hitrosti, ki ustrezajo nalogi.
Prilagodite pozive in veščine. Pozivi, veščine in navodila v repozitoriju naj bodo usklajeni glede tega, kaj naj model izdela, kaj lahko stori samostojno in kdaj je delo končano.
Ohranite pravo smer pri dolgotrajnem delu. Za obravnavo sprememb in samostojnega dela uporabite usmerjanje(odpre se v novem oknu), asinhrona orodja(odpre se v novem oknu) in delegiranje(odpre se v novem oknu). Jasno določite, kdaj naj vas model prosi za navodila.
Pred uvedbo opravite nekaj preverjanj in vzpostavite dobre prakse.
Mislite na učinkovitost. (odpre se v novem oknu)Odstranite kontekst, ki za nalogo ni potreben(odpre se v novem oknu), in ohranite potrebne dokaze. Kjer aplikacija to podpira, neodvisne naloge izvajajte hkrati(odpre se v novem oknu), da počasen korak ne zadrži nepovezanega dela.
Pri ponavljajočem se delu znova uporabite skupni kontekst s predpomnjenjem pozivov(odpre se v novem oknu). Predpomnjeni vhodni žetoni stanejo do 95 % manj(odpre se v novem oknu) kot nepredpomnjeni, odvisno od modela. Stalna navodila in referenčno gradivo postavite pred spremenljive podrobnosti naloge, definicije orodij pa ohranjajte dosledne. Nadzorna plošča za predpomnjenje(odpre se v novem oknu) in diagnostični vodnik(odpre se v novem oknu) vam pomagata ugotoviti, kje ponovna uporaba odpove. Pri oceni stroškov celotnega poteka dela upoštevajte zapisovanje v predpomnilnik in morebitne tarife za dolg kontekst.
Pri daljših pogovorih kompaktiranje(odpre se v novem oknu) zmanjša obseg konteksta, hkrati pa ohrani stanje, potrebno za nadaljevanje.
Določite, kako boste spremljali vedenje(odpre se v novem oknu), in preglejte možnosti nadzora nad podatki(odpre se v novem oknu) za svojo aplikacijo.
Pred uvedbo testirajte: izvedite reprezentativne naloge ter izmerite uspešnost, zakasnitev in stroške na uspešno opravljeno nalogo. Oglejte si naš kontrolni seznam za uvedbo API-ja(odpre se v novem oknu).
Pri izbiri modela in ravni sklepanja iščite ravnovesje med inteligenco in ceno.
Model:
GPT‑6 Astra(odpre se v novem oknu) za najzahtevnejše sklepanje, kjer je potrebna največja inteligenca.
GPT‑6.1 Sol(odpre se v novem oknu) za zahtevno programiranje, raziskovanje in uporabo računalnika.
GPT‑6 Luna(odpre se v novem oknu) za ozko opredeljene naloge v velikem obsegu in vsakodnevno, ponavljajoče se delo z jasnim ciljem, kot so izluščevanje polj iz računov, razvrščanje zahtev ali priprava strukturiranih povzetkov.
Pri izbiri najboljšega modela za nalogo primerjajte cene(odpre se v novem oknu) posameznih modelov.
Raven sklepanja: V API-ju izberite, koliko truda naj model vloži v nalogo.
Nizko: rutinske naloge, kot so izluščevanje dejstev ali manjši popravki.
Srednje: delo, ki zahteva presojo, kot sta načrtovanje funkcije ali primerjava možnosti.
Visoko: zahtevno odpravljanje napak, poglobljena analiza ali temeljit pregled.
Zelo visoko / Najvišje: kjer sta podprti, ju preizkusite, če raven Visoko ne zadostuje. Ohranite ju le, če izboljšanje upraviči dodatni čas in stroške.
V API-ju lahko med pogovorom spremenite intenzivnost sklepanja(odpre se v novem oknu), ne da bi prekinili uporabo predpomnilnika.
V Codex začnite s privzeto ravnjo sklepanja za izbrani model, nato jo znižajte za preprostejše naloge ali zvišajte za poglobljeno analizo.
Hitrost:
V API-ju uporabite hitri način(odpre se v novem oknu), kadar je odzivni čas pomemben, na primer v aplikacijah za klepet ali programerskih orodjih. Zagotavlja krajše in bolj predvidljive odzivne čase, vendar z višjimi stroški na žeton kot standardna obdelava.
V Codex in API-ju uporabite izjemno hitri način(odpre se v novem oknu), kadar so hitrejši odzivi vredni doplačila, na primer pri hitrem iterativnem programiranju. Pospeši ustvarjanje žetonov neodvisno od intenzivnosti sklepanja. Na voljo za GPT‑6 Astra(odpre se v novem oknu).

—Eric Provencher, izkušnja razvijalcev pri OpenAI
Začnite z jasno opredeljeno nalogo: navedite želeni rezultat, komu je namenjen, ustrezen kontekst in omejitve ter merila za dokončanje. Za temeljitejšo posodobitev navodil nato preglejte ta štiri področja, povzeta po članku Nov razmislek o veščinah in pozivih za GPT‑6 Astra(odpre se v novem oknu):
Ustvarite boljše veščine: Opisi naj bodo kratki in naj jasno povedo, kdaj naj se posamezna veščina izvede. Dodatne podrobnosti naložite le po potrebi, toga navodila pa nadomestite s smernicami, prilagojenimi modelom, ki jih uporablja vaša ekipa.
Posodobite AGENTS.md: Pojasnite, kdaj so posamezni dokumenti in testi pomembni, ter izrecno dovolite varne rutinske poteke dela, kot je izvajanje lokalnih testov z začasnimi podatki in brez dostopa do produkcije.
Določite meje odločanja: Navedite, katera dejanja se lahko izvajajo samostojno in katera zahtevajo odobritev. Splošna pravila »vedno vprašaj« nadomestite z jasnimi mejami.
Jasno določite, kako vztrajno naj model dela: Opredelite, kaj pomeni »končano« – uvedbo spremembe, zagon, pregled rezultata in odpravo napak – ter navedite odločitve, ki jih morate pregledati.
Za dodatna navodila si oglejte dobre prakse za sklepanje(odpre se v novem oknu).
Ne glede na to, ali delate v Codex ali razvijate z API-jem, določite, katere odločitve lahko sprejme model, kdaj naj vas prosi za navodila in kakšen naj bo uporaben odgovor.
Modelu dajte dovolj usmeritev, da lahko nadaljuje delo brez ugibanja pri pomembnih odločitvah. (odpre se v novem oknu)Povejte mu, kaj lahko odloči sam in kdaj naj vas prosi za navodila(odpre se v novem oknu). Lahko na primer sam izbere strukturo povzetka, pred spremembo obsega projekta pa naj se posvetuje z vami. (odpre se v novem oknu)Opišite, kakšen naj bo uporaben odgovor(odpre se v novem oknu): na primer razumljiv jezik, tehnične podrobnosti, prilagojene občinstvu, in kratko zaključno poročilo o spremembah, opravljenih preverjanjih in tem, čemu je še treba posvetiti pozornost.
Z družino modelov GPT‑6 se lahko zdaj lotite nalog, ki trajajo več ur ali dni. Za boljše upravljanje agentov pri dolgotrajnih nalogah uporabite naslednje funkcije.
V API-ju uporabite usmerjanje, asinhrona orodja in vzporedno delo, da dolgotrajne naloge nemoteno napredujejo.
Posodobite navodila med izvajanjem: Usmerjanje med potezo(odpre se v novem oknu) omogoča, da prek API-ja Responses WebSocket(odpre se v novem oknu) pošljete popravek, medtem ko model dela. Posodobitve se uvrstijo v čakalno vrsto; ne prekinejo orodij, ki se izvajajo, in ne razveljavijo že opravljenih dejanj.
Nadaljujte delo med izvajanjem orodja: Asinhrono klicanje orodij(odpre se v novem oknu) modelu omogoča, da nadaljuje neodvisno delo, medtem ko aplikacija izvaja počasnejšo nalogo, na primer teste. Aplikacija vrne rezultat, ko je pripravljen. Preden začnete delo, ki je odvisno od tega rezultata, počakajte nanj.
Delegirajte neodvisne podnaloge: GPT‑6.1 Sol podpira poteke dela z več agenti v API-ju Responses(odpre se v novem oknu). Podagentom lahko dodeli neodvisno delo, kot je preučevanje različnih delov zbirke kode, in njihove ugotovitve združi v končni odgovor. Delo z več agenti je trenutno v različici beta.
Pri dolgotrajnih nalogah se lahko pojavijo odločitve, ki jih v začetnem pozivu ne bi nujno predvideli. S pojasnili in usmerjanjem ohranjajte delo na pravi poti.
Odgovarjajte na vprašanja med delom: Z modelom GPT‑6 Astra lahko Codex med delom prosi za pojasnila(odpre se v novem oknu). Razrešite vprašanja, ki vplivajo na naslednji korak, in določite, katero neodvisno delo se lahko nadaljuje, medtem ko se odločate. Če boste odsotni, orodju Codex povejte, katere naloge lahko nadaljuje in kdaj naj počaka na vaš odgovor.
Preusmerite delo, ko se zahteve spremenijo: Usmerite aktivno nalogo(odpre se v novem oknu) z novimi informacijami in pojasnite, kaj naj se spremeni in kaj naj ostane enako. Tako se izognete dodatni porabi časa za pristop, ki ne ustreza več vašim potrebam.

Uporaba računalnika(odpre se v novem oknu) modelom GPT‑6 Astra, GPT‑6.1 Sol in GPT‑6 Luna omogoča neposredno upravljanje spletnih mest in namiznih aplikacij, tudi tistih brez API-ja. Modelu lahko na primer naročite, naj razišče napako, popravi kodo in odpre vaš izdelek v brskalniku, da preveri, ali popravek deluje.
Za vsak korak izberite najpreprostejši zanesljiv način:
Uporabite API ali povezano orodje, kadar lahko nalogo opravi neposredno.
Funkcijo uporabe računalnika uporabite, kadar mora model za vas prebrati zaslon, klikniti gumbe ali izpolniti obrazec.
Če uporabo računalnika vgrajujete v svojo aplikacijo, modelu zagotovite orodje, ki lahko izvaja kodo za upravljanje brskalnika ali namizja. Playwright deluje z brskalniki(odpre se v novem oknu), PyAutoGUI pa z namiznimi aplikacijami.



