Vodič kroz porodicu modela GPT‑6
Praktični savjeti za najbolje rezultate s GPT‑6 modelima uz upravljanje vremenom i troškovima
GPT‑6 je naš dosad najnapredniji skup modela i nudi vam izbor modela za različite vrste poslova.
Bilo da ideju pretvarate u funkcionalan prototip, razvijate i testirate funkcionalnost ili koordinirate višekoračne radne tokove kroz repozitorije koda, baze podataka i vanjske API-je, ovaj vodič objašnjava kako odabrati GPT‑6 model, dati mu djelotvorne upute, upravljati dugotrajnim radom i pripremiti se za produkciju.

Radite efikasno u produkciji. Koristite keširanje(otvara se u novom prozoru) i kompakciju(otvara se u novom prozoru) za upravljanje kontekstom i troškovima. Mjerite uspješnost zadataka i latenciju te planirajte nadzor i kontrole podataka.
Odaberite model prema vrsti posla. Uravnotežite sposobnosti, troškove i latenciju izborom modela, intenziteta rezonovanja(otvara se u novom prozoru) i brzine koji odgovaraju zadatku.
Prilagodite upite i vještine. Uskladite upite, vještine i upute u repozitoriju o tome šta model treba isporučiti, šta može raditi samostalno i kada se posao smatra završenim.
Održavajte dugotrajan rad na pravom putu. Koristite usmjeravanje(otvara se u novom prozoru), asinhrone alate(otvara se u novom prozoru) i delegiranje(otvara se u novom prozoru) za upravljanje izmjenama i nezavisnim radom. Jasno odredite kada model treba tražiti vaše mišljenje.
Prije puštanja u rad uvedite nekoliko provjera i dobrih praksi.
Vodite računa o efikasnosti. Uklonite kontekst koji nije potreban za zadatak(otvara se u novom prozoru), ali zadržite potrebne dokaze. Ako aplikacija to podržava, izvršavajte nezavisne zadatke paralelno(otvara se u novom prozoru) kako jedan spor korak ne bi zadržavao nepovezane poslove.
Za ponavljajuće poslove iznova koristite zajednički kontekst putem keširanja promptova(otvara se u novom prozoru). Keširani ulazni tokeni koštaju do 95% manje(otvara se u novom prozoru) od nekeširanih, zavisno od modela. Stalne upute i referentne materijale stavite ispred promjenjivih detalja zadatka, a definicije alata održavajte dosljednim. Kontrolna ploča za keširanje(otvara se u novom prozoru) i vodič za dijagnostiku(otvara se u novom prozoru) pomažu vam da otkrijete gdje ponovna upotreba konteksta ne uspijeva. Pri procjeni troška cijelog radnog toka uračunajte upise u keš i sve tarife za dugi kontekst.
U dužim razgovorima kompakcija(otvara se u novom prozoru) smanjuje kontekst uz očuvanje stanja potrebnog za nastavak.
Odlučite kako ćete pratiti ponašanje(otvara se u novom prozoru) i pregledajte kontrole podataka(otvara se u novom prozoru) za svoju aplikaciju.
Testirajte prije puštanja u rad: izvršite reprezentativne zadatke i mjerite uspješnost, latenciju i trošak po uspješnom zadatku. Pogledajte našu kontrolnu listu za puštanje u rad putem API-ja(otvara se u novom prozoru).
Izbor modela i nivoa rezonovanja posmatrajte kao kompromis između inteligencije i cijene.
Model:
GPT‑6 Astra(otvara se u novom prozoru) za najzahtjevnije zadatke rezonovanja kojima je potrebna maksimalna inteligencija.
GPT‑6.1 Sol(otvara se u novom prozoru) za složeno programiranje, istraživanje i korištenje računara.
GPT‑6 Luna(otvara se u novom prozoru) za usko definirane zadatke velikog obima i svakodnevne, ponavljajuće poslove s jasnim ciljem, poput izdvajanja polja iz faktura, klasifikacije zahtjeva ili izrade strukturiranih sažetaka.
Pri izboru najboljeg modela za zadatak uporedite cijene(otvara se u novom prozoru) svih modela.
Nivo rezonovanja: U API-ju odaberite koliko truda model ulaže u zadatak.
Niska: Rutinski zadaci, poput izdvajanja činjenica ili manjih izmjena.
Srednja: Poslovi koji traže prosuđivanje, poput planiranja funkcionalnosti ili poređenja opcija.
Visoka: Teško otklanjanje grešaka, dublja analiza ili pažljiv pregled.
Veoma visoka / Max: Testirajte gdje je podržano ako postavka Visoka nije dovoljna, a zadržite samo ako poboljšanje opravdava dodatno vrijeme i trošak.
U API-ju možete promijeniti intenzitet rezonovanja tokom razgovora(otvara se u novom prozoru) bez narušavanja keša.
U Codexu počnite s podrazumijevanim nivoom rezonovanja za taj model, pa ga smanjite za jednostavnije zadatke ili povećajte za dublju analizu.
Brzina:
U API-ju koristite Brzi mod(otvara se u novom prozoru) kada je vrijeme odziva važno, npr. u aplikacijama za razgovor ili alatima za programiranje. Pruža brži i ujednačeniji odziv uz višu cijenu po tokenu nego standardna obrada.
U Codexu i API-ju koristite Ultrabrzi mod(otvara se u novom prozoru) kada brži odgovori opravdavaju višu cijenu, npr. pri brzim iteracijama u programiranju. On ubrzava generiranje tokena nezavisno od intenziteta rezonovanja. Dostupno za GPT‑6 Astra(otvara se u novom prozoru).

—Eric Provencher, tim za iskustvo programera u kompaniji OpenAI
Počnite jasnim zadatkom: navedite željeni rezultat, kome je namijenjen, relevantni kontekst i ograničenja te kada se posao smatra završenim. Zatim razmotrite ove četiri oblasti, sažete iz teksta Novi pristup vještinama i upitima za GPT‑6 Astra(otvara se u novom prozoru), za detaljniji uvid u ažuriranje uputa:
Kreirajte bolje vještine: U kratkim opisima jasno navedite kada se svaka vještina pokreće, učitavajte dodatne detalje samo po potrebi i zamijenite krute postupke smjernicama prilagođenim modelima vašeg tima.
Ažurirajte AGENTS.md: Objasnite kada su pojedini dokumenti i testovi relevantni te izričito odobrite sigurne rutinske radne tokove, poput lokalnih testova s privremenim podacima i bez pristupa produkciji.
Postavite granice odlučivanja: Navedite koje se radnje mogu obavljati samostalno, a koje traže odobrenje. Opća pravila poput „uvijek pitaj“ zamijenite jasnim granicama.
Jasno odredite koliko treba istrajati: Definirajte šta znači „završeno“ — implementirati izmjenu, pokrenuti je, pregledati rezultat i otkloniti greške — te navedite odluke koje morate pregledati.
Za dodatne smjernice pogledajte najbolje prakse za rezonovanje(otvara se u novom prozoru).
Bilo da radite u Codexu ili razvijate uz API, navedite koje odluke model može donijeti, kada treba tražiti vaše mišljenje i kako izgleda koristan odgovor.
Dajte modelu dovoljno smjernica da nastavi rad bez nagađanja pri važnim odlukama. Recite mu koje odluke može donositi i kada treba tražiti vaše mišljenje(otvara se u novom prozoru). Naprimjer, može odabrati kako će organizirati sažetak, ali prije promjene obima projekta treba se konsultovati s vama. Opišite kako izgleda koristan odgovor(otvara se u novom prozoru), naprimjer: jednostavan jezik, tehnički detalji prilagođeni publici i kratak završni pregled izmjena, izvršenih provjera i onoga što još zahtijeva pažnju.
Uz porodicu modela GPT‑6 sada možete preuzeti zadatke koji traju satima ili danima. Koristite sljedeće funkcionalnosti za bolje upravljanje agentima na dugotrajnim zadacima.
U API-ju koristite usmjeravanje, asinhrone alate i paralelan rad kako bi dugotrajni zadaci stalno napredovali.
Ažurirajte upute tokom izvršavanja: Usmjeravanje tokom obrade(otvara se u novom prozoru) omogućava vam da pošaljete korekciju putem Responses WebSocket API-ja(otvara se u novom prozoru) dok model radi. Izmjene se stavljaju u red čekanja; ne otkazuju pokrenute alate niti poništavaju završene radnje.
Nastavite rad dok se alat izvršava: Asinhrono pozivanje alata(otvara se u novom prozoru) omogućava modelu da nastavi nezavisan rad dok vaša aplikacija izvršava sporiji zadatak, poput testova. Aplikacija vraća rezultat kada bude spreman. Sačekajte taj rezultat prije nego što započnete posao koji zavisi od njega.
Delegirajte nezavisne podzadatke: GPT‑6.1 Sol podržava radne tokove s više agenata u Responses API-ju(otvara se u novom prozoru). Može dodijeliti nezavisne poslove podagentima (poput istraživanja različitih dijelova baze koda) i objediniti njihove nalaze u konačan odgovor. Rad s više agenata trenutno je u beta fazi.
Tokom dugotrajnih zadataka mogu se pojaviti odluke koje niste mogli predvidjeti u početnom upitu. Koristite pojašnjenja i usmjeravanje kako bi rad ostao na pravom putu.
Odgovarajte na pitanja kako rad napreduje: Uz GPT‑6 Astra, Codex može tražiti pojašnjenja dok radi(otvara se u novom prozoru). Razriješite pitanja koja utiču na sljedeći korak i navedite koji se nezavisni poslovi mogu nastaviti dok odlučujete. Ako ćete biti odsutni, recite Codexu koje zadatke može nastaviti i kada treba zastati da sačeka vaš odgovor.
Preusmjerite rad kada se zahtjevi promijene: Usmjerite aktivni zadatak(otvara se u novom prozoru) novim informacijama i objasnite šta treba promijeniti, a šta treba ostati isto. Tako izbjegavate dodatno trošenje vremena na pristup koji više ne odgovara vašim potrebama.

Korištenje računara(otvara se u novom prozoru) omogućava modelima GPT‑6 Astra, GPT‑6.1 Sol i GPT‑6 Luna da direktno rade s web-stranicama i desktop aplikacijama, čak i onima bez API-ja. Naprimjer, možete tražiti od modela da istraži grešku, ispravi kôd i otvori vaš proizvod u pregledniku da provjeri radi li ispravka.
Za svaki korak odaberite najjednostavniji pouzdan način:
Koristite API ili povezani alat kada može direktno obaviti posao.
Koristite mogućnost korištenja računara kada model treba pročitati sadržaj ekrana, kliknuti dugmad ili popuniti obrazac za vas.
Ako u svoju aplikaciju ugrađujete mogućnost korištenja računara, dajte modelu alat koji može izvršavati kôd za upravljanje preglednikom ili radnom površinom. Playwright radi s preglednicima(otvara se u novom prozoru); PyAutoGUI radi s desktop aplikacijama.



