Vodič kroz obitelj modela GPT‑6
Praktični savjeti za najbolje rezultate uz modele GPT‑6, uz kontrolu vremena i troškova
GPT‑6 je naš dosad najnapredniji skup modela, koji vam nudi izbor modela za različite vrste rada.
Bilo da ideju pretvarate u funkcionalni prototip, razvijate i testirate značajku ili koordinirate višekoračne radne procese u repozitorijima koda, bazama podataka i vanjskim API-jima, ovaj vodič objašnjava kako odabrati model GPT‑6, dati mu učinkovite upute, upravljati dugotrajnim radom i pripremiti se za produkciju.

Radite učinkovito u produkciji. Upravljajte kontekstom i troškovima uz predmemoriranje(otvara se u novom prozoru) i sažimanje(otvara se u novom prozoru). Mjerite uspješnost zadataka i latenciju te planirajte nadzor i kontrole podataka.
Odaberite model prema vrsti posla. Uravnotežite sposobnosti, troškove i latenciju odabirom modela, razine rasuđivanja(otvara se u novom prozoru) i brzine koji odgovaraju zadatku.
Prilagodite upite i vještine. Uskladite upite, vještine i upute u repozitoriju: što model treba isporučiti, što smije raditi samostalno i kada je zadatak završen.
Usmjeravajte dugotrajan rad. Uz usmjeravanje(otvara se u novom prozoru), asinkrone alate(otvara se u novom prozoru) i delegiranje(otvara se u novom prozoru) upravljajte izmjenama i neovisnim radom. Jasno odredite kada model treba zatražiti vaš doprinos.
Prije puštanja u rad uspostavite nekoliko provjera i dobrih praksi.
Vodite računa o učinkovitosti. (otvara se u novom prozoru)Uklonite kontekst koji zadatku nije potreban(otvara se u novom prozoru), ali zadržite potrebne dokaze. Ako aplikacija to podržava, izvodite neovisne zadatke istodobno(otvara se u novom prozoru) kako jedan spor korak ne bi kočio nepovezan rad.
Za ponavljajuće poslove ponovno upotrijebite zajednički kontekst uz predmemoriranje upita(otvara se u novom prozoru). Predmemorirani ulazni tokeni stoje do 95 % manje(otvara se u novom prozoru) od nepredmemoriranih, ovisno o modelu. Stalne upute i referentne materijale stavite prije promjenjivih pojedinosti zadatka, a definicije alata održavajte dosljednima. Nadzorna ploča predmemoriranja(otvara se u novom prozoru) i dijagnostički vodič(otvara se u novom prozoru) pomažu otkriti gdje ponovna upotreba ne funkcionira. Pri procjeni troška cijelog radnog procesa uključite upise u predmemoriju i eventualne tarife za dugi kontekst.
U duljim razgovorima sažimanje(otvara se u novom prozoru) smanjuje veličinu konteksta, a čuva stanje potrebno za nastavak.
Odlučite kako ćete nadzirati ponašanje(otvara se u novom prozoru) i pregledajte kontrole podataka(otvara se u novom prozoru) za svoju aplikaciju.
Testirajte prije puštanja u rad: pokrenite reprezentativne zadatke i mjerite uspješnost, latenciju i trošak po uspješnom zadatku. Pogledajte naš kontrolni popis za uvođenje API-ja(otvara se u novom prozoru).
Izbor modela i razine rasuđivanja promatrajte kao kompromis između inteligencije i cijene.
Model:
GPT‑6 Astra(otvara se u novom prozoru) za najteže zadatke rasuđivanja koji zahtijevaju maksimalnu inteligenciju.
GPT‑6.1 Sol(otvara se u novom prozoru) za složeno programiranje, istraživanje i korištenje računala.
GPT‑6 Luna(otvara se u novom prozoru) za velik broj usko definiranih zadataka i svakodnevni ponavljajući rad s jasnim ciljem, poput izdvajanja polja s računa, razvrstavanja zahtjeva ili izrade strukturiranih sažetaka.
Pri odabiru najboljeg modela za zadatak usporedite cijene(otvara se u novom prozoru) svih modela.
Razina rasuđivanja: U API-ju odaberite koliko će truda model uložiti u zadatak.
Niska: rutinski zadaci, poput izdvajanja činjenica ili manjih izmjena.
Srednja: rad koji zahtijeva prosudbu, poput planiranja značajke ili usporedbe mogućnosti.
Visoka: zahtjevno otklanjanje pogrešaka, dublja analiza ili pomna provjera.
Vrlo visoka / Max: isprobajte gdje je podržano ako razina Visoka nije dovoljna, a zadržite samo ako poboljšanje opravdava dodatno vrijeme i trošak.
U API-ju možete promijeniti razinu rasuđivanja tijekom razgovora(otvara se u novom prozoru) bez narušavanja predmemorije.
U Codexu počnite sa zadanom razinom rasuđivanja za taj model, pa je smanjite za jednostavnije zadatke ili povećajte za dublju analizu.
Brzina:
U API-ju koristite Brzi način rada(otvara se u novom prozoru) kada je vrijeme odziva važno, primjerice u aplikacijama za razgovor ili programerskim alatima. Omogućuje brži i ujednačeniji odziv uz višu cijenu po tokenu nego standardna obrada.
U Codexu i API-ju koristite Ultrabrzi način rada(otvara se u novom prozoru) kada brži odgovori vrijede više cijene, primjerice pri brzim iteracijama koda. Ubrzava generiranje tokena neovisno o razini rasuđivanja. Dostupno za GPT‑6 Astra(otvara se u novom prozoru).

— Eric Provencher, tim za iskustvo razvojnih programera u OpenAI-ju
Počnite jasnim zadatkom: navedite željeni rezultat, kome je namijenjen, relevantan kontekst i ograničenja te uvjete za završetak. Zatim proučite ova četiri područja, sažeta iz članka Novi pristup vještinama i upitima za GPT‑6 Astra(otvara se u novom prozoru), da biste bolje razumjeli kako ažurirati upute:
Izradite bolje vještine: U kratkim opisima jasno navedite kada treba pokrenuti koju vještinu, dodatne pojedinosti učitavajte samo po potrebi, a krute postupke zamijenite smjernicama prilagođenima modelima koje vaš tim koristi.
Ažurirajte AGENTS.md: Objasnite kada su određeni dokumenti i testovi relevantni te izričito dopustite sigurne rutinske procese, poput lokalnih testova s jednokratnim podacima i bez pristupa produkciji.
Postavite granice odlučivanja: Navedite koje radnje model smije obavljati samostalno, a za koje treba odobrenje. Opća pravila poput „uvijek pitaj” zamijenite jasnim granicama.
Jasno propišite ustrajnost: Definirajte što znači „završeno” — provedbu izmjene, pokretanje, provjeru rezultata i ispravljanje pogrešaka — te navedite odluke koje morate pregledati.
Dodatne smjernice potražite u dobrim praksama za rasuđivanje(otvara se u novom prozoru).
Bilo da radite u Codexu ili razvijate uz API, navedite koje odluke model smije donositi, kada treba zatražiti vaš doprinos i kako izgleda koristan odgovor.
Dajte modelu dovoljno smjernica da nastavi raditi bez nagađanja pri važnim odlukama. (otvara se u novom prozoru)Recite mu što može sam odlučiti i kada treba zatražiti vaš doprinos(otvara se u novom prozoru). Primjerice, može odabrati kako organizirati sažetak, ali treba se posavjetovati s vama prije promjene opsega projekta. (otvara se u novom prozoru)Opišite kako izgleda koristan odgovor(otvara se u novom prozoru): primjerice, jednostavan jezik, tehničke pojedinosti prilagođene publici i kratko završno izvješće o tome što je promijenjeno, što je provjereno i čemu još treba posvetiti pozornost.
Uz obitelj modela GPT‑6 sada možete obavljati zadatke koji traju satima ili danima. Sljedeće značajke pomažu vam bolje upravljati agentima na dugotrajnim zadacima.
U API-ju koristite usmjeravanje, asinkrone alate i paralelan rad kako bi dugotrajni zadaci napredovali.
Ažurirajte upute tijekom izvršavanja: Usmjeravanje tijekom poteza(otvara se u novom prozoru) omogućuje slanje ispravka putem Responses WebSocket API-ja(otvara se u novom prozoru) dok model radi. Izmjene se stavljaju u red čekanja; ne prekidaju pokrenute alate niti poništavaju dovršene radnje.
Nastavite rad dok se alat izvršava: Asinkrono pozivanje alata(otvara se u novom prozoru) omogućuje modelu da nastavi neovisan rad dok aplikacija izvršava sporiji zadatak, poput testova. Aplikacija vraća rezultat kada je spreman. Pričekajte taj rezultat prije nego što započnete rad koji ovisi o njemu.
Delegirajte neovisne podzadatke: GPT‑6.1 Sol podržava radne procese s više agenata u Responses API-ju(otvara se u novom prozoru). Može dodijeliti neovisan rad podagentima, primjerice istraživanje različitih dijelova baze koda, i objediniti njihove nalaze u konačan odgovor. Rad s više agenata trenutačno je u beta fazi.
Tijekom dugotrajnih zadataka mogu se pojaviti odluke koje niste nužno mogli predvidjeti u početnom upitu. Pojašnjenjima i usmjeravanjem održavajte rad na pravom putu.
Odgovarajte na pitanja tijekom rada: Uz GPT‑6 Astra Codex može tražiti pojašnjenja dok radi(otvara se u novom prozoru). Razriješite pitanja koja utječu na sljedeći korak i navedite koji se neovisni poslovi mogu nastaviti dok odlučujete. Ako ćete biti odsutni, recite Codexu koje zadatke može nastaviti i kada treba zastati te pričekati vaš odgovor.
Preusmjerite rad kada se zahtjevi promijene: Usmjerite aktivni zadatak(otvara se u novom prozoru) novim informacijama i objasnite što treba promijeniti, a što treba ostati isto. Tako izbjegavate daljnje trošenje vremena na pristup koji više ne odgovara vašim potrebama.

Korištenje računala(otvara se u novom prozoru) omogućuje modelima GPT‑6 Astra, GPT‑6.1 Sol i GPT‑6 Luna izravnu interakciju s web-stranicama i aplikacijama za računalo, čak i onima bez API-ja. Primjerice, možete zatražiti od modela da istraži pogrešku, ispravi kod i otvori vaš proizvod u pregledniku kako bi provjerio funkcionira li ispravak.
Za svaki korak odaberite najjednostavniji pouzdan način:
Upotrijebite API ili povezani alat kada može izravno obaviti posao.
Odaberite korištenje računala kada model treba pročitati sadržaj zaslona, kliknuti gumbe ili ispuniti obrazac umjesto vas.
Ako korištenje računala ugrađujete u vlastitu aplikaciju, dajte modelu alat koji može izvršavati kod za upravljanje preglednikom ili radnom površinom. Playwright radi s preglednicima(otvara se u novom prozoru), a PyAutoGUI s aplikacijama za računalo.



