Započinjemo ograničeni pregled serije GPT‑5.6: Sol, naš vodeći model; Terra, uravnotežen model za svakodnevni rad; i Luna, brz i cjenovno pristupačan model. Terra ima konkurentne performanse u odnosu na GPT‑5.5, uz dvostruko nižu cijenu, a Luna donosi snažne sposobnosti po našoj najnižoj cijeni.
GPT‑5.6 Sol pokreće se s našim dosad najrobusnijim sigurnosnim slojem. Pojačali smo zaštitu za aktivnosti višeg rizika, osjetljive kibernetičke zahtjeve i ponovljenu zloupotrebu te smo više tjedana tražili slabosti, testirali sustav pod pritiskom i učvršćivali ga protiv napada iz stvarnog svijeta.
Vjerujemo u širok pristup i planiramo GPT‑5.6 Sol, Terra i Luna učiniti općenito dostupnima u sljedećim tjednima. U sklopu naše stalne suradnje s vladom SAD-a, prije današnjeg pokretanja predstavili smo svoje planove i sposobnosti modela. Na njihov zahtjev počinjemo s ograničenim pregledom za malu skupinu pouzdanih partnera čije je sudjelovanje podijeljeno s vladom, prije šireg objavljivanja. Tijekom ovog pregleda nastavit ćemo testirati i usko koordinirati s partnerima dok radimo na široj dostupnosti. Ne vjerujemo da bi ovakav postupak pristupa za vladu trebao postati dugoročna zadana praksa. Time se najbolji alati uskraćuju korisnicima, razvojnim programerima, organizacijama, sigurnosnim stručnjacima i globalnim partnerima kojima su potrebni. Ovaj kratkoročni korak poduzimamo jer vjerujemo da je to najjači put prema široj dostupnosti u sljedećim tjednima, dok s administracijom radimo na okviru kibernetičke izvršne uredbe i ponovljivom postupku za buduća izdanja modela.
GPT‑5.6 Sol naš je najsnažniji model dosad. Kako bismo dali uvid u performanse modela, dijelimo skup evaluacija koje ističu poboljšane agentske sposobnosti u kodiranju, biologiji i kibernetičkoj sigurnosti, uz dodatne evaluacije sigurnosti i pripravnosti dostupne u našem dokumentu o sustavu(otvara se u novom prozoru). Prošireni skup rezultata evaluacija podijelit ćemo kada model učinimo široko dostupnim.
S GPT‑5.6 uvodimo novi napor rasuđivanja `max` kako bismo Solu dali najviše vremena za duboko rasuđivanje. Osim toga, uvodimo novi način rada `ultra` koji nadilazi sposobnosti jednog agenta tako što iskorištava podagente za ubrzavanje složenog rada.
Za tijekove rada u kodiranju GPT‑5.6 Sol postavlja novo najviše mjerilo na Terminal‑Bench 2.1, koji testira tijekove rada u naredbenom retku koji zahtijevaju planiranje, iteraciju i koordinaciju alata.
GPT‑5.6 Sol pokazuje i široka poboljšanja u biološkim tijekovima rada. Na GeneBench v1, koji evaluira dugoročne analize genomike i kvantitativne biologije, postiže jače rezultate od GPT‑5.5 uz manje tokena.
GPT‑5.6 Sol naš je dosad najsposobniji model za kibernetičku sigurnost. Pomiče granicu omjera performansi i učinkovitosti za dugotrajne sigurnosne zadatke, uključujući istraživanje ranjivosti i eksploataciju. Na ExploitBench² GPT‑5.6 Sol konkurentan je modelu Mythos Preview koristeći samo oko 1/3 izlaznih tokena. Na ExploitGymu(otvara se u novom prozoru)3, referentnom testu koji su izradili istraživači s UC Berkeleyja u suradnji s OpenAI-jem i drugim vodećim AI laboratorijima, modeli GPT‑5.6 Sol, Terra i Luna pokazuju snažna poboljšanja kibernetičkih sposobnosti kako povećavamo rasuđivanje.
GPT‑5.6 Sol, Terru i Lunu razvili smo s našim dosad najrobusnijim zaštitnim mjerama, uz konfiguracije usklađene sa sposobnostima svakog modela. Kako model postaje sposobniji, zaštitne mjere oblikujemo tako da sve bolje izdrže stvarni protivnički pritisak, uz očuvanje pristupa legitimnom radu kao što su pregled koda, istraživanje ranjivosti, razvoj zakrpa, otklanjanje pogrešaka, sigurnosna edukacija i obrambeno testiranje. Cilj nam je zabranjene napadačke aktivnosti učiniti težima, neizvjesnijima i uočljivijima, bez nepotrebnog ograničavanja tih korisnih primjena. Na temelju naše procjene modela i zaštitnih mjera očekujemo znatnu korist za legitiman obrambeni rad, uz smisleno ograničavanje zabranjenih napadačkih aktivnosti.
GPT‑5.6 Sol bolji je u pomaganju ljudima da pronađu i poprave ranjivosti nego u pouzdanom izvođenju napada od početka do kraja. Kako te sposobnosti postaju naprednije, prioritet nam je osigurati da dođu do sigurnosnih stručnjaka i koriste im, kako bi tim alatima mogli pronalaziti slabosti, razvijati zakrpe i šire jačati sustave.
GPT‑5.6 Sol ne prelazi prag Cyber Critical prema našem Okviru pripravnosti. U evaluacijama koje su uključivale Chromium i Firefox identificirao je bugove i primitive za eksploataciju – gradivne elemente eksploita – ali u testiranim uvjetima nije autonomno proizveo funkcionalan eksploit punog lanca. Ipak, pragovi referentnih testova ne mogu obuhvatiti svaki način na koji se model može koristiti ili kombinirati s drugim alatima. Ta neizvjesnost, zajedno sa širim iskorakom u sposobnostima modela, razlog je zašto povećane sposobnosti modela povezujemo sa snažnijim zaštitnim mjerama i postupnim izdavanjem. Više pojedinosti o našim zaštitnim mjerama dijelimo u dokumentu o sustavu za pregled GPT‑5.6(otvara se u novom prozoru).
Nijedna pojedinačna zaštitna mjera nije dovoljna protiv odlučne ili prilagodljive zloupotrebe. Tijekom pregleda GPT‑5.6 koristimo slojevite zaštitne mjere, s točnim konfiguracijama koje se razlikuju među modelima, i testiramo ih pod pritiskom napada iz stvarnog svijeta. One uključuju zaštite ugrađene treniranjem u model, provjere u stvarnom vremenu tijekom generiranja, signale na razini računa, diferencirani pristup, nadzor, provedbu pravila i kontinuirano testiranje.
GPT‑5.6 treniran je da odbije zabranjenu kibernetičku pomoć, uključujući situacije kada korisnici pokušavaju prikriti namjeru ili jailbreakati model. Te zaštitne mjere na razini modela uspostavljaju prvu granicu oko toga u čemu model treba, a u čemu ne treba pomagati.
Klasifikatori za zloupotrebu u kibernetičkoj sigurnosti i biologiji u stvarnom vremenu pružaju dodatni sloj evaluiranjem izlaza dok se generira. U slučajevima višeg rizika, ako otkriju moguće kršenje, generiranje se može pauzirati dok veći model za rasuđivanje pregledava razgovor i njegov kontekst. Ako se izlaz procijeni nedopuštenim, zadržava se prije nego što dođe do korisnika.
Označena aktivnost može pokrenuti i pregled na razini računa kroz relevantne razgovore i signale rizika, u skladu s našim uvjetima i pravilima o zadržavanju i pregledu sadržaja. Pogled izvan jednog razgovora pomaže našim sustavima razlikovati ustrajno zlonamjerno ponašanje od legitimnog sigurnosnog rada dvojne namjene, u kojem se slični tehnički pojmovi mogu pojaviti u vrlo različitim kontekstima.
Zajedno ti slojevi čine cjelokupni pristup robusnijim od bilo koje pojedinačne zaštitne mjere. Ponašanje modela smanjuje vjerojatnost štetnih odgovora, sustavi u stvarnom vremenu mogu intervenirati tijekom generiranja, pregled na razini računa može prepoznati šire obrasce, a diferencirani pristup čuva važan obrambeni rad bez toga da se najosjetljivije sposobnosti prema zadanim postavkama učine široko dostupnima.
Osobito tijekom pregleda, korisnici mogu naići na zaštitne mjere koje blokiraju ili odbijaju neke zahtjeve. Drugi zahtjevi mogu potrajati dulje jer se generiranje pauzira radi dodatnog pregleda. Zaštitne mjere povremeno mogu intervenirati u legitimnom radu, osobito u područjima dvojne namjene gdje obrambena i ofenzivna aktivnost u početku mogu izgledati slično.
To je dio onoga za što je pregled osmišljen. Želimo razumjeti ne samo ograničavaju li zaštitne mjere zloupotrebu, nego i mogu li legitimni korisnici i dalje pouzdano i učinkovito obavljati uobičajen rad. Povratne informacije tijekom pregleda pomoći će nam smanjiti nepotrebna blokiranja i kašnjenja, poboljšati način na koji zaštitne mjere tumače kontekst i stvoriti uglađenije iskustvo prije šireg izdanja.
S korisnicima iz poslovnog sektora radimo i na dugoročnijim pristupima – uključujući detekciju koja čuva privatnost, sigurnosne kontrole kojima upravljaju korisnici i pristup prilagođen riziku klijenta, korisnika ili radnog opterećenja – kako bismo unaprijedili sigurnost uz podršku poslovnim zahtjevima za privatnošću,
Zaštita koja djeluje samo na fiksni skup poznatih napada nije dovoljno robusna za napredni model.
Zato u sigurnost ulažemo više inteligencije i računalnih resursa nego ikad, koristeći vlastite modele kako bismo brže pronašli slabosti i poboljšali zaštitne mjere. Automatiziranom red-teamingu posvećenom pronalaženju univerzalnih jailbreakova namijenili smo više od 700.000 GPU sati ekvivalentnih A100: napada koji mogu funkcionirati u mnogim upitima ili kontekstima, a ne samo u jednom uskom okruženju. Usmjerenost na te teže, općenitije napade omogućila nam je da zaštitne mjere testiramo izvan fiksnog skupa poznatih neuspjeha. Omogućuje nam i da istražimo daleko više obrazaca napada nego što bi moglo pokriti samo ljudsko testiranje, ranije prepoznamo obrasce neuspjeha i skratimo put od pronalaska slabosti do njezina uklanjanja.
Uz automatizirani red-teaming, surađivali smo s vanjskim testerima na opsežnom red-teamingu koji provode ljudski stručnjaci, a koji će se nastaviti tijekom razdoblja pregleda. Ljudski red-teaming nadopunjuje automatizirani rad testiranjem zaštitnih mjera protiv kreativnih stručnjaka koji pokušavaju zloupotrijebiti model na načine koje naši sustavi možda ne bi predvidjeli.
Nijedna evaluacija ne može obuhvatiti svaku konfiguraciju proizvoda, višekoračni napad ili stvarni tijek rada. Zato održavamo postupak brzog odgovora kako bismo reproducirali, procijenili, odredili prioritet i otklonili novootkrivene jailbreakove, a zatim ih dodali u naše stalne evaluacije kako bismo ubuduće mogli testirati slične neuspjehe.
Tijekom pregleda modeli GPT‑5.6 u početku će biti dostupni putem API-ja i Codexa odabranoj skupini pouzdanih partnera i organizacija. Uskoro ih planiramo učiniti šire dostupnima korisnicima ChatGPT‑a, Codexa i API-ja.
U novom sustavu imenovanja uvedenom s GPT‑5.6 broj označava generaciju modela, dok Sol, Terra i Luna označavaju trajne razine sposobnosti koje mogu napredovati vlastitim ritmom. Ta obitelj zajedno korisnicima i razvojnim programerima pruža jasniji izbor prema inteligenciji, brzini i trošku.
GPT‑5.6 naplaćuje se po 1 mil. tokena za tri veličine modela: Sol je 5 USD za ulaz / 30 USD za izlaz; Terra 2,50 USD za ulaz / 15 USD za izlaz; a Luna 1 USD za ulaz / 6 USD za izlaz. GPT‑5.6 uvodi i predvidljivije predmemoriranje upita, uključujući podršku za izričite točke prekida predmemorije i minimalni vijek predmemorije od 30 minuta. Za GPT‑5.6 i kasnije modele, upisi u predmemoriju naplaćuju se po 1,25 puta višoj necachiranoj ulaznoj tarifi modela, dok čitanja iz predmemorije i dalje ostvaruju popust od 90 % za predmemorirani ulaz.
U srpnju pokrećemo i GPT‑5.6 Sol na Cerebrasu, s do 750 tokena u sekundi, donoseći korisnicima vrhunsku inteligenciju dosad nezabilježenom brzinom. Pristup će u početku biti ograničen na odabrane korisnike dok širimo kapacitete.
Veselimo se nastavku učenja tijekom ovog razdoblja pregleda i skorom približavanju modela GPT‑5.6 Sol, Terra i Luna većem broju ljudi.
1. Latenciju i trošak API-ja procjenjujemo promatrajući produkcijsko ponašanje svojih modela i simulirajući izvanmrežno. Te procjene uzimaju u obzir pojedinosti poziva alata, uzorkovane tokene i ulazne tokene. Rezultati u stvarnom svijetu mogu se znatno razlikovati i ovise o mnogim čimbenicima koji nisu obuhvaćeni našom simulacijom. Latenciju simuliramo pri velikim brzinama API-ja, a trošak prema redovitim cijenama API-ja.
2. Svi se modeli evaluiraju s pomoću API okvira ExploitBench s 5 početnih vrijednosti i kontinuitetom rasuđivanja.
3. ExploitGym smo pokrenuli na našem alfa API-ju, koji odgovore ispisuje brže od našeg javnog API-ja, a zatim smo rezultate preračunali kako bi odgovarali javnom API-ju. Pri preračunavanju latencija na brzine očekivane za naš javni API neke procijenjene latencije premašuju vremenska ograničenja od 2 h i 6 h, iako su u evaluacijskom pokretanju ispravno poštovana. Za veće brzine u vremenski osjetljivom radu nudimo prioritetnu obradu u API-ju i brzi način rada u Codexu.
4. Modeli bez prijavljenih izlaznih tokena, latencije ili troška prikazani su kao vodoravne točkaste linije.

