Započinjemo ograničeni pregled serije GPT‑5.6: Sol, naš glavni model; Terra, uravnotežen model za svakodnevni rad; i Luna, brz i pristupačan model. Terra ima konkurentne performanse u odnosu na GPT‑5.5, uz 2x nižu cijenu, a Luna donosi snažne sposobnosti po našem najnižem trošku.
GPT‑5.6 Sol se pokreće s našim najrobusnijim sigurnosnim slojem do sada. Pojačali smo zaštitu za aktivnosti višeg rizika, osjetljive kibernetičke zahtjeve i ponovljene zloupotrebe, te proveli više sedmica tražeći slabosti, testirajući sistem pod pritiskom i učvršćujući ga protiv napada iz stvarnog svijeta.
Vjerujemo u širok pristup i planiramo učiniti GPT‑5.6 Sol, Terra i Lunu općenito dostupnim u narednim sedmicama. U sklopu našeg kontinuiranog angažmana s vladom SAD-a, prije današnjeg lansiranja predstavili smo svoje planove i sposobnosti modela. Na njihov zahtjev, počinjemo s ograničenim pregledom za malu grupu pouzdanih partnera čije je učešće podijeljeno s vladom, prije šireg objavljivanja. Tokom ovog pregleda nastavit ćemo testiranje i blisku koordinaciju s partnerima dok radimo na široj dostupnosti. Ne vjerujemo da bi ova vrsta procesa vladinog pristupa trebala dugoročno postati podrazumijevana praksa. Time se najbolji alati uskraćuju korisnicima, programerima, preduzećima, kibernetičkim braniocima i globalnim partnerima kojima su potrebni. Ovaj kratkoročni korak poduzimamo jer vjerujemo da je to najsnažniji put do šire dostupnosti u narednim sedmicama, dok s Administracijom radimo na razvoju okvira kibernetičke izvršne uredbe i ponovljivog procesa za buduća izdanja modela.
GPT‑5.6 Sol je naš najjači model do sada. Kako bismo dali pregled performansi modela, dijelimo skup evaluacija koje ističu poboljšane agentske sposobnosti u kodiranju, biologiji i kibernetičkoj sigurnosti, uz dodatne evaluacije sigurnosti i pripravnosti dostupne u našoj kartici sistema(otvara se u novom prozoru). Prošireni skup rezultata evaluacije podijelit ćemo kada model učinimo široko dostupnim.
S GPT‑5.6 uvodimo novi napor rezonovanja `max`, kako bismo Solu dali najviše vremena za duboko rezonovanje. Uz to uvodimo novi način rada `ultra`, koji nadilazi sposobnosti jednog agenta koristeći podagente za ubrzavanje složenog rada.
Za radne tokove kodiranja, GPT‑5.6 Sol postavlja novo vrhunsko dostignuće na Terminal‑Bench 2.1, koji testira radne tokove komandne linije koji zahtijevaju planiranje, iteraciju i koordinaciju alata.
GPT‑5.6 Sol pokazuje i široka poboljšanja u biološkim radnim tokovima. Na GeneBench v1, koji evaluira dugoročne analize genomike i kvantitativne biologije, postiže jače rezultate od GPT‑5.5 uz korištenje manje tokena.
GPT‑5.6 Sol je naš najsposobniji model do sada za kibernetičku sigurnost. Pomiče granicu performansi i efikasnosti za dugoročne sigurnosne zadatke, uključujući istraživanje ranjivosti i eksploataciju. Na ExploitBenchu², GPT‑5.6 Sol je konkurentan s Mythos Preview koristeći samo oko 1/3 izlaznih tokena. Na ExploitGymu(otvara se u novom prozoru)3, benchmarku koji su kreirali istraživači s UC Berkeleyja u saradnji s OpenAI i drugim frontier laboratorijama, modeli GPT‑5.6 Sol, Terra i Luna pokazuju snažna poboljšanja kibernetičkih sposobnosti kako povećavamo rezonovanje.
GPT‑5.6 Sol, Terra i Lunu razvili smo s našim najrobusnijim zaštitnim mjerama do sada, uz konfiguracije usklađene sa sposobnostima svakog modela. Kako model postaje sposobniji, zaštitne mjere dizajniramo tako da sve bolje izdrže adversarijalni pritisak iz stvarnog svijeta, uz očuvanje pristupa legitimnom radu kao što su pregled koda, istraživanje ranjivosti, razvoj zakrpa, otklanjanje grešaka, sigurnosna edukacija i defanzivno testiranje. Naš cilj je učiniti zabranjene ofanzivne aktivnosti težim, neizvjesnijim i uočljivijim, bez nepotrebnog ograničavanja tih korisnih primjena. Na osnovu naše procjene modela i zaštitnih mjera, očekujemo znatnu korist za legitiman defanzivni rad, uz smisleno ograničavanje zabranjene ofanzivne upotrebe.
GPT‑5.6 Sol bolje pomaže ljudima da pronađu i poprave ranjivosti nego što pouzdano izvodi napade od početka do kraja. Kako ove sposobnosti nastavljaju napredovati, naš prioritet je osigurati da dođu do branilaca i njima koriste, kako bi tim alatima pronalazili slabosti, razvijali zakrpe i šire jačali sisteme.
GPT‑5.6 Sol ne prelazi prag Cyber Critical prema našem okviru Preparedness Framework. U evaluacijama koje su uključivale Chromium i Firefox, identificirao je greške i primitive eksploatacije — gradivne elemente exploita — ali u testiranim uslovima nije autonomno proizveo funkcionalan exploit punog lanca. Ipak, pragovi benchmarka ne mogu obuhvatiti svaki način na koji se model može koristiti ili kombinirati s drugim alatima. Ta neizvjesnost, zajedno sa širim skokovitim napretkom sposobnosti modela, razlog je što povećane sposobnosti modela uparujemo sa snažnijim zaštitnim mjerama i faznim objavljivanjem. Više detalja o našim zaštitnim mjerama dijelimo u kartici sistema GPT‑5.6 Preview(otvara se u novom prozoru).
Nijedna pojedinačna zaštitna mjera nije dovoljna protiv odlučne ili prilagodljive zloupotrebe. Tokom pregleda GPT‑5.6 koristimo slojevite zaštitne mjere, s tačnim konfiguracijama koje se razlikuju među modelima, i testiramo ih pod pritiskom protiv napada iz stvarnog svijeta. One uključuju zaštite ugrađene obukom u model, provjere u stvarnom vremenu tokom generiranja, signale na nivou računa, diferenciran pristup, praćenje, provođenje pravila i kontinuirano testiranje.
GPT‑5.6 je obučen da odbije zabranjenu kibernetičku pomoć, uključujući situacije kada korisnici pokušavaju prikriti namjeru ili napraviti jailbreak modela. Ove zaštitne mjere na nivou modela uspostavljaju prvu granicu oko toga u čemu model treba, a u čemu ne treba pomagati.
Klasifikatori zloupotrebe u kibernetici i biologiji u stvarnom vremenu pružaju još jedan sloj evaluirajući izlaz dok se generira. U slučajevima višeg rizika, ako otkriju potencijalno kršenje, generiranje se može pauzirati dok veći model rezonovanja pregleda razgovor i njegov kontekst. Ako se izlaz ocijeni kao nedozvoljen, zadržava se prije nego što dođe do korisnika.
Označena aktivnost također može pokrenuti pregled na nivou računa kroz relevantne razgovore i signale rizika, u skladu s našim uslovima i pravilima o zadržavanju i pregledu sadržaja. Pogled izvan jednog razgovora pomaže našim sistemima da razlikuju uporno zlonamjerno ponašanje od legitimnog sigurnosnog rada dvojne namjene, gdje se slični tehnički koncepti mogu pojaviti u vrlo različitim kontekstima.
Zajedno, ovi slojevi čine ukupni pristup robusnijim nego bilo koja pojedinačna zaštitna mjera sama za sebe. Ponašanje modela smanjuje vjerovatnoću štetnih odgovora, sistemi u stvarnom vremenu mogu intervenirati tokom generiranja, pregled na nivou računa može prepoznati šire obrasce, a diferencirani pristup čuva važan defanzivni rad bez toga da najosjetljivije sposobnosti podrazumijevano budu široko dostupne.
Posebno tokom pregleda, korisnici mogu naići na zaštitne mjere koje blokiraju ili odbijaju neke zahtjeve. Drugi zahtjevi mogu trajati duže jer se generiranje pauzira radi dodatnog pregleda. Zaštitne mjere ponekad mogu intervenirati u legitimnom radu, naročito u područjima dvojne namjene gdje defanzivna i ofanzivna aktivnost u početku mogu izgledati slično.
To je dio onoga za što je pregled osmišljen da testira. Želimo razumjeti ne samo ograničavaju li zaštitne mjere zloupotrebu, nego i mogu li legitimni korisnici i dalje pouzdano i efikasno obavljati uobičajeni rad. Povratne informacije tokom pregleda pomoći će nam da smanjimo nepotrebna blokiranja i kašnjenja, poboljšamo način na koji zaštitne mjere tumače kontekst i stvorimo uglađenije iskustvo prije šireg izdanja.
Također radimo s poslovnim korisnicima na dugoročnijim pristupima — uključujući detekciju koja čuva privatnost, sigurnosne kontrole kojima upravljaju korisnici i pristup kalibriran prema riziku korisnika, upotrebljavatelja ili radnog opterećenja — kako bismo unaprijedili sigurnost uz podršku zahtjevima preduzeća za privatnost.
Zaštitne mjere moraju ostati učinkovite i kada napadači prilagode svoje taktike. Zaštita koja djeluje samo na fiksnom skupu poznatih napada nije dovoljno robusna za frontier model.
Zato na sigurnost primjenjujemo više inteligencije i računarskih resursa nego ikad, koristeći vlastite modele da brže pronađemo slabosti i poboljšamo zaštitne mjere. Posvetili smo više od 700.000 GPU sati ekvivalentnih A100 automatiziranom red-team testiranju usmjerenom na pronalaženje univerzalnih jailbreakova: napada koji mogu djelovati u mnogim upitima ili kontekstima, a ne samo u jednom uskom okruženju. Fokus na ove teže, općenitije napade omogućio nam je da zaštitne mjere testiramo izvan fiksnog skupa poznatih neuspjeha. Također nam omogućava da istražimo mnogo više obrazaca napada nego što bi samo ljudsko testiranje moglo obuhvatiti, ranije prepoznamo obrasce neuspjeha i skratimo put od pronalaska slabosti do njenog otklanjanja.
Uz automatizirano red-team testiranje, radili smo s testerima trećih strana na opsežnom ljudskom ekspertnom red-team testiranju, koje će se nastaviti tokom perioda pregleda. Ljudsko red-team testiranje dopunjuje automatizirani rad tako što provjerava zaštitne mjere protiv kreativnih stručnjaka koji pokušavaju zloupotrijebiti model na načine koje naši sistemi možda ne bi predvidjeli.
Nijedna evaluacija ne može obuhvatiti svaku konfiguraciju proizvoda, višekorakni napad ili stvarni radni tok. Zato održavamo proces brzog odgovora za reprodukciju, procjenu, određivanje prioriteta i otklanjanje novootkrivenih jailbreakova, a zatim ih dodajemo u naše tekuće evaluacije kako bismo ubuduće mogli testirati slične neuspjehe.
Tokom pregleda, GPT‑5.6 modeli će u početku biti dostupni putem API-ja i Codexa odabranoj grupi pouzdanih partnera i organizacija. Planiramo ih uskoro učiniti šire dostupnim ljudima koji koriste ChatGPT, Codex i API.
U ovom novom sistemu imenovanja uvedenom s GPT‑5.6, broj označava generaciju modela, dok Sol, Terra i Luna označavaju trajne nivoe sposobnosti koji mogu napredovati vlastitim tempom. Zajedno, ova porodica ljudima i programerima daje jasniji izbor između inteligencije, brzine i troška.
GPT‑5.6 ima cijenu po 1M tokena kroz tri veličine modela: Sol je $5 ulaz / $30 izlaz; Terra je $2,50 ulaz / $15 izlaz; a Luna je $1 ulaz / $6 izlaz. GPT‑5.6 uvodi i predvidljivije keširanje upita, uključujući podršku za eksplicitne tačke prekida keša i minimalni vijek keša od 30 minuta. Za GPT‑5.6 i kasnije modele, upisi u keš naplaćuju se 1,25x u odnosu na nekehranu ulaznu tarifu modela, dok čitanja iz keša i dalje ostvaruju popust od 90% za keširani ulaz.
Također u julu pokrećemo GPT‑5.6 Sol na Cerebrasu do 750 tokena u sekundi, donoseći frontier inteligenciju korisnicima neviđenom brzinom. Pristup će u početku biti ograničen na odabrane korisnike dok širimo kapacitete.
Radujemo se nastavku učenja tokom ovog perioda pregleda i tome da uskoro GPT‑5.6 Sol, Terra i Lunu donesemo većem broju ljudi.
1. Latenciju i API trošak procjenjujemo posmatranjem produkcijskog ponašanja naših modela i offline simulacijom. Ove procjene uzimaju u obzir detalje poziva alata, uzorkovane tokene i ulazne tokene. Rezultati u stvarnom svijetu mogu se znatno razlikovati i zavise od mnogih faktora koji nisu obuhvaćeni našom simulacijom. Latenciju simuliramo pri brzim API brzinama, a trošak pri standardnim API cijenama.
2. Svi modeli evaluiraju se pomoću ExploitBench API okvira s 5 seedova i kontinuitetom rezonovanja.
3. Pokrenuli smo ExploitGym na našem alpha API-ju, koji odgovore ispisuje brže od našeg javnog API-ja, a zatim rezultate skalirali da odgovaraju našem javnom API-ju. Kada se latencije skaliraju na brzine očekivane za naš javni API, neke procijenjene latencije premašuju vremenska ograničenja od 2 h i 6 h, iako su u evaluacijskom pokretanju pravilno poštovana. Za veće brzine u vremenski osjetljivom radu nudimo prioritetnu obradu u API-ju i brzi način rada u Codexu.
4. Modeli bez prijavljenih izlaznih tokena, latencije ili troška prikazani su kao horizontalne isprekidane linije.

