Pereiti prie pagrindinio turinio
OpenAI

2026 m. birželio 26 d.

ProduktasLeidimas

GPT‑5.6 Sol peržiūra: naujos kartos modelis

Įkeliama...

Pradedame ribotą GPT‑5.6 serijos peržiūrą: Sol – mūsų pavyzdinis modelis, Terra – subalansuotas modelis kasdieniam darbui, ir Luna – greitas bei įperkamas modelis. Terra našumu konkuruoja su GPT‑5.5, bet yra 2 kartus pigesnis, o Luna suteikia stiprias galimybes už mažiausią mūsų kainą.

GPT‑5.6 Sol pristatomas su iki šiol patikimiausiu mūsų saugos sluoksnių rinkiniu. Sustiprinome apsaugą didesnės rizikos veiklai, jautrioms kibernetinėms užklausoms ir pakartotiniam piktnaudžiavimui, o kelias savaites skyrėme silpnosioms vietoms ieškoti, sistemai testuoti spaudimo sąlygomis ir grūdinti ją nuo realių atakų.

Tikime plačia prieiga ir planuojame per artimiausias savaites GPT‑5.6 Sol, Terra ir Luna padaryti visuotinai prieinamus. Tęsdami bendradarbiavimą su JAV vyriausybe, prieš šiandienos pristatymą iš anksto pristatėme savo planus ir modelių galimybes. Jų prašymu pradedame nuo ribotos peržiūros nedidelei patikimų partnerių grupei, apie kurios dalyvavimą informuota vyriausybė, ir tik tada pereisime prie platesnio išleidimo. Per šią peržiūrą tęsime testavimą ir glaudžiai koordinuosime veiksmus su partneriais, siekdami platesnio prieinamumo. Nemanome, kad toks vyriausybinės prieigos procesas turėtų tapti ilgalaike numatytąja praktika. Jis geriausius įrankius atitolina nuo naudotojų, kūrėjų, įmonių, kibernetinės gynybos specialistų ir pasaulinių partnerių, kuriems jų reikia. Šio trumpalaikio žingsnio imamės, nes manome, kad tai stipriausias kelias į platesnį prieinamumą artimiausiomis savaitėmis, kol su Administracija kuriame kibernetinio saugumo vykdomojo įsakymo sistemą ir pakartojamą procesą būsimiems modelių išleidimams.

Galimybės

GPT‑5.6 Sol yra stipriausias mūsų modelis iki šiol. Norėdami pateikti modelio našumo peržiūrą, dalijamės vertinimų rinkiniu, kuriame pabrėžiamos pagerėjusios agentinės galimybės kodavimo, biologijos ir kibernetinio saugumo srityse; papildomi saugos ir pasirengimo vertinimai pateikiami mūsų sistemos kortelėje(atsidaro naujame lange). Išplėstą vertinimo rezultatų rinkinį paskelbsime tada, kai modelį padarysime plačiai prieinamą.

Su GPT‑5.6 pristatome naujas `max` protavimo pastangas, kad Sol turėtų daugiausia laiko giliai protauti. Be to, pristatome naują `ultra` režimą, kuris peržengia vieno agento galimybes, pasitelkdamas subagentus sudėtingam darbui paspartinti.

Kodavimo darbo eigose GPT‑5.6 Sol pasiekia naują geriausią rezultatą Terminal‑Bench 2.1 etalone, kuriame tikrinamos komandinės eilutės darbo eigos, reikalaujančios planavimo, iteravimo ir įrankių koordinavimo.

GPT‑5.6 Sol taip pat rodo plataus masto pagerėjimą biologijos darbo eigose. GeneBench v1, kuriame vertinamos ilgo horizonto genomikos ir kiekybinės biologijos analizės, jis pasiekia geresnių rezultatų nei GPT‑5.5, naudodamas mažiau žetonų.

GPT‑5.6 Sol yra mūsų pajėgiausias modelis kibernetiniam saugumui iki šiol. Jis perstumia našumo ir efektyvumo ribą ilgo horizonto saugumo užduotims, įskaitant pažeidžiamumų tyrimus ir išnaudojimą. ExploitBench² etalone GPT‑5.6 Sol konkuruoja su Mythos Preview, naudodamas tik apie 1/3 išvesties žetonų. ExploitGym(atsidaro naujame lange)3 – UC Berkeley tyrėjų, bendradarbiaujant su OpenAI ir kitomis pažangiausiomis laboratorijomis, sukurtame etalone – GPT‑5.6 Sol, Terra ir Luna modeliai visi demonstruoja ryškų kibernetinių galimybių pagerėjimą didinant protavimą.

Stipresnės kibernetinės galimybės su stipresnėmis apsaugos priemonėmis

GPT‑5.6 Sol, Terra ir Luna sukūrėme su iki šiol patikimiausiomis savo apsaugos priemonėmis, kurių konfigūracijos pritaikytos kiekvieno modelio galimybėms. Modeliui tampant pajėgesniam, apsaugos priemones kuriame taip, kad jos vis labiau atlaikytų realaus pasaulio priešišką spaudimą, kartu išsaugodamos prieigą prie teisėto darbo, pavyzdžiui, kodo peržiūros, pažeidžiamumų tyrimų, pataisų kūrimo, derinimo, saugumo mokymo ir gynybinio testavimo. Mūsų tikslas – uždraustą puolamąją veiklą padaryti sudėtingesnę, neapibrėžtesnę ir lengviau aptinkamą, be reikalo neribojant šių naudingų naudojimo būdų. Remdamiesi modelio ir apsaugos priemonių vertinimu, tikimės didelės naudos teisėtam gynybiniam darbui, kartu reikšmingai ribodami uždraustą puolamąjį naudojimą.

GPT‑5.6 Sol geriau padeda žmonėms rasti ir taisyti pažeidžiamumus, nei patikimai vykdo atakas nuo pradžios iki pabaigos. Šioms galimybėms toliau tobulėjant, mūsų prioritetas – užtikrinti, kad jos pasiektų gynėjus ir jiems padėtų: jie gali naudoti šiuos įrankius silpnosioms vietoms rasti, pataisoms kurti ir sistemoms plačiau stiprinti.

Pagal mūsų Preparedness Framework GPT‑5.6 Sol neperžengia Cyber Critical slenksčio. Vertinimuose su Chromium ir Firefox jis nustatė klaidas ir išnaudojimo primityvus – išnaudojimo kūrimo blokus, – tačiau išbandytomis sąlygomis savarankiškai nesukūrė veikiančio visos grandinės išnaudojimo. Vis dėlto etalonų slenksčiai negali aprėpti visų būdų, kaip modelis gali būti naudojamas ar derinamas su kitais įrankiais. Būtent dėl šio neapibrėžtumo ir platesnio modelio galimybių šuolio didesnes modelio galimybes deriname su stipresnėmis apsaugos priemonėmis ir etapiniu išleidimu. Daugiau informacijos apie savo apsaugos priemones pateikiame GPT‑5.6 Preview sistemos kortelėje(atsidaro naujame lange).

Sluoksniuotas apsaugos priemonių rinkinys

Jokia viena apsaugos priemonė nėra pakankama prieš ryžtingą ar prisitaikantį piktnaudžiavimą. Per GPT‑5.6 peržiūrą naudojame sluoksniuotas apsaugos priemones, kurių tikslios konfigūracijos skiriasi priklausomai nuo modelio, ir testuojame jas spaudimo sąlygomis prieš realias atakas. Tai apima modelyje apmokytas apsaugas, tikrinimus realiuoju laiku generavimo metu, paskyros lygmens signalus, diferencijuotą prieigą, stebėseną, taisyklių vykdymą ir tęstinį testavimą.

GPT‑5.6 apmokytas atsisakyti teikti uždraustą kibernetinę pagalbą, įskaitant atvejus, kai naudotojai bando užmaskuoti savo ketinimus arba „jailbreak“ būdu apeiti modelio ribojimus. Šios modelio lygmens apsaugos priemonės nustato pirmąją ribą, kuo modelis turėtų ir neturėtų padėti.

Kibernetinio ir biologinio piktnaudžiavimo klasifikatoriai realiuoju laiku suteikia dar vieną sluoksnį, vertindami išvestį jai generuojantis. Didesnės rizikos atvejais, aptikus galimą pažeidimą, generavimas gali būti pristabdytas, kol didesnis protavimo modelis peržiūri pokalbį ir jo kontekstą. Jei išvestis įvertinama kaip neleistina, ji sulaikoma dar nepasiekusi naudotojo.

Pažymėta veikla taip pat gali paskatinti paskyros lygmens peržiūrą susijusiuose pokalbiuose ir rizikos signaluose, laikantis mūsų sąlygų ir politikų dėl turinio saugojimo ir peržiūros. Žvilgsnis plačiau nei į vieną pokalbį padeda mūsų sistemoms atskirti nuolatinį kenkėjišką elgesį nuo teisėto dvejopo naudojimo saugumo darbo, kuriame panašios techninės sąvokos gali pasirodyti labai skirtinguose kontekstuose.

Kartu šie sluoksniai daro bendrą požiūrį atsparesnį nei bet kuri viena apsaugos priemonė atskirai. Modelio elgsena mažina žalingų atsakymų tikimybę, realiojo laiko sistemos gali įsikišti generavimo metu, paskyros lygmens peržiūra gali nustatyti platesnius dėsningumus, o diferencijuota prieiga išsaugo svarbų gynybinį darbą, nepadarydama jautriausių galimybių plačiai prieinamų pagal numatytąją tvarką.

Ypač per peržiūrą naudotojai gali susidurti su apsaugos priemonėmis, kurios blokuoja arba atmeta kai kurias užklausas. Kitos užklausos gali užtrukti ilgiau, nes generavimas pristabdomas papildomai peržiūrai. Apsaugos priemonės kartais gali įsikišti į teisėtą darbą, ypač dvejopo naudojimo srityse, kur gynybinė ir puolamoji veikla iš pradžių gali atrodyti panašiai.

Būtent tam ši peržiūra ir skirta – tai patikrinti. Norime suprasti ne tik tai, ar apsaugos priemonės riboja piktnaudžiavimą, bet ir tai, ar teisėti naudotojai vis dar gali patikimai ir efektyviai atlikti įprastą darbą. Per peržiūrą gauti atsiliepimai padės sumažinti nereikalingus blokavimus ir vėlavimus, pagerinti, kaip apsaugos priemonės interpretuoja kontekstą, ir sukurti sklandesnę patirtį prieš platesnį išleidimą.

Taip pat dirbame su verslo klientais prie ilgalaikių metodų, įskaitant privatumą išsaugantį aptikimą, klientų valdomas saugos kontrolės priemones ir prieigą, pritaikytą prie kliento, naudotojo ar darbo krūvio rizikos, kad didintume saugą ir kartu palaikytume įmonių privatumo reikalavimus.

Atsparumo didinimas automatizuotu raudonosios komandos testavimu

Apsaugos priemonės turi išlikti veiksmingos ir tada, kai užpuolikai keičia taktiką. Apsauga, veikianti tik prieš fiksuotą žinomų atakų rinkinį, nėra pakankamai atspari pažangiausiam modeliui.

Todėl saugai skiriame daugiau intelekto ir skaičiavimo išteklių nei kada nors anksčiau: pasitelkiame savo modelius silpnosioms vietoms rasti ir apsaugos priemonėms sparčiau tobulinti. Automatizuotam raudonosios komandos testavimui, skirtam universaliems „jailbreak“ metodams rasti, skyrėme daugiau kaip 700 000 A100 ekvivalento GPU valandų: tai atakos, galinčios veikti daugelyje užklausų ar kontekstų, o ne tik vienoje siauroje aplinkoje. Sutelkdami dėmesį į šias sudėtingesnes ir bendresnes atakas, galėjome patikrinti apsaugos priemones plačiau nei vien pagal fiksuotą žinomų nesėkmių rinkinį. Tai taip pat leidžia ištirti kur kas daugiau atakų modelių, nei aprėptų vien žmonių testavimas, anksčiau nustatyti nesėkmių dėsningumus ir sutrumpinti kelią nuo silpnosios vietos radimo iki jos pašalinimo.

Be automatizuoto raudonosios komandos testavimo, dirbome su trečiųjų šalių testuotojais, kad atliktume plataus masto žmonių ekspertų raudonosios komandos testavimą; jis tęsis ir per peržiūros laikotarpį. Žmonių atliekamas raudonosios komandos testavimas papildo automatizuotą darbą, tikrindamas apsaugos priemones prieš kūrybingus ekspertus, bandančius netinkamai panaudoti modelį būdais, kurių mūsų sistemos gali nenumatyti.

Joks vertinimas negali aprėpti visų produkto konfigūracijų, kelių žingsnių atakų ar realaus pasaulio darbo eigų. Todėl palaikome greito reagavimo procesą, kad naujai aptiktus „jailbreak“ metodus galėtume atkurti, įvertinti, nustatyti jų prioritetą ir ištaisyti, o tada įtraukti į nuolatinius vertinimus, kad ateityje galėtume tikrinti panašias nesėkmes.

Prieinamumas ir kainodara

Per peržiūrą GPT‑5.6 modeliai iš pradžių bus pasiekiami per API ir Codex atrinktai patikimų partnerių ir organizacijų grupei. Netrukus planuojame juos plačiau pasiūlyti žmonėms, naudojantiems ChatGPT, Codex ir API.

Šioje naujoje pavadinimų sistemoje, pristatytoje su GPT‑5.6, skaičius nurodo modelio kartą, o Sol, Terra ir Luna žymi ilgalaikius pajėgumų lygius, kurie gali tobulėti savo tempu. Visa ši šeima žmonėms ir kūrėjams suteikia aiškesnį pasirinkimą pagal intelektą, spartą ir kainą.

GPT‑5.6 kaina nustatyta už 1 mln. žetonų trijų dydžių modeliams: Sol – 5 USD už įvestį / 30 USD už išvestį; Terra – 2,50 USD už įvestį / 15 USD už išvestį; Luna – 1 USD už įvestį / 6 USD už išvestį. GPT‑5.6 taip pat pristato labiau nuspėjamą užklausų talpyklą, įskaitant aiškių talpyklos lūžio taškų palaikymą ir 30 minučių minimalų talpyklos galiojimo laiką. GPT‑5.6 ir vėlesniuose modeliuose įrašymas į talpyklą apmokestinamas 1,25 karto didesniu tarifu nei modelio įprasta įvestis be talpyklos, o skaitymui iš talpyklos ir toliau taikoma 90 % talpykloje saugomos įvesties nuolaida.

Liepos mėnesį taip pat pristatome GPT‑5.6 Sol platformoje Cerebras – iki 750 žetonų per sekundę, suteikdami klientams pažangiausią intelektą neregėta sparta. Iš pradžių prieiga bus ribojama atrinktiems klientams, kol didinsime pajėgumus.

Džiaugiamės galėdami toliau mokytis per šį peržiūros laikotarpį ir netrukus pasiūlyti GPT‑5.6 Sol, Terra ir Luna daugiau žmonių.


1. Delsą ir API kainą vertiname pagal mūsų modelių veikimą produkcinėje aplinkoje ir modeliuodami neprisijungus. Šiuose įverčiuose atsižvelgiama į įrankių iškvietimų informaciją, atrinktus žetonus ir įvesties žetonus. Realūs rezultatai gali gerokai skirtis ir priklauso nuo daugelio veiksnių, kurių mūsų simuliacija neapima. Delsą modeliuojame esant greitam API veikimui, o kainą – pagal įprastą API kainodarą.

2. Visi modeliai vertinami naudojant ExploitBench API testavimo aplinką su 5 pradinėmis reikšmėmis ir protavimo tęstinumu.

3. ExploitGym paleidome savo alfa API, kuris atsakymus pateikia greičiau nei mūsų viešasis API, o tada perskaičiavome rezultatus, kad jie atitiktų viešąjį API. Perskaičiuojant delsas pagal tikėtiną viešojo API spartą, kai kurios įvertintos delsos viršija 2 ir 6 val. laiko ribas, nors vertinimo paleidime jų buvo tinkamai laikomasi. Laikui jautriems darbams, kuriems reikia didesnės spartos, API siūlome prioritetinį apdorojimą, o Codex – greitąjį režimą.

4. Modeliai, kuriems nepateikti išvesties žetonai, delsa ar kaina, diagramoje rodomi kaip horizontalios punktyrinės linijos.

Autorius

OpenAI