Kalo te përmbajtja kryesore
OpenAI

Zgjerimi i Daybreak tek ngushtohet koha për mbrojtje kibernetike

Mënyra të reja për të shfrytëzuar aftësi të avancuara kibernetike me GPT‑5.6‑Cyber, modelin tonë më të ri posaçërisht për sigurinë kibernetike.

Bota e sigurisë kibernetike po ndryshon me shpejtësi—aktorët keqdashës do ta përdorin gjithnjë e më shumë IA-në për të kryer sulme kibernetike me shpejtësi dhe përmasa të paprecedentë, përfshirë edhe në mënyrë plotësisht autonome. Teksa këto aftësi përhapen, mbrojtësve po u ngushtohet koha për t'u përgatitur. Përgjigjja jonë është t'ua japim inteligjencën avangardë mbrojtësve të besuar kudo, përpara se sulmuesit të vënë në përdorim në shkallë të gjerë aftësi ofensive të IA-së.

Po e zgjerojmë OpenAI Daybreak me dy nivele aksesi, të krijuara për t'u dhënë mbrojtësve të miratuar aftësitë e duhura për punën e tyre:

  • Daybreak Blue ofron akses në modele avangardë për përdorim të përgjithshëm, përfshirë GPT‑5.6 Sol, me masa mbrojtëse të përshtatura për punë të autorizuar të sigurisë mbrojtëse. Është pika e rekomanduar e nisjes për shumicën e mbrojtësve dhe mbështet zbulimin e cenueshmërive, shqyrtimin e sigurt të kodit, analizën e programeve keqdashëse, reagimin ndaj incidenteve dhe verifikimin e korrigjimeve.
  • Daybreak Red ofron akses në modelet tona të trajnuara posaçërisht për sigurinë kibernetike, për kërkime të autorizuara mbi cenueshmëritë, verifikim shfrytëzimesh dhe testim sigurie.

Po prezantojmë gjithashtu GPT‑5.6‑Cyber, të ofruar përmes Daybreak Red. I ndërtuar mbi GPT‑5.6 Sol, ai është trajnuar për të përmirësuar aftësitë në disa detyra të specializuara të sigurisë kibernetike (p.sh., gjetjen e cenueshmërive zero-day dhe zhvillimin e zinxhirëve të shfrytëzimit) dhe për të ulur refuzimet për disa detyra kibernetike me rrezik më të lartë dhe përdorim të dyfishtë.

Daybreak mundëson aftësi të avancuara kibernetike

Siç kemi njoftuar më parë, GPT‑5.6 Sol ofron performancë bashkëkohore në detyrat e sigurisë kibernetike. Në prodhim, vendosim masa mbrojtëse në nivel sistemi për të kontrolluar kërkesat që lidhen me sigurinë kibernetike dhe për të parandaluar keqpërdorimin, por ato mund të bllokojnë edhe punë të ligjshme mbrojtëse. Aksesi në Daybreak Blue i heq këto kufizime, duke i ndihmuar mbrojtësit ta shfrytëzojnë më mirë modelin në detyra reale sigurie, përfshirë zbulimin dhe reagimin ndaj incidenteve, hetimet, menaxhimin e cenueshmërive dhe vlerësimet e sigurisë.

Edhe pa kufizime në nivel sistemi, ekzistojnë kërkesa të sigurisë kibernetike me përdorim të theksuar të dyfishtë (p.sh., testimi i depërtimit në sisteme prodhimi), të cilave GPT‑5.6 Sol do të refuzojë t'u përgjigjet. Për ta trajtuar këtë, trajnuam GPT‑5.6‑Cyber, të ofruar përmes aksesit në Daybreak Red, që të ulë më tej refuzimet dhe të përmirësojë performancën në detyra të caktuara. GPT‑5.6‑Cyber i ndihmon mbrojtësit e besuar të kryejnë veprimtari të ligjshme sigurie.

Për të matur uljen e shkallës së refuzimeve që ofron GPT‑5.6‑Cyber përmes aksesit në Daybreak Red, krijuam një vlerësim të brendshëm (Shkalla e përfundimit për sigurinë e avancuar kibernetike), i cili mat sa shpesh modelet u përgjigjen kërkesave që përfshijnë zhvillimin e zinxhirëve të shfrytëzimit, anashkalimin e autentikimit, përshkallëzimin e privilegjeve dhe skenarë të tjerë të avancuar të sigurisë kibernetike1. GPT‑5.6‑Cyber përfundon 95,0% të këtyre kërkesave, krahasuar me vetëm 1,5% për GPT‑5.6 Sol dhe 2,0% kur ky përdoret me akses në Daybreak Blue. Ai përfundon gjithashtu më shumë kërkesa se GPT‑5.5‑Cyber, i cili përfundon vetëm 57,3% të tyre, duke adresuar komentet e studiuesve të sigurisë që hasën refuzime të vazhdueshme me modelin e mëparshëm.

Më poshtë paraqesim një sërë kërkesash për sigurinë kibernetike dhe përgjigjet përkatëse të modeleve GPT‑5.6 Sol me kufizime në nivel sistemi, GPT‑5.6 Sol (Daybreak Blue), GPT‑5.5‑Cyber (Daybreak Red) dhe GPT‑5.6‑Cyber (Daybreak Red).

Përmirësimi i performancës së sigurisë kibernetike

Modeli GPT‑5.6‑Cyber është trajnuar për të përmirësuar performancën në disa procese të sigurisë kibernetike që përfshijnë zhvillimin e shfrytëzimeve dhe kërkime të avancuara të sigurisë. Në ExploitGym2, i cili vlerëson nëse agjentët mund t'i shndërrojnë cenueshmëritë e njohura në shfrytëzime funksionale që arrijnë ekzekutim arbitrar kodi në mjedise të kontrolluara, GPT‑5.6‑Cyber e tejkalon si GPT‑5.6 Sol, ashtu edhe GPT‑5.5 Cyber.

Një fushë tjetër që GPT‑5.6‑Cyber synon të përmirësojë është aftësia për të gjetur cenueshmëri të reja zero-day dhe për të përcaktuar me saktësi shkallën e rrezikshmërisë së tyre. Krijuam një grup të brendshëm të dhënash vlerësimi, ku modeleve u japim versionin aktual të një depoje me burim të hapur. Më pas u kërkojmë të krijojnë shfrytëzime si prova koncepti me ndikimin maksimal të mundshëm, së bashku me një përshkrim teknik të gjetjeve. Modelet vlerësohen për rrezikshmërinë dhe ndikimin e gjetjeve, si edhe për kalibrimin dhe cilësinë e përshkrimit teknik shoqërues. Falë trajnimit të specializuar, GPT‑5.6‑Cyber (Daybreak Red) e tejkaloi GPT‑5.6 Sol (Daybreak Blue) në këtë standard vlerësimi.

E vlerësuam GPT‑5.6‑Cyber edhe me vlerësimin tonë të brendshëm për Zbulimin e cenueshmërive dhe hartimin e raporteve, i cili i jep një agjenti një kërkesë të hapur për të gjetur cenueshmëri në një depo ku dihet se ka një të tillë. Modelet fitojnë pikë në këtë vlerësim duke gjetur cenueshmëri serioze dhe të trajtueshme, qofshin të reja apo të njohura, duke zhvilluar një provë koncepti funksionale dhe duke dorëzuar një raport cilësor për cenueshmërinë. Si GPT‑5.6 Sol, ashtu edhe GPT‑5.6‑Cyber përmirësohen krahasuar me GPT‑5.5‑Cyber. GPT‑5.6‑Cyber ka performancë më të dobët se GPT‑5.6 Sol në këtë vlerësim, çka besojmë se ndodh sepse modeli ndonjëherë prodhon raporte më të shkurtra dhe më pak të hollësishme për cenueshmëritë.

Së fundi, matëm aftësitë e zhvillimit të shfrytëzimeve në ExploitBench3, një vlerësim që teston aftësinë e një agjenti për ta shndërruar një cenueshmëri V8 në një shfrytëzim të plotë. Kjo detyrë shfrytëzimi është më e vështirë se ExploitGym—më shumë masa mbrojtëse, si ambienti i testimit V8, mbeten aktive dhe agjentit i jepet më pak informacion për cenueshmërinë që duhet shfrytëzuar. Në konfigurimin standard, i cili i kufizon agjentët në 300 hapa, GPT‑5.6 Sol (Daybreak Blue) i zgjidh detyrat me më pak tokenë dhe ka performancë më të mirë. Nëse e zgjerojmë konfigurimin standard nga 300 në 600 hapa, diferenca e performancës mes dy modeleve ngushtohet.

Përveç rezultateve në standardet e vlerësimit, i dhamë akses të hershëm në GPT‑5.6‑Cyber edhe një grupi partnerësh-klientë të besuar. Këta klientë i kanë përdorur me shumë sukses modelet për të përshpejtuar proceset e tyre mbrojtëse:

Gjetja dhe korrigjimi i cenueshmërive në programe reale

Aftësitë e GPT‑5.6‑Cyber shkojnë përtej performancës në standardet kërkimore, duke u shtrirë në kërkimin real të cenueshmërive. Kërkimi i cenueshmërive në botën reale shpesh kërkon arsyetim të vazhdueshëm në baza të mëdha e të panjohura kodi. Studiuesit duhet të formulojnë e testojnë hipoteza, të gjurmojnë ndërveprimet mes disa komponentëve, të riprodhojnë sjellje të papritura dhe të përcaktojnë nëse një cenueshmëri e dyshuar mund të shfrytëzohet në praktikë.

Që kur përfundoi trajnimi i modelit GPT‑5.6‑Cyber, e kemi përdorur për të studiuar gjerësisht dhe për të përmirësuar disa projekte të përzgjedhura softuerike. Për shembull, përdorëm GPT‑5.6‑Cyber për të hetuar V8, motorin JavaScript që përdor Chrome. Zbuluam dy cenueshmëri të panjohura më parë, të cilat mund të lidheshin në zinxhir për të dëmtuar memorien dhe për të dalë nga mjedisi i testimit të heap-it V8. Studiuesit tanë i verifikuan gjetjet dhe ia raportuan Google përmes procesit të bashkërenduar të raportimit të cenueshmërive. Google e korrigjoi cenueshmërinë dhe i caktoi identifikuesin CVE-2026-15903.

CVE-2026-15903 është një cenueshmëri me rrezikshmëri të lartë në V8, motorin JavaScript të Chrome. Kompiluesi i tij optimizues anashkalonte gabimisht një kontroll sigurie gjatë shndërrimit të vlerave në numra të plotë, duke lejuar që vlerat e papërcaktuara të prodhonin çuditërisht një numër të madh në vend të rezultatit të pritshëm.

Nëse ai numër përdoret si indeks vargu, kompiluesi mund të supozojë gabimisht se ndodhet brenda kufijve të vargut dhe të heqë kontrollin e zakonshëm të kufijve. Më pas, një sulmues mund të lexojë ose të mbishkruajë memorien e objekteve të tjera, duke ekzekutuar potencialisht kod arbitrar brenda mjedisit të testimit të Chrome. Dalja nga mjedisi i testimit të heap-it zakonisht do të kërkonte një cenueshmëri të dytë, të cilën GPT‑5.6‑Cyber e gjeti gjithashtu. Diagrami më poshtë jep një përmbledhje të kësaj cenueshmërie me rrezikshmëri të lartë.

Një defekt në kod i kompiluesit JIT prodhon një varg jashtë kufijve, duke mundësuar lexim dhe shkrim arbitrar brenda mjedisit të testimit. Më pas, një dalje nga stiva JSPI mundëson ekzekutimin e kodit vendas, kapjen e flamurit V8CTF ose kalimin në fazën e mjedisit të testimit të shfletuesit.

Përveç këtyre cenueshmërive të V8, kemi përdorur GPT‑5.6‑Cyber edhe për të identifikuar probleme me rrezikshmëri të lartë në programe që variojnë nga bazat e njohura të të dhënave deri te telefonat celularë:

  • Të paktën pesë cenueshmëri në një sistem operativ të njohur për pajisje celulare, përfshirë një zinxhir nga një aplikacion i pabesuar deri te përshkallëzimi lokal i privilegjeve.
  • Tri cenueshmëri kritike në një bazë të njohur të dhënash, përfshirë një rrugë në distancë drejt ekzekutimit të kodit.
  • Mbi 400 cenueshmëri që mund të çojnë në përshkallëzim privilegjesh në bërthamën e një sistemi operativ të njohur.

Po punojmë ngushtë me partnerët e Daybreak dhe anëtarët e komunitetit me burim të hapur për t'i raportuar dhe korrigjuar këto cenueshmëri në sistemet celulare, bazat e të dhënave dhe bërthamën.

Vlerësimet e gatishmërisë

Sipas Preparedness Framework, modeli GPT‑5.6 Sol u vlerësua si High për aftësitë e sigurisë kibernetike dhe nën pragun Critical. Përpara prezantimit të GPT‑5.6‑Cyber, vlerësuam edhe aftësitë e tij kibernetike avangardë dhe përcaktuam se ai arrin po ashtu pragun High, por jo pragun Critical. Modeli u përmirësua krahasuar me GPT‑5.6 Sol në disa detyra të specializuara kibernetike për të cilat e trajnuam drejtpërdrejt, por jo mjaftueshëm për të arritur pragun tonë Critical. Ki parasysh, siç përmendëm në përditësimet tona për incidentin e Hugging Face, GPT‑5.6‑Cyber nuk u përfshi në shfrytëzimin e Hugging Face dhe as ndonjë model tjetër i planifikuar për publikim të afërt.

Në një datë të mëvonshme do të publikojmë një kartë sistemi me vlerësime të mëtejshme të GPT‑5.6‑Cyber.

Aksesi dhe masat mbrojtëse

Modelet që funksionojnë me masa të reduktuara mbrojtëse paraqesin rreziqe përtej përdorimit standard të modeleve, qoftë nga keqpërdorimi, qoftë nga mospërputhja. Pavarësisht këtyre rreziqeve, besojmë se demokratizimi i aksesit të mbrojtësve në inteligjencën avangardë është thelbësor për përshpejtimin dhe automatizimin e mbrojtjes kibernetike.

Aksesi në Daybreak Blue dhe Daybreak Red ofrohet për individë(hapet në një dritare të re) dhe organizata të miratuara që kryejnë punë të autorizuar. Aksesin e kontrollojmë përmes verifikimit të identitetit, sigurisë së llogarisë, monitorimit, kufizimeve të përdorimit të miratuar dhe deklarimeve ligjore.

Po ndërmarrim edhe hapa shtesë për të mundësuar përdorim më të sigurt të modeleve kibernetike:

  • Po i nxisim fuqishëm klientët e Daybreak që përdorin Codex të kalojnë nga modaliteti me akses të plotë në modalitetin e shqyrtimit automatik, përmes cilësimeve të parazgjedhura të aplikacionit dhe veçorive të ndërfaqes. Shqyrtimi automatik vlerëson përpara ekzekutimit veprimet që kërkojnë leje të zgjeruara dhe mund të bllokojë kërkesat që paraqesin rrezik të konsiderueshëm për sjellje shkatërruese.
  • Duke filluar nga data 1 shtator 2026, do t'u kërkojmë të gjitha llogarive individuale në Daybreak të përdorin çelësa fizikë sigurie.
  • Po punojmë aktivisht për masa të tjera sigurie, përfshirë monitorim të përmirësuar, të cilat synojmë t'i zbatojmë në javët e ardhshme.
  • Po i japim përparësi trajnimit dhe testimit të përputhshmërisë për versionet e ardhshme të Daybreak.
  • Kemi përditësuar dokumentacionin e Codex për praktikat më të mira të sigurisë, për t'i ndihmuar ekipet t'i mbajnë agjentët me aftësi kibernetike brenda kufijve të synuar të sigurisë.

Praktikat më të mira për përdorimin e serisë Daybreak përfshijnë:

  • Përdor mjedis testimi dhe izolo. Ekzekuto proceset e sigurisë në mjedise të kontrolluara, pa akses në sisteme të ndjeshme prodhimi ose në internetin e hapur. Testo rregullisht kufijtë e mjedisit të testimit.
  • Monitoro veprimet e agjentit. Përdor modalitetin e shqyrtimit automatik(hapet në një dritare të re) për të shqyrtuar thirrjet e mjeteve jashtë mjedisit të testimit të Codex përpara se të ekzekutohen. Shto monitorim të mëtejshëm dhe mbikëqyrje njerëzore për proceset me rrezik më të lartë.
  • Përcakto fushën e veprimit. Përcakto se cilat sisteme dhe veprime janë të autorizuara. Përdor profile lejesh me fushë të kufizuar(hapet në një dritare të re) për t'i zbatuar këta kufij.

Organizatat mund edhe ta përshtatin politikën e shqyrtimit(hapet në një dritare të re) për proceset e tyre specifike.

Për shumicën e mbrojtësve, rekomandojmë Daybreak Blue si pikënisje. Ekipet, puna e autorizuar e të cilave përfshin kërkime të avancuara mbi cenueshmëritë, zhvillim shfrytëzimesh ose simulim sulmesh, mund të kërkojnë akses në Daybreak Red për modelet tona më të avancuara kibernetike. Apliko për t'iu bashkuar programit në openai.com/daybreak/partners.


1. Për të gjitha vlerësimet, tregojmë performancën e secilit model duke përdorur nivelin më të lartë të arsyetimit që ofrohet publikisht. Vini re se GPT‑5.6‑Cyber priret të jetë më i gjerë dhe më gjithëpërfshirës se GPT‑5.6 Sol në buxhetin e tij të arsyetimit, çka sjell përdorim më të lartë të tokenëve.

2. Të gjitha vlerësimet e ExploitGym u kryen me implementimin tonë të ri të brendshëm në mjedise të izoluara dhe të përforcuara nga ana e sigurisë, me monitorim të rreptë për të identifikuar sjellje që devijojnë nga qëllimet e synuara.

3. Vlerësimet e ExploitBench u kryen me implementimin tonë të brendshëm, në mjedise të izoluara dhe të përforcuara nga ana e sigurisë.

Autor

OpenAI