Aqbeż għall-kontenut prinċipali
OpenAI

10 ta’ Awwissu 2026

SigurtàSigurtà

Inwessgħu Daybreak hekk kif jonqos żmien id-difiża ċibernetika

Qed nippreżentaw modi ġodda biex nisfruttaw kapaċitajiet ċibernetiċi avvanzati flimkien ma’ GPT‑5.6‑Cyber, l-aħħar mudell tagħna speċifiku għaċ-ċibersigurtà.

Id-dinja taċ-ċibersigurtà qed tinbidel malajr—l-atturi tat-theddid se jużaw dejjem aktar l-IA biex iwettqu attakki ċibernetiċi b’veloċità u fuq skala bla preċedent, inkluż b’mod kompletament awtonomu. Hekk kif dawn il-kapaċitajiet jinfirxu, id-difensuri għandhom dejjem inqas żmien biex iħejju ruħhom. It-tweġiba tagħna hi li nqiegħdu l-intelliġenza avvanzata f’idejn difensuri fdati kullimkien, qabel ma l-attakkanti jużaw kapaċitajiet offensivi tal-IA fuq skala kbira.

Qed inwessgħu OpenAI Daybreak b’żewġ livelli ta’ aċċess maħsuba biex jagħtu lid-difensuri approvati il-kapaċitajiet xierqa għal xogħolhom:

  • Daybreak Blue jagħti aċċess għal mudelli avvanzati għal skopijiet ġenerali, inkluż GPT‑5.6 Sol, b’salvagwardji mfassla għal xogħol difensiv awtorizzat tas-sigurtà. Huwa l-punt tat-tluq rakkomandat għall-biċċa l-kbira tad-difensuri u jappoġġa l-iskoperta ta’ vulnerabbiltajiet, ir-rieżami ta’ kodiċi sigur, l-analiżi tal-malware, ir-rispons għall-inċidenti u l-validazzjoni tal-garżi.
  • Daybreak Red jagħti aċċess għall-mudelli tagħna taċ-ċibersigurtà mħarrġa apposta għal riċerka awtorizzata dwar vulnerabbiltajiet, validazzjoni ta’ exploits u ttestjar tas-sigurtà.

Qed nippreżentaw ukoll GPT‑5.6‑Cyber, disponibbli permezz ta’ Daybreak Red. Mibni fuq GPT‑5.6 Sol, huwa mħarreġ biex itejjeb il-kapaċitajiet f’diversi kompiti speċjalizzati taċ-ċibersigurtà (eż. is-sejba ta’ vulnerabbiltajiet zero-day u l-iżvilupp ta’ ktajjen ta’ exploits) u biex inaqqas ir-rifjuti għal ċerti kompiti ċibernetiċi b’użu doppju u ta’ riskju ogħla.

Daybreak jiftaħ il-bieb għal kapaċitajiet ċibernetiċi avvanzati

Kif għedna qabel, GPT‑5.6 Sol joffri prestazzjoni mill-aqwa fil-kompiti taċ-ċibersigurtà. Fil-produzzjoni, nużaw salvagwardji fil-livell tas-sistema biex jiskrinjaw talbiet relatati maċ-ċibersigurtà u jipprevjenu l-użu ħażin, iżda dawn jistgħu jimblukkaw ukoll xogħol difensiv leġittimu. L-aċċess għal Daybreak Blue ineħħi dawk il-limitazzjonijiet, biex jgħin lid-difensuri jisfruttaw aħjar il-mudell f’kompiti reali tas-sigurtà, fosthom l-identifikazzjoni u r-rispons għall-inċidenti, l-investigazzjonijiet, il-ġestjoni tal-vulnerabbiltajiet u l-valutazzjonijiet tas-sigurtà.

Anki mingħajr limitazzjonijiet fil-livell tas-sistema, għad hemm prompts taċ-ċibersigurtà b’użu doppju qawwi (eż. ittestjar tal-penetrazzjoni ta’ sistemi tal-produzzjoni) li GPT‑5.6 Sol jirrifjuta li jwettaq. Biex nindirizzaw dan, ħarriġna lil GPT‑5.6‑Cyber, disponibbli permezz tal-aċċess għal Daybreak Red, biex ikompli jnaqqas ir-rifjuti u jtejjeb il-prestazzjoni f’ċerti kompiti. GPT‑5.6‑Cyber jgħin lid-difensuri fdati iwettqu attivitajiet leġittimi tas-sigurtà.

Biex inkejlu t-tnaqqis fir-rata ta’ rifjuti li joffri GPT‑5.6‑Cyber permezz tal-aċċess għal Daybreak Red, ħloqna evalwazzjoni interna (Rata ta’ Tlestija Avvanzata taċ-Ċibersigurtà) li tkejjel kemm-il darba l-mudelli jwieġbu għal talbiet li jinvolvu l-iżvilupp ta’ ktajjen ta’ exploits, qbiż tal-awtentikazzjoni, eskalazzjoni tal-privileġġi u xenarji avvanzati oħra taċ-ċibersigurtà1. GPT‑5.6‑Cyber ilesti 95.0% ta’ dawn it-talbiet, meta mqabbel ma’ 1.5% biss għal GPT‑5.6 Sol u 2.0% meta jintuża b’aċċess għal Daybreak Blue. Ilesti wkoll aktar talbiet minn GPT‑5.5‑Cyber, li jtemm biss 57.3% tat-talbiet, u b’hekk jindirizza l-kummenti ta’ riċerkaturi tas-sigurtà li ltaqgħu ma’ rifjuti persistenti bil-mudell preċedenti.

Hawn taħt nuru sensiela ta’ prompts taċ-ċibersigurtà u t-tweġibiet relatati mill-mudelli GPT‑5.6 Sol b’limitazzjonijiet fil-livell tas-sistema, GPT‑5.6 Sol (Daybreak Blue), GPT‑5.5‑Cyber (Daybreak Red) u GPT‑5.6‑Cyber (Daybreak Red).

Titjib tal-prestazzjoni taċ-ċibersigurtà

Il-mudell GPT‑5.6‑Cyber huwa mħarreġ biex itejjeb il-prestazzjoni f’ċerti flussi tax-xogħol taċ-ċibersigurtà li jinvolvu l-iżvilupp ta’ exploits u riċerka avvanzata tas-sigurtà. Fuq ExploitGym2, li jevalwa jekk l-aġenti jistgħux ibiddlu vulnerabbiltajiet magħrufa f’exploits li jaħdmu u jwettqu kodiċi arbitrarju f’ambjenti kkontrollati, GPT‑5.6‑Cyber jaqbeż kemm lil GPT‑5.6 Sol kif ukoll lil GPT‑5.5 Cyber.

Qasam ieħor li GPT‑5.6‑Cyber għandu l-għan li jtejjeb huwa l-kapaċità li jsib vulnerabbiltajiet zero-day ġodda u jikkalibra b’mod preċiż is-severità tagħhom. Ħloqna sett intern ta’ data għall-evalwazzjoni li fih nagħtu lill-mudelli l-ħarġa attwali ta’ repożitorju open source. Imbagħad nitolbuhom jiġġeneraw exploits ta’ prova tal-kunċett bl-akbar impatt possibbli flimkien ma’ rapport tekniku tas-sejbiet tagħhom. Il-mudelli jiġu evalwati skont is-severità u l-impatt tas-sejbiet tagħhom, kif ukoll il-kalibrazzjoni u l-kwalità tar-rapport tekniku li jakkumpanjahom. GPT‑5.6‑Cyber (Daybreak Red) qabeż lil GPT‑5.6 Sol (Daybreak Blue) f’dan il-parametru referenzjarju minħabba t-taħriġ speċjalizzat tiegħu.

Evalwajna wkoll lil GPT‑5.6‑Cyber bl-evalwazzjoni interna tagħna tal-Iskoperta ta’ Vulnerabbiltajiet u l-Kitba ta’ Rapporti, li tagħti lil aġent prompt miftuħ biex isib vulnerabbiltajiet f’repożitorju b’vulnerabbiltà magħrufa. Il-mudelli jiksbu punti f’din l-evalwazzjoni billi jsibu vulnerabbiltajiet serji u azzjonabbli (ġodda jew magħrufa), jiżviluppaw prova tal-kunċett li taħdem u jippreżentaw rapport ta’ vulnerabbiltà ta’ kwalità għolja. Kemm GPT‑5.6 Sol kif ukoll GPT‑5.6‑Cyber jitjiebu meta mqabbla ma’ GPT‑5.5‑Cyber. GPT‑5.6‑Cyber imur agħar minn GPT‑5.6 Sol f’din l-evalwazzjoni, u nemmnu li dan iseħħ għax il-mudell xi drabi jipproduċi rapporti ta’ vulnerabbiltà iqsar u inqas dettaljati.

Fl-aħħar, kejjilna l-kapaċitajiet tal-iżvilupp ta’ exploits fuq ExploitBench3, evalwazzjoni li tittestja l-kapaċità ta’ aġent li jiżviluppa vulnerabbiltà ta’ V8 f’exploit sħiħ. Dan il-kompitu ta’ sfruttament huwa aktar diffiċli minn ExploitGym—jibqgħu attivati aktar protezzjonijiet difensivi, bħas-sandbox ta’ V8, u l-aġent jingħata inqas informazzjoni dwar il-vulnerabbiltà li jrid jisfrutta. Fl-issettjar standard, li jillimita l-aġenti għal 300 rawnd, GPT‑5.6 Sol (Daybreak Blue) isolvi l-kompiti b’użu aktar effiċjenti tat-tokens u jikseb l-aħjar prestazzjoni. Jekk immorru lil hinn mill-issettjar standard ta’ 300 rawnd għal 600 rawnd, id-differenza fil-prestazzjoni bejn iż-żewġ mudelli tonqos.

Minbarra r-riżultati fil-parametri referenzjarji tal-evalwazzjoni, tajna wkoll aċċess bikri għal GPT‑5.6‑Cyber lil grupp ta’ sħab klijenti fdati. Dawn il-klijenti użaw il-mudelli b’suċċess kbir biex jaċċelleraw il-flussi tax-xogħol difensivi tagħhom:

Insibu u nsewwu vulnerabbiltajiet f’software reali

Il-kapaċitajiet ta’ GPT‑5.6‑Cyber imorru lil hinn mill-prestazzjoni fil-parametri referenzjarji tar-riċerka u jestendu għar-riċerka dwar vulnerabbiltajiet reali. Ir-riċerka dwar vulnerabbiltajiet reali spiss teħtieġ raġunament sostnut fuq bażijiet kbar u mhux familjari ta’ kodiċi. Ir-riċerkaturi jridu jifformulaw u jittestjaw ipoteżijiet, isegwu l-interazzjonijiet bejn diversi komponenti, jirriproduċu mġiba mhux mistennija u jiddeterminaw jekk vulnerabbiltà suspettata tistax tiġi sfruttata fil-prattika.

Minn meta l-mudell GPT‑5.6‑Cyber temm it-taħriġ, użajnieh biex nistudjaw u ntejbu b’mod estensiv għadd ta’ proġetti tas-software magħżula. Pereżempju, użajna lil GPT‑5.6‑Cyber biex ninvestigaw V8, il-magna JavaScript li juża Chrome. Skoprejna żewġ vulnerabbiltajiet li qabel ma kinux magħrufa u li setgħu jintrabtu f’katina biex jikkorrompu l-memorja u jaħarbu mis-sandbox tal-heap ta’ V8. Ir-riċerkaturi tagħna vvalidaw is-sejbiet u rrappurtawhom lil Google permezz ta’ żvelar koordinat tal-vulnerabbiltajiet. Google sewwiet il-vulnerabbiltà u assenjatilha CVE-2026-15903.

CVE-2026-15903 hija vulnerabbiltà ta’ severità għolja f’V8, il-magna JavaScript ta’ Chrome. Il-kompilatur tal-ottimizzazzjoni tagħha qabeż b’mod żbaljat kontroll tas-sikurezza meta kkonverta valuri f’numri sħaħ, u ppermetta li valuri mhux definiti jipproduċu numru kbir mhux mistenni minflok ir-riżultat mistenni.

Jekk dak in-numru jintuża bħala indiċi ta’ array, il-kompilatur jista’ jassumi b’mod żbaljat li jinsab fil-limiti tal-array u jħalli barra l-kontroll tas-soltu tal-limiti. Attakkant imbagħad jista’ jaqra jew jikteb fuq il-memorja ta’ oġġetti oħra, u potenzjalment jeżegwixxi kodiċi arbitrarju ġewwa s-sandbox ta’ Chrome. Biex wieħed jaħrab mis-sandbox tal-heap ġeneralment tkun meħtieġa vulnerabbiltà oħra, li GPT‑5.6‑Cyber sab ukoll. Id-dijagramma t’hawn taħt tagħti ħarsa ġenerali lejn din il-vulnerabbiltà ta’ severità għolja.

Bug f’kompilatur JIT jipproduċi string barra mil-limiti, li jippermetti qari u kitba arbitrarji fis-sandbox. Ħarba mill-munzell JSPI mbagħad tippermetti l-eżekuzzjoni ta’ kodiċi nattiv, il-qbid tal-bandiera V8CTF jew il-progress lejn stadju ta’ sandbox tal-browser.

Minbarra dawn il-vulnerabbiltajiet ta’ V8, użajna wkoll lil GPT‑5.6‑Cyber biex nidentifikaw problemi ta’ severità għolja f’software li jvarja minn databases popolari sa mowbajls:

  • Mill-inqas ħames vulnerabbiltajiet f’sistema operattiva popolari għall-mowbajls, inkluża katina minn app mhux fdata għal eskalazzjoni lokali tal-privileġġi.
  • Tliet vulnerabbiltajiet kritiċi f’database popolari, inkluż mezz remot għall-eżekuzzjoni ta’ kodiċi.
  • Aktar minn 400 vulnerabbiltà li jistgħu jwasslu għal eskalazzjoni tal-privileġġi fil-kernel ta’ sistema operattiva popolari.

Qed naħdmu mill-qrib mas-sħab ta’ Daybreak u mal-membri tal-komunità open source biex niżvelaw u nsewwu dawn il-vulnerabbiltajiet fis-sistemi operattivi tal-mowbajls, fid-databases u fil-kernels.

Evalwazzjonijiet tat-Tħejjija

Skont il-Qafas tat-Tħejjija tagħna, il-mudell GPT‑5.6 Sol ġie vvalutat bħala Għoli għall-kapaċità taċ-ċibersigurtà u taħt il-livell Kritiku. Qabel nedejna GPT‑5.6‑Cyber, evalwajna wkoll il-kapaċitajiet ċibernetiċi avvanzati tiegħu u ddeterminajna li bl-istess mod jilħaq il-livell Għoli, iżda mhux dak Kritiku. Il-mudell tjieb fuq GPT‑5.6 Sol f’xi kompiti ċibernetiċi speċjalizzati li ħarriġna direttament għalihom, iżda mhux biżżejjed biex jilħaq il-livell Kritiku tagħna. Innota li, kif semmejna fl-aġġornamenti tagħna dwar l-inċident ta’ Hugging Face, GPT‑5.6‑Cyber ma kienx involut fl-isfruttament ta’ Hugging Face, u lanqas ma kien involut xi mudell ieħor ippjanat għal ħruġ li jmiss.

Aktar tard se nippubblikaw kard tas-sistema b’aktar evalwazzjonijiet ta’ GPT‑5.6‑Cyber.

Aċċess u salvagwardji

Mudelli li jaħdmu b’inqas salvagwardji jġorru riskji lil hinn mill-użu standard tal-mudelli, kemm minn użu ħażin kif ukoll minn nuqqas ta’ allinjament. Minkejja dawn ir-riskji, nemmnu li d-demokratizzazzjoni tal-aċċess għal intelliġenza avvanzata għad-difensuri hija kruċjali biex id-difiża ċibernetika titħaffef u tiġi awtomatizzata.

L-aċċess għal Daybreak Blue u Daybreak Red huwa disponibbli għal individwi(jinfetaħ f’tieqa ġdida) u organizzazzjonijiet approvati li jwettqu xogħol awtorizzat. Nikkontrollaw l-aċċess permezz tal-verifika tal-identità, is-sigurtà tal-kontijiet, il-monitoraġġ, restrizzjonijiet fuq l-użu approvat u attestazzjonijiet legali.

Qed nieħdu wkoll passi addizzjonali biex il-mudelli ċibernetiċi jintużaw b’mod aktar sigur:

  • Qed inħeġġu bil-qawwa lill-klijenti ta’ Daybreak li jużaw Codex biex jaqilbu mill-modalità ta’ aċċess sħiħ għall-modalità ta’ rieżami awtomatiku permezz tas-settings predefiniti tal-app u l-karatteristiċi tal-interfaċċa. Ir-rieżami awtomatiku jevalwa azzjonijiet li jeħtieġu permessi elevati qabel l-eżekuzzjoni u jista’ jimblokka talbiet li joħolqu riskju sinifikanti ta’ mġiba distruttiva.
  • Mill-1 ta’ Settembru 2026, se neħtieġu li l-kontijiet individwali kollha f’Daybreak jużaw ċwievet tas-sigurtà fiżiċi.
  • Qed naħdmu b’mod attiv fuq miżuri addizzjonali tas-sigurtà, inkluż monitoraġġ imtejjeb, li biħsiebna nniedu fil-ġimgħat li ġejjin.
  • Qed nagħtu prijorità lit-taħriġ u l-ittestjar tal-allinjament għall-ħarġiet li jmiss ta’ Daybreak.
  • Aġġornajna d-dokumentazzjoni ta’ Codex dwar l-aħjar prattiki tas-sikurezza biex ngħinu lit-timijiet iżommu l-aġenti b’kapaċitajiet ċibernetiċi fil-konfini tas-sigurtà maħsuba għalihom.

L-aħjar prattiki għall-użu tas-serje Daybreak jinkludu:

  • Uża sandbox u iżola. Ħaddem il-flussi tax-xogħol tas-sigurtà f’ambjenti kkontrollati mingħajr aċċess għal sistemi sensittivi tal-produzzjoni jew għall-internet miftuħ. Ittestja regolarment il-konfini tas-sandbox.
  • Immonitorja l-azzjonijiet tal-aġent. Uża l-modalità ta’ rieżami awtomatiku(jinfetaħ f’tieqa ġdida) biex tirrieżamina sejħiet tal-għodod barra mis-sandbox ta’ Codex qabel ma jiġu eżegwiti. Żid aktar monitoraġġ u sorveljanza umana għal flussi tax-xogħol b’riskju ogħla.
  • Iddefinixxi l-ambitu. Speċifika liema sistemi u azzjonijiet huma awtorizzati. Uża profili ta’ permessi b’ambitu definit(jinfetaħ f’tieqa ġdida) biex tinforza dawk il-konfini.

L-organizzazzjonijiet jistgħu wkoll jippersonalizzaw il-politika tar-rieżami(jinfetaħ f’tieqa ġdida) għall-flussi tax-xogħol speċifiċi tagħhom.

Nirrakkomandaw Daybreak Blue bħala l-punt tat-tluq għall-biċċa l-kbira tad-difensuri. Timijiet li x-xogħol awtorizzat tagħhom jinkludi riċerka avvanzata dwar vulnerabbiltajiet, żvilupp ta’ exploits jew red teaming jistgħu jitolbu aċċess għal Daybreak Red għall-aktar mudelli ċibernetiċi avvanzati tagħna. Applika biex tingħaqad mal-programm fuq openai.com/daybreak/partners.


1. Għall-evalwazzjonijiet kollha, nuru l-prestazzjoni ta’ kull mudell bl-ogħla livell ta’ raġunament disponibbli pubblikament. Innota li GPT‑5.6‑Cyber għandu t-tendenza li jkun aktar estensiv u komprensiv minn GPT‑5.6 Sol fil-baġit tar-raġunament tiegħu, u għalhekk juża aktar tokens.

2. L-evalwazzjonijiet kollha ta’ ExploitGym saru bl-implimentazzjoni interna l-ġdida tagħna f’ambjenti iżolati u msaħħa għas-sigurtà, b’monitoraġġ strett għal imġibiet mhux allinjati.

3. L-evalwazzjonijiet ta’ ExploitBench saru bl-implimentazzjoni interna tagħna f’ambjenti iżolati u msaħħa għas-sigurtà.

Awtur

OpenAI