Atsakas į naują kritinių kibernetinių pajėgumų etapą
Kibernetinis saugumas sparčiai keičiasi, nes modeliai tampa vis pajėgesni ir gali tiek sustiprinti kibernetinę gynybą, tiek sudaryti sąlygas vykdyti precedento neturinčio greičio ir masto atakas.
Naujausi per pastarąsias kelias dienas atlikti vieno iš būsimų mūsų modelių „Astra“ vidaus vertinimai rodo didelę agentinio programavimo ir kibernetinio saugumo pažangą. Remdamiesi šiais rezultatais ir ekspertų vertinimais, praėjusią naktį padarėme išvadą, kad pagal mūsų Pasirengimo sistemą(atsidaro naujame lange) negalime atmesti kritinių kibernetinių pajėgumų galimybės.
Apie tai pranešame, nes manome, kad visuomenę ir saugos bei saugumo bendruomenes svarbu skaidriai informuoti apie šį galimą pajėgumų pokytį.
Pasirengimo sistemą pirmą kartą paskelbėme 2023 m. gruodį, gerokai anksčiau, nei modeliai priartėjo prie tokio lygio biologinių, cheminių, kibernetinio saugumo ir savarankiško DI tobulinimo pajėgumų. Ją sukūrėme kaip gaires, padedančias nustatyti pajėgumų pažangą ir planuoti, kaip mūsų įmonė elgsis šiems pajėgumams atsirandant. Ankstesni modeliai, įskaitant GPT‑5.6‑Sol, buvo vertinami dėl priešakinių kibernetinių pajėgumų ir priskirti aukštai, o ne kritinei, ribai.
Pagal mūsų Pasirengimo sistemą modelis pasiekia kritinę kibernetinio saugumo ribą, jei be žmogaus įsikišimo gali daugelyje sustiprintų realių ypatingos svarbos sistemų aptikti ir sukurti veikiančius bet kokio pavojingumo nulinės dienos pažeidžiamumų išnaudojimo būdus arba, gavęs tik bendro pobūdžio tikslą, sukurti ir nuo pradžios iki galo įgyvendinti naujas kibernetinių atakų prieš sustiprintus taikinius strategijas.
Toliau testuojame ir vertiname šį modelį, tačiau preliminarūs vertinimai rodo pakankamai gerus rezultatus, todėl šiuo metu negalime atmesti kritinio pajėgumų lygio galimybės. „Astra“ yra būsimas modelis ir nebuvo naudojamas įsilaužiant į „Hugging Face“.
Todėl išplėtėme savo apsaugos priemonių ir saugumo kontrolės priemonių atsparumo bandymus, kad jos būtų tinkamos diegiant šiuos pajėgumus. Taip pat ėmėmės toliau nurodytų vidaus veiksmų, kad šis modelis būtų toliau kuriamas saugiai:
- Diegiame griežtesnes saugumo kontrolės priemones pajėgesniems modeliams ir susijusiai veiklai, įskaitant izoliuotas bandymų aplinkas, ribotą prieigą prie tinklo ir įrankių, sustiprintą modelio svorių apsaugą ir šifravimą, papildomas stebėsenos bei aptikimo galimybes ir vykdymą izoliuotoje aplinkoje.
- Stabdome su „Astra“ susijusią vidaus veiklą, kuri dar neatitinka šių sugriežtintų saugumo kontrolės reikalavimų.
- Visose agentinėse „Astra“ taikymo srityse, įskaitant mokymą ir vertinimą, įdiegėme visuotinę rizikingų veiksmų ir neatitikties stebėseną. Stebėsenos priemonės vertina modelio samprotavimo grandinę ir, aptikusios didelės rizikos veiklą, inicijuoja saugumo procedūrą, kad ši veikla būtų peržiūrėta ir sustabdyta.
- Bendradarbiausime su atitinkamomis valdžios institucijomis ir atrinktomis DI saugos organizacijomis, kad išbandytume šio modelio pajėgumus.
- Trečiųjų šalių testavimo partneriams pateiksime rekomenduojamas saugumo kontrolės priemones, kad didesnės rizikos vertinimai ir darbo krūviai būtų vykdomi saugiai.
Ši sistema jau padėjo mums valdyti kitus pajėgumų pokyčius. 2025 m. birželį, mūsų modeliams pagal Pasirengimo sistemą priartėjus prie aukštos biologinių pajėgumų ribos, apibūdinome veiksmus, kurių ėmėmės siekdami sustiprinti apsaugos priemones, išplėsti testavimą, bendradarbiauti su išorės ekspertais ir įdiegti papildomas saugumo kontrolės priemones. Čia vadovaujamės tuo pačiu principu.
Manome, kad pažangūs kibernetinių pajėgumų turintys modeliai turėtų padėti gynėjams aptikti ir pašalinti pažeidžiamumus anksčiau, nei jais pasinaudos užpuolikai. Esame įsipareigoję bendradarbiauti su vyriausybėmis, saugos institutais ir pilietine visuomene, kad priešakiniai tokių modelių kaip „Astra“ ir vėlesnių modelių pajėgumai būtų diegiami atsakingai, plačiai ir visos žmonijos labui.


