Reakcia na novú úroveň kritických kybernetických schopností
Kybernetická bezpečnosť sa rýchlo mení, pretože čoraz schopnejšie modely môžu posilniť kybernetickú obranu, ale aj umožniť útoky s bezprecedentnou rýchlosťou a v bezprecedentnom rozsahu.
Naše najnovšie interné hodnotenia pripravovaného modelu Astra z posledných dní poukazujú na významný pokrok v agentickom programovaní a kybernetickej bezpečnosti. Na základe týchto výsledkov a odborných posudkov sme včera večer dospeli k záveru, že podľa nášho dokumentu Rámec pripravenosti(otvorí sa v novom okne) nemôžeme vylúčiť kritické kybernetické schopnosti.
Tieto informácie zverejňujeme, pretože považujeme za dôležité otvorene informovať verejnosť aj komunity zamerané na bezpečnosť a ochranu o tomto možnom posune v schopnostiach.
Rámec pripravenosti sme prvýkrát zverejnili v decembri 2023, teda dlho predtým, ako sa modely priblížili k tejto úrovni schopností v biologickej a chemickej oblasti, kybernetickej bezpečnosti a sebazdokonaľovaní AI. Vytvorili sme ho ako pomôcku na rozpoznávanie pokroku v schopnostiach a plánovanie krokov, ktoré naša spoločnosť podnikne, keď sa tieto schopnosti objavia. Predchádzajúce modely vrátane GPT‑5.6‑Sol sme hodnotili z hľadiska prelomových kybernetických schopností a zaradili na úroveň „Vysoká“, nie „Kritická“.
Podľa nášho Rámca pripravenosti model dosiahne kritický prah kybernetických schopností, ak dokáže bez zásahu človeka v mnohých zabezpečených reálnych kritických systémoch identifikovať a vytvárať funkčné exploity zraniteľností nultého dňa všetkých úrovní závažnosti alebo navrhnúť a uskutočniť úplne nové komplexné stratégie kybernetických útokov proti zabezpečeným cieľom len na základe všeobecne formulovaného požadovaného výsledku.
Hoci model naďalej porovnávame s referenčnými hodnotami a posudzujeme, naše predbežné hodnotenia naznačujú natoľko vysoký výkon, že momentálne nemôžeme vylúčiť úroveň schopností „Kritická“. Astra je pripravovaný model a na zneužití platformy Hugging Face sa nepodieľal.
Preto sme rozšírili testovanie odolnosti našich ochranných opatrení a bezpečnostných kontrol, aby zodpovedali nasadeniu modelu s týmito schopnosťami. Interne sme prijali aj nasledujúce opatrenia, aby ďalší vývoj tohto modelu prebiehal bezpečne:
- Zavádzame prísnejšie bezpečnostné kontroly pre modely s vyššími schopnosťami a súvisiace činnosti vrátane izolovaných testovacích prostredí, obmedzeného prístupu k sieti a nástrojom, lepšej ochrany a šifrovania váh modelu, ďalších možností monitorovania a detekcie a spúšťania v izolovanom prostredí sandbox.
- Pozastavujeme interné činnosti súvisiace s modelom Astra, ktoré ešte nespĺňajú tieto prísnejšie požiadavky na bezpečnostné kontroly.
- Vo všetkých agentických nasadeniach modelu Astra vrátane trénovania a hodnotenia sme zaviedli univerzálne monitorovanie rizikových činností a nesúladu s cieľmi. Monitorovacie systémy vyhodnocujú reťazec uvažovania modelu a pri vysokorizikovej činnosti spúšťajú bezpečnostnú reakciu, ktorá zabezpečí jej preskúmanie a prerušenie.
- Pri testovaní schopností tohto modelu budeme spolupracovať s príslušnými vládnymi orgánmi a vybranými organizáciami zameranými na bezpečnosť AI.
- Externým partnerom zapojeným do testovania poskytneme odporúčané bezpečnostné kontroly na bezpečné vykonávanie rizikovejších hodnotení a pracovných záťaží.
Tento rámec nám už pomohol zvládnuť aj iné prechody medzi úrovňami schopností. Keď sa naše modely v júni 2025 podľa Rámca pripravenosti priblížili k prahu úrovne „Vysoká“ v oblasti biologických schopností, predstavili sme kroky, ktoré sme podnikali na posilnenie ochranných opatrení, rozšírenie testovania, spoluprácu s externými odborníkmi a zavedenie ďalších bezpečnostných kontrol. Rovnakú zásadu uplatňujeme aj v tomto prípade.
Sme presvedčení, že pokročilé modely s kybernetickými schopnosťami by mali pomáhať obrancom identifikovať a odstraňovať zraniteľnosti skôr než útočníci. Zaviazali sme sa spolupracovať s vládami, inštitútmi pre bezpečnosť a občianskou spoločnosťou, aby sa prelomové schopnosti modelov ako Astra aj ich nástupcov nasadzovali zodpovedne a v širokom rozsahu v prospech celého ľudstva.


