Kuidas reageerime kriitiliste kübervõimete uuele tasemele
Küberturvalisus muutub ülikiiresti, sest üha võimekamad mudelid saavad nii küberkaitset tugevdada kui ka võimaldada enneolematu kiiruse ja ulatusega ründeid.
Meie viimaste päevade sisehindamised näitavad, et ühel meie peagi ilmuval mudelil Astral on agentse kodeerimise ja küberturvalisuse vallas märkimisväärselt arenenud võimed. Need tulemused koos ekspertide hinnangutega viisid meid eile õhtul järeldusele, et meie Valmisoleku raamistiku(avaneb uues aknas) järgi ei saa välistada kriitilisi kübervõimeid.
Jagame seda teavet, sest peame oluliseks olla avalikkuse ning ohutuse ja turvalisusega tegelevate kogukondadega selle võimaliku võimekuse muutuse asjus läbipaistvad.
Avaldasime „Valmisoleku raamistiku“ esimest korda 2023. aasta detsembris, ammu enne seda, kui mudelid jõudsid bioloogia, keemia, küberturvalisuse ja tehisaru enesetäiustamise vallas selliste võimete lähedale. Lõime selle juhiseks, mille abil märgata võimete arengut ja kavandada, mida meie ettevõte nende võimete tekkides ette võtab. Varasemaid mudeleid, sealhulgas GPT‑5.6‑Soli, on hinnatud tipptasemel kübervõimete suhtes ning need on paigutatud tasemele „kõrge“, mitte „kriitiline“.
Meie „Valmisoleku raamistiku“ järgi jõuab mudel küberturvalisuse tasemele „kriitiline“, kui see suudab ilma inimese sekkumiseta leida ja välja töötada igasuguse raskusastmega nullpäeva turvanõrkuste toimivaid ärakasutusmeetodeid paljudes hästi kaitstud reaalsetes elutähtsates süsteemides või kavandada ja ellu viia algusest lõpuni uudseid küberründestrateegiaid hästi kaitstud sihtmärkide vastu, lähtudes üksnes üldiselt sõnastatud eesmärgist.
Kuigi jätkame selle mudeli võrdlustestimist ja hindamist, näitavad esialgsed tulemused piisavalt tugevat sooritust, et praegu ei saa välistada võimekuse taset „kriitiline“. Astra on peagi ilmuv mudel ega olnud seotud Hugging Face’i ärakasutamisega.
Seetõttu oleme suurendanud kaitsemeetmete ja turvakontrollide töökindluse testimist, et need vastaksid selliste võimete kasutuselevõtu vajadustele. Oleme võtnud ettevõttes ka järgmised meetmed, et selle mudeli edasine arendamine toimuks ohutult ja turvaliselt.
- Teeme võimekamatele mudelitele ja nendega seotud tegevustele rangemaid turvakontrolle, sealhulgas loome isoleeritud testkeskkondi, piiratud juurdepääsu võrgule ja tööriistadele, mudeli kaalude tõhusamat kaitset ja krüpteerimist, täiendavaid seire- ja tuvastusvõimeid ning liivakastis käitamist.
- Peatame Astraga seotud sisetegevused, mis ei vasta veel neile rangematele turvakontrolli nõuetele.
- Oleme kõigis Astra agentrakendustes, sealhulgas treenimisel ja hindamisel, võtnud kasutusele riskantsete toimingute ning eesmärkidest kõrvalekaldumise üldise seire. Seiresüsteemid hindavad mudeli mõttekäiku ning kutsuvad ellu turvameetmed, et suure riskiga tegevus üle vaadata ja katkestada.
- Teeme asjaomaste valitsusasutuste ja valitud tehisaru ohutusega tegelevate organisatsioonidega koostööd, et selle mudeli võimeid testida.
- Anname kolmandatest osalistest testimispartneritele soovituslikud turvakontrollid, et suurema riskiga hindamisi ja töökoormusi saaks ohutult käitada.
Raamistik on meid juba suunanud teiste võimekuse muutuste ajal. Kui meie mudelid lähenesid 2025. aasta juunis „Valmisoleku raamistikus“ bioloogiavõimetele määratud kõrgele lävendile, kirjeldasime võetavaid meetmeid, millega tugevdasime kaitsemeetmeid, suurendasime testimist, tegime koostööd välisekspertidega ja tegime lisaturvakontrolle. Rakendame siin sama põhimõtet.
Usume, et täiustatud kübervõimetega mudelid peaksid aitama kaitsjatel turvanõrkusi leida ja kõrvaldada enne, kui ründajad neid ära kasutavad. Oleme pühendunud koostööle valitsuste, ohutusinstituutide ja kodanikuühiskonnaga, et Astra-sarnaste ja järgnevate mudelite tipptasemel võimeid rakendataks vastutustundlikult ja laialdaselt kogu inimkonna hüvanguks.


