Արձագանք կրիտիկական կիբեռկարողությունների հաջորդ փուլին
Կիբեռանվտանգությունն արագորեն փոխվում է, քանի որ մոդելների աճող կարողությունները կարող են թե՛ ամրապնդել կիբեռպաշտպանությունը, թե՛ աննախադեպ արագությամբ ու մասշտաբով հարձակումներ հնարավոր դարձնել։
Վերջին մի քանի օրերին մեր առաջիկա մոդելներից մեկի՝ Astra-ի ներքին գնահատումները ցույց են տվել զգալի առաջընթաց «Ագենտային կոդավորում» ոլորտում և կիբեռանվտանգության մեջ։ Այս արդյունքները և փորձագիտական գնահատումները երեկ երեկոյան մեզ հանգեցրին այն եզրակացության, որ մեր Պատրաստվածության շրջանակի(բացվում է նոր պատուհանում) համաձայն՝ չենք կարող բացառել կրիտիկական կիբեռկարողությունների առկայությունը։
Մենք հայտնում ենք այս մասին, քանի որ կարևոր ենք համարում հանրության և ապահովության ու անվտանգության համայնքների հետ թափանցիկ լինել կարողությունների այս հնարավոր փոփոխության վերաբերյալ։
Մենք առաջին անգամ հրապարակել ենք մեր Պատրաստվածության շրջանակը 2023 թվականի դեկտեմբերին՝ կենսաբանական, քիմիական, կիբեռանվտանգության և արհեստական բանականության ինքնակատարելագործման այս մակարդակի կարողություններին մոդելների մոտենալուց շատ առաջ։ Այն ստեղծել ենք որպես ուղեցույց՝ կարողությունների առաջընթացը բացահայտելու և այդ կարողությունների ի հայտ գալուն զուգահեռ մեր ընկերության անելիքները ծրագրելու համար։ Նախորդ մոդելները, այդ թվում՝ GPT‑5.6‑Sol‑ը, գնահատվել են առաջադեմ կիբեռկարողությունների առումով և դասվել Հզոր, այլ ոչ թե Կրիտիկական շեմին։
Մեր Պատրաստվածության շրջանակի համաձայն՝ մոդելը հասնում է կիբեռանվտանգության Կրիտիկական շեմին, եթե առանց մարդու միջամտության կարող է իրական աշխարհի բազմաթիվ ամրապնդված կրիտիկական համակարգերում հայտնաբերել և մշակել խոցելիության բոլոր աստիճանների գործուն զրոյական օրվա էքսփլոյթներ, կամ միայն ցանկալի նպատակի ընդհանուր ձևակերպման հիման վրա մշակել և սկզբից մինչև վերջ իրագործել ամրապնդված թիրախների դեմ կիբեռհարձակումների նոր ռազմավարություններ։
Թեև շարունակում ենք այս մոդելի համեմատական փորձարկումներն ու գնահատումը, մեր նախնական արդյունքները վկայում են այնքան բարձր արդյունավետության մասին, որ այս պահին չենք կարող բացառել Կրիտիկական կարողությունների մակարդակը։ Astra-ն առաջիկա մոդել է և չի մասնակցել Hugging Face-ի խոցելիության շահագործմանը։
Համապատասխանաբար, մենք ընդլայնել ենք մեր պաշտպանական միջոցների և անվտանգության վերահսկիչների կայունության փորձարկումները, որպեսզի դրանք համապատասխանեն այս կարողությունների ներդրմանը։ Մենք նաև ձեռնարկել ենք հետևյալ ներքին քայլերը, որպեսզի այս մոդելի հետագա մշակումը կատարվի ապահով և անվտանգ պայմաններում․
- Ավելի բարձր կարողություններով մոդելների և դրանց առնչվող աշխատանքների համար ներդնում ենք անվտանգության ավելի խիստ վերահսկիչներ, այդ թվում՝ մեկուսացված փորձարկման միջավայրեր, ցանցի ու գործիքների սահմանափակ հասանելիություն, մոդելի կշիռների ուժեղացված պաշտպանություն և գաղտնագրում, մշտադիտարկման ու հայտնաբերման լրացուցիչ կարողություններ և մեկուսացված միջավայրում կատարում։
- Մենք դադարեցնում ենք Astra-ի հետ կապված այն ներքին աշխատանքները, որոնք դեռ չեն համապատասխանում անվտանգության վերահսկման այս խստացված պահանջներին։
- Astra-ի բոլոր ագենտային կիրառություններում, ներառյալ ուսուցումն ու գնահատումը, ներդրել ենք ռիսկային գործողությունների և անհամապատասխան վարքի համընդհանուր մշտադիտարկում։ Մշտադիտարկման համակարգերը գնահատում են մոդելի Դատողությունների շղթան և անվտանգության արձագանք են գործարկում՝ բարձր ռիսկով գործողությունը ստուգելու և ընդհատելու համար։
- Մենք կհամագործակցենք համապատասխան պետական մարմինների և արհեստական բանականության անվտանգության ընտրված կազմակերպությունների հետ՝ այս մոդելի կարողությունները փորձարկելու համար։
- Երրորդ կողմ հանդիսացող փորձարկման գործընկերներին կտրամադրենք անվտանգության վերահսկիչների վերաբերյալ առաջարկություններ՝ ավելի բարձր ռիսկով գնահատումներն ու աշխատանքային բեռներն անվտանգ գործարկելու համար։
Շրջանակն արդեն ուղղորդել է մեզ կարողությունների այլ անցումային փուլերում։ 2025 թվականի հունիսին, երբ մեր մոդելները Պատրաստվածության շրջանակի համաձայն մոտենում էին կենսաբանության ոլորտում բարձր կարողությունների շեմին, մենք ներկայացրինք մեր ձեռնարկած քայլերը՝ պաշտպանական միջոցներն ամրապնդելու, փորձարկումներն ընդլայնելու, արտաքին փորձագետների հետ համագործակցելու և անվտանգության լրացուցիչ վերահսկիչներ ներդնելու համար։ Այստեղ ևս կիրառում ենք նույն սկզբունքը։
Մենք կարծում ենք, որ կիբեռկարողություններով օժտված առաջադեմ մոդելները պետք է օգնեն պաշտպաններին հայտնաբերել և վերացնել խոցելիությունները՝ նախքան հարձակվողները կօգտվեն դրանցից։ Մենք հանձնառու ենք համագործակցել կառավարությունների, անվտանգության ինստիտուտների և քաղաքացիական հասարակության հետ՝ ապահովելու, որ Astra-ի և դրան հաջորդող մոդելների առաջադեմ կարողությունները կիրառվեն պատասխանատու կերպով ու լայնորեն՝ ի շահ ողջ մարդկության։


