Реагиране на следващата граница при критичните киберспособности
Киберсигурността се променя бързо, тъй като моделите придобиват все по-големи възможности, които могат както да укрепят киберзащитата, така и да позволят атаки с безпрецедентна скорост и мащаб.
Последните ни вътрешни оценки на Astra — един от предстоящите ни модели — през изминалите няколко дни показват значителен напредък в агентното кодиране и киберсигурността. Тези резултати, наред с експертните оценки, ни накараха снощи да заключим, че не можем да изключим наличието на критични киберспособности съгласно нашата Рамка за готовност(отваря се в нов прозорец).
Споделяме това, защото смятаме, че е важно да бъдем открити пред обществеността и общностите, работещи в областта на безопасността и сигурността, относно тази потенциална промяна във възможностите.
За първи път публикувахме нашата Рамка за готовност през декември 2023 г. — много преди моделите да се доближат до това ниво на възможности в биологията, химията, киберсигурността и самоусъвършенстването на ИИ. Създадохме я, за да ни служи като ориентир при установяването на напредъка във възможностите и планирането на действията на компанията ни с появата на тези възможности. Предишни модели, включително GPT‑5.6‑Sol, бяха оценени за авангардни киберспособности и определени като достигащи прага за „Високо“, а не „Критично“ ниво.
Съгласно нашата Рамка за готовност даден модел достига прага на „Критично“ ниво за киберсигурност, ако може без човешка намеса да открива и разработва работещи експлойти за уязвимости от нулевия ден с всякаква степен на сериозност в множество добре защитени реални критични системи или ако може да създава и изпълнява от начало до край нови стратегии за кибератаки срещу добре защитени цели само въз основа на общо формулирана желана цел.
Докато продължаваме сравнителните тестове и оценяването на този модел, предварителните ни оценки показват достатъчно висока производителност, така че на този етап не можем да изключим ниво на способностите „Критично“. Astra е предстоящ модел и не е участвал в атаката срещу Hugging Face.
Затова разширихме тестовете за устойчивост на защитните ни механизми и контролите за сигурност, така че те да са подходящи за внедряването на тези възможности. Предприехме и следните вътрешни стъпки, за да гарантираме безопасното и сигурно по-нататъшно разработване на този модел:
- Въвеждаме по-строги контроли за сигурност за моделите с по-големи възможности и свързаните с тях дейности, включително изолирани тестови среди, ограничен достъп до мрежи и инструменти, засилена защита и криптиране на теглата на моделите, допълнителни възможности за наблюдение и откриване и изпълнение в изолирана среда.
- Временно спираме вътрешните дейности, свързани с Astra, които все още не отговарят на тези по-строги изисквания за контрол на сигурността.
- Въведохме цялостно наблюдение за рискови действия и несъответствие с целите във всички агентни приложения на Astra, включително при обучението и оценяването. Системите за наблюдение оценяват веригата от разсъждения на модела и задействат процедура за сигурност за преглед и прекъсване на високорискови дейности.
- Ще работим със съответните държавни институции и избрани организации за безопасност на ИИ, за да тестваме възможностите на този модел.
- Ще предоставим на външните си партньори за тестване препоръчителни контроли за сигурност, за да могат безопасно да извършват по-рискови оценки и работни натоварвания.
Рамката вече ни е помагала при други преходи към по-високи нива на способностите. През юни 2025 г., когато моделите ни се доближиха до прага на „Високо“ ниво за способности в областта на биологията съгласно Рамката за готовност, описахме стъпките, които предприемаме, за да укрепим защитните механизми, да разширим тестването, да работим с външни експерти и да внедрим допълнителни контроли за сигурност. И тук прилагаме същия принцип.
Смятаме, че усъвършенстваните модели с киберспособности трябва да помагат на защитниците да откриват и отстраняват уязвимости преди нападателите. Ангажирани сме да работим съвместно с правителства, институти за безопасност и гражданското общество, за да гарантираме, че авангардните способности на модели като Astra и техните наследници се внедряват отговорно и широко в полза на цялото човечество.


