Реагиране на следващата граница при критичните киберспособности
Киберсигурността се променя бързо, тъй като моделите придобиват все по-големи възможности, които могат както да укрепят киберзащитата, така и да позволят атаки с безпрецедентна скорост и мащаб.
Последните ни вътрешни оценки на Astra — един от предстоящите ни модели — през изминалите няколко дни показват значителен напредък в агентното кодиране и киберсигурността. Тези резултати, наред с експертните оценки, ни накараха снощи да заключим, че не можем да изключим наличието на критични киберспособности съгласно нашата Рамка за готовност(отваря се в нов прозорец).
Споделяме това, защото смятаме, че е важно да бъдем открити пред обществеността и общностите, работещи в областта на безопасността и сигурността, относно тази потенциална промяна във възможностите.
За първи път публикувахме нашата Рамка за готовност през декември 2023 г. — много преди моделите да се доближат до това ниво на възможности в биологията, химията, киберсигурността и самоусъвършенстването на ИИ. Създадохме я, за да ни служи като ориентир при установяването на напредъка във възможностите и планирането на действията на компанията ни с появата на тези възможности. Предишни модели, включително GPT‑5.6‑Sol, бяха оценени за авангардни киберспособности и определени като достигащи прага за „Високо“, а не „Критично“ ниво.
Съгласно нашата Рамка за готовност даден модел достига прага на „Критично“ ниво за киберсигурност, ако може без човешка намеса да открива и разработва работещи експлойти за уязвимости от нулевия ден с всякаква степен на сериозност в множество добре защитени реални критични системи или ако може да създава и изпълнява от начало до край нови стратегии за кибератаки срещу добре защитени цели само въз основа на общо формулирана желана цел.
Докато продължаваме сравнителните тестове и оценяването на този модел, предварителните ни оценки показват достатъчно висока производителност, така че на този етап не можем да изключим ниво на способностите „Критично“. Astra е предстоящ модел и не е участвал в атаката срещу Hugging Face.
Затова разширихме тестовете за устойчивост на защитните ни механизми и контролите за сигурност, така че те да са подходящи за внедряването на тези възможности. Предприехме и следните вътрешни стъпки, за да гарантираме безопасното и сигурно по-нататъшно разработване на този модел:
Въвеждаме по-строги контроли за сигурност за моделите с по-големи възможности и свързаните с тях дейности, включително изолирани тестови среди, ограничен достъп до мрежи и инструменти, засилена защита и криптиране на теглата на моделите, допълнителни възможности за наблюдение и откриване и изпълнение в изолирана среда.
Временно спираме вътрешните дейности, свързани с Astra, които все още не отговарят на тези по-строги изисквания за контрол на сигурността.
Въведохме цялостно наблюдение за рискови действия и несъответствие с целите във всички агентни приложения на Astra, включително при обучението и оценяването. Системите за наблюдение оценяват веригата от разсъждения на модела и задействат процедура за сигурност за преглед и прекъсване на високорискови дейности.
Ще работим със съответните държавни институции и избрани организации за безопасност на ИИ, за да тестваме възможностите на този модел.
Ще предоставим на външните си партньори за тестване препоръчителни контроли за сигурност, за да могат безопасно да извършват по-рискови оценки и работни натоварвания.
Рамката вече ни е помагала при други преходи към по-високи нива на способностите. През юни 2025 г., когато моделите ни се доближиха до прага на „Високо“ ниво за способности в областта на биологията съгласно Рамката за готовност, описахме стъпките, които предприемаме, за да укрепим защитните механизми, да разширим тестването, да работим с външни експерти и да внедрим допълнителни контроли за сигурност. И тук прилагаме същия принцип.
Смятаме, че усъвършенстваните модели с киберспособности трябва да помагат на защитниците да откриват и отстраняват уязвимости преди нападателите. Ангажирани сме да работим съвместно с правителства, институти за безопасност и гражданското общество, за да гарантираме, че авангардните способности на модели като Astra и техните наследници се внедряват отговорно и широко в полза на цялото човечество.

