Одговор на нову границу критичних сајбер способности
Сајбер безбедност се брзо мења јер модели постају способнији на начине који могу и да ојачају сајбер одбрану и да омогуће нападе невиђеном брзином и у невиђеним размерама.
Наше најновије интерне евалуације модела Astra, једног од наших предстојећих модела, током последњих неколико дана указују на значајан напредак у програмирању од стране агента и сајбер безбедности. Ови резултати, уз процене стручњака, навели су нас да синоћ закључимо да не можемо искључити критичне сајбер способности према нашем Оквиру спремности(отвара се у новом прозору).
Ово објављујемо јер сматрамо да је важно да јавност и заједнице посвећене безбедности буду обавештене о овој потенцијалној промени способности.
Наш Оквир спремности први пут смо објавили у децембру 2023, знатно пре него што су се модели приближили овом нивоу биолошких, хемијских и сајбер способности, као и способности самопобољшања вештачке интелигенције. Осмислили смо га као смернице за препознавање напретка способности и планирање корака које би наша компанија предузимала како се те способности буду појављивале. Претходни модели, укључујући GPT‑5.6‑Sol, оцењивани су у погледу граничних сајбер способности и сврстани на праг „високо“, а не „критично“.
Према нашем Оквиру спремности, модел достиже критични праг у сајбер безбедности ако без људске интервенције може да пронађе и развије функционалне експлоите за рањивости нултог дана свих нивоа озбиљности у великом броју ојачаних критичних система из стварног света или ако, само на основу општег жељеног циља, може да осмисли и спроведе потпуно нове стратегије сајбер напада на ојачане мете.
Док настављамо да тестирамо и процењујемо овај модел, наши прелиминарни резултати указују на довољно добре перформансе да тренутно не можемо искључити критични ниво способности. Astra је предстојећи модел и није учествовала у искоришћавању рањивости платформе Hugging Face.
Зато смо проширили тестирање отпорности наших заштитних мера и безбедносних контрола како би оне биле примерене примени ових способности. Интерно смо предузели и следеће кораке како би даљи развој овог модела био безбедан и заштићен:
- Уводимо строже безбедносне контроле за способније моделе и повезане активности, укључујући изолована окружења за тестирање, ограничен приступ мрежи и алатима, унапређену заштиту и шифровање тежина модела, додатне могућности надзора и откривања, као и извршавање у изолованом окружењу.
- Привремено обустављамо интерне активности које укључују модел Astra, а које још не испуњавају ове пооштрене захтеве за безбедносне контроле.
- Увели смо свеобухватан надзор ризичних радњи и неусклађености у свим применама модела Astra заснованим на агентима, укључујући обуку и евалуацију. Системи за надзор процењују ланац размишљања модела и покрећу безбедносни одговор ради провере и прекида активности високог ризика.
- Сарађиваћемо са надлежним државним органима и одабраним организацијама за безбедност вештачке интелигенције како бисмо тестирали способности овог модела.
- Независним партнерима за тестирање даћемо препоручене безбедносне контроле за сигурно спровођење ризичнијих евалуација и радних оптерећења.
Овај оквир нас је већ усмеравао током других прелаза на нове нивое способности. У јуну 2025, када су се наши модели приближили високом прагу биолошких способности према Оквиру спремности, представили смо кораке које предузимамо ради јачања заштитних мера, проширења тестирања, сарадње са спољним стручњацима и увођења додатних безбедносних контрола. И овде примењујемо исти принцип.
Сматрамо да напредни модели са сајбер способностима треба да помогну браниоцима да пронађу и отклоне рањивости пре него што их нападачи искористе. Посвећени смо сарадњи са владама, институтима за безбедност и цивилним друштвом како бисмо обезбедили да се граничне способности модела као што је Astra, као и њихових наследника, примењују одговорно и широко, на добробит целог човечанства.


