Как мы реагируем на новый уровень критических кибервозможностей
Кибербезопасность стремительно меняется по мере того, как модели приобретают новые возможности, способные как укрепить киберзащиту, так и обеспечить беспрецедентные скорость и масштаб атак.
Последние внутренние оценки Astra — одной из наших будущих моделей, проведенные за последние несколько дней, — указывают на значительный прогресс в агентном программировании и кибербезопасности. Эти результаты в сочетании с оценками экспертов позволили нам вчера вечером заключить, что в рамках нашей Программы готовности(открывается в новом окне) мы не можем исключить наличие критических кибервозможностей.
Мы сообщаем об этом, поскольку считаем важным открыто информировать общественность и специалистов по безопасности об этом потенциальном изменении возможностей.
Мы впервые опубликовали Программу готовности в декабре 2023 года, задолго до того, как модели приблизились к этому уровню возможностей в биологии, химии, кибербезопасности и самосовершенствовании ИИ. Мы создали ее как руководство, которое помогает выявлять развитие возможностей и планировать действия нашей компании по мере их появления. Предыдущие модели, включая GPT‑5.6‑Sol, оценивались на наличие передовых кибервозможностей и достигли порогового уровня «Высокий», а не «Критический».
Согласно нашей Программе готовности, модель достигает критического порога в кибербезопасности, если она способна без участия человека находить и создавать работоспособные эксплойты нулевого дня любой степени опасности для множества хорошо защищенных критически важных систем, используемых в реальных условиях, либо самостоятельно разрабатывать и полностью реализовывать новые стратегии кибератак на хорошо защищенные цели, имея лишь общее описание желаемого результата.
Мы продолжаем тестировать и оценивать эту модель, однако предварительные результаты уже настолько высоки, что сейчас мы не можем исключить достижение критического уровня возможностей. Astra — будущая модель, и она не участвовала во взломе Hugging Face.
В связи с этим мы расширили проверку надежности наших защитных механизмов и средств контроля безопасности, чтобы они соответствовали развертыванию таких возможностей. Мы также приняли следующие внутренние меры, чтобы дальнейшая разработка этой модели велась безопасно и надежно:
- Мы внедряем более строгие меры безопасности для моделей с расширенными возможностями и связанных с ними работ. В их числе изолированные среды тестирования, ограниченный доступ к сетям и инструментам, усиленная защита и шифрование весов модели, дополнительные средства мониторинга и обнаружения угроз, а также выполнение в изолированной среде.
- Мы приостанавливаем внутренние работы с Astra, которые пока не соответствуют этим усиленным требованиям безопасности.
- Мы внедрили всеобщий мониторинг рискованных действий и отклонений от заданных целей во всех агентных сценариях использования Astra, включая обучение и оценку. Системы мониторинга анализируют цепочку рассуждений модели и при обнаружении действий с высоким уровнем риска запускают процедуру безопасности для их проверки и пресечения.
- Мы будем сотрудничать с соответствующими государственными ведомствами и отдельными организациями по безопасности ИИ при тестировании возможностей этой модели.
- Мы предоставим сторонним партнерам по тестированию рекомендации по мерам безопасности для безопасного проведения оценок и выполнения задач повышенного риска.
Эта программа уже помогала нам при переходе моделей на другие уровни возможностей. В июне 2025 года, когда наши модели приблизились к высокому порогу биологических возможностей по Программе готовности, мы описали принимаемые меры по усилению защитных механизмов, расширению тестирования, сотрудничеству с внешними экспертами и внедрению дополнительных средств контроля безопасности. Здесь мы руководствуемся тем же принципом.
Мы считаем, что модели с развитыми кибервозможностями должны помогать специалистам по защите находить и устранять уязвимости раньше злоумышленников. Мы намерены сотрудничать с правительствами, институтами безопасности и гражданским обществом, чтобы передовые возможности таких моделей, как Astra, и последующих моделей внедрялись ответственно, широко применялись и приносили пользу всему человечеству.


