Переход к основному контенту
OpenAI

7 августа 2026 г.

Защита

Как мы реагируем на новый уровень критических кибервозможностей

Загрузка…

Кибербезопасность стремительно меняется по мере того, как модели приобретают новые возможности, способные как укрепить киберзащиту, так и обеспечить беспрецедентные скорость и масштаб атак.

Последние внутренние оценки Astra — одной из наших будущих моделей, проведенные за последние несколько дней, — указывают на значительный прогресс в агентном программировании и кибербезопасности. Эти результаты в сочетании с оценками экспертов позволили нам вчера вечером заключить, что в рамках нашей Программы готовности(открывается в новом окне) мы не можем исключить наличие критических кибервозможностей.

Мы сообщаем об этом, поскольку считаем важным открыто информировать общественность и специалистов по безопасности об этом потенциальном изменении возможностей.

Мы впервые опубликовали Программу готовности в декабре 2023 года, задолго до того, как модели приблизились к этому уровню возможностей в биологии, химии, кибербезопасности и самосовершенствовании ИИ. Мы создали ее как руководство, которое помогает выявлять развитие возможностей и планировать действия нашей компании по мере их появления. Предыдущие модели, включая GPT‑5.6‑Sol, оценивались на наличие передовых кибервозможностей и достигли порогового уровня «Высокий», а не «Критический».

Оценка критических возможностей в кибербезопасности 

Согласно нашей Программе готовности, модель достигает критического порога в кибербезопасности, если она способна без участия человека находить и создавать работоспособные эксплойты нулевого дня любой степени опасности для множества хорошо защищенных критически важных систем, используемых в реальных условиях, либо самостоятельно разрабатывать и полностью реализовывать новые стратегии кибератак на хорошо защищенные цели, имея лишь общее описание желаемого результата. 

Мы продолжаем тестировать и оценивать эту модель, однако предварительные результаты уже настолько высоки, что сейчас мы не можем исключить достижение критического уровня возможностей. Astra — будущая модель, и она не участвовала во взломе Hugging Face. 

Наши меры

В связи с этим мы расширили проверку надежности наших защитных механизмов и средств контроля безопасности, чтобы они соответствовали развертыванию таких возможностей. Мы также приняли следующие внутренние меры, чтобы дальнейшая разработка этой модели велась безопасно и надежно: 

  • Мы внедряем более строгие меры безопасности для моделей с расширенными возможностями и связанных с ними работ. В их числе изолированные среды тестирования, ограниченный доступ к сетям и инструментам, усиленная защита и шифрование весов модели, дополнительные средства мониторинга и обнаружения угроз, а также выполнение в изолированной среде.
  • Мы приостанавливаем внутренние работы с Astra, которые пока не соответствуют этим усиленным требованиям безопасности.
  • Мы внедрили всеобщий мониторинг рискованных действий и отклонений от заданных целей во всех агентных сценариях использования Astra, включая обучение и оценку. Системы мониторинга анализируют цепочку рассуждений модели и при обнаружении действий с высоким уровнем риска запускают процедуру безопасности для их проверки и пресечения.
  • Мы будем сотрудничать с соответствующими государственными ведомствами и отдельными организациями по безопасности ИИ при тестировании возможностей этой модели.
  • Мы предоставим сторонним партнерам по тестированию рекомендации по мерам безопасности для безопасного проведения оценок и выполнения задач повышенного риска. 

Эта программа уже помогала нам при переходе моделей на другие уровни возможностей. В июне 2025 года, когда наши модели приблизились к высокому порогу биологических возможностей по Программе готовности, мы описали принимаемые меры по усилению защитных механизмов, расширению тестирования, сотрудничеству с внешними экспертами и внедрению дополнительных средств контроля безопасности. Здесь мы руководствуемся тем же принципом.

Мы считаем, что модели с развитыми кибервозможностями должны помогать специалистам по защите находить и устранять уязвимости раньше злоумышленников. Мы намерены сотрудничать с правительствами, институтами безопасности и гражданским обществом, чтобы передовые возможности таких моделей, как Astra, и последующих моделей внедрялись ответственно, широко применялись и приносили пользу всему человечеству.

Автор

OpenAI