Перейти до основного вмісту
OpenAI

7 серпня 2026 р.

Захист

Реагування на новий рубіж критичних кіберможливостей

Завантаження…

Кібербезпека стрімко змінюється зі зростанням можливостей моделей, які можуть як посилювати кіберзахист, так і уможливлювати атаки з безпрецедентною швидкістю та в небачених масштабах.

Наші останні внутрішні оцінювання Astra, однієї з наших майбутніх моделей, проведені протягом останніх кількох днів, свідчать про значний прогрес в автономній розробці коду та кібербезпеці. Ці результати разом з оцінками експертів учора ввечері привели нас до висновку, що ми не можемо виключити наявність критичних кіберможливостей за нашою рамковою системою готовності(відкривається у новому вікні).

Ми повідомляємо про це, оскільки вважаємо важливою прозорість перед громадськістю та спільнотами у сферах безпеки й захисту щодо цієї потенційної зміни можливостей.

Ми вперше опублікували рамкову систему готовності в грудні 2023 року — задовго до того, як моделі наблизилися до такого рівня можливостей у біології, хімії, кібербезпеці та самовдосконаленні ШІ. Ми створили її як орієнтир для виявлення прогресу в можливостях і планування дій нашої компанії в міру їх появи. Попередні моделі, зокрема GPT‑5.6‑Sol, оцінювали на наявність передових кіберможливостей і відносили до порогового рівня «Високий», а не «Критичний».

Вимірювання критичних можливостей у сфері кібербезпеки 

За нашою рамковою системою готовності модель досягає порога «Критичний» у сфері кібербезпеки, якщо без втручання людини може виявляти й розробляти дієві експлойти нульового дня всіх рівнів серйозності для багатьох добре захищених критично важливих реальних систем або розробляти й реалізовувати від початку до кінця нові стратегії кібератак проти захищених цілей, маючи лише загальний опис бажаної мети. 

Поки ми продовжуємо тестувати й оцінювати цю модель, попередні результати свідчать про настільки високу ефективність, що наразі ми не можемо виключити рівень можливостей «Критичний». Astra — це майбутня модель, яка не була причетна до експлуатації вразливостей Hugging Face. 

Заходи, яких ми вживаємо

Відповідно, ми розширили перевірку надійності наших запобіжних заходів і засобів контролю безпеки, щоб вони відповідали вимогам до розгортання систем із такими можливостями. Ми також ужили таких внутрішніх заходів, щоб подальша розробка цієї моделі відбувалася безпечно та надійно: 

  • Ми впроваджуємо суворіші засоби контролю безпеки для моделей із розширеними можливостями та пов’язаної з ними діяльності, зокрема ізольовані середовища тестування, обмежений доступ до мережі й інструментів, посилений захист і шифрування ваг моделі, додаткові засоби моніторингу та виявлення, а також виконання в ізольованому середовищі.
  • Ми призупиняємо внутрішню діяльність із використанням Astra, яка ще не відповідає цим посиленим вимогам контролю безпеки.
  • Ми запровадили універсальний моніторинг ризикованих дій і невідповідності цілям у всіх застосуваннях Astra в ролі агента, зокрема під час навчання та оцінювання. Засоби моніторингу оцінюють ланцюжок міркувань моделі та запускають процедуру безпекового реагування для перевірки й припинення діяльності з високим рівнем ризику.
  • Ми співпрацюватимемо з відповідними державними установами та окремими організаціями з безпеки ШІ для тестування можливостей цієї моделі.
  • Ми надамо стороннім партнерам із тестування рекомендації щодо засобів контролю безпеки для безпечного проведення оцінювань і виконання робочих навантажень із підвищеним ризиком. 

Ця рамкова система вже допомогла нам пройти через інші переходи на нові рівні можливостей. У червні 2025 року, коли наші моделі наблизилися до високого порога біологічних можливостей за рамковою системою готовності, ми описали заходи, яких уживали, щоб посилити запобіжні заходи, розширити тестування, залучити зовнішніх експертів і впровадити додаткові засоби контролю безпеки. Тут ми застосовуємо той самий принцип.

Ми вважаємо, що передові моделі з кіберможливостями мають допомагати фахівцям із кіберзахисту виявляти й усувати вразливості раніше за зловмисників. Ми прагнемо співпрацювати з урядами, інститутами безпеки та громадянським суспільством, щоб передові можливості таких моделей, як Astra, і їхніх наступників упроваджувалися відповідально та широко — на благо всього людства.

Автор

OpenAI