Passer au contenu principal
OpenAI

7 août 2026

Cybersécurité

Réagir à la prochaine frontière des cybercapacités critiques

Chargement…

La cybersécurité évolue rapidement à mesure que les modèles gagnent en capacités, ce qui peut à la fois renforcer les cyberdéfenses et permettre des attaques d’une rapidité et d’une ampleur sans précédent.

Nos plus récentes évaluations internes d’Astra, l’un de nos prochains modèles, menées au cours des derniers jours, indiquent des avancées importantes en programmation agentique et en cybersécurité. Ces résultats, ainsi que les évaluations d’experts, nous ont amenés à conclure hier soir que nous ne pouvions pas exclure des cybercapacités critiques selon notre cadre de préparation(s'ouvre dans une nouvelle fenêtre).

Nous communiquons cette information parce que nous croyons qu’il est important de faire preuve de transparence auprès du public et des communautés de la sûreté et de la sécurité quant à cette évolution potentielle des capacités.

Nous avons publié notre cadre de préparation pour la première fois en décembre 2023, bien avant que les modèles n’approchent de ce niveau de capacités en biologie, en chimie, en cybersécurité et en autoamélioration de l’IA. Nous l’avons créé pour nous guider dans la détection des progrès en matière de capacités, puis dans la planification des mesures que notre entreprise prendrait à mesure que ces capacités émergeraient. Les modèles précédents, dont GPT‑5.6‑Sol, ont été évalués quant à leurs cybercapacités de pointe et classés au seuil Élevé (plutôt que Critique).

Mesurer les capacités critiques en cybersécurité 

Selon notre cadre de préparation, un modèle atteint le seuil Critique en cybersécurité s’il peut, sans intervention humaine, repérer et mettre au point des exploits fonctionnels de vulnérabilités jour zéro de tous les niveaux de gravité dans de nombreux systèmes critiques réels et renforcés, ou concevoir et exécuter de bout en bout de nouvelles stratégies de cyberattaque contre des cibles renforcées à partir d’un simple objectif général. 

Pendant que nous poursuivons l’analyse comparative et l’évaluation de ce modèle, nos évaluations préliminaires indiquent un rendement suffisamment élevé pour que nous ne puissions pas exclure, à ce stade, le niveau de capacité Critique. Astra est un modèle à venir et n’a pas participé à l’exploitation de Hugging Face. 

Mesures que nous prenons

Par conséquent, nous avons intensifié les tests de robustesse de nos mesures de protection et de nos contrôles de sécurité afin qu’ils conviennent au déploiement de ces capacités. À l’interne, nous avons également pris les mesures suivantes afin que la poursuite du développement de ce modèle se fasse de façon sûre et sécuritaire : 

  • Nous mettons en œuvre des contrôles de sécurité plus stricts pour les modèles aux capacités supérieures et les activités connexes, notamment des environnements de test isolés, un accès restreint aux réseaux et aux outils, une protection et un chiffrement accrus des poids des modèles, des capacités supplémentaires de surveillance et de détection ainsi qu’une exécution en bac à sable.
  • Nous suspendons les activités internes liées à Astra qui ne satisfont pas encore à ces exigences renforcées en matière de contrôles de sécurité.
  • Nous avons mis en place une surveillance universelle des actions risquées et des défauts d’alignement dans toutes les applications agentiques d’Astra, y compris lors de l’entraînement et de l’évaluation. Les systèmes de surveillance évaluent la chaîne de pensée du modèle et déclenchent une intervention de sécurité afin d’examiner et d’interrompre les activités à haut risque.
  • Nous collaborerons avec les organismes gouvernementaux concernés et certains organismes de sûreté de l’IA afin de tester les capacités de ce modèle.
  • Nous fournirons aux partenaires de test tiers des contrôles de sécurité recommandés afin qu’ils puissent exécuter en toute sécurité les évaluations et les charges de travail présentant des risques plus élevés. 

Le cadre nous a déjà guidés lors d’autres transitions en matière de capacités. En juin 2025, alors que nos modèles approchaient du seuil de capacités élevées en biologie selon le cadre de préparation, nous avons présenté les mesures que nous prenions pour renforcer les mesures de protection, élargir les tests, collaborer avec des experts externes et déployer des contrôles de sécurité supplémentaires. Nous appliquons ici le même principe.

Nous croyons que les modèles dotés de cybercapacités avancées devraient aider les défenseurs à repérer et à corriger les vulnérabilités avant les attaquants. Nous nous engageons à collaborer avec les gouvernements, les instituts de sûreté et la société civile afin de veiller à ce que les capacités de pointe de modèles comme Astra, et de ceux qui suivront, soient déployées de façon responsable et généralisée au bénéfice de toute l’humanité.

Auteur

OpenAI