Zum Hauptinhalt springen
OpenAI

7. August 2026

Sicherheit

Umgang mit der nächsten Stufe kritischer Cyberfähigkeiten

Laden …

Die Cybersicherheit verändert sich rasant: Leistungsfähigere Modelle können die Cyberabwehr stärken, aber auch Angriffe in bislang unerreichter Geschwindigkeit und Größenordnung ermöglichen.

Unsere jüngsten internen Bewertungen von Astra, einem unserer kommenden Modelle, die wir in den vergangenen Tagen durchgeführt haben, deuten auf erhebliche Fortschritte beim agentischen Programmieren und in der Cybersicherheit hin. Diese Ergebnisse und Einschätzungen von Fachleuten führten uns gestern Abend zu dem Schluss, dass wir kritische Cyberfähigkeiten gemäß unserem Preparedness Framework(wird in einem neuen Fenster geöffnet) nicht ausschließen können.

Wir veröffentlichen diese Informationen, weil wir die Öffentlichkeit sowie Fachkreise für Schutz und Sicherheit transparent über diese mögliche Veränderung der Fähigkeiten informieren möchten.

Wir haben unser Preparedness Framework erstmals im Dezember 2023 veröffentlicht, lange bevor sich Modelle in den Bereichen Biologie, Chemie, Cybersicherheit und KI-Selbstverbesserung einem solchen Fähigkeitsniveau näherten. Es dient uns als Leitfaden, um Fortschritte bei den Fähigkeiten zu erkennen und zu planen, wie unser Unternehmen beim Auftreten dieser Fähigkeiten vorgeht. Frühere Modelle, darunter GPT‑5.6‑Sol, wurden auf Frontier-Cyberfähigkeiten geprüft und dem Schwellenwert Hoch statt Kritisch zugeordnet.

Kritische Cybersicherheitsfähigkeiten messen 

Nach unserem Preparedness Framework erreicht ein Modell den kritischen Schwellenwert für Cybersicherheit, wenn es ohne menschliches Eingreifen in vielen gehärteten, real eingesetzten kritischen Systemen funktionsfähige Zero-Day-Exploits sämtlicher Schweregrade identifizieren und entwickeln kann. Gleiches gilt, wenn es allein anhand eines übergeordneten Ziels neuartige End-to-End-Strategien für Cyberangriffe auf gehärtete Ziele entwickeln und ausführen kann. 

Während wir dieses Modell weiter anhand von Benchmarks prüfen und bewerten, zeigen unsere vorläufigen Untersuchungen eine so hohe Leistung, dass wir die Fähigkeitsstufe Kritisch derzeit nicht ausschließen können. Astra ist ein kommendes Modell und war nicht an der Kompromittierung von Hugging Face beteiligt. 

Unsere Maßnahmen

Daher haben wir die Belastbarkeitstests unserer Schutzvorkehrungen und Sicherheitskontrollen ausgeweitet, damit sie für die Bereitstellung dieser Fähigkeiten geeignet sind. Intern haben wir außerdem folgende Maßnahmen ergriffen, damit die weitere Entwicklung dieses Modells sicher erfolgt: 

  • Wir führen strengere Sicherheitskontrollen für leistungsfähigere Modelle und damit verbundene Aktivitäten ein. Dazu gehören isolierte Testumgebungen, eingeschränkter Netzwerk- und Werkzeugzugriff, verbesserter Schutz und Verschlüsselung der Modellgewichte, zusätzliche Überwachungs- und Erkennungsfunktionen sowie die Ausführung in Sandbox-Umgebungen.
  • Wir setzen interne Aktivitäten mit Astra aus, die diese verschärften Anforderungen an die Sicherheitskontrollen noch nicht erfüllen.
  • Für sämtliche agentischen Anwendungen von Astra, einschließlich Training und Bewertung, haben wir eine umfassende Überwachung riskanter Handlungen und möglicher Fehlausrichtungen eingeführt. Überwachungssysteme bewerten den Gedankengang des Modells und lösen eine Sicherheitsreaktion aus, um besonders riskante Aktivitäten zu prüfen und zu unterbrechen.
  • Wir werden mit den zuständigen Behörden und ausgewählten Organisationen für KI-Sicherheit zusammenarbeiten, um die Fähigkeiten dieses Modells zu testen.
  • Externen Testpartnern werden wir Sicherheitskontrollen empfehlen, mit denen sie risikoreichere Bewertungen und Workloads sicher ausführen können. 

Das Framework hat uns bereits durch andere Übergänge bei den Fähigkeiten geleitet. Als sich unsere Modelle im Juni 2025 gemäß dem Preparedness Framework dem biologischen Schwellenwert Hoch näherten, haben wir unsere geplanten Maßnahmen vorgestellt: Schutzvorkehrungen stärken, Tests ausweiten, mit externen Fachleuten zusammenarbeiten und zusätzliche Sicherheitskontrollen einführen. Hier wenden wir dasselbe Prinzip an.

Wir sind überzeugt, dass fortschrittliche Modelle mit Cyberfähigkeiten Verteidigungsteams dabei unterstützen sollten, Schwachstellen vor Angreifenden zu erkennen und zu beheben. Wir arbeiten eng mit Regierungen, Sicherheitsinstituten und der Zivilgesellschaft zusammen, damit die Frontier-Fähigkeiten von Modellen wie Astra und ihren Nachfolgern verantwortungsvoll eingesetzt werden und möglichst der gesamten Menschheit zugutekommen.

Autor

OpenAI