OpenAI is strengthening monitoring, alignment, and security for frontier AI models. See how new safeguards are guiding the pace of model development.
OpenAI präsentiert neue Ergebnisse zu offenen Problemen in Mathematik und theoretischer Informatik, darunter Fortschritte in Geometrie, Kryptografie und Komplexität.
Wie zwei API-Einstellungen die Performance von GPT-5.6 bei ARC-AGI-3 steigerten – mit höheren Scores und mehr Effizienz durch beibehaltenes Reasoning und aktivierte Compaction.
Ein neuer Praxisbericht zeigt, wie Forschende mit KI-Coding-Agenten wissenschaftliche Software modernisieren und Entwicklung sowie Forschung in der Genomik beschleunigen.
Lerne GPT-Red kennen, OpenAIs automatisiertes Red-Teaming-System, das mit Self-Play KI-Sicherheit, Alignment und Robustheit gegen Prompt Injection verbessert.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
Eine neue OpenAI-Analyse zeigt Probleme in SWE-Bench Pro, einem gängigen Coding-Benchmark, und damit Zweifel an der Zuverlässigkeit und Genauigkeit der KI-Modell-Bewertung.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
GeneBench-Pro ist ein neuer Benchmark, der KI-Leistung in Genomik, Biologie und Forschung anhand komplexer, realitätsnaher Datensätze testet.