OpenAI is strengthening monitoring, alignment, and security for frontier AI models. See how new safeguards are guiding the pace of model development.
OpenAI presenterar nya resultat om öppna problem inom matematik och teoretisk datavetenskap, med framsteg inom geometri, kryptografi och komplexitet.
Så förbättrade två API-inställningar GPT-5.6 i ARC-AGI-3 genom att bevara resonemang och aktivera komprimering, vilket höjde poängen och effektiviteten.
En ny fältrapport visar hur forskare använder kodningsagenter för att modernisera vetenskapliga beräkningar och påskynda utveckling och upptäckter inom genometik och andra områden.
Utforska GPT-Red, OpenAI:s automatiserade red teaming-system som använder självspel för att förbättra AI-säkerhet, anpassning och robusthet mot promptinjektioner.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
En ny analys från OpenAI avslöjar problem i SWE-Bench Pro, ett populärt riktmärke för kodning, och väcker frågor om tillförlitlighet och precision vid utvärdering av AI-modeller.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
Vi introducerar GeneBench-Pro, ett nytt benchmark som testar AI-prestanda inom genomik, biologi och forskning med komplexa, verkliga dataset.