We’re introducing GPT-6.1 Sol. GPT-6.1 is the latest model family in the GPT-6 series.
MentalHealthBench er et ekspertbaseret benchmark til at evaluere nyttige og sikre AI-svar i realistiske samtaler om psykisk sundhed.
Vi offentliggør en AI-genereret løsning på Navier–Stokes-Millenniumprisproblemet med en redegørelse og et formelt bevis i Lean.
Hos OpenAI er kodningsagenter ved at omforme AI-forskningen. Udforsk tidlige data om agentbrug, eksperimenthastighed, opgavekompleksitet og hurtigere forskning.
Astra is our first model to reach the Critical level of cybersecurity capability under our Preparedness Framework.
OpenAI deler resultater fra Hugging Face-sikkerhedshændelsen og de tiltag, vi iværksætter for at styrke AI-modelsikkerhed, overvågning og tilpasning.
OpenAI styrker overvågning, tilpasning og sikkerhed for banebrydende AI-modeller. Se, hvordan nye sikkerhedsforanstaltninger styrer tempoet i modeludviklingen.
OpenAI deler nye resultater om uløste problemer i matematik og teoretisk datalogi, herunder fremskridt inden for geometri, kryptografi og kompleksitet.
Sådan forbedrede to API-indstillinger GPT-5.6 på ARC-AGI-3 med højere score og effektivitet via bevaret ræsonnering og komprimering.