OpenAI styrker overvåking, tilpasning og sikkerhet for banebrytende KI-modeller. Se hvordan nye sikkerhetstiltak styrer tempoet i modellutviklingen.
OpenAI deler nye resultater om uløste problemer innen matematikk og teoretisk informatikk, med fremskritt innen geometri, kryptografi og kompleksitet.
Slik forbedret to API-innstillinger ytelsen til GPT-5.6 på ARC-AGI-3 ved å bevare resonnering og aktivere komprimering.
En ny feltrapport viser hvordan forskere bruker AI-kodeagenter til å modernisere vitenskapelig databehandling og fremskynde utvikling og oppdagelser innen genomikk og andre fag.
Utforsk GPT-Red, OpenAIs automatiserte red teaming-system som bruker selvspill til å forbedre KI-sikkerhet, alignment og robusthet mot promptinjeksjon.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
En ny analyse fra OpenAI avdekker problemer i SWE-Bench Pro, en populær kodebenchmark, og reiser spørsmål om pålitelighet og nøyaktighet i evaluering av KI-modeller.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
Vi introduserer GeneBench-Pro, en ny referansetest som tester KI-ytelse innen genomikk, biologi og vitenskapelig forskning ved hjelp av komplekse datasett fra den virkelige verden.