OpenAI styrker overvågning, tilpasning og sikkerhed for banebrydende AI-modeller. Se, hvordan nye sikkerhedsforanstaltninger styrer tempoet i modeludviklingen.
OpenAI deler nye resultater om uløste problemer i matematik og teoretisk datalogi, herunder fremskridt inden for geometri, kryptografi og kompleksitet.
Sådan forbedrede to API-indstillinger GPT-5.6 på ARC-AGI-3 med højere score og effektivitet via bevaret ræsonnering og komprimering.
En ny feltrapport viser, hvordan forskere bruger AI-kodningsagenter til at modernisere videnskabelig databehandling og fremskynde softwareudvikling og opdagelser i genomik m.m.
Udforsk GPT-Red, OpenAI’s automatiserede red-teaming-system, der bruger self-play til at forbedre AI-sikkerhed, alignment og robusthed mod prompt injection.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
En ny analyse fra OpenAI afslører problemer i SWE-Bench Pro, en populær benchmark for kodning, og rejser spørgsmål om pålidelighed og nøjagtighed ved evaluering af AI-modeller.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
Vi introducerer GeneBench-Pro, en ny benchmark, der tester AI-ydeevne inden for genomik, biologi og videnskabelig forskning ved hjælp af komplekse datasæt fra den virkelige verden.