OpenAI versterkt monitoring, afstemming en beveiliging voor grensverleggende AI-modellen. Lees hoe nieuwe waarborgen het tempo van modelontwikkeling bepalen.
OpenAI deelt nieuwe resultaten voor langlopende open problemen in de wiskunde en theoretische informatica, met vooruitgang in meetkunde, cryptografie en complexiteit.
Hoe twee API-instellingen de prestaties van GPT-5.6 op ARC-AGI-3 verbeterden met hogere scores en efficiëntie dankzij behoud van redenering en compaction.
Een nieuw veldrapport toont hoe wetenschappers AI-programmeeragents inzetten om softwareontwikkeling en ontdekkingen in genomica en andere vakgebieden te versnellen.
Ontdek GPT-Red, OpenAI's geautomatiseerde red-teaming-systeem dat self-play gebruikt om AI-veiligheid, alignment en robuustheid tegen prompt-injecties te verbeteren.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
Een nieuwe OpenAI-analyse onthult problemen met SWE-Bench Pro, een populaire programmeerbenchmark, en roept twijfels op over de betrouwbare evaluatie van AI-modellen.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
Dit is GeneBench-Pro: een nieuwe benchmark die AI-prestaties in de genomica, biologie en wetenschap test met complexe, realistische datasets.