OpenAI is strengthening monitoring, alignment, and security for frontier AI models. See how new safeguards are guiding the pace of model development.
OpenAI przedstawia nowe wyniki dotyczące otwartych problemów matematyki i informatyki teoretycznej, w tym postępy w geometrii, kryptografii i teorii złożoności.
Jak zachowywanie rozumowania i kompaktowanie poprawiły wyniki oraz wydajność GPT-5.6 w ARC-AGI-3.
Nowy raport pokazuje, jak agenci programistyczni AI pomagają naukowcom modernizować obliczenia naukowe oraz przyspieszać rozwój oprogramowania i odkrycia w genomice.
Poznaj GPT-Red, zautomatyzowany system kontrolowanych ataków OpenAI, który dzięki self-play zwiększa bezpieczeństwo AI, dostosowanie do celów i odporność na wstrzykiwanie poleceń.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
Nowa analiza OpenAI ujawnia problemy w SWE-Bench Pro, popularnym benchmarku kodowania, budząc obawy o wiarygodność i dokładność oceny modeli AI.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
GeneBench-Pro: nowy benchmark oceniający działania AI w genomice, biologii i badaniach naukowych na złożonych, realistycznych zbiorach danych.