We’re introducing GPT-6.1 Sol. GPT-6.1 is the latest model family in the GPT-6 series.
MentalHealthBench és un benchmark basat en criteris experts per avaluar respostes d'IA útils i segures en converses realistes sobre salut mental.
Compartim una solució generada per IA al problema de Navier–Stokes del Premi del Mil·lenni, amb una explicació i una demostració formal en Lean.
Els agents de programació transformen la recerca en IA a OpenAI. Descobreix dades sobre l'ús d'agents, el ritme d'experimentació, la complexitat de les tasques i el progrés.
Astra is our first model to reach the Critical level of cybersecurity capability under our Preparedness Framework.
OpenAI comparteix les conclusions de l’incident de seguretat de Hugging Face i les mesures que adoptem per reforçar la seguretat, la supervisió i l’alineació dels models d’IA.
OpenAI reforça la supervisió, l'alineament i la seguretat dels models d'IA d'avantguarda. Descobriu com les noves salvaguardes guien el ritme de desenvolupament dels models.
OpenAI presenta resultats sobre problemes oberts de llarga data en matemàtiques i informàtica teòrica, amb avenços en geometria, criptografia i complexitat.
Com dos paràmetres de l'API van millorar el rendiment de GPT-5.6 a ARC-AGI-3, augmentant la puntuació i l'eficiència amb el raonament conservat i la condensació de context.