We’re introducing GPT-6.1 Sol. GPT-6.1 is the latest model family in the GPT-6 series.
MentalHealthBench es una evaluación comparativa basada en expertos para evaluar respuestas útiles y seguras de la IA en conversaciones realistas sobre salud mental.
Compartimos una solución generada por IA al problema del milenio de Navier–Stokes, con una exposición y una demostración formal en Lean.
Los agentes de programación transforman la investigación en OpenAI. Explora los primeros datos sobre su uso, el ritmo de experimentación, la complejidad de tareas y los avances.
Astra is our first model to reach the Critical level of cybersecurity capability under our Preparedness Framework.
OpenAI comparte hallazgos del incidente de seguridad de Hugging Face y las medidas que estamos tomando para reforzar la seguridad, la supervisión y la alineación de los modelos de IA.
OpenAI refuerza la supervisión, la alineación y la seguridad de los modelos de IA de vanguardia. Descubre cómo las nuevas salvaguardas marcan el ritmo de desarrollo de los modelos.
OpenAI presenta nuevos resultados sobre problemas abiertos de larga data en matemáticas e informática teórica, con avances en geometría, criptografía y complejidad.
Cómo dos ajustes de la API mejoraron GPT-5.6 en ARC-AGI-3 al aumentar la puntuación y la eficiencia mediante el razonamiento conservado y la compactación.