OpenAI refuerza el monitoreo, la alineación y la seguridad de los modelos de IA de vanguardia. Descubre cómo las nuevas salvaguardas orientan el ritmo de desarrollo de modelos.
OpenAI presenta resultados sobre problemas abiertos de larga data en matemáticas e informática teórica, con avances en geometría, criptografía y complejidad.
Cómo dos ajustes de la API mejoraron GPT-5.6 en ARC-AGI-3 al aumentar la puntuación y la eficiencia mediante el razonamiento conservado y la compactación.
Un informe muestra cómo los científicos usan agentes de codificación de IA para modernizar la computación científica y acelerar avances en genómica y otros campos.
Explora GPT-Red, el sistema automatizado de red teaming de OpenAI que usa autojuego para mejorar la seguridad, la alineación y la robustez ante inyecciones de prompts en IA.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
Un nuevo análisis de OpenAI revela problemas en SWE-Bench Pro, un benchmark popular de codificación, y plantea dudas sobre la confiabilidad y precisión al evaluar modelos de IA.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
Presentamos GeneBench-Pro, un nuevo benchmark que evalúa el desempeño de IA en genómica, biología e investigación científica con datos complejos del mundo real.