A OpenAI está reforçando o monitoramento, o alinhamento e a segurança dos modelos de IA de fronteira. Veja como novas salvaguardas orientam o ritmo de desenvolvimento dos modelos.
A OpenAI apresenta resultados sobre problemas em aberto de longa data em matemática e computação teórica, com avanços em geometria, criptografia e complexidade.
Como duas configurações da API melhoraram o desempenho do GPT-5.6 no ARC-AGI-3, elevando pontuação e eficiência com retenção do raciocínio e compactação.
Um novo relatório mostra como cientistas usam agentes de IA para modernizar a computação científica e acelerar o software e as descobertas em genômica e outras áreas.
Conheça o GPT-Red, sistema automatizado de red teaming da OpenAI que usa self-play para melhorar segurança, alinhamento e robustez contra injeção de prompt.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
Nova análise da OpenAI revela problemas no SWE-Bench Pro, benchmark popular de programação, levantando dúvidas sobre confiabilidade e precisão na avaliação de modelos de IA.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
Apresentamos o GeneBench-Pro, um novo benchmark que testa o desempenho de IA em genômica, biologia e pesquisa científica usando conjuntos de dados complexos e do mundo real.