O MentalHealthBench é um benchmark baseado no parecer de especialistas para avaliar respostas de IA úteis e seguras em conversas realistas sobre saúde mental.
Conheça o GPT-6 Sol e o Luna, dois modelos que levam inteligência de fronteira ao trabalho quotidiano, com diferentes equilíbrios entre capacidade e custo.
O GPT‑Live‑1 traz conversas de voz naturais e full-duplex para a API, com melhor seguimento de instruções, vozes personalizadas e suporte para telefonia.
Partilhamos uma solução gerada por IA para o Problema do Prémio Millennium de Navier–Stokes, incluindo uma descrição e uma prova formal em Lean.
Inside OpenAI, coding agents are reshaping AI research. Explore early data on agent usage, experiment velocity, task complexity, and research acceleration.
Apresentamos o GPT-6 Astra, o nosso modelo mais inteligente e alinhado até à data, com capacidades de ponta em utilização de computador, programação, cibersegurança e ciência.
Astra is our first model to reach the Critical level of cybersecurity capability under our Preparedness Framework.
A OpenAI partilha as conclusões sobre o incidente de segurança da Hugging Face e as medidas que está a tomar para reforçar a segurança, a monitorização e o alinhamento dos modelos de IA.
A OpenAI reforça a monitorização, o alinhamento e a segurança dos modelos de IA de fronteira. Saiba como as novas salvaguardas orientam o ritmo de desenvolvimento dos modelos.