We’re introducing GPT-6.1 Sol. GPT-6.1 is the latest model family in the GPT-6 series.
MentalHealthBench は、実際に起こりうるメンタルヘルスに関するさまざまな会話で、AI の応答の有用性と安全性を評価するための、専門家の知見に基づくベンチマークです。
ナビエ–ストークスのミレニアム懸賞問題について、AI が生成した解法を、解説と Lean による形式的証明とともに公開します。
OpenAI 内部では、コーディングエージェントが AI 研究を変革しています。エージェントの利用状況、実験のペース、タスクの複雑さ、研究の加速に関する初期データをご覧ください。
Astra is our first model to reach the Critical level of cybersecurity capability under our Preparedness Framework.
OpenAI が、Hugging Face のセキュリティインシデントに関する調査結果と、AI モデルのセキュリティ、監視、アラインメントを強化するために現在進めている取り組みを紹介します。
OpenAI は、フロンティア AI モデルのモニタリング、アラインメント、セキュリティを強化しています。新たな安全策がモデル開発のペースをどう導いているかをご覧ください。
OpenAI が、数学と理論計算機科学の長年の未解決問題に関する新たな成果を公開。幾何学、暗号、計算量理論などで進展を示します。
推論の保持とコンパクションの有効化という 2 つの API 設定により、ARC-AGI-3 で GPT-5.6 のスコアと効率が向上した仕組みを紹介します。