OpenAI は、フロンティア AI モデルのモニタリング、アラインメント、セキュリティを強化しています。新たな安全策がモデル開発のペースをどう導いているかをご覧ください。
OpenAI が、数学と理論計算機科学の長年の未解決問題に関する新たな成果を公開。幾何学、暗号、計算量理論などで進展を示します。
推論の保持とコンパクションの有効化という 2 つの API 設定により、ARC-AGI-3 で GPT-5.6 のスコアと効率が向上した仕組みを紹介します。
新たなフィールドレポートでは、科学者が AI コーディングエージェントで科学技術計算を刷新し、ゲノミクスなどのソフトウェア開発と発見を加速する方法を紹介します。
自己対戦を使って AI の安全性、アラインメント、プロンプトインジェクションへの堅牢性を高める、OpenAI の自動レッドチーミングシステム GPT-Red を紹介します。
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
OpenAI の新たな分析により、人気のコーディングベンチマーク SWE-Bench Pro に問題があることが明らかになり、AI モデル評価の信頼性と正確性に懸念が生じています。
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
複雑な実世界のデータセットを用いて、ゲノミクス、生物学、科学研究におけるAIの性能を評価する新しいベンチマーク、GeneBench-Pro をご紹介します。