We’re introducing GPT-6.1 Sol. GPT-6.1 is the latest model family in the GPT-6 series.
MentalHealthBench 是參考專家意見建立的基準測試,用於評估 AI 在貼近現實的精神健康對話中能否提供實用而安全的回應。
我們現分享由 AI 得出的納維-斯托克斯千禧年大獎難題解法,包括論文及 Lean 形式化證明。
在 OpenAI 內部,編碼智能代理正改變 AI 研究的方式。探索有關智能代理使用情況、實驗速度、任務複雜度及研究加速的初步數據。
Astra is our first model to reach the Critical level of cybersecurity capability under our Preparedness Framework.
OpenAI 分享 Hugging Face 系統防護事件的調查結果,以及我們為加強 AI 模型的系統防護、監察和對齊而採取的措施。
OpenAI 正加強前沿人工智能模型的監察、對齊及系統防護。了解新防護措施如何引導模型開發步伐。
OpenAI 分享數學及理論電腦科學長期未解問題的新成果,包括幾何學、密碼學和複雜度方面的進展。
兩項 API 設定如何透過保留推理和啟用上下文壓縮,提高 GPT-5.6 在 ARC-AGI-3 的得分和效率。