MentalHealthBench 是參考專家意見建立的基準測試,用於評估 AI 在貼近現實的精神健康對話中能否提供實用而安全的回應。
認識 GPT-6 Sol 和 Luna:兩款以不同能力與成本組合,將前沿智能帶到日常工作的模型。
GPT‑Live‑1 為 API 帶來自然的全雙工語音對話,並加強指令遵循、自訂語音及電話支援。
我們現分享由 AI 得出的納維-斯托克斯千禧年大獎難題解法,包括論文及 Lean 形式化證明。
在 OpenAI 內部,編碼智能代理正改變 AI 研究的方式。探索有關智能代理使用情況、實驗速度、任務複雜度及研究加速的初步數據。
GPT-6 Astra 登場。這是我們迄今智能和對齊程度最高的模型,在電腦操作、編碼、網絡安全及科學方面均具備最先進能力。
Astra is our first model to reach the Critical level of cybersecurity capability under our Preparedness Framework.
OpenAI 分享 Hugging Face 系統防護事件的調查結果,以及我們為加強 AI 模型的系統防護、監察和對齊而採取的措施。
OpenAI 正加強前沿人工智能模型的監察、對齊及系統防護。了解新防護措施如何引導模型開發步伐。