MentalHealthBench 是一項以專家意見為基礎的基準,用來評估 AI 在真實心理健康對話中能否提供安全且有幫助的回應。
認識 GPT-6 Sol 和 Luna:兩款以不同能力與成本組合,將前沿智慧帶入日常工作的模型。
GPT‑Live‑1 為 API 帶來自然的全雙工語音對話,具備更強的指令遵循能力、自訂語音與電話支援。
我們分享由 AI 產生的 Navier–Stokes 千禧年大獎難題解法,包括證明文稿及 Lean 形式化證明。
在 OpenAI 內部,程式碼編寫智慧體正在重塑 AI 研究。探索智慧體使用情況、實驗速度、任務複雜度與研究加速的早期資料。
隆重介紹 GPT-6 Astra,這是我們迄今智慧和對齊程度最高的模型,在電腦操作、程式碼編寫、網路安全及科學方面均具備最先進能力。
Astra is our first model to reach the Critical level of cybersecurity capability under our Preparedness Framework.
OpenAI 分享 Hugging Face 安全事件的調查結果,以及我們為強化 AI 模型安全性、監控與對齊所採取的措施。
OpenAI 正強化前沿 AI 模型的監控、對齊與安全措施。瞭解新防護措施如何引導模型開發步調。