MentalHealthBench 是一项基于专家意见设立的基准,用于评估 AI 在真实心理健康对话中能否提供实用且安全的回应。
认识 GPT-6 Sol 和 Luna:两款以不同能力与成本组合,将前沿智能带入日常工作的模型。
GPT‑Live‑1 为 API 带来自然的全双工语音对话,并增强了指令遵循能力、自定义语音和电话支持。
我们在此分享由 AI 生成的纳维–斯托克斯千禧年大奖难题解法,包括相关论文和 Lean 形式化证明。
在 OpenAI 内部,编程智能体正在重塑 AI 研究。探索有关智能体使用情况、实验速度、任务复杂度和研究加速的早期数据。
GPT-6 Astra 正式上线 — 这是我们迄今为止智能程度最高、最符合人类意图的模型,在计算机操作、编程、网络安全和科学领域均具备行业前沿水平的能力。
Astra is our first model to reach the Critical level of cybersecurity capability under our Preparedness Framework.
OpenAI 分享 Hugging Face 安全事件的调查结果,以及我们为加强 AI 模型安全、监控和对齐所采取的措施。
OpenAI 正在加强前沿 AI 模型的监控、对齐和安全保障。了解新的保障措施如何引导模型开发节奏。