MentalHealthBench는 현실적인 정신건강 대화에서 AI 응답의 유용성과 안전성을 평가하기 위해 전문가의 의견을 반영한 벤치마크입니다.
역량과 비용의 균형을 달리해 일상 업무에 프런티어 지능을 제공하는 두 모델, GPT-6 Sol과 Luna를 만나보세요.
GPT‑Live‑1은 더욱 강력한 지침 준수, 맞춤형 음성, 전화 통신 지원과 함께 자연스러운 전이중 음성 대화를 API로 제공합니다.
AI가 도출한 나비에–스토크스 밀레니엄 문제의 해법을 공개합니다. 해설과 Lean 형식 증명이 포함됩니다.
OpenAI 내부에서는 코딩 에이전트가 AI 연구의 방식을 바꿔 놓고 있습니다. 에이전트 사용량과 실험 속도, 작업 복잡도, 연구 가속화에 관한 초기 데이터를 살펴보세요.
당사가 지금까지 개발한 모델 가운데 가장 지능적이고 정렬 수준이 높으며, 컴퓨터 사용, 코딩, 사이버 보안, 과학 전반에서 최첨단 역량을 갖춘 GPT-6 Astra를 소개합니다.
Astra is our first model to reach the Critical level of cybersecurity capability under our Preparedness Framework.
OpenAI가 Hugging Face 보안 사고에서 확인한 사항과 AI 모델의 보안, 모니터링 및 정렬을 강화하기 위해 취하고 있는 조치를 공유합니다.
OpenAI는 프런티어 AI 모델의 모니터링과 정렬, 보안을 강화하고 있습니다. 새로운 보호 조치가 모델 개발 속도를 어떻게 이끄는지 알아보세요.