OpenAI’ın self-play kullanarak yapay zekâ güvenliğini, hizalamayı ve prompt enjeksiyonu dayanıklılığını artıran otomatik red teaming sistemi GPT-Red’i keşfedin.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
OpenAI’ın yeni analizi, popüler kodlama kıyaslaması SWE-Bench Pro’daki sorunları ortaya koyarak AI modellerini değerlendirmede güvenilirlik endişeleri doğuruyor.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
Genomik, biyoloji ve bilimsel araştırmalarda karmaşık gerçek dünya veri kümeleriyle yapay zeka performansını ölçen yeni kıyaslama GeneBench-Pro ile tanışın.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch – our most robust yet – are built to deliver these models safely and at scale, around the world.
OpenAI ve Molecule.one, GPT-5.4 kullanan neredeyse otonom bir yapay zeka kimyagerinin önemli bir ilaç üretimi reaksiyonunu iyileştirerek tıbbi kimya araştırmalarının ilerlemesine nasıl katkı sağladığını gösteriyor.
LifeSciBench: AI sistemlerinin gerçek yaşam bilimleri araştırma görev ve kararlarını nasıl ele aldığını değerlendiren, uzmanlarca yazılıp incelenmiş bir kıyaslama.