Упознајте GPT-Red, аутоматизовани систем црвене команде привредног друштва OpenAI који самосталном игром побољшава безбедност AI-ја, усклађивање и робусност на уметање инструкције.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
Нова анализа привредног друштва OpenAI открива проблеме у SWE-Bench Pro, популарној реф. вредности за програмирање и доводи у питање поузданост и тачност оцењивања AI модела.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
Представљамо GeneBench-Pro, ново референтно тестирање AI перформанси у геномици, биологији и научном истраживању на сложеним стварним подацима
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch – our most robust yet – are built to deliver these models safely and at scale, around the world.
OpenAI и Molecule.one показују како је скоро аутономни AI хемичар који користи GPT-5.4 побољшао кључну реакцију за прављење лекова, унапређујући истраживање медицинске хемије.
Представљамо LifeSciBench, референтну вредност коју пишу и рецензирају стручњаци за процену како AI системи решавају реалне задатке и одлуке у природним наукама.