Descobreix GPT-Red, el sistema automatitzat d’equip vermell d’OpenAI que usa autojoc per millorar la seguretat, l’alineació i la robustesa davant injeccions d’indicacions.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
Una nova anàlisi d’OpenAI revela problemes a SWE-Bench Pro, un benchmark de programació popular, i qüestiona la fiabilitat i la precisió de l’avaluació de models d’IA.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
Presentem GeneBench-Pro, un nou banc de proves que avalua el rendiment de la IA en genòmica, biologia i recerca científica mitjançant conjunts de dades complexos i reals.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch – our most robust yet – are built to deliver these models safely and at scale, around the world.
OpenAI i Molecule.one mostren com un químic d'IA gairebé autònom que utilitza GPT-5.4 va millorar una reacció clau per a la fabricació de medicaments, avançant la recerca en química medicinal.
Presentem LifeSciBench, un banc de proves creat i revisat per experts per avaluar com els sistemes AI gestionen tasques i decisions reals en ciències de la vida.