Poznaj GPT-Red, zautomatyzowany system kontrolowanych ataków OpenAI, który dzięki self-play zwiększa bezpieczeństwo AI, dostosowanie do celów i odporność na wstrzykiwanie poleceń.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
Nowa analiza OpenAI ujawnia problemy w SWE-Bench Pro, popularnym benchmarku kodowania, budząc obawy o wiarygodność i dokładność oceny modeli AI.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
GeneBench-Pro: nowy benchmark oceniający działania AI w genomice, biologii i badaniach naukowych na złożonych, realistycznych zbiorach danych.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch – our most robust yet – are built to deliver these models safely and at scale, around the world.
OpenAI i Molecule.one pokazują, jak niemal autonomiczny chemik AI używający GPT-5.4 ulepszył kluczową reakcję wytwarzania leków, rozwijając badania w chemii medycznej.
Przedstawiamy LifeSciBench — system ocen tworzony i recenzowany przez ekspertów, oceniający systemy AI w rzeczywistych zadaniach i decyzjach z dziedziny nauk przyrodniczych.