GPT-Red-ი არის OpenAI-ს ავტომატიზებული შეტევითი ტესტირების (red teaming) სისტემა: ის თვითთამაშით აუმჯობესებს AI-ს უსაფრთხოებას, თანხვედრასა და პრომპტ-ინიექციისადმი სიმტკიცეს.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
OpenAI-ს ახალი ანალიზი ავლენს პრობლემებს SWE-Bench Pro-ში, პოპულარულ კოდის ბენჩმარკში, რაც აჩენს კითხვებს ხელოვნური ინტელექტის მოდელების შეფასების სანდოობასა და სიზუსტეზე.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
წარმოგიდგენთ GeneBench-Pro-ს, ახალ ბენჩმარკს, რომელიც ტესტავს AI-ის ეფექტურობას გენომიკაში, ბიოლოგიასა და სამეცნიერო კვლევაში რთული, რეალურ მონაცემთა ნაკრებების გამოყენებით.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch – our most robust yet – are built to deliver these models safely and at scale, around the world.
OpenAI და Molecule.one აჩვენებენ, თუ როგორ გააუმჯობესა თითქმის ავტონომიურმა ხელოვნური ინტელექტის ქიმიკოსმა, GPT-5.4-ის გამოყენებით, მედიკამენტების წარმოების საკვანძო რეაქცია, რამაც წინ წასწია კვლევები სამედიცინო ქიმიის სფეროში.
გაიცანით LifeSciBench — ექსპერტების შექმნილი და რეცენზირებული ბენჩმარკი AI სისტემების შესაფასებლად სიცოცხლის მეცნიერების რეალურ კვლევით ამოცანებსა და გადაწყვეტილებებში.