OpenAI is strengthening monitoring, alignment, and security for frontier AI models. See how new safeguards are guiding the pace of model development.
OpenAI აქვეყნებს ახალ შედეგებს მათემატიკისა და თეორიული კომპიუტერული მეცნიერების დიდი ხნის ღია პრობლემებზე, მათ შორის გეომეტრიაში, კრიპტოგრაფიასა და სირთულეში.
API-ის ორმა პარამეტრმა ARC-AGI-3-ზე GPT-5.6-ის შედეგი გააუმჯობესა: მსჯელობის შენარჩუნებამ და შეკუმშვამ ქულები და ეფექტიანობა გაზარდა.
ახალ საველე ანგარიშში ჩანს, როგორ იყენებენ მეცნიერები პროგრამირების AI-აგენტებს სამეცნიერო გამოთვლების მოდერნიზებისთვის და გენომიკასა თუ სხვა სფეროებში პროგრესის დასაჩქარებლად.
GPT-Red-ი არის OpenAI-ს ავტომატიზებული შეტევითი ტესტირების (red teaming) სისტემა: ის თვითთამაშით აუმჯობესებს AI-ს უსაფრთხოებას, თანხვედრასა და პრომპტ-ინიექციისადმი სიმტკიცეს.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
OpenAI-ს ახალი ანალიზი ავლენს პრობლემებს SWE-Bench Pro-ში, პოპულარულ კოდის ბენჩმარკში, რაც აჩენს კითხვებს ხელოვნური ინტელექტის მოდელების შეფასების სანდოობასა და სიზუსტეზე.
GPT-Live-1 and GPT-Live-1 mini are a new generation of voice models designed to make conversations with AI feel more natural and intelligent.
წარმოგიდგენთ GeneBench-Pro-ს, ახალ ბენჩმარკს, რომელიც ტესტავს AI-ის ეფექტურობას გენომიკაში, ბიოლოგიასა და სამეცნიერო კვლევაში რთული, რეალურ მონაცემთა ნაკრებების გამოყენებით.