გადადით მთავარ შინაარსზე
OpenAI

7 აგვისტო, 2026

უსაფრთხოება

კრიტიკულად მნიშვნელოვანი კიბერშესაძლებლობების ახალ გამოწვევებზე რეაგირება

იტვირთება…

კიბერუსაფრთხოება სწრაფად იცვლება, რადგან მოდელების მზარდ შესაძლებლობებს შეუძლია როგორც კიბერდაცვის გაძლიერება, ისე უპრეცედენტო სისწრაფისა და მასშტაბის შეტევების განხორციელება.

ბოლო დღეებში ჩატარებული ჩვენი ერთ-ერთი მომავალი მოდელის, Astra-ს, უახლესი შიდა შეფასებები აგენტურ პროგრამირებასა და კიბერუსაფრთხოებაში მნიშვნელოვან წინსვლაზე მიუთითებს. ამ შედეგებისა და ექსპერტთა შეფასებების საფუძველზე, გუშინ ღამით დავასკვნათ, რომ ჩვენი მზაობის ჩარჩოთი(იხსნება ახალ ფანჯარაში) განსაზღვრულ კრიტიკულად მნიშვნელოვან კიბერშესაძლებლობებს ვერ გამოვრიცხავთ.

ამ ინფორმაციას იმიტომ ვაზიარებთ, რომ მიგვაჩნია: შესაძლებლობების ამ პოტენციური ცვლილების შესახებ საზოგადოებასთან და უსაფრთხოების სფეროს წარმომადგენლებთან გამჭვირვალობა მნიშვნელოვანია.

მზაობის ჩარჩო პირველად 2023 წლის დეკემბერში გამოვაქვეყნეთ — გაცილებით ადრე, ვიდრე მოდელები ბიოლოგიის, ქიმიის, კიბერუსაფრთხოებისა და ხელოვნური ინტელექტის თვითგაუმჯობესების ამ დონის შესაძლებლობებს მიუახლოვდებოდა. ეს ჩარჩო შევქმენით, რათა შესაძლებლობების განვითარება გამოგვევლინა და წინასწარ დაგვეგეგმა, რას გააკეთებდა ჩვენი კომპანია მათი წარმოქმნისას. წინა მოდელები, მათ შორის GPT‑5.6‑Sol, მოწინავე კიბერშესაძლებლობებზე შეფასდა და კრიტიკულის ნაცვლად მაღალ ზღვარს მიეკუთვნა.

კრიტიკული მნიშნელობის კიბერუსაფრთხოების შესაძლებლობების გაზომვა 

ჩვენი მზაობის ჩარჩოს თანახმად, მოდელი კიბერუსაფრთხოების კრიტიკულ ზღვარს აღწევს, თუ მას ადამიანის ჩარევის გარეშე შეუძლია მრავალ რეალურ, დაცვით გამაგრებულ კრიტიკულად მნიშვნელოვან სისტემაში ნებისმიერი სიმძიმის მოქმედი ნულოვანი დღის ექსპლოიტების აღმოჩენა და შექმნა, ან მხოლოდ მაღალი დონის სასურველი მიზნის საფუძველზე დაცვით გამაგრებულ სამიზნეებზე კიბერშეტევის სრულიად ახალი, თავიდან ბოლომდე გამართული სტრატეგიების შემუშავება და განხორციელება. 

ამ მოდელის საკონტროლო ტესტირებასა და შეფასებას ვაგრძელებთ, თუმცა წინასწარი შედეგები იმდენად ძლიერია, რომ ამ ეტაპზე შესაძლებლობების კრიტიკულ დონეს ვერ გამოვრიცხავთ. Astra მომავალი მოდელია და Hugging Face-ის ექსპლუატაციაში მონაწილეობა არ მიუღია. 

ჩვენ მიერ გადადგმული ნაბიჯები

შესაბამისად, გავაფართოეთ ჩვენი დამცავი ზომებისა და უსაფრთხოების კონტროლების მდგრადობის ტესტირება, რათა ისინი ამ შესაძლებლობების დანერგვას შეესაბამებოდეს. მოდელის შემდგომი განვითარება უსაფრთხოდ და დაცულად რომ გაგრძელდეს, შიდა დონეზე შემდეგი ნაბიჯებიც გადავდგით: 

  • მეტი შესაძლებლობის მქონე მოდელებისა და მათთან დაკავშირებული საქმიანობისთვის უსაფრთხოების უფრო მკაცრ კონტროლებს ვნერგავთ. მათ შორისაა იზოლირებული სატესტო გარემოები, ქსელსა და ხელსაწყოებზე შეზღუდული წვდომა, მოდელის წონების გაძლიერებული დაცვა და დაშიფვრა, მონიტორინგისა და გამოვლენის დამატებითი შესაძლებლობები და იზოლირებულ გარემოში შესრულება.
  • დროებით ვაჩერებთ Astra-სთან დაკავშირებულ შიდა საქმიანობას, რომელიც უსაფრთხოების კონტროლის ამ გამკაცრებულ მოთხოვნებს ჯერ არ აკმაყოფილებს.
  • Astra-ს ყველა აგენტურ გამოყენებაში, მათ შორის სწავლებასა და შეფასებაში, სარისკო ქმედებებისა და მიზნებთან შეუსაბამობის საყოველთაო მონიტორინგი დავნერგეთ. მონიტორები აფასებენ მოდელის აზროვნების ჯაჭვს და მაღალი რისკის საქმიანობის შესამოწმებლად და შესაწყვეტად უსაფრთხოების რეაგირებას ააქტიურებენ.
  • ამ მოდელის შესაძლებლობების შესამოწმებლად შესაბამის სამთავრობო უწყებებთან და ხელოვნური ინტელექტის უსაფრთხოების შერჩეულ ორგანიზაციებთან ვითანამშრომლებთ.
  • მესამე მხარის სატესტო პარტნიორებს უსაფრთხოების რეკომენდებულ კონტროლებს მივაწვდით, რათა მათ უფრო მაღალი რისკის შეფასებები და სამუშაო დატვირთვები უსაფრთხოდ განახორციელონ. 

ეს ჩარჩო შესაძლებლობების სხვა გარდამავალ ეტაპებზეც უკვე გამოგვადგა. 2025 წლის ივნისში, როდესაც ჩვენი მოდელები მზაობის ჩარჩოთი განსაზღვრულ ბიოლოგიური შესაძლებლობების მაღალ ზღვარს მიუახლოვდა, აღვწერეთ ჩვენ მიერ გადადგმული ნაბიჯები დამცავი ზომების გასაძლიერებლად, ტესტირების გასაფართოებლად, გარე ექსპერტებთან სამუშაოდ და უსაფრთხოების დამატებითი კონტროლების დასანერგად. აქაც იმავე პრინციპს ვიყენებთ.

მიგვაჩნია, რომ მოწინავე კიბერშესაძლებლობების მქონე მოდელები დამცველებს უნდა დაეხმაროს მოწყვლადობების თავდამსხმელებზე ადრე აღმოჩენასა და აღმოფხვრაში. ჩვენ მზად ვართ, მთავრობებთან, უსაფრთხოების ინსტიტუტებსა და სამოქალაქო საზოგადოებასთან ერთად ვიმუშაოთ, რათა Astra-სა და მომდევნო მოდელების მოწინავე შესაძლებლობები პასუხისმგებლობით, ფართოდ და მთელი კაცობრიობის სასარგებლოდ დაინერგოს.

ავტორი

OpenAI