मुख्य मजकूराकडे जा
OpenAI

७ ऑगस्ट, २०२६

सुरक्षा

महत्त्वपूर्ण सायबर क्षमतांच्या पुढील अत्याधुनिकला प्रतिसाद देताना

लोड होत आहे...

सायबर सुरक्षा वेगाने बदलत आहे, कारण मॉडेल्स अधिक सक्षम होत आहेत; ही क्षमता सायबर-संरक्षण बळकट करू शकते, तसेच अभूतपूर्व वेग आणि व्याप्तीने सायबर हल्ले घडवून आणण्यासही कारणीभूत ठरू शकते.

आमच्या आगामी मॉडेल्सपैकी एक असलेल्या 'Astra प्रिपेयर्डनेस फ्रेमवर्कबाबत गेल्या काही दिवसांत केलेल्या अंतर्गत मूल्यमापनांवरून, 'एजंटिक कोडिंग' आणि सायबर सुरक्षा या क्षेत्रांत लक्षणीय प्रगती झाल्याचे दिसून आले आहे. तज्ञांच्या अभिप्रायासोबतच या निष्कर्षांमुळे, आमच्या प्रिपेयर्डनेस फ्रेमवर्क(नवीन विंडोमध्ये उघडेल) अत्यंत महत्त्वपूर्ण सायबर क्षमतांच्या शक्यतेकडे दुर्लक्ष करता येणार नाही, असा निष्कर्ष आम्ही काल रात्री काढला आहे.

आम्ही हे सामायिक करत आहोत कारण आमचा विश्वास आहे की क्षमतांमध्ये या संभाव्य बदलाबाबत सार्वजनिक आणि सुरक्षितता आणि सुरक्षा समुदायांसोबत पारदर्शक असणे महत्त्वाचे आहे.

मॉडेल्सनी जैविक, रासायनिक, सायबर सुरक्षा आणि कृत्रिम बुद्धिमत्तेच्या स्व-सुधारणेसंबंधी क्षमतांची ही पातळी गाठण्यापूर्वीच, डिसेंबर 2023 मध्ये आम्ही प्रथम आमचे प्रिपेयर्डनेस फ्रेमवर्क प्रकाशित केले. क्षमतांमधील प्रगती ओळखण्यासाठी आणि त्या क्षमता उदयास आल्यावर आमच्या कंपनीने काय करावे याचे नियोजन करण्यासाठी मार्गदर्शक म्हणून आम्ही ते तयार केले. GPT‑5.6‑Sol सह मागील मॉडेल्सचे अत्याधुनिक सायबर क्षमतांसाठी मूल्यमापन करण्यात आले असून, त्यांना गंभीर मर्यादेऐवजी उच्च (मर्यादेवर ठेवण्यात आले) आहे.

गंभीर सायबर सुरक्षा क्षमतांचे मापन 

आमच्या प्रिपेयर्डनेस फ्रेमवर्क अंतर्गत, एक मॉडेल गंभीर सायबरसुरक्षा उंबरठ्यावर पोहोचते जर ते मानवी हस्तक्षेपाशिवाय अनेक कठोर वास्तविक-जगातील गंभीर प्रणालींमध्ये सर्व तीव्रतेचे कार्यात्मक शून्य-दिवसीय शोषण ओळखू शकते आणि विकसित करू शकते किंवा केवळ लक्ष्यित उच्च स्तरावरील लक्ष्यित लक्ष्यित सायबर हल्ल्यांच्या विरूद्ध शेवट-टू-एंड कादंबरी धोरणे आखू शकते आणि अंमलात आणू शकते. 

या मॉडेलची मानक चाचणी आणि मूल्यमापन सुरू असतानाच, आमच्या प्राथमिक मूल्यमापनांत त्याची कामगिरी इतकी प्रभावी दिसते की सध्या त्याची क्षमता गंभीर पातळीवर असल्याची शक्यता नाकारता येत नाही. Astra हे आगामी मॉडेल असून Hugging Face मधील त्रुटिशोषणात त्याचा सहभाग नव्हता. 

आम्ही उचलत असलेली पावले

त्यानुसार, या क्षमतांच्या अंमलबजावणीसाठी योग्य ठरतील अशा प्रकारे आम्ही आमच्या सुरक्षा उपाययोजना आणि सुरक्षा नियंत्रणांच्या 'रोबस्टनेस टेस्टिंग'ची व्याप्ती वाढवली आहे. तसेच, या मॉडेलचा पुढील विकास सुरक्षितपणे व्हावा यासाठी आम्ही अंतर्गत पातळीवर खालील पावले उचलली आहेत: 

  • आम्ही उच्च-क्षमता मॉडेल्स आणि संबंधित क्रियाकलापांसाठी कठोर सुरक्षा नियंत्रणे लागू करत आहोत, ज्यामध्ये वेगळ्या चाचणी वातावरण, प्रतिबंधित नेटवर्क आणि टूल ऍक्सेस, वर्धित मॉडेल वजन संरक्षण आणि एन्क्रिप्शन, अतिरिक्त देखरेख आणि शोध क्षमता आणि सँडबॉक्स अंमलात आणणे समाविष्ट आहे.
  • या अधिक कठोर सुरक्षा नियंत्रणांच्या आवश्यकता अद्याप पूर्ण न करणारी Astra शी संबंधित अंतर्गत कामे आम्ही थांबवत आहोत.
  • आम्ही प्रशिक्षण आणि मूल्यमापनासह, Astraच्या सर्व एजेंटिक ॲप्लिकेशन्समध्ये जोखमीच्या कृती आणि विसंगतीसाठी सार्वत्रिक देखरेख प्रणाली लागू केली आहे. मॉनिटर्स मॉडेलच्या चेन-ऑफ-थॉट करतात आणि उच्च जोखमीच्या हालचालींचे पुनरावलोकन करून त्या थांबवण्यासाठी सुरक्षा प्रतिसाद सुरू करतात.
  • या मॉडेलच्या क्षमतांची चाचणी घेण्यासाठी आम्ही संबंधित सरकारी संस्था आणि निवडक AI सुरक्षा संस्थांसोबत काम करू.
  • उच्च जोखमीची मूल्यमापने आणि कार्यभार सुरक्षितपणे चालवण्यासाठी आम्ही तृतीय-पक्ष चाचणी भागीदारांना शिफारस केलेली सुरक्षा नियंत्रणे देणार आहोत. 

या आराखड्याने आम्हाला यापूर्वीही क्षमतांमधील बदलांच्या प्रक्रियेत मार्गदर्शन केले आहे. जून 2025मध्ये, जेव्हा आमचे मॉडेल्स 'प्रिपेयर्डनेस फ्रेमवर्क' अंतर्गत जीवशास्त्राशी संबंधित उच्च क्षमतेच्या टप्प्यापर्यंत पोहोचले, तेव्हा आम्ही काही पावले उचलण्याचे निश्चित केले होते जसे की सुरक्षा उपाय बळकट करणे, चाचण्यांची व्याप्ती वाढवणे, बाह्य तज्ज्ञांसोबत काम करणे आणि अतिरिक्त सुरक्षा नियंत्रणे लागू करणे. आम्ही येथेही त्याच तत्त्वाचा अवलंब करत आहोत.

आमचा असा विश्वास आहे की, सायबर क्षेत्रातील प्रगत क्षमता असलेली मॉडेल्स संरक्षकांना, हल्लेखोरांच्या आधीच प्रणालीतील त्रुटी (vulnerabilities) शोधून त्या दूर करण्यास मदत करतील. 'Astra' आणि त्यानंतर येणाऱ्या मॉडेल्सच्या अत्याधुनिक क्षमतांचा वापर संपूर्ण मानवजातीच्या हितासाठी जबाबदारीने आणि व्यापक स्तरावर केला जावा, हे सुनिश्चित करण्यासाठी सरकारे, सुरक्षा संस्था आणि नागरी समाज यांच्यासोबत काम करण्यास आम्ही कटिबद्ध आहोत.

लेखक

OpenAI