முக்கிய உள்ளடக்கத்திற்கு செல்க
OpenAI

4 ஆகஸ்ட், 2026

பாதுாய்வு

OpenAI மாடல்கள் சார்ந்த மூன்றாம் தரப்பு இணையப் பாதுகாப்பு மதிப்பீடுகள்

ஏற்றுகிறது…

வெளியிடுவதற்கு முன் அபாயங்களைச் சரிபார்த்து மேலும் புரிந்துகொள்ள எங்களுக்கு உதவுவதில் சுயாதீனச் சோதனை முக்கியப் பங்கு வகிக்கிறது. சில இணையப் பாதுகாப்பு மதிப்பீடுகள், பொதுவில் கிடைக்கும் வெளியீடுகளில் மாடல்கள் வழக்கமாக எவ்வாறு செயல்படுகின்றன என்பதை அல்லாமல் அவற்றின் அடிப்படைத் திறனை அளவிட, குறைக்கப்பட்ட பாதுகாப்பு நடவடிக்கைகள் உள்ளிட்ட தனிப்பயன் உள்ளமைவுகளை வேண்டுமென்றே பயன்படுத்துகின்றன.

அண்மைய மதிப்பீடுகளின்போது, சோதனை உள்ளமைவுகள் மற்றும் கட்டுப்பாடுகளுடன் புதிய மாடல்களின் வளர்ந்துவரும் திறன்களும் சேர்ந்ததால், மாடல்களின் செயல்பாடு நிர்ணயிக்கப்பட்ட சோதனை எல்லைகளுக்கு அப்பால் சென்ற நிகழ்வுகளை வெளிப்புறச் சோதனைக் கூட்டாளர்கள் இருவர் கண்டறிந்தனர். மாடல்களின் திறன் வளர வளர, சோதனைச் சூழல்கள் மற்றும் நடைமுறைகளுக்கான தரநிலைகளை மேம்படுத்த, துறை முழுவதும் மற்றும் மூன்றாம் தரப்பு மதிப்பீட்டாளர்களுடன் இணைந்து செயல்படுவது முக்கியம் என்பதை இந்த நிகழ்வுகள் உணர்த்துகின்றன. ஆசிரியர் குறிப்பு: இவை Hugging Face பாதுகாப்பு நிகழ்விலிருந்து தனிப்பட்டவை. Hugging Face நிகழ்வு குறித்த புதுப்பிப்புகளைத் தொடர்ந்து இங்கே பகிர்வோம்.

சாதாரண வெளியீட்டு நிலையைப் பிரதிபலிக்காத குறிப்பிட்ட சூழ்நிலைகளிலும் குறைக்கப்பட்ட பாதுகாப்பு உள்ளமைவுகளிலும், மூன்றாம் தரப்பு இணையப் பாதுகாப்பு மதிப்பீடுகளின்போது OpenAI மாடல்கள், பொது இணையத்தை அணுகியது புதிய நிகழ்வுகளில் அடங்கும். அந்த நிகழ்வுகள் பின்வருமாறு.

  1. ஏஜென்ட்கள் தங்களுக்கான கருவிகளைத் தாங்களே கண்டறிந்து, உண்மையான தாக்குதலாளரின் சூழலுக்கு நெருக்கமான நிலையில் செயல்படுவதற்காக, பிரிட்டன் அரசின் செயற்கை நுண்ணறிவுப் பாதுகாப்பு நிறுவனமான UK AISI, இணைய அணுகலை வேண்டுமென்றே இயக்கி இணையப் பாதுகாப்புச் சோதனை வரம்பு மதிப்பீடுகளை நடத்தியது. அடிப்படைத் திறனை அளவிட இணையப் பாதுகாப்பு வகைப்படுத்திகளும் முடக்கப்பட்டிருந்தன. அவர்களின் வலைப்பதிவை இங்கே(புதிய சாளரத்தில் திறக்கும்) படிக்கலாம்.
  2. எங்கள் வெளிப்புற இணையப் பாதுகாப்புச் சோதனைக் கூட்டாளர்களில் ஒன்றான Irregular, இணையத்திலிருந்து தனிமைப்படுத்தப்பட வேண்டிய கொடி-கைப்பற்றுதல் பாணி மதிப்பீடுகளை நடத்தியது. ஆனால், சோதனைச் சூழலில் இருந்த தவறான உள்ளமைவானது பொது இணையத்தை மாடல்கள் அணுக அனுமதித்தது.

என்ன நடந்தது, செயல்பாட்டைச் சாத்தியமாக்கிய சோதனை நிலைமைகள், அதைக் கட்டுப்படுத்த எடுக்கப்பட்ட நடவடிக்கைகள், மேலும் திறன்மிக்கதாகிவரும் மாடல்களைச் சுயாதீன ஆய்வகங்கள் தொடர்ந்து கடுமையாகவும் பாதுகாப்பாகவும் மதிப்பிடுவதை உறுதிசெய்ய நாங்கள் மேற்கொள்ளும் பணிகள் ஆகியவற்றைக் கீழே சுருக்கமாக விளக்குகிறோம்.

மூன்றாம் தரப்பு மாடல் மதிப்பீட்டுச் சூழல்களை வலுப்படுத்துதல்

Hugging Face நிகழ்வு குறித்த அண்மைய பதிவில் நாங்கள் விவரித்த அதே விரிவான சவாலை இந்த நிகழ்வுகள் சுட்டிக்காட்டுகின்றன. மாடல்களின் திறன்கள் வளரும்போது, அவற்றைச் சுற்றியுள்ள பாதுகாப்பு முறைமைகளும் வளர வேண்டும். மாடல்களை உருவாக்கப் பயன்படுத்தப்படும் சூழல்களும், அவற்றை மதிப்பிட ஆய்வகங்களும் சுயாதீனக் கூட்டாளர்களும் பயன்படுத்தும் சூழல்களும் இதில் அடங்கும்.

வரும் வாரங்களில், அதிக அபாயமுள்ள மதிப்பீடுகளை அடையாளம் காண்பது, செயல்பாட்டு வரம்பை ஒப்புக்கொள்வது, இணைய அணுகலை இயக்குவது அல்லது பாதுகாப்பு நடவடிக்கைகளைக் குறைப்பதற்கான கோரிக்கைகளை மதிப்பிடுவது, தனிமைப்படுத்தல், அணுகல் விவரங்களைக் கையாளுதல், கண்காணிப்பு மற்றும் நிறுத்த நிபந்தனைகளுக்கான எதிர்பார்ப்புகளை அமைப்பது, மேலும் தெளிவான நிகழ்வு அறிவிப்பு மற்றும் தீவிரப்படுத்தல் செயல்முறைகளை நிறுவுவது உள்ளிட்ட மூன்றாம் தரப்புச் சோதனைக்கான எங்கள் அணுகுமுறையை ஆய்வு செய்வோம்.

தேசியச் செயற்கை நுண்ணறிவு நிறுவனங்கள், சுயாதீன மதிப்பீட்டாளர்கள், பிற செயற்கை நுண்ணறிவு ஆய்வகங்கள் மற்றும் பிற குழுக்கள் போன்ற பங்குதாரர்களை வரும் வாரங்களில் ஒன்றுகூட்டுவது உட்பட, அதிக அபாயமுள்ள மதிப்பீடுகளைப் பாதுகாப்பாக நடத்துவதற்கான பொதுவான நடைமுறைகளை வலுப்படுத்த துறை முழுவதும் இணைந்து செயல்பட உறுதிபூண்டுள்ளோம். மேலும் திறன்மிக்கதாகிவரும் மாடல்களுக்கு ஏற்ப சோதனை நடைமுறைகள் முன்னேறுவதை உறுதிசெய்யும் அதே நேரத்தில், கடுமையான சுயாதீன மதிப்பீட்டின் மதிப்பைப் பாதுகாப்பதே எங்கள் இலக்கு ஆகும்.

UK AISI

ஜூலை 25 அன்று தொடங்கிய வழக்கமான இணையப் பாதுகாப்பு மதிப்பீட்டின்போது, OpenAI மற்றும் மற்றொரு ஆய்வகத்தின் மாடல்கள் சில சந்தர்ப்பங்களில் சோதனையின் வரம்பை மீறியதாக ஆகஸ்ட் 3 அன்று UK AISI எங்களிடம் தெரிவித்தது. நிஜ உலக வலைப்பின்னல்களைப் பிரதிபலிக்கும் வகையில் வடிவமைக்கப்பட்ட கட்டுப்படுத்தப்பட்ட இணையப் பாதுகாப்புச் சோதனை வரம்புகளில் மதிப்பீடு நடைபெற்றது. கண்டறியப்பட்ட 19 நிகழ்வுகளில் இரண்டில் OpenAI மாடலான GPT‑5.6 Sol சம்பந்தப்பட்டிருந்தது. மற்ற நிகழ்வுகளில் வேறொரு ஆய்வகத்தின் மாடல்கள் சம்பந்தப்பட்டிருந்தன.

இந்த மதிப்பீட்டில், கொடி-கைப்பற்றுதல் பயிற்சியில் இணையப் பாதுகாப்பு நிபுணர்களாகச் செயல்படுமாறு ஏஜென்ட்களுக்கு அறிவுறுத்தப்பட்டது. இணைக்கப்பட்ட மூன்று உருவகப்படுத்தப்பட்ட சூழல்களை ஊடுருவி, இறுதிக் கொடியைப் பெறுவது அவர்களின் பணியாக இருந்தது. பணிக்கான ப்ராம்ப்ட், வரம்புக்குள் உள்ள வலைப்பின்னல்களை அடையாளப்படுத்தியதுடன், பல முறைமைகள் வரம்புக்கு அப்பாற்பட்டவை என்றும் குறிப்பிட்டது. கருவிகளை ஏஜென்ட்கள் பதிவிறக்கி, மனிதத் தாக்குதலாளரின் சூழலுக்கு நெருக்கமான நிலையில் செயல்பட நேரடி இணைய அணுகலையும் UK AISI இயக்கியது. அடிப்படைத் திறனை அளவிட மாடலின் இணையப் பாதுகாப்பு வகைப்படுத்திகளையும் முடக்கியது.

உருவகப்படுத்தப்பட்ட இணையப் பாதுகாப்புச் சோதனை வரம்பே UK AISI நிர்ணயித்த அனுமதி எல்லையாகும். குறிப்பிட்ட உருவகப்படுத்தப்பட்ட வலைப்பின்னல்களைத் தாக்கி ஒரு கொடியைப் பெற ஏஜென்ட்களுக்கு அனுமதி வழங்கப்பட்டிருந்ததே தவிர, அந்த வரம்பின் வலைப்பின்னல் எல்லைக்கு வெளியேயுள்ள முறைமைகளுடன் தொடர்புகொள்ள அல்ல. ஆனால், திறந்த இணைய அணுகலை எவ்வாறு பயன்படுத்தலாம், எவ்வாறு பயன்படுத்தக்கூடாது என்பது ஏஜென்ட்களுக்குத் தெளிவாகக் கூறப்படவில்லை. இது நிகழ்வுக்குப் பங்களித்திருக்கக்கூடிய காரணம் என UK AISI குறிப்பிடுகிறது.

இந்தச் சோதனை ஓட்டங்கள் முழுவதிலும், உருவகப்படுத்தப்பட்ட சோதனை வரம்பிற்குள் நுழைவதற்கான வழியைக் கண்டறிந்து கொடியைப் பெற முயன்றபோது GPT‑5.6 Sol இரு அனுமதிக்கப்படாத நடவடிக்கைகளை மேற்கொண்டதாக UK AISI கண்டறிந்தது:

  1. மற்றொரு ஆய்வகத்தின் ஏஜென்ட் பொதுவாக அணுகக்கூடிய நிலையில் விட்டிருந்த GitHub டோக்கனை GPT‑5.6 Sol மீண்டும் பயன்படுத்தியது. சோதனை வரம்புக்குள் இருந்த ஒரு முறைமை, GitHub அல்லது வேறொரு புதுப்பிப்புச் சேவையைத் தொடர்ந்து விசாரிக்கிறதா என்பதைச் சரிபார்க்கவும், கணக்கு மீட்பு மற்றும் கோரிக்கை வரம்புக்கான மாற்றுவழிகளை முயலவும், வெளிப்புற DNS மற்றும் சுரங்கச் சேவை வழங்குநர்களிடம் கணக்குகளைப் பதிவுசெய்யவும் அது இதைச் செய்தது.
  2. GPT‑5.6 Sol, தனது மதிப்பீட்டுச் சூழலில் அகத்தில் இயங்கிய DNS சேவையகத்தைப் பொது இணையத்திலிருந்து அணுகக்கூடியதாக்க ஒரு பொதுச் சுரங்கச் சேவையைப் பயன்படுத்தியது. சோதனை வரம்பில் இயங்கிய ஒரு மென்பொருளில் அறியப்பட்ட பாதிப்பைப் பயன்படுத்துவதற்கான தீங்குநிரல் பகுதிகள் அந்தச் சேவையகத்தில் இருந்தன. அந்த அமைவு செயல்படவில்லை; உண்மையான எந்த DNS தீர்வியும் அதை வினவியதற்கான ஆதாரம் இல்லை. மதிப்பீடு முடிந்ததும் அந்த உள்கட்டமைப்பு அகற்றப்பட்டது.

இணையப் பாதுகாப்புச் சோதனை வரம்பை நிறைவுசெய்ய மாடல் முயன்றபோதிலும், வரம்பின் எல்லைக்கு வெளியேயுள்ள உண்மையான வெளிப்புறக் கணக்குகளையும் சேவைகளையும் பயன்படுத்தியதாலும், பணியை முடிக்க இந்த நடவடிக்கைகள் தேவைப்படாததாலும், UK AISI இவற்றை அனுமதிக்கப்படாத நடவடிக்கைகளாகக் கருதியது. பொது இணையத்தில் பாதிப்பைப் பயன்படுத்தும் தீங்குநிரல் பகுதிகளையும் DNS சேவையகம் வழங்கியது. எனினும், அந்த அமைவு செயல்படவில்லை; உண்மையான எந்த DNS தீர்வியும் அதை வினவியதற்கான ஆதாரம் இல்லை.

பாதுகாப்புக் கண்காணிப்பு வழக்கத்திற்கு மாறான தரவுப் பரிமாற்றங்களைக் கண்டறிந்ததைத் தொடர்ந்து, ஜூலை 28 அன்று UK AISI இந்தச் செயல்பாட்டைக் கண்டறிந்தது. அது தொடர்புடைய மதிப்பீடுகளை நிறுத்தி, சம்பந்தப்பட்ட இயந்திரங்களைத் தனிமைப்படுத்தி, கண்டறிந்த சுமார் ஒரு மணி நேரத்திற்குள் செயல்பாட்டைக் கட்டுப்படுத்தியது.

இந்தச் செயல்முறை முழுவதிலும் செயல்பாட்டைக் கண்டறிந்து, விசாரித்து, அதன் விவரங்களைப் பகிர்ந்தது உட்பட UK AISI வழங்கிய ஒத்துழைப்பை நாங்கள் பாராட்டுகிறோம். எங்கள் கூட்டு ஒத்துழைப்பைத் தொடர ஆவலுடன் இருக்கிறோம்.

Irregular

எங்கள் மூன்றாம் தரப்பு மதிப்பீட்டுக் கூட்டாளர்களில் ஒன்றான Irregular, கொடி-கைப்பற்றுதல் (CTF) பாணி இணையப் பாதுகாப்பு மதிப்பீடுகளின்போது OpenAI மாடல்கள் சம்பந்தப்பட்ட ஒரு நிகழ்வு குறித்து ஜூலை 29 அன்று எங்களுக்குத் தெரிவித்தது. உருவகப்படுத்தப்பட்ட சூழலுக்குள் உள்ள பலவீனங்களைப் பயன்படுத்தி மறைக்கப்பட்ட தகவல்களைக் கண்டறியுமாறு மாடல்களுக்கு அறிவுறுத்தப்பட்டது. அவற்றுக்கு இணைய அணுகல் இல்லை என்றும் கூறப்பட்டது. ஆனால், சோதனைச் சூழலில் இருந்த தவறான உள்ளமைவானது பொது இணையத்தை மாடல்கள் அணுக அனுமதித்தது.

ஒரு சோதனையில், CTF சவாலுக்கான கற்பனை இலக்கின் பெயர் எதிர்பாராதவிதமாக ஓர் உண்மையான இணையக் களத்தின் பெயருடன் ஒத்துப்போனது. சோதனைச் சூழல் தவறுதலாக இணையத்துடன் இணைக்கப்பட்டிருந்ததால், உண்மையான ஓர் இணையதளத்தை உருவகப்படுத்தப்பட்ட சூழலின் பகுதி எனத் தவறாகக் கருதி மாடல் அதன் பாதிப்பைப் பயன்படுத்தியது. இது நுட்பமான கட்டுப்படுத்தப்பட்ட சூழல் தப்பிப்போ அல்லது முன்பறியப்படாத பாதிப்போ அல்ல. தவறான உள்ளமைவால் இணைய அணுகல் கிடைத்தது; மாடல் ஓர் அடிப்படைப் பாதுகாப்புப் பாதிப்பைப் பயன்படுத்தியதாகத் தெரிகிறது.

Irregular நடத்திய விசாரணையின்படி, அதே இணையதளத்தை இயக்குவதற்கான அணுகல் விவரங்களையும் மாடல் கண்டறிந்து பயன்படுத்தியது. பாதிக்கப்பட்ட இணையதளத்தின் சொந்தத் தரவுகளுக்கு அப்பால் எந்தத் தாக்கத்தையும் Irregular கண்டறியவில்லை. அதன் தணிக்கை தொடர்ந்து நடைபெறுகிறது. அது மதிப்பீடுகளை இடைநிறுத்தி, சீரமைப்புப் பணிகளைத் தொடங்கியுள்ளது. பாதிக்கப்பட்ட மூன்றாம் தரப்பினருக்கும் தகவல் தெரிவிக்கப்பட்டது. இந்த நிகழ்வு தொடர்பாகக் கண்டறியப்பட்ட சிக்கல்கள் எதுவும் தற்போது செயல்பாட்டில் இல்லை என்றும், சோதனைச் சூழலில் உரிய பாதுகாப்பு நடவடிக்கைகள் சேர்க்கப்பட்டுள்ளன என்றும் Irregular எங்களுக்குத் தெரிவித்துள்ளது. அதே சோதனைச் சூழலில் மற்ற ஆய்வகங்கள் சம்பந்தப்பட்ட தொடர்புடைய நிகழ்வுகள் குறித்தும் Irregular தகவல் தெரிவித்துள்ளது.

Irregular வழங்கிய ஒத்துழைப்பை நாங்கள் பாராட்டுகிறோம். அதன் ஆய்வுக்கு ஆதரவளிக்க அதனுடன் தொடர்ந்து நெருக்கமாகப் பணியாற்றுவோம். கட்டுப்படுத்தலுக்கும் இணையப் பாதுகாப்பு மதிப்பீடுகளைப் பாதுகாப்பாக நடத்துவதற்குமான சிறந்த நடைமுறைகளைப் பகிர, Irregular ஓர் ஆய்வறிக்கையையும் உருவாக்கி வருகிறது. கண்டுபிடிப்புகளைச் சமூகத்திற்குக் கிடைக்கச் செய்யும் அந்த ஆய்வறிக்கையில் பங்கேற்கவும், எங்கள் கூட்டு ஒத்துழைப்பைத் தொடரவும் ஆவலுடன் இருக்கிறோம். தற்போதைய மற்றும் எதிர்கால மாடல்களைப் பாதுகாப்பாகவும் முழுமையாகவும் மதிப்பிடுவதை உறுதிசெய்ய இத்தகைய ஒத்துழைப்பு இன்றியமையாதது எனக் கருதுகிறோம்.

ஆசிரியர்

OpenAI