முக்கிய உள்ளடக்கத்திற்கு செல்க
OpenAI

30 செப்டம்பர், 2026

பாதுாய்வு

ஒருங்கிணைந்த மாடல் அறிவு வடித்தெடுப்பு முயற்சியை முறியடித்தல்

ஏற்றுகிறது…

எங்கள் மாடல்களில் பாதுகாக்கப்பட்டுள்ள ரீஸனிங்கைப் பிரித்தெடுக்க மேற்கொள்ளப்பட்ட ஒருங்கிணைந்த முயற்சியை அண்மையில் கண்டறிந்து முறியடித்தோம். இது தொடர்பான செயல்பாடு முதன்முதலில் ஜூலை முதல் வாரத்தில் காணப்பட்டது. இந்தச் செயல்பாடு, தாக்குதல் நோக்கிலான அறிவு வடித்தெடுப்பின் தன்மைகளைக் கொண்டுள்ளது. அதாவது, ஒரு மாடலின் வெளியீடுகளை அல்லது ரீஸனிங்கை அனுமதியின்றி முறையாகப் பயன்படுத்தி, மற்றொரு மாடலைப் பயிற்றுவிக்கவோ, உருவாக்கவோ, மேம்படுத்தவோ உதவுவதாகும். பாதுகாக்கப்பட்ட ரீஸனிங் என்பது ஒரு பணியைச் செய்து முடிப்பதற்கான மாடலின் உள்பதிவு. அதைப் பிரித்தெடுப்பதால், இறுதிப் பதிலில் வெளியிடப்படாத தகவல்கள் வெளிப்படலாம்; மாடலின் திறன்களை மற்றவர்கள் மீண்டும் உருவாக்கவும் அது உதவலாம்.

இதில் ஈடுபட்டவர்கள் எங்கள் குறியாக்கத்தை உடைக்கவோ, தரவுத்தளத்திற்குள் ஊடுருவவோ, சேமிக்கப்பட்ட பயனர் உரையாடல்களை நேரடியாக அணுகவோ இல்லை. மாறாக, கோரிக்கை விடுப்பவருக்குத் தெரியக்கூடிய வடிவங்களில் பாதுகாக்கப்பட்ட ரீஸனிங்கை மீண்டும் வெளியிடச் செய்யும் வகையில், மாடலுடனான உரையாடல்களை அவர்கள் கையாண்டனர். ஒருங்கிணைந்த முறையில் பெரிய அளவில் மேற்கொள்ளப்பட்ட இந்தச் செயல்பாடு, எங்கள் சேவை விதிமுறைகளை மீறியது. இவ்வாறு கையாளப்படக்கூடிய பலவீனம் OpenAI மாடல்களுக்கு மட்டும் உரியதல்ல. தாக்குதல் நோக்கிலான அறிவு வடித்தெடுப்புக்கு எதிரான கூட்டுப் பாதுகாப்பை வலுப்படுத்த, அதிநவீன மாடல் மன்றம் வழியாகத் தொழில்துறைக் கூட்டாளர்களுடன் இது குறித்த தகவல்களைப் பகிர்ந்துள்ளோம்.

இதை வெளியிடுவதற்கு முன், இச்செயல்பாட்டின் பரப்பையும் சாத்தியமான தாக்கத்தையும் ஆராய்ந்தோம்; எங்கள் தரப்பில் தடுப்பு நடவடிக்கைகளைச் செயல்படுத்தினோம். இவ்வகைத் தாக்குதலுக்கு எதிரான பாதுகாப்புகள் நடைமுறையில் இருப்பதை உறுதிசெய்ய, ஆராய்ச்சியாளர்களுடனும் தொழில்துறைக் கூட்டாளர்களுடனும் தகவல்களைப் பகிர்ந்து, அவர்களது கருத்துகளையும் பெற்றோம். கூடுதல் தடுப்பு நடவடிக்கைகளும் விசாரணைப் பணிகளும் தொடர்கின்றன. நாங்கள் அறிந்தவற்றை இப்போது பகிர்வது, இத்துறை சார்ந்த அனைவரும் தங்கள் பாதுகாப்பை வலுப்படுத்த உதவும் என்று நம்புகிறோம்.

நாங்கள் கண்டறிந்தவை

பாதுகாக்கப்பட்ட ரீஸனிங்கைப் புதிய வழிகளில் பிரித்தெடுக்க அவர்கள் முயன்றதைக் கண்டோம். எடுத்துக்காட்டாக, ஓர் உரையாடலிலிருந்து குறியாக்கப்பட்ட ரீஸனிங்கை நகலெடுத்து, மற்றொரு உரையாடலில் உள்ள மாடலிடம் அதன் குறியாக்கத்தை நீக்கி, மறைக்கப்பட்ட ரீஸனிங் உள்ளடக்கத்தை எழுத்தாக வெளியிடுமாறு கேட்டனர்.

சுயாதீனப் பாதுகாப்பு ஆராய்ச்சியாளர்களும்⁠(புதிய சாளரத்தில் திறக்கும்) மாடல்களுக்கு இடையிலான பரிமாற்றம் மற்றும் உரையாடல் சுருக்குதல் தொடர்பான பலவீனங்களைப் பொறுப்பான முறையில் வெளிப்படுத்தி, எங்கள் கவனத்திற்குக் கொண்டுவந்தனர். அவர்களது கண்டுபிடிப்புகளை ஆராய்ந்து, அவர்கள் அடையாளம் கண்ட தாக்குதல் வழிகள் உண்மையிலேயே செயல்படக்கூடியவை என்பதை உறுதிப்படுத்தினோம். இந்த வகைத் தாக்குதல்களை விரிவாகப் புரிந்துகொள்ளவும், தடுப்பு நடவடிக்கைகளை விரைவுபடுத்தவும் அவர்களது பணி உதவியது.

ஜூலை 1 அன்று தொடங்கிய இந்தச் செயல்பாடு, முதலில் குறைந்த அளவிலேயே இருந்தது. ஜூலை 24 மற்றும் 25 தேதிகளில் அது பெருமளவில் அதிகரித்ததைக் கண்டோம்: 4,000-க்கும் மேற்பட்ட பயனர்களிடமிருந்து, தொடர்புடைய பிரித்தெடுப்பு முறையைப் பயன்படுத்திய 16,000 கோரிக்கைகள்1 வந்தன. மேலும் விசாரித்ததில், 15,000-க்கும் மேற்பட்ட பயனர்களைக் கொண்ட ஒரு தொகுப்பில் இதனுடன் தொடர்புடைய ப்ராம்ப்ட் வடிவிலான செயல்பாடுகளைக் கண்டறிந்தோம். ஜூலை 28-க்குள் அவற்றை முழுமையாக முறியடித்தோம்.

காலப்போக்கில் இந்தச் செயல்பாட்டின் முறைகள் மாறின. தாக்குதல் நோக்கிலான அறிவு வடித்தெடுப்பு என்பது, பல அடுக்குகளைக் கொண்ட, சூழலுக்கேற்ப மாறக்கூடிய பாதுகாப்புகள் தேவைப்படும் விரிவான பாதுகாப்புச் சவால் என்பதை இது மேலும் உறுதிப்படுத்தியது.

இதன் பின்னணியில் இருப்பவர்கள் குறித்த எங்கள் மதிப்பீடு

குறிப்பிட்ட காலப்பகுதியில் நாங்கள் கவனித்த அனைவரும் ஒரே தரப்பின் சார்பில் செயல்பட்டார்களா என்பது தெளிவாகத் தெரியவில்லை. இருப்பினும், இச்செயல்பாட்டின் முக்கியத் தொகுப்பு ஒன்றை மேற்கொண்டவர்கள், கிமியை உருவாக்கிய மூன்ஷாட் ஏஐ நிறுவனத்துடன் தொடர்புடையவர்கள் என மதிப்பிடுகிறோம்.

இது ஏன் முக்கியம்

தாக்குதல் நோக்கிலான அறிவு வடித்தெடுப்பு, பாதுகாப்புக்கும் தேசியப் பாதுகாப்புக்கும் ஆபத்துகளை ஏற்படுத்துகிறது. அசல் மாடல் பயனர்களுக்கு வழங்கும் வெளியீடுகளில் உள்ள பாதுகாப்பு ஏற்பாடுகளைத் தக்கவைக்காமல், பிரித்தெடுக்கப்பட்ட ரீஸனிங்கைப் பயன்படுத்தி மற்றொரு மாடலைப் பயிற்றுவிக்க முடியும். பெரிய அளவில் மேற்கொள்ளப்படும் அறிவு வடித்தெடுப்பு, பாதுகாப்பில் அதே அளவு முதலீடு செய்யாமலேயே மேம்பட்ட திறன்களைப் பிற மாடல்களுக்கு விரைவாக மாற்றவும் வழிவகுக்கும். நன்மைக்கும் தீமைக்கும் பயன்படுத்தக்கூடிய துறைகளில் மாடல்களின் திறன்கள் வளரும்போது, இந்தக் கவலைகள் மேலும் அதிகரிக்கின்றன.

இந்த ஆபத்து OpenAI-க்கு மட்டும் உரியதல்ல. மேலே குறிப்பிட்டபடி, இதே போன்ற உத்திகள் மற்ற மேம்பட்ட செயற்கை நுண்ணறிவு அமைப்புகளையும் பாதிக்கலாம். எனவே, இது தொழில்துறை முழுவதும் ஒருங்கிணைந்து எதிர்கொள்ள வேண்டிய பொதுவான பாதுகாப்புச் சவாலாகும்.

நாங்கள் எடுத்த நடவடிக்கைகள்

கணக்குகள் மீதான விதிமுறை அமலாக்கம், தொழில்நுட்பக் கட்டுப்பாடுகள், கூட்டாளர்களுடனான ஒருங்கிணைப்பு ஆகியவற்றை இணைத்து, அண்மையில் நடந்த இந்த அறிவு வடித்தெடுப்பு முயற்சியைக் கட்டுப்படுத்தினோம். மோசடிக் கணக்குகளைத் தடைசெய்தோம் அல்லது கட்டுப்படுத்தினோம்; பதிவுசெய்தல் மற்றும் உள்கட்டமைப்புக் கட்டுப்பாடுகளை வலுப்படுத்தினோம்; தொடர்புடைய வலையமைப்புகளின் கண்காணிப்பை விரிவுபடுத்தினோம்.

பயனர்கள், பணியிடங்கள், நிறுவனங்கள், மாடல் குடும்பங்கள் அனைத்திலும் மறைக்கப்பட்ட ரீஸனிங்கிற்கான பாதுகாப்புகளையும் வலுப்படுத்தினோம். மற்றொரு பயனரின் குறியாக்கப்பட்ட ரீஸனிங்கை ஏற்கெனவே வைத்திருப்பவர், அதை மீண்டும் உள்ளீடாகச் செலுத்தி அதன் உள்ளடக்கத்தை மீட்க வழிவகுத்த பாதையை அடைத்தோம். மேலும், ரீஸனிங்கை வெளிப்படுத்தக்கூடிய தொடர் வெளியீட்டைக் கண்டறிந்து நிறுத்திவைக்கச் சோதனைகளைச் சேர்த்தோம். தொடர்புடைய செயல்பாடு மூன்றாம் தரப்புச் சேவைகள் வழியாகத் தொடர்ந்தபோது, அதில் ஈடுபட்ட கணக்குகளைக் கண்டறிந்து முடக்க, அந்தச் சேவை வழங்குநர்களுடன் இணைந்து செயல்பட்டோம்.

இறுதியாக, அதிநவீன மாடல் மன்றம் மற்றும் பொருத்தமான அரசுத் தகவல் பகிர்வு வழிகள் மூலம் தொடர்புடைய கண்டுபிடிப்புகளைப் பகிர்ந்தோம். இதன் மூலம், பிற அதிநவீன மாடல் உருவாக்குநர்களும் பொதுத்துறைக் கூட்டாளர்களும் இதே போன்ற செயல்பாடுகளைத் தேடிக் கண்டறிந்து, தங்கள் பாதுகாப்பை வலுப்படுத்த முடியும். இடம்மாற்றக்கூடிய அல்லது மீண்டும் உள்ளீடாகப் பயன்படுத்தக்கூடிய ரீஸனிங் பதிவுகளை ஆதரிக்கும் அமைப்புகளும் இதுபோன்ற ஆபத்துகளை எதிர்கொள்ளலாம்.

அடுத்தகட்ட நடவடிக்கைகள்

அதிநவீன மாடல்கள் மேம்படுவதாலும், அவற்றின் திறன்களைப் பின்பற்றிக் குறைந்த செலவில் உருவாக்கும் வழிகளைச் சிலர் தேடுவதாலும், தாக்குதல் நோக்கிலான அறிவு வடித்தெடுப்பு முயற்சிகள் மேலும் நுட்பமாகும் என எதிர்பார்க்கிறோம். இச்செயல்பாட்டிலிருந்து பாதுகாத்துக்கொள்ளப் பல அடுக்குக் கட்டுப்பாடுகளும், சூழலுக்கேற்பத் தொடர்ந்து மாற்றங்களைச் செய்வதும் அவசியம்.

இந்தப் பணி இன்னும் முடிவடையவில்லை. நாங்கள் நேரடியாக வழங்கும் சேவைகளில் உள்ள அதே பாதுகாப்புகள், கூட்டாளர்கள் இயக்கும் அமைப்புகளுக்கும் தேவை. கருவி வெளியீடுகள் வழியான தாக்குதல்களைத் தடுக்க, வழக்கமாகக் கண்ணுக்குத் தெரியும் உரையைத் தாண்டியும் ஆய்வு செய்யும் பாதுகாப்புகள் அவசியம். கருவிகளுக்கான பாதுகாப்புகள், வகைப்படுத்திகளின் கண்காணிப்புப் பரப்பு, மாடல்களின் மறுப்புத் திறன் ஆகியவற்றைத் தொடர்ந்து மேம்படுத்தி வருகிறோம். தொடர்புடைய கட்டுப்பாடுகளை மேகக்கணினிக் கூட்டாளர்கள் அனைவரிடமும் விரிவுபடுத்தி வருகிறோம்.

எங்கள் நடவடிக்கைகள் தொடர்ந்து மூன்று பகுதிகளில் கவனம் செலுத்தும்: பிரித்தெடுப்புக்கு எதிரான வலுவான தொழில்நுட்பப் பாதுகாப்புகள்; ஒருங்கிணைந்த முயற்சிகளைச் சிறப்பாகக் கண்டறிந்து அவற்றுக்கு எதிராக விதிமுறைகளை அமல்படுத்துதல்; தொழில்துறைக்கும் அரசுக்கும் இடையே அச்சுறுத்தல் குறித்த தகவல்களை மேலும் விரிவாகப் பகிர்தல்.

ஆசிரியர்/எழுத்தாளர்

OpenAI

அடிக்குறிப்புகள்

  1. 1

    இந்த எண்ணிக்கைகள் தகவலைப் பிரித்தெடுக்க மேற்கொள்ளப்பட்ட முயற்சிகளைக் குறிக்கின்றன; அவை அனைத்தும் வெற்றியடைந்ததாகக் கொள்ளக்கூடாது.