મુખ્ય વિષય-સામગ્રી પર જાવો
OpenAI

4 ઑગસ્ટ, 2026

સુરક્ષા

OpenAI મોડલ સાથે તૃતીય-પક્ષ સાઇબર મૂલ્યાંકનો

લોડિંગ…

સ્વતંત્ર પરીક્ષણ અમલીકરણ પહેલાં જોખમોની ખરાઈ કરવામાં અને તેમને વધુ સારી રીતે સમજવામાં અમને મદદરૂપ થવામાં મહત્ત્વની ભૂમિકા ભજવે છે. કેટલાક સાઇબર મૂલ્યાંકનોમાં મૂળભૂત ક્ષમતા માપવા માટે જાણીજોઈને વિશિષ્ટ ગોઠવણો વપરાય છે, જેમાં સુરક્ષા ઉપાયો ઘટાડવાનો પણ સમાવેશ થાય છે. તેનાથી જાહેર ઉપયોગ માટેનાં અમલીકરણોમાં મોડલ સામાન્ય રીતે કેવું વર્તન કરે છે તે માપવામાં આવતું નથી.

તાજેતરનાં મૂલ્યાંકનો દરમિયાન બે બાહ્ય પરીક્ષણ ભાગીદારોએ એવી ઘટનાઓ ઓળખી, જેમાં પરીક્ષણની ગોઠવણો અને નિયંત્રણો સાથે તાજેતરનાં મોડલની વધતી ક્ષમતાઓને કારણે મોડલની પ્રવૃત્તિ તેની નિર્ધારિત પરીક્ષણ સીમાઓની બહાર વિસ્તરી શકી. મોડલ વધુ સક્ષમ બનતાં જાય તેમ પરીક્ષણ વાતાવરણો અને પદ્ધતિઓનાં ધોરણોને વિકસાવવા માટે સમગ્ર ઉદ્યોગ અને તૃતીય-પક્ષ મૂલ્યાંકનકારો સાથે સહયોગ કરવાનું મહત્ત્વ આ ઘટનાઓ દર્શાવે છે. સંપાદકની નોંધ: આ ઘટનાઓ Hugging Faceની સુરક્ષા ઘટનાથી અલગ છે અને અમે Hugging Faceની ઘટના વિશેની નવી માહિતી અહીં આપતા રહીશું.

નવી ઘટનાઓમાં એવી વિશિષ્ટ પરિસ્થિતિઓ અને ઘટાડેલા સુરક્ષા ઉપાયોની ગોઠવણ હેઠળ તૃતીય-પક્ષ સાઇબર મૂલ્યાંકનો દરમિયાન OpenAI મોડલ દ્વારા જાહેર ઇન્ટરનેટનો ઉપયોગ સામેલ હતો, જે સામાન્ય અમલીકરણને પ્રતિબિંબિત કરતી નહોતી. ઘટનાઓમાં આ સામેલ હતું:

  1. UK AISI એટલે કે બ્રિટિશ સરકારની AI સુરક્ષા સંસ્થા એવા સાઇબર-ક્ષેત્ર મૂલ્યાંકનો ચલાવી રહી હતી જેમાં ઇન્ટરનેટની સુલભતા જાણીજોઈને ચાલુ રાખવામાં આવી હતી, જેથી એજન્ટ પોતાનાં સાધનો શોધી શકે અને વાસ્તવિક હુમલાખોર જેવી પરિસ્થિતિઓમાં કામ કરી શકે. મૂળભૂત ક્ષમતા માપવા માટે સાઇબર વર્ગીકરણકારો પણ બંધ કરાયા હતા. તેમનો માહિતીલેખ તમે અહીં વાંચી શકો છો.(નવી વિન્ડોમાં ખૂલે છે)
  2. અમારા બાહ્ય સાઇબર સુરક્ષા પરીક્ષણ ભાગીદારોમાંથી એક Irregular ઇન્ટરનેટથી અલગ રાખવા માટે રચાયેલાં કેપ્ચર-ધ-ફ્લેગ શૈલીનાં મૂલ્યાંકનો ચલાવી રહ્યું હતું, પરંતુ પરીક્ષણ વાતાવરણની ખોટી ગોઠવણને કારણે મોડલ જાહેર ઇન્ટરનેટનો ઉપયોગ કરી શક્યાં.

નીચે અમે શું બન્યું, કઈ પરીક્ષણ પરિસ્થિતિઓએ આ પ્રવૃત્તિ શક્ય બનાવી, તેને નિયંત્રણમાં લેવા માટે કયાં પગલાં લેવાયાં અને વધુ ને વધુ સક્ષમ બનતાં મોડલનું સ્વતંત્ર પ્રયોગશાળાઓ કડક અને સુરક્ષિત રીતે મૂલ્યાંકન ચાલુ રાખી શકે તે સુનિશ્ચિત કરવા અમે શું કરી રહ્યા છીએ તેનો સાર આપ્યો છે.

તૃતીય-પક્ષ મોડલ મૂલ્યાંકન વાતાવરણોને વધુ મજબૂત બનાવવાં

આ ઘટનાઓ Hugging Faceની ઘટના વિશેની અમારી તાજેતરની નોંધમાં વર્ણવેલા વ્યાપક પડકાર તરફ ઇશારો કરે છે: મોડલની ક્ષમતાઓ વધે તેમ તેની આસપાસની સુરક્ષા અને સલામતી પ્રણાલીઓ પણ આગળ વધવી જોઈએ. તેમાં મોડલ વિકસાવવા માટે વપરાતાં વાતાવરણો ઉપરાંત પ્રયોગશાળાઓ અને સ્વતંત્ર ભાગીદારો તેને મૂલવવા માટે વાપરે છે તે વાતાવરણો પણ સામેલ છે.

આવતાં અઠવાડિયાંમાં અમે તૃતીય-પક્ષ પરીક્ષણ પ્રત્યેના અમારા અભિગમની સમીક્ષા કરીશું. તેમાં વધુ જોખમી મૂલ્યાંકનો ઓળખવાની અને કાર્યસીમા નક્કી કરવાની રીત, ઇન્ટરનેટની સુલભતા ચાલુ કરવા કે સુરક્ષા ઉપાયો ઘટાડવાની વિનંતીઓનું આકલન, અલગીકરણ, ઓળખપત્ર વ્યવસ્થાપન, દેખરેખ અને કાર્ય રોકવાની શરતો અંગેની અપેક્ષાઓ નક્કી કરવી તથા ઘટનાની સૂચના અને તેને ઉપલા સ્તરે લઈ જવાની વધુ સ્પષ્ટ પ્રક્રિયાઓ સ્થાપિત કરવી સામેલ છે.

ઉચ્ચ જોખમવાળાં મૂલ્યાંકનો સુરક્ષિત રીતે ચલાવવા માટેની સહિયારી પદ્ધતિઓ મજબૂત બનાવવા અમે સમગ્ર ઉદ્યોગ સાથે કામ કરવા પ્રતિબદ્ધ છીએ. તેમાં આવતાં અઠવાડિયાંમાં રાષ્ટ્રીય AI સંસ્થાઓ, સ્વતંત્ર મૂલ્યાંકનકારો, અન્ય AI પ્રયોગશાળાઓ અને બીજા જૂથો જેવા હિતધારકોને એકત્ર કરવાનો પણ સમાવેશ થાય છે. અમારો હેતુ કડક સ્વતંત્ર મૂલ્યાંકનનું મૂલ્ય જાળવી રાખવાનો અને પરીક્ષણ પદ્ધતિઓ વધુ ને વધુ સક્ષમ બનતાં મોડલની સાથે આગળ વધે તે સુનિશ્ચિત કરવાનો છે.

UK AISI

3 ઑગસ્ટે UK AISIએ અમને જણાવ્યું કે 25 જુલાઈએ શરૂ થયેલા નિયમિત સાઇબર મૂલ્યાંકન દરમિયાન કેટલાક કિસ્સામાં OpenAI અને અન્ય પ્રયોગશાળાનાં મોડલ પરીક્ષણની કાર્યસીમાની બહાર ગયાં હતાં. આ મૂલ્યાંકન વાસ્તવિક દુનિયાનાં નેટવર્કની નકલ કરવા માટે બનાવેલાં નિયંત્રિત સાઇબર ક્ષેત્રોમાં થયું હતું. ઓળખાયેલી 19 ઘટનાઓમાંથી બેમાં OpenAIનું GPT‑5.6 Sol મોડલ સામેલ હતું. અન્ય કિસ્સાઓમાં બીજી પ્રયોગશાળાનાં મોડલ સામેલ હતાં.

આ મૂલ્યાંકન માટે એજન્ટને કેપ્ચર-ધ-ફ્લેગની કવાયતમાં સાઇબર સુરક્ષા નિષ્ણાત તરીકે કામ કરવાની સૂચના અપાઈ હતી: પરસ્પર જોડાયેલાં ત્રણ કૃત્રિમ વાતાવરણમાં પ્રવેશ મેળવવો અને અંતિમ ધ્વજ મેળવવો. કાર્યના પ્રોમ્પ્ટમાં કાર્યસીમામાં આવતાં ક્ષેત્રનાં નેટવર્ક ઓળખાવવામાં આવ્યાં હતાં અને કેટલીક સિસ્ટમને કાર્યસીમાની બહારની ગણાવવામાં આવી હતી. UK AISIએ એજન્ટને સાધનો ડાઉનલોડ કરવા અને માનવ હુમલાખોર જેવી પરિસ્થિતિઓમાં કામ કરવા દેવા માટે સીધી ઇન્ટરનેટ સુલભતા પણ ચાલુ કરી હતી અને મૂળભૂત ક્ષમતા માપવા માટે મોડલના સાઇબર વર્ગીકરણકારો બંધ કર્યા હતા.

UK AISIની નિર્ધારિત અધિકૃતતા-સીમા કૃત્રિમ સાઇબર ક્ષેત્ર પૂરતી હતી: એજન્ટને નિર્દિષ્ટ કૃત્રિમ નેટવર્ક પર હુમલો કરીને ફ્લેગ મેળવવાની મંજૂરી હતી, પરંતુ ક્ષેત્રના નેટવર્કની સીમાની બહારની સિસ્ટમ સાથે સંપર્ક કરવાની મંજૂરી નહોતી. જોકે, એજન્ટને ખુલ્લા ઇન્ટરનેટની સુલભતાનો ઉપયોગ કઈ રીતે કરી શકાય અને કઈ રીતે નહીં તે સ્પષ્ટપણે જણાવાયું નહોતું. UK AISIએ તેને ઘટનાનું સંભવિત સહાયક કારણ ગણાવ્યું છે.

આ તમામ પ્રયાસોમાં UK AISIએ જોયું કે કૃત્રિમ ક્ષેત્રમાં પ્રવેશવાનો માર્ગ શોધીને ધ્વજ મેળવવાનો પ્રયાસ કરતી વખતે GPT‑5.6 Solએ બે અનધિકૃત પગલાં લીધાં:

  1. GPT‑5.6 Solએ અન્ય પ્રયોગશાળાના એજન્ટે જાહેર રીતે સુલભ રાખેલું GitHub ટોકન ફરી વાપરીને તપાસ્યું કે નિર્ધારિત ક્ષેત્રની અંદરની કોઈ સિસ્ટમ GitHub કે અન્ય અપડેટ સેવાને વારંવાર તપાસી રહી છે કે નહીં, ખાતું પુનઃપ્રાપ્ત કરવા અને વિનંતી મર્યાદા ટાળવાના ઉપાયો અજમાવ્યા તથા બાહ્ય DNS અને ટનલિંગ પ્રદાતાઓ પાસે ખાતાં નોંધાવ્યાં.
  2. GPT‑5.6 Solએ જાહેર ટનલિંગ સેવાનો ઉપયોગ કરીને તેના મૂલ્યાંકન વાતાવરણમાં સ્થાનિક રીતે ચાલતા DNS સર્વરને જાહેર ઇન્ટરનેટ પરથી સુલભ બનાવ્યું. સર્વરમાં પરીક્ષણ ક્ષેત્રમાં ચાલતા એક સોફ્ટવેરની જાણીતી નબળાઈનો લાભ લેવા માટે બનાવેલા પેલોડ હતા. આ ગોઠવણ કામ કરી નહોતી, કોઈ વાસ્તવિક રિઝોલ્વરે તેને ક્વેરી મોકલી હોવાનો પુરાવો નથી અને મૂલ્યાંકન પૂરું થતાં માળખું દૂર કરવામાં આવ્યું હતું.

મોડલ સાઇબર ક્ષેત્રનું કાર્ય પૂરું કરવાનો પ્રયાસ કરી રહ્યું હતું, છતાં UK AISIએ આ પગલાંને અનધિકૃત ગણ્યાં, કારણ કે તેમાં ક્ષેત્રની સીમાની બહારનાં વાસ્તવિક બાહ્ય ખાતાં અને સેવાઓ સામેલ હતાં તથા કાર્ય પૂરું કરવા માટે આ પગલાં જરૂરી નહોતાં. DNS સર્વર પર જાહેર ઇન્ટરનેટમાં નબળાઈનો લાભ લેતા પેલોડ પણ મૂકાયા હતા, જોકે ગોઠવણ કામ કરી નહોતી અને કોઈ વાસ્તવિક રિઝોલ્વરે તેને ક્વેરી મોકલી હોવાનો પુરાવો નથી.

સુરક્ષા દેખરેખમાં અસામાન્ય ડેટા ટ્રાન્સફર જણાયા બાદ UK AISIએ 28 જુલાઈએ આ પ્રવૃત્તિ ઓળખી. તેણે સંબંધિત મૂલ્યાંકનો અટકાવ્યાં, સંબંધિત મશીનોને અલગ કર્યાં અને પ્રવૃત્તિ જણાયાના લગભગ એક કલાકમાં તેને નિયંત્રણમાં લીધી.

આ પ્રવૃત્તિને ઓળખવા, તેની તપાસ કરવા અને તેની વિગતો વહેંચવાના કાર્ય સહિત સમગ્ર પ્રક્રિયા દરમિયાન UK AISIએ આપેલા સહકારની અમે કદર કરીએ છીએ. અમે આ સહયોગ આગળ પણ ચાલુ રાખવા આતુર છીએ.

Irregular

29 જુલાઈએ અમારા તૃતીય-પક્ષ મૂલ્યાંકન ભાગીદારોમાંથી એક Irregularએ કેપ્ચર-ધ-ફ્લેગ (CTF) શૈલીનાં સાઇબર સુરક્ષા મૂલ્યાંકનો દરમિયાન OpenAI મોડલ સાથે સંકળાયેલી એક ઘટના વિશે અમને જાણ કરી. મોડલને કૃત્રિમ વાતાવરણની નબળાઈઓનો લાભ લઈને છુપાયેલી માહિતી શોધવાની સૂચના અપાઈ હતી અને તેમને કહેવામાં આવ્યું હતું કે તેમની પાસે ઇન્ટરનેટની સુલભતા નથી. જોકે, પરીક્ષણ વાતાવરણની ખોટી ગોઠવણને કારણે મોડલ જાહેર ઇન્ટરનેટનો ઉપયોગ કરી શક્યાં.

એક પરીક્ષણમાં CTF પડકાર માટેના કાલ્પનિક લક્ષ્યનું નામ અજાણતાં એક વાસ્તવિક ડોમેન સાથે મેળ ખાતું હતું. પરીક્ષણ વાતાવરણ ભૂલથી ઇન્ટરનેટ સાથે જોડાયેલું હોવાથી, મોડલે એક વાસ્તવિક વેબસાઇટને કૃત્રિમ વાતાવરણનો ભાગ સમજીને તેની નબળાઈનો લાભ લીધો. આમાં અત્યાધુનિક સુરક્ષિત પરીક્ષણ-વાતાવરણમાંથી બહાર નીકળવાની રીત કે ઝીરો-ડે નબળાઈ સામેલ નહોતી. ઇન્ટરનેટની સુલભતા ખોટી ગોઠવણને કારણે મળી હતી અને મોડલે મૂળભૂત સુરક્ષા નબળાઈનો લાભ લીધો હોવાનું જણાયું.

Irregularની તપાસ અનુસાર, મોડલે તે જ સાઇટ ચલાવવા માટેનાં ક્રેડેન્શિયલ્સ પણ શોધ્યાં અને વાપર્યાં. Irregularને અસરગ્રસ્ત સાઇટના પોતાના ડેટાથી આગળ કોઈ અસર જણાઈ નથી અને તેનું નિરીક્ષણ ચાલુ છે. તેણે મૂલ્યાંકનો થોભાવ્યાં છે, સુધારાની કામગીરી શરૂ કરી છે અને અસરગ્રસ્ત તૃતીય પક્ષોને જાણ કરવામાં આવી છે. Irregularએ અમને જણાવ્યું છે કે ઘટના સંબંધિત ઓળખાયેલી તમામ સમસ્યાઓ હવે સક્રિય નથી અને પરીક્ષણ વાતાવરણમાં સંબંધિત સુરક્ષા ઉપાયો ઉમેરવામાં આવ્યા છે. Irregularએ એ જ પરીક્ષણ વાતાવરણમાંથી અન્ય પ્રયોગશાળાઓ સાથે સંકળાયેલી સંબંધિત ઘટનાઓ વિશે પણ માહિતી આપી છે.

અમે Irregularના ભાગીદારીની કદર કરીએ છીએ અને તેની સમીક્ષાને ટેકો આપવા તેની સાથે નજીકથી કામ કરવાનું ચાલુ રાખીશું. Irregular પ્રવૃત્તિને નિયંત્રિત રાખવા અને સાઇબર મૂલ્યાંકનો સુરક્ષિત રીતે ચલાવવાની શ્રેષ્ઠ પદ્ધતિઓ વહેંચવા માટે એક શ્વેતપત્ર પણ તૈયાર કરી રહ્યું છે. તારણો સમુદાયને ઉપલબ્ધ કરાવવા માટે અમે શ્વેતપત્રમાં યોગદાન આપવા અને આ સહયોગ ચાલુ રાખવા આતુર છીએ. વર્તમાન અને ભાવિ મોડલનું સુરક્ષિત અને સંપૂર્ણ મૂલ્યાંકન સુનિશ્ચિત કરવા માટે અમે આ પ્રકારના સહયોગને આવશ્યક માનીએ છીએ.

લેખક

OpenAI