Kukomesha kampeni iliyoratibiwa ya kuhamisha maarifa ya miundo
Hivi karibuni tuligundua na kukomesha kampeni iliyoratibiwa ya kuchota uwazaji unaolindwa kutoka kwa miundo yetu. Shughuli za kwanza tulizobaini zilifanyika katika wiki ya kwanza ya Julai. Shughuli hizi zinaendana na uhamishaji haramu wa maarifa kati ya miundo: matumizi ya kimfumo na yasiyoidhinishwa ya matokeo au uwazaji wa muundo mmoja ili kusaidia kufunza, kuiga au kuboresha muundo mwingine. Uwazaji unaolindwa ni rekodi ya ndani ya muundo inayoonyesha jinsi unavyoshughulikia kazi; kuuchota kunaweza kufichua taarifa ambazo hazijajumuishwa katika jibu la mwisho na kuwasaidia wengine kuiga uwezo wa muundo huo.
Wahusika hawakuvunja usimbaji fiche wetu, kuvamia hifadhidata au kupata ufikiaji wa moja kwa moja wa mazungumzo ya watumiaji yaliyohifadhiwa. Badala yake, walitumia ujanja katika mawasiliano na miundo ili kufanya uwazaji unaolindwa utolewe tena kwa namna inayoonekana kwa mwombaji. Walifanya hivyo kwa uratibu na kwa kiwango kikubwa, wakikiuka masharti yetu ya huduma. Ujanja huu hautumii udhaifu uliopo kwenye miundo ya OpenAI pekee. Tumeshiriki taarifa kuuhusu na washirika wa sekta kupitia Frontier Model Forum ili kuimarisha ulinzi wa pamoja dhidi ya uhamishaji haramu wa maarifa kati ya miundo.
Kabla ya kuchapisha taarifa hizi, tulichunguza ukubwa wa shughuli hizo na athari zinazoweza kutokea, tukatekeleza hatua zetu za kupunguza hatari, na kushiriki matokeo na kupokea maoni kutoka kwa watafiti na washirika wa sekta ili kuhakikisha kuwa kuna ulinzi dhidi ya mashambulizi ya aina hii. Kazi zaidi ya kupunguza hatari na kufanya uchunguzi inaendelea. Tunaamini kuwa kushiriki tuliyojifunza sasa kutasaidia wadau wengine katika sekta nzima kuimarisha ulinzi wao.
Tuliona wahusika wakijaribu kuchota uwazaji unaolindwa kwa mbinu mpya, zikiwemo kunakili uwazaji uliosimbwa fiche kutoka kwenye mazungumzo moja na kuomba muundo katika mazungumzo mengine ufumbue usimbaji huo na kuandika maudhui ya uwazaji yaliyofichwa.
Watafiti huru wa usalama(fungua katika dirisha jipya) pia walitujulisha kuhusu udhaifu unaohusiana na mwingiliano kati ya miundo na ukandamizaji wa mutadha wa mazungumzo, kwa kufuata utaratibu wa kuripoti udhaifu kwa uwajibikaji. Tulichunguza matokeo yao na kuthibitisha kuwa njia za kushambulia walizobaini zilikuwepo kweli. Kazi yao ilitusaidia kuelewa kundi pana zaidi la mashambulizi ya aina hii na kuharakisha hatua za kupunguza hatari.
Shughuli hizo zilianza tarehe 1 Julai, mwanzoni zikiwa chache, hadi tulipoona ongezeko kubwa tarehe 24 na 25 Julai: maombi 16,0001 kutoka kwa watumiaji zaidi ya 4,000, yakitumia mbinu ya uchotaji inayohusiana na shughuli hizo. Uchunguzi zaidi ulibaini matumizi ya vidokeza vyenye mpangilio unaohusiana na shughuli hizo katika kundi la watumiaji zaidi ya 15,000. Kufikia tarehe 28 Julai, tulikuwa tumekomesha shughuli hizo kabisa.
Shughuli hizo zilibadilika kadiri muda ulivyopita, zikisisitiza kuwa uhamishaji haramu wa maarifa kati ya miundo ni changamoto pana ya usalama inayohitaji ulinzi wa ngazi mbalimbali unaobadilika kulingana na vitisho.
Haijabainika kama wahusika wote tuliowaona katika kipindi husika walikuwa wakitenda kwa niaba ya mhusika mmoja. Hata hivyo, tunahusisha kundi kuu la shughuli hizo na watu wanaohusiana na Moonshot AI, kampuni iliyotengeneza Kimi.
Uhamishaji haramu wa maarifa kati ya miundo unahatarisha usalama wa watu na usalama wa taifa. Uwazaji uliochotwa unaweza kutumiwa kufunza muundo mwingine bila kudumisha kinga zinazotumika kwa matokeo ambayo muundo wa awali huonyesha watumiaji. Unapofanywa kwa kiwango kikubwa, uhamishaji wa maarifa kati ya miundo unaweza pia kuharakisha uhamishaji wa uwezo wa hali ya juu bila kuhitaji uwekezaji wa kiwango sawa katika usalama. Wasiwasi huu huongezeka kadiri miundo inavyopata uwezo katika nyanja zinazoweza kutumiwa kwa manufaa au kwa madhara.
Hatari hii haiikabili OpenAI pekee. Kama ilivyoelezwa hapo juu, mbinu zinazofanana zinaweza kuathiri mifumo mingine ya AI ya hali ya juu. Hivyo, hii ni changamoto ya pamoja ya usalama inayohitaji uratibu katika sekta nzima.
Tulipunguza athari za kampeni hii ya hivi karibuni ya kuhamisha maarifa kati ya miundo kwa kuchanganya hatua dhidi ya akaunti zilizokiuka masharti, udhibiti wa kiufundi na uratibu na washirika. Tulifungia au kuwekea vikwazo akaunti za ulaghai, tukaimarisha udhibiti wa usajili na miundombinu, na kupanua ufuatiliaji wa mitandao inayohusiana na shughuli hizo.
Pia tuliimarisha ulinzi wa uwazaji uliofichwa katika ngazi za watumiaji, maeneo ya kazi, mashirika na makundi ya miundo. Tuliziba njia iliyomwezesha mtu ambaye tayari alikuwa na uwazaji wa mtumiaji mwingine uliosimbwa fiche kuuwasilisha tena na kupata maudhui yake. Pia tuliongeza ukaguzi wa kugundua na kuzuia matokeo yanayotumwa hatua kwa hatua ambayo huenda yakafichua uwazaji. Shughuli zinazohusiana na kampeni hiyo zilipohamia kwenye huduma za wahusika wengine, tulishirikiana na watoa huduma hao kutambua na kuzuia akaunti zilizohusika.
Hatimaye, tulishiriki matokeo husika kupitia Frontier Model Forum na njia zinazofaa za serikali za kushiriki taarifa, ili watengenezaji wengine wa miundo ya mpaka na washirika wa sekta ya umma waweze kutafuta shughuli zinazofanana na kuimarisha ulinzi wao. Mifumo inayoruhusu rekodi za uwazaji kuhamishwa au kutumiwa tena inaweza kukabiliwa na hatari zinazohusiana na hizi.
Tunatarajia majaribio ya kuhamisha maarifa kati ya miundo kinyume cha sheria kutumia mbinu changamano zaidi kadiri miundo ya mpaka inavyoboreshwa na wahusika wanavyotafuta njia za gharama nafuu za kuiga uwezo wake. Kujilinda dhidi ya shughuli hizi kunahitaji udhibiti wa ngazi mbalimbali na marekebisho endelevu kulingana na vitisho.
Kazi hii bado haijakamilika. Mifumo inayohifadhiwa na washirika inahitaji ulinzi sawa na huduma tunazotoa moja kwa moja. Mashambulizi yanayotumia matokeo ya zana yanahitaji ulinzi unaokagua zaidi ya maandishi ya kawaida yanayoonekana. Tunaendelea kuboresha ulinzi wa zana, kupanua wigo wa utambuzi wa mifumo ya uainishaji, kuimarisha uwezo wa miundo kukataa maombi yasiyofaa, na kusambaza udhibiti husika kwa washirika wa huduma za wingu.
Hatua zetu zitaendelea kulenga maeneo matatu: ulinzi thabiti zaidi wa kiufundi dhidi ya uchotaji, ugunduzi bora wa kampeni zilizoratibiwa na uchukuaji wa hatua dhidi yake, na ushirikiano wa kina zaidi kati ya sekta na serikali katika kushiriki taarifa za vitisho.

