Ruka hadi kwenye maudhui kuu
OpenAI

21 Julai 2026

Ulinzi

OpenAI na Hugging Face washirikiana kushughulikia tukio la usalama wakati wa tathmini ya muundo

Inapakia…

Wiki iliyopita, Hugging Face ilifichua aina mpya ya tukio la usalama(fungua katika dirisha jipya) baada ya kugundua na kudhibiti wakala wa AI aliyohatarisha miundombinu yao, jambo tunalotarajia litazidi kuwa la kawaida kadiri miundo yenye uwezo mkubwa zaidi wa kimtandao inavyoenea. Baada ya uchunguzi, sasa tunajua kuwa tukio hili mahususi liliendeshwa na mchanganyiko wa miundo ya OpenAI — ikiwemo GPT‑5.6 Sol na muundo wa kabla ya kutolewa wenye uwezo mkubwa zaidi, yote ikiwa imepunguziwa kukataa maombi ya kimtandao kwa madhumuni ya tathmini — wakati wa majaribio ya ndani kwenye kipimo(fungua katika dirisha jipya) cha uwezo wa kimtandao.

Tunalichukulia tukio hili kuwa tukio la kimtandao lisilo na kifani, linalohusisha uwezo wa kisasa zaidi wa kimtandao, na tunalijibu ipasavyo. Tunashiriki matokeo ya awali katika hatua hii ili kuwasaidia walinzi kuelewa kilichotokea na kupima kwa usahihi uwezo ambao miundo sasa inao. Tutaendelea kufanya uchunguzi wa kina pamoja na Hugging Face na tutashiriki maelezo zaidi kuhusu athari za kiusalama, tukio, na matokeo uchunguzi wetu utakapokamilika.

Kilichotokea wakati wa tukio hili

Tukio hili lilitokea wakati wa tathmini ya ndani inayoiagiza miundo kufuatilia unyonyaji wa hali ya juu kwa kutumia njia changamano za mashambulizi, kwa lengo la kupima uwezo wake wa kimtandao. Tunakadiria uwezo wa juu zaidi wa kimtandao kwa kuendesha tathmini hii bila viainishaji vya uzalishaji vinavyotumika kuzuia miundo kufuatilia shughuli za kimtandao zenye hatari kubwa. Vipimo vyetu huendeshwa katika mazingira yaliyotengwa sana, huku ufikiaji wa mtandao ukizuiwa hadi uwezo wa kusakinisha vifurushi kupitia programu ya mhusika mwingine inayopangishwa ndani, ambayo hufanya kazi kama proksi na akiba ya sajili za vifurushi.

Miundo hiyo ilitambua na kuunganisha athari za kiusalama katika mazingira ya utafiti ya OpenAI na miundombinu ya uzalishaji ya Hugging Face ili kupata majibu ya majaribio moja kwa moja kutoka hifadhidata ya uzalishaji ya Hugging Face. Ushahidi wote unaonyesha kuwa miundo hiyo ilijikita kupita kiasi katika kupata suluhisho la ExploitGym, ikichukua hatua kali sana ili kufikia lengo finyu la majaribio.

Ikiwa inafanya kazi katika mazingira yetu ya majaribio yaliyotengwa, miundo yetu ilitumia kiasi kikubwa cha kompyuti ya uhawilishaji kutafuta njia ya kupata ufikiaji wazi wa Intaneti, ikiwa na lengo la kutatua tatizo la tathmini. Ili kupata ufikiaji, miundo ilitambua na kutumia athari ya zero-day (ambayo sasa tumeifichua kwa uwajibikaji kwa muuzaji) katika proksi ya akiba ya sajili ya vifurushi. Kwa ufikiaji huu, miundo yetu ilitekeleza mfululizo wa hatua za kuongeza upendeleo na kusogea upande kwa upande katika mazingira yetu ya majaribio ya utafiti hadi miundo ilipofikia nodi yenye ufikiaji wa Intaneti.

Baada ya kupata ufikiaji wa Intaneti, miundo ilihitimisha kuwa huenda Hugging Face ilikuwa inapangisha miundo, seti za data na suluhisho za ExploitGym. Kwa kujua hili, muundo ulitafuta na kufanikiwa kupata njia za kufikia taarifa za siri ambazo ungeweza kutumia kudanganya tathmini. Katika mfano mmoja, muundo uliunganisha vekta kadhaa za mashambulizi, ikiwemo kutumia vitambulisho vilivyoibiwa na athari za zero-day ili kupata njia ya kutekeleza msimbo kwa mbali kwenye seva za Hugging Face. Timu ya usalama ya OpenAI iligundua shughuli hii isiyo ya kawaida ndani ya shirika.

Timu ya usalama ya Hugging Face na mawakala wake waligundua na kusitisha shughuli hiyo kwenye miundombinu yao, na walikuwa tayari wameanza kuidhibiti na kuijenga upya kwa uchunguzi wa kidijitali kwa kutumia miundo yao ya open-source kabla ya timu zetu kuunganishwa. Tunashirikiana nao kikamilifu kuendelea kuchunguza tukio hilo. Tunashukuru Hugging Face kwa ushirikiano wao wa haraka na wa karibu katika uchunguzi na urekebishaji.

Hatua tunazochukua sasa

  1. Kama sehemu ya uchunguzi, tunatekeleza udhibiti mkali katika usanidi wa miundombinu, hata kama hilo linapunguza kasi ya utafiti, wakati athari hizo za kiusalama zikirekebishwa. Tunaiarifu mara kwa mara Kamati yetu ya Usalama na Ulinzi kuhusu udhibiti huu na athari zake.
  2. Tunashirikiana na Hugging Face kufanya uchunguzi wa kina wa kidijitali kuhusu tukio hilo.
  3. Tumefichua kwa uwajibikaji athari ya zero-day iliyotambuliwa katika programu ya mhusika mwingine inayopangishwa ndani, na tunashirikiana nao kuirekebisha.
  4. Tumeijumuisha Hugging Face katika mpango wa ufikiaji unaoaminika na tunazisaidia timu zao kutumia haraka uwezo wa miundo yetu kuimarisha ulinzi wao.
  5. Tunaboresha na kuongeza ulinzi imara zaidi kwa mafunzo na tathmini zijazo. Wiki hii, tulichapisha blogu kuhusu kuboresha usalama na uoanishaji katika enzi ya miundo yenye upeo mrefu wa muda wa kazi. Ulinzi huu wa matumizi haukuwashwa kwa makusudi wakati wa tathmini hii kwa sababu lengo lake lilikuwa kupima athari za kiusalama za mtandao. Tukio hili linaonyesha haja ya kuimarisha zaidi uoanishaji wa muundo wetu, ulinzi wa kimtandao wakati wa tathmini, na ufuatiliaji wakati wa majaribio ya ndani.

Mbinu yetu ya kutathmini uwezo wa hali ya juu wa kimtandao

Kama tulivyoshiriki hivi karibuni, AI inaharakisha ugunduzi na utumiaji wa athari za kiusalama. Funzo kuu kutokana na tukio hili ni kwamba usalama na ulinzi wa muundo lazima viende sambamba na uwezo unaosonga mbele kwa kasi. Tunaimarisha uzuiaji, ufuatiliaji, udhibiti wa ufikiaji, na mbinu za tathmini zinazotumika wakati wa ukuzaji wa muundo.

Tathmini ya UK AISI inaonyesha kuwa miundo kama GPT‑5.6 Sol inazidi kuweza kuendeleza operesheni changamano za kimtandao, zenye hatua nyingi, katika upeo mrefu wa muda wa kazi. Tukio hili linaashiria kuwa uwezo huu wa kinadharia hutumika katika mazingira halisi.

Chati kutoka Taasisi ya Usalama wa AI ya Uingereza inayolinganisha miundo ya hivi karibuni ya open-weight na miundo ya AI ya kiwango cha juu zaidi kwenye majaribio ya kimtandao yenye upeo mrefu wa muda wa kazi.

Tukio hili pia linaonyesha wazi kuwa miundo ya hali ya juu inaweza kugundua na kutumia njia mpya za mashambulizi katika mifumo halisi bila kufikia msimbo chanzo. Linaonyesha kuwa uwezo wa hali ya juu wa kimtandao lazima uendelezwe pamoja na ulinzi imara zaidi na zana za kujilinda.

Tunaamini miundo yenye uwezo wa hali ya juu wa kimtandao inapaswa kusaidia timu za usalama kupata udhaifu kabla ya washambuliaji, kuelewa jinsi athari za kiusalama zinavyoweza kuunganishwa, na kuzirekebisha kwa kasi ya mashine. Tunatumia uwezo huu kuendelea kuimarisha ulinzi wa usanidi wa miundombinu na mazingira ya tathmini ya muundo; tutashiriki matokeo na mbinu bora tunapoendelea kujifunza. Tunawahimiza walinzi wengine watume maombi ya ufikiaji unaoaminika na wajaribu miundo hii sasa ili kuugeuza uwezo huu kuwa uzuiaji bora, ugunduzi wa haraka zaidi, na mwitikio bora zaidi kwa matukio.

“Tunashukuru kwa ushirikiano na OpenAI kuhusu hili na mada nyingine. Tukio hili, ambalo huenda likawa la kwanza la aina yake, linathibitisha jambo ambalo tumeliamini kwa muda mrefu: usalama wa AI hautatatuliwa na kampuni yoyote moja inayofanya kazi kwa siri. Utatatuliwa kwa uwazi, kwa ushirikiano, na kwa ufikiaji mpana wa AI kwa kila mlinzi, kila mahali.”
—Clem Delangue, Mwanzilishi mwenza na CEO, Hugging Face

Mwandishi

OpenAI