Пређите на главни садржај
OpenAI

1. јун 2025.

Безбедност

Операција „Подругљива рецензија“: утицајна активност пореклом из Кине

OpenAI је забранио налоге који су помоћу вештачке интелигенције правили објаве са критикама тајванског инфлуенсера и о повезаним темама у САД.

Учитавање…

Ова студија случаја првобитно је објављена у OpenAI извештају из јуна 2025.⁠(отвара се у новом прозору)

Актер

Забранили смо ChatGPT налоге за које смо открили да помоћу наших модела масовно праве објаве за друштвене мреже, у складу са активностима прикривене операције утицаја. Током истраге приметили смо и да су на овим налозима састављани интерни извештаји о учинку.

Са ових налога су углавном задаване инструкције на кинеском, усмерене на политичке и геополитичке теме значајне за Кину. Један корисник је у инструкцији навео да ради за кинеско Одељење за пропаганду, али немамо независне доказе којима бисмо потврдили ту тврдњу.

Понашање

Налози које смо забранили били су укључени у две главне врсте активности. Најобимнија активност била је прављење кратких коментара за друштвене мреже на енглеском и кинеском, уз неколико на урдуу. Утврдили смо да су многи од ових коментара објављени на платформама TikTok и X, док се додатни садржај појављивао на Reddit-у, Facebook-у и различитим веб-сајтовима.

Уобичајени образац подразумевао је почетни коментар са „главног“ налога, често наизглед направљеног само за ту објаву, након чега је следио низ одговора са других налога. Изгледа да је циљ оваквог понашања био стварање лажног утиска о спонтаној интеракцији.

Објава на TikTok-у повезана са операцијом „Подругљива рецензија“.

Објава на TikTok-у под насловом „Гашење #USAID-а је само #ПОЧЕТАК!“, повезана са овом активношћу. Назив канала, текст титлова у видеу и све коментаре видљиве на овом снимку екрана направила је ова мрежа помоћу ChatGPT‑а.

На TikTok-у су налози који су остављали коментаре користили корисничка имена на различитим језицима и писмима, често неповезаним са језиком садржаја који су објављивали. На пример, налог са корејским именом објавио је коментар на урдуу, док су налози са тајландским и хебрејским именима објављивали коментаре на енглеском које је направила ова мрежа. На платформи X, налози који су остављали коментаре обично су користили цртане профилне слике, а у неким случајевима имали су имена повезана са криптовалутама.

Твит и одговори повезани са операцијом „Подругљива рецензија“.

Твит и одговори на њега, које је ова мрежа направила помоћу ChatGPT‑а.

Мрежа је била мање активна на Facebook-у. Њене активности углавном су обухватале прављење назива и профилних слика за две странице које су се представљале као медији. Ниједна страница није имала пратиоце ни свиђања, а на свакој је било свега неколико објава.

Објава на Facebook-у повезана са операцијом „Подругљива рецензија“.

Објава на Facebook-у којом се дели видео за који смо утврдили да је вероватно повезан са овом операцијом.

Мрежа је повремено правила дуже објаве на кинеском или енглеском. Једну такву објаву пронашли смо на Reddit-у, а још две на различитим веб-форумима. Друга врста активности подразумевала је коришћење ChatGPT‑а за израду докумената који су, по свему судећи, били интерне смернице или извештаји о учинку.

Резултати

Садржај за друштвене мреже који је овај актер претње правио обухватао је разне теме, све уско усклађене са геостратешким интересима Кине.

Део садржаја био је усмерен на Тајван, а посебно на „Обрнути фронт“⁠(отвара се у новом прозору) („逆統戰“), видео-игру и друштвену игру усредсређене на Тајван, које замишљају отпор Комунистичкој партији Кине. Мрежа је направила десетине критичких коментара о игри на кинеском, а затим и дужи чланак у којем се тврдило да је изазвала широко негодовање. То је била најпрепознатљивија активност ове операције, па смо је на основу тога назвали „Подругљива рецензија“.

Други садржај, на енглеском и урдуу, био је усмерен на пакистанску активисткињу Махранг Балоч, која је јавно критиковала кинеска улагања у Белуџистану⁠(отвара се у новом прозору). Налог на TikTok-у и страница на Facebook-у повезани са мрежом објавили су видео у којем су лажно оптужили Балоч да се појавила у порнографском филму. Операција је затим направила стотине кратких коментара на оба језика како би створила привид великог интересовања.

Коментари на видео Махранг Балоч на TikTok-у.

Шокирани коментари на видео Махранг Балоч на TikTok-у.

Последња група садржаја била је усредсређена на гашење америчке Агенције за међународни развој (USAID), уз прављење кратких коментара који су тај потез хвалили или критиковали. Ови коментари објављени су на платформама TikTok и X.

Твитови који повезују помоћ и царине, направљени у оквиру операције „Подругљива рецензија“.

Твитови који повезују питање помоћи са питањем царина, а које је ова мрежа направила помоћу ChatGPT‑а.

На крају, актери претње користили су наше моделе за израду наизглед интерних докумената, укључујући детаљан есеј написан у стилу званичног документа о јавној безбедности и извештај о учинку који описује кораке предузете ради успостављања и вођења операције.

Утицај

Изгледа да је ова операција била тек у почетној фази када смо прекинули њено коришћење наших модела. Ниједна страница на Facebook-у није имала пратиоце. На Reddit-у је једна објава добила 44 позитивна гласа, док су друге две блокиране или уклоњене са подфорума на којима су објављене.

Уклоњена објава на Reddit-у повезана са операцијом „Подругљива рецензија“.

Снимак екрана објаве са налога на Reddit-у који смо препознали као део ове мреже, на којем се види да су је уклонили филтери платформе.

Интеракције на платформама X и TikTok биле су разноврсније: два видеа на TikTok-у прикупила су укупно 25.000 свиђања, док су твитови са главног налога ове операције обично имали око 10.000 прегледа. Међутим, многе коментаре на овим објавама направила је ова мрежа помоћу ChatGPT‑а, што указује на барем делимично неаутентичну интеракцију. Зато све податке о интеракцијама треба тумачити опрезно.

Према скали продора⁠(отвара се у новом прозору) за мерење утицаја операција утицаја, ово бисмо сврстали на доњу границу 3. категорије ако су подаци о интеракцијама на платформама X и TikTok аутентични. Оцену бисмо снизили ако се појави више доказа који потврђују претпоставку да већина свиђања и прегледа, као и већина коментара, није била аутентична.