„Gúnyos értékelés” művelet: kínai eredetű befolyásolási tevékenység
Az OpenAI letiltotta azokat a fiókokat, amelyek MI-vel bíráltak egy tajvani közösségimédia-véleményvezért és kapcsolódó amerikai témákat.
Ez az esettanulmány eredetileg az OpenAI 2025. júniusi(új ablakban nyílik meg) jelentésében jelent meg.
Szereplő
Letiltottuk azokat a ChatGPT‑fiókokat, amelyek észlelésünk szerint modelljeinkkel tömegesen generáltak közösségimédia-bejegyzéseket egy titkos befolyásolási művelet tevékenységéhez illeszkedően. Vizsgálatunk során azt is megfigyeltük, hogy ezekkel a fiókokkal belső teljesítményértékeléseket fogalmaztak.
Ezekből a fiókokból főként kínai nyelvű utasításokat adtak, és a Kína szempontjából releváns politikai és geopolitikai témákra összpontosítottak. Egy felhasználó egy utasításban azt állította, hogy a kínai Propagandaosztálynak dolgozik, de nincs független bizonyítékunk az állítás igazolására.
Viselkedés
Az általunk letiltott fiókok két fő munkafolyamatban vettek részt. A nagyobb volumenű munkafolyamat keretében rövid közösségimédia-hozzászólásokat generáltak angolul és kínaiul, kisebb számban pedig urdu nyelven. E hozzászólások közül sokat megtaláltunk a TikTokon és az X-en, további tartalmak pedig a Redditen, a Facebookon és különböző webhelyeken jelentek meg.
Jellemzően egy „fő” fiókból tették közzé az első hozzászólást – a fiókot gyakran láthatóan kizárólag ehhez hozták létre –, majd más fiókokból válaszok sorozata érkezett rá. Ennek a viselkedésnek láthatóan az volt a célja, hogy a spontán felhasználói aktivitás hamis látszatát keltse.

Az ehhez a tevékenységhez kapcsolódó, „A #USAID leállítása még csak a #KEZDET!” című TikTok-bejegyzés. A csatorna nevét, a videó feliratainak szövegét és a képernyőképen látható összes hozzászólást ez a hálózat generálta a ChatGPT segítségével.
A TikTokon a hozzászóló fiókok különféle nyelveken és írásrendszerekkel írt megjelenített neveket használtak, amelyek gyakran nem kapcsolódtak az általuk közzétett tartalom nyelvéhez. Egy koreai nevű fiók például urdu nyelvű hozzászólást tett közzé, míg thai és héber nevű fiókok a hálózat által generált angol nyelvű hozzászólásokat posztoltak. Az X-en a hozzászóló fiókok jellemzően rajzolt profilképeket használtak, nevük pedig egyes esetekben kriptovalutákhoz kapcsolódott.

Egy tweet és az arra adott válaszok, amelyeket mind ez a hálózat generált a ChatGPT segítségével.
A hálózat kevésbé volt aktív a Facebookon. Tevékenysége főként két, híroldalnak álcázott oldal nevének és profilképének generálásából állt. Egyik oldalnak sem volt követője vagy kedvelése, és mindkettőn csak néhány bejegyzés szerepelt.

Egy videót megosztó Facebook-bejegyzés, amelyet valószínűleg ehhez a művelethez kapcsolódónak azonosítottunk.
A hálózat időnként hosszabb kínai vagy angol nyelvű bejegyzéseket is generált. Egy ilyen bejegyzést a Redditen, további kettőt pedig különböző internetes fórumokon azonosítottunk. A második munkafolyamatban a ChatGPT segítségével látszólag belső szabályzati vagy teljesítményértékelési dokumentumokat generáltak.
Generált tartalmak
A fenyegető szereplő által generált közösségimédia-tartalmak számos témát érintettek, amelyek mind szorosan igazodtak Kína geostratégiai érdekeihez.
Egyes tartalmak Tajvanra összpontosítottak, és kifejezetten a „Fordított front”(új ablakban nyílik meg) („逆統戰”) című, tajvani témájú videó- és társasjátékot támadták, amely a Kínai Kommunista Párttal szembeni ellenállást mutatja be. A hálózat több tucat kritikus kínai nyelvű hozzászólást generált a játékról, majd egy hosszabb cikket is, amely szerint a játék széles körű felháborodást váltott ki. Ez volt a művelet legjellegzetesebb tevékenysége, ezért a „Gúnyos értékelés” nevet adtuk a műveletnek.
Más angol és urdu nyelvű tartalmak Mahrang Baloch pakisztáni aktivistát támadták, aki nyilvánosan bírálta Kína beludzsisztáni beruházásait(új ablakban nyílik meg). A hálózathoz kapcsolódó TikTok-fiók és Facebook-oldal közzétett egy videót, amely valótlanul azzal vádolta Balochot, hogy szerepelt egy pornográf filmben. A művelet ezután mindkét nyelven több száz rövid hozzászólást generált, hogy széles körű aktivitást színleljen.

Megdöbbent hozzászólások a Mahrang Balochról szóló TikTok-videó alatt.
Az utolsó tartalomcsoport az Egyesült Államok Nemzetközi Fejlesztési Ügynökségének (USAID) bezárására összpontosított, és a lépést dicsérő vagy bíráló rövid hozzászólásokat tartalmazott. Ezeket a hozzászólásokat a TikTokon és az X-en tették közzé.

A segélyezés és a vámok kérdését összekapcsoló, a hálózat által ChatGPT‑vel generált tweetek.
Végül a fenyegető szereplők modelljeinkkel látszólag belső dokumentumokat generáltak. Ezek között volt egy hivatalos közbiztonsági dokumentum stílusában írt részletes esszé, valamint egy teljesítményértékelés, amely ismertette a művelet létrehozásához és működtetéséhez megtett lépéseket.
Hatás
Amikor megakadályoztuk, hogy a művelet tovább használja modelljeinket, az láthatóan még kezdeti szakaszában járt. Egyik Facebook-oldalnak sem volt követője. A Redditen egy bejegyzés 44 pozitív szavazatot kapott, két másikat pedig letiltottak vagy eltávolítottak azokból a subredditekből, amelyekben közzétették őket.

A hálózat részeként azonosított Reddit-fiók egyik bejegyzésének képernyőképe, amelyen látható, hogy a platform szűrői eltávolították.
Az X-en és a TikTokon változatosabb volt az aktivitás: a két TikTok-videó összesen 25 000 kedvelést gyűjtött, míg a művelet fő fiókjának tweetjeit jellemzően egyenként mintegy 10 000 alkalommal tekintették meg. E bejegyzések számos hozzászólását azonban ez a hálózat generálta a ChatGPT segítségével, ami arra utal, hogy az aktivitás legalább részben nem volt hiteles. Ezért minden aktivitási adatot fenntartással kell kezelni.
A befolyásolási műveletek hatását mérő Breakout-skála(új ablakban nyílik meg) alapján a 3. kategória alsó tartományába sorolnánk ezt a műveletet, ha az X-en és a TikTokon mért aktivitási adatok hitelesek lennének. Lefelé módosítanánk ezt a besorolást, ha további bizonyítékok támasztanák alá azt a feltételezést, hogy a hozzászólások többségéhez hasonlóan a kedvelések és megtekintések többsége sem volt hiteles.