Przejdź do treści głównej
OpenAI

1 czerwca 2025

Bezpieczeństwo

Operacja „Szydercza recenzja”: działania wpływu pochodzące z Chin

OpenAI zablokowało konta używające AI do tworzenia postów krytykujących tajwańskiego influencera i poruszających powiązane tematy dotyczące USA.

Ładowanie…

To studium przypadku opublikowano pierwotnie w raporcie OpenAI z czerwca 2025 r.⁠(otwiera nowe okno)

Podmiot

Zablokowaliśmy konta ChatGPT, które — jak wykryliśmy — używały naszych modeli do masowego generowania postów w mediach społecznościowych zgodnych z działalnością tajnej operacji wpływu. W toku dochodzenia zauważyliśmy również, że konta te sporządzały wewnętrzne oceny wyników pracy.

Konta te wydawały polecenia głównie po chińsku i koncentrowały się na tematach politycznych i geopolitycznych istotnych dla Chin. Jeden z użytkowników stwierdził w poleceniu, że pracuje dla chińskiego Departamentu Propagandy. Nie mamy jednak niezależnych dowodów potwierdzających tę deklarację.

Sposób działania

Zablokowane przez nas konta prowadziły dwa główne rodzaje działań. Najbardziej intensywne z nich polegały na generowaniu krótkich komentarzy do mediów społecznościowych po angielsku i chińsku, a w kilku przypadkach także w urdu. Wiele z tych komentarzy opublikowano na TikToku i platformie X, a dodatkowe treści pojawiły się na Reddicie, Facebooku i różnych stronach internetowych.

Typowy schemat obejmował opublikowanie pierwszego komentarza z „głównego” konta, często najwyraźniej utworzonego wyłącznie na potrzeby tego wpisu, a następnie serii odpowiedzi z innych kont. Takie działanie miało najwyraźniej wywołać fałszywe wrażenie spontanicznego zaangażowania użytkowników.

Post na TikToku powiązany z operacją „Szydercza recenzja”.

Post na TikToku zatytułowany „Zamknięcie #USAID to dopiero #POCZĄTEK!”, powiązany z tą działalnością. Nazwa kanału, tekst napisów w filmie i wszystkie komentarze widoczne na tym zrzucie ekranu zostały wygenerowane przez tę sieć za pomocą ChatGPT.

Na TikToku konta publikujące komentarze używały nazw w różnych językach i alfabetach, często niezwiązanych z językiem zamieszczanych treści. Na przykład konto o koreańskiej nazwie opublikowało komentarz w urdu, natomiast konta o nazwach tajskiej i hebrajskiej zamieszczały wygenerowane przez tę sieć komentarze po angielsku. Na platformie X konta publikujące komentarze zazwyczaj używały rysunkowych zdjęć profilowych, a w niektórych przypadkach miały nazwy związane z kryptowalutami.

Tweet i odpowiedzi powiązane z operacją „Szydercza recenzja”.

Tweet i odpowiedzi na niego — wszystkie wygenerowane przez tę sieć za pomocą ChatGPT.

Sieć była mniej aktywna na Facebooku. Jej działalność polegała głównie na generowaniu nazw i zdjęć profilowych dla dwóch stron podszywających się pod serwisy informacyjne. Żadna z tych stron nie miała obserwujących ani polubień, a na każdej opublikowano zaledwie kilka postów.

Post na Facebooku powiązany z operacją „Szydercza recenzja”.

Post na Facebooku udostępniający film, który uznaliśmy za prawdopodobnie powiązany z tą operacją.

Sieć sporadycznie generowała dłuższe posty po chińsku lub angielsku. Zidentyfikowaliśmy jeden taki post na Reddicie i dwa kolejne na różnych forach internetowych. Drugi rodzaj działań polegał na używaniu ChatGPT do generowania materiałów, które wyglądały na wewnętrzne dokumenty dotyczące zasad lub oceny wyników pracy.

Wygenerowane treści

Treści do mediów społecznościowych generowane przez ten podmiot stanowiący zagrożenie obejmowały różne tematy, ściśle związane z geostrategicznymi interesami Chin.

Część treści dotyczyła Tajwanu, a konkretnie była wymierzona w „Odwrócony front”⁠(otwiera nowe okno) („逆統戰”) — osadzoną w tajwańskich realiach grę komputerową i planszową przedstawiającą opór przeciwko Komunistycznej Partii Chin. Sieć wygenerowała dziesiątki krytycznych komentarzy o grze po chińsku, a następnie obszerny artykuł, w którym twierdzono, że spotkała się ona z powszechną krytyką. Było to najbardziej charakterystyczne działanie tej operacji, dlatego nazwaliśmy ją „Szyderczą recenzją”.

Inne treści, w języku angielskim i urdu, były wymierzone w pakistańską aktywistkę Mahrang Baloch, która publicznie krytykowała chińskie inwestycje w Beludżystanie⁠(otwiera nowe okno). Powiązane z siecią konto na TikToku i strona na Facebooku opublikowały film fałszywie oskarżający Baloch o występ w filmie pornograficznym. Następnie w ramach operacji wygenerowano setki krótkich komentarzy w obu językach, aby stworzyć pozory powszechnego zaangażowania.

Komentarze pod filmem Mahrang Baloch na TikToku.

Pełne oburzenia komentarze pod filmem Mahrang Baloch na TikToku.

Ostatnia grupa treści dotyczyła zamknięcia amerykańskiej Agencji ds. Rozwoju Międzynarodowego (USAID) i obejmowała krótkie komentarze, które chwaliły lub krytykowały tę decyzję. Komentarze te opublikowano na TikToku i platformie X.

Tweety łączące pomoc i cła, wygenerowane przez operację „Szydercza recenzja”.

Wygenerowane przez tę sieć za pomocą ChatGPT tweety łączące kwestię pomocy z kwestią ceł.

Ponadto podmioty stanowiące zagrożenie używały naszych modeli do generowania materiałów, które wyglądały na dokumenty wewnętrzne. Obejmowały one szczegółowy esej napisany w stylu oficjalnego dokumentu służb bezpieczeństwa publicznego oraz ocenę wyników pracy opisującą działania podjęte w celu utworzenia i prowadzenia operacji.

Wpływ

Gdy przerwaliśmy wykorzystywanie naszych modeli w tej operacji, znajdowała się ona najwyraźniej na wczesnym etapie. Żadna z dwóch stron na Facebooku nie miała obserwujących. Na Reddicie jeden post otrzymał 44 głosy pozytywne, a dwa inne zostały zablokowane lub usunięte z subredditów, na których je opublikowano.

Usunięty post na Reddicie powiązany z operacją „Szydercza recenzja”.

Zrzut ekranu przedstawiający post z konta na Reddicie, które uznaliśmy za część tej sieci. Widać, że post został usunięty przez filtry platformy.

Zaangażowanie na platformie X i TikToku było bardziej zróżnicowane: dwa filmy na TikToku zgromadziły łącznie 25 000 polubień, natomiast tweety z głównego konta operacji miały zwykle po około 10 000 wyświetleń. Wiele komentarzy pod tymi postami wygenerowała jednak ta sieć za pomocą ChatGPT, co wskazuje, że przynajmniej część zaangażowania nie była autentyczna. Dlatego wszystkie dane dotyczące zaangażowania należy traktować z ostrożnością.

Korzystając ze skali Breakout⁠(otwiera nowe okno) do oceny wpływu operacji informacyjnych, zaklasyfikowalibyśmy tę operację przy dolnej granicy kategorii 3, gdyby dane dotyczące zaangażowania na platformie X i TikToku były autentyczne. Obniżylibyśmy tę ocenę, gdyby pojawiło się więcej dowodów na poparcie hipotezy, że większość polubień i wyświetleń — podobnie jak większość komentarzy — nie była autentyczna.