Переход к основному контенту
OpenAI

1 июня 2025 г.

Безопасность

Операция «Насмешливая рецензия»: китайская кампания влияния

OpenAI заблокировала аккаунты, использовавшие ИИ для создания публикаций с критикой тайваньской инфлюенсерки и на связанные с США темы.

Загрузка…

Изначально этот разбор был опубликован в отчете OpenAI за июнь 2025 года⁠(открывается в новом окне).

Субъект угрозы

Мы заблокировали аккаунты ChatGPT, которые, по нашим данным, использовали наши модели для массового создания публикаций в социальных сетях в рамках скрытой операции влияния. В ходе расследования мы также заметили, что с помощью этих аккаунтов составлялись внутренние отчеты об эффективности работы.

В этих аккаунтах преимущественно использовались промпты на китайском языке, посвященные актуальным для Китая политическим и геополитическим темам. Один пользователь указал в промпте, что работает в китайском ведомстве пропаганды, однако независимых подтверждений этому заявлению у нас нет.

Поведение

Заблокированные нами аккаунты использовались в двух основных направлениях. Самым масштабным было создание коротких комментариев для социальных сетей на английском и китайском языках, а также нескольких комментариев на урду. Многие из этих комментариев публиковались в TikTok и X, а отдельные материалы появлялись на Reddit, Facebook и различных сайтах.

Как правило, сначала с «основного» аккаунта публиковали комментарий — зачастую аккаунт, по-видимому, создавался только ради него, — после чего другие аккаунты оставляли серию ответов. По всей видимости, так участники пытались создать ложное впечатление естественной активности пользователей.

Публикация в TikTok, связанная с операцией «Насмешливая рецензия».

Связанная с этой деятельностью публикация в TikTok под заголовком «Закрытие #USAID — это только #НАЧАЛО!». Название канала, текст субтитров к видео и все видимые на этом снимке экрана комментарии были созданы этой сетью с помощью ChatGPT.

В TikTok аккаунты комментаторов использовали имена на разных языках и в разных системах письма, часто не связанных с языком публикуемого контента. Например, аккаунт с корейским именем опубликовал комментарий на урду, а аккаунты с тайским и еврейским именами — созданные этой сетью комментарии на английском. В X аккаунты комментаторов обычно использовали рисованные изображения профиля, а их имена в некоторых случаях были связаны с криптовалютой.

Твит и ответы, связанные с операцией «Насмешливая рецензия».

Твит и ответы на него, созданные этой сетью с помощью ChatGPT.

В Facebook сеть проявляла меньшую активность. В основном она создавала названия и изображения профиля для двух Страниц, выдававших себя за новостные издания. Ни у одной из Страниц не было подписчиков или отметок «Нравится», и на каждой было опубликовано лишь несколько материалов.

Публикация в Facebook, связанная с операцией «Насмешливая рецензия».

Публикация в Facebook с видео, которое мы сочли, вероятно, связанным с этой операцией.

Иногда сеть создавала более длинные публикации на китайском или английском языке. Одну такую публикацию мы обнаружили на Reddit, а еще две — на различных интернет-форумах. Вторым направлением было использование ChatGPT для создания предположительно внутренних документов по вопросам политики или оценки эффективности работы.

Созданные материалы

Созданные этим субъектом угрозы материалы для социальных сетей охватывали ряд тем, тесно связанных с геостратегическими интересами Китая.

Некоторые материалы были посвящены Тайваню и, в частности, критиковали «Обратный фронт»⁠(открывается в новом окне) («逆統戰») — видеоигру и настольную игру о Тайване, в которых представлено сопротивление Коммунистической партии Китая. Сеть создала десятки критических комментариев об игре на китайском языке, а затем — развернутую статью, где утверждалось, что игра вызвала массовое возмущение. Это было наиболее характерное направление деятельности, поэтому мы назвали операцию «Насмешливая рецензия».

Другие материалы на английском и урду были направлены против пакистанской активистки Махранг Балоч, которая публично критиковала китайские инвестиции в Белуджистане⁠(открывается в новом окне). Связанные с сетью аккаунт TikTok и Страница Facebook опубликовали видео с ложным обвинением Балоч в съемках в порнографическом фильме. Затем участники операции создали сотни коротких комментариев на обоих языках, имитируя массовую активность пользователей.

Комментарии под видео Махранг Балоч в TikTok.

Возмущенные комментарии под видео Махранг Балоч в TikTok.

Последняя группа материалов была посвящена закрытию американского Агентства по международному развитию (USAID): создавались короткие комментарии как в поддержку, так и с критикой этого решения. Эти комментарии публиковались в TikTok и X.

Твиты о связи помощи и тарифов, созданные операцией «Насмешливая рецензия».

Твиты, связывающие вопросы помощи и тарифов, которые эта сеть создала с помощью ChatGPT.

Наконец, участники операции использовали наши модели для создания предположительно внутренних документов, в том числе подробного очерка в стиле официального документа органов общественной безопасности и отчета об эффективности работы с описанием действий по созданию и ведению операции.

Влияние

По всей видимости, на момент прекращения доступа к нашим моделям эта операция находилась на ранней стадии. Ни у одной из Страниц Facebook не было подписчиков. На Reddit одна публикация получила 44 голоса «за», а еще две были заблокированы или удалены из сообществ, где их разместили.

Удаленная публикация на Reddit, связанная с операцией «Насмешливая рецензия».

Снимок публикации аккаунта Reddit, который мы отнесли к этой сети. Видно, что публикация была удалена фильтрами платформы.

Показатели активности в X и TikTok различались сильнее: два видео в TikTok в общей сложности получили 25 000 отметок «Нравится», а твиты основного аккаунта операции обычно набирали около 10 000 просмотров каждый. Однако многие комментарии под этими публикациями были созданы сетью с помощью ChatGPT, что указывает как минимум на частично неаутентичную активность. Поэтому ко всем показателям активности следует относиться с осторожностью.

Если показатели активности в X и TikTok были подлинными, то по шкале охвата⁠(открывается в новом окне) для оценки влияния информационных операций мы отнесли бы эту операцию к нижней границе категории 3. Мы понизили бы эту оценку, если бы появились дополнительные доказательства того, что большинство отметок «Нравится» и просмотров, как и большинство комментариев, были неаутентичными.