Ir al contenido principal
OpenAI

1 de junio de 2025

Seguridad

Operación «Reseña burlona»: actividad de influencia de origen chino

OpenAI bloqueó cuentas que usaban IA para generar publicaciones críticas con una influencer taiwanesa y sobre temas relacionados con EE. UU.

Cargando…

Este caso práctico se publicó originalmente en el informe de junio de 2025⁠(se abre en una ventana nueva) de OpenAI.

Agente

Bloqueamos cuentas de ChatGPT que detectamos usando nuestros modelos para generar en masa publicaciones en redes sociales compatibles con la actividad de una operación encubierta de influencia. Durante nuestra investigación, también observamos que estas cuentas redactaban evaluaciones internas de desempeño.

Estas cuentas enviaban principalmente prompts en chino y se centraban en temas políticos y geopolíticos relevantes para China. Un usuario afirmó en un prompt que trabajaba para el Departamento de Propaganda de China; sin embargo, no disponemos de pruebas independientes que confirmen esta afirmación.

Comportamiento

Las cuentas que bloqueamos desarrollaban dos líneas de trabajo principales. La más prolífica consistía en generar comentarios breves para redes sociales en inglés y chino, además de algunos en urdu. Identificamos muchos de estos comentarios publicados en TikTok y X, además de otros contenidos en Reddit, Facebook y diversos sitios web.

Un patrón habitual consistía en publicar un comentario inicial desde una cuenta «principal», que a menudo parecía haberse creado exclusivamente para esa publicación, seguido de una serie de respuestas desde otras cuentas. Este comportamiento parecía diseñado para crear una falsa impresión de interacción orgánica.

Publicación de TikTok asociada a la operación «Reseña burlona».

Publicación de TikTok titulada «¡Cerrar #USAID es solo el #PRINCIPIO!», asociada a esta actividad. El nombre del canal, el texto de los subtítulos del vídeo y todos los comentarios visibles en esta captura fueron generados por esta red mediante ChatGPT.

En TikTok, las cuentas que publicaban comentarios usaban nombres de usuario en diversos idiomas y alfabetos, a menudo sin relación con el idioma del contenido que publicaban. Por ejemplo, una cuenta con nombre coreano publicó un comentario en urdu, mientras que otras con nombres tailandeses y hebreos publicaron en inglés comentarios generados por esta red. En X, las cuentas que comentaban solían usar imágenes de perfil de dibujos animados y, en algunos casos, tenían nombres relacionados con las criptomonedas.

Tuit y respuestas asociados a la operación «Reseña burlona».

Tuit y comentarios de respuesta, todos generados por esta red mediante ChatGPT.

La red tuvo menos actividad en Facebook. Su actividad consistía principalmente en generar nombres e imágenes de perfil para dos páginas que se hacían pasar por medios de comunicación. Ninguna de las páginas tenía seguidores ni «Me gusta», y cada una contenía solo unas pocas publicaciones.

Publicación de Facebook asociada a la operación «Reseña burlona».

Publicación de Facebook que comparte un vídeo que identificamos como probablemente vinculado a esta operación.

Ocasionalmente, la red generaba publicaciones más extensas en chino o inglés. Identificamos una de estas publicaciones en Reddit y otras dos en distintos foros web. La segunda línea de trabajo consistía en usar ChatGPT para generar documentos que parecían ser evaluaciones internas de políticas o de desempeño.

Resultados generados

El contenido para redes sociales generado por este agente de amenazas abordaba diversos temas, todos ellos estrechamente relacionados con los intereses geoestratégicos de China.

Parte del contenido se centraba en Taiwán y atacaba específicamente a «Frente invertido»⁠(se abre en una ventana nueva) («Guerra de unificación inversa»), un videojuego y juego de mesa centrado en Taiwán que imagina la resistencia contra el Partido Comunista Chino. La red generó decenas de comentarios críticos en chino sobre el juego, seguidos de un artículo extenso que afirmaba que había provocado un rechazo generalizado. Esta fue la actividad más característica de la operación; por ello, la hemos denominado «Reseña burlona».

Otros contenidos, en inglés y urdu, atacaban a la activista pakistaní Mahrang Baloch, que ha criticado públicamente las inversiones de China en Baluchistán⁠(se abre en una ventana nueva). Una cuenta de TikTok y una página de Facebook vinculadas a la red publicaron un vídeo en el que acusaban falsamente a Baloch de aparecer en una película pornográfica. Después, la operación generó cientos de comentarios breves en ambos idiomas para simular una interacción generalizada.

Comentarios en un vídeo de TikTok sobre Mahrang Baloch.

Comentarios de sorpresa en el vídeo de TikTok sobre Mahrang Baloch.

Un último conjunto de contenidos se centró en el cierre de la Agencia de los Estados Unidos para el Desarrollo Internacional (USAID) y generó comentarios breves que elogiaban o criticaban la decisión. Estos comentarios se publicaron en TikTok y X.

Tuits sobre ayudas y aranceles generados por la operación «Reseña burlona».

Tuits que vinculaban la cuestión de las ayudas con la de los aranceles, generados por esta red mediante ChatGPT.

Por último, los agentes de amenazas usaron nuestros modelos para generar lo que parecían ser documentos internos, entre ellos un ensayo detallado escrito con el estilo de un documento oficial de seguridad pública y una evaluación de desempeño que describía los pasos dados para crear y dirigir la operación.

Impacto

Esta operación parecía estar en sus primeras etapas cuando interrumpimos su uso de nuestros modelos. Ninguna de las páginas de Facebook tenía seguidores. En Reddit, una publicación recibió 44 votos positivos, mientras que otras dos fueron bloqueadas o eliminadas de los subreddits donde se publicaron.

Publicación eliminada de Reddit asociada a la operación «Reseña burlona».

Captura de una publicación de una cuenta de Reddit que identificamos como parte de esta red y que muestra que los filtros de la plataforma la eliminaron.

La interacción en X y TikTok fue más variada: los dos vídeos de TikTok acumularon en conjunto 25 000 «Me gusta», mientras que los tuits de la cuenta principal de esta operación solían recibir unas 10 000 visualizaciones cada uno. Sin embargo, muchos de los comentarios de estas publicaciones fueron generados por esta red mediante ChatGPT, lo que indica que al menos parte de la interacción no era auténtica. Por tanto, todas las cifras de interacción deben interpretarse con cautela.

Según la escala Breakout⁠(se abre en una ventana nueva) del impacto de las operaciones de influencia, situaríamos esta operación en el extremo inferior de la categoría 3 si las cifras de interacción en X y TikTok fueran auténticas. Rebajaríamos esta valoración si aparecieran más pruebas que respaldaran la hipótesis de que la mayoría de los «Me gusta» y las visualizaciones, al igual que la mayoría de los comentarios, no eran auténticos.