Operación cibernética: asistencia en coreano para desarrollar malware
OpenAI bloqueó cuentas que operaban en coreano y usaban IA para ayudar a desarrollar y depurar malware, hacer phishing y ejecutar procesos de robo de credenciales.
Este estudio de caso se publicó originalmente en el informe de octubre de 2025(se abre en una ventana nueva) de OpenAI.
Actor
Identificamos y bloqueamos un grupo de cuentas de ChatGPT cuyos operadores, que trabajaban en coreano, intentaron usar nuestros modelos para desarrollar malware y sistemas de mando y control (C2). Los indicadores que observamos durante nuestra investigación coinciden con los de un informe de Trellix que vinculó una actividad similar con campañas de phishing dirigido contra misiones diplomáticas surcoreanas, el despliegue del malware XenoRAT y el uso de repositorios de GitHub para C2.
Las coincidencias con el informe de Trellix —entre ellas, el uso observado del coreano, una actividad compatible con las zonas horarias UTC+8 y UTC+9, y los temas y asuntos operativos— concuerdan con lo que la comunidad de seguridad sabe sobre los actores de Corea del Norte (RPDC). Sin embargo, no podemos atribuirles esta actividad de forma independiente y, además, bloqueamos el acceso a nuestros servicios desde Corea del Norte.
Comportamiento
Las cuentas interactuaban con nuestros modelos principalmente en coreano y mostraban flujos de trabajo estructurados, con muchas cuentas activas durante franjas horarias reducidas. Cada una de estas cuentas parece haberse centrado en un caso de uso concreto, como convertir extensiones de Chrome a Safari para publicarlas en la App Store de Apple, configurar VPN en Windows Server o desarrollar extensiones del Finder para macOS, en lugar de abarcar varias áreas técnicas.
Observamos interacciones con nuestros modelos relacionadas con técnicas como la interceptación de la API de Windows, flujos de acceso a credenciales y cookies del navegador mediante DPAPI, y páginas de verificación que imitaban a las originales, como clones de reCAPTCHA. También vimos borradores de correos de phishing en coreano, a menudo relacionados con las criptomonedas y diseñados para parecer mensajes de organismos públicos o proveedores de servicios financieros.
Además, los actores experimentaron con servicios de almacenamiento en la nube como pCloud y file.io, con la creación de enlaces directos de GDrive y scripts para API, y con funciones de GitHub como la obtención de contenido sin procesar y la gestión de tokens. No encontramos indicios de que los archivos binarios maliciosos empleados en las campañas descritas por Trellix se generaran con nuestros modelos. Es posible que los mismos operadores usaran nuestros modelos mientras preparaban cargas maliciosas mediante plataformas de desarrollo y servicios en la nube.
Resultados generados
Los actores de amenazas generaron con los modelos resultados destinados a respaldar varias áreas operativas, entre ellas:
Desarrollo de implantes y herramientas afines a los RAT: exploración de técnicas de carga reflectiva de DLL, ejecución en memoria e interceptación de la API de Windows.
Rutinas de robo de credenciales: generación, modificación y depuración de scripts para extraer claves de cifrado del navegador, cookies y contraseñas guardadas mediante flujos DPAPI de Chrome y Edge.
Phishing y señuelos: redacción de lo que parecía ser contenido de phishing en coreano, a menudo relacionado con las criptomonedas, organismos públicos o proveedores de servicios financieros; experimentación con la ofuscación de HTML y el uso de reCAPTCHA mediante proxy para crear páginas de inicio de sesión convincentes.
Estructuras base para desarrollar en macOS: solicitudes sobre el desarrollo de extensiones para Finder y Safari, y la generación de una Política de privacidad de ejemplo para la App Store.
Operaciones con criptomonedas: resolución de problemas con llamadas a API e interacciones con monederos.
Muchas de estas solicitudes se encontraban en la zona gris de las actividades de doble uso. Pueden tener aplicaciones totalmente legítimas, como la depuración de software, la criptografía o el desarrollo de navegadores, pero adquieren un significado distinto cuando un actor de amenazas las reutiliza con otros fines.
Impacto
Desactivamos todas las cuentas asociadas con esta operación y compartimos los indicadores pertinentes con nuestros socios. No encontramos indicios de que el acceso a los modelos proporcionara capacidades nuevas que no estuvieran ya disponibles públicamente.