Pasar al contenido principal
OpenAI

Combatir los usos maliciosos de la IA

Explora los casos de estudio e informes más recientes de OpenAI sobre cómo detectamos y combatimos los usos maliciosos de la IA.

Tarjeta amarilla con patrón de cuadrícula y texto morado que dice "Detectar estafas con ChatGPT".

Detectar estafas con ChatGPT: una segunda opinión cuando algo no parece estar bien

Más información(se abre en una nueva ventana)

Cómo funciona la revisión humana

Los sistemas automatizados ayudan a detectar posibles infracciones, mientras que los revisores humanos cumplen una función esencial para identificar y combatir los usos maliciosos de la IA, incluidas las estafas, la actividad cibernética maliciosa, las operaciones de influencia encubiertas y otras conductas dañinas o ilegales.

Detectar

Identificamos señales de intentos de uso indebido en productos, reportes y pistas de investigación.

Investigar

Investigadores humanos revisan la actividad, relacionan casos vinculados y evalúan la conducta en su contexto.

Neutralizar

Tomamos medidas contra las cuentas y redes que infringen nuestros términos o políticas, a la vez que reforzamos nuestras defensas contra abusos similares.

Divulgar

Cuando corresponde, publicamos hallazgos que pueden ayudar a nuestro sector y a la sociedad en general a reconocer y enfrentar mejor estas amenazas.

Casos de estudio

Explora casos de estudio de investigaciones de OpenAI sobre usos maliciosos de la IA. Cada caso explica qué intentaron hacer los actores, cómo usaron la IA y cómo respondió OpenAI.

Informes