La retención cero de datos ofrece a los clientes elegibles de la API una promesa clara: OpenAI no conserva sus instrucciones ni las respuestas del modelo después de procesar una solicitud. El personal de OpenAI no puede acceder al contenido de los clientes para revisarlo1, y los datos de clientes empresariales no se utilizan para entrenar nuestros modelos, salvo que estos lo autoricen expresamente.
A medida que los modelos asumen tareas más largas y complejas, algunos riesgos graves pueden hacerse visibles solo al analizar varias interacciones. Los sistemas de seguridad actuales compatibles con ZDR evalúan cada interacción por separado. Hoy presentamos un avance del Procesamiento privado de seguridad, diseñado para identificar patrones en interacciones relacionadas sin dar al personal de OpenAI acceso al contenido subyacente.
En las implementaciones con ZDR, el contenido del cliente permanece en infraestructura bajo su control. También estamos desarrollando una opción en la que el contenido se almacena en infraestructura de OpenAI y se cifra con claves controladas por el cliente. En ambos casos, los sistemas automatizados pueden identificar posibles usos indebidos y devolver señales de seguridad limitadas sin exponer al personal de OpenAI las instrucciones ni las respuestas subyacentes.
Los riesgos más graves para la seguridad de la IA no siempre son visibles en una sola interacción. A menudo, las intenciones potencialmente dañinas solo se hacen evidentes cuando se analizan varias interacciones en conjunto. También pueden surgir riesgos similares cuando actores malintencionados ponen a prueba repetidamente las medidas de protección, se coordinan entre cuentas o disfrazan amenazas como investigaciones rutinarias. Los riesgos también pueden aparecer durante una tarea ejecutada por un agente; por ejemplo, si un sistema deja de ajustarse a la intención del usuario al seguir actuando después de que se le indicó que se detuviera.
A medida que los sistemas de IA asumen tareas más largas y complejas, este contexto más amplio adquiere una importancia cada vez mayor para distinguir la actividad legítima del uso indebido y garantizar que los agentes de IA se mantengan dentro de los límites de la autoridad prevista.
Algunas implementaciones recientes de modelos de vanguardia han exigido que los clientes permitan que su proveedor de IA conserve contenido confidencial para supervisar la seguridad. Para muchas organizaciones, estos requisitos entran en conflicto con sus obligaciones de seguridad o con los compromisos asumidos con las personas a las que prestan servicios.
El Procesamiento privado de seguridad está diseñado para que podamos seguir ofreciendo ZDR.
El Procesamiento privado de seguridad se basa en las protecciones automatizadas que ya se utilizan en ZDR y otras implementaciones. Los sistemas de seguridad actuales compatibles con ZDR evalúan las interacciones por separado. El Procesamiento privado de seguridad amplía esas protecciones a interacciones relacionadas, lo que permite que los sistemas automatizados identifiquen patrones sin que el personal de OpenAI tenga acceso al contenido conservado de los clientes.
El Procesamiento privado de seguridad utiliza el contenido de los clientes sin importar dónde esté almacenado, ya sea en infraestructura bajo su control —implementaciones con ZDR— o en almacenamiento proporcionado por OpenAI. Cuando OpenAI proporciona el almacenamiento, el contenido de los clientes se cifra con claves bajo su control. El personal de OpenAI no tiene una copia de esas claves, por lo que no puede acceder al contenido subyacente.
Cuando se identifica un riesgo, OpenAI recibe una señal muy específica que indica el tipo de actividad implicada, de forma similar a nuestros sistemas de seguridad actuales. Esa señal puede utilizarse para determinar si es necesario aplicar medidas. El personal de OpenAI no obtiene acceso al contenido del cliente, ni siquiera cuando este se marca.
Los clientes pueden investigar las alertas y las decisiones de aplicación de medidas con la información disponible en sus propios sistemas. Si desean apelar, aclarar que una actividad es legítima o apoyar una investigación sobre un abuso verificado, pueden optar por compartir información pertinente con OpenAI.
El Procesamiento privado de seguridad se está probando actualmente con los primeros clientes. Compartimos este avance ahora porque nuestros clientes nos han expresado con claridad que necesitan previsibilidad sobre cómo se protegerá su contenido a medida que los sistemas de IA adquieran mayores capacidades.
Nuestra misión es garantizar que la inteligencia artificial general beneficie a toda la humanidad. La colaboración con clientes y socios es esencial para crear medidas de protección eficaces. Como dejan claro nuestros principios, ningún laboratorio de IA puede abordar por sí solo los riesgos emergentes. El Procesamiento privado de seguridad refleja ese enfoque y se está definiendo con aportes de clientes de distintos sectores, regiones y tamaños de empresa.
Las organizaciones con las que trabajamos manejan parte de la información más confidencial de sus sectores, incluidos registros financieros, datos de salud, planes empresariales confidenciales e investigaciones propias. Proteger esa información es esencial para cumplir las obligaciones regulatorias, mantener la confianza de los clientes y preservar su ventaja competitiva.
Sus comentarios nos ayudan a crear medidas de protección más sólidas y, al mismo tiempo, mantener su información bajo su control.
“La adopción empresarial de la IA depende por completo de que los clientes controlen sus datos, sin ningún uso directo ni derivado más allá del servicio elegido. El compromiso de OpenAI de no usar los datos para entrenamiento y la ZDR dan a Glean la confianza necesaria para desarrollar con OpenAI. A medida que los modelos adquieren mayores capacidades, OpenAI demuestra que la seguridad puede avanzar sin comprometer la privacidad ni el control que sustentan la confianza empresarial”.
—Sunil Agrawal, director de seguridad de la información, Glean
Seguiremos trabajando con los clientes en los detalles técnicos y operativos de nuestro enfoque. Planeamos comenzar a implementar el Procesamiento privado de seguridad y publicar un informe técnico en septiembre. Mantendremos informados a los clientes en cada etapa: compartiremos novedades con anticipación, explicaremos qué implican para los compromisos existentes y les daremos el tiempo y el apoyo que necesitan para planificar.
Autor
- 1
Al igual que otros proveedores de modelos de vanguardia, OpenAI tiene la obligación legal(se abre en una nueva ventana) de denunciar materiales que aparentemente constituyan material de abuso sexual infantil (MASI). Las imágenes marcadas como posible MASI seguirán conservándose para su revisión manual y denuncia, incluso en implementaciones con retención cero de datos, como ocurre actualmente.


