La opción sin retención de datos ofrece a los clientes de la API que cumplan los requisitos una garantía clara: OpenAI no conserva sus instrucciones ni las respuestas del modelo después de procesar una solicitud. El personal de OpenAI no puede acceder al contenido del cliente para revisarlo1, y los datos de clientes empresariales no se utilizan para entrenar nuestros modelos salvo que estos lo autoricen expresamente.
A medida que los modelos asumen tareas más largas y complejas, puede que algunos riesgos graves solo se hagan visibles al analizar varias interacciones. Los sistemas de seguridad actuales compatibles con ZDR evalúan cada interacción por separado. Hoy presentamos un avance del Procesamiento privado de seguridad, diseñado para identificar patrones en interacciones relacionadas sin que el personal de OpenAI acceda al contenido subyacente.
En las implantaciones con ZDR, el contenido del cliente permanece en una infraestructura controlada por este. También estamos desarrollando una opción en la que el contenido se almacena en la infraestructura de OpenAI y se cifra con claves controladas por el cliente. En ambos casos, los sistemas automatizados pueden identificar posibles usos indebidos y devolver señales de seguridad limitadas sin exponer las instrucciones ni las respuestas subyacentes al personal de OpenAI.
Los riesgos más graves para la seguridad de la IA no siempre son visibles en una única interacción. A menudo, las intenciones potencialmente perjudiciales solo quedan claras al analizar conjuntamente varias interacciones. Pueden surgir riesgos similares cuando agentes malintencionados ponen a prueba repetidamente las salvaguardas, se coordinan entre distintas cuentas o disfrazan amenazas de investigaciones rutinarias. Los riesgos también pueden aparecer durante una tarea agéntica; por ejemplo, si un sistema se desvía de la intención del usuario al seguir actuando después de que se le haya ordenado detenerse.
A medida que los sistemas de IA asumen tareas más largas y complejas, este contexto más amplio cobra cada vez más importancia para distinguir la actividad legítima del uso indebido y garantizar que los agentes de IA se mantengan dentro de los límites de la autoridad que se les ha concedido.
Algunas implantaciones recientes de modelos de vanguardia han exigido que los clientes permitan a su proveedor de IA conservar contenido sensible para supervisar la seguridad. Para muchas organizaciones, estos requisitos entran en conflicto con sus obligaciones de seguridad o con los compromisos adquiridos con las personas a las que prestan servicio.
El Procesamiento privado de seguridad está diseñado para que podamos seguir ofreciendo ZDR.
El Procesamiento privado de seguridad se basa en las protecciones automatizadas que ya se utilizan en implantaciones con ZDR y de otros tipos. Los sistemas de seguridad actuales compatibles con ZDR evalúan las interacciones por separado. El Procesamiento privado de seguridad amplía esas protecciones a interacciones relacionadas y permite que los sistemas automatizados identifiquen patrones sin que el personal de OpenAI acceda al contenido conservado de los clientes.
El Procesamiento privado de seguridad utiliza el contenido del cliente con independencia de dónde se almacene, ya sea en una infraestructura controlada por el cliente —implantaciones con ZDR— o en un almacenamiento proporcionado por OpenAI. Cuando OpenAI proporciona el almacenamiento, el contenido del cliente se cifra con claves controladas por este. El personal de OpenAI no dispone de una copia de esas claves, por lo que no puede acceder al contenido subyacente.
Cuando se identifica un riesgo, OpenAI recibe una señal estrictamente delimitada que indica el tipo de actividad implicada, como sucede actualmente con nuestros sistemas de seguridad. Esa señal puede utilizarse para determinar si es necesario aplicar alguna medida. El personal de OpenAI no obtiene acceso al contenido del cliente ni siquiera cuando este se marca.
Los clientes pueden investigar las alertas y las decisiones de aplicación de medidas mediante la información disponible en sus propios sistemas. Si desean recurrir una decisión, aclarar que se trata de una actividad legítima o colaborar en la investigación de un abuso verificado, pueden optar por compartir la información pertinente con OpenAI.
El Procesamiento privado de seguridad se está probando actualmente con los primeros clientes. Compartimos este avance ahora porque nuestros clientes nos han dejado muy claro que necesitan previsibilidad sobre cómo se protegerá su contenido a medida que aumenten las capacidades de los sistemas de IA.
Nuestra misión es garantizar que la inteligencia artificial general beneficie a toda la humanidad. La colaboración con clientes y socios es esencial para crear salvaguardas eficaces. Como dejan claro nuestros principios, ningún laboratorio de IA puede abordar por sí solo los riesgos emergentes. El Procesamiento privado de seguridad refleja este enfoque y se está definiendo con la participación de clientes de distintos sectores, regiones y tamaños de empresa.
Las organizaciones con las que trabajamos gestionan algunos de los datos más sensibles de sus sectores, como registros financieros, datos sanitarios, planes empresariales confidenciales e investigaciones propias. Proteger esa información es esencial para cumplir las obligaciones normativas, mantener la confianza de los clientes y preservar su ventaja competitiva.
Sus comentarios nos ayudan a crear salvaguardas más sólidas y, al mismo tiempo, a mantener su información bajo su control.
«La adopción de la IA empresarial depende exclusivamente de que el cliente controle sus datos, sin ningún uso directo ni derivado más allá del servicio elegido. El compromiso de OpenAI de no usar los datos para entrenamiento y la ZDR dan a Glean la confianza necesaria para desarrollar con OpenAI. A medida que los modelos adquieren más capacidades, OpenAI demuestra que la seguridad puede avanzar sin comprometer la privacidad y el control que sustentan la confianza empresarial».
—Sunil Agrawal, director de Seguridad de la Información, Glean
Seguiremos trabajando con los clientes en los detalles técnicos y operativos de nuestro enfoque. Tenemos previsto empezar a implantar el Procesamiento privado de seguridad y publicar un libro blanco técnico en septiembre. Mantendremos informados a los clientes en cada etapa: compartiremos las novedades con antelación, explicaremos qué implican para los compromisos existentes y les proporcionaremos el tiempo y el apoyo necesarios para planificar con antelación.
Autor
- 1
Como otros proveedores de modelos de vanguardia, OpenAI está obligada por ley(se abre en una ventana nueva) a denunciar el material aparente de abuso sexual infantil (MASI). Las imágenes marcadas como posible MASI seguirán conservándose para su revisión manual y denuncia, incluso en implantaciones sin retención de datos, como ocurre actualmente.


