Pasar al contenido principal
OpenAI

29 de septiembre de 2026

SeguridadSeguridad

Cómo incorporamos seguridad, protección y privacidad en los dots

A medida que tus dots asumen más trabajo, ayudamos a proteger tu información y a mantener las decisiones importantes en tus manos.

Cargando...

Los dots son agentes siempre activos que asumen responsabilidades de forma continua para que tengas más tiempo y atención para lo que te importa. Cada dot tiene su propia computadora y trabaja con las aplicaciones que elijas conectar. Tú les asignas objetivos a los dots y defines lo que pueden hacer por su cuenta. Pueden completar los pasos, adaptarse a los cambios y seguir avanzando entre conversaciones. Pueden seguir una noticia en desarrollo y preparar el borrador de un boletín, o ayudar a actualizar un proyecto a medida que llega nueva información. Te presentan los resultados para que los revises y recurren a ti cuando hace falta tomar decisiones que requieren tu criterio.

Darles esa responsabilidad a los dots implica confiarles más información y trabajo. Es importante que sepas a qué puede acceder cada dot, cómo usa ese acceso y cuándo necesita tu participación. Estas preguntas son importantes porque los errores de un agente pueden tener consecuencias más allá de una conversación: malinterpretar una solicitud podría llevarlo a modificar el archivo equivocado o compartir información que querías mantener privada.

Incorporamos protecciones en cada parte de ese trabajo. Partimos de GPT‑6 Astra, al que entrenamos para comprender tu intención y seguir reglas de seguridad. Luego agregamos salvaguardas para la información que usan los dots, los entornos en los que trabajan y las acciones que planean realizar. Un espacio de trabajo protegido en la nube ayuda a contener los errores; los flujos de inicio de sesión seguro ayudan a proteger las credenciales sensibles; y las verificaciones independientes de las acciones ayudan a detectar pasos que no se ajustan a tus instrucciones o a los requisitos de seguridad. Tú eliges qué conectar, estableces tus preferencias y sigues o reorientas el trabajo a medida que avanza.

Los dots aún pueden cometer errores, y seguiremos mejorando estas protecciones a medida que aprendamos de su uso real. Aquí explicamos cómo funcionan las salvaguardas en conjunto, qué puedes controlar y qué limitaciones siguen existiendo, para que puedas tomar decisiones informadas sobre el trabajo que les confías a los dots.

Un modelo diseñado para comprender lo que quieres decir

Los dots funcionan con GPT‑6 Astra, nuestro modelo más capaz y alineado. Astra se destaca por comprender tu objetivo, mantenerse dentro del alcance de tu solicitud y hacer preguntas específicas cuando las respuestas podrían cambiar lo que debe hacer. Estas capacidades ayudan a los dots a dar continuidad a las tareas a lo largo del tiempo sin perder de vista tu intención.

Entrenamos a Astra para rechazar solicitudes dañinas, incluidas las relacionadas con usos indebidos en biología o ciberseguridad. Ponemos a prueba cómo los dots manejan los cambios de instrucciones, las solicitudes ambiguas y los intentos de hacer que excedan los permisos que les otorgaste. El red teaming humano y automatizado nos ayuda a encontrar debilidades, mejorar el modelo y los sistemas que lo rodean, y volver a poner a prueba esos cambios.

Seguridad para agentes que pueden realizar acciones

Complementamos esas salvaguardas del modelo con las protecciones de seguridad de ChatGPT y medidas adicionales para agentes que pueden seguir trabajando en tu nombre.

Las protecciones integradas de ChatGPT incluyen el cifrado de tu contenido tanto mientras está almacenado como cuando se transmite entre tú, OpenAI y nuestros proveedores de servicios, además de controles de acceso que ayudan a proteger la información almacenada. Nuestros sistemas de seguridad de cuentas también buscan usos sospechosos de tu cuenta de OpenAI y pueden pedirte que vuelvas a iniciar sesión si una sesión parece estar comprometida.

Los agentes también necesitan protección frente a la información que encuentran mientras hacen su trabajo. Una página web, un correo electrónico o un documento pueden contener instrucciones maliciosas que intentan desviarlos de su tarea o hacer que compartan información privada. Este problema se conoce como inyección de prompts. Combinamos las salvaguardas del modelo con restricciones de herramientas, verificaciones previas a las acciones y monitoreo para ayudar a evitar que ese contenido se convierta en una acción no deseada.

También monitoreamos a los dots mientras planifican y ejecutan acciones para detectar comportamientos potencialmente dañinos, como actuar fuera de tus instrucciones o intentar eludir las salvaguardas. Si el monitoreo de seguridad detecta un posible problema en el trabajo en curso de un dot, puede pausarlo y mostrarte una advertencia para que la revises. Este monitoreo está integrado y ayuda a detectar posibles problemas a medida que avanza una tarea, junto con las protecciones que limitan a qué pueden acceder los dots y qué pueden hacer.

Un espacio de trabajo protegido para cada dot

Cada dot tiene su propia computadora en la nube, donde puede navegar, analizar información, crear archivos y ejecutar herramientas. Los dots pueden seguir avanzando en estos espacios de trabajo, incluso cuando no estás participando activamente.

Tú eliges qué cuentas pueden usar los dots, ya sea conectando aplicaciones con los permisos que le otorgaste a ChatGPT o iniciando sesión en un sitio web desde el navegador de un dot, con el inicio de sesión seguro cuando esté disponible. También puedes conectar tu computadora personal para darles a los dots más formas de ayudarte, como analizar una hoja de cálculo guardada en tu escritorio o usar herramientas de programación instaladas en tu dispositivo.

Dentro del espacio de trabajo protegido de cada dot, el aislamiento restringe el código y las herramientas a los que puede acceder, lo que ayuda a contener el impacto de un código dañino o un comando erróneo. También aislamos los entornos en la nube de los distintos usuarios y nos encargamos del mantenimiento del sistema operativo Linux y del navegador Chrome que utilizan.

Los dots ejecutan código en entornos separados de los sistemas que coordinan su trabajo y hacen cumplir las salvaguardas clave. Pueden crear archivos y ejecutar herramientas allí, pero no pueden usar ese acceso para modificar los sistemas de seguridad ni desactivar las verificaciones obligatorias. Esta separación ayuda a mantener las salvaguardas incluso si un dot comete un error.

Las reglas de acción que se describen a continuación determinan lo que los dots pueden hacer con su acceso.

El espacio de trabajo en la nube de cada dot reúne su computadora y las herramientas que puede usar. Tú eliges qué aplicaciones conectar y si quieres conectar tu computadora personal. La Revisión automática comprueba las acciones que requieren revisión antes de que se ejecuten. Si bloquea un paso, le explica el motivo al dot para que decida qué hacer a continuación.

El espacio de trabajo en la nube de cada dot reúne su computadora y las herramientas que puede usar. Tú eliges qué aplicaciones conectar y si quieres conectar tu computadora personal. La Revisión automática comprueba las acciones que requieren revisión antes de que se ejecuten. Si bloquea un paso, le explica el motivo al dot para que decida qué hacer a continuación.

Inicios de sesión seguros

El inicio de sesión seguro permite que los dots trabajen en tus cuentas sin que las contraseñas entren en la conversación. En los inicios de sesión compatibles, el modelo se pausa mientras completas un formulario de acceso seguro. Este envía tus credenciales directamente al entorno del navegador y las presenta para iniciar sesión sin exponerlas al contexto del modelo. Luego, el dot reanuda el trabajo en la cuenta con la sesión iniciada. Mantener la contraseña fuera de la conversación reduce el riesgo de que aparezca en una respuesta o se comparta por error.

Los flujos compatibles con contraseñas guardadas mantienen esa separación mediante un servicio específico de credenciales cifradas. El servicio proporciona la contraseña para iniciar sesión sin enviársela al modelo. Así, los dots pueden trabajar en las cuentas que autorizaste mientras las contraseñas permanecen fuera del contexto del modelo. Estas protecciones se aplican específicamente a los flujos de inicio de sesión seguro y de contraseñas guardadas; un dato secreto incluido por separado en un mensaje o documento legible puede seguir siendo visible para el modelo.

Inicio de sesión seguro en un panel flotante sobre el fondo de pantalla de dots.

Controla tu información y sigue el trabajo

Administras qué aplicaciones pueden usar los dots mediante tus conexiones y permisos actuales de ChatGPT, que se comparten entre ChatGPT, ChatGPT Work y Codex. En la sección Plugins de Configuración, puedes revisar las cuentas conectadas y cambiar a qué podrán acceder los dots en adelante. Desconectar una aplicación impide que se comparta nueva información a través de esa conexión. Sin embargo, la información que un dot ya haya aprendido permanece en su propio contexto. Estos permisos rigen el acceso a tus aplicaciones; no anulan los requisitos de seguridad obligatorios.

Si quieres que los dots trabajen con archivos o herramientas locales, también puedes conectar tu computadora. Esa conexión sigue sujeta al entorno aislado local y a las verificaciones de acciones correspondientes. Para usar el micrófono o la cámara de tu computadora, también se necesitan los permisos del dispositivo, que puedes optar por otorgarle a ChatGPT.

Permisos de aplicaciones dentro del marco de un teléfono sobre el fondo de pantalla de dots.

La Vista de actividad de la aplicación de escritorio te permite seguir y orientar el trabajo en curso. Muestra las tareas en curso y delegadas, junto con su estado. Puedes agregar contexto, corregir un malentendido, cambiar de rumbo o pedirle a un dot que se detenga.

Vista de actividad en una captura de escritorio flotante con esquinas redondeadas sobre el fondo de pantalla de dots.

Los dots amplían su contexto con el tiempo para ofrecerte una ayuda más útil. Cuando delegan trabajo, los otros agentes reciben instrucciones de conservar la información necesaria para la tarea y evitar guardar detalles sensibles innecesarios. Cada dot tiene su propio contexto, que puedes restablecer en cualquier momento.

En los Espacios de trabajo de ChatGPT Business, Enterprise y Edu, no usamos tus datos para entrenar nuestros modelos de forma predeterminada. En los planes personales de ChatGPT, tú controlas si las conversaciones de tus dots y el trabajo que realizan se usan para mejorar nuestros modelos mediante la opción “Mejorar el modelo para todos”. Cuando el entrenamiento del modelo está habilitado, esto puede incluir las acciones que realizan los dots y las automatizaciones que configuras, después de que trabajamos para eliminar los identificadores personales. Puedes leer más sobre cómo se usan tus datos en este artículo⁠(se abre en una nueva ventana) de nuestro centro de ayuda.

Los dots siguen buscando formas de ayudarte

Además del trabajo que les pides, los dots pueden iniciar tareas de investigación en segundo plano para buscar otras formas de ayudarte, como detectar un cambio en tus planes de viaje. A esto lo llamamos investigación proactiva.

Estas tareas se ejecutan en el entorno en la nube de cada dot. Usan herramientas de solo lectura para recopilar información de las fuentes conectadas permitidas y luego guardan notas privadas para ese dot. Aplicamos estos límites mediante código: las tareas de investigación no pueden enviar mensajes directamente a otras personas, modificar contenido en las aplicaciones conectadas ni controlar un navegador o un escritorio. Los dots pueden usar los hallazgos para decidir cómo ayudar, pero cualquier acción posterior debe seguir las reglas y verificaciones habituales.

La investigación proactiva se ejecuta como una tarea en segundo plano dentro del entorno en la nube de cada dot. Lee las fuentes conectadas permitidas y devuelve notas privadas a ese dot, que decide cómo ayudar. Cualquier acción posterior sigue las reglas y verificaciones habituales.

La investigación proactiva se ejecuta como una tarea en segundo plano dentro del entorno en la nube de cada dot. Lee las fuentes conectadas permitidas y devuelve notas privadas a ese dot, que decide cómo ayudar. Cualquier acción posterior sigue las reglas y verificaciones habituales.

No entrenamos nuestros modelos directamente con esos hilos de investigación en segundo plano ni con las notas que generan. Sin embargo, un dot puede recibir notas de su tarea de investigación en segundo plano o leer partes de sus hilos de investigación. La información incorporada de esta manera a una conversación o tarea apta para entrenamiento puede usarse para entrenar modelos, según tu configuración. Por ejemplo, una tarea de investigación en segundo plano podría recopilar información sobre varios destinos para un próximo viaje a Europa. Ese hilo de investigación y sus notas no se usan directamente para el entrenamiento. Más adelante, cuando le pidas a tu dot que te ayude a planear un viaje a Lisboa, podría leer una nota sobre Lisboa de su tarea de investigación en segundo plano. Esa nota pasa a formar parte del contexto de tu conversación para planear el viaje y, a partir de entonces, puede usarse para el entrenamiento, según tu configuración. El resto de la investigación en segundo plano no se usa para el entrenamiento, a menos que también se incorpore a una conversación o tarea apta para ese fin.

Reglas claras para realizar acciones

Los dots siguen límites de seguridad integrados, diseñados para evitar daños y dejar las decisiones importantes en tus manos. Sus reglas de seguridad les exigen rechazar solicitudes dañinas, incluidas las relacionadas con usos indebidos en biología o ciberseguridad. Para las tareas en las que pueden ayudar, las reglas de acción definen cuándo pueden avanzar, cuándo deben pedir confirmación y cuándo deben dejar un paso en tus manos.

Dentro de esos límites, los dots pueden leer la información a la que tienen permiso de acceder, analizarla y preparar borradores en tus conversaciones. Para enviar un mensaje o compartir un archivo, se les enseña a solicitar una autorización que abarque la información y el tipo de destinatario. Cuanto más sensibles sean los datos, más específicos deben ser los destinatarios. Por ejemplo, para los datos de salud, siempre se requerirá que el usuario indique un destinatario por su nombre (“comparte mi historial médico con el Dr. Thompson”). Para los datos personales menos sensibles, como una dirección de correo electrónico o un número de teléfono, de forma predeterminada se requerirá que el usuario especifique categorías de destinatarios (“cualquier aerolínea”). El usuario puede ampliar aún más las reglas sobre datos personales menos sensibles (“compártelos en cualquier formulario en línea”) creando una Regla personalizada. Consulta la siguiente sección para obtener más detalles sobre esta función. Esa autorización sigue vinculada a tus instrucciones para la tarea; continuar más adelante o delegar trabajo no la amplía.

Los dots pueden hacer compras con las tarjetas que ya hayas guardado en el sitio web de un comercio. Esas compras requieren tu aprobación.

Algunas acciones requieren tu confirmación cada vez, como eliminar datos de forma permanente, instalar o ejecutar software de una fuente no reconocida u otorgar nuevos permisos de acceso que afecten la seguridad. Estos requisitos te dan la oportunidad de revisar cambios que podrían ser difíciles de deshacer o darle a alguien un nuevo acceso.

En otros pasos delicados, como cambiar una contraseña o transferir dinero entre cuentas financieras, los dots pueden ayudar con el resto de la tarea, pero deben dejar esos pasos en tus manos.

Define tus preferencias con las Reglas personalizadas

Las Reglas personalizadas te permiten definir cómo te ayudan los dots dentro de estas protecciones integradas; por ejemplo, puedes indicarles que nunca envíen correos electrónicos. También puedes dar instrucciones específicas para una tarea, como pedirle a un dot que le avise a un colega que estás ausente sin compartir el motivo personal. Esas instrucciones siguen vigentes cuando el dot delega trabajo o trabaja en segundo plano.

Los dots pueden ayudarte a escribir Reglas personalizadas, pero necesitan tu aprobación para modificarlas. Estas preferencias funcionan dentro de los límites de seguridad integrados y no pueden eliminar las confirmaciones obligatorias, los pasos que deben quedar en tus manos ni los requisitos de seguridad fundamentales.

Reglas personalizadas dentro del marco de un teléfono sobre el fondo de pantalla de dots.

Una verificación independiente antes de que los dots actúen

Antes de que los dots realicen acciones como enviar correos electrónicos o modificar archivos, un sistema de seguridad independiente llamado Revisión automática comprueba que los pasos planeados se ajusten a tus instrucciones, tus Reglas personalizadas y los requisitos de seguridad. En el caso de un correo electrónico, revisa el destinatario y el mensaje para ayudar a detectar una dirección incorrecta o información que no querías compartir.

Si la Revisión automática permite un paso, el dot que lo propuso lo ejecuta con la herramienta adecuada de la computadora o la aplicación y luego usa el resultado para continuar con tu tarea. Puede basarse en una aprobación que ya hayas dado cuando esta abarque la acción y las reglas no exijan una nueva confirmación.

Si la Revisión automática bloquea un paso, impide que se ejecute la acción y le explica el motivo al dot. Ese dot puede pedirte más información o tu aprobación si eso pudiera resolver el bloqueo y, luego, volver a enviar el paso para su revisión. Según el motivo, en lugar de eso puede probar una alternativa permitida, dejar un paso delicado en tus manos o detenerse. Tu aprobación no puede anular los requisitos de seguridad fundamentales.

Mantenemos los controles que hacen cumplir la Revisión automática fuera de los entornos que los dots pueden modificar, para que no puedan cambiar ni desactivar una verificación obligatoria. Los pasos habituales de solo lectura siguen sujetos a los permisos de las aplicaciones, las restricciones de herramientas y otras salvaguardas, pero no necesitan esta revisión adicional.

Cuando la Revisión automática permite una acción, el dot la ejecuta y recibe el resultado. Cuando bloquea una acción, le comunica el motivo al dot, que decide si debe consultarte, probar una alternativa permitida, dejar el paso en tus manos o detenerse.

Cuando la Revisión automática permite una acción, el dot la ejecuta y recibe el resultado. Cuando bloquea una acción, le comunica el motivo al dot, que decide si debe consultarte, probar una alternativa permitida, dejar el paso en tus manos o detenerse.

Más ayuda, con el control en tus manos

Confiarles a los dots un trabajo continuo implica saber cómo seguirán tus instrucciones y cómo responderán cuando ocurra algo inesperado. Astra los ayuda a comprender tu intención, mientras que las protecciones de sus datos, espacios de trabajo, credenciales y acciones ayudan a limitar los daños que pueden causar los errores o el contenido malicioso. En conjunto, estas salvaguardas les dan a los dots margen para hacer un trabajo útil y reducen la probabilidad de que un error se convierta en una acción o divulgación no deseada.

Tú eliges a qué pueden conectarse los dots y cómo te ayudan, y puedes seguir su progreso o cambiar de rumbo a medida que cambien tus necesidades. Las aprobaciones y los pasos que quedan a tu cargo mantienen las decisiones clave en tus manos. Los dots aún pueden cometer errores, así que seguiremos poniendo a prueba y mejorando sus protecciones a medida que aprendamos de su uso real. Nuestro objetivo es que te resulte más fácil dejarles trabajo a los dots y encontrar avances útiles al volver, con tus preferencias como guía y las decisiones importantes siempre en tus manos.

Más información

Lee la tarjeta del sistema⁠(se abre en una nueva ventana) para conocer más detalles sobre nuestras salvaguardas, evaluaciones de seguridad y las limitaciones que aún existen.

Para conocer las bases de seguridad de ChatGPT, consulta Seguridad y privacidad en OpenAI. Para conocer más a fondo una de las protecciones de seguridad web, consulta Cómo protegemos tus datos cuando un agente de IA hace clic en un enlace.

Autor

OpenAI