Os dots são agentes sempre ativos que assumem responsabilidades de forma contínua, dando-lhe mais tempo e atenção para aquilo que lhe importa. Cada dot tem o seu próprio computador e trabalha nas aplicações que escolher ligar. Atribui objetivos aos dots e define o que podem fazer de forma autónoma. Podem executar as várias etapas, adaptar-se às mudanças e continuar a avançar entre conversas. Podem acompanhar uma notícia em desenvolvimento e preparar um rascunho de uma newsletter, ou ajudar a atualizar um projeto à medida que surgem novas informações — apresentando os resultados para sua revisão e recorrendo a si para decisões que exigem o seu discernimento.
Dar essa responsabilidade aos dots significa confiar-lhes mais informações e trabalho. Deve saber a que é que cada dot pode aceder, como utiliza esse acesso e quando precisa de o envolver. Estas questões são importantes porque os erros de um agente podem ter consequências que vão além de uma conversa: interpretar mal um pedido pode levá-lo a alterar o ficheiro errado ou a partilhar informações que pretendia manter privadas.
Criamos proteções para cada parte desse trabalho. Começamos pelo GPT‑6 Astra, que treinamos para compreender a sua intenção e seguir regras de segurança. Depois, acrescentamos salvaguardas relativas às informações que os dots utilizam, aos ambientes em que trabalham e às ações que planeiam executar. Um espaço de trabalho protegido na nuvem ajuda a conter os erros, os processos de início de sessão seguro ajudam a proteger credenciais sensíveis e as verificações independentes das ações ajudam a detetar etapas que não respeitem as suas instruções ou os requisitos de segurança. Escolhe o que ligar, define preferências e acompanha ou redireciona o trabalho à medida que este avança.
Os dots continuam a poder cometer erros, e continuaremos a melhorar estas proteções com base no que aprendemos com a utilização real. Aqui, explicamos como as salvaguardas funcionam em conjunto, o que pode controlar e quais as limitações que ainda existem — para que possa tomar decisões informadas sobre o trabalho que confia aos dots.
Os dots são alimentados pelo GPT‑6 Astra, o nosso modelo mais capaz e alinhado. O Astra destaca-se por compreender o seu objetivo, respeitar o âmbito do seu pedido e fazer perguntas específicas quando as respostas podem mudar o que deve fazer. Estas capacidades ajudam os dots a acompanhar tarefas ao longo do tempo sem perderem de vista o que pretendia.
Treinámos o Astra para recusar pedidos nocivos, incluindo os que envolvem utilização indevida na área da biologia ou da cibersegurança. Testamos a forma como os dots lidam com alterações às instruções, pedidos ambíguos e tentativas de os levar a agir para além das permissões que concedeu. O red teaming humano e automatizado ajuda-nos a encontrar fragilidades, a melhorar o modelo e os sistemas que o rodeiam e a voltar a testar essas alterações.
Complementamos essas salvaguardas do modelo com as proteções de segurança do ChatGPT e medidas adicionais para agentes que podem continuar a trabalhar em seu nome.
As proteções integradas do ChatGPT incluem a encriptação do seu conteúdo durante o armazenamento e a transmissão entre si, a OpenAI e os nossos prestadores de serviços, bem como controlos de acesso que ajudam a proteger as informações armazenadas. Os nossos sistemas de segurança de contas também procuram detetar utilizações suspeitas da sua conta OpenAI e podem exigir um novo início de sessão se uma sessão parecer comprometida.
Os agentes também precisam de proteção contra as informações que encontram ao realizar o seu trabalho. Uma página Web, um e-mail ou um documento pode conter instruções maliciosas que tentam redirecioná-los ou levá-los a partilhar informações privadas — um problema chamado injeção de prompt. Combinamos as salvaguardas do modelo com restrições às ferramentas, verificações antes das ações e monitorização para ajudar a impedir que esse conteúdo se transforme numa ação indesejada.
Também monitorizamos os dots enquanto planeiam e executam ações, procurando comportamentos potencialmente nocivos, como agir fora das suas instruções ou tentar contornar salvaguardas. Se a monitorização de segurança detetar um possível problema no trabalho em curso de um dot, pode interromper esse trabalho e mostrar-lhe um aviso para analisar. Esta monitorização está integrada e ajuda a detetar possíveis problemas à medida que uma tarefa avança, a par das proteções que limitam aquilo a que os dots podem aceder e o que podem fazer.
Cada dot tem o seu próprio computador na nuvem, onde pode navegar na Web, analisar informações, criar ficheiros e executar ferramentas. Os dots podem continuar a avançar nestes espaços de trabalho, mesmo quando não está a participar ativamente.
Escolhe que contas os dots podem utilizar, quer ligando aplicações dentro das permissões que concedeu ao ChatGPT, quer iniciando sessão num site no navegador de um dot, através do início de sessão seguro quando disponível. Também pode optar por ligar o seu computador pessoal para dar aos dots mais formas de ajudar — por exemplo, analisando uma folha de cálculo guardada no seu ambiente de trabalho ou utilizando ferramentas de programação instaladas no seu dispositivo.
No espaço de trabalho protegido de cada dot, o isolamento num ambiente restrito limita o código e as ferramentas a que esse dot pode aceder, ajudando a conter o impacto de código nocivo ou de um comando incorreto. Também isolamos os ambientes na nuvem dos utilizadores uns dos outros e asseguramos a manutenção do sistema operativo Linux e do navegador Chrome subjacentes.
Os dots executam código em ambientes separados dos sistemas que coordenam o seu trabalho e fazem cumprir as principais salvaguardas. Podem criar ficheiros e executar ferramentas nesses ambientes, mas não podem utilizar esse acesso para alterar esses sistemas de segurança ou desativar verificações obrigatórias. Esta separação ajuda a manter essas salvaguardas em vigor, mesmo que um dot cometa um erro.
As regras de ação descritas abaixo determinam o que os dots podem fazer com o acesso de que dispõem.

O espaço de trabalho na nuvem de cada dot reúne o seu computador e as ferramentas que pode utilizar. Escolhe que aplicações ligar e se pretende ligar o seu computador pessoal. A Revisão automática verifica as ações que precisam de revisão antes de serem executadas. Se bloquear uma etapa, comunica o motivo ao dot para que este possa decidir o que fazer a seguir.
O início de sessão seguro permite que os dots trabalhem em contas sem que as palavras-passe entrem na conversa. Nos inícios de sessão compatíveis, o modelo é colocado em pausa enquanto preenche um formulário seguro de início de sessão. Este envia as suas credenciais diretamente para o ambiente do navegador e submete-as sem as expor ao contexto do modelo. O dot retoma então o trabalho na conta com sessão iniciada. Manter a palavra-passe fora da conversa reduz o risco de esta aparecer numa resposta ou ser partilhada por engano.
Os processos compatíveis que utilizam palavras-passe guardadas mantêm essa separação através de um serviço de credenciais dedicado e encriptado. O serviço fornece a palavra-passe para iniciar sessão sem a transmitir ao modelo. Assim, os dots podem trabalhar nas contas que autorizou, enquanto as palavras-passe permanecem fora do contexto do modelo. Estas proteções são específicas dos processos de início de sessão seguro e de utilização de palavras-passe guardadas; um segredo colocado separadamente numa mensagem ou num documento legível pode continuar a ser visível para o modelo.

Gere as aplicações que os dots podem utilizar através das suas ligações e permissões existentes no ChatGPT, que são partilhadas entre o ChatGPT, o ChatGPT Work e o Codex. Na secção Plugins das Definições, pode rever as contas ligadas e alterar aquilo a que os dots podem aceder daí em diante. Desligar uma aplicação impede novas partilhas de informações através dessa ligação. No entanto, as informações que um dot já adquiriu permanecem no seu contexto. Estas permissões regem o acesso às suas aplicações; não se sobrepõem aos requisitos de segurança obrigatórios.
Se quiser que os dots trabalhem com ficheiros ou ferramentas locais, também pode optar por ligar o seu computador. Essa ligação continua sujeita ao ambiente restrito local e às verificações de ações aplicáveis. A utilização do microfone ou da câmara do seu computador também exige permissões do dispositivo, que pode optar por conceder ao ChatGPT.

A Vista de atividade na aplicação para computador permite-lhe acompanhar e orientar o trabalho em curso. Mostra as tarefas em curso e as tarefas delegadas, bem como o respetivo estado. Pode acrescentar contexto, corrigir um mal-entendido, mudar de rumo ou pedir a um dot que pare.

Os dots acumulam contexto ao longo do tempo para tornar a sua ajuda mais útil. Quando delegam trabalho, os outros agentes recebem instruções para conservar as informações necessárias à tarefa e evitar reter detalhes sensíveis desnecessários. Cada dot tem o seu próprio contexto, que pode repor a qualquer momento.
Nos espaços de trabalho do ChatGPT Business, Enterprise e Edu, não utilizamos os seus dados para treinar os nossos modelos por predefinição. Nos planos pessoais do ChatGPT, controla se as conversas dos seus dots e o trabalho que realizam são utilizados para melhorar os nossos modelos, através da definição «Melhorar o modelo para todos». Quando o treino de modelos está ativado, isto pode incluir ações realizadas pelos dots e automatizações que configurar, depois de tomarmos medidas para remover identificadores pessoais. Pode saber mais sobre a utilização dos seus dados neste artigo(abre numa nova janela) do nosso centro de ajuda.
Além do trabalho que lhes pede, os dots podem iniciar tarefas de pesquisa em segundo plano para procurar outras formas de ajudar — por exemplo, detetando uma alteração aos seus planos de viagem. Chamamos a isto pesquisa proativa.
Estas tarefas são executadas no ambiente na nuvem de cada dot. Utilizam ferramentas só de leitura para recolher informações de fontes ligadas cujo acesso está autorizado e, em seguida, guardam notas privadas para esse dot. Impomos estes limites no código: as tarefas de pesquisa não podem enviar mensagens diretamente a outras pessoas, alterar conteúdo em aplicações ligadas nem controlar um navegador ou um ambiente de trabalho. Os dots podem utilizar os resultados para decidir como ajudar, mas qualquer ação subsequente tem de seguir as regras e verificações habituais.

A pesquisa proativa é executada como uma tarefa em segundo plano no ambiente na nuvem de cada dot. Lê as fontes ligadas cujo acesso está autorizado e devolve notas privadas a esse dot, que decide como ajudar. Qualquer ação subsequente segue as regras e verificações habituais.
Não treinamos os nossos modelos diretamente com essas conversas de pesquisa em segundo plano nem com as notas que produzem. No entanto, um dot pode receber notas da sua tarefa de pesquisa em segundo plano ou ler partes das suas conversas de pesquisa. As informações introduzidas desta forma numa conversa ou tarefa elegível podem ser utilizadas para treinar modelos, consoante as suas definições. Por exemplo, uma tarefa de pesquisa em segundo plano pode recolher informações sobre vários destinos para uma próxima viagem à Europa. Essa conversa de pesquisa e as respetivas notas não são utilizadas diretamente para treino. Mais tarde, quando pedir ao seu dot que ajude a planear uma viagem a Lisboa, este poderá ler uma nota sobre Lisboa da sua tarefa de pesquisa em segundo plano. Essa nota passa a fazer parte do contexto da sua conversa de planeamento da viagem e poderá então ser utilizada para treino, consoante as suas definições. A restante pesquisa em segundo plano não é utilizada para treino, a menos que também seja introduzida numa conversa ou tarefa elegível.
Os dots seguem mecanismos de proteção integrados, concebidos para evitar danos e manter nas suas mãos as decisões com consequências importantes. As suas regras de segurança exigem que recusem pedidos nocivos, incluindo os que envolvem utilização indevida na área da biologia ou da cibersegurança. Nas tarefas em que podem ajudar, as regras de ação definem quando podem avançar, quando têm de pedir confirmação e quando têm de deixar uma etapa a seu cargo.
Dentro desses limites, os dots podem ler informações a que têm permissão para aceder, analisá-las e preparar rascunhos nas suas conversas. Para enviar uma mensagem ou partilhar um ficheiro, são treinados para obter uma autorização que abranja as informações e o tipo de destinatário — dados mais sensíveis exigem uma identificação mais específica dos destinatários. Por exemplo, os dados de saúde exigem sempre que o utilizador identifique um destinatário pelo nome («partilha o meu historial clínico com o Dr. Thompson»). Os dados pessoais menos sensíveis, como um endereço de e-mail ou um número de telefone, exigem por predefinição que o utilizador especifique categorias de destinatários («qualquer companhia aérea»). O utilizador pode ainda alargar as regras para dados pessoais menos sensíveis («partilha com qualquer formulário online»), criando uma Regra personalizada — consulte a secção seguinte para obter mais informações sobre esta funcionalidade. Essa autorização continua vinculada às suas instruções para a tarefa; retomar o trabalho mais tarde ou delegá-lo não a alarga.
Os dots podem fazer compras com cartões que já tenha guardado no site de um comerciante. Essas compras exigem a sua aprovação.
Algumas ações exigem a sua confirmação sempre que são realizadas, incluindo eliminar dados permanentemente, instalar ou executar software de uma origem desconhecida ou conceder novos acessos com implicações de segurança. Estes requisitos dão-lhe a oportunidade de rever alterações que possam ser difíceis de reverter ou que concedam novos acessos a alguém.
Noutras etapas sensíveis, incluindo alterar uma palavra-passe ou transferir dinheiro entre contas financeiras, os dots podem ajudar com a tarefa envolvente, mas têm de deixar essas etapas sensíveis a seu cargo.
As Regras personalizadas permitem-lhe definir como os dots ajudam, respeitando estas proteções integradas — por exemplo, indicando-lhes que nunca enviem e-mails. Também pode dar instruções específicas para uma tarefa, como pedir a um dot que informe um colega de que está ausente sem revelar o motivo pessoal. Essas instruções continuam a aplicar-se quando esse dot delega trabalho ou trabalha em segundo plano.
Os dots podem ajudar a escrever Regras personalizadas, mas precisam da sua aprovação para as alterar. Estas preferências respeitam os mecanismos de proteção integrados e não podem eliminar confirmações obrigatórias, etapas que têm de ficar a seu cargo ou requisitos fundamentais de segurança.

Antes de os dots realizarem ações como enviar e-mails ou alterar ficheiros, um sistema de segurança independente chamado Revisão automática verifica se as etapas planeadas respeitam as suas instruções, as Regras personalizadas e os requisitos de segurança. No caso de um e-mail, verifica o destinatário e a mensagem para ajudar a detetar um endereço errado ou informações que não pretendia partilhar.
Se a Revisão automática permitir uma etapa, o dot que a propôs executa-a com a ferramenta adequada do computador ou da aplicação e utiliza o resultado para prosseguir com a sua tarefa. Pode basear-se numa aprovação que já tenha dado, quando essa aprovação abrange a ação e as regras não exigem uma nova confirmação.
Se a Revisão automática bloquear uma etapa, impede a execução da ação e comunica o motivo ao dot. Esse dot pode pedir mais informações ou a sua aprovação, se isso puder resolver o bloqueio, e depois submeter novamente a etapa a revisão. Consoante o motivo, pode, em alternativa, tentar uma opção permitida, deixar uma etapa sensível a seu cargo ou parar. A sua aprovação não pode sobrepor-se aos requisitos fundamentais de segurança.
Mantemos os controlos que impõem a Revisão automática fora dos ambientes que os dots podem alterar, para que estes não possam modificar nem desativar uma verificação obrigatória. As etapas habituais só de leitura continuam a respeitar as permissões das aplicações, as restrições das ferramentas e outras salvaguardas, mas não precisam desta revisão adicional.

Quando a Revisão automática permite uma ação, o dot executa-a e recebe o resultado. Quando bloqueia uma ação, comunica o motivo ao dot, que decide se deve consultar o utilizador, tentar uma alternativa permitida, deixar a etapa a cargo do utilizador ou parar.
Confiar trabalho contínuo aos dots implica saber como vão seguir as suas instruções e reagir quando acontecer algo inesperado. O Astra ajuda-os a compreender a sua intenção, enquanto as proteções dos seus dados, espaços de trabalho, credenciais e ações ajudam a limitar os danos causados por erros ou conteúdo malicioso. Em conjunto, estas salvaguardas dão aos dots margem para realizar trabalho útil, reduzindo a probabilidade de um erro se transformar numa ação ou divulgação indesejada.
Escolhe a que se podem ligar os dots e como ajudam, e pode acompanhar o seu progresso ou mudar de rumo à medida que as suas necessidades mudam. As aprovações e as etapas deixadas a seu cargo mantêm as decisões essenciais nas suas mãos. Os dots continuam a poder cometer erros, pelo que continuaremos a testar e a melhorar as suas proteções com base no que aprendemos com a utilização real. O nosso objetivo é facilitar a delegação de trabalho aos dots para que, quando voltar, encontre progressos úteis, com as suas preferências a orientar a tarefa e as decisões importantes ainda nas suas mãos.
Leia o system card(abre numa nova janela) para saber mais sobre as nossas salvaguardas, avaliações de segurança e limitações que ainda existem.
Para conhecer as bases de segurança do ChatGPT, consulte Segurança e privacidade na OpenAI. Para conhecer melhor uma das proteções de segurança na Web, consulte Manter os seus dados seguros quando um agente de IA clica numa ligação.