Salta al contingut principal
OpenAI

29 de setembre del 2026

SeguretatSeguretat

Com integrem la seguretat, la protecció i la privadesa als dots

A mesura que els teus dots assumeixen més feina, ajudem a protegir la teva informació i a mantenir les decisions importants a les teves mans.

S'està carregant…

Els dots són agents sempre actius que assumeixen responsabilitats de manera continuada i et deixen més temps i atenció per dedicar a allò que t'importa. Cada dot té el seu propi ordinador i treballa amb les aplicacions que tries connectar. Tu dones objectius als dots i defineixes què poden fer pel seu compte. Poden anar completant els passos, adaptar-se als canvis i continuar avançant entre converses. Poden seguir l'evolució d'una notícia i preparar l'esborrany d'un butlletí, o ajudar a actualitzar un projecte a mesura que arriba informació nova. Et presenten els resultats perquè els revisis i recorren a tu per a les decisions que requereixen el teu criteri.

Donar aquesta responsabilitat als dots vol dir confiar-los més informació i feina. És important que entenguis a què pot accedir cada dot, com fa servir aquest accés i quan necessita la teva intervenció. Aquestes qüestions són importants perquè els errors d'un agent poden tenir conseqüències més enllà d'una conversa: si interpreta malament una petició, podria modificar un fitxer equivocat o compartir informació que volies mantenir privada.

Incorporem proteccions a cada part d'aquesta feina. Partim de GPT‑6 Astra, que entrenem perquè entengui la teva intenció i segueixi les regles de seguretat. Després hi afegim salvaguardes per a la informació que utilitzen els dots, els entorns en què treballen i les accions que preveuen dur a terme. Un espai de treball protegit al núvol ajuda a contenir els errors, els processos d'inici de sessió segur ajuden a protegir les credencials sensibles i les comprovacions independents de les accions ajuden a detectar passos que no s'ajusten a les teves instruccions o als requisits de seguretat. Tu tries què vols connectar, estableixes les preferències i segueixes o reorientes la feina a mesura que avança.

Els dots encara poden cometre errors, i continuarem millorant aquestes proteccions a mesura que aprenguem de l'ús real. Aquí expliquem com es complementen les salvaguardes, què controles tu i quines limitacions encara tenen, perquè puguis prendre decisions informades sobre la feina que confies als dots.

Un model dissenyat per entendre què vols dir

Els dots funcionen amb GPT‑6 Astra, el nostre model més capaç i alineat. Astra destaca a l'hora d'entendre el teu objectiu, cenyir-se a l'abast de la teva petició i fer preguntes concretes quan les respostes poden canviar el que hauria de fer. Aquestes capacitats ajuden els dots a donar continuïtat a les tasques sense perdre de vista el que volies aconseguir.

Hem entrenat Astra perquè rebutgi peticions perjudicials, incloses les que impliquen un ús indegut en l'àmbit de la biologia o la ciberseguretat. Posem a prova com gestionen els dots les instruccions canviants, les peticions ambigües i els intents de fer-los anar més enllà dels permisos que els has concedit. Les proves d'equip vermell, tant humanes com automatitzades, ens ajuden a trobar punts febles, millorar el model i els sistemes que l'envolten, i tornar a posar a prova aquests canvis.

Protecció per a agents que poden actuar

Reforcem aquestes salvaguardes del model amb les proteccions de seguretat de ChatGPT i mesures addicionals per als agents que poden continuar treballant en nom teu.

Les proteccions integrades de ChatGPT inclouen el xifratge del teu contingut tant quan està emmagatzemat com quan es transmet entre tu, OpenAI i els nostres proveïdors de serveis, a més de controls d'accés que ajuden a protegir la informació emmagatzemada. Els nostres sistemes de seguretat dels comptes també busquen usos sospitosos del teu compte d'OpenAI i poden exigir que tornis a iniciar sessió si sembla que una sessió s'ha vist compromesa.

Els agents també necessiten protecció davant la informació que troben mentre fan la seva feina. Una pàgina web, un correu electrònic o un document pot contenir instruccions malicioses que intentin desviar-los del seu objectiu o fer-los compartir informació privada: un problema anomenat injecció d'indicacions. Combinem les salvaguardes del model amb restriccions de les eines, comprovacions prèvies a les accions i supervisió per ajudar a evitar que aquest contingut es converteixi en una acció no desitjada.

També supervisem els dots mentre planifiquen i executen accions, buscant comportaments potencialment perjudicials, com ara actuar al marge de les teves instruccions o intentar eludir les salvaguardes. Si el sistema de supervisió de seguretat detecta un possible problema en la feina en curs d'un dot, pot posar-la en pausa i mostrar-te un avís perquè el revisis. Aquesta supervisió està integrada i ajuda a detectar possibles problemes a mesura que avança una tasca, juntament amb les proteccions que limiten a què poden accedir els dots i què poden fer.

Un espai de treball protegit per a cada dot

Cada dot té el seu propi ordinador al núvol, on pot navegar, analitzar informació, crear fitxers i executar eines. Els dots poden continuar avançant en aquests espais de treball, encara que no hi participis activament.

Tu tries quins comptes poden utilitzar els dots, ja sigui connectant aplicacions dins dels permisos que has concedit a ChatGPT o iniciant sessió en un lloc web al navegador d'un dot, amb l'inici de sessió segur quan estigui disponible. També pots connectar el teu ordinador personal per donar als dots més maneres d'ajudar-te; per exemple, analitzant un full de càlcul desat a l'escriptori o utilitzant eines de programació instal·lades al dispositiu.

Dins de l'espai de treball protegit de cada dot, l'aïllament restringeix el codi i les eines als quals pot accedir, i ajuda a contenir l'impacte del codi perjudicial o d'una ordre errònia. També aïllem els entorns al núvol dels usuaris els uns dels altres i mantenim el sistema operatiu Linux i el navegador Chrome en què es basen.

Els dots executen codi en entorns separats dels sistemes que coordinen la seva feina i fan complir les salvaguardes principals. Hi poden crear fitxers i executar eines, però no poden utilitzar aquest accés per modificar els sistemes de seguretat ni desactivar les comprovacions obligatòries. Aquesta separació ajuda a mantenir les salvaguardes actives encara que un dot cometi un error.

Les regles d'acció que es descriuen a continuació regulen què poden fer els dots amb l'accés de què disposen.

L'espai de treball al núvol de cada dot reuneix el seu ordinador i les eines que pot utilitzar. Tu tries quines aplicacions vols connectar i si vols connectar el teu ordinador personal. La revisió automàtica comprova les accions que requereixen revisió abans que s'executin. Si bloqueja un pas, n'indica el motiu al dot perquè pugui decidir què fer a continuació.

L'espai de treball al núvol de cada dot reuneix el seu ordinador i les eines que pot utilitzar. Tu tries quines aplicacions vols connectar i si vols connectar el teu ordinador personal. La revisió automàtica comprova les accions que requereixen revisió abans que s'executin. Si bloqueja un pas, n'indica el motiu al dot perquè pugui decidir què fer a continuació.

Inicis de sessió segurs

L'inici de sessió segur permet als dots treballar en comptes sense que les contrasenyes entrin a la conversa. En els inicis de sessió compatibles, el model es posa en pausa mentre emplenes un formulari d'inici de sessió segur. Aquest formulari envia les credencials directament a l'entorn del navegador i les tramet sense exposar-les al context del model. El dot reprèn aleshores la feina al compte amb la sessió iniciada. Mantenir la contrasenya fora de la conversa redueix el risc que aparegui en una resposta o es comparteixi per error.

Els processos compatibles amb contrasenyes desades mantenen aquesta separació mitjançant un servei específic de credencials xifrades. El servei proporciona la contrasenya per iniciar sessió sense passar-la al model, de manera que els dots poden treballar en els comptes que has autoritzat mentre les contrasenyes es mantenen fora del context del model. Aquestes proteccions són específiques dels processos d'inici de sessió segur i de contrasenyes desades; una dada secreta inclosa per separat en un missatge o document llegible encara pot ser visible per al model.

Inici de sessió segur en un panell flotant sobre el fons de pantalla dels dots.

Controla la teva informació i segueix la feina

Gestiones quines aplicacions poden utilitzar els dots a través de les connexions i els permisos que ja tens a ChatGPT, que es comparteixen entre ChatGPT, ChatGPT Work i Codex. A la secció Connectors de la Configuració, pots revisar els comptes connectats i canviar a què podran accedir els dots d'ara endavant. Desconnectar una aplicació impedeix que es comparteixi informació nova a través d'aquella connexió. Però la informació que un dot ja ha après es manté en el seu context. Aquests permisos regulen l'accés a les teves aplicacions; no anul·len els requisits de seguretat obligatoris.

Si vols que els dots treballin amb fitxers o eines locals, també pots optar per connectar el teu ordinador. Aquesta connexió continua subjecta a l'entorn aïllat local i a les comprovacions d'accions que hi siguin aplicables. Per utilitzar el micròfon o la càmera de l'ordinador també calen els permisos del dispositiu, que pots decidir concedir a ChatGPT.

Permisos de les aplicacions dins del marc d'un telèfon sobre el fons de pantalla dels dots.

La Vista d'activitat de l'aplicació d'escriptori et permet seguir i orientar la feina en curs. Mostra les tasques en curs i les delegades, així com el seu estat. Pots afegir context, corregir un malentès, canviar de rumb o demanar a un dot que s'aturi.

Vista d'activitat en una captura d'escriptori flotant amb cantonades arrodonides sobre el fons de pantalla dels dots.

Els dots acumulen context amb el temps per oferir una ajuda més útil. Quan deleguen feina, els altres agents reben instruccions per conservar la informació necessària per a la tasca i evitar retenir detalls sensibles innecessaris. Cada dot té un context propi que pots restablir en qualsevol moment.

Als espais de treball de ChatGPT Business, Enterprise i Edu, per defecte no utilitzem les teves dades per entrenar els nostres models. Als plans personals de ChatGPT, tu controles si les converses dels teus dots i la feina que fan s'utilitzen per millorar els nostres models, mitjançant l'opció «Millora el model per a tothom». Quan l'entrenament del model està activat, s'hi poden incloure les accions que fan els dots i les automatitzacions que configures, després que hàgim treballat per eliminar-ne els identificadors personals. Pots llegir més sobre com s'utilitzen les teves dades en aquest article⁠(s'obre en una finestra nova) del nostre centre d'ajuda.

Els dots continuen buscant maneres d'ajudar-te

A més de la feina que els encarregues, els dots poden iniciar tasques de recerca en segon pla per buscar altres maneres d'ajudar-te; per exemple, detectant un canvi en els teus plans de viatge. En diem recerca proactiva.

Aquestes tasques s'executen a l'entorn al núvol de cada dot. Utilitzen eines de només lectura per recollir informació de les fonts connectades permeses i després desen notes privades per a aquell dot. Fem complir aquests límits mitjançant el codi: les tasques de recerca no poden enviar missatges directament a altres persones, modificar contingut en aplicacions connectades ni controlar un navegador o un escriptori. Els dots poden utilitzar els resultats per decidir com ajudar-te, però qualsevol acció posterior ha de seguir les regles i les comprovacions habituals.

La recerca proactiva s'executa com una tasca en segon pla dins de l'entorn al núvol de cada dot. Llegeix les fonts connectades permeses i retorna notes privades al dot, que decideix com ajudar-te. Qualsevol acció posterior segueix les regles i les comprovacions habituals.

La recerca proactiva s'executa com una tasca en segon pla dins de l'entorn al núvol de cada dot. Llegeix les fonts connectades permeses i retorna notes privades al dot, que decideix com ajudar-te. Qualsevol acció posterior segueix les regles i les comprovacions habituals.

No entrenem els nostres models directament amb aquests fils de recerca en segon pla ni amb les notes que generen. Però un dot pot rebre notes de la seva tasca de recerca en segon pla o llegir parts dels seus fils de recerca. La informació incorporada així a una conversa o tasca apta per a l'entrenament es pot utilitzar per entrenar el model, segons la teva configuració. Per exemple, una tasca de recerca en segon pla podria recollir informació sobre diverses destinacions per a un proper viatge a Europa. Aquell fil de recerca i les seves notes no s'utilitzen directament per a l'entrenament. Més endavant, quan demanis al teu dot que t'ajudi a planificar un viatge a Lisboa, podria llegir una nota sobre Lisboa de la seva tasca de recerca en segon pla. Aquesta nota passa a formar part del context de la conversa en què planifiques el viatge i, aleshores, es pot utilitzar per a l'entrenament, segons la teva configuració. La resta de la recerca en segon pla no s'utilitza per a l'entrenament tret que també s'incorpori a una conversa o tasca apta per a aquest ús.

Regles clares per actuar

Els dots segueixen uns límits integrats dissenyats per prevenir danys i deixar les decisions importants a les teves mans. Les seves regles de seguretat els obliguen a rebutjar peticions perjudicials, incloses les que impliquen un ús indegut en l'àmbit de la biologia o la ciberseguretat. Per a les tasques en què poden ajudar, les regles d'acció defineixen quan poden continuar, quan han de demanar confirmació i quan han de deixar un pas a les teves mans.

Dins d'aquests límits, els dots poden llegir la informació a la qual tenen permís per accedir, analitzar-la i preparar esborranys a les teves converses. Per enviar un missatge o compartir un fitxer, se'ls ensenya a demanar una autorització que inclogui la informació i el tipus de destinatari: com més sensibles són les dades, més concrets han de ser els destinataris. Per exemple, les dades de salut sempre requereixen que l'usuari indiqui un destinatari amb nom i cognoms («comparteix el meu historial mèdic amb el Dr. Thompson»). Per a les dades personals menys sensibles, com ara una adreça electrònica o un número de telèfon, per defecte cal que l'usuari especifiqui categories de destinataris («qualsevol companyia aèria»). L'usuari pot ampliar encara més les regles sobre dades personals menys sensibles («comparteix-les amb qualsevol formulari en línia») creant una regla personalitzada. Consulta la secció següent per obtenir més detalls sobre aquesta funció. Aquesta autorització continua vinculada a les teves instruccions per a la tasca; reprendre-la més endavant o delegar feina no n'amplia l'abast.

Els dots poden fer compres amb targetes que ja hagis desat al lloc web d'un comerç. Aquestes compres requereixen la teva aprovació.

Algunes accions requereixen la teva confirmació cada vegada, com ara suprimir dades definitivament, instal·lar o executar programari d'una font desconeguda o concedir nous accessos sensibles des del punt de vista de la seguretat. Aquests requisits et donen l'oportunitat de revisar canvis que podrien ser difícils de desfer o que podrien concedir un nou accés a algú.

En altres passos sensibles, com ara canviar una contrasenya o transferir diners entre comptes financers, els dots poden ajudar amb la resta de la tasca, però han de deixar aquests passos a les teves mans.

Defineix les teves preferències amb les regles personalitzades

Les regles personalitzades et permeten definir com t'ajuden els dots dins d'aquestes proteccions integrades; per exemple, indicant-los que no enviïn mai correus electrònics. També pots donar instruccions específiques per a una tasca, com ara demanar a un dot que avisi un company que ets fora sense compartir-ne el motiu personal. Aquestes instruccions continuen vigents quan el dot delega feina o treballa en segon pla.

Els dots et poden ajudar a redactar regles personalitzades, però necessiten la teva aprovació per modificar-les. Aquestes preferències funcionen dins dels límits integrats i no poden eliminar les confirmacions obligatòries, els passos que has de fer tu ni els requisits de seguretat fonamentals.

Regles personalitzades dins del marc d'un telèfon sobre el fons de pantalla dels dots.

Una comprovació independent abans que els dots actuïn

Abans que els dots facin accions com ara enviar correus electrònics o modificar fitxers, un sistema de seguretat independent anomenat revisió automàtica comprova que els passos previstos s'ajustin a les teves instruccions, les regles personalitzades i els requisits de seguretat. En el cas d'un correu electrònic, comprova el destinatari i el missatge per ajudar a detectar una adreça equivocada o informació que no volies compartir.

Si la revisió automàtica permet un pas, el dot que l'ha proposat l'executa amb l'eina adequada de l'ordinador o de l'aplicació i després utilitza el resultat per continuar la teva tasca. Pot basar-se en una aprovació que ja hagis donat si cobreix l'acció i les regles no requereixen una nova confirmació.

Si la revisió automàtica bloqueja un pas, impedeix que s'executi l'acció i n'indica el motiu al dot. El dot pot demanar més informació o la teva aprovació si això pot resoldre el bloqueig, i després tornar a enviar el pas a revisió. Segons el motiu, pot optar per provar una alternativa permesa, deixar un pas sensible a les teves mans o aturar-se. La teva aprovació no pot anul·lar els requisits de seguretat fonamentals.

Mantenim els controls que fan complir la revisió automàtica fora dels entorns que els dots poden modificar, de manera que no puguin canviar ni desactivar cap comprovació obligatòria. Els passos habituals de només lectura continuen subjectes als permisos de les aplicacions, les restriccions de les eines i altres salvaguardes, però no necessiten aquesta revisió addicional.

Quan la revisió automàtica permet una acció, el dot l'executa i en rep el resultat. Quan la bloqueja, n'indica el motiu al dot, que decideix si t'ha de consultar, provar una alternativa permesa, deixar el pas a les teves mans o aturar-se.

Quan la revisió automàtica permet una acció, el dot l'executa i en rep el resultat. Quan la bloqueja, n'indica el motiu al dot, que decideix si t'ha de consultar, provar una alternativa permesa, deixar el pas a les teves mans o aturar-se.

Més ajuda, amb el control a les teves mans

Confiar feina continuada als dots implica saber com seguiran les teves instruccions i com respondran quan passi alguna cosa inesperada. Astra els ajuda a entendre la teva intenció, mentre que les proteccions de les dades, els espais de treball, les credencials i les accions ajuden a limitar els danys derivats d'errors o de contingut maliciós. En conjunt, aquestes salvaguardes donen marge als dots per fer feina útil i redueixen la probabilitat que un error es converteixi en una acció o una divulgació no desitjada.

Tu tries a què es poden connectar els dots i com t'ajuden, i pots seguir-ne el progrés o canviar de rumb a mesura que canvien les teves necessitats. Les aprovacions i els passos que els dots deixen a les teves mans fan que les decisions clau continuïn sent teves. Els dots encara poden cometre errors, de manera que continuarem posant a prova i millorant les seves proteccions a mesura que aprenguem de l'ús real. El nostre objectiu és que et sigui més fàcil deixar feina als dots i trobar avenços útils quan hi tornis, amb les teves preferències orientant la tasca i les decisions importants encara a les teves mans.

Més informació

Llegeix la fitxa del model⁠(s'obre en una finestra nova) per obtenir més detalls sobre les nostres salvaguardes, les avaluacions de seguretat i les limitacions que encara hi ha.

Per conèixer els fonaments de seguretat de ChatGPT, consulta Seguretat i privadesa a OpenAI. Per aprofundir en una de les proteccions de seguretat web, consulta Com protegim les teves dades quan un agent d'IA fa clic en un enllaç.

Autor

OpenAI