Sari la conținutul principal
OpenAI

29 septembrie 2026

SiguranțăSecuritate

Cum integrăm siguranța, securitatea și confidențialitatea în agenți dot

Pe măsură ce agenții tăi dot preiau mai multe activități, te ajutăm să îți protejezi informațiile și să păstrezi deciziile importante în mâinile tale.

Se încarcă…

Agenții dot sunt agenți mereu activi, care preiau responsabilități pe termen lung, lăsându-ți mai mult timp și atenție pentru lucrurile care contează pentru tine. Fiecare agent dot are propriul computer și lucrează în aplicațiile pe care alegi să le conectezi. Tu le stabilești obiective agenților dot și definești ce pot face pe cont propriu. Aceștia pot parcurge pașii necesari, se pot adapta la schimbări și pot continua să avanseze între conversații. Pot urmări un subiect de actualitate în evoluție și pregăti o ciornă de buletin informativ sau pot ajuta la actualizarea unui proiect pe măsură ce apar informații noi — prezentându-ți rezultatele pentru verificare și apelând la tine pentru deciziile care necesită judecata ta.

A le oferi agenților dot această responsabilitate înseamnă a le încredința mai multe informații și mai mult din munca ta. Este important să înțelegi la ce are acces fiecare agent dot, cum folosește acel acces și când trebuie să te implice. Aceste întrebări contează, deoarece greșelile unui agent pot avea consecințe dincolo de conversație: dacă înțelege greșit o cerere, ar putea modifica alt fișier decât cel dorit sau ar putea distribui informații pe care voiai să le păstrezi private.

Integrăm măsuri de protecție în fiecare parte a acestei activități. Pornim de la GPT‑6 Astra, pe care îl antrenăm să îți înțeleagă intenția și să respecte regulile de siguranță, apoi adăugăm măsuri de protecție pentru informațiile folosite de agenții dot, mediile în care lucrează și acțiunile pe care plănuiesc să le execute. Un spațiu de lucru protejat în cloud ajută la limitarea efectelor greșelilor, fluxurile de autentificare securizată ajută la protejarea datelor sensibile de autentificare, iar verificările separate ale acțiunilor ajută la identificarea pașilor care nu respectă instrucțiunile tale sau cerințele de siguranță. Tu alegi ce să conectezi, îți stabilești preferințele și urmărești sau redirecționezi activitatea pe parcurs.

Agenții dot pot face în continuare greșeli, iar noi vom îmbunătăți aceste măsuri de protecție pe măsură ce învățăm din utilizarea lor în practică. Aici explicăm cum funcționează împreună măsurile de protecție, ce poți controla și ce limite au în continuare — pentru ca tu să poți decide în cunoștință de cauză ce activități le încredințezi agenților dot.

Un model creat să înțeleagă ce vrei să spui

Agenții dot sunt bazați pe GPT‑6 Astra, modelul nostru cel mai capabil și cel mai bine aliniat la intențiile umane. Astra excelează în a-ți înțelege obiectivul, a se încadra în limitele cererii tale și a pune întrebări punctuale atunci când răspunsurile ar putea schimba ceea ce ar trebui să facă. Aceste capacități îi ajută pe agenții dot să se ocupe de sarcini în timp, fără să piardă din vedere intenția ta.

Am antrenat Astra să refuze cererile dăunătoare, inclusiv pe cele care implică utilizări abuzive în domeniul biologic sau al securității cibernetice. Testăm modul în care agenții dot gestionează instrucțiunile în schimbare, cererile ambigue și încercările de a-i determina să depășească permisiunile acordate de tine. Testarea de tip red teaming, efectuată atât de oameni, cât și automat, ne ajută să găsim puncte slabe, să îmbunătățim modelul și sistemele din jurul său și să testăm din nou modificările.

Securitate pentru agenții care pot acționa

Completăm măsurile de protecție ale modelului cu protecțiile de securitate din ChatGPT și cu măsuri suplimentare pentru agenții care pot continua să lucreze în numele tău.

Protecțiile integrate în ChatGPT includ criptarea conținutului tău atât în timpul stocării, cât și în timpul transferului între tine, OpenAI și furnizorii noștri de servicii, alături de controale de acces care ajută la protejarea informațiilor stocate. Sistemele noastre de securitate a conturilor caută și semne de utilizare suspectă a contului tău OpenAI și pot solicita o nouă autentificare dacă o sesiune pare compromisă.

Agenții au nevoie și de protecție împotriva riscurilor din informațiile pe care le întâlnesc în timpul activității. O pagină web, un e-mail sau un document poate conține instrucțiuni rău intenționate care încearcă să îi redirecționeze sau să îi determine să divulge informații private — o problemă numită injectare prompt. Combinăm măsurile de protecție ale modelului cu restricții asupra instrumentelor, verificări înainte de acțiuni și monitorizare, pentru a împiedica un astfel de conținut să ducă la o acțiune nedorită.

De asemenea, monitorizăm agenții dot în timp ce planifică și execută acțiuni, căutând comportamente potențial dăunătoare, cum ar fi nerespectarea instrucțiunilor tale sau încercarea de a ocoli măsurile de protecție. Dacă sistemul de monitorizare a siguranței semnalează o problemă în activitatea curentă a unui agent dot, poate suspenda acea activitate și îți poate afișa un avertisment de analizat. Această monitorizare este integrată și ajută la detectarea problemelor pe parcursul unei sarcini, alături de protecțiile care limitează ce pot accesa și ce pot face agenții dot.

Un spațiu de lucru protejat pentru fiecare agent dot

Fiecare agent dot are propriul computer în cloud, unde poate naviga pe web, analiza informații, crea fișiere și rula instrumente. Agenții dot pot continua să avanseze în aceste spații de lucru chiar și atunci când nu participi activ.

Tu alegi ce conturi pot folosi agenții dot, fie conectând aplicații în limitele permisiunilor acordate ChatGPT, fie autentificându-te pe un site în browserul unui agent dot, prin autentificare securizată acolo unde aceasta este acceptată. Poți alege și să îți conectezi computerul personal, pentru a le oferi agenților dot mai multe modalități de a te ajuta — de exemplu, analizând o foaie de calcul salvată pe desktop sau folosind instrumente de programare instalate pe dispozitivul tău.

În spațiul de lucru protejat al fiecărui agent dot, izolarea într-un mediu de tip sandbox restricționează codul și instrumentele pe care agentul le poate accesa, contribuind la limitarea impactului codului dăunător sau al unei comenzi greșite. De asemenea, izolăm mediile cloud ale utilizatorilor unele de altele și asigurăm mentenanța sistemului de operare Linux și a browserului Chrome pe care acestea se bazează.

Agenții dot rulează cod în medii separate de sistemele care le coordonează activitatea și impun măsurile esențiale de protecție. Pot crea fișiere și rula instrumente în aceste medii, dar nu pot folosi acel acces pentru a modifica sistemele de siguranță sau pentru a dezactiva verificările obligatorii. Această separare ajută la menținerea măsurilor de protecție chiar dacă un agent dot face o greșeală.

Regulile de acțiune descrise mai jos stabilesc ce pot face agenții dot folosind accesul acordat.

Spațiul de lucru din cloud al fiecărui agent dot reunește computerul său și instrumentele pe care le poate folosi. Tu alegi ce aplicații să conectezi și dacă să îți conectezi computerul personal. Revizuirea automată examinează acțiunile care necesită verificare înainte de a fi executate. Dacă blochează un pas, îi comunică motivul agentului dot, pentru ca acesta să poată decide ce să facă în continuare.

Spațiul de lucru din cloud al fiecărui agent dot reunește computerul său și instrumentele pe care le poate folosi. Tu alegi ce aplicații să conectezi și dacă să îți conectezi computerul personal. Revizuirea automată examinează acțiunile care necesită verificare înainte de a fi executate. Dacă blochează un pas, îi comunică motivul agentului dot, pentru ca acesta să poată decide ce să facă în continuare.

Autentificări securizate

Autentificarea securizată le permite agenților dot să lucreze în conturi fără ca parolele să intre în conversație. Pentru autentificările compatibile, modelul este pus pe pauză cât timp completezi un formular de autentificare securizat. Acesta trimite datele tale de autentificare direct către mediul browserului și le transmite pentru autentificare fără a le expune în contextul modelului. Agentul dot își reia apoi activitatea în contul în care te-ai autentificat. Păstrarea parolei în afara conversației reduce riscul ca aceasta să apară într-un răspuns sau să fie divulgată din greșeală.

Fluxurile compatibile care folosesc parole salvate mențin această separare printr-un serviciu dedicat, care gestionează datele de autentificare în formă criptată. Serviciul furnizează parola pentru autentificare fără a o transmite modelului, astfel încât agenții dot să poată lucra în conturile pe care le-ai autorizat, iar parolele să rămână în afara contextului modelului. Aceste protecții sunt specifice fluxurilor de autentificare securizată și celor care folosesc parole salvate; o informație secretă introdusă separat într-un mesaj sau document care poate fi citit poate rămâne vizibilă pentru model.

Autentificare securizată afișată într-un panou flotant pe fundalul agenților dot.

Controlează-ți informațiile și urmărește activitatea

Gestionezi aplicațiile pe care le pot folosi agenții dot prin conexiunile și permisiunile tale existente în ChatGPT, care sunt comune pentru ChatGPT, ChatGPT Work și Codex. În secțiunea Pluginuri din Setări, poți verifica conturile conectate și poți modifica ceea ce agenții dot vor putea accesa de acum înainte. Deconectarea unei aplicații oprește partajarea de informații noi prin acea conexiune. Însă informațiile pe care un agent dot le-a aflat deja rămân în contextul său. Aceste permisiuni reglementează accesul la aplicațiile tale; ele nu anulează cerințele obligatorii de siguranță.

Dacă vrei ca agenții dot să lucreze cu fișiere sau instrumente locale, poți alege și să îți conectezi computerul. Această conexiune rămâne supusă restricțiilor mediului sandbox local și verificărilor aplicabile acțiunilor. Folosirea microfonului sau a camerei computerului necesită și permisiunile dispozitivului, pe care poți alege să le acorzi ChatGPT.

Permisiunile aplicațiilor afișate într-o machetă de telefon pe fundalul agenților dot.

Vizualizarea activității din aplicația desktop îți permite să urmărești și să ghidezi activitatea în desfășurare. Aceasta afișează sarcinile în desfășurare și pe cele delegate, împreună cu starea lor. Poți adăuga context, corecta o neînțelegere, schimba direcția sau cere unui agent dot să se oprească.

Vizualizarea activității afișată într-o captură de ecran desktop flotantă, cu colțuri rotunjite, pe fundalul agenților dot.

Agenții dot acumulează context în timp, pentru a-ți oferi un ajutor mai util. Când deleagă activități, ceilalți agenți primesc instrucțiuni să păstreze informațiile necesare sarcinii și să evite reținerea detaliilor sensibile care nu sunt necesare. Fiecare agent dot are propriul context, pe care îl poți reseta oricând.

Pentru spațiile de lucru ChatGPT Business, Enterprise și Edu, în mod implicit nu folosim datele tale pentru a ne antrena modelele. Pentru planurile personale ChatGPT, tu controlezi dacă sunt folosite conversațiile cu agenții tăi dot și activitățile pe care le desfășoară pentru a ne îmbunătăți modelele, prin setarea „Îmbunătățește modelul pentru toată lumea”. Când antrenarea modelelor este activată, aceasta poate include acțiunile agenților dot și automatizările pe care le configurezi, după ce luăm măsuri pentru a elimina elementele de identificare personală. Poți afla mai multe despre cum sunt folosite datele tale în acest articol⁠(se deschide într-o fereastră nouă) din centrul nostru de ajutor.

Agenții dot caută mereu modalități de a te ajuta

Pe lângă activitățile pe care le ceri, agenții dot pot iniția sarcini de cercetare în fundal pentru a căuta alte modalități de a te ajuta — de exemplu, observând o schimbare în planurile tale de călătorie. Numim acest lucru cercetare proactivă.

Aceste sarcini se desfășoară în mediul cloud al fiecărui agent dot. Ele folosesc instrumente doar pentru citire ca să adune informații din sursele conectate pentru care există permisiune, apoi salvează note private pentru agentul dot respectiv. Impunem aceste limite prin cod: sarcinile de cercetare nu pot trimite direct mesaje altor persoane, nu pot modifica conținutul din aplicațiile conectate și nu pot controla un browser sau un desktop. Agenții dot pot folosi rezultatele pentru a decide cum să ajute, dar orice acțiune ulterioară trebuie să respecte regulile și verificările obișnuite.

Cercetarea proactivă se desfășoară ca sarcină în fundal, în mediul cloud al fiecărui agent dot. Aceasta citește sursele conectate pentru care există permisiune și îi transmite note private agentului dot, care decide cum să ajute. Orice acțiune ulterioară respectă regulile și verificările obișnuite.

Cercetarea proactivă se desfășoară ca sarcină în fundal, în mediul cloud al fiecărui agent dot. Aceasta citește sursele conectate pentru care există permisiune și îi transmite note private agentului dot, care decide cum să ajute. Orice acțiune ulterioară respectă regulile și verificările obișnuite.

Nu ne antrenăm modelele direct pe firele de cercetare din fundal sau pe notele pe care acestea le produc. Însă un agent dot poate primi note din sarcina sa de cercetare în fundal sau poate citi părți din firele sale de cercetare. Informațiile introduse astfel într-o conversație sau sarcină eligibilă pot fi folosite pentru antrenarea modelelor, în funcție de setările tale. De exemplu, o sarcină de cercetare în fundal ar putea aduna informații despre mai multe destinații pentru o viitoare călătorie în Europa. Acel fir de cercetare și notele sale nu sunt folosite direct pentru antrenare. Mai târziu, când îi ceri agentului tău dot să te ajute să planifici o călătorie la Lisabona, acesta ar putea citi o notă despre Lisabona din sarcina sa de cercetare în fundal. Nota respectivă devine parte din contextul conversației de planificare a călătoriei și poate fi apoi folosită pentru antrenare, în funcție de setările tale. Restul cercetării din fundal nu este folosit pentru antrenare decât dacă este introdus, la rândul său, într-o conversație sau sarcină eligibilă.

Reguli clare pentru acțiuni

Agenții dot respectă limite de siguranță integrate, concepute să prevină daunele și să lase în mâinile tale deciziile cu consecințe importante. Regulile lor de siguranță le impun să refuze cererile dăunătoare, inclusiv utilizările abuzive în domeniul biologic sau al securității cibernetice. Pentru sarcinile la care pot ajuta, regulile de acțiune stabilesc când pot continua, când trebuie să ceară confirmare și când trebuie să îți lase ție un anumit pas.

În aceste limite, agenții dot pot citi informațiile pe care au permisiunea să le acceseze, le pot analiza și pot pregăti ciorne în conversațiile tale. Pentru a trimite un mesaj sau a partaja un fișier, sunt instruiți să ceară o autorizare care să acopere informațiile și tipul de destinatar — cu cât datele sunt mai sensibile, cu atât destinatarii trebuie precizați mai exact. De exemplu, pentru datele privind sănătatea, utilizatorul va trebui întotdeauna să indice un destinatar anume („trimite istoricul meu medical doctorului Thompson”). Pentru datele personale mai puțin sensibile, cum ar fi o adresă de e-mail sau un număr de telefon, utilizatorul va trebui, în mod implicit, să specifice categorii de destinatari („orice companie aeriană”). Utilizatorul poate extinde regulile pentru datele personale mai puțin sensibile („transmite-le prin orice formular online”) creând o Regulă personalizată — vezi secțiunea următoare pentru mai multe detalii despre această funcție. Acea autorizare rămâne legată de instrucțiunile tale pentru sarcina respectivă; reluarea ulterioară sau delegarea activității nu îi extinde limitele.

Agenții dot pot face cumpărături folosind cardurile pe care le-ai salvat deja pe site-ul unui comerciant. Aceste cumpărături necesită aprobarea ta.

Unele acțiuni necesită confirmarea ta de fiecare dată, inclusiv ștergerea definitivă a datelor, instalarea sau rularea de software dintr-o sursă nerecunoscută ori acordarea unor noi drepturi de acces sensibile din perspectiva securității. Aceste cerințe îți oferă ocazia de a verifica modificările care ar putea fi greu de anulat sau care ar acorda cuiva noi drepturi de acces.

În cazul altor pași sensibili, inclusiv schimbarea unei parole sau transferul de bani între conturi financiare, agenții dot pot ajuta cu restul sarcinii, dar trebuie să îți lase ție pașii sensibili.

Stabilește-ți preferințele cu Reguli personalizate

Regulile personalizate îți permit să stabilești cum te ajută agenții dot, în limitele protecțiilor integrate — de exemplu, spunându-le să nu trimită niciodată e-mailuri. Poți da și indicații specifice unei sarcini, cum ar fi să îi ceri unui agent dot să anunțe un coleg că lipsești, fără a divulga motivul personal. Aceste instrucțiuni continuă să se aplice când agentul dot respectiv deleagă activități sau lucrează în fundal.

Agenții dot te pot ajuta să redactezi Reguli personalizate, dar au nevoie de aprobarea ta pentru a le modifica. Aceste preferințe se aplică în limitele de siguranță integrate și nu pot elimina confirmările obligatorii, pașii care trebuie lăsați în seama ta sau cerințele fundamentale de siguranță.

Reguli personalizate afișate într-o machetă de telefon pe fundalul agenților dot.

O verificare separată înainte ca agenții dot să acționeze

Înainte ca agenții dot să execute acțiuni precum trimiterea de e-mailuri sau modificarea fișierelor, un sistem de siguranță separat, numit Revizuirea automată, verifică dacă pașii planificați respectă instrucțiunile tale, Regulile personalizate și cerințele de siguranță. În cazul unui e-mail, verifică destinatarul și mesajul pentru a ajuta la identificarea unei adrese greșite sau a informațiilor pe care nu intenționai să le divulgi.

Dacă Revizuirea automată permite un pas, agentul dot care l-a propus îl execută folosind instrumentul adecvat de pe computer sau din aplicație, apoi folosește rezultatul pentru a continua sarcina ta. Se poate baza pe o aprobare pe care ai dat-o deja, dacă aceasta acoperă acțiunea și regulile nu cer o nouă confirmare.

Dacă Revizuirea automată blochează un pas, împiedică executarea acțiunii și îi comunică motivul agentului dot. Agentul dot poate cere mai multe informații sau aprobarea ta, dacă acest lucru ar putea înlătura blocajul, apoi poate trimite din nou pasul spre verificare. În funcție de motiv, poate în schimb să încerce o alternativă permisă, să îți lase ție un pas sensibil sau să se oprească. Aprobarea ta nu poate anula cerințele fundamentale de siguranță.

Păstrăm mecanismele care impun Revizuirea automată în afara mediilor pe care agenții dot le pot modifica, astfel încât aceștia să nu poată schimba sau dezactiva o verificare obligatorie. Pașii obișnuiți care presupun doar citire respectă în continuare permisiunile aplicațiilor, restricțiile instrumentelor și celelalte măsuri de protecție, dar nu au nevoie de această verificare suplimentară.

Când Revizuirea automată permite o acțiune, agentul dot o execută și primește rezultatul. Când blochează o acțiune, îi transmite agentului dot motivul, iar acesta decide dacă să te întrebe, să încerce o alternativă permisă, să îți lase ție pasul respectiv sau să se oprească.

Când Revizuirea automată permite o acțiune, agentul dot o execută și primește rezultatul. Când blochează o acțiune, îi transmite agentului dot motivul, iar acesta decide dacă să te întrebe, să încerce o alternativă permisă, să îți lase ție pasul respectiv sau să se oprească.

Mai mult ajutor, cu controlul în mâinile tale

A le încredința agenților dot activități pe termen lung înseamnă să știi cum îți vor urma instrucțiunile și cum vor reacționa când apare ceva neașteptat. Astra îi ajută să îți înțeleagă intenția, iar protecțiile pentru datele, spațiile de lucru, datele de autentificare și acțiunile lor contribuie la limitarea daunelor provocate de greșeli sau de conținut rău intenționat. Împreună, aceste măsuri de protecție le oferă agenților dot libertatea de a face lucruri utile, reducând în același timp riscul ca o eroare să ducă la o acțiune sau o divulgare nedorită.

Tu alegi la ce se pot conecta agenții dot și cum te ajută, iar pe măsură ce nevoile tale se schimbă, le poți urmări progresul sau le poți schimba direcția. Aprobările și pașii lăsați în seama ta păstrează deciziile esențiale în mâinile tale. Agenții dot pot face în continuare greșeli, așa că vom continua să le testăm și să le îmbunătățim protecțiile pe măsură ce învățăm din utilizarea lor în practică. Scopul nostru este să îți fie mai ușor să le lași agenților dot o sarcină și să revii la progrese utile, cu preferințele tale ghidând activitatea și cu deciziile importante rămânând în mâinile tale.

Află mai multe

Citește fișa de sistem⁠(se deschide într-o fereastră nouă) pentru mai multe detalii despre măsurile noastre de protecție, evaluările de siguranță și limitările rămase.

Pentru fundamentele de securitate pe care se bazează ChatGPT, consultă Securitate și confidențialitate la OpenAI. Pentru o privire mai atentă asupra unei măsuri de securitate web, consultă Cum îți protejăm datele când un agent AI face clic pe un link.

Autor

OpenAI