Opțiunea zero date păstrate le oferă clienților API eligibili o promisiune clară: OpenAI nu le păstrează solicitările sau răspunsurile modelului după procesarea unei cereri. Conținutul clienților nu este disponibil personalului OpenAI pentru verificare1, iar datele clienților corporativi nu sunt folosite pentru instruirea modelelor noastre decât dacă aceștia optează explicit pentru acest lucru.
Pe măsură ce modelele preiau sarcini mai lungi și mai complexe, unele riscuri grave pot deveni vizibile doar în cadrul mai multor interacțiuni. Sistemele de siguranță existente, compatibile cu ZDR, evaluează separat fiecare interacțiune. Astăzi prezentăm în avanpremieră Procesarea privată pentru siguranță, concepută să identifice tipare în interacțiunile corelate fără a oferi personalului OpenAI acces la conținutul subiacent.
În implementările ZDR, conținutul clienților rămâne în infrastructura controlată de aceștia. Dezvoltăm și o opțiune prin care conținutul este stocat în infrastructura OpenAI și criptat cu chei controlate de client. În ambele cazuri, sistemele automate pot identifica potențiale utilizări abuzive și pot transmite semnale de siguranță limitate, fără a-i dezvălui personalului OpenAI solicitările sau răspunsurile subiacente.
Cele mai grave riscuri pentru siguranța IA nu sunt întotdeauna vizibile într-o singură interacțiune. Adesea, intențiile potențial dăunătoare devin clare doar atunci când mai multe interacțiuni sunt analizate împreună. Riscuri similare pot apărea atunci când actorii rău intenționați testează în mod repetat măsurile de protecție, se coordonează prin mai multe conturi sau deghizează amenințările drept cercetări obișnuite. Riscurile pot apărea și pe parcursul unei sarcini executate de un agent, de exemplu, dacă un sistem nu mai acționează conform intenției utilizatorului și continuă după ce i s-a cerut să se oprească.
Pe măsură ce sistemele IA preiau sarcini mai lungi și mai complexe, acest context mai larg devine tot mai important pentru a distinge activitatea legitimă de utilizarea abuzivă și pentru a garanta că agenții IA rămân în limitele autorității care le-a fost acordată.
Unele implementări recente de modele de vârf le-au impus clienților să-i permită furnizorului lor de IA să păstreze conținut confidențial pentru monitorizarea siguranței. Pentru multe organizații, asemenea cerințe intră în conflict cu obligațiile lor de securitate sau cu angajamentele față de persoanele pe care le deservesc.
Procesarea privată pentru siguranță este concepută astfel încât să putem oferi în continuare ZDR.
Procesarea privată pentru siguranță are la bază măsurile automate de protecție utilizate deja în implementările ZDR și în alte implementări. Sistemele de siguranță existente, compatibile cu ZDR, evaluează interacțiunile separat. Procesarea privată pentru siguranță extinde aceste măsuri de protecție asupra interacțiunilor asociate, permițând sistemelor automate să identifice tipare fără ca personalul OpenAI să aibă acces la conținutul păstrat al clienților.
Procesarea privată pentru siguranță utilizează conținutul clienților indiferent unde este stocat: fie în infrastructura controlată de clienți (implementări ZDR), fie în spațiul de stocare oferit de OpenAI. Când este folosit spațiul de stocare oferit de OpenAI, conținutul clienților este criptat cu chei controlate de client. Personalul OpenAI nu deține o copie a acestor chei, deci nu poate accesa conținutul subiacent.
Când este identificat un risc, OpenAI primește un semnal strict definit, care indică tipul activității implicate, similar semnalelor folosite în prezent de sistemele noastre de siguranță. Acest semnal poate fi utilizat pentru a stabili dacă sunt necesare măsuri de aplicare a regulilor. Personalul OpenAI nu primește acces la conținutul clientului nici măcar atunci când acesta este semnalat.
Clienții pot investiga alertele și deciziile privind aplicarea regulilor folosind informațiile disponibile în propriile lor sisteme. Dacă doresc să conteste o decizie, să clarifice o activitate legitimă sau să sprijine investigarea unui abuz confirmat, pot alege să transmită informațiile relevante către OpenAI.
Procesarea privată pentru siguranță este testată în prezent împreună cu primii clienți. Prezentăm acum această avanpremieră deoarece clienții ne-au transmis foarte clar că au nevoie de predictibilitate privind modul în care le va fi protejat conținutul pe măsură ce sistemele IA devin mai capabile.
Misiunea noastră este să ne asigurăm că inteligența generală artificială îi va aduce beneficii întregii omeniri. Colaborarea cu clienții și partenerii este esențială pentru modul în care construim măsuri de protecție eficiente. Așa cum arată clar principiile noastre, niciun laborator de IA nu poate aborda singur riscurile emergente. Procesarea privată pentru siguranță reflectă această abordare și este definită cu ajutorul clienților din diverse domenii, regiuni și companii de diferite dimensiuni.
Organizațiile cu care colaborăm gestionează unele dintre cele mai sensibile informații din sectoarele lor, inclusiv evidențe financiare, date medicale, planuri de afaceri confidențiale și cercetări proprietare. Protejarea acestor informații este esențială pentru respectarea obligațiilor de reglementare, menținerea încrederii clienților și păstrarea avantajului lor competitiv.
Feedbackul lor ne ajută să construim măsuri de protecție mai solide, păstrând în același timp informațiile sub controlul lor.
„Adoptarea IA în companii depinde în totalitate de controlul clienților asupra datelor, fără utilizarea lor directă sau derivată în afara serviciului ales. Angajamentul OpenAI de a nu folosi datele pentru instruire și ZDR îi oferă companiei Glean încrederea necesară pentru a dezvolta cu OpenAI. Pe măsură ce modelele devin mai capabile, OpenAI demonstrează că siguranța poate progresa fără a compromite confidențialitatea și controlul care determină încrederea companiilor.”
—Sunil Agrawal, director pentru securitatea informațiilor, Glean
Vom continua să colaborăm cu clienții în privința detaliilor tehnice și operaționale ale abordării noastre. Intenționăm să începem lansarea Procesării private pentru siguranță și să publicăm o documentație tehnică în luna septembrie. Vom informa clienții la fiecare pas, publicând din timp noutățile, explicând ce înseamnă acestea pentru angajamentele existente și oferindu-le timpul și sprijinul necesare pentru a-și face planuri.
Autor
- 1
La fel ca alți furnizori de modele de vârf, OpenAI este obligată prin lege(se deschide într-o fereastră nouă) să raporteze materialele care par să conțină abuzuri sexuale asupra copiilor (CSAM). Imaginile semnalate cu potențial CSAM vor fi păstrate în continuare pentru verificare manuală și raportare, inclusiv în implementările cu zero date păstrate, la fel ca și în prezent.


