Ingen oppbevaring av data gir kvalifiserte API-kunder et tydelig løfte: OpenAI oppbevarer ikke instruksjonene eller modellsvarene deres etter at en forespørsel er behandlet. Kundeinnhold er ikke tilgjengelig for gjennomgang av OpenAI-ansatte1, og data fra bedriftskunder brukes ikke til å trene modellene våre med mindre kundene uttrykkelig samtykker.
Når modeller utfører lengre og mer komplekse oppgaver, kan enkelte alvorlige risikoer først bli synlige på tvers av flere interaksjoner. Eksisterende ZDR-kompatible sikkerhetssystemer vurderer hver interaksjon separat. I dag forhåndsviser vi Privat sikkerhetsbehandling, som er utviklet for å identifisere mønstre på tvers av relaterte interaksjoner uten å gi OpenAI-ansatte tilgang til det underliggende innholdet.
Ved ZDR-implementeringer forblir kundeinnholdet i infrastruktur som kunden kontrollerer. Vi utvikler også et alternativ der innhold lagres i OpenAIs infrastruktur og krypteres med nøkler som kunden kontrollerer. I begge tilfeller kan automatiserte systemer identifisere mulig misbruk og returnere begrensede sikkerhetssignaler uten å vise de underliggende instruksjonene eller svarene til OpenAI-ansatte.
De mest alvorlige sikkerhetsrisikoene ved KI er ikke alltid synlige i én enkelt interaksjon. Potensielt skadelige hensikter blir ofte først tydelige når flere interaksjoner ses i sammenheng. Lignende risikoer kan oppstå når aktører med onde hensikter gjentatte ganger tester sikkerhetstiltak, koordinerer seg på tvers av kontoer eller kamuflerer trusler som rutinemessig forskning. Risikoer kan også utvikle seg i løpet av en agentstyrt oppgave – for eksempel hvis et system ikke lenger handler i tråd med brukerens hensikt og fortsetter etter å ha fått beskjed om å stoppe.
Når KI-systemer utfører lengre og mer komplekse oppgaver, blir denne bredere konteksten stadig viktigere for å skille legitim aktivitet fra misbruk og sikre at KI-agenter holder seg innenfor den tiltenkte myndigheten.
Ved enkelte nyere implementeringer av banebrytende modeller har kundene måttet tillate at KI-leverandøren oppbevarer sensitivt innhold for sikkerhetsovervåking. For mange organisasjoner strider slike krav mot sikkerhetsforpliktelsene deres eller løftene de har gitt menneskene de betjener.
Privat sikkerhetsbehandling er utviklet slik at vi fortsatt kan tilby ZDR.
Privat sikkerhetsbehandling bygger videre på den automatiserte beskyttelsen som allerede brukes i ZDR og andre implementeringer. Eksisterende ZDR-kompatible sikkerhetssystemer vurderer interaksjoner separat. Privat sikkerhetsbehandling utvider denne beskyttelsen til relaterte interaksjoner, slik at automatiserte systemer kan identifisere mønstre uten at OpenAI-ansatte får tilgang til oppbevart kundeinnhold.
Privat sikkerhetsbehandling bruker kundeinnhold uavhengig av hvor det lagres – enten i infrastruktur kunden kontrollerer (ZDR-implementeringer), eller i lagring levert av OpenAI. Ved lagring levert av OpenAI krypteres kundeinnholdet med nøkler som kunden kontrollerer. OpenAI-ansatte har ingen kopi av disse nøklene og kan derfor ikke få tilgang til det underliggende innholdet.
Når en risiko identifiseres, mottar OpenAI et snevert definert signal som angir hvilken type aktivitet det gjelder, tilsvarende det dagens sikkerhetssystemer gjør. Dette signalet kan brukes til å avgjøre om det er nødvendig å iverksette tiltak. OpenAI-ansatte får ikke tilgang til kundeinnholdet, selv når det flagges.
Kundene kan undersøke varsler og beslutninger om tiltak ved hjelp av informasjon som er tilgjengelig i deres egne systemer. Hvis de ønsker å klage, avklare legitim aktivitet eller støtte en undersøkelse av bekreftet misbruk, kan de velge å dele relevant informasjon med OpenAI.
Privat sikkerhetsbehandling testes for tiden med de første kundene. Vi deler denne forhåndsvisningen nå fordi kundene våre tydelig har sagt at de trenger forutsigbarhet om hvordan innholdet deres vil bli beskyttet etter hvert som KI-systemene blir mer avanserte.
Målet vårt er å sikre at kunstig generell intelligens kommer hele menneskeheten til gode. Samarbeid med kunder og partnere er avgjørende for hvordan vi utvikler effektive sikkerhetstiltak. Som prinsippene våre tydelig viser, kan ingen KI-laboratorier håndtere nye risikoer alene. Privat sikkerhetsbehandling gjenspeiler denne tilnærmingen og utformes i samarbeid med kunder på tvers av bransjer, regioner og virksomhetsstørrelser.
Organisasjonene vi samarbeider med, håndterer noe av den mest sensitive informasjonen i sine sektorer, blant annet finansopplysninger, helsedata, fortrolige forretningsplaner og egenutviklet forskning. Det er avgjørende å beskytte denne informasjonen for å oppfylle lovpålagte krav, bevare kundenes tillit og opprettholde konkurransefortrinnet deres.
Tilbakemeldingene deres hjelper oss med å utvikle sterkere sikkerhetstiltak, samtidig som de beholder kontrollen over informasjonen sin.
«Innføring av KI i virksomheter avhenger helt av at kundene har kontroll over dataene, uten direkte eller avledet bruk utover den valgte tjenesten. OpenAIs løfte om ikke å bruke data til trening og ZDR gir Glean trygghet til å bygge med OpenAI. Etter hvert som modellene blir mer avanserte, viser OpenAI at sikkerheten kan styrkes uten at det går på bekostning av personvernet og kontrollen som opprettholder virksomhetenes tillit.»
– Sunil Agrawal, informasjonssikkerhetsdirektør i Glean
Vi vil fortsette samarbeidet med kundene om de tekniske og driftsmessige detaljene i tilnærmingen vår. Vi planlegger å begynne utrullingen av Privat sikkerhetsbehandling og publisere en teknisk hvitbok i september. Vi vil holde kundene orientert hele veien ved å dele oppdateringer tidlig, forklare hva de betyr for eksisterende forpliktelser og gi kundene tiden og støtten de trenger for å planlegge fremover.
Forfatter
- 1
I likhet med andre leverandører av banebrytende modeller er OpenAI lovpålagt(åpnes i et nytt vindu) å rapportere tilsynelatende materiale som viser seksuelle overgrep mot barn (CSAM). Bilder som flagges som mulig CSAM, vil fortsatt bli oppbevart for manuell gjennomgang og rapportering, også ved implementeringer med ingen oppbevaring av data, slik de blir i dag.


