Nulové uchovávanie údajov pre prelomové modely
Predstavujeme súkromné bezpečnostné spracovanie, ktoré posilňuje ochranu naprieč interakciami a zostáva kompatibilné so ZDR.
Nulové uchovávanie údajov dáva oprávneným zákazníkom API jasný prísľub: OpenAI po spracovaní požiadavky neuchováva ich pokyny ani odpovede modelu. Pracovníci OpenAI nemajú prístup k obsahu zákazníkov na účely kontroly1 a údaje podnikových zákazníkov nepoužívame na trénovanie našich modelov, pokiaľ s tým zákazníci výslovne nesúhlasia.
Keď modely vykonávajú dlhšie a zložitejšie úlohy, niektoré závažné riziká sa môžu prejaviť až v priebehu viacerých interakcií. Existujúce bezpečnostné systémy kompatibilné so ZDR vyhodnocujú každú interakciu samostatne. Dnes predstavujeme ukážku súkromného bezpečnostného spracovania, ktoré má odhaľovať vzorce v súvisiacich interakciách bez toho, aby pracovníci OpenAI získali prístup k ich obsahu.
Pri nasadeniach ZDR zostáva obsah zákazníka v infraštruktúre, ktorú riadi zákazník. Vyvíjame aj možnosť ukladať obsah v infraštruktúre OpenAI a šifrovať ho kľúčmi, ktoré má pod kontrolou zákazník. V oboch prípadoch môžu automatizované systémy odhaliť možné zneužitie a poskytnúť obmedzené bezpečnostné signály bez sprístupnenia príslušných pokynov či odpovedí pracovníkom OpenAI.
Najzávažnejšie bezpečnostné riziká AI sa nie vždy prejavia počas jedinej interakcie. Potenciálne škodlivé úmysly sú často zrejmé až pri spoločnom posúdení viacerých interakcií. Podobné riziká môžu vzniknúť, keď sa škodliví aktéri opakovane pokúšajú prekonať ochranné mechanizmy, koordinujú činnosť medzi účtami alebo vydávajú hrozby za bežný výskum. Riziká sa môžu rozvinúť aj počas úlohy vykonávanej agentom – napríklad ak systém prestane konať v súlade so zámerom používateľa a pokračuje aj po výzve, aby prestal.
Keď systémy AI vykonávajú dlhšie a zložitejšie úlohy, tento širší kontext je čoraz dôležitejší na rozlíšenie oprávnenej činnosti od zneužitia a na zabezpečenie toho, aby agenti AI neprekračovali rámec svojich právomocí.
Pri niektorých nedávnych nasadeniach prelomových modelov museli zákazníci povoliť poskytovateľovi AI uchovávanie citlivého obsahu na účely monitorovania bezpečnosti. V prípade mnohých organizácií sú takéto požiadavky v rozpore s ich bezpečnostnými povinnosťami alebo záväzkami voči ľuďom, ktorým poskytujú služby.
Súkromné bezpečnostné spracovanie je navrhnuté tak, aby sme mohli ZDR ponúkať aj naďalej.
Súkromné bezpečnostné spracovanie vychádza z automatizovaných ochranných mechanizmov, ktoré sa už používajú pri ZDR a ďalších nasadeniach. Existujúce bezpečnostné systémy kompatibilné so ZDR vyhodnocujú interakcie samostatne. Súkromné bezpečnostné spracovanie rozširuje tieto ochranné mechanizmy na súvisiace interakcie, vďaka čomu môžu automatizované systémy odhaľovať vzorce bez toho, aby pracovníci OpenAI získali prístup k uchovávanému obsahu zákazníkov.
Súkromné bezpečnostné spracovanie využíva obsah zákazníka bez ohľadu na miesto jeho uloženia – či už v infraštruktúre riadenej zákazníkom (nasadenia ZDR), alebo v úložisku poskytovanom OpenAI. V úložisku poskytovanom OpenAI sa obsah zákazníka šifruje kľúčmi, ktoré má pod kontrolou zákazník. Pracovníci OpenAI nemajú kópiu týchto kľúčov, takže k príslušnému obsahu nemajú prístup.
Keď systém odhalí riziko, OpenAI dostane úzko vymedzený signál označujúci typ príslušnej aktivity, podobne ako pri našich súčasných bezpečnostných systémoch. Tento signál možno použiť na určenie, či sú potrebné donucovacie opatrenia. Pracovníci OpenAI nezískajú prístup k obsahu zákazníka ani po jeho označení.
Zákazníci môžu upozornenia a rozhodnutia o donucovacích opatreniach preskúmať pomocou informácií dostupných vo vlastných systémoch. Ak sa chcú odvolať, objasniť oprávnenú činnosť alebo podporiť vyšetrovanie potvrdeného zneužitia, môžu sa rozhodnúť zdieľať príslušné informácie s OpenAI.
Súkromné bezpečnostné spracovanie momentálne testujeme s prvými zákazníkmi. Túto ukážku zverejňujeme už teraz, pretože naši zákazníci jasne vyjadrili potrebu vedieť, ako bude ich obsah chránený s rastúcimi schopnosťami systémov AI.
Naším poslaním je zabezpečiť, aby všeobecná umelá inteligencia prinášala úžitok celému ľudstvu. Spolupráca so zákazníkmi a partnermi je kľúčová pri vytváraní účinných ochranných mechanizmov. Ako jasne uvádzajú naše zásady, žiadne laboratórium AI nedokáže riešiť vznikajúce riziká samo. Súkromné bezpečnostné spracovanie odráža tento prístup a pomáhajú ho formovať zákazníci z rôznych odvetví, regiónov a spoločností všetkých veľkostí.
Organizácie, s ktorými spolupracujeme, spracúvajú jedny z najcitlivejších informácií vo svojich odvetviach vrátane finančných záznamov, zdravotných údajov, dôverných obchodných plánov a chráneného výskumu. Ochrana týchto informácií je nevyhnutná na plnenie regulačných povinností, udržanie dôvery zákazníkov a zachovanie ich konkurenčnej výhody.
Ich spätná väzba nám pomáha vytvárať účinnejšie ochranné mechanizmy a zároveň ponechať ich údaje pod ich kontrolou.
„Zavádzanie AI v podnikoch závisí výlučne od toho, či majú zákazníci kontrolu nad svojimi údajmi a či sa tieto údaje priamo ani odvodene nepoužívajú nad rámec zvolenej služby. Záväzok OpenAI nepoužívať údaje na trénovanie a podpora ZDR dávajú spoločnosti Glean istotu pri vývoji s OpenAI. S rastúcimi schopnosťami modelov OpenAI ukazuje, že bezpečnosť môže napredovať bez ohrozenia súkromia a kontroly, na ktorých stojí dôvera podnikov.“
—Sunil Agrawal, riaditeľ informačnej bezpečnosti, Glean
So zákazníkmi budeme naďalej spolupracovať na technických a prevádzkových podrobnostiach nášho prístupu. Súkromné bezpečnostné spracovanie plánujeme začať zavádzať v septembri, keď zároveň zverejníme technickú správu. Zákazníkov budeme priebežne informovať o každom kroku: novinky im oznámime včas, vysvetlíme ich vplyv na existujúce záväzky a poskytneme im čas a podporu potrebné na plánovanie.
Autor
- 1
Rovnako ako iní poskytovatelia prelomových modelov má OpenAI zákonnú povinnosť(otvorí sa v novom okne) nahlasovať zjavný materiál zobrazujúci sexuálne zneužívanie detí (CSAM / materiál zobrazujúci sexuálne zneužívanie detí)). Obrázky označené ako potenciálny CSAM / materiál zobrazujúci sexuálne zneužívanie detí) sa budú naďalej uchovávať na účely manuálnej kontroly a nahlásenia, a to aj pri nasadeniach s nulovým uchovávaním údajov, rovnako ako dnes.


