Нулево задържане на данни за авангардни модели
Представяме „Поверителна обработка за безопасност“, която укрепва защитите при множество взаимодействия и остава съвместима със ZDR.
Нулевото задържане на данни дава ясно обещание на отговарящите на условията клиенти на API: OpenAI не съхранява техните подкани или отговорите на модела след обработването на заявката. Клиентското съдържание не е достъпно за преглед от служители на OpenAI1, а данните на корпоративните клиенти не се използват за обучение на нашите модели, освен ако клиентите изрично не се съгласят.
С нарастването на продължителността и сложността на задачите, изпълнявани от моделите, някои сериозни рискове могат да станат видими едва при разглеждане на множество взаимодействия. Съществуващите системи за безопасност, съвместими със ZDR, оценяват всяко взаимодействие поотделно. Днес представяме предварителната версия на „Поверителна обработка за безопасност“, предназначена да открива закономерности в свързани взаимодействия, без служителите на OpenAI да получават достъп до съдържанието им.
При внедрявания със ZDR клиентското съдържание остава в инфраструктура под контрола на клиента. Разработваме и вариант, при който съдържанието се съхранява в инфраструктурата на OpenAI, криптирано с ключове, контролирани от клиента. И в двата случая автоматизираните системи могат да откриват потенциална злоупотреба и да връщат ограничени сигнали за безопасност, без служителите на OpenAI да виждат основните подкани или отговори.
Най-сериозните рискове за безопасността на ИИ невинаги се забелязват в рамките на едно взаимодействие. Често потенциално вредните намерения стават ясни едва когато няколко взаимодействия се разгледат заедно. Подобни рискове могат да възникнат, когато злонамерени лица многократно изпробват защитните мерки, координират действията си чрез различни акаунти или прикриват заплахи като обичайни проучвания. Рискове могат да се развият и в хода на задача, изпълнявана от агент – например ако системата се отклони от намерението на потребителя, като продължи да действа, след като ѝ е наредено да спре.
Когато системите с ИИ поемат по-продължителни и сложни задачи, този по-широк контекст става все по-важен за разграничаването на правомерната дейност от злоупотребата и за гарантирането, че агентите с ИИ остават в рамките на предоставените им правомощия.
При някои скорошни внедрявания на авангардни модели от клиентите се изисква да позволят на доставчика си на ИИ да съхранява чувствително съдържание с цел наблюдение на безопасността. За много организации подобни изисквания противоречат на задълженията им за сигурност или на ангажиментите им към хората, на които служат.
„Поверителна обработка за безопасност“ е проектирана така, че да можем да продължим да предлагаме ZDR.
„Поверителна обработка за безопасност“ надгражда автоматизираните защити, които вече се използват при ZDR и други внедрявания. Съществуващите системи за безопасност, съвместими със ZDR, оценяват взаимодействията поотделно. „Поверителна обработка за безопасност“ разширява тези защити върху свързаните взаимодействия, като позволява на автоматизираните системи да откриват закономерности, без служителите на OpenAI да имат достъп до съхраняваното клиентско съдържание.
„Поверителна обработка за безопасност“ използва клиентското съдържание независимо от мястото, където се съхранява – в инфраструктура под контрола на клиентите (при внедрявания със ZDR) или в хранилище, предоставено от OpenAI. При хранилище, предоставено от OpenAI, клиентското съдържание се шифрова с ключове под контрола на клиента. Служителите на OpenAI не разполагат с копие на тези ключове и следователно нямат достъп до основното съдържание.
При установяване на риск OpenAI получава строго дефиниран сигнал, който посочва вида на съответната дейност, подобно на настоящите ни системи за безопасност. Този сигнал може да се използва, за да се определи дали са необходими принудителни мерки. Служителите на OpenAI не получават достъп до клиентското съдържание дори когато то е маркирано като рисково.
Клиентите могат да разследват сигналите и решенията за налагане на мерки чрез информацията, налична в собствените им системи. Ако желаят да обжалват, да пояснят правомерна дейност или да подпомогнат разследване на потвърдена злоупотреба, те могат да изберат да споделят съответната информация с OpenAI.
В момента „Поверителна обработка за безопасност“ се тества с първите клиенти. Споделяме тази предварителна информация сега, защото клиентите ни ясно заявиха, че се нуждаят от предвидимост относно защитата на съдържанието им с нарастването на възможностите на системите с ИИ.
Нашата мисия е да гарантираме, че изкуственият общ интелект е от полза за цялото човечество. Сътрудничеството с клиенти и партньори е съществена част от начина, по който изграждаме ефективни защитни мерки. Както ясно посочват нашите принципи, нито една лаборатория за ИИ не може сама да се справи с възникващите рискове. „Поверителна обработка за безопасност“ следва този подход и се оформя с приноса на клиенти от различни отрасли, региони и компании с различен мащаб.
Организациите, с които работим, обработват част от най-чувствителната информация в своите сектори, включително финансови документи, здравни данни, поверителни бизнес планове и защитени научни изследвания. Защитата на тази информация е от съществено значение за спазването на регулаторните задължения, поддържането на доверието на клиентите и запазването на конкурентното им предимство.
Техните отзиви ни помагат да изграждаме по-надеждни защитни мерки, като същевременно запазваме информацията им под техен контрол.
„Внедряването на ИИ в предприятията зависи изцяло от контрола на клиентите върху данните, без пряко или производно използване извън избраната услуга. Ангажиментът на OpenAI да не използва данните за обучение и ZDR дават на Glean увереност да разработва с OpenAI. С повишаването на възможностите на моделите OpenAI показва, че безопасността може да напредва, без да се засягат поверителността и контролът, на които се крепи доверието на предприятията.“
– Сунил Агравал, директор „Информационна сигурност“, Glean
Ще продължим да работим с клиентите по техническите и оперативните подробности на нашия подход. Планираме да започнем поетапното внедряване на „Поверителна обработка за безопасност“ и да публикуваме техническа бяла книга през септември. Ще информираме клиентите на всяка стъпка, като споделяме своевременно новостите, обясняваме какво означават те за съществуващите ангажименти и осигуряваме необходимите време и подкрепа, за да могат клиентите да планират предварително.
Автор
- 1
Както и други доставчици на авангардни модели, OpenAI е задължена по закон(отваря се в нов прозорец) да докладва за очевидни материали със сексуално насилие над деца (CSAM). Изображенията, маркирани като CSAM, ще продължат да се съхраняват за целите на ръчен преглед и докладването, включително при внедрявания с нулево задържане на данни, както и досега.


