Нулевое хранение данных для передовых моделей
Представляем Конфиденциальный анализ безопасности, который усиливает меры защиты в рамках связанных взаимодействий и при этом остается совместимым с ZDR.
Нулевое хранение данных (ZDR) дает соответствующим требованиям клиентам API четкую гарантию: после обработки запроса OpenAI не хранит их запросы и ответы модели. Сотрудники OpenAI не имеют доступа к контенту клиентов для проверки1, а данные корпоративных клиентов не используются для обучения наших моделей без их явного согласия.
По мере того как модели берутся за более длительные и сложные задачи, некоторые серьезные риски могут проявляться только в ходе нескольких взаимодействий. Существующие системы безопасности, совместимые с ZDR, оценивают каждое взаимодействие отдельно. Сегодня мы представляем Конфиденциальный анализ безопасности (Private Safety Processing), который позволяет выявлять закономерности в связанных взаимодействиях, не предоставляя сотрудникам OpenAI доступа к их содержимому.
При развертываниях с ZDR контент клиента остается в управляемой им инфраструктуре. Мы также разрабатываем вариант, при котором контент хранится в инфраструктуре OpenAI и шифруется ключами под управлением клиента. В обоих случаях автоматизированные системы могут выявлять возможные злоупотребления и передавать ограниченный набор сигналов безопасности, не раскрывая сотрудникам OpenAI исходные запросы или ответы.
Наиболее серьезные риски безопасности ИИ не всегда можно заметить в рамках одного взаимодействия. Зачастую потенциально вредоносные намерения становятся очевидными, только если рассматривать несколько взаимодействий вместе. Подобные риски возникают и тогда, когда злоумышленники многократно испытывают средства защиты, координируют действия через разные учетные записи или маскируют угрозы под обычные исследования. Риски могут возникать и по ходу выполнения агентной задачи — например, если система отклоняется от намерений пользователя и продолжает действовать после команды остановиться.
По мере того как системы ИИ берутся за более длительные и сложные задачи, этот широкий контекст становится все важнее для разграничения правомерных действий и злоупотреблений, а также для того, чтобы агенты ИИ не выходили за рамки предоставленных им полномочий.
При некоторых недавних развертываниях передовых моделей клиентам приходилось разрешать поставщику ИИ хранить конфиденциальный контент для мониторинга безопасности. Для многих организаций такие требования противоречат их обязательствам в области безопасности или обязательствам перед людьми, которым они оказывают услуги.
Конфиденциальный анализ безопасности разработан так, чтобы мы могли и дальше предлагать нулевое хранение данных (ZDR).
Конфиденциальный анализ безопасности дополняет автоматизированные средства защиты, уже применяемые при развертываниях с ZDR и в других сценариях. Существующие системы безопасности, совместимые с ZDR, оценивают взаимодействия по отдельности. Конфиденциальный анализ безопасности распространяет эту защиту на связанные взаимодействия, позволяя автоматизированным системам выявлять закономерности без доступа сотрудников OpenAI к хранящемуся контенту клиентов.
Конфиденциальный анализ безопасности работает с контентом клиента независимо от места хранения: в управляемой клиентом инфраструктуре при развертывании с ZDR или в хранилище OpenAI. В хранилище OpenAI контент клиента шифруется с помощью ключей под управлением клиента. У сотрудников OpenAI нет копий этих ключей, поэтому они не могут получить доступ к исходному контенту.
При выявлении риска OpenAI получает строго ограниченный сигнал с указанием типа соответствующей активности — аналогично тому, как сегодня работают наши системы безопасности. На основе этого сигнала можно определить, требуется ли принять меры. Даже если контент клиента помечен системой, сотрудники OpenAI не получают к нему доступа.
Клиенты могут расследовать оповещения и решения о применении мер, используя информацию из собственных систем. Если клиент хочет подать апелляцию, пояснить правомерность действий или помочь в расследовании подтвержденного злоупотребления, он может передать OpenAI соответствующую информацию.
Сейчас Конфиденциальный анализ безопасности тестируется первыми клиентами. Мы публикуем эту предварительную информацию уже сейчас, поскольку четко услышали запрос клиентов на предсказуемость в вопросах защиты их контента по мере роста возможностей систем ИИ.
Наша миссия — сделать так, чтобы общий искусственный интеллект приносил пользу всему человечеству. Сотрудничество с клиентами и партнерами играет ключевую роль в создании эффективных мер защиты. Как ясно показывают наши принципы, ни одна лаборатория ИИ не способна в одиночку справиться с новыми рисками. Конфиденциальный анализ безопасности воплощает этот подход и совершенствуется при участии клиентов из разных отраслей и регионов, а также компаний разного масштаба.
Организации, с которыми мы работаем, обрабатывают одни из самых конфиденциальных сведений в своих отраслях, включая финансовую документацию, медицинские данные, закрытые бизнес-планы и собственные исследования. Защита этой информации необходима для соблюдения нормативных требований, поддержания доверия клиентов и сохранения конкурентных преимуществ.
Их отзывы помогают нам создавать более надежные меры защиты, сохраняя контроль клиентов над их информацией.
«Внедрение ИИ в компаниях целиком зависит от контроля клиентов над своими данными и отсутствия их прямого или косвенного использования за пределами выбранного сервиса. Обязательство OpenAI не использовать данные для обучения и поддержка ZDR позволяют Glean уверенно создавать решения с OpenAI. По мере роста возможностей моделей OpenAI показывает, что безопасность можно совершенствовать без ущерба для конфиденциальности и контроля, на которых держится доверие корпоративных клиентов».
— Сунил Агравал, директор по информационной безопасности Glean
Мы продолжим вместе с клиентами прорабатывать технические и операционные аспекты нашего подхода. В сентябре мы планируем начать внедрение Конфиденциального анализа безопасности и опубликовать технический документ. Мы будем держать клиентов в курсе на каждом этапе: заранее сообщать об изменениях, объяснять, как они повлияют на действующие обязательства, и предоставлять клиентам время и поддержку, необходимые для дальнейшего планирования.
Автор
- 1
Как и другие поставщики передовых моделей, OpenAI по закону обязана(открывается в новом окне) сообщать о выявленных материалах сексуального насилия над детьми (CSAM). Как и сейчас, изображения, отмеченные как потенциальный CSAM, будут храниться для ручной проверки и подачи отчетности даже при развертываниях с нулевым хранением данных (ZDR).


