메인 콘텐츠로 건너뛰기
OpenAI

2026년 8월 19일

회사안전

프런티어 모델에 데이터 비보관 제공

ZDR과의 호환성을 유지하면서 여러 상호작용에 걸친 보호 조치를 강화하는 비공개 안전 처리 미리보기.

로딩 중...

데이터 비보관은 자격을 갖춘 API 고객에게 명확한 약속을 제공합니다. OpenAI는 요청 처리가 끝난 후 고객의 프롬프트나 모델 응답을 보관하지 않습니다. OpenAI 직원은 검토 목적으로 고객 콘텐츠에 접근할 수 없으며1, 기업 고객이 명시적으로 동의하지 않는 한 해당 데이터를 모델 학습에 사용하지 않습니다.

모델이 더 길고 복잡한 작업을 수행하게 되면서 일부 심각한 위험은 여러 상호작용을 종합해야만 드러날 수 있습니다. 기존 ZDR 호환 안전 시스템은 각 상호작용을 개별적으로 평가합니다. 오늘 OpenAI는 직원이 원본 콘텐츠에 접근하지 않고도 연관된 여러 상호작용에서 패턴을 식별하도록 설계된 비공개 안전 처리를 미리 선보입니다.

ZDR 배포 환경에서는 고객 콘텐츠가 고객이 제어하는 인프라에 그대로 유지됩니다. 또한 고객이 관리하는 키로 콘텐츠를 암호화해 OpenAI 인프라에 저장하는 옵션도 개발하고 있습니다. 두 경우 모두 자동화 시스템은 OpenAI 직원에게 원본 프롬프트나 응답을 노출하지 않으면서 잠재적 오용을 식별하고 제한된 안전 신호를 반환할 수 있습니다.

안전 시스템이 발전해야 하는 이유

가장 심각한 AI 안전 위험이 한 번의 상호작용에서 늘 드러나는 것은 아닙니다. 잠재적으로 유해한 의도는 여러 상호작용을 함께 살펴봐야 비로소 명확해지는 경우가 많습니다. 악의적 행위자가 보호 조치를 반복적으로 시험하거나 여러 계정에서 조직적으로 행동하거나 위협을 일상적인 연구로 위장할 때도 이와 유사한 위험이 발생할 수 있습니다. 에이전트형 작업이 진행되는 동안에도 위험이 발생할 수 있습니다. 예를 들어 시스템이 중단 지시를 받은 후에도 계속 행동해 사용자의 의도에서 벗어날 수 있습니다.

AI 시스템이 더 길고 복잡한 작업을 수행하게 될수록, 정상적인 활동과 오용을 구분하고 AI 에이전트가 부여된 권한의 범위를 벗어나지 않도록 하는 데 이러한 폭넓은 맥락이 더욱 중요해집니다.

최근 일부 프런티어 모델 배포에서는 안전 모니터링을 위해 AI 제공업체가 민감한 콘텐츠를 보관하도록 고객이 허용해야 했습니다. 많은 조직에서 이러한 요구 사항은 보안 의무나 서비스를 제공하는 대상과의 약속에 어긋납니다.

비공개 안전 처리는 OpenAI가 ZDR을 계속 제공할 수 있도록 설계되었습니다.

비공개 안전 처리의 작동 방식

비공개 안전 처리는 ZDR 및 기타 배포 환경에서 이미 사용 중인 자동화된 보호 기능을 기반으로 합니다. 기존 ZDR 호환 안전 시스템은 상호작용을 개별적으로 평가합니다. 비공개 안전 처리는 이러한 보호 기능을 연관된 여러 상호작용으로 확장하여, OpenAI 직원이 보관된 고객 콘텐츠에 접근하지 않고도 자동화 시스템이 패턴을 식별할 수 있게 합니다.

비공개 안전 처리는 고객 콘텐츠가 고객 관리 인프라(ZDR 배포)에 있든 OpenAI 제공 스토리지에 있든 저장 위치와 관계없이 이를 활용합니다. OpenAI 제공 스토리지를 사용하는 경우 고객이 관리하는 키로 고객 콘텐츠를 암호화합니다. OpenAI 직원에게는 해당 키의 사본이 없으므로 원본 콘텐츠에 접근할 수 없습니다.

위험이 식별되면 OpenAI는 현재의 기존 안전 시스템과 마찬가지로 관련 활동의 유형을 나타내는 제한된 범위의 신호를 받습니다. 이 신호를 바탕으로 제재가 필요한지 판단할 수 있습니다. 플래그가 지정된 경우에도 OpenAI 직원은 고객 콘텐츠에 접근할 수 없습니다.

고객은 자체 시스템에서 이용할 수 있는 정보를 활용해 알림과 제재 결정을 조사할 수 있습니다. 이의를 제기하거나 정상적인 활동임을 소명하거나 확인된 악용에 대한 조사를 지원하려는 경우, 고객은 관련 정보를 OpenAI와 공유할 수 있습니다.

비공개 안전 처리는 현재 초기 고객을 대상으로 테스트 중입니다. AI 시스템의 역량이 향상되는 가운데 고객 콘텐츠가 어떻게 보호될지 예측할 수 있어야 한다는 고객의 분명한 요구를 반영해 지금 이 미리보기를 공개합니다.

API 요청이 비공개 안전 처리로 전달되고, 고객이 제어하는 암호화 스토리지와 자동 안전 검토를 거치는 과정을 보여주는 콘텐츠 액세스 제어 다이어그램. 고객은 상세 알림을 받고 콘텐츠를 OpenAI와 공유할 수 있습니다. 공유하지 않으면 OpenAI에는 고객 콘텐츠 없이 알림 범주와 심각도만 표시됩니다.

고객과 함께, 고객을 위해 구축하는 개인정보 보호와 안전

OpenAI의 사명은 범용 인공지능이 모든 인류에게 혜택을 주도록 하는 것입니다. 효과적인 보호 조치를 구축하려면 고객 및 파트너와의 협력이 필수적입니다. OpenAI의 원칙에서 분명히 밝히듯, 어떤 AI 연구소도 새롭게 등장하는 위험을 단독으로 해결할 수 없습니다. 비공개 안전 처리는 이러한 접근 방식을 반영하며, 다양한 산업과 지역, 규모의 고객 의견을 바탕으로 발전하고 있습니다.

OpenAI와 협력하는 조직들은 금융 기록, 의료 데이터, 기밀 사업 계획, 독점 연구 자료 등 각 분야에서 가장 민감한 정보의 일부를 취급합니다. 이러한 정보를 보호하는 일은 규제 의무를 준수하고 고객의 신뢰와 경쟁 우위를 유지하는 데 필수적입니다.

고객의 피드백은 정보에 대한 고객의 통제권을 유지하면서 더욱 강력한 보호 조치를 구축하는 데 도움이 되고 있습니다.

“기업의 AI 도입은 선택한 서비스 이외의 용도로 데이터를 직접 또는 파생적으로 사용하지 않고, 고객이 데이터를 온전히 통제할 수 있어야 가능합니다. OpenAI가 고객 데이터로 학습하지 않겠다고 약속하고 ZDR을 제공하기에 Glean은 안심하고 OpenAI를 기반으로 구축할 수 있습니다. 모델의 역량이 향상되는 가운데 OpenAI는 기업의 신뢰를 지탱하는 개인정보 보호와 통제권을 훼손하지 않으면서도 안전성을 강화할 수 있음을 보여줍니다.”

—수닐 아그라왈, Glean 최고정보보안책임자

앞으로도 접근 방식의 기술적·운영적 세부 사항을 고객과 함께 논의하겠습니다. 9월부터 비공개 안전 처리를 순차적으로 도입하고 기술 백서를 공개할 계획입니다. 모든 단계에서 고객에게 진행 상황을 알리겠습니다. 업데이트를 조기에 공유하고 기존 약속에 미치는 영향을 설명하며, 고객이 미리 계획하는 데 필요한 시간과 지원을 제공하겠습니다.

작성자

OpenAI
  1. 1

    다른 프런티어 모델 제공업체와 마찬가지로 OpenAI는 명백한 아동 성착취물(CSAM)을 신고할 법적 의무(새 창에서 열기)가 있습니다. 현재와 마찬가지로 데이터 비보관 배포 환경에서도 잠재적 아동 성착취물로 플래그가 지정된 이미지는 수동 검토와 신고를 위해 계속 보관됩니다.