零資料保留向符合資格的 API 客戶作出明確承諾:請求處理完畢後,OpenAI 不會保留其提示詞或模型回覆。OpenAI 人員無法存取客戶內容進行審查1;除非企業客戶明確選擇加入,否則我們不會使用其資料訓練模型。
隨著模型承擔耗時更長、更加複雜的任務,有些嚴重風險可能要經過多次互動才會浮現。現有與 ZDR 相容的安全系統會分別評估每次互動。今天,我們首次介紹私密安全處理。這項機制旨在辨識相關互動中的模式,同時不讓 OpenAI 人員存取其背後的內容。
採用 ZDR 部署時,客戶內容會留在客戶所控制的基礎架構上。我們也在開發另一個選項,將內容儲存在 OpenAI 基礎架構上,並以客戶控制的金鑰加密。在這兩種情況下,自動化系統都能辨識潛在濫用行為並回傳有限的安全訊號,而不會向 OpenAI 人員揭露其背後的提示詞或回覆。
最嚴重的 AI 安全風險,不一定會在單次互動中顯現。潛在的有害意圖,往往要綜合檢視多次互動後才會變得明確。惡意行為者反覆試探防護措施、跨帳戶協同行動,或將威脅偽裝成例行研究時,也可能引發類似風險。風險也可能在代理式任務的執行過程中逐漸形成,例如系統接獲停止指示後仍繼續行動,因而偏離使用者意圖。
隨著 AI 系統承擔耗時更長且更加複雜的任務,更廣泛的情境對於區分正當活動與濫用行為,以及確保 AI 代理不超出預定權限範圍,將變得日益重要。
近期部分前沿模型部署要求客戶允許 AI 供應商保留敏感內容,以進行安全監控。對許多組織而言,這類要求與其安全義務或對服務對象作出的承諾相衝突。
私密安全處理的設計,讓我們得以繼續提供 ZDR。
私密安全處理以 ZDR 和其他部署已使用的自動化防護措施為基礎。現有與 ZDR 相容的安全系統會分別評估每次互動。私密安全處理將這些防護措施延伸至相關互動,讓自動化系統能辨識模式,同時不讓 OpenAI 人員存取保留的客戶內容。
無論客戶內容儲存在何處,是由客戶控制的基礎架構(ZDR 部署),還是 OpenAI 提供的儲存空間,私密安全處理都能加以運用。使用 OpenAI 提供的儲存空間時,客戶內容會以客戶控制的金鑰加密。OpenAI 人員沒有這些金鑰的副本,因此無法存取其背後的內容。
識別出風險時,OpenAI 會收到一項範圍明確且有限的訊號,指出相關活動類型,做法與目前既有的安全系統類似。這項訊號可用於判斷是否有必要採取處置措施。即使客戶內容遭到標記,OpenAI 人員仍無法存取該內容。
客戶可運用自身系統中的資訊,調查警示與處置決定。如要提出申訴、釐清正當活動,或協助調查已證實的濫用行為,客戶可以選擇與 OpenAI 分享相關資訊。
私密安全處理目前正與早期客戶共同測試。我們現在分享這項預覽,是因為已清楚聽見客戶的需求:隨著 AI 系統能力日益提升,他們需要能夠預先掌握自身內容將如何受到保護。
我們的使命是確保通用人工智慧造福全人類。與客戶及合作夥伴協作,是我們建立有效防護措施不可或缺的一環。正如我們的原則明確指出,任何 AI 實驗室都無法獨力因應新興風險。私密安全處理體現了這種做法,並由來自不同產業、地區及公司規模的客戶共同塑造。
與我們合作的組織經手其產業中最敏感的資訊,包括財務紀錄、健康資料、機密商業計畫及專有研究。保護這些資訊,是履行監管義務、維繫客戶信任及保持競爭優勢的必要條件。
他們的意見正協助我們建立更完善的防護措施,同時讓資訊仍由他們掌控。
「企業採用 AI,完全取決於客戶能否掌控資料,確保資料不會在所選服務之外遭到直接或衍生使用。OpenAI 不使用資料進行訓練的承諾與 ZDR,讓 Glean 能放心運用 OpenAI 進行開發。隨著模型能力日益提升,OpenAI 證明安全也能同步進步,而不必犧牲維繫企業信任的隱私與控制權。」
—Sunil Agrawal,Glean 資訊安全長
我們將繼續與客戶合作,完善這套方法的技術與營運細節。我們計畫於 9 月開始推出私密安全處理,並發布技術白皮書。我們會全程向客戶說明進度,提早分享最新消息、解釋其對現有承諾的影響,並提供客戶事先規劃所需的時間與支援。
作者
- 1
與其他前沿模型供應商一樣,OpenAI 依法必須(在新視窗中開啟)通報疑似兒童性虐待素材(CSAM)。與目前做法相同,即使採用零資料保留部署,遭標記為潛在 CSAM 的影像仍會保留,以供人工審查與通報。


