零資料保留為合資格的 API 客戶提供明確承諾:OpenAI 在處理請求後,不會保留其提示詞或模型回應。OpenAI 人員無法存取客戶內容作審查用途1;除非企業客戶明確選擇加入,否則其資料不會用於訓練我們的模型。
隨着模型承擔時間更長、更加複雜的任務,有些嚴重風險可能要綜合多次互動才會顯現。現有兼容 ZDR 的安全系統會逐一評估每次互動。今天,我們率先介紹 Private Safety Processing。這項方案旨在識別相關互動之間的規律,而不會讓 OpenAI 人員存取底層內容。
在 ZDR 部署中,客戶內容會留在由客戶控制的基礎設施上。我們亦正開發另一個選項:內容儲存在 OpenAI 基礎設施上,並以客戶控制的密鑰加密。在這兩種情況下,自動系統都可識別潛在濫用行為並傳回有限的安全訊號,而不會向 OpenAI 人員披露底層提示詞或回應。
最嚴重的 AI 安全風險不一定會在單次互動中顯現。潛在有害意圖往往要綜合審視多次互動,才會變得清晰。惡意行為者反覆試探保障措施、跨帳戶協同行動,或把威脅偽裝成一般研究時,也可能帶來類似風險。風險亦可能在智能代理式任務執行期間逐步形成,例如系統在收到停止指示後仍繼續行動,因而偏離使用者的意圖。
隨着 AI 系統承擔時間更長、更加複雜的任務,更廣泛的情境對區分正當活動與濫用越發重要,也有助確保 AI 智能代理不會超越其預定權限。
近期部分前沿模型部署要求客戶允許 AI 供應商保留敏感內容,以進行安全監察。對許多機構而言,這類要求與其安全責任或對服務對象作出的承諾有所衝突。
Private Safety Processing 的設計,讓我們能夠繼續提供 ZDR。
Private Safety Processing 建基於 ZDR 及其他部署目前採用的自動保障措施。現有兼容 ZDR 的安全系統會逐一評估每次互動。Private Safety Processing 把這些保障延伸至多次相關互動,讓自動系統能夠識別規律,而 OpenAI 人員無法存取所保留的客戶內容。
無論客戶內容儲存在由客戶控制的基礎設施(ZDR 部署),還是 OpenAI 提供的儲存空間,Private Safety Processing 都可使用該內容。使用 OpenAI 提供的儲存空間時,客戶內容會以客戶控制的密鑰加密。OpenAI 人員沒有這些密鑰的副本,因此無法存取底層內容。
識別到風險時,OpenAI 會收到一個範圍嚴格限定的訊號,顯示所涉及的活動類型,與我們現有安全系統的運作方式相若。該訊號可用於判斷是否需要採取處置措施。即使客戶內容被標記,OpenAI 人員仍無法存取該內容。
客戶可使用其自身系統中的資料,調查警示及處置決定。如要提出上訴、澄清正當活動,或協助調查經核實的濫用行為,客戶可選擇與 OpenAI 分享相關資料。
Private Safety Processing 目前正由早期客戶參與測試。我們現在率先分享這項方案,是因為客戶已明確表示,隨着 AI 系統能力增強,他們需要能夠預期其內容將如何受到保護。
我們的使命是確保通用人工智能造福全人類。與客戶和合作夥伴協作,是我們建立有效保障措施不可或缺的一環。正如我們的原則所明確指出,沒有任何一家 AI 實驗室能夠獨力應對新興風險。Private Safety Processing 體現了這種做法,其設計正由來自不同行業、地區和企業規模的客戶共同塑造。
與我們合作的機構會處理其行業中一些最敏感的資料,包括財務紀錄、健康資料、機密商業計劃及專有研究。保護這些資料,對履行監管責任、維持客戶信任及保障其競爭優勢至關重要。
他們的意見有助我們建立更完善的保障措施,同時讓他們繼續掌控自己的資料。
「企業採用 AI 完全取決於客戶能否掌控資料,且不得在所選服務範圍以外直接使用或以衍生形式使用這些資料。OpenAI 不使用客戶資料訓練模型的承諾及 ZDR,讓 Glean 有信心採用 OpenAI 進行開發。隨着模型能力增強,OpenAI 證明安全可以持續提升,而不必犧牲維繫企業信任的私隱和控制權。」
—Sunil Agrawal,Glean 資訊安全總監
我們會繼續與客戶合作,完善這套方案的技術和營運細節。我們計劃於 9 月開始推出 Private Safety Processing,並發表技術白皮書。我們會在整個過程中讓客戶掌握最新情況,及早分享進展、解釋這些進展對現有承諾的影響,並提供客戶預先規劃所需的時間和支援。
作者
- 1
與其他前沿模型供應商一樣,OpenAI 依法必須(在新視窗中開啟)舉報疑似兒童性虐待材料(CSAM)。與目前做法一樣,即使採用零資料保留部署,被標記為可能涉及 CSAM 的影像仍會保留,以供人手審查及舉報之用。


