跳到主要內容
OpenAI

2026年8月19日

公司安全機制

為前沿模型提供零資料保留

率先介紹 Private Safety Processing,在維持 ZDR 兼容性的同時,加強跨互動保障。

正在載入...

零資料保留為合資格的 API 客戶提供明確承諾:OpenAI 在處理請求後,不會保留其提示詞或模型回應。OpenAI 人員無法存取客戶內容作審查用途1;除非企業客戶明確選擇加入,否則其資料不會用於訓練我們的模型。

隨着模型承擔時間更長、更加複雜的任務,有些嚴重風險可能要綜合多次互動才會顯現。現有兼容 ZDR 的安全系統會逐一評估每次互動。今天,我們率先介紹 Private Safety Processing。這項方案旨在識別相關互動之間的規律,而不會讓 OpenAI 人員存取底層內容。

在 ZDR 部署中,客戶內容會留在由客戶控制的基礎設施上。我們亦正開發另一個選項:內容儲存在 OpenAI 基礎設施上,並以客戶控制的密鑰加密。在這兩種情況下,自動系統都可識別潛在濫用行為並傳回有限的安全訊號,而不會向 OpenAI 人員披露底層提示詞或回應。

安全系統為何需要演進

最嚴重的 AI 安全風險不一定會在單次互動中顯現。潛在有害意圖往往要綜合審視多次互動,才會變得清晰。惡意行為者反覆試探保障措施、跨帳戶協同行動,或把威脅偽裝成一般研究時,也可能帶來類似風險。風險亦可能在智能代理式任務執行期間逐步形成,例如系統在收到停止指示後仍繼續行動,因而偏離使用者的意圖。

隨着 AI 系統承擔時間更長、更加複雜的任務,更廣泛的情境對區分正當活動與濫用越發重要,也有助確保 AI 智能代理不會超越其預定權限。

近期部分前沿模型部署要求客戶允許 AI 供應商保留敏感內容,以進行安全監察。對許多機構而言,這類要求與其安全責任或對服務對象作出的承諾有所衝突。

Private Safety Processing 的設計,讓我們能夠繼續提供 ZDR。

Private Safety Processing 的運作方式

Private Safety Processing 建基於 ZDR 及其他部署目前採用的自動保障措施。現有兼容 ZDR 的安全系統會逐一評估每次互動。Private Safety Processing 把這些保障延伸至多次相關互動,讓自動系統能夠識別規律,而 OpenAI 人員無法存取所保留的客戶內容。

無論客戶內容儲存在由客戶控制的基礎設施(ZDR 部署),還是 OpenAI 提供的儲存空間,Private Safety Processing 都可使用該內容。使用 OpenAI 提供的儲存空間時,客戶內容會以客戶控制的密鑰加密。OpenAI 人員沒有這些密鑰的副本,因此無法存取底層內容。

識別到風險時,OpenAI 會收到一個範圍嚴格限定的訊號,顯示所涉及的活動類型,與我們現有安全系統的運作方式相若。該訊號可用於判斷是否需要採取處置措施。即使客戶內容被標記,OpenAI 人員仍無法存取該內容。

客戶可使用其自身系統中的資料,調查警示及處置決定。如要提出上訴、澄清正當活動,或協助調查經核實的濫用行為,客戶可選擇與 OpenAI 分享相關資料。

Private Safety Processing 目前正由早期客戶參與測試。我們現在率先分享這項方案,是因為客戶已明確表示,隨着 AI 系統能力增強,他們需要能夠預期其內容將如何受到保護。

內容存取控制圖解,顯示 API 請求進入 Private Safety Processing,當中包含由客戶控制的加密儲存空間及自動安全審查。客戶會收到完整警示,並可與 OpenAI 分享內容;否則 OpenAI 只會看到警示類別和嚴重程度,不會看到任何客戶內容。

與客戶共同建立、為客戶而設的私隱與安全保障

我們的使命是確保通用人工智能造福全人類。與客戶和合作夥伴協作,是我們建立有效保障措施不可或缺的一環。正如我們的原則所明確指出,沒有任何一家 AI 實驗室能夠獨力應對新興風險。Private Safety Processing 體現了這種做法,其設計正由來自不同行業、地區和企業規模的客戶共同塑造。

與我們合作的機構會處理其行業中一些最敏感的資料,包括財務紀錄、健康資料、機密商業計劃及專有研究。保護這些資料,對履行監管責任、維持客戶信任及保障其競爭優勢至關重要。

他們的意見有助我們建立更完善的保障措施,同時讓他們繼續掌控自己的資料。

「企業採用 AI 完全取決於客戶能否掌控資料,且不得在所選服務範圍以外直接使用或以衍生形式使用這些資料。OpenAI 不使用客戶資料訓練模型的承諾及 ZDR,讓 Glean 有信心採用 OpenAI 進行開發。隨着模型能力增強,OpenAI 證明安全可以持續提升,而不必犧牲維繫企業信任的私隱和控制權。」

—Sunil Agrawal,Glean 資訊安全總監

我們會繼續與客戶合作,完善這套方案的技術和營運細節。我們計劃於 9 月開始推出 Private Safety Processing,並發表技術白皮書。我們會在整個過程中讓客戶掌握最新情況,及早分享進展、解釋這些進展對現有承諾的影響,並提供客戶預先規劃所需的時間和支援。

作者

OpenAI
  1. 1

    與其他前沿模型供應商一樣,OpenAI 依法必須(在新視窗中開啟)舉報疑似兒童性虐待材料(CSAM)。與目前做法一樣,即使採用零資料保留部署,被標記為可能涉及 CSAM 的影像仍會保留,以供人手審查及舉報之用。