跳到主要內容
OpenAI

2026年9月29日

安全機制系統防護

我們如何將安全性、資訊保安及私隱保障融入 Dot

當你的 Dot 承擔更多工作時,我們協助保護你的資訊,並將重要決定留在你手中。

正在載入...

Dot 是持續運作的智能代理,能長期承擔工作,讓你有更多時間和精力專注於在意的事情。每個 Dot 都有自己的電腦,並能跨越你選擇連接的應用程式處理工作。你為 Dot 設定目標,並界定它們可以自行處理的事。它們可以逐步完成工作、因應變化作出調整,並在兩次對話之間繼續推進任務。它們可以追蹤持續發展的新聞並草擬通訊,或在收到新資訊時協助更新專案,再將成果交給你審閱,遇到需要你判斷的事則請你作決定。

把這些責任交給 Dot,意味著你會將更多資訊和工作託付給它們。你應該清楚每個 Dot 可以存取甚麼、如何運用這些存取權,以及何時需要你參與。這些問題十分重要,因為智能代理的錯誤可能造成對話以外的後果:一旦誤解要求,它可能修改錯誤的檔案,或分享你原本想保密的資訊。

我們在這些工作的每個環節都設置了防護措施。我們以 GPT‑6 Astra 為基礎,訓練它理解你的意圖並遵守安全規則,再針對 Dot 使用的資訊、工作的環境,以及計劃執行的操作,增設防護措施。受保護的雲端工作區有助限制錯誤的影響範圍,安全登入流程有助保護敏感的憑證,而獨立的操作檢查則有助識別不符合你指示或安全要求的步驟。你可以選擇連接的項目、設定偏好,並在工作進行期間追蹤進度或調整方向。

Dot 仍可能出錯;我們會從實際使用中汲取經驗,持續改進這些防護措施。本文將說明這些防護措施如何配合運作、你可以控制哪些事項,以及它們仍有哪些限制,讓你在決定將甚麼工作託付給 Dot 時有充分依據。

專為理解你的意圖而打造的模型

Dot 由 GPT‑6 Astra 驅動;這是我們能力最強、對齊程度最高的模型。Astra 擅長理解你的目標,將工作保持在你要求的範圍內,並在答案可能影響下一步做法時,提出有針對性的問題。這些能力有助 Dot 長期跟進任務,同時不偏離你的原意。

我們已訓練 Astra 拒絕有害要求,包括涉及濫用生物技術或網絡安全技術的要求。我們會測試 Dot 如何應對不斷變更的指示、含糊的要求,以及試圖令它們超出你所授權限的行為。透過人工及自動化紅隊演練,我們能找出弱點,改進模型及其周邊系統,並再次測試這些改動。

為能執行操作的智能代理提供保安防護

除了模型本身的防護措施,我們還加入 ChatGPT 的保安防護,並為能持續代你工作的智能代理增設額外措施。

ChatGPT 的內置防護包括加密保護,涵蓋你的內容在儲存期間,以及在你、OpenAI 與我們的服務供應商之間傳輸的過程,另有存取控制以協助保護已儲存的資訊。我們的帳戶保安系統也會偵測你的 OpenAI 帳戶是否有可疑使用情況;若某個工作階段疑似遭入侵,系統可要求重新登入。

智能代理也需要防範執行工作時接觸到的資訊所帶來的風險。網頁、電郵或文件可能包含惡意指示,試圖改變它們的行動方向,或誘使它們分享私人資訊;這類問題稱為提示注入。我們結合模型防護、工具限制、操作前檢查及監察機制,協助防止這些內容觸發非預期操作。

我們也會在 Dot 規劃及執行操作時加以監察,識別潛在有害行為,例如超出你的指示範圍行事,或試圖繞過防護措施。若安全監察機制發現 Dot 正在進行的工作有問題,便可暫停該工作並顯示警告,供你查看。這項內置監察機制有助在任務推進期間偵測問題,並與限制 Dot 存取及操作範圍的防護措施配合運作。

每個 Dot 都有受保護的工作區

每個 Dot 都有自己的雲端電腦,可用來瀏覽網頁、分析資訊、建立檔案及執行工具。即使你沒有積極參與,Dot 仍可在這些工作區內繼續推進工作。

你可以選擇 Dot 能使用哪些帳戶:在已授予 ChatGPT 的權限範圍內連接應用程式,或在 Dot 的瀏覽器中登入網站,並在支援的情況下使用安全登入。你也可以選擇連接個人電腦,讓 Dot 以更多方式提供協助,例如分析儲存在桌面的試算表,或使用裝置上已安裝的編程工具。

在每個 Dot 受保護的工作區內,沙盒機制會限制它可存取的程式碼和工具,有助控制有害程式碼或錯誤指令造成的影響。我們也會將不同使用者的雲端環境互相隔離,並維護底層的 Linux 作業系統及 Chrome 瀏覽器。

Dot 執行程式碼的環境,與負責協調工作及落實關鍵防護措施的系統彼此分開。它們可以在該環境中建立檔案及執行工具,但不能利用這些存取權修改安全系統,或關閉必要的檢查。這種分隔有助確保即使 Dot 出錯,防護措施仍然有效。

下文介紹的操作規則,會規範 Dot 可以如何運用其存取權。

每個 Dot 的雲端工作區都整合了它的電腦及可用工具。你可以選擇連接哪些應用程式,以及是否連接你的個人電腦。自動審查會在需要審核的操作執行前進行檢查。若某個步驟被攔截,它會告知 Dot 原因,讓 Dot 決定下一步怎樣做。

每個 Dot 的雲端工作區都整合了它的電腦及可用工具。你可以選擇連接哪些應用程式,以及是否連接你的個人電腦。自動審查會在需要審核的操作執行前進行檢查。若某個步驟被攔截,它會告知 Dot 原因,讓 Dot 決定下一步怎樣做。

安全登入

安全登入讓 Dot 能在帳戶內工作,而無須在對話中提供密碼。在支援安全登入的情況下,模型會在你填寫安全登入表格時暫停運作。表格會將你的憑證直接傳送至瀏覽器環境並提交,而不會讓憑證進入模型的上下文。隨後,Dot 便會在已登入的帳戶中繼續工作。不讓密碼進入對話,可降低密碼出現在回答中或被誤分享的風險。

支援使用已儲存密碼的登入流程,會透過專用的加密憑證服務維持這種分隔。該服務會提供登入所需的密碼,但不會將密碼傳給模型。這樣 Dot 就能在你授權的帳戶內工作,而密碼仍不會進入模型的上下文。這些防護措施僅適用於安全登入及使用已儲存密碼的流程;若你另外將機密資料放在可讀取的訊息或文件中,模型仍可能看到。

安全登入介面以浮動面板形式顯示在 Dot 桌布上。

掌控你的資訊,追蹤工作進度

你可以透過現有的 ChatGPT 連接及權限,管理 Dot 可使用哪些應用程式;這些連接及權限由 ChatGPT、ChatGPT 工作及 Codex 共用。在「設定」的「外掛程式」部分,你可以查看已連接的帳戶,並更改 Dot 日後可存取的內容。中斷應用程式連接後,系統便不會再透過該連接分享新資訊。但 Dot 已獲取的資訊仍會保留在它自己的上下文中。這些權限規範的是應用程式存取範圍,不能凌駕強制性的安全要求。

如果你想讓 Dot 處理本機檔案或使用本機工具,也可以選擇連接你的電腦。該連接仍受本機沙盒及適用的操作檢查所限制。使用電腦的咪高峰或相機也需要裝置權限,你可以選擇是否授予 ChatGPT。

應用程式權限顯示在手機外框內,以 Dot 桌布為背景。

桌面應用程式中的「活動檢視」,讓你追蹤並引導正在進行的工作。它會顯示進行中及已委派的任務,以及各項任務的狀態。你可以補充背景資訊、澄清誤解、改變方向,或要求 Dot 停止。

「活動檢視」以帶圓角的浮動桌面截圖形式顯示在 Dot 桌布上。

Dot 會逐步累積上下文,以提供更有用的協助。當它們委派工作時,其他智能代理會獲指示保留任務所需的資訊,並避免留存不必要的敏感細節。每個 Dot 都有自己的上下文,你可以隨時重設。

對於 ChatGPT Business、Enterprise 及 Edu 工作區,我們預設不會使用你的資料訓練模型。若使用個人 ChatGPT 方案,你可以透過「為所有人改進模型」設定,控制是否允許我們使用你的 Dot 對話及它們執行的工作來改進模型。若啟用模型訓練,這些資料可能包括 Dot 執行的操作,以及你設定的自動化流程;我們會先致力移除其中的個人識別資料。如欲進一步了解我們如何使用你的資料,請閱讀說明中心的這篇文章⁠(在新視窗中開啟)。

Dot 持續尋找提供協助的方式

除了你交託的工作,Dot 也可以啟動背景研究任務,尋找其他提供協助的機會,例如留意到你的旅遊計劃有變動。我們將此稱為「主動研究」。

這些任務會在每個 Dot 的雲端環境中執行。它們會使用唯讀工具,從已連接且獲准存取的來源收集資訊,再為該 Dot 儲存私人筆記。我們透過程式碼強制執行這些限制:研究任務不能直接向他人傳送訊息、修改已連接應用程式中的內容,或操控瀏覽器或桌面。Dot 可以運用研究結果,決定如何提供協助,但任何後續操作都必須遵循一貫的規則及檢查程序。

「主動研究」會在每個 Dot 的雲端環境中以背景任務形式執行。它會讀取已連接且獲准存取的來源,並將私人筆記回傳給該 Dot,由它決定如何提供協助。任何後續操作都須遵循一貫的規則及檢查程序。

「主動研究」會在每個 Dot 的雲端環境中以背景任務形式執行。它會讀取已連接且獲准存取的來源,並將私人筆記回傳給該 Dot,由它決定如何提供協助。任何後續操作都須遵循一貫的規則及檢查程序。

我們不會直接使用這些背景研究討論串或其產生的筆記來訓練模型。不過,Dot 可能會接收其背景研究任務產生的筆記,或讀取部分研究討論串。以這種方式帶入符合訓練資格的對話或任務中的資訊,可能會用於模型訓練,視乎你的設定而定。例如,某個背景研究任務可能會為即將到來的歐洲之旅,收集數個目的地的資訊。該研究討論串及其筆記不會直接用於訓練。之後,當你要求 Dot 協助規劃里斯本之旅時,它可能會讀取背景研究任務中一則關於里斯本的筆記。這則筆記會成為旅遊規劃對話上下文的一部分,之後可能用於訓練,視乎你的設定而定。其餘背景研究內容不會用於訓練,除非它們也被帶入符合訓練資格的對話或任務中。

明確的操作規則

Dot 會遵循內置的防護規範,以防止造成傷害,並將影響重大的決定留給你。安全規則要求它們拒絕有害要求,包括涉及濫用生物技術或網絡安全技術的要求。對於它們能協助處理的任務,操作規則會界定何時可以繼續、何時必須請你確認,以及何時必須將某個步驟交回給你處理。

在這些界限內,Dot 可以讀取獲准存取的資訊、進行分析,並在你的對話中準備草稿。我們訓練它們在傳送訊息或分享檔案前,先取得涵蓋相關資訊及收件人類型的授權;資料越敏感,就越需要具體指明收件人。例如,分享健康資料一律需要使用者指明收件人姓名(「與 Thompson 醫生分享我的病歷」)。對於敏感度較低的個人資料,例如電郵地址或電話號碼,預設要求是由使用者指定收件人類別(「任何航空公司」)。使用者可以建立自訂規則,進一步放寬敏感度較低的個人資料分享規則(「可填入任何網上表格」);下一節將詳細介紹這項功能。這項授權始終受你對該任務的指示所限;稍後繼續工作或委派任務,都不會擴大授權範圍。

Dot 可以使用你已儲存在商戶網站的付款卡購物。這些購買操作需要你的批准。

某些操作每次都需要你確認,包括永久刪除資料、安裝或執行來自未獲識別來源的軟件,或授予新的、涉及敏感保安事項的存取權。這些要求讓你有機會審視可能難以撤銷,或會讓他人取得新存取權的變更。

至於其他敏感步驟,包括更改密碼或在金融帳戶之間轉帳,Dot 可以協助處理相關工作,但必須將這些敏感步驟交回給你親自處理。

透過自訂規則設定偏好

自訂規則讓你在內置防護的範圍內,設定 Dot 提供協助的方式,例如要求它們絕不傳送電郵。你也可以針對特定任務給予指示,例如要求 Dot 告訴同事你暫時不在,但不要透露私人原因。當該 Dot 委派工作或在背景執行任務時,這些指示仍然適用。

Dot 可以協助你撰寫自訂規則,但必須獲得你的批准才能修改規則。這些偏好設定必須遵守內置防護規範,不能取消強制確認、交回使用者處理的步驟,或核心安全要求。

自訂規則顯示在手機外框內,以 Dot 桌布為背景。

Dot 執行操作前的獨立檢查

在 Dot 傳送電郵或修改檔案等操作之前,一個名為「自動審查」的獨立安全系統會檢查擬執行的步驟,確保符合你的指示、自訂規則及安全要求。以電郵為例,系統會檢查收件人及訊息內容,協助發現錯誤地址,或你無意分享的資訊。

若自動審查准許某個步驟,提出該步驟的 Dot 便會使用適當的電腦或應用程式工具執行,再根據結果繼續處理你的任務。只要你先前的批准涵蓋該操作,而且規則沒有要求再次確認,它便可以依據既有批准行事。

若自動審查攔截某個步驟,就會阻止操作執行,並告知 Dot 原因。如果補充資訊或取得你的批准能解決攔截原因,該 Dot 可以向你提出請求,然後再次提交該步驟以供審核。視乎原因,它也可能改為嘗試獲准的替代方案、將敏感步驟交回給你處理或停止。你的批准不能凌駕核心安全要求。

我們將強制執行自動審查的控制機制,設置在 Dot 可修改的環境之外,因此它們無法更改或關閉必要的檢查。一般的唯讀步驟仍須遵守應用程式權限、工具限制及其他防護措施,但不需要這項額外審查。

當自動審查准許某項操作時,Dot 便會執行操作並接收結果。若操作被攔截,自動審查會將原因回傳給該 Dot,由它決定是詢問你、嘗試獲准的替代方案、將該步驟交回給你處理,還是停止。

當自動審查准許某項操作時,Dot 便會執行操作並接收結果。若操作被攔截,自動審查會將原因回傳給該 Dot,由它決定是詢問你、嘗試獲准的替代方案、將該步驟交回給你處理,還是停止。

獲得更多協助,主導權仍在你手中

要放心將持續進行的工作託付給 Dot,你需要了解它們如何遵循你的指示,以及遇到突發情況時如何應對。Astra 協助它們理解你的意圖,而圍繞資料、工作區、憑證及操作設置的防護措施,則有助限制錯誤或惡意內容造成的傷害。這些防護措施相互配合,讓 Dot 有空間完成有用的工作,同時降低錯誤導致非預期操作或資訊洩露的機會。

你可以選擇 Dot 能連接甚麼,以及如何提供協助,也可以追蹤進度,或隨需求改變而調整方向。透過批准及交回處理機制,關鍵決定仍由你掌握。Dot 仍可能出錯,因此我們會從實際使用中汲取經驗,持續測試及改進防護措施。我們希望讓你更輕鬆地把工作交給 Dot,回來時便能看到實質進展;任務始終按你的偏好推進,重要決定仍掌握在你手中。

了解更多

閱讀系統說明卡⁠(在新視窗中開啟),進一步了解我們的防護措施、安全評估及仍然存在的限制。

如欲了解 ChatGPT 的保安基礎,請參閱 OpenAI 的資訊保安與私隱保障。如欲深入了解其中一項網頁保安措施,請參閱當 AI 智能代理點擊連結時,如何保障你的資料安全。

作者

OpenAI