「零資料保留」(Zero Data Retention, ZDR)政策向符合資格的 API 客戶明確承諾:OpenAI 在處理請求後,不會保留他們的提示詞或模型回應。客戶內容不會供 OpenAI 人員審查,且企業客戶的資料除非明確選擇加入,否則不會用於訓練我們的模型。

隨著模型承擔更長、更複雜的任務,一些嚴重的風險可能只會在多個互動中顯現。現有的 ZDR 相容安全系統會單獨評估每個互動。為此,我們今天預覽了「私有安全處理」(Private Safety Processing),其設計宗旨是在不讓 OpenAI 人員接觸底層內容的情況下,識別相關互動中的模式。

對於 ZDR 部署,客戶內容會保留在客戶控制的基礎設施上。我們也正在開發一個選項,讓內容儲存在 OpenAI 的基礎設施上,並使用客戶控制的金鑰進行加密。在這兩種情況下,自動化系統都能識別潛在的濫用行為,並回傳有限的安全訊號,而不會將底層的提示詞或回應暴露給 OpenAI 人員。

為何安全系統需要演進

最嚴重的 AI 安全風險不總是能在單一互動中被看見。通常,潛在的有害意圖只有在多個互動被一起檢視時才會變得清晰。當惡意行為者反覆探測安全防護、跨帳戶協調,或將威脅偽裝成例行研究時,也可能出現類似的風險。此外,在代理任務的過程中也可能產生風險,例如,如果系統在被告知停止後仍繼續行動,導致與使用者意圖不符。

隨著 AI 系統承擔更長、更複雜的任務,這種更廣泛的上下文對於區分合法活動與濫用行為變得越來越重要,同時也能確保 AI 代理保持在其預期權限範圍內。

近期一些前瞻模型的部署要求客戶允許其 AI 供應商保留敏感內容以進行安全監控。對於許多組織而言,這些要求與其安全義務或對服務對象的承諾相衝突。

「私有安全處理」的設計宗旨是讓我們能夠繼續提供 ZDR 服務。

「私有安全處理」如何運作

「私有安全處理」建立在 ZDR 及其他部署中已使用的自動化保護措施之上。現有的 ZDR 相容安全系統會單獨評估互動,而「私有安全處理」則將這些保護擴展到相關互動,允許自動化系統識別模式,同時不讓 OpenAI 人員接觸到保留的客戶內容。

無論客戶內容儲存在何處,無論是在客戶控制的基礎設施(ZDR 部署)還是由 OpenAI 提供的儲存空間,「私有安全處理」都會利用這些內容。對於 OpenAI 提供的儲存空間,客戶內容會使用客戶控制的金鑰進行加密。OpenAI 人員沒有這些金鑰的副本,因此無法存取底層內容。

當識別出風險時,OpenAI 會收到一個狹義定義的訊號,指示所涉及的活動類型,這與我們現有的安全系統類似。該訊號可用於判斷是否需要執行強制措施。即使內容被標記,OpenAI 人員也無法存取客戶內容。

客戶可以使用其系統中可用的資訊來調查警報和強制執行決策。如果他們希望提出申訴、澄清合法活動,或支持對已驗證濫用行為的調查,他們可以選擇與 OpenAI 分享相關資訊。

「私有安全處理」目前正在與早期客戶進行測試。我們現在分享此預覽版,是因為我們清楚地聽到客戶的需求,他們希望在 AI 系統能力越來越強大的同時,能預測其內容將如何受到保護。

與客戶共同打造的隱私與安全

我們的使命是確保通用人工智慧(AGI)造福全人類。與客戶和合作夥伴的協作對於我們建立有效的安全防護至關重要。正如我們的原則所闡明,沒有任何 AI 實驗室能夠單獨應對新興風險。「私有安全處理」反映了這種方法,並正由來自各行各業、地區和公司規模的客戶共同塑造。

我們合作的組織處理著其行業中最敏感的一些資訊,包括財務記錄、健康數據、機密商業計畫和專有研究。保護這些資訊對於履行監管義務、維持客戶信任以及保持其競爭優勢至關重要。

客戶的回饋正幫助我們建立更強大的安全防護措施,同時讓他們的資訊保持在自己的控制之下。

Glean 資訊長 Sunil Agrawal 表示:「企業採用 AI 完全取決於客戶對資料的控制權,除了所選服務之外,不得有任何直接或衍生用途。OpenAI 的不訓練承諾和 ZDR 讓 Glean 有信心與 OpenAI 合作。隨著模型能力越來越強,OpenAI 證明安全可以進步,同時不損害維持企業信任的隱私和控制權。」

我們將繼續與客戶合作,完善我們方法的技術和營運細節。我們計畫在九月開始推出「私有安全處理」並分享一份技術白皮書。我們將全程讓客戶知情,及早分享更新,解釋這些更新對現有承諾的意義,並提供客戶所需的時間和支援以提前規劃。