AI 模型的濫用風險與企業數據私隱之間的矛盾,正成為企業採用 AI 時最頭痛的難題。8 月 19 日,OpenAI 宣布推出 Private Safety Processing(私隱安全處理)預覽服務——一套全新的自動化監控系統,能夠在保留企業客戶私隱的同時監測潛在濫用行為。更關鍵的是:它完全不做任何數據保留。
據 TechCrunch 報導,這項服務被視為 OpenAI 對其主要競爭對手 Anthropic 的直接反擊。Anthropic 在 7 月宣布的「涵蓋模型」(Covered Models)數據保留政策,允許該公司將用戶的所有對話數據保留長達 30 天,目的是讓安全團隊能夠審查和分析潛在的不當使用行為。這項政策雖然出發點是安全,但對於處理大量敏感數據的企業客戶來說,無疑是一道紅線。
Private Safety Processing 如何運作?
要理解 OpenAI 這項新技術的獨特之處,首先需要了解行業標準的「零數據保留」(Zero Data Retention,ZDR)政策。
目前多數 AI 公司(包括 OpenAI 和 Anthropic)在標準 API 上都遵循 ZDR——即 API 調用中的數據不會被模型提供商保留。但 Anthropic 的例外在於,其「涵蓋模型」(包括所有 Mythos 級模型及未來同等能力的模型)會將用戶對話保留 30 天供人工審查。
Private Safety Processing 則在 ZDR 之上更進一步。它是一種長時域安全監控(Long-Horizon Safety Monitoring)技術,不僅分析單次對話的輸入和輸出,還能跨越多個對話進行比對——而且全過程由 AI Agent 自動完成,不涉及任何人工審查。
OpenAI 發言人解釋,新的技術能夠更有效地偵測跨會話的惡意行為。傳統的安全監控只檢查單次請求,但真正的惡意行為者往往會將惡意請求分散到多次對話中,以逃避檢測。例如,一個試圖製作惡意軟件的攻擊者,可能會分多次、在不同對話中逐步獲取所需的資訊。Private Safety Processing 能夠將這些分散的請求關聯起來,識別出潛在的攻擊模式。
當系統被觸發時,它會向 OpenAI 發送一個「狹義定義的信號」,指示特定類型的可疑活動。OpenAI 必須根據該信號決定是否需要執行進一步行動。如果需要,OpenAI 會聯絡客戶而不是直接查看數據——客戶可以自行決定是否分享更多上下文。
Anthropic 的立場:透明度與控制
Anthropic 對數據保留的態度並非沒有道理。該公司指出,其人工審查僅通過「受控訪問路徑」進行,只涉及「一小組經批准的審查員」,且每個審查會話都會記錄在無法篡改的日誌中。Claude Fable 的水印技術(8 月 15 日詳細公開)也進一步強化了模型輸出的可追溯性。
但對於亞洲特別是香港的企業客戶而言,數據一旦離開企業控制範圍,即使有「嚴格的審查路徑」,也很難滿足本地監管要求。香港個人資料私隱專員公署(PCPD)對跨國數據傳輸和數據處理有明確規範,尤其是在涉及金融、醫療等高度監管行業時。
為香港企業帶來的實際考量
1. AI 供應商的數據政策已成為選型關鍵
香港企業在評估 AI 供應商時,傳統上更關注模型性能、價格和功能覆蓋。但 Private Safety Processing 的推出標誌著數據治理政策本身已成為競爭差異化因素。如果你正在建立企業級 AI 策略,現在需要將以下問題納入供應商評估標準:
- 數據保留政策是什麼?哪些模型屬於例外範圍?
- 安全監控是否涉及人工審查?審查者是否在美國/海外?
- 能否獲得書面的數據處理協議(DPA)?
- 能否在特定地理區域內完成所有推理和監控?
2. 金融業的敏感數據尤為關鍵
香港作為國際金融中心,銀行、保險和證券公司對客戶數據的保護要求極高。有趣的是,Reuters 同日報導指出,滙豐(HSBC)和花旗(Citi)已採用螞蟻國際的 AI 外匯工具,反映金融機構正在積極探索 AI,但對數據治理的要求也最嚴格。OpenAI 的新政策可能讓一些原本傾向 Anthropic 的金融客戶重新考慮。
3. 「安全」與「私隱」並非二選一
傳統觀點認為,要實現有效的安全監控,就必須保留數據供審查。OpenAI 的 Private Safety Processing 證明了AI Agent 可以同時做到兩者——自動監控濫用行為,同時不讓任何人類看到你的數據。雖然這項技術目前僅向選定客戶提供預覽,但可以預期類似能力會很快成為 AI API 的標準配置。
行業背景:AI 安全壓力與日俱增
OpenAI 在安全和私隱領域的動作並非孤立事件。Reuters 報導同日指出,OpenAI 因應近期 Hugging Face 安全漏洞事件,已放慢了模型訓練節奏以強化安全措施。此外,美國商品期貨交易委員會(CFTC)正就 AI 算力衍生產品尋求公眾意見——監管機構對 AI 基礎設施的重視程度正在迅速提高。
與此同時,OpenAI 於 8 月 18 日推出了針對青少年的安全版 ChatGPT,配備更強的安全護欄。這一連串動作顯示,AI 龍頭之間的競爭正從「誰的模型更強」轉向「誰的生態更可信」。
立即行動
- 審視目前使用的 AI API 的數據保留條款:檢視與 OpenAI、Anthropic、Google、Microsoft 等供應商的數據處理協議,特別注意「涵蓋模型」或「例外模型」條款。
- 要求供應商提供 ZDR 書面承諾:如果你的業務涉及客戶個人資料(尤其是金融、醫療、法律行業),確保供應商能以書面形式確認零數據保留政策。
- 建立 AI 數據分類制度:對擬交給 AI 處理的數據進行分類——哪些可以送往外國 API、哪些必須在本地部署的模型上處理。不同敏感度的數據應對應不同的模型選擇策略。
- 密切關注 Private Safety Processing 正式發布:OpenAI 表示此項服務目前為「預覽」階段,正式推出後應第一時間評估是否適合企業環境。
總結:一場「誰更可信」的競賽
OpenAI 與 Anthropic 之間的競爭,過去集中在模型性能(誰的基準分數更高)、定價(誰的 Token 更便宜)和功能(誰的生態更豐富)。Private Safety Processing 的出現,將競爭維度擴展到數據治理和客戶信任——這恰恰是企業決策者(而非開發者)最關心的問題。
對於香港企業而言,好消息是市場正在提供更多選擇。無論是 OpenAI 的零保留監控,還是 Anthropic 的透明審查機制,又或者是阿里巴巴 Qwen 3.8 等可在本地部署的開源模型,不同的數據治理需求都能找到對應方案。關鍵在於:先了解自己的數據合規需求,再選擇匹配的 AI 供應商——而非反過來。