OpenAI正測試一套全新安全系統,在不保留客戶數據的情況下偵測不當使用,正面挑戰競爭對手Anthropic最新推出、要求保留數據30日的政策。
重點整理:
- OpenAI預覽「Private Safety Processing」,可在不保留客戶提示(prompt)及回覆的情況下,於相關工作階段之間偵測濫用模式。
- Anthropic要求其最強大模型的企業客戶,必須保留使用記錄30日,稱此舉是為了攔截多步驟攻擊。
- OpenAI計劃在9月擴大推出相關功能,並發表技術白皮書。
「Private Safety Processing」主攻跨工作階段濫用
公司於周三宣布推出預覽版,並將此定位為「Zero Data Retention」安排的延伸——在該安排下,一旦請求處理完成,OpenAI不會保留任何提示內容或模型回覆。較大規模的部署及技術白皮書預期在9月公布。
按新設計,客戶內容要麼留在由企業自行管理的基建上,要麼存放於OpenAI的系統,但以只由客戶掌握的金鑰加密。自動化工具會在這些內容中搜尋跨多個相關工作階段的濫用模式。設計亦涵蓋「智能代理」工作,即系統在用戶表面上已叫停後仍可能繼續運作的情況;在整個過程中,OpenAI員工不會接觸到這些內容。
公司產品政策主管Aleah Houze向記者表示,不少高風險行為只有在將多次互動一併審視時才會顯現。她舉例指,用戶可能先在一段對話中試探軟件弱點,再在另一段對話詢問遠程存取工具。
延伸閱讀:Claude隱藏水印扭曲寫作工藝,Gruber直言不滿
Anthropic 30日留存政策突顯兩家路線分歧
Anthropic在7月闡述相反策略,規定使用其最強大模型(包括Fable 5及Mythos 5)的企業客戶,必須把數據保留30日。
該實驗室承認此政策未必受市場歡迎,甚至可能損害業務,但堅稱留存紀錄是偵測刻意分散於多個請求中的攻擊行為所「不可或缺」的條件。有人為覆核空間仍然保留,但僅透過嚴格管控的流程,由一小撮獲批准的審查人員進行。每個工作階段都會被寫入防篡改記錄。相關紀錄機制全程封存。
分析師質疑OpenAI時機與證據
政策研究機構FormerGov執行董事Brian Levine在評論中指,OpenAI此承諾在技術層面算是「相當強烈」,因為歷來要同時做到內容監察與對內容「視而不見」,二者往往互相牴觸。
他亦指出,真正的技術證據要數星期後才會出爐。Moor Insights and Strategy的Jason Andersen則認為,OpenAI本周密集公布相關消息,某程度上是在為首次公開招股(IPO)前「擺位」。
LexisNexis Risk Solutions Group首席資訊安全官Flavio Villanustre則視之為OpenAI試圖在預期香港及歐美更嚴厲監管之前,先行「軟化」監管環境的舉措。
這次預覽為OpenAI一整周的安全訊息攻勢畫上句號。公司周二表示,已放緩擴展步伐,並暫停強化學習訓練,以便加固研究環境及進行更嚴格的紅隊測試。公司同時估算,擴大監察機制後,相關安全監控將消耗約20%的受監控推理運算資源。





