OpenAI 將在歐盟版 ChatGPT 及 Codex 產生的文字中嵌入隱形浮水印,但其內部測試顯示,只要替換約 10% 用字,偵測成功率便由約 92% 跌至約 66%。
要點速覽:
- 未來數周內,歐盟地區所有付費及免費 ChatGPT、Codex 用戶陸續啟用新浮水印;API 客戶則可自選開關。
- 內部評估發現,如替換 25% 字詞為同義詞,偵測率再大跌至 17%。
- 初期偵測工具只向獲批研究人員及專業機構開放,一般用戶無權使用。
OpenAI 歐盟浮水印部署
OpenAI 周一在官方博客 公布 計劃,指未來數周會向歐盟地區所有合資格 ChatGPT 及 Codex 用戶推送隱形浮水印功能,涵蓋各級收費方案,但推出時不會即時擴展為全球預設標準。
另一方面,全球使用 OpenAI API 的開發者,即日起可為部分模型 手動啟用 浮水印,不過預設仍為關閉。是次部署,被視為配合《歐盟人工智能法》(EU AI Act)中有關「標示義務」的條文——相關要求已於 8 月 2 日生效,規定供應商須讓機器能識別 AI 生成文本。已在市面營運的公司 最遲須在 12 月 2 日前 完成符合。
延伸閱讀: 幣安 AI Agent 從自然語句自動砌策略、代客落盤收費 19.99 USDC
textGrain 偵測技術與局限
OpenAI 這套方法名為 textGrain,並不在文字上加入任何肉眼可見標記,而是微調模型選字偏好,在文字中留下統計特徵,讓專用偵測器讀取,即使內容被複製、貼上或轉傳,該特徵理論上仍會「隨文同行」。
OpenAI 指出,textGrain 的效果與其測試過的其他方法相若甚至更佳,包括 Google 用於文字的 SynthID,且公司計劃將技術開源。
然而,一經編輯,訊號便會顯著削弱。
在長度約 400 token 的段落測試中,若只將約 10% 字詞改為同義詞,偵測率便由約 92% 跌至 66%;若把 25% 字詞替換,偵測率更被 壓低 至僅約 17%。篇幅較短、數學答案及翻譯文本亦較難被標記,例如在心理學等題材、長度約 200 token 的段落,在僅 1% 誤報率設定下,偵測率約為 80%。
ChatGPT 偵測器誰可用?
OpenAI 稱,現階段偵測工具只會向獲批准的研究人員及專業機構開放,並未打算面向公眾,理由是目前技術仍存在漏檢及誤報風險。
公司同時強調,若偵測不到浮水印,「並不代表內容必然由真人撰寫」;而浮水印本身亦不會紀錄或揭示具體用戶身份、帳戶、或背後使用的提示(prompt),只標示內容曾否由相關模型生成。
此舉延續了 Anthropic 在 8 月作出的決定——該公司宣布會為其大模型 Claude 於全球生成的文字加上浮水印,當時曾惹來部分用戶不滿。據 2024 年報道,OpenAI 過去其實已研發過文字浮水印技術,但一度擱置,部分原因是擔心用戶因此轉投競爭對手。
目前 OpenAI 與 Google、Meta、Microsoft 及 Anthropic 等大型科技公司,均已 承諾遵守 歐盟的 AI 生成內容透明度實務守則,在標示 AI 內容及披露生成來源方面作出協調。

