OpenAI 将在欧盟为 ChatGPT 和 Codex 生成的文本嵌入“隐形水印”,但其内部测试显示,只需替换约 10% 的词汇,系统检测率就会从约 92% 降至 66%。
关键信息:
- 未来数周内,欧盟地区所有套餐下符合条件的 ChatGPT 与 Codex 用户将陆续接入该水印功能;API 客户仍为自愿选择开启。
- 在公司测试中,如将 25% 的词替换为同义词,检测率进一步下探至 17%。
- 上线初期,水印检测工具仅向经批准的研究人员及专业机构开放。
OpenAI 隐形水印在欧盟的落地路径
OpenAI 在一篇博文中公布了这项计划,称未来几周内,该标记机制将面向欧盟地区所有套餐下的 ChatGPT 和 Codex 合规用户逐步推送;但在上线阶段,它不会直接扩展为全球默认配置。
全球范围内的开发者,现已可通过 API 为部分模型手动开启文本水印功能,但默认仍保持关闭状态。此举被视为对欧盟《人工智能法案》的回应。该法案自 8 月 2 日起对“内容标记”提出强制要求,要求服务提供方必须让机器能够识别 AI 生成文本。对于已在市场运营的企业,合规宽限期截至 12 月 2 日,相关规定届时正式收紧。
延伸阅读:币安 AI 交易助手能读懂自然语言下单,策略费每笔收 19.99 USDC
textGrain:隐形水印的检测边界
OpenAI 此次采用的方案名为 textGrain。该方法不会在文本表面添加任何可见标记,而是通过在用词、表述选择上施加轻微偏好,形成一种统计层面的“纹理”,可被专门的检测器捕捉,并能随复制、转载一并传播。
OpenAI 表示,此方案在内部测试中与包括 Google 的文本版 SynthID 在内的其他水印技术相比,表现“相当或更优”,并计划在后续将相关技术以开源形式释放。
但水印信号极易被编辑削弱。
在对 400 个 token 长度文本的评估中,仅将约 10% 的词替换为同义词,就能把检测率从约 92% 拉低至 66%;当替换比例提升至 25% 时,根据第三方报道,检测率进一步跌至 17%。
此外,对于短文本、数学解答以及机器翻译后的内容,检测难度也明显上升。以约 200 个 token 的心理学主题文本为例,在保持约 1% 误报率的前提下,检测器的命中率约为 80%。
ChatGPT 检测器:先对“少数人开放”
出于对“漏检水印”和“误判为 AI 文本”的风险考量,OpenAI 暂时只向经审核的研究人员及专业机构开放水印检测工具。
公司同时强调,检测不到水印“并不能证明”文本一定是由人类撰写;水印本身也不会携带生成该段文本的具体用户身份、账号信息或具体提示词内容。
此举与 Anthropic 的策略形成呼应。后者在 8 月宣布,将在全球范围内为 Claude 生成文本添加水印,这一决定一度引发部分用户不满。根据 2024 年的一则媒体报道,OpenAI 早前其实已开发出文本水印技术,但迟迟未推向市场,部分原因是担忧用户因此“用脚投票”转向竞争对手。
目前,OpenAI 与 Google、Meta、Microsoft 及 Anthropic 等公司,已共同承诺遵守欧盟关于 AI 生成内容透明度的自律准则,就内容标记、溯源与虚假信息防治等方面承担更高披露义务。

