OpenAI 将仅在欧盟为 ChatGPT 文本添加水印

- OpenAI 将在欧盟地区为符合条件的 ChatGPT 和 Codex 文本添加不可见的水印。
- 其 textGrain 系统将统计信号嵌入到词汇选择中,而非可见的元数据。
- 编辑会显著削弱检测效果,因此 OpenAI 在发布初期限制了检测器的访问权限。
OpenAI 于周一宣布,已开始为欧盟地区的用户标注由其 AI 系统 ChatGPT 和 Codex 生成的文本,这是为了遵守于 8 月 2 日生效的《欧盟人工智能法案》所要求的透明度规定。
这些规则要求人工智能公司以其他系统可读取的形式标注机器生成的内容,违反第50条将面临高达1500万欧元或全球年营业额3%的罚款。该功能将在未来几周内逐步向所有计划中的符合条件的账户开放,但仅限欧盟区域内使用。
据TechCrunch报道,开发者可从任何位置通过API访问该功能,自今日起即可为特定模型启用此功能;不过,在客户主动激活之前,该功能将保持未激活状态。
我们正在扩展内容溯源方法,以响应欧盟监管要求,涵盖文本生成内容,同时承认当前文本水印技术存在显著局限性。
我们的工具已帮助验证图片或音频文件是否由我们……
— OpenAI (@OpenAI) 10月5日,2026
textGrain 将水印隐藏在模型的用词选择中
OpenAI 的 textGrain 系统的工作原理是:当 ChatGPT 面临多个同样合适的词语选项时,系统会对其选择进行轻微引导。在足够长的文本中,这些微小决策会累积形成一种统计模式,肉眼无法察觉,但可通过专用软件检测出来。
由于水印直接嵌入在文本措辞中,而非存储在文件元数据里,即使文本被复制粘贴到其他位置,水印仍可被检测到。
OpenAI 与宾夕法尼亚大学和耶鲁大学的研究人员共同开发了该系统。他们的技术论文指出,textGrain 使用一个密钥对可能的下一个词进行排名,并微妙地偏向某些选择。当这些选择中的足够多出现在一段文本中时,拥有相同密钥的软件可以识别该模式,并确定该文本很可能由 OpenAI 模型生成或处理。
OpenAI 表示,该水印不包含任何可识别生成文本用户的信息。该公司还称,其测试发现,在启用 textGrain 的情况下,GPT-6 Astra 的性能并未出现明显下降。
轻度编辑会显著削弱水印检测效果
OpenAI 同时公布了该系统的局限性。在其测试中,仅将 10% 的单词替换为同义词,就使检测率从约 92% 降至 66%。此外,在简短段落、数学答案以及翻译后的文本中,水印更难被检测出来。
由于存在这些局限性,OpenAI 目前将限制其检测工具的使用范围,仅限授权研究人员和专家机构使用。该公司还指出,无法检测到水印并不能证明文本是由人类撰写的。这可能是因为文本过短、经过大量编辑,甚至是由其他公司的模型生成的。
水印可以表明某段文字的部分内容是由 OpenAI 系统生成或处理的,但无法反映其中投入了多少人类判断、编辑或创意。
– OpenAI
Anthropic 选择全球范围的水印策略,而 OpenAI 则先从欧洲开始实施
今年8月,Anthropic 开始在全球范围内对 Claude 的输出内容进行水印标记。起初,这似乎比仅在欧洲实施水印的 OpenAI 政策更为广泛,但背后的原因是技术性的:Anthropic 当时尚未具备限制区域水印的技术系统。
两家公司已于7月签署了欧盟《关于人工智能生成内容透明度准则》,与 Google、Meta、Microsoft 和 Mistral 等约190家其他组织一同加入。因此,它们的水印举措是对自8月2日起生效的欧盟透明度要求的响应。
Anthropic 的这一推广仍遭到部分用户的批评,他们认为用户提供了想法、指令和判断,而 Claude 主要是在写作方面提供帮助。
据《华尔街日报》报道,OpenAI 早在多年前就创建了文本水印系统,但出于担心用户可能转向不使用水印输出的其他 AI 系统的顾虑,该公司选择不公开该系统。
最聪明的加密领域人士已经在阅读我们的通讯。想加入吗?加入他们。

Micah Abiodun
Micah Abiodun 充分利用其在塔林理工大学(TalTech)获得的环境工程与管理硕士(MSc)学位,为 Cryptopolitan 打磨内容并撰写价格预测新闻。如今他已在加密媒体领域深耕第 7 个年头,专注于报道主流加密货币、山寨币、DeFi、稳定币、宏观趋势及新兴技术。
















