OpenAI周一在一篇博客文章中表示,为遵守欧盟《人工智能法案》,公司将开始在欧盟为ChatGPT和Codex生成的文本加入一种不可见水印。
欧盟《人工智能法案》的透明度规则已于8月2日生效,要求AI公司以可被其他系统识别的方式标记AI生成内容。
OpenAI表示,这项水印功能将在未来几周向欧盟境内所有套餐中符合条件的ChatGPT和Codex用户推出,但仅限欧盟。与此同时,全球任何地区使用OpenAI API的开发者从当天起都可以为部分模型开启这一功能;该功能默认关闭。OpenAI表示,在推出之初,不会将文本水印设为全球默认选项。
这种水印并不是实际可见的符号,而是通过细微调整模型的用词选择来实现,留下读者看不见、但检测器可以识别的模式。由于这种模式存在于文本本身中,因此在文本被复制粘贴后仍会保留。OpenAI表示,这种水印不会识别用户身份,而且在开启该功能后,公司没有观察到模型性能出现有意义的变化。
OpenAI还随公告一同发布了其方法的技术报告,这一方法名为textGrain。该报告由宾夕法尼亚大学和耶鲁大学的研究人员共同撰写,介绍了一个示例:使用密钥对下一个词的预测结果进行排序,以完成句子。通过数百次这样的微小引导,检测器便可以仅凭文本和密钥识别出AI生成内容。
水印能否通过编辑被移除?OpenAI的测试显示可以。在一项测试中,将10%的词替换为同义词后,检测率从约92%降至66%。公司还表示,较短的段落、数学答案以及翻译后的文本更难检测。

公司表示:“这些局限性促使我们决定,初期仅向获批研究人员和专业机构提供检测器访问权限,以便他们帮助我们评估其可靠性和负责任的使用方式。”
OpenAI还提醒称,缺少水印“并不能证明文本出自人类作者”。文本可能过短、被大量编辑,或者来自另一家公司的AI。
公司表示:“(水印)可以表明某段文字中的部分内容由OpenAI系统生成或处理,但无法说明其中包含了多少人类判断、编辑或创造力。”
这一公告发布于Anthropic表示将为Claude生成文本加入水印的两个月后,后者是在全球范围内实施这一举措。该决定曾引发部分Claude用户反弹,他们认为是自己提供了“指令、上下文、决策”,而Claude只是“工具”。
据《华尔街日报》2024年报道,OpenAI此前已经开发出一种文本水印,但一直未予发布,部分原因是担心用户会转向那些不加水印的竞争对手。
Anthropic、Google、Meta、Microsoft和OpenAI都在承诺遵守欧盟关于AI生成内容的行为准则的公司之列。












