原文标题:OpenAI will start watermarking ChatGPT’s text in the EU

该公司周一在博客文章中表示,OpenAI 将开始在欧盟 ChatGPT 和 Codex 生成的文本中添加隐形水印,以遵守欧盟人工智能法案。

欧盟人工智能法案的透明度规则于 8 月 2 日生效,要求人工智能公司以其他系统可以识别的方式标记人工智能生成的内容。

OpenAI 表示,水印将在未来几周内向所有计划中符合资格的 ChatGPT 和 Codex 用户推出,但仅限于欧盟。从今天开始,世界各地使用 OpenAI API 的开发人员都可以为选定的模型启用它;默认情况下它是关闭的。 OpenAI 表示,它不会在发布时将文本水印设置为全球默认设置。

水印不是一个实际的符号,而是通过巧妙地塑造模型的单词选择来发挥作用,留下读者看不到但检测器可以拾取的模式。因为它存在于文字本身中,所以在复制和粘贴时它会随文本一起传播。 OpenAI 表示,水印无法识别用户的身份,并且打开水印后,模型的性能没有发生任何有意义的变化。

OpenAI 在发布公告的同时还发布了一份名为 textGrain 的方法的技术报告。与来自以下机构的研究人员共同撰写

宾夕法尼亚大学和耶鲁大学,它演示了一个使用密钥对下一个单词预测进行排序以完成句子的示例。将数百个这样的轻推加在一起,检测器可以仅使用文本和密钥来识别人工智能生成的内容。

可以通过编辑去掉水印吗? OpenAI 的测试表明是的。在一项测试中,用同义词替换 10% 的单词使检测率从大约 92% 下降到 66%。该公司还表示,短文、数学答案和翻译文本更难检测。

来源:openai OpenAI 图片来源:OpenAI

该公司表示:“这些限制促使我们决定仅向经批准的研究人员和专家组织提供初始探测器访问权限,他们可以帮助我们评估可靠性和负责任的使用。”

OpenAI 还警告说,缺失的水印“并不能证明作者身份”。文本可能太短或编辑过多,也可能来自另一家公司的人工智能。

该公司表示:“[水印]可以表明 OpenAI 系统生成或处理了一段段落的一部分,但不能表明其中涉及了多少人类判断、编辑或创造力。”

该公告是在 Anthropic 表示将

克劳德生成的水印文本,这一举措正在全球范围内应用。这一决定引起了一些克劳德用户的强烈反对,他们认为他们提供了“说明、背景、决定”,而克劳德只是“工具”。

据《华尔街日报》 2024 年报道,OpenAI 之前已经创建了文本水印,但推迟发布,部分原因是担心用户会转向没有水印的竞争对手。

Anthropic、谷歌、Meta、微软和 OpenAI 等公司都承诺遵守欧盟关于人工智能生成内容的行为准则。