OpenAI 将在欧盟为 ChatGPT 文本添加水印,以符合《AI 法案》
OpenAI 周一宣布,将在欧盟范围内为 ChatGPT 和 Codex 生成的文本添加隐形水印,以符合欧盟《人工智能法案》的透明度要求。该法案的相关条款已于 8 月 2 日生效,要求 AI 公司以其他系统可识别的方式标记 AI 生成内容。
水印如何工作
OpenAI 介绍,水印并非可见符号,而是通过微妙地调整模型的选词方式,在文本中留下一种读者无法察觉、但检测器可以识别的模式。由于水印存在于文字本身,当文本被复制粘贴时,水印会随之转移。OpenAI 表示,水印不会识别用户身份,且开启后模型性能没有出现明显变化。
OpenAI 同时发布了一份技术报告,介绍其名为 textGrain 的方法。该报告与宾夕法尼亚大学和耶鲁大学的研究人员合著,展示了如何使用密钥对下一个词的预测进行排序以完成句子。将数百次这样的微调叠加起来,检测器仅凭文本和密钥就能识别 AI 生成内容。
编辑可削弱检测
OpenAI 的测试表明,水印可以通过编辑去除。在一项测试中,将 10% 的词语替换为同义词后,检测率从约 92% 降至 66%。该公司还表示,短段落、数学答案和翻译文本更难被检测到。
OpenAI 称:“这些局限性促使我们决定,初期仅向经过批准的研究人员和专家组织提供检测器访问权限,他们可以帮助我们评估可靠性和负责任的使用方式。”
OpenAI 还提醒,缺少水印并不能证明文本由人类撰写。文本可能太短、被过度编辑,或者来自其他公司的 AI。该公司表示:“水印可以表明 OpenAI 系统生成或处理了某段文字的一部分,但不能说明其中包含多少人类判断、编辑或创造力。”
与 Anthropic 的对比
此次宣布距 Anthropic 表示将为 Claude 生成的文本添加水印已有两个月,后者在全球范围内应用了这一措施。该决定引发了一些 Claude 用户的反对,他们认为自己提供的指令……(原文此处截断)。
OpenAI 表示,水印将在未来几周内向欧盟所有套餐的符合条件的 ChatGPT 和 Codex 用户推出,但仅限于欧盟。全球范围内使用 OpenAI API 的开发者即日起可为特定模型开启该功能,默认关闭。OpenAI 称,在推出初期不会将文本水印设为全球默认。
