SheepNav
新上线今天0 投票

Anthropic 详解 Claude 隐形文字水印:如何在不影响质量的前提下标记 AI 生成文本

为了满足欧盟《人工智能法案》的透明度要求,Anthropic 近日公布了其将如何为 Claude 生成的文本添加隐形水印。该公司表示,其文本标记系统采用了 Google DeepMind 开发的开源技术 SynthID-Text 的“一个版本”,该技术通过调整词语选择的概率来嵌入可检测的隐藏模式,而不会影响文本的阅读体验。

水印如何工作?

Anthropic 用了一个生动的例子来解释:在句子“The weather today was cold and…”中,下一个词是“sugary”的可能性极低,而“overcast”或“grey”则很常见。在大多数情况下,选择哪个词对读者来说无关紧要,因此模型通常通过随机数来决定。水印技术正是利用这些“低风险”的选择,通过预设的密钥和前面的几个词来引导选择,从而在整段文本中留下一种人类无法察觉、但持有密钥的检测工具可以识别的模式。

不影响质量和成本

Anthropic 强调,该水印功能不会增加用户的使用成本,也不会对 Claude 输出的质量或内容产生实际影响。这意味着,无论是免费用户还是付费用户,都无需担心水印会改变文本的流畅性或准确性。

欧盟 AI 法案的合规要求

欧盟《人工智能法案》要求,合成音频、图像、视频和文本必须包含机器可读的标记,以便识别内容是否由 AI 生成或操纵。Anthropic 的文本水印和针对 Claude 处理图像的 C2PA 支持,正是为了满足这一要求。值得注意的是,其他主要 AI 开发商也面临同样的合规压力,因此 Anthropic 的解决方案可能为行业提供参考。

行业背景与展望

随着 AI 生成内容的普及,如何平衡透明度与用户体验成为关键。SynthID-Text 作为开源技术,其采用可能推动行业标准化。然而,水印的鲁棒性(例如能否被去除或篡改)仍是未知数,Anthropic 也未透露密钥的管理方式。对于企业和开发者而言,这一功能意味着更合规的 AI 应用,但具体实施效果还需在实际场景中检验。

总之,Anthropic 的隐形水印方案是 AI 透明度领域的一次重要尝试,它通过巧妙的技术设计,在满足监管要求的同时,尽量不打扰用户的正常使用。未来,随着 AI 法规的完善,类似的技术可能会成为行业标配。

延伸阅读

  1. 查询知道该遗忘什么:线性注意力中的第二擦除方向
  2. 对比学习赋能对撞机实验:可解释异常检测新框架ORCA
  3. 无需训练的知识迁移:激活引导剪枝实现跨规模模型融合
查看原文