Anthropic 已澄清其计划如何在 Claude 生成的文本中应用隐形水印,以遵守欧洲的 AI 透明度规则。上周五,Anthropic 宣布 Claude 的文本标记系统是“SynthID-Text 方法的一个版本”——这是一种由 Google DeepMind 开发的开源水印技术,利用词汇概率创建可检测的模式。
该水印功能与 Claude 处理图像的 C2PA 支持一同推出,旨在使 Anthropic 履行《欧盟人工智能法案》规定的义务。该法案要求合成音频、图像、视频和文本包含机器可读标记,以便内容可被检测为人工生成或操纵。Anthropic 表示,文本水印不会让用户使用 Claude 的成本更高,也“不会对 Claude 输出的质量或内容产生任何实际影响”。以下是 Anthropic 对其工作原理的解释:
以“今天天气很冷,而且……”这句话为例。下一个词不太可能是“甜的”。但很有可能是“阴天的”或“灰蒙蒙的”。在大多数情况下,读者并不太在意模型最终选择这两个词中的哪一个——句子的含义无论哪种方式都基本相同。在这种情况下,选择由随机数决定。水印利用这类低风险选择——在生成的文本中会出现多次——在 Claude 的回复中留下一种模式。这种模式对读者来说是不可见的,但任何拥有编码密钥的人都可以检测到。使用水印时,选择仍然是随机的,但随机性的来源不同。水印不使用任意的随机数生成器来选择下一个词,而是使用密钥和前面的几个词来决定模型应选择哪个词。
正如 Anthropic 所指出的,欧盟的 AI 透明度要求也影响了其他主要 AI 开发商,因此 Claude 不会是唯一引入文本水印的模型。Google 的 Gemini 聊天机器人自 2024 年起就支持 SynthID-Text 解决方案,而 OpenAI 虽然尚未在其 AI 法案合规路线图中详细说明 ChatGPT 的文本水印计划,但它也将受到该法律要求的约束。