Anthropic 将在其 Claude 模型生成的每一段文本和文件中嵌入隐藏的数字签名,此举旨在满足欧盟新的 AI 透明度规则。该变更适用于 8 月 2 日欧盟《AI 法案》透明度准则生效后发布的所有模型,并将自动出现在 Claude 的 API、Code、Cowork 和 Tag 界面中。

为什么欧盟规则至关重要

透明度准则要求开发者对 AI 生成或编辑的内容进行标记,以便下游系统能够识别其合成来源。该规则旨在遏制虚假信息,并在用户接触机器创作的内容时提供明确信号。Anthropic 的应对方案——模型级水印——是将标记直接植入输出内容中,而不是将其附加在产品 UI 上。

其他 AI 巨头也做出了类似的承诺。Google、Meta、Microsoft、OpenAI 和 Black Forest Labs 都表示将符合欧盟标准。对于非文本资产,Anthropic 将使用 C2PA 开放标准,这是一种用于在图像、视频和其他媒体中嵌入来源数据的公开文档方法。通过遵循开放规范,Anthropic 希望其标记能够与记者、平台和事实核查人员现有的工具协同工作。

水印的工作原理

Anthropic 表示,水印已植入模型的文本生成过程中。在实践中,该签名成为了模型输出的 token 流的一部分。当用户将文本复制到文字处理器、电子邮件或社交媒体帖子中时,隐藏的模式会随之移动。该公司指出,水印可以经受住适度的编辑,但尚未透露在标记消失前需要更改多少个字符。

“Claudefishing”担忧

Anthropic 的这一举措是在人们对大语言模型 (LLM) 滥用行为的担忧日益增长之际推出的。Substack CEO Chris Best 最近创造了“Claudefishing”一词,用来描述利用 AI 创作模仿特定作者口吻的欺骗性内容的行为。随着合成文本越来越难以与人类写作区分开来,来源的自动检测成为了至关重要的防线。

Anthropic 并非唯一在增加防护措施的公司。音乐生成平台 Suno 和新闻通讯服务 Substack 都引入了标记机制,在内容由 AI 创建时提醒读者。通过在源头嵌入水印,Anthropic 旨在使该信号更难被剥离,并更容易被下游过滤器识别和处理。

核心要点

  • 合规性: Anthropic 正在实施水印技术以符合 8 月 2 日生效的欧盟《AI 法案》透明度准则。
  • 模型级集成: 水印应用于模型层级,因此它们在所有产品(API、Claude Code 等)中均可持久存在,并能经受住复制粘贴操作。
  • 标准化的文件标记: 对于文件,Anthropic 将使用 C2PA 开放标准,以确保数字内容的互操作性和透明度。