Anthropic 为 Claude 生成的文本推出了水印,以满足《欧盟人工智能法案》(EU AI Act) 的要求,即合成内容必须以机器可读的方式进行清晰标记。该公司表示,该技术可以在不降低模型速度或消耗额外 token 的情况下标记 AI 编写的文本,监管机构和竞争对手很快将对这一说法进行验证。
为什么水印很重要
该水印通过私钥和上下文环境,在词汇选择决策中植入特征。读者无法察觉到这种模式,但了解私钥的验证器可以识别它。在实际应用中,下游工具会扫描文档并报告该文档是否由 Claude 生成。
监管压力
《欧盟人工智能法案》强制要求生成式系统的提供商在合成内容中嵌入可检测的信号。
商业权衡
企业在决定是否采用此类标记时,需要权衡三个方面的考量:
- 可追溯性限制 —— 水印可以确认文本来自 AI 模型,但无法将输出内容与特定的用户或账户关联起来。当 AI 生成的内容被滥用时,这一缺口使得问责变得困难。
- 营收风险 —— 一些提供商担心,可见的水印可能会吓跑多达三分之一的客户,因为出于竞争或隐私原因,这些客户更倾向于使用未标记的文本。
- 技术约束 —— 嵌入模式可能会略微削减模型输出的创造力,尤其是在字数极少的短文本片段中,水印可利用的词汇较少。用户还可以通过手动改写部分文本来稀释信号,从而增加检测难度。
Anthropic 押注其方法可以规避大部分此类缺点。通过将密钥编织进 token 选择过程中,该公司声称不会增加延迟,也不会产生额外的 token 成本,从而保留了付费客户所期望的用户体验。
技术挑战
可检测性取决于验证器是否拥有生成时使用的相同私钥。短文本仍然是一个薄弱环节,因为其统计模式不够明显,从而提高了漏报率。水印也无法阻止下游的编辑;如果用户改写了半个段落,实际上就可以抹除标记。
核心结论: Anthropic 的水印回应了新的法律指令,但其影响将取决于它如何在可检测性、灵活性降低以及被绕过的风险之间取得平衡。
