Anthropic 在里程碑式的 AI 版权诉讼中获得 15 亿美元和解协议
一位联邦法官已正式批准 Anthropic 与作者及出版商之间高达 15 亿美元的和解协议,这标志着围绕 AI 训练数据的法律斗争进入了一个历史性时刻。尽管这笔赔偿金是美国版权史上规模最大的,但其背后的法律裁决为生成式 AI 的未来发展创造了一个复杂的局面。
财务明细与盗版问题
该和解协议源于一场集体诉讼,核心在于 Anthropic 获取用于训练其大语言模型的数据方式。法院发现,虽然 Anthropic 购买了一些书籍,但它还从 Library Genesis 和 Pirate Library Mirror 等盗版网站非法下载了数百万件受版权保护的作品。
为了解决诉讼并避免可能更具破坏性的陪审团审判,Anthropic 同意针对估计 50 万件作品,按每件作品 3,000 美元进行赔付。这些资金将分配给拥有被侵权材料权利的作者和出版商。法官 Araceli Martinez-Olguin 签署了最终批准,结束了由前任法官 William Alsup 发起的这一进程。
“合理使用”原则下的争议性胜利
尽管面临巨额经济处罚,但在 AI 训练的核心原则方面,法律上的胜利在很大程度上属于 Anthropic。在一项令科技界感到震惊的裁决中,Alsup 法官裁定,利用受版权保护的文本训练 AI 模型构成“合理使用”(fair use)。
这一区别至关重要:法院并没有因为 Anthropic 从文本中“学习”这一行为而对其进行处罚,而是针对其“获取方式”——特别是使用盗版资源库的行为——进行了处罚。通过将模型训练的合法性与数据来源的合法性区分开来,法院为 AI 实验室提供了一个重要的法律护盾,前提是它们能够证明其训练集是通过合法渠道获取的。
为什么这并不会结束 AI 法律战争
虽然此案为 Anthropic 划上了句号,但它并未建立具有约束力的全国性先例。由于 Anthropic 选择和解,该案件永远不会提交至上诉法院来为整个行业制定明确的规则。因此,“合理使用”问题对于其他主要参与者来说仍然是一个开放的战场。
AI 领域目前正面临着一波类似的诉讼浪潮。包括 Google、Meta、Midjourney 和 OpenAI 在内的公司都在应对有关其训练方法的活跃诉讼。例如,最近一起涉及 Hachette、Cengage 和 Elsevier 等巨头的集体诉讼指控 Google 使用受版权保护的作品来训练其 Gemini 平台。在更高层级的法院发布最终裁决之前,AI 训练的法律地位仍处于各地区法院裁决拼凑而成的碎片化状态。
核心要点
- 历史性赔付: Anthropic 将支付 15 亿美元以达成和解,针对约 50 万件受版权保护的作品,按每件作品 3,000 美元进行分配。
- “合理使用”先例: 法院裁定,利用受版权保护的文本训练 AI 模型属于“合理使用”,尽管使用盗版资源的行为被判定为非法。
- 法律不确定性依然存在: 由于这是一项和解而非上诉裁决,对于 OpenAI、Google 和 Meta 等公司而言,AI 训练的合法性仍未定论。
