Anthropic, 기념비적인 AI 저작권 소송에서 15억 달러 규모의 합의 도출

연방법원이 저자와 출판사 간의 Anthropic과 15억 달러 규모의 대규모 합의를 공식 승인하면서, AI 학습 데이터를 둘러싼 법적 분쟁의 역사적인 순간을 맞이했습니다. 이번 배상액은 미국 저작권 역사상 최대 규모이지만, 그 근간이 되는 법적 판결은 생성형 AI 개발의 미래에 복잡한 지형을 형성하고 있습니다.

재정적 세부 내역 및 불법 복제 문제

이번 합의는 Anthropic이 대규모 언어 모델(LLM) 학습에 사용된 데이터를 어떻게 확보했는지를 중심으로 한 집단 소송의 결과입니다. 법원은 Anthropic이 일부 도서를 구매하기도 했지만, Library Genesis 및 Pirate Library Mirror와 같은 불법 복제 사이트에서 수백만 개의 저작물을 불법으로 다운로드했다는 사실을 확인했습니다.

소송을 해결하고 잠재적으로 더 큰 피해를 줄 수 있는 배심원 재판을 피하기 위해, Anthropic은 약 50만 개의 저작물에 대해 작품당 3,000달러를 지급하기로 합의했습니다. 이 자금은 침해된 자료에 대한 권리를 보유한 저자와 출판사들에게 배분될 예정입니다. Araceli Martinez-Olguin 판사가 최종 승인에 서명함으로써, 이전 판사인 William Alsup 체제에서 시작된 절차가 마무리되었습니다.

"공정 이용(Fair Use)"을 향한 논란 섞인 승리

막대한 재정적 벌금에도 불구하고, AI 학습의 핵심 원칙과 관련해서는 법적 승리가 대체로 Anthropic의 몫이 되었습니다. 기술 업계에 충격을 안겨준 이번 결정에서 Alsup 판사는 저작권이 있는 텍스트로 AI 모델을 학습시키는 것이 "공정 이용(fair use)"에 해당한다고 판결했습니다.

이 구분은 매우 중요합니다. 법원은 텍스트로부터 학습하는 행위 자체에 대해 Anthropic을 처벌한 것이 아니라, 데이터 확보 방식, 즉 불법 복제 저장소를 사용한 점에 대해 처벌한 것입니다. 모델 학습의 적법성과 데이터 소싱의 적법성을 분리함으로써, 법원은 AI 연구소들이 학습 데이터 세트를 합법적인 경로를 통해 확보했음을 증명할 수 있다면 상당한 법적 보호막을 제공하게 되었습니다.

이것이 AI 법적 전쟁의 종결이 아닌 이유

이번 사건이 Anthropic에게는 한 장의 막을 내리게 해주었지만, 전국적으로 구속력 있는 선례를 남긴 것은 아닙니다. Anthropic이 합의를 선택했기 때문에, 이 사건은 업계 전체에 적용될 확정적인 규칙을 세우기 위해 항소 법원까지 올라가지 않을 것입니다. 결과적으로 "공정 이용" 문제는 다른 주요 기업들에게 여전히 미결 상태의 전쟁터로 남아 있습니다.

현재 AI 업계는 유사한 소송의 물결에 직면해 있습니다. Google, Meta, Midjourney, OpenAI를 포함한 기업들은 모두 자신들의 학습 방법론과 관련된 진행 중인 소송을 헤쳐 나가고 있습니다. 예를 들어, Hachette, Cengage, Elsevier와 같은 거물급 기업들이 참여한 최근의 집단 소송은 Google이 Gemini 플랫폼을 학습시키기 위해 저작물을 사용했다고 비난하고 있습니다. 상급 법원이 확정적인 판결을 내릴 때까지, AI 학습의 법적 지위는 각 지역 법원의 결정들이 얽혀 있는 불완전한 상태로 남을 것입니다.

핵심 요약

  • 역사적인 배상액: Anthropic은 청구 사항을 해결하기 위해 15억 달러를 지급하며, 약 50만 개의 저작물에 대해 작품당 3,000달러를 배분합니다.
  • 공정 이용 선례: 법원은 저작권이 있는 텍스트로 AI 모델을 학습시키는 것은 "공정 이용"에 해당한다고 판결했으나, 불법 복제 소스를 사용한 구체적인 방식은 불법으로 간주되었습니다.
  • 법적 불확실성 지속: 이번 건은 항소 판결이 아닌 합의였기 때문에, OpenAI, Google, Meta와 같은 기업들에게 AI 학습의 적법성 문제는 여전히 해결되지 않은 상태로 남아 있습니다.