การยอมความกรณีละเมิดลิขสิทธิ์มูลค่า 1.5 พันล้านดอลลาร์ของ Anthropic: ความสูญเสียเป็นประวัติการณ์และชัยชนะทางกลยุทธ์
Anthropic ได้บรรลุข้อตกลงยอมความครั้งประวัติศาสตร์มูลค่า 1.5 พันล้านดอลลาร์กับกลุ่มนักเขียน หลังจากถูกกล่าวหาว่าใช้ฐานข้อมูลที่ละเมิดลิขสิทธิ์ในการฝึกฝนโมเดล แม้ว่าการจ่ายเงินจำนวนมหาศาลนี้จะเป็นความสูญเสียทางการเงิน แต่รายละเอียดทางกฎหมายของคดีนี้อาจถือเป็นชัยชนะครั้งสำคัญสำหรับอุตสาหกรรม AI ในวงกว้างในประเด็นเรื่องการใช้งานโดยชอบธรรม (fair use)
รายละเอียดของการยอมความที่ทำลายสถิติ
ศาลรัฐบาลกลางในซานฟรานซิสโกได้อนุมัติการยอมความครั้งสำคัญ หลังจากมีหลักฐานเปิดเผยว่า Anthropic ได้ดาวน์โหลดหนังสือจากฐานข้อมูลละเมิดลิขสิทธิ์ที่มีชื่อเสียงอย่าง LibGen และ PiLiMi ในช่วงระหว่างปี 2021 ถึง 2022 ขนาดของการยอมความครั้งนี้ถือเป็นเรื่องที่ไม่เคยปรากฏมาก่อนในประวัติศาสตร์ของการฟ้องร้องแบบกลุ่ม (class action) โดยครอบคลุมผลงานที่ระบุไว้ประมาณ 482,460 รายการ
จากผลงานทั้งหมดที่เกี่ยวข้อง มีนักเขียนที่สามารถเรียกร้องสิทธิ์ได้สำเร็จถึงร้อยละ 91.3 โดยผู้เรียกร้องแต่ละรายจะได้รับเงินประมาณ 3,000 ดอลลาร์ ซึ่งเป็นจำนวนที่สูงกว่าขั้นต่ำตามกฎหมายถึงสี่เท่า และเพื่อเป็นส่วนหนึ่งของการยุติทางกฎหมาย Anthropic จะต้องทำลายไฟล์ที่ละเมิดลิขสิทธิ์ซึ่งถูกใช้ในช่วงเวลาดังกล่าว ที่สำคัญคือ การยอมความครั้งนี้ไม่ได้เป็นการให้สิทธิ์ขาดแก่บริษัท เนื่องจากนักเขียนยังคงมีสิทธิ์ในการฟ้องร้องหากผลลัพธ์จาก AI มีการทำซ้ำผลงานต้นฉบับ หรือหากแนวทางการจัดหาข้อมูลในอนาคตของ Anthropic ละเมิดกฎหมายลิขสิทธิ์
ประเด็นทางเทคนิคที่เป็นประโยชน์ต่อการพัฒนา AI
แม้จะมีราคาที่สูงถึง 1.5 พันล้านดอลลาร์ แต่บรรทัดฐานทางกฎหมายที่เกิดขึ้นจากคดีนี้กลับเป็นประโยชน์ต่อห้องปฏิบัติการ AI อย่างน่าประหลาดใจ การยอมความนี้มุ่งเน้นไปที่การกระทำเฉพาะเจาะจงในการใช้แหล่งข้อมูลที่ ละเมิดลิขสิทธิ์ แต่ไม่ได้ตัดสินถึงความชอบด้วยกฎหมายของการฝึกฝน AI โดยตัวมันเอง
ผู้พิพากษา Alsup เคยได้วางบรรทัดฐานความแตกต่างที่สำคัญไว้ว่า การฝึกฝน AI ด้วยหนังสือที่ได้รับมาอย่างถูกกฎหมายนั้นเป็นสิ่งที่ "สร้างสรรค์สิ่งใหม่ (transformative)—อย่างน่าทึ่ง"—และถือว่าอยู่ภายใต้หลักการใช้งานโดยชอบธรรม (fair use) อย่างชัดเจน ความแตกต่างนี้มีความสำคัญอย่างยิ่งต่อบริษัทอย่าง OpenAI, Google และ Meta เพราะมันบ่งชี้ว่า แม้ว่า แหล่งที่มา ของข้อมูล (การละเมิดลิขสิทธิ์ เทียบกับการจัดหาอย่างถูกกฎหมาย) จะเป็นความรับผิดทางกฎหมาย แต่ กระบวนการ ในการฝึกฝนโมเดลเพื่อให้เข้าใจภาษาและรูปแบบต่างๆ นั้นสามารถป้องกันได้ในทางกฎหมาย
พรมแดนที่ยังไม่ได้รับการแก้ไขของการดึงข้อมูลจำนวนมาก (Mass Scraping)
แม้ว่าคำตัดสินนี้จะเป็นทางรอดให้กับห้องปฏิบัติการที่ฝึกฝนโมเดลด้วยชุดข้อมูลขนาดใหญ่ แต่การต่อสู้ทางกฎหมายเรื่อง "การจัดหาข้อมูลอย่างถูกกฎหมาย" ยังคงอีกยาวไกล คำถามสำคัญยังคงเป็น: การดึงข้อมูล (scraping) เนื้อหาบนอินเทอร์เน็ตจำนวนมากโดยไม่ได้รับความยินยอมอย่างชัดเจนจากเจ้าของเว็บไซต์ ถือเป็นการจัดหาข้อมูลอย่างถูกกฎหมายหรือเป็นการละเมิดลิขสิทธิ์กันแน่?
การยอมความครั้งนี้ชี้ให้เห็นถึงความเป็นจริงทางกฎหมายที่แยกเป็นสองทางสำหรับอุตสาหกรรม AI บริษัทต่างๆ สามารถหลีกเลี่ยงค่าปรับมหาศาลได้โดยการตรวจสอบให้แน่ใจว่ากระบวนการจัดหาข้อมูล (data pipelines) ของตนไม่มีการใช้คลังข้อมูลที่ทราบว่าละเมิดลิขสิทธิ์ แต่พวกเขายังคงต้องเผชิญกับสถานการณ์ที่ไม่แน่นอนเกี่ยวกับสิทธิ์ของผู้เผยแพร่เนื้อหาบนเว็บและผู้สร้างสรรค์ผลงาน ในขณะที่ห้องปฏิบัติการ AI ยังคงขยายตัวต่อไป ความตึงเครียดระหว่างความก้าวหน้าทางเทคโนโลยีที่สร้างสรรค์สิ่งใหม่กับสิทธิ์ในทรัพย์สินทางปัญญาจะยังคงเป็นอุปสรรคทางกฎหมายที่สำคัญที่สุดของอุตสาหกรรมนี้
สรุปประเด็นสำคัญ
- การจ่ายเงินทำลายสถิติ: Anthropic จะจ่ายเงิน 1.5 พันล้านดอลลาร์ให้แก่นักเขียนหลังจากใช้ฐานข้อมูลที่ละเมิดลิขสิทธิ์อย่าง LibGen ซึ่งถือเป็นการยอมความด้านลิขสิทธิ์ครั้งใหญ่ที่สุดในประวัติศาสตร์ของการฟ้องร้องแบบกลุ่ม
- บรรทัดฐานการใช้งานโดยชอบธรรม: ศาลยืนยันว่าการฝึกฝน AI ด้วยข้อมูลที่ได้รับมาอย่างถูกกฎหมายนั้น "สร้างสรรค์สิ่งใหม่ได้อย่างน่าทึ่ง" ซึ่งเป็นการสร้างเกราะป้องกันทางกฎหมายที่สำคัญสำหรับการฝึกฝน AI ที่ชอบด้วยกฎหมาย
- ความถูกต้องของข้อมูลคือสิ่งสำคัญ: คำตัดสินเน้นย้ำว่าความชอบด้วยกฎหมายของการฝึกฝน AI มักขึ้นอยู่กับแหล่งที่มาของข้อมูลที่ใช้ฝึกฝน มากกว่าตัวกระบวนการฝึกฝนเอง
