Penyelesaian Cetak Rompak $1.5B Anthropic: Kerugian Rekod dan Kemenangan Strategik

Anthropic telah mencapai penyelesaian bersejarah sebanyak $1.5 bilion dengan sekumpulan penulis buku susulan dakwaan menggunakan pangkalan data cetak rompak untuk melatih model-modelnya. Walaupun bayaran besar ini merupakan tamparan kewangan, nuansa undang-undang dalam kes ini sebenarnya mungkin memberikan kemenangan besar kepada industri AI yang lebih luas berkaitan penggunaan adil (fair use).

Perincian Penyelesaian yang Memecahkan Rekod

Sebuah mahkamah persekutuan di San Francisco telah meluluskan penyelesaian mercu tanda selepas bukti mendedahkan bahawa Anthropic memuat turun buku daripada pangkalan data cetak rompak yang terkenal, khususnya LibGen dan PiLiMi, antara tahun 2021 dan 2022. Skala penyelesaian ini tidak pernah berlaku sebelum ini dalam sejarah tindakan kelas, merangkumi kira-kira 482,460 karya yang disenaraikan.

Daripada jumlah keseluruhan karya yang terlibat, 91.3 peratus telah berjaya dituntut oleh penulis. Setiap penuntut dijangka menerima kira-kira $3,000, satu angka yang merupakan empat kali ganda daripada jumlah minimum statutori. Sebagai sebahagian daripada penyelesaian undang-undang, Anthropic dikehendaki memusnahkan fail cetak rompak yang digunakan dalam tempoh tersebut. Yang paling penting, penyelesaian ini tidak memberikan pengecualian mutlak kepada syarikat tersebut; penulis mengekalkan hak untuk membuat tuntutan jika output AI menghasilkan semula karya asal atau jika amalan pemerolehan data Anthropic pada masa hadapan melanggar undang-undang hak cipta.

Satu Teknikaliti yang Memihak kepada Pembangunan AI

Walaupun melibatkan kos yang mengejutkan sebanyak $1.5 bilion, duluan undang-undang yang ditetapkan oleh kes ini secara mengejutkan memihak kepada makmal AI. Penyelesaian tersebut menangani tindakan khusus menggunakan sumber cetak rompak, tetapi ia tidak memutuskan tentang kesahihan latihan AI itu sendiri.

Hakim Alsup sebelum ini telah menetapkan perbezaan kritikal: melatih AI menggunakan buku yang diperoleh secara sah adalah "transformatif—sangat transformatif"—dan jatuh sepenuhnya di bawah doktrin penggunaan adil (fair use). Perbezaan ini sangat penting bagi syarikat seperti OpenAI, Google, dan Meta. Ia menunjukkan bahawa walaupun sumber data (cetak rompak berbanding pemerolehan sah) merupakan satu liabiliti, proses melatih model untuk memahami bahasa dan corak adalah boleh dipertahankan dari segi undang-undang.

Sempadan Pengikisan Data Massa yang Belum Selesai

Walaupun keputusan ini menawarkan talian hayat kepada makmal yang melatih model menggunakan set data yang besar, pertempuran undang-undang mengenai "pemerolehan sah" masih jauh daripada selesai. Persoalan utamanya tetap sama: adakah pengikisan data (mass scraping) kandungan internet secara besar-besaran tanpa keizinan nyata daripada pemilik laman web merupakan pemerolehan sah atau pelanggaran hak cipta?

Penyelesaian ini menonjolkan realiti undang-undang yang berbelah bahagi bagi industri AI. Syarikat boleh mengelakkan penalti besar dengan memastikan saluran data mereka dibersihkan daripada repositori cetak rompak yang diketahui, tetapi mereka masih menghadapi landskap yang tidak menentu mengenai hak penerbit web dan pencipta kandungan. Memandangkan makmal AI terus berkembang, ketegangan antara kemajuan teknologi yang transformatif dan hak harta intelek akan kekal menjadi halangan undang-undang yang paling ketara dalam industri ini.

Ringkasan Utama

  • Bayaran Rekod: Anthropic akan membayar $1.5 bilion kepada penulis selepas menggunakan pangkalan data cetak rompak seperti LibGen, menandakan penyelesaian hak cipta terbesar dalam sejarah tindakan kelas.
  • Duluan Penggunaan Adil: Mahkamah mengesahkan bahawa melatih AI menggunakan data yang diperoleh secara sah adalah "sangat transformatif," memberikan perlindungan undang-undang yang besar untuk latihan AI yang sah.
  • Integriti Data adalah Kritikal: Keputusan tersebut menekankan bahawa kesahihan latihan AI sering bergantung pada asal usul data latihan dan bukannya proses latihan itu sendiri.