Penyelesaian Kasus Pembajakan Anthropic Senilai $1,5 Miliar: Kerugian Rekor dan Kemenangan Strategis

Anthropic telah mencapai penyelesaian bersejarah senilai $1,5 miliar dengan sekelompok penulis buku menyusul tuduhan penggunaan basis data bajakan untuk melatih model-modelnya. Meskipun pembayaran besar ini merupakan pukulan finansial, nuansa hukum dari kasus ini sebenarnya dapat memberikan kemenangan signifikan bagi industri AI yang lebih luas terkait penggunaan wajar (fair use).

Rincian Penyelesaian yang Memecahkan Rekor

Pengadilan federal di San Francisco telah menyetujui penyelesaian penting setelah bukti mengungkapkan bahwa Anthropic mengunduh buku dari basis data pembajakan yang terkenal, khususnya LibGen dan PiLiMi, antara tahun 2021 dan 2022. Skala penyelesaian ini belum pernah terjadi sebelumnya dalam sejarah gugatan kelompok (class action), mencakup sekitar 482.460 karya yang terdaftar.

Dari total karya yang terlibat, 91,3 persen berhasil diklaim oleh para penulis. Setiap penggugat dijadwalkan menerima sekitar $3.000, angka yang empat kali lipat dari batas minimum undang-undang. Sebagai bagian dari resolusi hukum, Anthropic diwajibkan untuk menghancurkan file bajakan yang digunakan selama periode tersebut. Yang terpenting, penyelesaian ini tidak memberikan kebebasan mutlak bagi perusahaan; penulis tetap memiliki hak untuk mengajukan tuntutan jika hasil AI mereproduksi karya asli atau jika praktik akuisisi data Anthropic di masa depan melanggar hukum hak cipta.

Teknis Hukum yang Menguntungkan Pengembangan AI

Terlepas dari biaya yang mengejutkan sebesar $1,5 miliar, preseden hukum yang ditetapkan oleh kasus ini secara mengejutkan menguntungkan bagi laboratorium AI. Penyelesaian ini menangani tindakan spesifik penggunaan sumber yang dibajak, tetapi tidak memutuskan legalitas pelatihan AI itu sendiri.

Hakim Alsup sebelumnya telah menetapkan perbedaan kritis: melatih AI menggunakan buku yang diperoleh secara legal adalah "transformatif—sangat transformatif"—dan sepenuhnya termasuk dalam doktrin penggunaan wajar (fair use). Perbedaan ini sangat penting bagi perusahaan seperti OpenAI, Google, dan Meta. Hal ini menunjukkan bahwa meskipun sumber data (pembajakan vs. akuisisi legal) merupakan sebuah liabilitas, proses melatih model untuk memahami bahasa dan pola dapat dipertahankan secara hukum.

Batas yang Belum Terselesaikan dari Mass Scraping

Meskipun keputusan ini menawarkan jalan keluar bagi laboratorium yang melatih model pada kumpulan data masif, pertempuran hukum mengenai "akuisisi legal" masih jauh dari selesai. Pertanyaan utamanya tetap sama: apakah mass scraping konten internet tanpa persetujuan eksplisit dari pemilik situs web merupakan akuisisi legal atau pelanggaran hak cipta?

Penyelesaian ini menyoroti realitas hukum yang terbelah bagi industri AI. Perusahaan dapat menghindari penalti besar dengan memastikan saluran data (data pipelines) mereka dibersihkan dari repositori bajakan yang diketahui, tetapi mereka masih menghadapi lanskap yang tidak pasti terkait hak-hak penerbit web dan pembuat konten. Seiring laboratorium AI terus berkembang, ketegangan antara kemajuan teknologi yang transformatif dan hak kekayaan intelektual akan tetap menjadi hambatan hukum paling signifikan bagi industri ini.

Poin-Poin Penting

  • Pembayaran Rekor: Anthropic akan membayar $1,5 miliar kepada para penulis setelah menggunakan basis data bajakan seperti LibGen, menandai penyelesaian hak cipta terbesar dalam sejarah gugatan kelompok (class action).
  • Preseden Penggunaan Wajar: Pengadilan menegaskan bahwa melatih AI pada data yang diperoleh secara legal adalah "sangat transformatif," memberikan perlindungan hukum utama bagi pelatihan AI yang sah.
  • Integritas Data Sangat Penting: Keputusan tersebut menekankan bahwa legalitas pelatihan AI sering kali bergantung pada asal-usul (provenance) data pelatihan, bukan pada proses pelatihannya itu sendiri.