Komunitas kreatif tidak lagi hanya menonton secara pasif saat karya seumur hidup mereka dimasukkan ke dalam kumpulan data pelatihan yang masif. Dari penulis ternama hingga ilustrator digital, gelombang tindakan hukum yang terus berkembang tengah menantang pembelaan "fair use" (penggunaan wajar) yang digunakan oleh raksasa AI untuk membenarkan pengambilan data (scraping) kekayaan intelektual tanpa izin.
Penemuan Kumpulan Data Pelatihan Tanpa Izin
Ketegangan antara kreator dan pengembang AI mencapai titik didih menyusul laporan dari The Atlantic, yang menerbitkan kumpulan data yang dapat dicari yang merinci karya-karya yang digunakan untuk melatih model bahasa besar (large language models). Bagi penulis seperti Kirk Wallace Johnson, penemuan ini bersifat pribadi dan mendalam. Johnson, yang dikenal karena karya nonfiksi hasil riset mendalam seperti The Feather Thief dan The Fishermen and the Dragon, menemukan bahwa hasil investigasi dan penulisan yang teliti selama bertahun-tahun telah dibajak dan dimasukkan ke dalam chatbot tanpa izin atau kompensasi.
Fenomena ini bukanlah insiden terisolasi melainkan praktik sistemik. Para profesional kreatif menemukan bahwa karya milik mereka—yang sering kali merupakan hasil kerja keras bertahun-tahun—digunakan untuk membangun korporasi yang "sangat kaya raya" (galactically wealthy). Kesadaran ini telah mengubah sentimen dari sekadar kekhawatiran menjadi litigasi aktif, saat para seniman berupaya merebut kembali kendali atas kekayaan intelektual mereka.
Litigasi Strategis: Menargetkan Raksasa Teknologi
Serangan hukum ini bersifat multifaset, menargetkan mekanisme inti dari cara model AI generatif dibangun. Para seniman tidak hanya mengandalkan klaim pelanggaran hak cipta; mereka juga menjajaki jalur lain seperti pelanggaran ketentuan layanan (terms of service) untuk menuntut pertanggungjawaban perusahaan.
Pertempuran hukum profil tinggi sudah mulai berjalan. Banyak kreator telah bergabung dengan tim hukum khusus, seperti Susman Godfrey, yang saat ini memimpin kasus signifikan terhadap Anthropic atas nama berbagai penulis. Pionir lain dalam gerakan ini termasuk ilustrator dan kartunis Sarah Andersen, yang merupakan salah satu orang pertama yang secara langsung menantang raksasa AI. Gugatan-gugatan ini bertujuan untuk membongkar ketergantungan industri pada pengambilan data (data scraping) tanpa kompensasi dan memaksakan standar baru tentang bagaimana kumpulan data pelatihan dikurasi.
Medan Pertempuran "Fair Use"
Ketegangan utama di ruang sidang ini terletak pada definisi hukum "fair use" (penggunaan wajar). Perusahaan AI berargumen bahwa melatih model pada data yang ada bersifat transformatif dan termasuk dalam perlindungan hukum. Namun, para kreator berargumen bahwa ketika AI dapat mereplikasi gaya spesifik seorang seniman atau suara unik seorang penulis, hal itu tidak lagi bersifat transformatif dan menjadi pengganti pasar langsung yang mendevaluasi karya aslinya.
Seiring berjalannya kasus-kasus ini, mereka akan menentukan masa depan lanskap AI. Hasilnya akan menentukan apakah lintasan "AI slop" saat ini—produksi massal konten derivatif berkualitas rendah—dapat dipertahankan secara hukum, atau apakah era baru akuisisi data yang berlisensi dan etis harus muncul untuk melindungi para kreator manusia yang menjadi inti dari ekonomi informasi.
Poin-Poin Penting
- Pengambilan Data Sistemik: Model AI utama ditemukan menggunakan kumpulan data bajakan yang berisi buku-buku hasil riset mendalam dan karya seni milik orang lain tanpa izin kreator.
- Strategi Hukum yang Beragam: Gugatan hukum menargetkan perusahaan AI melalui pelanggaran hak cipta, pelanggaran ketentuan layanan, dan tantangan terhadap doktrin "fair use".
- Momen Krusial bagi KI: Hasil dari kasus-kasus yang sedang berlangsung terhadap perusahaan seperti Anthropic akan menetapkan preseden hukum tentang bagaimana kekayaan intelektual dinilai di era AI generatif.
Bagaimana kontroversi ini meletus
Percikan muncul ketika sebuah majalah besar menerbitkan daftar buku, artikel, dan karya seni yang dapat dicari yang digunakan untuk melatih model bahasa besar. Bagi penulis Kirk Wallace Johnson, yang buku-buku nonfiksinya membutuhkan riset dan perjalanan bertahun-tahun, pengungkapan ini bersifat pribadi. Ia menemukan bahwa kata-kata yang ia sempurnakan selama satu dekade adalah bagian dari data yang menggerakkan chatbot yang dapat mereproduksi gayanya sesuai permintaan, tanpa royalti atau pengakuan apa pun.
Pengalaman Johnson bukanlah insiden tunggal. Kreator di bidang sastra, ilustrasi, musik, dan film melaporkan bahwa hasil karya berhak cipta mereka telah dipanen secara massal. Praktik ini, yang digambarkan oleh orang dalam industri sebagai ekstraksi sistematis dari "kumpulan data bajakan," telah mengubah kekhawatiran menjadi tindakan hukum yang terkoordinasi. Para seniman kini berargumen bahwa nilai yang mereka ciptakan disedot ke dalam konglomerat teknologi yang "sangat kaya raya" yang meraup keuntungan dari kerja keras mereka sementara para kreator tidak menerima apa-apa.
Gugatan hukum yang membentuk pertempuran ini
Serangan hukum ini ditujukan pada inti dari bagaimana model AI generatif disusun. Para penggugat mengajukan klaim tidak hanya atas pelanggaran hak cipta, tetapi juga atas pelanggaran ketentuan layanan platform itu sendiri. Ilustrator dan kartunis Sarah Andersen, yang karyanya telah menjadi bagian penting dari budaya internet, adalah salah satu seniman visual pertama yang mengajukan gugatan langsung terhadap perusahaan AI. Gugatannya menyatakan bahwa kemampuan model tersebut untuk meniru gaya garis dan humor khasnya mengikis pasar komik aslinya, yang secara efektif mengubah mereknya menjadi sumber daya yang bisa digunakan secara bebas oleh siapa saja.
Kasus-kasus ini ditangani oleh pengacara yang berspesialisasi dalam sengketa kekayaan intelektual dan memiliki rekam jejak dalam menantang raksasa teknologi. Strategi mereka adalah untuk memaksa pengungkapan (discovery) dataset tepat yang digunakan, mewajibkan perusahaan untuk menghentikan penggunaan materi yang disengketakan, dan menuntut ganti rugi yang mencerminkan nilai komersial dari konten yang dicuri.
Argumen “fair use” yang sedang diperdebatkan
Pengembang AI berpendapat bahwa melatih model menggunakan data yang tersedia untuk publik adalah penggunaan transformatif yang dilindungi oleh hukum. Mereka berargumen bahwa model tersebut tidak mereproduksi satu karya pun secara verbatim; sebaliknya, model tersebut mempelajari pola yang memungkinkannya menghasilkan teks atau gambar baru. Dari perspektif tersebut, proses ini mirip dengan seorang peneliti yang membaca banyak buku untuk mendapatkan wawasan, alih-alih menyalinnya.
Para kreator menyanggah bahwa transformasi hanyalah alasan yang lemah ketika hasilnya dapat berupa duplikat yang hampir identik dengan suara penulis atau gaya seorang seniman. Ketika sebuah chatbot dapat menjawab pertanyaan dengan irama dan pilihan kata yang sama dengan yang dikenal dari seorang novelis, atau ketika generator gambar dapat menghasilkan gambar yang tidak dapat dibedakan dari portofolio ilustrator yang masih aktif, hasilnya berfungsi sebagai pengganti pasar. Para penggugat berargumen bahwa substitusi ini merugikan kemampuan mereka untuk menjual buku, komisi, dan kesepakatan lisensi, serta bahwa pembelaan “fair use” runtuh di bawah beban dampak komersialnya.
Apa yang dipertaruhkan
Tekanan ekonomi pada perusahaan AI – Jika pengadilan memutuskan bahwa scraping skala besar melanggar hak cipta, perusahaan dapat menghadapi konsekuensi finansial yang signifikan, yang berpotensi mendorong perubahan pada alur data (data pipelines).
Berkas pengadilan dan pengungkapan (discovery) – Gelombang dokumen berikutnya akan mengungkapkan judul dan gambar mana saja yang digunakan secara tepat, memberikan gambaran yang lebih jelas tentang skala pemanenan data.
