Komuniti kreatif tidak lagi sekadar memerhati secara pasif ketika hasil kerja seumur hidup mereka dimasukkan ke dalam set data latihan yang besar. Daripada penulis terkenal hingga ilustrator digital, gelombang tindakan undang-undang yang semakin meningkat sedang mencabar pembelaan "penggunaan adil" (fair use) yang digunakan oleh gergasi AI untuk menghalalkan pengitipan harta intelek tanpa kebenaran.
Penemuan Set Latihan Tanpa Kebenaran
Ketegangan antara pencipta dan pembangun AI mencapai kemuncak susulan laporan daripada The Atlantic, yang menerbitkan set data yang boleh dicari memperincikan karya-karya yang digunakan untuk melatih model bahasa besar. Bagi penulis seperti Kirk Wallace Johnson, penemuan itu bersifat peribadi dan mendalam. Johnson, yang dikenali melalui karya bukan fiksyen yang dikaji secara mendalam seperti The Feather Thief dan The Fishermen and the Dragon, mendapati bahawa penyelidikan dan penulisan bertahun-tahun yang dilakukan dengan gigih telah dicetak rompak dan dimasukkan ke dalam chatbot tanpa kebenaran atau pampasan.
Fenomena ini bukanlah insiden terpencil tetapi merupakan satu amalan sistemik. Profesional kreatif mendapati bahawa karya hak milik mereka—yang sering menjadi hasil usaha bertahun-tahun—digunakan untuk membina korporat yang "sangat kaya". Kesedaran ini telah mengubah sentimen daripada sekadar kebimbangan kepada litigasi aktif, memandangkan artis berusaha untuk menuntut semula kawalan ke atas harta intelek mereka.
Litigasi Strategik: Mensasarkan Gergasi Teknologi
Serangan undang-undang ini bersifat pelbagai dimensi, mensasarkan mekanik teras tentang bagaimana model AI generatif dibina. Artis bukan sahaja bergantung kepada tuntutan pelanggaran hak cipta; mereka juga meneroka jalan lain seperti pelanggaran terma perkhidmatan untuk menuntut akauntabiliti syarikat.
Pertempuran undang-undang berprofil tinggi sudah pun bermula. Ramai pencipta telah bergabung tenaga dengan pasukan undang-undang khusus, seperti Susman Godfrey, yang kini sedang mengetuai kes besar terhadap Anthropic bagi pihak pelbagai penulis. Perintis lain dalam gerakan ini termasuk ilustrator dan kartunis Sarah Andersen, yang merupakan antara yang terawal mencabar gergasi AI secara langsung. Saman-saman ini bertujuan untuk meruntuhkan kebergantungan industri terhadap pengitipan data tanpa pampasan dan memaksa piawaian baharu tentang bagaimana set latihan dikurasi.
Medan Pertempuran "Fair Use"
Ketegangan utama di bilik mahkamah ini terletak pada definisi undang-undang bagi "penggunaan adil" (fair use). Syarikat AI berhujah bahawa melatih model menggunakan data sedia ada adalah bersifat transformatif dan tertakluk di bawah perlindungan undang-undang. Walau bagaimanapun, pencipta berhujah bahawa apabila AI dapat meniru gaya khusus seorang artis atau suara unik seorang penulis, ia tidak lagi bersifat transformatif dan menjadi pengganti pasaran secara langsung yang merendahkan nilai karya asal.
Memandangkan kes-kes ini sedang berjalan, ia akan menentukan masa depan landskap AI. Keputusannya akan menentukan sama ada trajektori semasa "AI slop"—pengeluaran besar-besaran kandungan derivatif berkualiti rendah—adalah mampan dari segi undang-undang, atau jika era baharu pemerolehan data yang berlesen dan beretika mesti muncul untuk melindungi pencipta manusia yang menjadi teras ekonomi maklumat.
Ringkasan Utama
- Pengitipan Data Sistemik: Model AI utama didapati menggunakan set data cetak rompak yang mengandungi buku-buku hasil kajian mendalam dan karya seni hak milik tanpa kebenaran pencipta.
- Strategi Undang-undang yang Pelbagai: Saman-saman menyasarkan syarikat AI melalui pelanggaran hak cipta, pelanggaran terma perkhidmatan, dan cabaran terhadap doktrin "penggunaan adil".
- Detik Penting bagi IP: Keputusan kes-kes yang sedang berlangsung terhadap syarikat seperti Anthropic akan menetapkan preseden undang-undang tentang bagaimana harta intelek dinilai dalam era AI generatif.
Bagaimana kontroversi ini tercetus
Pencetusnya bermula apabila sebuah majalah utama menerbitkan senarai buku, artikel, dan karya seni yang boleh dicari yang telah digunakan untuk melatih model bahasa besar. Bagi penulis Kirk Wallace Johnson, yang buku bukan fiksyennya memerlukan penyelidikan dan perjalanan bertahun-tahun, pendedahan itu adalah bersifat peribadi. Beliau mendapati bahawa kata-kata yang dihabiskan selama sedekad untuk disempurnakan adalah sebahagian daripada data yang menggerakkan chatbot yang boleh menghasilkan semula gayanya atas permintaan, tanpa sebarang royalti atau pengiktirafan.
Pengalaman Johnson bukanlah satu insiden tunggal. Pencipta dalam bidang sastera, ilustrasi, muzik, dan filem melaporkan bahawa hasil kerja hak cipta mereka telah dituai secara besar-besaran. Amalan tersebut, yang digambarkan oleh orang dalam industri sebagai pengekstrakan sistematik "set data cetak rompak," telah mengubah kebimbangan kepada tindakan undang-undang yang terkoordinasi. Artis kini berhujah bahawa nilai yang mereka cipta sedang disedut masuk ke dalam konglomerat teknologi yang "sangat kaya" yang mengaut keuntungan daripada kerja mereka sementara pencipta tidak menerima apa-apa.
Tindakan undang-undang yang mencorakkan perjuangan ini
Serangan undang-undang ini menyasarkan teras cara model AI generatif dibina. Plaintif memfailkan tuntutan bukan sahaja untuk pelanggaran hak cipta, tetapi juga untuk pelanggaran terma perkhidmatan platform itu sendiri. Ilustrator dan kartunis Sarah Andersen, yang karyanya telah menjadi elemen utama dalam budaya internet, merupakan antara artis visual pertama yang memfailkan saman terus terhadap sebuah syarikat AI. Failannya menegaskan bahawa keupayaan model tersebut untuk meniru gaya garisan dan humor uniknya menghakis pasaran komik asalnya, secara berkesan menukarkan jenamanya menjadi sumber yang boleh digunakan secara percuma oleh sesiapa sahaja.
Kes-kes ini dikendalikan oleh peguam yang pakar dalam pertikaian harta intelek dan mempunyai rekod prestasi mencabar gergasi teknologi. Strategi mereka adalah untuk memaksa proses penemuan (discovery) set data tepat yang digunakan, memaksa syarikat menghentikan penggunaan bahan yang dipertikaikan, dan menuntut ganti rugi yang mencerminkan nilai komersial kandungan yang dicuri.
Hujah “penggunaan adil” (fair use) kini dicabar
Pembangun AI menegaskan bahawa melatih model menggunakan data yang tersedia secara umum adalah penggunaan transformatif yang dilindungi oleh undang-undang. Mereka berhujah bahawa model tersebut tidak menghasilkan semula mana-mana karya tunggal secara bulat-bulat; sebaliknya, ia mempelajari corak yang membolehkannya menjana teks atau imej baharu. Dari perspektif itu, proses tersebut adalah serupa dengan seorang penyelidik yang membaca banyak buku untuk mendapatkan pemahaman, bukannya menyalinnya.
Pencipta membalas bahawa transformasi hanyalah alasan yang lemah apabila hasil yang dikeluarkan boleh menjadi hampir serupa dengan suara penulis atau gaya artis. Apabila sebuah chatbot boleh menjawab soalan dengan rentak dan gaya bahasa yang sama seperti yang dikenali oleh seorang novelis, atau apabila penjana imej boleh menghasilkan gambar yang tidak dapat dibezakan daripada portfolio ilustrator yang masih hidup, hasilnya berfungsi sebagai pengganti pasaran. Plaintif berhujah bahawa penggantian ini menjejaskan keupayaan mereka untuk menjual buku, menerima komisen, dan perjanjian pelesenan, serta pembelaan “penggunaan adil” (fair use) akan runtuh di bawah beban impak komersial.
Apa yang dipertaruhkan
Tekanan ekonomi terhadap firma AI – Jika mahkamah memutuskan bahawa pengikisan data (scraping) berskala besar melanggar hak cipta, syarikat boleh menghadapi kesan kewangan yang besar, yang berpotensi mendorong perubahan kepada saluran data (data pipelines).
Pemfailan mahkamah dan penemuan (discovery) – Gelombang dokumen seterusnya akan mendedahkan dengan tepat tajuk dan imej mana yang telah digunakan, memberikan gambaran yang lebih jelas tentang skala penuaian data.
