Departemen Kehakiman AS telah mengeluarkan intervensi hukum yang signifikan dalam perang hak cipta yang sedang berlangsung antara raksasa media dan pengembang AI. Dengan berargumen bahwa melatih Model Bahasa Besar (LLM) menggunakan data berhak cipta merupakan "penggunaan wajar" (fair use), DOJ telah memberikan perlindungan hukum yang masif bagi perusahaan seperti OpenAI dan Microsoft.

Argumen DOJ: Pelatihan vs. Output

Inti dari gugatan gabungan yang melibatkan The New York Times adalah perbedaan mendasar antara cara AI belajar dan apa yang dihasilkannya. The New York Times menuduh bahwa jutaan artikelnya digunakan tanpa izin untuk melatih model seperti GPT-4, yang menyebabkan kerugian miliaran dolar dan menciptakan produk yang bersaing langsung dengan surat kabar tersebut.

Namun, pengajuan terbaru DOJ berargumen bahwa pelanggaran hak cipta terjadi pada titik output, bukan pada titik penyerapan (ingestion). Departemen tersebut berpendapat bahwa meskipun seluruh karya disalin selama fase pelatihan, salinan-salinan ini tidak pernah tersedia untuk publik. Lebih lanjut, DOJ menegaskan bahwa output dari model seperti GPT-4 "sering kali, jika tidak selalu, kurang memiliki kemiripan substansial" dengan materi sumber aslinya. Dengan memisahkan proses pelatihan dari konten yang dihasilkan, DOJ mencoba memisahkan tindakan pembelajaran mesin dari konsep hukum substitusi pasar.

Analogi "Hemingway" dan Kreativitas Manusia

Untuk membuat konsep pembelajaran mesin lebih mudah dipahami, DOJ menggunakan analogi sastra yang melibatkan penulis Joan Didion. Pengajuan tersebut mencatat bahwa saat remaja, Didion akan menyalin cerita-cerita Ernest Hemingway untuk menganalisis struktur kalimatnya dan mempelajari keahliannya. DOJ berargumen bahwa jika hukum memperlakukan pelatihan mesin sebagai pelanggaran, seorang penulis seperti Didion secara teoritis dapat menghadapi tanggung jawab hukum setiap kali ia menerbitkan karya baru, karena proses belajarnya akan terkait erat dengan tulisan berikutnya.

Departemen tersebut lebih lanjut berargumen bahwa memberlakukan tanggung jawab mutlak (strict liability) untuk pelatihan AI justru secara paradoks akan menghambat kreativitas yang seharusnya dilindungi oleh hukum hak cipta. Dengan semakin banyaknya manusia yang menggunakan LLM untuk menyusun dan menyunting karya asli, DOJ menyarankan bahwa membuat pelatihan menjadi tidak diizinkan tanpa skema lisensi yang masif akan melumpuhkan inovasi berbasis AI.

Menantang Kantor Hak Cipta AS

Sikap DOJ secara langsung bertentangan dengan temuan terbaru dari Kantor Hak Cipta AS. Mantan Register Shira Perlmutter sebelumnya telah berargumen menentang pembelaan "penggunaan wajar" secara menyeluruh, dengan mencatat bahwa AI beroperasi pada skala dan kecepatan yang jauh melampaui kemampuan manusia dan sering kali menciptakan produk komersial yang bersaing langsung dengan pencipta konten asli.

DOJ telah mengambil langkah ofensif terhadap penilaian ini, dengan menyatakan bahwa laporan Perlmutter tidak memiliki otoritas hukum yang mengikat dan gagal mempertimbangkan hukum kasus yang telah mapan mengenai analisis kasus per kasus. Departemen tersebut memperingatkan bahwa memberlakukan tanggung jawab hukum yang luas secara efektif akan mewajibkan rezim lisensi yang akan membuat pengembangan model AI canggih menjadi mustahil secara hukum dan finansial.

Poin-Poin Penting

  • Pemisahan Pelatihan dan Output: DOJ berargumen bahwa menyalin teks untuk pelatihan tidak merupakan pelanggaran jika output model yang dihasilkan tidak menunjukkan "kemiripan substansial" dengan karya asli.
  • Perlindungan Inovasi: Departemen tersebut memperingatkan bahwa mewajibkan lisensi untuk semua data pelatihan akan menghambat kreativitas dan mencegah pengembangan LLM yang membantu pembuatan konten manusia.
  • Penentu Arah Hukum: Intervensi ini menciptakan konflik berisiko tinggi antara DOJ dan Kantor Hak Cipta AS, yang membuka jalan bagi keputusan pengadilan yang definitif mengenai masa depan AI generatif.

ARTIKEL: Departemen Kehakiman AS mengajukan amicus brief dalam gugatan hak cipta New York Times, dengan argumen bahwa menyalin teks yang dilindungi untuk melatih model bahasa besar (LLM) memenuhi syarat sebagai penggunaan wajar (fair use). Pengajuan ini memberikan perlindungan hukum bagi perusahaan seperti OpenAI dan Microsoft yang dapat menjauhkan mereka dari tuntutan ganti rugi yang diperkirakan oleh surat kabar tersebut mencapai miliaran dolar.

Mengapa kasus ini penting sekarang

Gugatan ini menggabungkan beberapa klaim bahwa pengembang AI memasukkan jutaan artikel surat kabar ke dalam model mereka tanpa izin, lalu merilis produk yang bersaing langsung dengan pelaporan Times sendiri. Jika pengadilan menolak argumen penggunaan wajar dari DOJ, perusahaan AI dapat menghadapi tagihan lisensi yang masif atau terpaksa menghentikan pengembangan agen percakapan generasi berikutnya.

Argumen inti DOJ

Dokumen hukum tersebut membagi alur kerja AI menjadi dua tahap yang berbeda. Pertama, model menyerap korpus teks dalam jumlah besar; kedua, model menghasilkan respons terhadap perintah pengguna. Departemen tersebut menyatakan bahwa pelanggaran hanya terjadi ketika karya berhak cipta direproduksi dengan cara yang dapat diakses oleh publik. Karena salinan pelatihan tidak pernah meninggalkan server pengembang, tindakan penyerapan tersebut tidak memenuhi ambang batas tersebut.

DOJ juga bersandar pada uji “kemiripan substansial” (substantial similarity), sebuah standar hak cipta yang telah lama berlaku. DOJ berpendapat bahwa teks yang dihasilkan oleh model seperti GPT-4 “sering kali, jika tidak selalu” berbeda cukup jauh dari sumber tunggal mana pun sehingga penggugat tidak dapat membuktikan kemiripan yang diperlukan. Singkatnya, dokumen tersebut berargumen bahwa fokus hukum haruslah pada hasil akhir, bukan pada proses pembelajaran internal.

Analogi sastra untuk mengilustrasikan poin tersebut

Untuk membuat argumen teknis tersebut lebih mudah dipahami, dokumen tersebut mengutip sebuah cerita tentang seorang penulis remaja yang menyalin cerita-cerita Ernest Hemingway untuk mempelajari gayanya. DOJ menyatakan bahwa jika hukum menganggap latihan pembelajaran tersebut sebagai pelanggaran, penulis tersebut dapat dituntut setiap kali ia menerbitkan karya baru, meskipun karyanya bersifat orisinal. Departemen tersebut memperingatkan bahwa menerapkan logika yang sama pada AI akan “melumpuhkan kreativitas yang justru ingin dilindungi oleh hukum hak cipta.”

Risiko bagi pengembang AI dan pembuat konten

  • Risiko inovasi: Mewajibkan lisensi untuk setiap teks yang digunakan dalam pelatihan dapat meningkatkan biaya begitu tinggi sehingga membangun model mutakhir (state-of-the-art) menjadi tidak layak secara finansial.
  • Alur kerja kreatif: Penulis manusia semakin bergantung pada LLM untuk penyusunan draf, penyuntingan, dan curah pendapat (brainstorming). Jika proses pelatihan dianggap ilegal, alat-alat tersebut bisa menghilang, mengubah cara konten diproduksi di berbagai industri.
  • Dampak pasar: Industri surat kabar berpendapat bahwa model AI yang dapat menjawab pertanyaan atau menghasilkan teks mirip berita mengikis nilai pelaporan orisinal, yang berpotensi menyedot pendapatan iklan dan langganan.

Argumen bantahan dari Kantor Hak Cipta

Sebuah laporan terbaru dari Kantor Hak Cipta AS, yang disusun di bawah mantan Register Shira Perlmutter, menolak pembelaan penggunaan wajar (fair-use) secara menyeluruh. Kantor tersebut menyoroti tiga faktor yang membedakan AI dari pembelajaran manusia: volume materi yang disalin yang sangat besar, kecepatan pemrosesannya, dan fakta bahwa model yang dihasilkan dapat dikemas dan dijual sebagai produk komersial yang bersaing langsung dengan pencipta sumbernya.

DOJ membantah poin-poin tersebut, dengan mencatat bahwa laporan tersebut tidak memiliki otoritas hukum yang mengikat dan bahwa hukum kasus yang ada sudah mewajibkan analisis penggunaan wajar berdasarkan fakta demi fakta. DOJ memperingatkan bahwa membebankan “tanggung jawab luas” (broad liability) secara efektif akan memaksa industri masuk ke dalam rezim lisensi yang “akan membuat pengembangan model AI tingkat lanjut menjadi mustahil secara hukum dan finansial.”

Apa yang mungkin terjadi selanjutnya

Pengadilan distrik yang menangani kasus Times harus menimbang posisi penggunaan wajar DOJ terhadap temuan Kantor Hak Cipta. Putusan yang memenangkan DOJ akan menetapkan preseden bahwa data pelatihan dapat dipanen tanpa izin eksplisit, asalkan hasil keluaran model terhindar dari kemiripan substansial. Keputusan yang memihak surat kabar dapat memicu gelombang negosiasi lisensi, yang berpotensi membentuk kembali ekonomi penelitian AI.

Intinya

Dokumen hukum DOJ mengubah pertanyaan tentang apakah pelatihan AI merupakan penggunaan wajar menjadi pertempuran ruang sidang dengan pertaruhan tinggi. Hasilnya akan menentukan apakah pengembang dapat terus membangun model bahasa yang kuat berdasarkan teks yang ada atau harus mencari lisensi yang mahal untuk setiap materi yang mereka serap. Keputusan ini akan berdampak luas pada sektor teknologi, industri media, dan ekonomi kreatif yang lebih luas.