Anthropic akan menyematkan tandatangan digital tersembunyi dalam setiap teks dan fail yang dihasilkan oleh model Claude miliknya, satu langkah yang direka untuk memenuhi peraturan ketelusan AI baharu Kesatuan Eropah. Perubahan ini berkuat kuasa untuk semua model yang dikeluarkan selepas Kod Ketelusan Akta AI EU mula berkuat kuasa pada 2 Ogos, dan ia akan muncul secara automatik merentasi antara muka API, Code, Cowork dan Tag Claude.
Mengapa peraturan EU penting
Kod Ketelusan mewajibkan pembangun untuk menandakan kandungan yang dijana atau disunting oleh AI supaya sistem hiliran dapat mengesan asal-usul sintetiknya. Peraturan ini bertujuan untuk mengekang maklumat salah dan memberi isyarat jelas kepada pengguna apabila mereka berhadapan dengan bahan yang dihasilkan oleh mesin. Tindak balas Anthropic—penandaan air (watermarking) pada peringkat model—meletakkan penanda tersebut secara terus ke dalam output dan bukannya menambahkannya pada UI produk.
Gergasi AI lain turut membuat janji yang serupa. Google, Meta, Microsoft, OpenAI dan Black Forest Labs semuanya menyatakan bahawa mereka akan memenuhi piawaian EU. Bagi aset bukan teks, Anthropic akan menggunakan piawaian terbuka C2PA, sebuah kaedah yang didokumentasikan secara awam untuk menyematkan data asal-usul (provenance) dalam imej, video dan media lain. Dengan mengikuti spesifikasi terbuka, Anthropic berharap tandaannya akan berfungsi dengan alatan yang sedia digunakan oleh wartawan, platform dan penyemak fakta.
Cara penandaan air berfungsi
Anthropic menyatakan bahawa penandaan air tersebut disepadukan ke dalam proses penjanaan teks model tersebut. Dalam praktiknya, tandatangan itu menjadi sebahagian daripada aliran token yang dikeluarkan oleh model. Apabila pengguna menyalin teks ke dalam pemproses perkataan, e-mel, atau hantaran media sosial, corak tersembunyi itu akan turut terbawa bersamanya. Syarikat itu menyatakan bahawa penandaan air tersebut boleh bertahan walaupun melalui penyuntingan sederhana, namun ia tidak mendedahkan berapa banyak aksara yang perlu diubah sebelum tanda tersebut hilang.
Kebimbangan “Claudefishing”
Pelancaran Anthropic ini berlaku ketika kebimbangan terhadap penyalahgunaan model bahasa besar (LLM) semakin meningkat. CEO Substack, Chris Best, baru-baru ini memperkenalkan istilah “Claudefishing” untuk menggambarkan penggunaan AI bagi menghasilkan kandungan mengelirukan yang meniru gaya penulisan penulis tertentu. Memandangkan teks sintetik semakin sukar dibezakan daripada penulisan manusia, pengesanan asal-usul secara automatik menjadi barisan pertahanan yang penting.
Anthropic bukan satu-satunya yang menambah langkah keselamatan. Platform penjanaan muzik Suno dan perkhidmatan surat berita Substack telah memperkenalkan mekanisme penandaan yang memberi amaran kepada pembaca apabila sesuatu karya dihasilkan oleh AI. Dengan menyematkan penandaan air pada sumbernya, Anthropic bertujuan untuk menjadikan isyarat tersebut lebih sukar untuk dibuang dan lebih mudah untuk ditindaklanjuti oleh penapis hiliran.
Ringkasan Utama
- Pematuhan Kawal Selia: Anthropic sedang melaksanakan penandaan air untuk memenuhi Kod Ketelusan Akta AI EU, yang mula berkuat kuasa pada 2 Ogos.
- Integrasi Peringkat Model: Penandaan air diterapkan pada peringkat model, jadi ia kekal merentasi semua produk (API, Claude Code, dll.) dan bertahan melalui tindakan salin-tampal.
- Penandaan Fail Terpiawai: Bagi fail, Anthropic akan menggunakan piawaian terbuka C2PA untuk memastikan kebolehoperasian dan ketelusan dalam kandungan digital.
