Anthropic akan menyematkan tanda tangan digital tersembunyi pada setiap teks dan file yang dihasilkan oleh model Claude miliknya, sebuah langkah yang dirancang untuk memenuhi aturan transparansi AI baru dari Uni Eropa. Perubahan ini berlaku untuk semua model yang dirilis setelah Kode Transparansi EU AI Act mulai berlaku pada 2 Agustus, dan akan muncul secara otomatis di seluruh antarmuka API, Code, Cowork, dan Tag milik Claude.

Mengapa aturan Uni Eropa ini penting

Kode Transparansi mewajibkan pengembang untuk menandai konten yang dihasilkan atau diedit oleh AI agar sistem hilir dapat mendeteksi asal-usul sintetisnya. Aturan ini bertujuan untuk menekan misinformasi dan memberikan sinyal yang jelas kepada pengguna saat mereka berhadapan dengan materi buatan mesin. Respons Anthropic—watermarking di tingkat model—menempatkan penanda langsung ke dalam output, alih-alih menempelkannya pada UI produk.

Raksasa AI lainnya juga memberikan janji serupa. Google, Meta, Microsoft, OpenAI, dan Black Forest Labs semuanya menyatakan akan memenuhi standar Uni Eropa. Untuk aset non-teks, Anthropic akan menggunakan standar terbuka C2PA, sebuah metode yang didokumentasikan secara publik untuk menyematkan data asal-usul dalam gambar, video, dan media lainnya. Dengan mengikuti spesifikasi terbuka, Anthropic berharap penandaannya dapat bekerja dengan alat yang sudah digunakan oleh jurnalis, platform, dan pemeriksa fakta.

Cara kerja watermark

Anthropic menyatakan bahwa watermark tersebut menyatu dalam proses pembuatan teks model. Dalam praktiknya, tanda tangan tersebut menjadi bagian dari aliran token yang dikeluarkan model. Saat pengguna menyalin teks ke pengolah kata, email, atau unggahan media sosial, pola tersembunyi tersebut akan ikut terbawa. Perusahaan mencatat bahwa watermark dapat bertahan meski melalui pengeditan ringan, namun belum mengungkapkan berapa banyak karakter yang harus berubah sebelum tanda tersebut menghilang.

Kekhawatiran tentang “Claudefishing”

Peluncuran Anthropic ini hadir di tengah meningkatnya kekhawatiran atas penyalahgunaan model bahasa besar (LLM). CEO Substack, Chris Best, baru-baru ini mencetuskan istilah “Claudefishing” untuk menggambarkan penggunaan AI dalam membuat konten penipu yang meniru gaya bicara penulis tertentu. Seiring dengan semakin sulitnya membedakan teks sintetis dari tulisan manusia, deteksi otomatis terhadap asal-usul konten menjadi lini pertahanan yang krusial.

Anthropic tidak sendirian dalam menambahkan perlindungan. Platform pembuatan musik Suno dan layanan buletin Substack telah memperkenalkan mekanisme penandaan yang memperingatkan pembaca ketika sebuah karya dibuat oleh AI. Dengan menyematkan watermark di sumbernya, Anthropic bertujuan agar sinyal tersebut lebih sulit dihapus dan lebih mudah ditindaklanjuti oleh filter hilir.

Poin-Poin Penting

  • Kepatuhan Regulasi: Anthropic menerapkan watermarking untuk memenuhi Kode Transparansi EU AI Act, yang mulai berlaku pada 2 Agustus.
  • Integrasi Tingkat Model: Watermark diterapkan pada tingkat model, sehingga tetap ada di semua produk (API, Claude Code, dll.) dan bertahan saat dilakukan tindakan salin-tempel.
  • Penandaan File Terstandarisasi: Untuk file, Anthropic akan menggunakan standar terbuka C2PA untuk memastikan interoperabilitas dan transparansi dalam konten digital.