Anthropic meluncurkan watermark untuk teks yang dihasilkan Claude guna memenuhi persyaratan EU AI Act bahwa konten sintetis harus ditandai secara jelas dengan cara yang dapat dibaca oleh mesin. Perusahaan tersebut menyatakan bahwa teknik ini menandai teks tulisan AI tanpa memperlambat model atau menggunakan token tambahan, sebuah klaim yang akan segera diuji oleh regulator dan kompetitor.

Mengapa watermark ini penting

Watermark tersebut menyisipkan kunci privat dan konteks sekitarnya ke dalam keputusan pemilihan kata. Pembaca tidak dapat melihat polanya, tetapi verifikator yang mengetahui kunci tersebut dapat mendeteksinya. Dalam praktiknya, sebuah alat hilir memindai dokumen dan melaporkan apakah Claude yang menghasilkannya.

Tekanan regulasi

EU AI Act memaksa penyedia sistem generatif untuk menyematkan sinyal yang dapat dideteksi dalam konten sintetis.

Pertimbangan bisnis

Perusahaan harus mempertimbangkan tiga kekhawatiran saat memutuskan apakah akan mengadopsi tanda semacam itu:

  • Batasan keterlacakan – Watermark tersebut mengonfirmasi bahwa teks berasal dari model AI, tetapi tidak dapat menghubungkan output tersebut ke pengguna atau akun tertentu. Celah tersebut membiarkan akuntabilitas tetap terbuka ketika konten buatan AI disalahgunakan.
  • Risiko pendapatan – Beberapa penyedia khawatir watermark yang terlihat akan menakuti hingga sepertiga klien mereka, yang lebih menyukai teks tanpa tanda karena alasan kompetitif atau privasi.
  • Kendala teknis – Menyematkan pola dapat sedikit mengurangi kreativitas dari output model, terutama pada cuplikan teks yang sangat pendek di mana watermark memiliki lebih sedikit kata untuk diolah. Pengguna juga dapat memperlemah sinyal dengan menulis ulang sebagian teks secara manual, sehingga deteksi menjadi lebih sulit.

Anthropic bertaruh bahwa pendekatannya dapat menghindari sebagian besar kelemahan ini. Dengan menyisipkan kunci ke dalam proses pemilihan token, perusahaan mengklaim tidak ada penalti latensi dan tidak ada biaya token tambahan, sehingga menjaga pengalaman pengguna yang diharapkan oleh pelanggan berbayar.

Tantangan teknis

Kemampuan deteksi bergantung pada verifikator yang memiliki kunci privat yang sama dengan yang digunakan selama pembuatan. Teks pendek tetap menjadi titik lemah karena pola statistiknya kurang menonjol, sehingga meningkatkan tingkat negatif palsu (false-negative). Watermark juga tidak menghentikan pengeditan hilir; pengguna yang menulis ulang setengah paragraf dapat secara efektif menghapus penanda tersebut.

Poin Penting: Watermark Anthropic menjawab mandat hukum baru, tetapi dampaknya akan bergantung pada seberapa baik ia menyeimbangkan kemampuan deteksi dengan berkurangnya fleksibilitas dan risiko untuk dilewati.