Anthropic, Claude modelleri tarafından üretilen her metin ve dosyaya gizli bir dijital imza yerleştirecek; bu hamle, Avrupa Birliği'nin yeni yapay zeka şeffaflık kurallarını karşılamak amacıyla tasarlandı. Değişiklik, AB Yapay Zeka Yasası'nın Şeffaflık Kodu'nun 2 Ağustos'ta yürürlüğe girmesinden sonra yayınlanan tüm modeller için geçerli olacak ve Claude'un API, Code, Cowork ve Tag arayüzlerinde otomatik olarak görünecek.

AB kuralı neden önemli

Şeffaflık Kodu, sonraki sistemlerin içeriğin sentetik kökenini tespit edebilmesi için geliştiricileri yapay zeka tarafından oluşturulan veya düzenlenen içeriği işaretlemeye zorunlu kılıyor. Kural, yanlış bilgiyi dizginlemeyi ve kullanıcıların makine tarafından üretilmiş bir materyalle karşılaştıklarında net bir sinyal almalarını sağlamayı amaçlıyor. Anthropic'in yanıtı olan model düzeyinde filigranlama, işareti bir ürün kullanıcı arayüzüne eklemek yerine doğrudan çıktıya yerleştiriyor.

Diğer yapay zeka devleri de benzer sözler veriyor. Google, Meta, Microsoft, OpenAI ve Black Forest Labs'in tamamı AB standartlarını karşılayacaklarını belirtti. Metin dışı varlıklar için Anthropic, görüntülere, videolara ve diğer medya türlerine köken verisi yerleştirmek için kullanılan, kamuya açık belgelenmiş bir yöntem olan C2PA açık standardını kullanacak. Anthropic, açık bir spesifikasyonu takip ederek işaretlemelerinin gazetecilerin, platformların ve teyitçilerin halihazırda kullandığı araçlarla uyumlu olmasını umuyor.

Filigran nasıl çalışır

Anthropic, filigranın modelin metin oluşturma sürecine dahil edildiğini söylüyor. Uygulamada imza, modelin yaydığı token akışının bir parçası haline geliyor. Bir kullanıcı metni bir kelime işlemciye, bir e-postaya veya bir sosyal medya gönderisine kopyaladığında, gizli desen metinle birlikte taşınıyor. Şirket, filigranın hafif düzenlemelerden etkilenebilmeyeceğini ancak işaretin kaybolması için kaç karakterin değişmesi gerektiğini açıklamadı.

“Claudefishing” endişesi

Anthropic'in bu uygulaması, büyük dil modellerinin (LLM'ler) kötüye kullanımına dair endişelerin arttığı bir dönemde geliyor. Substack CEO'su Chris Best, belirli bir yazarın sesini taklit eden yanıltıcı içerikler oluşturmak için yapay zekanın kullanılmasını tanımlamak amacıyla yakın zamanda “Claudefishing” terimini türetti. Sentetik metinleri insan yazısından ayırt etmek zorlaştıkça, kökenin otomatik olarak tespiti kritik bir savunma hattı haline geliyor.

Güvenlik önlemleri ekleme konusunda Anthropic yalnız değil. Müzik oluşturma platformu Suno ve bülten servisi Substack, bir içeriğin yapay zeka tarafından oluşturulduğuna dair okuyucuları uyaran işaretleme mekanizmaları tanıttı. Anthropic, filigranı kaynağında yerleştirerek sinyalin temizlenmesini zorlaştırmayı ve sonraki aşamadaki filtrelerin bu sinyale tepki vermesini kolaylaştırmayı amaçlıyor.

Önemli Çıkarımlar

  • Yasal Uyumluluk: Anthropic, 2 Ağustos'ta yürürlüğe giren AB Yapay Zeka Yasası'nın Şeffaflık Kodu'nu karşılamak için filigranlama uyguluyor.
  • Model Düzeyinde Entegrasyon: Filigranlar model düzeyinde uygulanır, böylece tüm ürünlerde (API, Claude Code vb.) kalıcı olurlar ve kopyala-yapıştır işlemlerinden etkilenmezler.
  • Standartlaştırılmış Dosya İşaretleme: Dosyalar için Anthropic, dijital içerikte birlikte çalışabilirliği ve şeffaflığı sağlamak amacıyla C2PA açık standardını kullanacak.