Anthropic یک امضای دیجیتال پنهان در هر متن و فایلی که توسط مدل‌های Claude تولید می‌شود، جاسازی خواهد کرد؛ اقدامی که برای پاسخگویی به قوانین جدید شفافیت هوش مصنوعی اتحادیه اروپا طراحی شده است. این تغییر برای تمام مدل‌هایی که پس از اجرایی شدن کد شفافیت قانون هوش مصنوعی اتحادیه اروپا در تاریخ ۲ اوت منتشر شده‌اند، اعمال می‌شود و به‌طور خودکار در رابط‌های کاربری Claude API، Code، Cowork و Tag ظاهر خواهد شد.

چرا قوانین اتحادیه اروپا اهمیت دارند

کد شفافیت، توسعه‌دهندگان را ملزم می‌کند تا محتوای تولید یا ویرایش‌شده توسط هوش مصنوعی را علامت‌گذاری کنند تا سیستم‌های پایین‌دستی بتوانند منشأ مصنوعی آن را تشخیص دهند. هدف این قانون، مهار اطلاعات نادرست و ارائه سیگنالی واضح به کاربران در هنگام مواجهه با مطالب ساخته‌شده توسط ماشین است. پاسخ Anthropic — یعنی واترمارک‌گذاری (watermarking) در سطح مدل — نشانگر را مستقیماً در خروجی قرار می‌دهد، به جای اینکه آن را صرفاً به رابط کاربری محصول اضافه کند.

سایر غول‌های هوش مصنوعی نیز وعده‌های مشابهی داده‌اند. گوگل، متا، مایکروسافت، OpenAI و Black Forest Labs همگی گفته‌اند که استانداردهای اتحادیه اروپا را رعایت خواهند کرد. برای دارایی‌های غیرمتنی، Anthropic از استاندارد باز C2PA استفاده خواهد کرد؛ روشی با مستندات عمومی برای جاسازی داده‌های منشأ (provenance) در تصاویر، ویدیو و سایر رسانه‌ها. Anthropic امیدوار است با پیروی از یک مشخصه (spec) باز، علامت‌گذاری‌هایش با ابزارهایی که روزنامه‌نگاران، پلتفرم‌ها و حقیقت‌سنج‌ها در حال حاضر استفاده می‌کنند، سازگار باشد.

واترمارک چگونه کار می‌کند

Anthropic می‌گوید که واترمارک در فرآیند تولید متن مدل نهادینه شده است. در عمل، این امضا به بخشی از جریان توکن (token stream) که مدل منتشر می‌کند، تبدیل می‌شود. وقتی کاربر متن را در یک واژه‌پرداز، ایمیل یا پست شبکه‌های اجتماعی کپی می‌کند، این الگوی پنهان همراه با آن منتقل می‌شود. این شرکت خاطرنشان کرد که واترمارک می‌تواند در برابر ویرایش‌های جزئی مقاومت کند، اما فاش نکرده است که چه تعداد کاراکتر باید تغییر کند تا این علامت ناپدید شود.

نگرانی از «Claudefishing»

عرضه این قابلیت توسط Anthropic در حالی انجام می‌شود که نگرانی‌ها در مورد سوءاستفاده از مدل‌های زبانی بزرگ (LLMs) رو به افزایش است. کریس بِست (Chris Best)، مدیرعامل Substack، اخیراً اصطلاح «Claudefishing» را برای توصیف استفاده از هوش مصنوعی جهت ساخت محتوای فریبنده که از لحن یک نویسنده خاص تقلید می‌کند، ابداع کرده است. از آنجایی که تشخیص متن مصنوعی از نوشته‌های انسانی دشوارتر می‌شود، شناسایی خودکار منشأ متن به یک خط دفاعی حیاتی تبدیل خواهد شد.

Anthropic در افزودن اقدامات حفاظتی تنها نیست. پلتفرم تولید موسیقی Suno و سرویس خبرنامه Substack مکانیسم‌های علامت‌گذاری‌ای را معرفی کرده‌اند که هنگام تولید یک اثر توسط هوش مصنوعی، به خوانندگان هشدار می‌دهند. Anthropic با جاسازی واترمارک در منبع، قصد دارد سیگنال را به‌گونه‌ای قرار دهد که حذف آن دشوارتر و واکنش فیلترهای پایین‌دستی به آن آسان‌تر باشد.

نکات کلیدی

  • انطباق با مقررات: Anthropic در حال پیاده‌سازی واترمارک‌گذاری برای رعایت کد شفافیت قانون هوش مصنوعی اتحادیه اروپا است که از ۲ اوت اجرایی شده است.
  • یکپارچه‌سازی در سطح مدل: واترمارک‌ها در سطح مدل اعمال می‌شوند، بنابراین در تمام محصولات (API، Claude Code و غیره) باقی می‌مانند و در عملیات کپی-پیست نیز حفظ می‌شوند.
  • علامت‌گذاری استاندارد فایل‌ها: برای فایل‌ها، Anthropic از استاندارد باز C2PA استفاده خواهد کرد تا از قابلیت همکاری و شفافیت در محتوای دیجیتال اطمینان حاصل کند.