Anthropic یک امضای دیجیتال پنهان در هر متن و فایلی که توسط مدلهای Claude تولید میشود، جاسازی خواهد کرد؛ اقدامی که برای پاسخگویی به قوانین جدید شفافیت هوش مصنوعی اتحادیه اروپا طراحی شده است. این تغییر برای تمام مدلهایی که پس از اجرایی شدن کد شفافیت قانون هوش مصنوعی اتحادیه اروپا در تاریخ ۲ اوت منتشر شدهاند، اعمال میشود و بهطور خودکار در رابطهای کاربری Claude API، Code، Cowork و Tag ظاهر خواهد شد.
چرا قوانین اتحادیه اروپا اهمیت دارند
کد شفافیت، توسعهدهندگان را ملزم میکند تا محتوای تولید یا ویرایششده توسط هوش مصنوعی را علامتگذاری کنند تا سیستمهای پاییندستی بتوانند منشأ مصنوعی آن را تشخیص دهند. هدف این قانون، مهار اطلاعات نادرست و ارائه سیگنالی واضح به کاربران در هنگام مواجهه با مطالب ساختهشده توسط ماشین است. پاسخ Anthropic — یعنی واترمارکگذاری (watermarking) در سطح مدل — نشانگر را مستقیماً در خروجی قرار میدهد، به جای اینکه آن را صرفاً به رابط کاربری محصول اضافه کند.
سایر غولهای هوش مصنوعی نیز وعدههای مشابهی دادهاند. گوگل، متا، مایکروسافت، OpenAI و Black Forest Labs همگی گفتهاند که استانداردهای اتحادیه اروپا را رعایت خواهند کرد. برای داراییهای غیرمتنی، Anthropic از استاندارد باز C2PA استفاده خواهد کرد؛ روشی با مستندات عمومی برای جاسازی دادههای منشأ (provenance) در تصاویر، ویدیو و سایر رسانهها. Anthropic امیدوار است با پیروی از یک مشخصه (spec) باز، علامتگذاریهایش با ابزارهایی که روزنامهنگاران، پلتفرمها و حقیقتسنجها در حال حاضر استفاده میکنند، سازگار باشد.
واترمارک چگونه کار میکند
Anthropic میگوید که واترمارک در فرآیند تولید متن مدل نهادینه شده است. در عمل، این امضا به بخشی از جریان توکن (token stream) که مدل منتشر میکند، تبدیل میشود. وقتی کاربر متن را در یک واژهپرداز، ایمیل یا پست شبکههای اجتماعی کپی میکند، این الگوی پنهان همراه با آن منتقل میشود. این شرکت خاطرنشان کرد که واترمارک میتواند در برابر ویرایشهای جزئی مقاومت کند، اما فاش نکرده است که چه تعداد کاراکتر باید تغییر کند تا این علامت ناپدید شود.
نگرانی از «Claudefishing»
عرضه این قابلیت توسط Anthropic در حالی انجام میشود که نگرانیها در مورد سوءاستفاده از مدلهای زبانی بزرگ (LLMs) رو به افزایش است. کریس بِست (Chris Best)، مدیرعامل Substack، اخیراً اصطلاح «Claudefishing» را برای توصیف استفاده از هوش مصنوعی جهت ساخت محتوای فریبنده که از لحن یک نویسنده خاص تقلید میکند، ابداع کرده است. از آنجایی که تشخیص متن مصنوعی از نوشتههای انسانی دشوارتر میشود، شناسایی خودکار منشأ متن به یک خط دفاعی حیاتی تبدیل خواهد شد.
Anthropic در افزودن اقدامات حفاظتی تنها نیست. پلتفرم تولید موسیقی Suno و سرویس خبرنامه Substack مکانیسمهای علامتگذاریای را معرفی کردهاند که هنگام تولید یک اثر توسط هوش مصنوعی، به خوانندگان هشدار میدهند. Anthropic با جاسازی واترمارک در منبع، قصد دارد سیگنال را بهگونهای قرار دهد که حذف آن دشوارتر و واکنش فیلترهای پاییندستی به آن آسانتر باشد.
نکات کلیدی
- انطباق با مقررات: Anthropic در حال پیادهسازی واترمارکگذاری برای رعایت کد شفافیت قانون هوش مصنوعی اتحادیه اروپا است که از ۲ اوت اجرایی شده است.
- یکپارچهسازی در سطح مدل: واترمارکها در سطح مدل اعمال میشوند، بنابراین در تمام محصولات (API، Claude Code و غیره) باقی میمانند و در عملیات کپی-پیست نیز حفظ میشوند.
- علامتگذاری استاندارد فایلها: برای فایلها، Anthropic از استاندارد باز C2PA استفاده خواهد کرد تا از قابلیت همکاری و شفافیت در محتوای دیجیتال اطمینان حاصل کند.
