آنتروپیک (Anthropic) با تعهد به واترمارک کردن (علامت‌گذاری دیجیتال) تمامی خروجی‌های مدل Claude در سطح جهانی، تغییر بزرگی را در شفافیت هوش مصنوعی اعلام کرده است. این اقدام که تحت تأثیر دستورالعمل‌های قانون هوش مصنوعی اتحادیه اروپا (EU AI Act) صورت گرفته، با هدف ارائه منشأ مشخص برای متن‌ها و فایل‌های تولیدشده توسط هوش مصنوعی در کل اکوسیستم محصولات این شرکت انجام می‌شود.

استانداردی جهانی برای منشأ و شفافیت

اگرچه این الزام از قانون هوش مصنوعی اتحادیه اروپا نشأت می‌گیرد، اما Anthropic این محافظت‌ها را تنها به کاربران اروپایی محدود نمی‌کند. از اوت ۲۰۲۶، تمامی مدل‌های جدید Claude دارای برچسب‌گذاری داخلی خواهند بود. این عرضه شامل تمام مجموعه Claude، از جمله Claude API، Claude Code، Claude Cowork و Claude Tag خواهد بود.

این استراتژی شامل یک رویکرد دو لایه برای شناسایی است. برای متن، Anthropic یک واترمارک نامرئی را در سطح مدل پیاده‌سازی خواهد کرد. این واترمارک به‌گونه‌ای طراحی شده است که مزاحمتی ایجاد نکند و اطمینان حاصل شود که معنا، کیفیت و خوانایی متن دست‌نخورده باقی می‌ماند. نکته حیاتی این است که Anthropic ادعا می‌کند این نشانه‌ها حتی پس از کپی، چسباندن (paste) یا ویرایش‌های جزئی متن نیز ممکن است باقی بمانند.

برای داده‌های بصری و ساختاریافته، Anthropic از استاندارد باز C2PA (ائتلاف برای منشأ و اصالت محتوا) استفاده خواهد کرد. فرمت‌های فایل پشتیبانی‌شده مانند .svg، .png و .jpg حاوی متادیتای منشأ با امضای دیجیتال خواهند بود. این امضا به عنوان یک سابقه قابل تأیید عمل می‌کند که نشان می‌دهد Claude فایل را پردازش کرده است و می‌تواند به شناسایی دست‌کاری‌های بعدی کمک کند.

چالش‌های فنی و محدودیت‌های شناسایی

علی‌رغم چارچوب فنی قدرتمند، Anthropic موضع واقع‌بینانه‌ای در مورد محدودیت‌های واترمارک کردن اتخاذ کرده است. شناسایی یک واترمارک لزوماً ثابت نمی‌کند که Claude نویسنده آن محتوا بوده است؛ کاربران اغلب از Claude برای وظایف ثانویه مانند ترجمه، خلاصه‌سازی یا غلط‌گیری استفاده می‌کنند که می‌تواند باعث ایجاد واترمارک روی ایده‌هایی شود که منشأ انسانی دارند.

برعکس، نبود واترمارک تضمینی برای نویسندگی انسانی نیست. عوامل متعددی می‌توانند این سیگنال‌ها را از بین برده یا پنهان کنند، از جمله:

  • ویرایش دستی سنگین یا بازترجمه گسترده.
  • بخش‌های متنی که برای شناسایی آماری قابل اعتماد، بسیار کوتاه هستند.
  • حذف متادیتا در حین تبدیل فرمت یا از طریق اسکرین‌شات.

این موضوع فضای پیچیده‌ای را برای توسعه‌دهندگان ایجاد می‌کند. کسانی که Claude را در سرویس‌های شخص ثالث ادغام می‌کنند، باید با دقت ارزیابی کنند که کدام الزامات ماده ۵۰ قانون هوش مصنوعی اتحادیه اروپا در مورد پیاده‌سازی خاص آن‌ها صدق می‌کند.

چشم‌انداز گسترده‌تر هوش مصنوعی: رقابت و اخلاق

حرکت Anthropic، این شرکت را در زمینه ایمنی و شفافیت، در رقابت مستقیم با سایر غول‌های این صنعت قرار می‌دهد. Google DeepMind پیش از این سیستم SynthID خود را در مدل‌های Gemini ادغام کرده است که با تغییر احتمالات پیش‌بینی توکن، واترمارک‌ها را جاسازی می‌کند. در همین حال، OpenAI با ذکر نگرانی‌هایی در مورد مثبت کاذب بودن نتایج و سهولت دور زدن چنین ابزارهایی توسط کاربران از طریق بازنویسی، انتشار تشخیص‌دهنده متن با دقت بالای خود را به تأخیر انداخته است.

مخاطرات به‌ویژه در بخش آموزش بسیار بالا است. از آنجایی که موسسات با سرقت ادبی به کمک هوش مصنوعی و کلاهبرداری‌های «مبتنی بر هوش مصنوعی» شامل تقلب در کمک‌های مالی دست و پنجه نرم می‌کنند، نیاز به شناسایی قابل اعتماد بسیار فوری است. با این حال، صنعت باید این نیاز را در برابر خطر اتهامات نادرست متعادل کند. Anthropic با انتشار ابزارهای تأیید برای اشخاص ثالث، تلاش می‌کند صنعت را به سمت یک روش استاندارد و قابل تأیید برای احراز اصالت محتوا سوق دهد.

نکات کلیدی

  • اجرای جهانی: واترمارک کردن Anthropic برای تمام محصولات Claude در سطح جهانی، از جمله API، و نه فقط در اتحادیه اروپا، اعمال خواهد شد.
  • رویکرد دو روشی: این شرکت از واترمارک‌های متنی نامرئی و متادیتای امضا شده با استاندارد C2PA برای فایل‌های تصویری (.png, .jpg, .svg) استفاده خواهد کرد.
  • ماندگاری در مقابل قابلیت اطمینان: اگرچه واترمارک‌ها برای باقی ماندن پس از کپی و ویرایش‌های جزئی طراحی شده‌اند، اما بی‌نقص نیستند و می‌توان با تغییر فرمت گسترده یا ترجمه، آن‌ها را دور زد.