آنتروپیک (Anthropic) با تعهد به واترمارک کردن (علامتگذاری دیجیتال) تمامی خروجیهای مدل Claude در سطح جهانی، تغییر بزرگی را در شفافیت هوش مصنوعی اعلام کرده است. این اقدام که تحت تأثیر دستورالعملهای قانون هوش مصنوعی اتحادیه اروپا (EU AI Act) صورت گرفته، با هدف ارائه منشأ مشخص برای متنها و فایلهای تولیدشده توسط هوش مصنوعی در کل اکوسیستم محصولات این شرکت انجام میشود.
استانداردی جهانی برای منشأ و شفافیت
اگرچه این الزام از قانون هوش مصنوعی اتحادیه اروپا نشأت میگیرد، اما Anthropic این محافظتها را تنها به کاربران اروپایی محدود نمیکند. از اوت ۲۰۲۶، تمامی مدلهای جدید Claude دارای برچسبگذاری داخلی خواهند بود. این عرضه شامل تمام مجموعه Claude، از جمله Claude API، Claude Code، Claude Cowork و Claude Tag خواهد بود.
این استراتژی شامل یک رویکرد دو لایه برای شناسایی است. برای متن، Anthropic یک واترمارک نامرئی را در سطح مدل پیادهسازی خواهد کرد. این واترمارک بهگونهای طراحی شده است که مزاحمتی ایجاد نکند و اطمینان حاصل شود که معنا، کیفیت و خوانایی متن دستنخورده باقی میماند. نکته حیاتی این است که Anthropic ادعا میکند این نشانهها حتی پس از کپی، چسباندن (paste) یا ویرایشهای جزئی متن نیز ممکن است باقی بمانند.
برای دادههای بصری و ساختاریافته، Anthropic از استاندارد باز C2PA (ائتلاف برای منشأ و اصالت محتوا) استفاده خواهد کرد. فرمتهای فایل پشتیبانیشده مانند .svg، .png و .jpg حاوی متادیتای منشأ با امضای دیجیتال خواهند بود. این امضا به عنوان یک سابقه قابل تأیید عمل میکند که نشان میدهد Claude فایل را پردازش کرده است و میتواند به شناسایی دستکاریهای بعدی کمک کند.
چالشهای فنی و محدودیتهای شناسایی
علیرغم چارچوب فنی قدرتمند، Anthropic موضع واقعبینانهای در مورد محدودیتهای واترمارک کردن اتخاذ کرده است. شناسایی یک واترمارک لزوماً ثابت نمیکند که Claude نویسنده آن محتوا بوده است؛ کاربران اغلب از Claude برای وظایف ثانویه مانند ترجمه، خلاصهسازی یا غلطگیری استفاده میکنند که میتواند باعث ایجاد واترمارک روی ایدههایی شود که منشأ انسانی دارند.
برعکس، نبود واترمارک تضمینی برای نویسندگی انسانی نیست. عوامل متعددی میتوانند این سیگنالها را از بین برده یا پنهان کنند، از جمله:
- ویرایش دستی سنگین یا بازترجمه گسترده.
- بخشهای متنی که برای شناسایی آماری قابل اعتماد، بسیار کوتاه هستند.
- حذف متادیتا در حین تبدیل فرمت یا از طریق اسکرینشات.
این موضوع فضای پیچیدهای را برای توسعهدهندگان ایجاد میکند. کسانی که Claude را در سرویسهای شخص ثالث ادغام میکنند، باید با دقت ارزیابی کنند که کدام الزامات ماده ۵۰ قانون هوش مصنوعی اتحادیه اروپا در مورد پیادهسازی خاص آنها صدق میکند.
چشمانداز گستردهتر هوش مصنوعی: رقابت و اخلاق
حرکت Anthropic، این شرکت را در زمینه ایمنی و شفافیت، در رقابت مستقیم با سایر غولهای این صنعت قرار میدهد. Google DeepMind پیش از این سیستم SynthID خود را در مدلهای Gemini ادغام کرده است که با تغییر احتمالات پیشبینی توکن، واترمارکها را جاسازی میکند. در همین حال، OpenAI با ذکر نگرانیهایی در مورد مثبت کاذب بودن نتایج و سهولت دور زدن چنین ابزارهایی توسط کاربران از طریق بازنویسی، انتشار تشخیصدهنده متن با دقت بالای خود را به تأخیر انداخته است.
مخاطرات بهویژه در بخش آموزش بسیار بالا است. از آنجایی که موسسات با سرقت ادبی به کمک هوش مصنوعی و کلاهبرداریهای «مبتنی بر هوش مصنوعی» شامل تقلب در کمکهای مالی دست و پنجه نرم میکنند، نیاز به شناسایی قابل اعتماد بسیار فوری است. با این حال، صنعت باید این نیاز را در برابر خطر اتهامات نادرست متعادل کند. Anthropic با انتشار ابزارهای تأیید برای اشخاص ثالث، تلاش میکند صنعت را به سمت یک روش استاندارد و قابل تأیید برای احراز اصالت محتوا سوق دهد.
نکات کلیدی
- اجرای جهانی: واترمارک کردن Anthropic برای تمام محصولات Claude در سطح جهانی، از جمله API، و نه فقط در اتحادیه اروپا، اعمال خواهد شد.
- رویکرد دو روشی: این شرکت از واترمارکهای متنی نامرئی و متادیتای امضا شده با استاندارد C2PA برای فایلهای تصویری (.png, .jpg, .svg) استفاده خواهد کرد.
- ماندگاری در مقابل قابلیت اطمینان: اگرچه واترمارکها برای باقی ماندن پس از کپی و ویرایشهای جزئی طراحی شدهاند، اما بینقص نیستند و میتوان با تغییر فرمت گسترده یا ترجمه، آنها را دور زد.
