هوش مصنوعی در برابر فن‌فیکشن: نبرد بر سر تشخیص Claude در AO3

دنیای خلاقانه فن‌فیکشن (fanfiction) با یک جنگ داخلی دیجیتال روبرو است، زیرا اعضای این جامعه تلاش می‌کنند هوش مصنوعی مولد را از صفوف خود پاکسازی کنند. روش تشخیص جدید و بحث‌برانگیزی که مدل Claude متعلق به Anthropic را هدف قرار می‌دهد، ظهور کرده و باعث ایجاد ترس از تشخیص‌های اشتباه (false positives) و عدم دقت فنی شده است.

ظهور «Claude Detector» توسط @heatedrivalryai

سال‌هاست که تنش میان خالقان انسانی و مدل‌های هوش مصنوعی مانند ChatGPT و Claude در حوزه‌های خلاقانه وجود داشته است. در حالی که خوانندگان به‌طور سنتی بر نشانه‌های ذهنی و کیفی — مانند «نثر پرطمطراق» (purple prose) یا الگوهای نقطه‌گذاری خاص مثل استفاده بیش از حد از خط تیره (em dash) — تکیه می‌کردند، یک رویکرد فنی جدید در X (توییتر سابق) پدیدار شده است.

یک حساب کاربری ناشناس به نام @heatedrivalryai، یک «اسکین» (skin) یا افزونه مرورگر تخصصی طراحی کرده است که برای Archive of Our Own (AO3)، بزرگترین مخزن فن‌فیکشن جهان، ساخته شده است. برخلاف روش‌های کیفی قبلی، این ابزار ادعا می‌کند که یک اثر فنی خاص را شناسایی می‌کند: یک تگ HTML پنهان. به گفته توسعه‌دهنده، وقتی کاربری متن را مستقیماً از رابط کاربری Claude متعلق به Anthropic کپی کرده و در ویرایشگر AO3 می‌چسباند (paste می‌کند)، متن یک قطعه کد خاص را با خود حفظ می‌کند: font-claude-response-body.

مکانیسم تشخیص چگونه کار می‌کند

این مکانیسم به‌طور چشمگیری دوگانه (binary) است. هنگامی که اسکین AO3 این کد خاصِ «تزریق‌شده توسط Claude» را در متادیتا یا بدنه یک اثر شناسایی می‌کند، با قرمز کردن کل پس‌زمینه صفحه، یک هشدار بصری فعال می‌شود.

آزمایش‌ها کارایی فنی این روش خاص را تأیید کرده‌اند. وقتی داستانی تولید شده توسط Claude مستقیماً از چت‌بات به ویرایشگر AO3 چسبانده می‌شود، هشدار «صفحه قرمز» بلافاصله فعال می‌شود. با این حال، این تشخیص نسبت به روش ورود متن بسیار حساس است. اگر کاربری دقیقاً همان متن تولید شده توسط هوش مصنوعی را بردارد اما آن را به صورت متن ساده (plain text) و بدون قالب‌بندی (formatting) بچسباند، هشدار قرمز ناپدید می‌شود. این امر یک تمایز حیاتی را آشکار می‌کند: این ابزار «سبک نوشتاری هوش مصنوعی» را تشخیص نمی‌دهد، بلکه بقایای تصادفیِ عملیات «کپی-پیست» را شناسایی می‌کند.

خطر آسیب‌های جانبی در جوامع خلاق

اگرچه این ابزار کپی-پیست مستقیم را به‌طور مؤثر شناسایی می‌کند، اما خطرات قابل توجهی برای اکوسیستم گسترده‌تر فن‌فیکشن ایجاد می‌کند. نگرانی اصلی این است که جنبش برای «ریشه‌کن کردن» هوش مصنوعی می‌تواند منجر به ایجاد فضایی از سوءظن شود که در آن نویسندگان انسانیِ واقعی در میان آتش این درگیری گرفتار شوند.

تمایز بین «استفاده از هوش مصنوعی به عنوان یک ابزار» و «سرقت ادبی تولید شده توسط هوش مصنوعی» در حال حاضر یک منطقه خاکستری در اخلاق دیجیتال است. با اجرای روش‌های تشخیص خودکار و تهاجمی، این جامعه با خطر ایجاد فضای «گناهکار تا زمانی که بی‌گناهی ثابت شود» روبرو است. علاوه بر این، با ادغام بیشتر مدل‌های زبانی بزرگ (LLMs) در جریان‌های کاری نویسندگی، مرز بین یک پیش‌نویس هوش مصنوعی که توسط انسان ویرایش شده و یک خروجی خالص هوش مصنوعی به‌طور فزاینده‌ای کمرنگ می‌شود، که این امر باعث می‌شود «آثار فنی» معیار بی‌ثباتی برای سنجش اصالت باشند.

نکات کلیدی

  • تشخیص فنی: یک اسکین جدید در AO3، اثر کد font-claude-response-body را که هنگام چسباندن مستقیم از Claude متعلق به Anthropic باقی می‌ماند، هدف قرار می‌دهد.
  • نقص در روش‌شناسی: این تشخیص‌دهنده به جای ماهیت نثر، روش چسباندن را شناسایی می‌کند؛ به این معنی که اگر قالب‌بندی متن حذف شود، متن هوش مصنوعی می‌تواند از تشخیص عبور کند.
  • تأثیر بر جامعه: این اقدام نشان‌دهنده تشدید درگیری میان کاربردی بودن هوش مصنوعی مولد و حفظ فضاهای خلاقانه انسان‌محور است.