ШІ проти фанфікшну: битва навколо виявлення Claude на AO3
Творчий світ фанфікшну переживає цифрову громадянську війну, оскільки члени спільноти намагаються витіснити генеративний ШІ зі своїх лав. З'явився новий суперечливий метод виявлення, спрямований на модель Claude від Anthropic, що викликає побоювання щодо хибнопозитивних результатів та технічної неточності.
Поява «детектора Claude» від @heatedrivalryai
Протягом багатьох років напруженість між творцями-людьми та моделями ШІ, такими як ChatGPT і Claude, назрівала в творчих нішах. Хоча читачі традиційно покладалися на суб'єктивні ознаки — такі як «надмірна пишність стилю» (purple prose) або специфічні пунктуаційні патерни, наприклад, надмірне використання довгих тире — у X (колишній Twitter) з'явився новий технічний підхід.
Анонімний акаунт @heatedrivalryai представив спеціалізований «скін» (skin) або розширення для браузера, розроблене для Archive of Our Own (AO3) — найбільшого у світі репозиторію фанфікшну. На відміну від попередніх якісних методів, цей інструмент стверджує, що може ідентифікувати специфічний технічний артефакт: прихований HTML-тег. За словами розробника, коли користувач копіює текст безпосередньо з інтерфейсу Claude від Anthropic і вставляє його в редактор AO3, текст зберігає певний фрагмент коду: font-claude-response-body.
Як працює механізм виявлення
Механізм є разюче бінарним. Коли скін AO3 виявляє цей специфічний «впроваджений Claude» код у метаданих або тілі твору, він активує візуальне попередження, зафарбовуючи весь фон сторінки в червоний колір.
Тестування підтвердило технічну ефективність цього методу. Коли історія, створена Claude, вставляється безпосередньо з чат-бота в редактор AO3, сповіщення «червоного екрана» спрацьовує миттєво. Однак виявлення дуже залежить від способу введення. Якщо користувач бере той самий текст, створений ШІ, але вставляє його як звичайний текст (видаляючи форматування), червоне попередження зникає. Це виявляє критичну відмінність: інструмент виявляє не «стиль письма ШІ», а випадковий залишок дії «копіювати-вставити».
Ризик побічної шкоди для творчих спільнот
Хоча інструмент ефективно ідентифікує пряме копіювання, він створює значні ризики для всієї екосистеми фанфікшну. Головне побоювання полягає в тому, що рух за «викорінення» ШІ може призвести до атмосфери підозрілості, де справжні автори-люди опиняться під вогнем.
Розмежування між «використанням ШІ як інструменту» та «плагіатом, створеним ШІ» вже є сірою зоною в цифровій етиці. Впроваджуючи агресивні автоматизовані методи виявлення, спільнота ризикує створити атмосферу «винний, доки не доведено протилежне». Крім того, оскільки LLM стають дедалі більше інтегрованими в робочі процеси письма, межа між відредагованим людиною чернеткою ШІ та чистим результатом роботи ШІ стає дедалі розмитішою, що робить технічні «артефакти» ненадійним показником автентичності.
Основні висновки
- Технічне виявлення: Новий скін AO3 націлений на артефакт коду
font-claude-response-body, який залишається при прямому копіюванні з Claude від Anthropic. - Недолік методології: Детектор ідентифікує спосіб вставки, а не природу тексту, що означає, що текст ШІ може обійти виявлення, якщо з нього видалити форматування.
- Вплив на спільноту: Цей крок сигналізує про загострення конфлікту між користю генеративного ШІ та збереженням творчих просторів, орієнтованих на людину.
