تقوم Anthropic الآن بدمج نمط إحصائي مخفي — SynthID-Text — في كل استجابة من استجابات Claude. تقول الشركة إن هذه الخطوة تلبي "مدونة الشفافية" (Transparency Code) الخاصة بقانون الذكاء الاصطناعي في الاتحاد الأوروبي (EU AI Act)، وتمنح المطورين وسيلة لإثبات أن نصاً ما قد صدر عن نموذج ذكاء اصطناعي. وتصمد العلامة المائية أمام التعديلات العابرة مع ترك النثر دون تغيير للقراء البشر.
لماذا يتم إضافة العلامة المائية
ضغط المنظمون الأوروبيون على مزودي النماذج اللغوية الكبيرة (LLM) لجعل المحتوى الذي يتم إنشاؤه بواسطة الذكاء الاصطناعي قابلاً للتمييز عن الكتابة البشرية. وتُلزم "مدونة الشفافية" الخاصة بقانون الذكاء الاصطناعي في الاتحاد الأوروبي، والتي سيتم إنفاذها قريباً في جميع أنحاء الكتلة، المطورين بتوفير طريقة كشف موثوقة لأي نص تنتجه نماذجهم. وقد استجابت Anthropic من خلال اعتماد تقنية SynthID-Text التي وصفتها Google DeepMind لأول مرة العام الماضي.
أثار هذا القرار موجة من النقاشات على Reddit و X، حيث أعرب المستخدمون عن قلقهم من أن العلامة المائية قد تؤدي إلى تدهور جودة المخرجات أو تصبح باباً خلفياً للمراقبة. وترد Anthropic بأن النمط غير مرئي للقراء، ولا يسبب أي تأخير (latency)، ويمكن إيقافه في عمليات النشر الخاصة. ومن خلال نشر التفاصيل التقنية، تأمل الشركة في تهدئة التكهنات ووضع معيار للصناعة.
كيف تعمل تقنية SynthID-Text
تبحث أدوات كشف الذكاء الاصطناعي التقليدية عن السمات اللغوية الغريبة — مثل تكرار العبارات، أو علامات الترقيم غير المعتادة، أو الانحرافات الإحصائية عن الكتابة البشرية. وتختفي هذه الإشارات بمجرد أن يعيد الإنسان كتابة الفقرة، مما يجعل أدوات الكشف غير موثوقة. وفي المقابل، تقوم SynthID-Text بدمج إشارة سرية أثناء خطوة اختيار الرموز (token-selection) الخاصة بالنموذج.
عندما يختار Claude بين رمزين (tokens) متساويين في الاحتمالية — مثل "overcast" مقابل "grey" — يقوم النظام بتوجيه القرار نحو الرمز الذي يتوافق مع نمط ثنائي (binary pattern) محسوب مسبقاً. وعلى طول المستند، تخلق هذه التوجيهات تسلسلاً من البتات (bits) التي يمكن لواجهة برمجة تطبيقات الكشف (detection API) استخراجها لاحقاً. النمط منخفض التأثير بشكل متعمد: فالمرادف المختار لا يزال كلمة طبيعية تماماً، لذا يظل تدفق النص دون تغيير. ولأن العلامة المائية تعيش في تدفق الرموز (token stream) بدلاً من النص السطحي، فإنها تصمد أمام معظم عمليات المعالجة اللاحقة التي لا تستبدل كل رمز.
مقاومة التعديل: ما الذي يصمد وما الذي لا يصمد
من الانتقادات الشائعة هي أن المستخدمين يمكنهم ببساطة تعديل النثر الذي تم إنشاؤه بواسطة الذكاء الاصطناعي لمحو العلامة المائية. وتوضح الاختبارات الداخلية لشركة Anthropic ثلاثة سيناريوهات للتعديل:
- التعديل الخفيف – تصحيح الأخطاء المطبعية، أو استبدال بعض الصفات، أو تعديل ترتيب الجمل. تظل البصمة الإحصائية للعلامة المائية سليمة إلى حد كبير لأن معظم الرموز تظل دون تغيير.
- التعديل المكثف بمساعدة Claude – توجيه Claude لإعادة كتابة مسودة تحتوي بالفعل على جمل تم إنشاؤها بواسطة الذكاء الاصطناعي. إذا احتفظ المستخدم بالسيطرة على معظم الصياغة، فإن إشارة العلامة المائية تضعف بما يتناسب مع كمية النص الجديد الذي اختاره البشر.
- إعادة الكتابة الكاملة – استبدال كل رمز بتوليد جديد أو إعادة كتابة يدوية. عند هذه النقطة، يتم تدمير العلامة المائية الأصلية، ولكن النص الناتج لا يعود يستوفي تعريف الاتحاد الأوروبي لـ "المحتوى المُنشأ بواسطة الذكاء الاصطناعي" لأنه لا تتبقى أي آثار لمخرجات النموذج الأصلية.
الخلاصة: تقاوم العلامة المائية الصقل العابر ولكنها لا تقاوم إعادة التوليد الكامل للمحتوى.
توليد الكود: أين توجد العلامة المائية
يُستخدم Claude على نطاق واسع كمساعد برمجي، حيث ينتج كل شيء بدءاً من مقتطفات من سطر واحد وصولاً إلى وحدات برمجية كاملة (full-stack modules). تترك لغات البرمجة مجالاً ضيقاً لاختيار المرادفات؛ فاستبدال رمز مثل "for" بـ "while" من شأنه أن يغير المنطق البرمجي. لذلك، تتوقع Anthropic أن تظهر العلامة المائية حصرياً تقريباً في الأقسام التي يتمتع فيها النموذج بحرية اختيار الكلمات — مثل التعليقات (comments)، وسلاسل التوثيق (docstrings)، والنثر التوضيحي الذي يصاحب الكود.
ولأن الجزء الوظيفي من الكود يظل دون تغيير، فلا ينبغي للمطورين أن يلاحظوا أي انخفاض في الصحة أو الأداء. يقتصر وجود العلامة المائية على النص الملحق الذي يساعد البشر على فهم الكود، مما يلبي متطلبات الشفافية دون المساس بالمنفعة.
التأثيرات المتتابعة في الصناعة
لا تعمل Anthropic بمفردها. فقد وقع العديد من مطوري النماذج اللغوية الكبيرة (LLM) الآخرين على نفس "مدونة قواعد الممارسة" (Code of Practice) التي تدعو إلى توفير واجهة برمجة تطبيقات (API) موحدة للكشف. وإذا سار الجدول الزمني لإنفاذ الاتحاد الأوروبي كما هو مخطط له، فقد تصبح العلامة المائية طبقة افتراضية في بنية نماذج LLM، تماماً كما هو الحال مع التشفير لنقل البيانات اليوم. وتخاطر الشركات التي تتجاهل هذا المتطلب بالغرامات، أو فقدان الوصول إلى السوق في أوروبا، أو الإزالة القسرية لخدماتها.
نقاط الخلاف
يجادل النقاد بأن التوقيع الخفي، حتى وإن كان غير مرئي، يمكن إعادة استخدامه لأغراض التتبع أو الإسناد بما يتجاوز الامتثال التنظيمي. كما يخشون من النتائج الإيجابية الكاذبة: فمن شأن وجود API للكشف يخطئ في تصنيف النصوص التي كتبها البشر أن يقوض الثقة في المنصات التي تعتمد على هذه الإشارة. تقر Anthropic بهذه المخاطر وتقول إن خوارزمية الكشف ستكون مفتوحة المصدر، مما يسمح بإجراء عمليات تدقيق ومعايرة مستقلة.
ثمة قلق عملي آخر يتمثل في العبء الحسابي الإضافي الناتج عن إنشاء العلامة المائية. وتفيد Anthropic بأن المعالجة الإضافية تزيد من وقت الاستدلال بأقل من جزء من المئة، وهو ادعاء ستختبره قريباً اختبارات قياسية من جهات خارجية.
ما يجب مراقبته لاحقاً
- إطلاق الـ API – تخطط Anthropic لإصدار نقطة نهاية عامة تستخرج نمط البت الخفي من أي مخرجات لـ Claude. وسيكون بمقدور المطورين دمج عملية التحقق هذه في مسارات الإشراف على المحتوى.
- جهود التوحيد القياسي – تعمل الهيئات التنظيمية والمجموعات الصناعية على صياغة تنسيق مشترك للبيانات الوصفية للعلامة المائية، مما قد يسهل عملية الكشف عبر النماذج المختلفة.
- الدراسات التجريبية – بدأ الباحثون المستقلون في استقصاء مدى صمود SynthID-Text أمام أدوات إعادة الكتابة العدائية. وستحدد نتائجهم مدى الثقة التي توليها المنصات لهذه الإشارة.
الخلاصة
يمنح اعتماد Anthropic لتقنية SynthID-Text مجتمع الذكاء الاصطناعي أداة ملموسة للوفاء بقواعد الشفافية الأوروبية القادمة مع الحفاظ على جودة مخرجات Claude. تظل العلامة المائية صامدة أمام عمليات التدقيق اللغوي اليومية، لكنها تتلاشى عندما يتم إعادة إنشاء النص بالكامل، كما أنها توجد في الأجزاء غير البرمجية من مخرجات البرمجة حيث لا تتعارض مع الوظائف البرمجية. ويعتمد تحول هذا النهج إلى معيار صناعي على مدى كفاءة الـ API الخاص بالكشف في بيئات العالم الحقيقي، وما إذا كان من الممكن معالجة المخاوف المتعلقة بالخصوصية والإنذارات الكاذبة.
