منذ أن أصبح ChatGPT اسماً مألوفاً في كل بيت، نشأت أسطورة حول كاشفات الذكاء الاصطناعي. يتخيلها الناس ككلاب صيد رقمية تشم رائحة بصمات ChatGPT. لكن الحقيقة أقل سينمائية بكثير؛ فهذه الأدوات لا تستعلم من قاعدة بيانات سرية لكل ما كتبه نموذج لغوي كبير (LLM) على الإطلاق، وليس لديها خط مباشر للوصول إلى سجل المتصفح الخاص بك. ما تفعله في الواقع هو تمرير نصك عبر نماذج إحصائية والبحث عن إشارات رياضية ترتبط بالنثر المولد آلياً. إن فهم تلك الإشارات يساعدك على تفسير نتائجها بحكمة، ويحميك من الإيمان الأعمى بنسبة مئوية معينة.
كيف تعمل هذه الأدوات في الواقع
في جوهرها، كاشفات الذكاء الاصطناعي هي محركات لمطابقة الأنماط مدفوعة بالاحتمالات. تعمل النماذج اللغوية الكبيرة عن طريق التنبؤ بالرمز (token) التالي الأكثر احتمالاً، جملة تلو الأخرى. وعلى مدار آلاف الكلمات، تترك هذه العادة بقايا إحصائية، وتحاول الكاشفات قياس تلك البقايا.
فكر في الأمر كتحليل خط اليد؛ فالخبير لا يقارن حرف "g" الخاص بك بقاعدة بيانات رئيسية لكل حرف "g" كُتب على الإطلاق، بل ينظر بدلاً من ذلك إلى الإيقاع، والميل، والضغط، والتباعد. وتطبق الكاشفات منطقاً مشابهاً على النص؛ فهي تفحص مدى قابلية اللغة للتنبؤ، ومدى استمرارية هيكلها الموحد، وما إذا كانت المفردات تتناسب مع النطاق الإحصائي الضيق الشائع في الكتابة الاصطناعية.
ولأن كل مزود للكاشفات يدرب نموذجه على مجموعات بيانات (corpora) مختلفة ويضبط حساسيته بشكل مختلف، يمكن لنفس الفقرة أن تحصل على درجة 12 بالمائة في منصة و87 بالمائة في منصة أخرى. لا يوجد معيار عالمي لـ "صفة الذكاء الاصطناعي". فكل أداة هي في الأساس رأي مُصاغ بلغة الرياضيات.
الإشارات الأربع التي تبحث عنها الكاشفات
تبحث معظم منصات الكشف عن مجموعة محددة من العلامات. ومعرفة ماهيتها يزيل الكثير من اللبس.
القابلية للتنبؤ اللغة البشرية غير منتظمة. فالشخص الذي يصف مقهى قد يذكر رائحة الإسبريسو المحترقة، ثم يتوه في ذكرى عن مطبخ جدته، ثم يعود إلى ألواح الأرضية الملطخة. أما الذكاء الاصطناعي فيميل إلى اتباع مسار الاحتمالية الأعلى؛ حيث يختار الكلمات التي أظهرت بيانات تدريبه أنها الأكثر أماناً وتوقعاً. وتقيس الكاشفات ذلك من خلال مؤشرات مثل "الحيرة" (perplexity). فإذا كان نصك نادراً ما يفاجئ النموذج اللغوي الداخلي للكاشف، فإن الأداة تشتبه في تدخل الذكاء الاصطناعي. وكلما كان النثر أكثر قابلية للتنبؤ، زاد مؤشر التحذير.
تباين الجمل اقرأ ألف كلمة من مخرجات الذكاء الاصطناعي غير المحررة بصوت عالٍ، وقد تلاحظ تأثيراً يشبه إيقاع الميترونوم. فغالباً ما تأتي الجمل في نطاق عدد كلمات متشابه، وعادة ما تكون هياكل مركبة متصلة بأدوات عطف. أما الكتاب البشر فيتنفسون بشكل مختلف على الصفحة؛ فهم يكتبون جملاً ناقصة، ويتركون جملة قصيرة واحدة تبرز بقوة بعد جملة طويلة ومتعرجة، ويدرجون أسئلة، ويكسرون الإيقاع عن قصد. تبحث الكاشفات عن هذا عدم الانتظام، والذي يسمى غالباً "التباين المفاجئ" (burstiness). فالإيقاع السلس والموحد يبدو إحصائياً، بينما الإيقاع المتقطع وغير المتساوي يبدو بشرياً.
اتساق النبرة والمنظور تميل مخرجات الذكاء الاصطناعي إلى البقاء محصورة في نفس السجل اللغوي من الجملة الأولى إلى الأخيرة. فإذا بدأت بصوت رسمي بضمير الغائب، فإنها تظل كذلك عموماً. أما البشر فيتغيرون؛ فقد يبدأون بملاحظة مهنية، ثم يستحضرون قصة شخصية، ثم يلقون دعابة، ثم يعودون للجدية مرة أخرى. يستخدمون الجمل الاعتراضية، أو يغيرون المفردات، أو يناقضون نقطة سابقة عند إعادة التفكير. هذه التقلبات النبرية يصعب على النماذج اللغوية الحالية محاكاتها بشكل مقنع عبر النصوص الطويلة. وتتعامل الكاشفات مع هذا عدم الاتساق كدليل على وجود شخص حقيقي خلف لوحة المفاتيح.
اختيار الكلمات والأسلوب عادة ما تشغل الكتابة الاصطناعية منطقة وسطى رسمية بشكل غريب. فهي تفضل الأسماء المجردة الشائعة والأفعال المستخدمة على نطاق واسع على حساب المصطلحات العامية المحددة، أو الاصطلاحات الإقليمية، أو الاختصارات المهنية. قد يكتب مبرمج بشري أنه "قام بتركيب سكربت بسرعة" (hacked together a script) أو "صارع مع خط أنابيب البناء" (wrestled with the build pipeline)، بينما من المرجح أن يقول الذكاء الاصطناعي إنه "طور حلاً" أو "عالج مشكلة النشر". تلاحظ الكاشفات عندما يظل النص ضمن نطاق مفردات ضيق وعالي التكرار ونادراً ما يخاطر باستخدام تعبير غير مألوف أو تحريف لغوي متعمد.
لماذا تتغير درجتك عبر المنصات المختلفة
إذا قمت بلصق نفس المقال في ثلاثة كاشفات مختلفة، فقد تتلقى ثلاثة أحكام غير متوافقة. يحدث هذا لأن الآلية الأساسية تختلف بطرق جوهرية.
تم تدريب بعض الأدوات بشكل أساسي على مخرجات GPT-3.5 القديمة، بينما تستوعب أدوات أخرى أجيال GPT-4 الأحدث أو تدمج نصوصاً اصطناعية من نماذج متعددة. كما تختلف أوزان ميزاتها؛ فقد تعطي إحدى المنصات وزناً كبيراً لانتظام طول الجمل، بينما تركز أخرى على "الحيرة" (perplexity). أما العتبات فهي خيارات داخلية تعسفية؛ فقد يصنف أحد الموردين أي شيء يتجاوز نسبة ثقة 60% على أنه "من المحتمل أن يكون ذكاءً اصطناعياً"، بينما يحتفظ المنافسون بهذا التصنيف لنسبة 90%.
لا توجد هيئة منظمة تعتمد هذه الأدوات، فهي أدوات تجريبية تُسوق تحت غطاء من اليقين. وإن التعامل مع أحكامها كأدلة قانونية أو مبررات للعقاب الأكاديمي يشبه استخدام محطة أرصاد جوية محمولة للتنبؤ بإنتاج المحاصيل لموسم كامل.
مشكلة الإيجابيات الكاذبة
نظرًا لأن الكواشف تعتمد على الارتباط الإحصائي بدلاً من الدليل المباشر، فإنها تخطئ بشكل روتيني في تحديد الكتابة البشرية على أنها اصطناعية. وهناك عدة فئات من النثر المشروع عرضة لهذا الخطأ بشكل خاص.
تتبع الأوراق الأكاديمية قواعد صارمة؛ فاستخدام صيغة المبني للمجهول، وعبارات التحوط، وعناوين الأقسام المعيارية، يخلق ملفاً إحصائياً منتظماً للغاية يحاكي بيانات التدريب الخاصة بنماذج الذكاء الاصطناعي. وتواجه الأدلة التقنية المشكلة نفسها، حيث تستخدم مصطلحات متسقة، وجملًا تقريرية قصيرة، وتنوعاً عاطفياً ضئيلاً، وكلها أمور تثير الشكوك القائمة على الأنماط. أما الوثائق القانونية فهي في الأساس قوالب مهيكلة، وتبدو دقتها المتكررة خوارزمية بالنسبة للمصنف.
غالباً ما ينتج المتحدثون بغير الإنجليزية كتابات صحيحة قواعدياً ولكنها بسيطة تركيبياً. إن بناءهم الدقيق — تحديداً لأنه يتجنب الفوضى الاصطلاحية للمتحدث الأصلي — يمكن أن يضعه في نفس المنطقة الإحصائية للنصوص الآلية. فقد يُتهم طالب بذل ساعات في صياغة مقال ظلماً، لمجرد أن جمله المنضبطة والواضحة تبدو منظمة للغاية بالنسبة للكاشف.
استخدام الكواشف دون السماح لها باستغلالك
الطريقة الأكثر صحة للتعامل مع هذه الأدوات هي اعتبارها مرشحاً أولياً، وليس حكماً قضائياً. إذا كنت محرراً أو معلماً أو مديراً للتوظيف، فاجعل الدرجة العالية دافعاً لإجراء حوار بدلاً من توجيه اتهام. اسأل الكاتب عن أسلوبه، واطلب مخططاً أو مسودة أولية، وابحث عن التفكير الأصيل الكامن وراء النص.
إذا كنت كاتباً، فلا تحاول تحسين عملك لخداع الكاشف. ففي اللحظة التي تبدأ فيها بإدراج أخطاء مطبعية عشوائية، أو تقطيع الجمل بشكل مفتعل، أو استبدال الكلمات الدقيقة بمرادفات غريبة لتبدو "أكثر بشرية"، ستكون قد ضحيت بالوضوح من أجل الهواجس. لن تعود تكتب للقارئ، بل ستصبح تؤدي عرضاً لخوارزمية.
اكتب بالطريقة التي تفكر بها. نوّع في إيقاعك بشكل طبيعي. استخدم المفردات المتخصصة في مجالك. أدرج ملاحظات لا يمكن لأحد غيرك ملاحظتها. هذا النسيج هو أفضل دفاع لك ضد أي كاشف، والأهم من ذلك، هو ما يجعل كتابتك تستحق القراءة في المقام الأول.
الخلاصة الحقيقية
كواشف الذكاء الاصطناعي هي مجرد أدوات مساعدة تحليلية، وليست هي من يقود العملية. يمكنها أن تقترح متى يبدو النص سلساً من الناحية الإحصائية، لكنها لا تستطيع قياس البصيرة أو الإبداع أو الخبرة المعاشة. الدرجة الواثقة لا يمكنها إخبارك ما إذا كانت الحجة أصيلة، أو القصة حقيقية، أو التفسير التقني دقيقاً.
ركز على الوضوح. أعطِ الأولوية للإنسان الموجود على الجانب الآخر من الشاشة. للأفكار الأصلية نسيج لا يمكن لأي مصنف التقاطه بالكامل، ولن تحل أي نسبة مئوية محل حكم القارئ المتأني.
