تم إيقاف معلم في الهند عن العمل بعد انتشار مقطع فيديو لحادثة داخل الفصل الدراسي عبر إحدى مجموعات الدردشة، وانقسم المشاهدون حول ما إذا كان المقطع حقيقياً أم تم إنشاؤه بواسطة الذكاء الاصطناعي. يسلط هذا الضجيج الضوء على "عائد الكاذب" (liar’s dividend) – وهي الطريقة التي يسمح بها مجرد وجود الوسائط الاصطناعية لأي شخص بالتشكيك في الأدلة الحقيقية – كما يكشف عن نقطة عمياء في الموجة الحالية من كاشفات التزييف العميق (deep-fake detectors).
القضية التي أثارت الإنذار
مع انتشار المقطع بشكل واسع، اندلع نقاش موازٍ: أشار بعض المستخدمين إلى وجود خلل تقني (glitches) قد يكشف عن تزييف عميق، بينما قال آخرون إن مجرد احتمال التلاعب يجعل أي دليل مرئي غير موثوق.
لماذا تقصر كاشفات التزييف العميق الحالية عن أداء المهمة
تبحث معظم حلول مكافحة التزييف العميق عن الآثار (artifacts) التي تتركها النماذج التوليدية – مثل أنماط البكسل الغريبة، أو الإضاءة غير المتسقة، أو الإشارات الصوتية غير المتطابقة. يمكن لهذه القرائن أن تشير إلى أصل اصطناعي، لكنها لا تفعل شيئاً لتأكيد هوية الشخص الذي يظهر في الإطار بالفعل. في قاعة المحكمة أو جلسة تأديبية، فإن درجة الاحتمالية التي تشير إلى أن الفيديو "من المحتمل أن يكون مزيفاً" لا تحسم مسألة الهوية. إن التركيز الحالي على سؤال "هل هذا الفيديو مزيف؟" يترك فجوة عندما تكون القضية الحقيقية هي "هل يظهر هذا الفيديو الشخص الذي يدعي إظهاره؟".
الحاجة إلى هوية بيومترية قابلة للتحقق
يحتاج المحققون إلى وسيلة لإثبات، بدقة رياضية، أن الوجه الموجود في الفيديو ينتمي إلى فرد معين. تستخرج خطوط معالجة الرؤية الحاسوبية الحديثة (computer-vision pipelines) متجه ميزات عالي الأبعاد – يُعرف بـ "التضمين" (embedding) – من كل وجه. ومن خلال قياس المسافة الإقليدية (Euclidean distance) بين تضمينين، يقوم النظام بتحديد مدى تشابه الوجوه. تشير المسافات الصغيرة إلى أنه نفس الشخص؛ بينما تشير المسافات الأكبر إلى فرد مختلف. يعمل هذا حتى عندما يكون المقطع مشوشاً أو ذا إضاءة ضعيفة، لأن التضمينات تلتقط الخصائص الوجهية المجردة بدلاً من قيم البكسل الخام.
عقبات عملية أمام المحققين
هناك عقبتان تجعلان التحقق البيومتري بعيد المنال للكثيرين ممن يحتاجون إليه. أولاً، الأدوات ذات المستوى المؤسسي (enterprise-grade) التي تعد بدقة عالية تحمل أسعاراً لا تستطيع فرق البحث الصغيرة أو المحققون المستقلون تحمل تكلفتها. ثانياً، تضحي التطبيقات الموجهة للمستهلكين بالدقة مقابل السهولة، مما يؤدي إلى معدلات عالية من الإيجابيات الكاذبة (false-positive rates) التي لا تصمد أمام التدقيق القانوني. إن الجمع بين التكلفة والنتائج غير الموثوقة يجبر المحققين على الاعتماد على مقارنات بصرية ارتجالية بعيدة كل البعد عن المنهج العلمي.
بناء أدوات يمكنها الصمود في المحكمة
يجب على المطورين الذين يهدفون إلى سد هذه الفجوة اتباع فلسفة تصميم تتكون من ثلاث خطوات:
- إظهار الثقة، وليس مجرد إجابة ثنائية. أبلغ عن المسافة بين التضمينات واسمح للمستخدمين بتحديد عتباتهم الخاصة. تتيح الدرجة الشفافة للمحامي الدفع بمعيار أكثر صرامة إذا لزم الأمر.
- التحقق من مصدر الملف. افحص البيانات الوصفية (metadata)، وقيم الهاش (hash values)، وعناوين URL المصدرية للكشف عن التلاعب أو سوء الإسناد. غالباً ما يضع المحتالون مقاطع الفيديو في سياقات مضللة، لذا يجب أن تقوم خطوط المعالجة بالإشارة إلى المصادر المشبوهة.
- إعطاء الأولوية للسرعة وكفاءة الموارد. يمكن للنماذج خفيفة الوزن المبنية على مكتبات مفتوحة المصدر أن تعمل على أجهزة متواضعة، مما يجعل التكنولوجيا متاحة للمحققين المستقلين دون التضحية بالسلامة الرياضية.
بعيداً عن الأرقام المجردة، يجب أن تتضمن المخرجات وسائل مساعدة بصرية: معالم الوجه المتراكبة (overlayed facial landmarks).
الخلاصة: المعركة الحقيقية لا تقتصر فقط على رصد الفيديوهات الاصطناعية؛ بل تتعلق بمنح المحققين وسيلة سليمة رياضياً لتأكيد هوية الشخص الموجود على الشاشة. المطورون الذين يتحولون من مجرد كشف التزييف العميق إلى التحقق من الهوية البيومترية سيساعدون في منع مقطع فيديو واحد واسع الانتشار من تدمير حياة إنسان.
