يواجه نظام Gemini AI من Google دعوى قضائية جماعية رُفعت في محكمة فيدرالية بنيويورك، تتهم الشركة بتدريب نماذجها على كتب ومقالات محمية بحقوق الطبع والنشر دون إذن. وتذكر الشكوى، التي قدمها تحالف يضم ناشرين كبار والكاتب Scott Turow، أن Google تعمدت تجريد معلومات حقوق الطبع والنشر لإخفاء استخدام "مواد مسروقة" في نظام الذكاء الاصطناعي التوليدي الخاص بها.

الدعوى القضائية وادعاءاتها الأساسية

تُدرج الدعوى المرفوعة في المحكمة الجزئية الأمريكية للمنطقة الجنوبية بنيويورك كلاً من Hachette وCencage وElsevier وتجمع S.C.R.I.B.E. وTurow كمدعين. ويزعم هؤلاء أن Google تجاوزت ترتيب "المقتطفات فقط" الذي كان يحكم Google Books، حيث استخدمت أعمالاً بنصوص كاملة من ذلك الأرشيف ومن العناوين التي تم رفعها على Google Play لتدريب Gemini. ووفقاً للشكوى، لم تكتفِ Google بسحب المحتوى فحسب، بل قامت أيضاً بتعديل أو إزالة البيانات الوصفية لحقوق الطبع والنشر، وهي خطوة يقول المدعون إنها كانت تهدف إلى إخفاء الانتهاك.

وتحذر مذكرة داخلية من Google تمت الإشارة إليها في الدعوى من أن استخدام الكتب المحمية بحقوق الطبع والنشر لتدريب الذكاء الاصطناعي قد يكون "إشكالياً للغاية" ويعرض الشركة لغرامات تتراوح بين 10 مليارات و100 مليار دولار. ويشير المدعون إلى غرامة قدرها 1.5 مليار دولار فُرضت مؤخراً على شركة ذكاء اصطناعي أخرى بسبب استخدام البيانات غير المصرح به، كمعيار لحجم المسؤولية المحتملة.

كيف وصلنا إلى هنا

بدأت علاقة Google مع ناشري الكتب من خلال Google Books، وهو فهرس قابل للبحث يعرض مقتطفات قصيرة وتفاصيل ببليوغرافية مع إبقاء النص الكامل خلف جدار دفع. اعتمد هذا النموذج على اتفاقيات ترخيص تقتصر على عرض المقتطفات فقط. وعلى مر السنين، وسعت Google نطاق حيازاتها من خلال متجر Google Play، حيث يقوم الناشرون والمؤلفون برفع كتب إلكترونية بنصوص كاملة للبيع.

ويجادل المدعون بأن تحول Google من خدمة فهرسة "محدودة النطاق" إلى مصدر بيانات لتدريب النماذج اللغوية الكبيرة (LLMs) يعد خرقاً للاتفاقيات الأصلية. ويقولون إن الشركة لم تحصل أبداً على الأذونات الواسعة اللازمة لإدراج أعمال كاملة في مسار تدريب Gemini.

ما هو على المحك بالنسبة لشركة Google وصناعة الذكاء الاصطناعي

إذا وجدت المحكمة أن استخدام المواد المحمية بحقوق الطبع والنشر دون ترخيص ينتهك قانون حقوق الطبع والنشر، فإن القرار قد يعيد تشكيل كيفية تجميع مطوري الذكاء الاصطناعي لبيانات التدريب.

الدفاعات والحجج المضادة المحتملة

من المرجح أن تستند Google إلى عقيدة "الاستخدام العادل"، التي تسمح بالاستخدام المحدود للمواد المحمية بحقوق الطبع والنشر لأغراض التعليق أو النقد أو التحويل. وقد عاملت أحكام قضائية حديثة في كاليفورنيا تدريب الذكاء الاصطناعي كنشاط تحويلي، مما منحه حماية الاستخدام العادل. وقد رفع المدعون في نيويورك دعواهم خارج ذلك النطاق القضائي لتجنب تلك السوابق.

ويرد المدعون بأن إزالة البيانات الوصفية لحقوق الطبع والنشر تظهر نية لإخفاء المصدر، مما يقوض أي ادعاء بالتحويل بحسن نية. كما يستشهدون بالمذكرة الداخلية كدليل على أن Google كانت تدرك المخاطر القانونية.

ما الذي يجب مراقبته لاحقاً

ستمر القضية عبر طلبات ما قبل المحاكمة التي قد تشكل الحجج المتاحة لكلا الجانبين، بما في ذلك ما إذا كانت المحكمة ستطبق تحليل الاستخدام العادل المستخدم في كاليفورنيا أو ستعتمد معياراً مختلفاً. وقد يحدد قرار بشأن الاختصاص القضائي ما إذا كانت محاكم نيويورك ستصبح المكان الرئيسي لنزاعات حقوق الطبع والنشر المتعلقة بالذكاء الاصطناعي.

الخلاصة: قد تعيد الدعوى المرفوعة في نيويورك ضد Gemini من Google رسم الخط الفاصل بين استخدام البيانات المسموح به وانتهاك حقوق الطبع والنشر، مما يجبر مطوري الذكاء الاصطناعي على إعادة التفكير في كيفية الحصول على المواد الخام التي تشغل نماذجهم، وإعادة تشكيل اقتصاديات الصناعة بأكملها.