تسوية Anthropic بشأن القرصنة بقيمة 1.5 مليار دولار: خسارة قياسية وفوز استراتيجي
توصلت Anthropic إلى تسوية تاريخية بقيمة 1.5 مليار دولار مع مجموعة من مؤلفي الكتب، وذلك في أعقاب اتهامات باستخدام قواعد بيانات مقرصنة لتدريب نماذجها. وبينما تمثل هذه الدفعة الضخمة ضربة مالية، فإن التفاصيل القانونية الدقيقة للقضية قد توفر في الواقع انتصاراً كبيراً لصناعة الذكاء الاصطناعي الأوسع نطاقاً فيما يتعلق بمبدأ "الاستخدام العادل".
تفاصيل التسوية القياسية
وافقت محكمة فيدرالية في سان فرانسيسكو على تسوية تاريخية بعد أن كشفت الأدلة أن Anthropic قامت بتنزيل كتب من قواعد بيانات قرصنة سيئة السمعة، وتحديداً LibGen و PiLiMi، بين عامي 2021 و2022. ويُعد حجم هذه التسوية غير مسبوق في تاريخ الدعاوى الجماعية، حيث تغطي ما يقرب من 482,460 عملاً مدرجاً.
ومن بين إجمالي الأعمال المعنية، نجح المؤلفون في المطالبة بنسبة 91.3 بالمائة منها. ومن المقرر أن يحصل كل مدّعٍ على حوالي 3,000 دولار، وهو رقم يعادل أربعة أضعاف الحد الأدنى القانوني. وكجزء من التسوية القانونية، تُطالب Anthropic بتدمير الملفات المقرصنة التي استُخدمت خلال هذه الفترة. والأهم من ذلك، أن التسوية لا تمنح الشركة حصانة مطلقة؛ إذ يحتفظ المؤلفون بالحق في تقديم مطالبات إذا قامت مخرجات الذكاء الاصطناعي بإعادة إنتاج الأعمال الأصلية، أو إذا انتهكت ممارسات الحصول على البيانات المستقبلية لشركة Anthropic قوانين حقوق الطبع والنشر.
ثغرة قانونية تصب في مصلحة تطوير الذكاء الاصطناعي
على الرغم من التكلفة الباهظة البالغة 1.5 مليار دولار، فإن السابقة القانونية التي أرستها هذه القضية مواتية بشكل مفاجئ لمختبرات الذكاء الاصطناعي. إذ تتناول التسوية الفعل المحدد المتمثل في استخدام مصادر مقرصنة، لكنها لا تفصل في قانونية تدريب الذكاء الاصطناعي في حد ذاته.
وكان القاضي Alsup قد وضع سابقاً تمييزاً حاسماً: تدريب الذكاء الاصطناعي على كتب تم الحصول عليها بشكل قانوني هو أمر "تحويلي—وبشكل مذهل"—ويقع تماماً ضمن عقيدة الاستخدام العادل. ويُعد هذا التمييز حيوياً لشركات مثل OpenAI و Google و Meta؛ إذ يشير إلى أنه بينما يمثل مصدر البيانات (القرصنة مقابل الاستحواذ القانوني) مسؤولية قانونية، فإن عملية تدريب النموذج على فهم اللغة والأنماط هي عملية يمكن الدفاع عنها قانونياً.
الحدود غير المحسومة لعمليات الكشط الجماعي (Mass Scraping)
وبينما يوفر هذا الحكم طوق نجاة للمختبرات التي تدربت على مجموعات بيانات ضخمة، فإن المعركة القانونية حول "الاستحواذ القانوني" لا تزال بعيدة عن الحسم. ويظل السؤال المركزي هو: هل يشكل الكشط الجماعي لمحتوى الإنترنت دون موافقة صريحة من أصحاب المواقع استحواذاً قانونياً أم انتهاكاً لحقوق الطبع والنشر؟
تسلط هذه التسوية الضوء على واقع قانوني منقسم لصناعة الذكاء الاصطناعي. إذ يمكن للشركات تجنب العقوبات الضخمة من خلال ضمان تنقية مسارات البيانات الخاصة بها من المستودعات المقرصنة المعروفة، لكنها لا تزال تواجه مشهداً غير مؤكد فيما يتعلق بحقوق ناشري الويب ومنشئي المحتوى. ومع استمرار توسع مختبرات الذكاء الاصطناعي، سيظل التوتر بين التقدم التكنولوجي التحويلي وحقوق الملكية الفكرية هو العقبة القانونية الأكبر في هذه الصناعة.
النقاط الرئيسية
- دفعة قياسية: ستدفع Anthropic مبلغ 1.5 مليار دولار للمؤلفين بعد استخدام قواعد بيانات مقرصنة مثل LibGen، مما يمثل أكبر تسوية لحقوق الطبع والنشر في تاريخ الدعاوى الجماعية.
- سابقة الاستخدام العادل: أكدت المحكمة أن تدريب الذكاء الاصطناعي على بيانات تم الحصول عليها قانونياً هو أمر "تحويلي بشكل مذهل"، مما يوفر درعاً قانونياً رئيسياً لتدريب الذكاء الاصطناعي المشروع.
- سلامة البيانات أمر بالغ الأهمية: يؤكد الحكم أن قانونية تدريب الذكاء الاصطناعي تعتمد غالباً على مصدر بيانات التدريب وليس على عملية التدريب نفسها.
