تسویه ۱.۵ میلیارد دلاری Anthropic در پرونده استفاده از منابع غیرقانونی: یک خسارت بیسابقه و یک پیروزی استراتژیک
شرکت Anthropic در پی اتهامات مربوط به استفاده از پایگاههای دادههای غیرقانونی برای آموزش مدلهای خود، به یک توافق تاریخی ۱.۵ میلیارد دلاری با گروهی از نویسندگان رسید. اگرچه این پرداخت سنگین یک ضربه مالی محسوب میشود، اما ظرافتهای حقوقی این پرونده ممکن است در واقع پیروزی قابل توجهی برای کل صنعت هوش مصنوعی در زمینه «استفاده منصفانه» (fair use) به همراه داشته باشد.
جزئیات این تسویه بیسابقه
یک دادگاه فدرال در سانفرانسیسکو پس از آنکه شواهدی نشان داد Anthropic بین سالهای ۲۰۲۱ تا ۲۰۲۲ کتابهایی را از پایگاههای دادههای مشهور سرقت آثار، بهویژه LibGen و PiLiMi، دانلود کرده است، یک توافق تاریخی را تأیید کرد. مقیاس این تسویه در تاریخ دعاوی گروهی (class action) بیسابقه است و تقریباً ۴۸۲,۴۶۰ اثر فهرستشده را پوشش میدهد.
از کل آثار درگیر در این پرونده، ۹۱.۳ درصد توسط نویسندگان با موفقیت مطالبه شد. قرار است هر مدعی مبلغی در حدود ۳,۰۰۰ دلار دریافت کند که این رقم چهار برابر حداقل قانونی تعیینشده است. به عنوان بخشی از این حل و فصل حقوقی، Anthropic موظف است فایلهای غیرقانونی استفادهشده در این دوره را از بین ببرد. نکته حیاتی این است که این توافق به شرکت اجازه عبور از تمامی مسئولیتها را نمیدهد؛ نویسندگان این حق را برای طرح شکایت حفظ میکنند که اگر خروجیهای هوش مصنوعی آثار اصلی را بازتولید کنند یا اگر شیوههای آیندهی اکتساب داده توسط Anthropic قوانین حق تکثیر (copyright) را نقض کنند.
یک نکته فنی که به نفع توسعه هوش مصنوعی است
علیرغم مبلغ هنگفت ۱.۵ میلیارد دلاری، رویه حقوقی ایجاد شده توسط این پرونده بهطور غافلگیرکنندهای به نفع آزمایشگاههای هوش مصنوعی است. این توافق به عملِ خاصِ استفاده از منابع غیرقانونی میپردازد، اما درباره قانونی بودن خودِ فرآیند آموزش هوش مصنوعی حکمی صادر نمیکند.
قاضی Alsup پیش از این تمایز مهمی را قائل شده بود: آموزش هوش مصنوعی بر روی کتابهایی که به صورت قانونی به دست آمدهاند، «تحولآفرین — و به شکلی خیرهکننده» است و دقیقاً ذیل دکترین «استفاده منصفانه» قرار میگیرد. این تمایز برای شرکتهایی مانند OpenAI، Google و Meta حیاتی است. این موضوع نشان میدهد که اگرچه منبع دادهها (سرقت آثار در مقابل اکتساب قانونی) یک مسئولیت حقوقی است، اما فرآیند آموزش یک مدل برای درک زبان و الگوها از نظر قانونی قابل دفاع است.
مرز حلنشدهی استخراج انبوه داده (Mass Scraping)
اگرچه این حکم راه نجات برای آزمایشگاههایی است که با مجموعهدادههای عظیم آموزش دیدهاند، اما نبرد حقوقی بر سر «اکتساب قانونی» هنوز به پایان نرسیده است. پرسش اصلی همچنان باقی است: آیا استخراج انبوه محتوای اینترنتی بدون رضایت صریح صاحبان وبسایتها، مصداق اکتساب قانونی است یا نقض حق تکثیر؟
این تسویه، یک واقعیت حقوقی دوگانه را برای صنعت هوش مصنوعی برجسته میکند. شرکتها میتوانند با اطمینان از اینکه خطوط انتقال دادهی (data pipelines) آنها از مخازن شناختهشدهی غیرقانونی پاکسازی شده است، از جریمههای سنگین جلوگیری کنند، اما همچنان با چشماندازی نامشخص در رابطه با حقوق ناشران وب و تولیدکنندگان محتوا روبرو هستند. با گسترش روزافزون آزمایشگاههای هوش مصنوعی، تنش میان پیشرفت فناورانه تحولآفرین و حقوق مالکیت معنوی، همچنان بزرگترین مانع حقوقی این صنعت باقی خواهد ماند.
نکات کلیدی
- پرداخت بیسابقه: Anthropic پس از استفاده از پایگاههای داده غیرقانونی مانند LibGen، مبلغ ۱.۵ میلیارد دلار به نویسندگان پرداخت خواهد کرد که بزرگترین تسویه مربوط به حق تکثیر در تاریخ دعاوی گروهی محسوب میشود.
- رویهی استفاده منصفانه: دادگاه تأیید کرد که آموزش هوش مصنوعی با استفاده از دادههای بهدستآمده بهصورت قانونی، «به شکلی خیرهکننده تحولآفرین» است و یک سپر حقوقی بزرگ برای آموزش مشروع هوش مصنوعی فراهم میکند.
- یکپارچگی دادهها حیاتی است: این حکم تأکید میکند که قانونی بودن آموزش هوش مصنوعی اغلب به منشأ دادههای آموزشی بستگی دارد، نه به خودِ فرآیند آموزش.
