تسویه ۱.۵ میلیارد دلاری Anthropic در پرونده استفاده از منابع غیرقانونی: یک خسارت بی‌سابقه و یک پیروزی استراتژیک

شرکت Anthropic در پی اتهامات مربوط به استفاده از پایگاه‌های داده‌های غیرقانونی برای آموزش مدل‌های خود، به یک توافق تاریخی ۱.۵ میلیارد دلاری با گروهی از نویسندگان رسید. اگرچه این پرداخت سنگین یک ضربه مالی محسوب می‌شود، اما ظرافت‌های حقوقی این پرونده ممکن است در واقع پیروزی قابل توجهی برای کل صنعت هوش مصنوعی در زمینه «استفاده منصفانه» (fair use) به همراه داشته باشد.

جزئیات این تسویه بی‌سابقه

یک دادگاه فدرال در سان‌فرانسیسکو پس از آنکه شواهدی نشان داد Anthropic بین سال‌های ۲۰۲۱ تا ۲۰۲۲ کتاب‌هایی را از پایگاه‌های داده‌های مشهور سرقت آثار، به‌ویژه LibGen و PiLiMi، دانلود کرده است، یک توافق تاریخی را تأیید کرد. مقیاس این تسویه در تاریخ دعاوی گروهی (class action) بی‌سابقه است و تقریباً ۴۸۲,۴۶۰ اثر فهرست‌شده را پوشش می‌دهد.

از کل آثار درگیر در این پرونده، ۹۱.۳ درصد توسط نویسندگان با موفقیت مطالبه شد. قرار است هر مدعی مبلغی در حدود ۳,۰۰۰ دلار دریافت کند که این رقم چهار برابر حداقل قانونی تعیین‌شده است. به عنوان بخشی از این حل و فصل حقوقی، Anthropic موظف است فایل‌های غیرقانونی استفاده‌شده در این دوره را از بین ببرد. نکته حیاتی این است که این توافق به شرکت اجازه عبور از تمامی مسئولیت‌ها را نمی‌دهد؛ نویسندگان این حق را برای طرح شکایت حفظ می‌کنند که اگر خروجی‌های هوش مصنوعی آثار اصلی را بازتولید کنند یا اگر شیوه‌های آینده‌ی اکتساب داده توسط Anthropic قوانین حق تکثیر (copyright) را نقض کنند.

یک نکته فنی که به نفع توسعه هوش مصنوعی است

علی‌رغم مبلغ هنگفت ۱.۵ میلیارد دلاری، رویه حقوقی ایجاد شده توسط این پرونده به‌طور غافلگیرکننده‌ای به نفع آزمایشگاه‌های هوش مصنوعی است. این توافق به عملِ خاصِ استفاده از منابع غیرقانونی می‌پردازد، اما درباره قانونی بودن خودِ فرآیند آموزش هوش مصنوعی حکمی صادر نمی‌کند.

قاضی Alsup پیش از این تمایز مهمی را قائل شده بود: آموزش هوش مصنوعی بر روی کتاب‌هایی که به صورت قانونی به دست آمده‌اند، «تحول‌آفرین — و به شکلی خیره‌کننده» است و دقیقاً ذیل دکترین «استفاده منصفانه» قرار می‌گیرد. این تمایز برای شرکت‌هایی مانند OpenAI، Google و Meta حیاتی است. این موضوع نشان می‌دهد که اگرچه منبع داده‌ها (سرقت آثار در مقابل اکتساب قانونی) یک مسئولیت حقوقی است، اما فرآیند آموزش یک مدل برای درک زبان و الگوها از نظر قانونی قابل دفاع است.

مرز حل‌نشده‌ی استخراج انبوه داده (Mass Scraping)

اگرچه این حکم راه نجات برای آزمایشگاه‌هایی است که با مجموعه‌داده‌های عظیم آموزش دیده‌اند، اما نبرد حقوقی بر سر «اکتساب قانونی» هنوز به پایان نرسیده است. پرسش اصلی همچنان باقی است: آیا استخراج انبوه محتوای اینترنتی بدون رضایت صریح صاحبان وب‌سایت‌ها، مصداق اکتساب قانونی است یا نقض حق تکثیر؟

این تسویه، یک واقعیت حقوقی دوگانه را برای صنعت هوش مصنوعی برجسته می‌کند. شرکت‌ها می‌توانند با اطمینان از اینکه خطوط انتقال داده‌ی (data pipelines) آن‌ها از مخازن شناخته‌شده‌ی غیرقانونی پاکسازی شده است، از جریمه‌های سنگین جلوگیری کنند، اما همچنان با چشم‌اندازی نامشخص در رابطه با حقوق ناشران وب و تولیدکنندگان محتوا روبرو هستند. با گسترش روزافزون آزمایشگاه‌های هوش مصنوعی، تنش میان پیشرفت فناورانه تحول‌آفرین و حقوق مالکیت معنوی، همچنان بزرگترین مانع حقوقی این صنعت باقی خواهد ماند.

نکات کلیدی

  • پرداخت بی‌سابقه: Anthropic پس از استفاده از پایگاه‌های داده غیرقانونی مانند LibGen، مبلغ ۱.۵ میلیارد دلار به نویسندگان پرداخت خواهد کرد که بزرگترین تسویه مربوط به حق تکثیر در تاریخ دعاوی گروهی محسوب می‌شود.
  • رویه‌ی استفاده منصفانه: دادگاه تأیید کرد که آموزش هوش مصنوعی با استفاده از داده‌های به‌دست‌آمده به‌صورت قانونی، «به شکلی خیره‌کننده تحول‌آفرین» است و یک سپر حقوقی بزرگ برای آموزش مشروع هوش مصنوعی فراهم می‌کند.
  • یکپارچگی داده‌ها حیاتی است: این حکم تأکید می‌کند که قانونی بودن آموزش هوش مصنوعی اغلب به منشأ داده‌های آموزشی بستگی دارد، نه به خودِ فرآیند آموزش.