جامعه خلاق دیگر منفعلانه نظاره‌گر نیست که آثار زندگی‌شان در مجموعه‌داده‌های آموزشی عظیم بلعیده شود. از نویسندگان تحسین‌شده گرفته تا تصویرگران دیجیتال، موج فزاینده‌ای از اقدامات قانونی در حال به چالش کشیدن دفاعیه «استفاده منصفانه» (fair use) است که غول‌های هوش مصنوعی برای توجیه استخراج غیرمجاز مالکیت فکری خود به کار می‌برند.

کشف مجموعه‌داده‌های آموزشی غیرمجاز

تنش میان خالقان و توسعه‌دهندگان هوش مصنوعی پس از گزارش‌های نشریه The Atlantic به نقطه اوج خود رسید؛ نشریه‌ای که یک مجموعه‌داده قابل جستجو شامل جزئیات آثاری که برای آموزش مدل‌های زبانی بزرگ استفاده شده‌اند، منتشر کرد. برای نویسندگانی مانند کرک والاس جانسون (Kirk Wallace Johnson)، این کشف شخصی و عمیق بود. جانسون که برای آثار غیرداستانی با تحقیق عمیق خود مانند The Feather Thief و The Fishermen and the Dragon شناخته می‌شود، دریافت که سال‌ها تحقیق و نگارش پرزحمت او، بدون رضایت یا پرداخت حق امتیاز، دزدی شده و به چت‌بات‌ها تغذیه شده است.

این پدیده یک حادثه گذرا نیست، بلکه یک رویه سیستماتیک است. متخصصان خلاق در حال کشف این واقعیت هستند که آثار اختصاصی آن‌ها — که اغلب نتیجه سال‌ها تلاش است — برای ساخت شرکت‌های «ثروتمند در سطح کهکشانی» استفاده می‌شود. این درک، احساسات را از نگرانی صرف به شکایت‌های فعال تغییر داده است، زیرا هنرمندان به دنبال بازپس‌گیری کنترل مالکیت فکری خود هستند.

شکایت‌های استراتژیک: هدف قرار دادن غول‌های فناوری

هجمه حقوقی چندجانبه است و مکانیسم‌های اصلی ساخت مدل‌های هوش مصنوعی مولد را هدف قرار می‌دهد. هنرمندان تنها به ادعاهای نقض حق چاپ (کپی‌رایت) متکی نیستند؛ آن‌ها همچنین مسیرهایی مانند نقض شرایط خدمات (terms of service) را برای پاسخگو کردن شرکت‌ها بررسی می‌کنند.

نبردهای حقوقی برجسته‌ای از هم‌اکنون در جریان است. بسیاری از خالقان با تیم‌های حقوقی متخصص، مانند Susman Godfrey، متحد شده‌اند که در حال حاضر پرونده مهمی را علیه Anthropic به نمایندگی از نویسندگان مختلف رهبری می‌کند. دیگر پیشگامان این جنبش شامل تصویرگر و کاریکاتوریست سارا اندرسن (Sarah Andersen) هستند که از اولین کسانی بود که مستقیماً غول‌های هوش مصنوعی را به چالش کشید. هدف این شکایت‌ها، از هم پاشیدن اتکای این صنعت به استخراج داده‌های بدون حق امتیاز و تحمیل استانداردی جدید برای نحوه گردآوری مجموعه‌داده‌های آموزشی است.

میدان نبرد «استفاده منصفانه»

تنش اصلی در این دادگاه‌ها در تعریف حقوقی «استفاده منصفانه» (fair use) نهفته است. شرکت‌های هوش مصنوعی استدلال می‌کنند که آموزش یک مدل بر روی داده‌های موجود، امری «تحول‌آفرین» (transformative) است و تحت حمایت‌های قانونی قرار می‌گیرد. با این حال، خالقان استدلال می‌کنند که وقتی یک هوش مصنوعی می‌تواند سبک خاص یک هنرمند یا صدای منحصربه‌فرد یک نویسنده را بازسازی کند، دیگر تحول‌آفرین نیست و به یک جایگزین مستقیم در بازار تبدیل می‌شود که ارزش اثر اصلی را کاهش می‌دهد.

با پیشرفت این پرونده‌ها، آینده چشم‌انداز هوش مصنوعی تعیین خواهد شد. نتایج آن‌ها مشخص خواهد کرد که آیا مسیر فعلی «زباله‌های هوش مصنوعی» (AI slop) — یعنی تولید انبوه محتوای کم‌کیفیت و مشتق‌شده — از نظر قانونی پایدار است، یا اینکه باید عصر جدیدی از اکتساب اخلاقی و دارای مجوز داده‌ها برای محافظت از خالقان انسانی که در قلب اقتصاد اطلاعات قرار دارند، ظهور کند.

نکات کلیدی

  • استخراج سیستماتیک داده‌ها: مشخص شده است که مدل‌های اصلی هوش مصنوعی از مجموعه‌داده‌های دزدی شامل کتاب‌های با تحقیق عمیق و آثار هنری اختصاصی، بدون رضایت خالقان استفاده می‌کنند.
  • استراتژی‌های حقوقی متنوع: شکایت‌ها از طریق نقض حق چاپ، نقض شرایط خدمات و به چالش کشیدن دکترین «استفاده منصفانه»، شرکت‌های هوش مصنوعی را هدف قرار می‌دهند.
  • لحظه‌ای سرنوشت‌ساز برای مالکیت فکری: نتایج پرونده‌های جاری علیه شرکت‌هایی مانند Anthropic، الگوی حقوقی تعیین‌کننده برای نحوه ارزش‌گذاری مالکیت فکری در عصر هوش مصنوعی مولد خواهد بود.

چگونه این جنجال شعله‌ور شد

جرقه زمانی زده شد که یک مجله بزرگ، فهرستی قابل جستجو از کتاب‌ها، مقالات و آثار هنری که مدل‌های زبانی بزرگ بر روی آن‌ها آموزش دیده‌اند، منتشر کرد. برای نویسنده کرک والاس جانسون، که کتاب‌های غیرداستانی‌اش سال‌ها تحقیق و سفر برده است، این افشاگری شخصی بود. او دریافت که همان کلماتی که یک دهه صرف تکمیل آن‌ها کرده بود، بخشی از داده‌هایی هستند که چت‌بات‌ها را تغذیه می‌کنند؛ چت‌بات‌هایی که می‌توانند سبک او را در هر زمان و بدون هیچ حق امتیاز یا قدردانی، بازتولید کنند.

تجربه جانسون یک حادثه تک‌افتاده نیست. خالقان در حوزه‌های ادبیات، تصویرگری، موسیقی و فیلم گزارش می‌دهند که آثار دارای حق چاپ آن‌ها به صورت انبوه برداشت شده است. این رویه که فعالان این صنعت آن را استخراج سیستماتیک «مجموعه‌داده‌های دزدی» توصیف می‌کنند، نگرانی را به اقدامات حقوقی هماهنگ تبدیل کرده است. اکنون هنرمندان استدلال می‌کنند که ارزشی که خلق می‌کنند، به سمت کنسرسیوم‌های فناوری «ثروتمند در سطح کهکشانی» مکیده می‌شود که از زحمات آن‌ها سود می‌برند، در حالی که خالقان چیزی دریافت نمی‌کنند.

شکایت‌هایی که به این نبرد شکل می‌دهند

این تهاجم حقوقی هسته اصلی نحوه ساخت مدل‌های هوش مصنوعی مولد را هدف قرار داده است. شاکیان نه تنها به دلیل نقض حق مؤلف (کپی‌رایت)، بلکه به دلیل نقض شرایط خدمات خودِ پلتفرم‌ها نیز شکایت کرده‌اند. سارا اندرسن، تصویرگر و کاریکاتوریست که آثارش به بخش جدایی‌ناپذیر فرهنگ اینترنت تبدیل شده است، از نخستین هنرمندان بصری بود که شکایت مستقیمی را علیه یک شرکت هوش مصنوعی مطرح کرد. در دادخواست او آمده است که توانایی مدل در تقلید از خطوط متمایز و طنز او، بازار آثار کمیک اصلی‌اش را تضعیف کرده و در عمل، برند او را به منبعی رایگان برای همگان تبدیل می‌کند.

این پرونده‌ها توسط وکلایی مدیریت می‌شوند که در اختلافات مالکیت فکری تخصص دارند و سابقه به چالش کشیدن غول‌های فناوری را در کارنامه دارند. استراتژی آن‌ها اجبار به افشای دقیق مجموعه‌داده‌های استفاده‌شده، وادار کردن شرکت‌ها به توقف استفاده از مطالب مورد مناقشه و درخواست خسارتی است که منعکس‌کننده ارزش تجاری محتوای سرقت‌شده باشد.

استدلال «استفاده منصفانه» زیر آتش

توسعه‌دهندگان هوش مصنوعی معتقدند که آموزش یک مدل بر روی داده‌های در دسترس عموم، یک «استفاده تحول‌آفرین» است که قانون از آن حمایت می‌کند. آن‌ها استدلال می‌کنند که مدل، هیچ اثر واحدی را عین به عین بازتولید نمی‌کند؛ بلکه در عوض، الگوهایی را می‌آموزد که آن را قادر به تولید متن یا تصاویر جدید می‌کند. از این منظر، این فرآیند مشابه پژوهشگری است که برای کسب بینش، کتاب‌های زیادی را می‌خواند، نه اینکه از آن‌ها کپی‌برداری کند.

خالقان آثار در مقابل می‌گویند که وقتی خروجی می‌تواند تقریباً مشابه صدای یک نویسنده یا سبک یک هنرمند باشد، «تحول‌آفرین» بودن تنها یک بهانه واهی است. وقتی یک چت‌بات می‌تواند به سوالی با همان آهنگ و عبارت‌پردازیِ شناخته‌شده‌ی یک رمان‌نویس پاسخ دهد، یا زمانی که یک مولد تصویر می‌تواند تصاویری تولید کند که از آثار یک تصویرگر زنده غیرقابل تشخیص باشد، نتیجه کار به عنوان یک جایگزین در بازار عمل می‌کند. شاکیان استدلال می‌کنند که این جایگزینی، توانایی آن‌ها را در فروش کتاب‌ها، سفارش‌های طراحی و قراردادهای مجوز استفاده (licensing) مختل می‌کند و دفاعیه «استفاده منصفانه» تحت فشار تأثیرات تجاری فرو می‌پاشد.

آنچه در خطر است

  • فشار اقتصادی بر شرکت‌های هوش مصنوعی – اگر دادگاه‌ها حکم دهند که استخراج داده (scraping) در مقیاس بزرگ، حق مؤلف را نقض می‌کند، شرکت‌ها ممکن است با پیامدهای مالی سنگینی روبرو شوند که می‌تواند منجر به تغییر در خطوط پردازش داده‌ها شود.

  • پرونده‌های دادگاه و افشای مدارک – موج بعدی اسناد، دقیقاً مشخص خواهد کرد که کدام عناوین و تصاویر استفاده شده‌اند و تصویر روشن‌تری از مقیاس برداشت داده‌ها ارائه خواهد داد.