படைப்பாற்றல் மிக்க சமூகத்தினர், தங்களின் வாழ்நாள் உழைப்பு மிகப்பெரிய பயிற்சித் தரவுத் தொகுப்புகளுக்குள் (training datasets) உள்வாங்கப்படுவதை இனி மௌனமாகப் பார்த்துக் கொண்டிருக்கவில்லை. புகழ்பெற்ற எழுத்தாளர்கள் முதல் டிஜிட்டல் ஓவியர்கள் வரை, அறிவுசார் சொத்துக்களை அனுமதியின்றித் திரட்டுவதை நியாயப்படுத்த AI நிறுவனங்கள் பயன்படுத்தும் "நியாயமான பயன்பாடு" (fair use) என்ற வாதத்தை ஒரு வளர்ந்து வரும் சட்டப் போராட்டம் சவாலுக்கு உட்படுத்தி வருகிறது.

அனுமதியற்ற பயிற்சித் தொகுப்புகள் கண்டறியப்படுதல்

படைப்பாளர்களுக்கும் AI மேம்பாட்டாளர்களுக்கும் இடையிலான பதற்றம், The Atlantic இதழ் வெளியிட்ட அறிக்கையைத் தொடர்ந்து உச்சக்கட்டத்தை எட்டியது. அந்த இதழ், பெரிய மொழி மாதிரிகளை (large language models) பயிற்றுவிக்கப் பயன்படுத்தப்பட்ட படைப்புகளை விவரிக்கும் தேடக்கூடிய ஒரு தரவுத் தொகுப்பை வெளியிட்டது. Kirk Wallace Johnson போன்ற எழுத்தாளர்களுக்கு, இந்தத் discovery தனிப்பட்ட ரீதியிலும் ஆழமானதாகவும் இருந்தது. The Feather Thief மற்றும் The Fishermen and the Dragon போன்ற ஆழமான ஆய்வுக் கட்டுரைகளுக்காக அறியப்படும் ஜான்சன், பல ஆண்டுகால கடின உழைப்பு மற்றும் எழுத்துப்பணிகள், அவரது அனுமதியோ அல்லது இழப்பீடோ இன்றி சாட்பாட்களுக்கு (chatbots) திருடப்பட்டு வழங்கப்பட்டதைக் கண்டறிந்தார்.

இந்த நிகழ்வு ஒரு தனிப்பட்ட சம்பவம் அல்ல, இது ஒரு முறையான நடைமுறை. படைப்பாற்றல் மிக்க தொழில் வல்லுநர்கள், பல ஆண்டுகால உழைப்பின் பலனாகத் தங்களின் தனிப்பட்ட படைப்புகள், அளப்பரிய செல்வம் கொண்ட பெருநிறுவனங்களை உருவாக்கப் பயன்படுத்தப்படுவதைக் கண்டறிந்து வருகின்றனர். இந்த உணர்வு வெறும் கவலையிலிருந்து தீவிரமான சட்டப் போராட்டமாக மாறியுள்ளது, ஏனெனில் கலைஞர்கள் தங்களின் அறிவுசார் சொத்துக்களின் மீதான கட்டுப்பாட்டை மீண்டும் பெற முயல்கின்றனர்.

மூலோபாய வழக்குத் தொடர்தல்: தொழில்நுட்ப ஜாம்பவான்களை இலக்கு வைத்தல்

இந்த சட்டப் போராட்டம் பன்முகத்தன்மை கொண்டது, இது உருவாக்கும் AI மாதிரிகள் (generative AI models) எவ்வாறு கட்டமைக்கப்படுகின்றன என்பதன் முக்கிய நுட்பங்களை இலக்கு வைக்கிறது. கலைஞர்கள் வெறும் பதிப்புரிமை மீறல் புகார்களை மட்டும் நம்பியிருக்கவில்லை; நிறுவனங்களை பொறுப்புக்கூறச் செய்ய சேவை விதிமுறைகளை (terms of service) மீறியதற்கான வழிகளையும் அவர்கள் ஆராய்ந்து வருகின்றனர்.

முக்கிய சட்டப் போராட்டங்கள் ஏற்கனவே தொடங்கிவிட்டன. பல படைப்பாளர்கள் Susman Godfrey போன்ற சிறப்பு சட்டக் குழுக்களுடன் இணைந்துள்ளனர், இந்த குழு தற்போது பல்வேறு எழுத்தாளர்கள் சார்பாக Anthropic நிறுவனத்திற்கு எதிராக ஒரு முக்கியமான வழக்கை முன்னெடுத்து வருகிறது. இந்த இயக்கத்தில் முன்னோடிகளில் ஒருவரான ஓவியர் மற்றும் கார்ட்டூனிஸ்ட் Sarah Andersen, AI ஜாம்பவான்களை நேரடியாகத் சவால் செய்தவர்களில் ஒருவர். இந்த வழக்குகள், இழப்பீடு வழங்காத தரவுச் சேகரிப்பு முறையை முறியடிக்கவும், பயிற்சித் தொகுப்புகள் எவ்வாறு தொகுக்கப்பட வேண்டும் என்பதற்கான புதிய தரநிலையை உருவாக்கவும் முயல்கின்றன.

"நியாயமான பயன்பாடு" (Fair Use) போர்க்களம்

நீதிமன்றங்களில் நிலவும் முக்கியப் பதற்றம் "நியாயமான பயன்பாடு" என்பதன் சட்ட வரையறையில் உள்ளது. ஏற்கனவே உள்ள தரவைக் கொண்டு ஒரு மாதிரியைப் பயிற்றுவிப்பது ஒரு மாற்றத்தை (transformative) உருவாக்குகிறது என்றும், அது சட்டப் பாதுகாப்பின் கீழ் வருகிறது என்றும் AI நிறுவனங்கள் வாதிடுகின்றன. இருப்பினும், ஒரு AI ஒரு கலைஞரின் குறிப்பிட்ட பாணியையோ அல்லது ஒரு எழுத்தாளரின் தனித்துவமான குரலையோ அப்படியே பிரதிபலிக்க முடியும் என்றால், அது மாற்றத்தை உருவாக்குவதாக அமையாமல், அசல் படைப்பின் மதிப்பை குறைக்கும் நேரடி சந்தைப் பிரதியீடாக (market substitute) மாறிவிடுகிறது என்று படைப்பாளர்கள் வாதிடுகின்றனர்.

இந்த வழக்குகள் முன்னேறும்போது, அவை AI உலகின் எதிர்காலத்தைத் தீர்மானிக்கும். "AI slop" எனப்படும் குறைந்த தரமான, நகல் உள்ளடக்கங்களின் பெருமளவிலான உற்பத்தி சட்டப்பூர்வமாகத் தொடர முடியுமா அல்லது தகவல் பொருளாதாரத்தின் மையப்பகுதியாக இருக்கும் மனித படைப்பாளர்களைப் பாதுகாக்க, உரிமம் பெற்ற, நெறிமுறை சார்ந்த தரவு சேகரிப்பு எனும் புதிய யுகம் உருவாக வேண்டுமா என்பதை இந்த முடிவுகள் தீர்மானிக்கும்.

முக்கியக் குறிப்புகள்

  • முறையான தரவுச் சேகரிப்பு: பெரிய AI மாதிரிகள், படைப்பாளிகளின் அனுமதியின்றி ஆழமான ஆய்வுக் கட்டுரைகள் மற்றும் தனிப்பட்ட கலைப்படைப்புகள் அடங்கிய திருடப்பட்ட தரவுத் தொகுப்புகளைப் பயன்படுத்துவது கண்டறியப்பட்டுள்ளது.
  • பல்வகைப்பட்ட சட்ட உத்திகள்: பதிப்புரிமை மீறல், சேவை விதிமுறைகளை மீறுதல் மற்றும் "நியாயமான பயன்பாடு" கோட்பாட்டிற்கு சவால் விடுதல் ஆகியவற்றின் மூலம் AI நிறுவனங்கள் இலக்கு வைக்கப்படுகின்றன.
  • IP-க்கான ஒரு முக்கியத் தருணம்: Anthropic போன்ற நிறுவனங்களுக்கு எதிரான தொடரும் வழக்குகளின் முடிவுகள், உருவாக்கும் AI யுகத்தில் அறிவுசார் சொத்து எவ்வாறு மதிப்பிடப்பட வேண்டும் என்பதற்கான சட்ட முன்னுதாரணத்தை அமைக்கும்.

சர்ச்சை எவ்வாறு வெடித்தது

ஒரு முக்கிய இதழ், பெரிய மொழி மாதிரிகள் பயிற்றுவிக்கப்பட்ட புத்தகங்கள், கட்டுரைகள் மற்றும் கலைப்படைப்புகளின் தேடக்கூடிய பட்டியலை வெளியிட்டபோது இந்தச் சர்ச்சை வெடித்தது. பல ஆண்டுகால ஆராய்ச்சி மற்றும் பயணங்களை உள்ளடக்கிய தனது புனைவு அல்லாத புத்தகங்களுக்காக, எழுத்தாளர் Kirk Wallace Johnson-க்கு இந்தத் தகவல் தனிப்பட்ட ரீதியில் பாதிப்பை ஏற்படுத்தியது. தான் ஒரு தசாப்த காலமாக செம்மைப்படுத்திய சொற்கள், எந்தவித ராயல்டி அல்லது அங்கீகாரமும் இன்றி, தனது பாணியையே மீண்டும் உருவாக்கக்கூடிய சாட்பாட்களை இயக்கும் தரவுகளில் ஒரு பகுதியாக இருப்பதை அவர் கண்டறிந்தார்.

ஜான்சனின் அனுபவம் ஒரு தனிப்பட்ட சம்பவம் அல்ல. இலக்கியம், ஓவியம், இசை மற்றும் চলচ্চিত্র ஆகிய துறைகளில் உள்ள படைப்பாளர்கள் தங்களின் பதிப்புரிமை பெற்ற படைப்புகள் பெருமளவில் அறுவடை செய்யப்படுவதாகத் தெரிவிக்கின்றனர். இந்த நடைமுறை, "திருடப்பட்ட தரவுத் தொகுப்புகள்" (pirated datasets) என்ற முறையான பிரித்தெடுத்தல் என்று தொழில்துறை வல்லுநர்களால் விவரிக்கப்படுகிறது. இது கவலையை ஒருங்கிணைந்த சட்ட நடவடிக்கையாக மாற்றியுள்ளது. தங்களின் உழைப்பால் லாபம் ஈட்டும் அளப்பரிய செல்வம் கொண்ட தொழில்நுட்ப நிறுவனங்களுக்குத் தங்களின் மதிப்பு உருவாக்கப்பட்டுச் சென்றாலும், படைப்பாளர்களுக்கு எதுவும் கிடைப்பதில்லை என்று கலைஞர்கள் இப்போது வாதிடுகின்றனர்.

போராட்டத்தை வடிவமைக்கும் வழக்குகள்

சட்ட ரீதியான இந்தத் தாக்குதல், generative AI மாதிரிகள் எவ்வாறு கட்டமைக்கப்படுகின்றன என்பதன் மையப்பகுதியை இலக்குக் கொண்டுள்ளது. வாதிகள் பதிப்புரிமை மீறலுக்காக மட்டுமல்லாமல், தளங்களின் சொந்த சேவை விதிமுறைகளை மீறியதற்காகவும் வழக்குத் தொடர்கின்றனர். இணைய கலாச்சாரத்தின் ஒரு முக்கிய அங்கமாக மாறியுள்ள ஓவியர் மற்றும் கார்ட்டூன் கலைஞர் சாரா ஆண்டர்சன், ஒரு AI நிறுவனத்திற்கு எதிராக நேரடி வழக்குத் தொடர்ந்த முதல் காட்சி கலைஞர்களில் ஒருவர். அவரது வழக்குத் தாக்கல் என்னவென்றால், அந்த மாதிரியின் தனித்துவமான கோட்டு வேலைப்பாடுகள் மற்றும் நகைச்சுவையை அப்படியே பிரதிபலிக்கும் திறன், அவரது அசல் காமிக்ஸ்களுக்கான சந்தையைச் சிதைக்கிறது என்றும், இது அவரது பிராண்டை அனைவருக்கும் இலவசமாகக் கிடைக்கும் ஒரு வளமாக மாற்றுகிறது என்றும் வாதிடுகிறது.

இந்த வழக்குகள் அறிவுசார் சொத்துத் தகராறுகளில் நிபுணத்துவம் பெற்ற மற்றும் தொழில்நுட்ப ஜாம்பவான்களுக்கு சவால் விடுப்பதில் அனுபவம் வாய்ந்த வழக்கறிஞர்களால் கையாளப்படுகின்றன. பயன்படுத்தப்பட்ட துல்லியமான தரவுத்தொகுப்புகளை (datasets) வெளிக்கொண்டு வர வற்புறுத்துவதும், சர்ச்சைக்குரியப் பொருட்களைப் பயன்படுத்துவதை நிறுத்த நிறுவனங்களைக் கட்டாயப்படுத்துவதும், திருடப்பட்ட உள்ளடக்கத்தின் வணிக மதிப்பைப் பிரதிபலிக்கும் இழப்பீடுகளைக் கோருவதும் இவர்களின் உத்தியாகும்.

விமர்சனத்திற்கு உள்ளாகும் “fair use” வாதம்

பொதுவில் கிடைக்கும் தரவைக் கொண்டு ஒரு மாதிரியைப் பயிற்றுவிப்பது, சட்டம் பாதுகாக்கும் ஒரு உருமாற்றப் பயன்பாடு (transformative use) என்று AI உருவாக்குநர்கள் வாதிடுகின்றனர். அந்த மாதிரி எந்தவொரு தனிப்பட்ட படைப்பையும் அப்படியே நகலெடுக்கவில்லை; மாறாக, புதிய உரை அல்லது படங்களை உருவாக்க உதவும் வடிவங்களைக் கற்றுக்கொள்கிறது என்று அவர்கள் கூறுகின்றனர். அந்தப் பார்வையில், இந்தச் செயல்முறை ஒரு ஆராய்ச்சியாளர் அறிவைப் பெறுவதற்காகப் பல புத்தகங்களைப் படிப்பது போன்றதே தவிர, அவற்றை நகலெடுப்பது போன்றதல்ல.

ஆனால், வெளியீடு என்பது ஒரு ஆசிரியரின் குரல் அல்லது ஒரு கலைஞரின் பாணியின் கிட்டத்தட்ட நகல் போன்றதாக இருக்கும்போது, "உருமாற்றம்" என்பது ஒரு பலவீனமான சாக்குப்போக்கு என்று படைப்பாளர்கள் மறுக்கின்றனர். ஒரு சாட்பாட் (chatbot), ஒரு நாவலாசிரியர் அறியப்பட்ட அதே தாளம் மற்றும் சொற்றொடர் அமைப்பைக் கொண்டு ஒரு கேள்விக்குப் பதிலளிக்கும்போது, அல்லது ஒரு இமேஜ்-ஜெனரேட்டர் (image-generator), ஒரு உயிருள்ள ஓவியரின் படைப்புகளிலிருந்து வேறுபடுத்த முடியாத படங்களை உருவாக்கும்போது, அதன் முடிவு ஒரு சந்தை மாற்றீடாக (market substitute) செயல்படுகிறது. இந்த மாற்றீடு புத்தகங்கள், கமிஷன் மற்றும் உரிமம் வழங்கும் ஒப்பந்தங்களை விற்பனை செய்யும் அவர்களின் திறனைப் பாதிக்கிறது என்றும், வணிகத் தாக்கத்தின் காரணமாக “fair use” என்ற வாதம் முறியடிக்கப்படும் என்றும் வாதிகள் கூறுகின்றனர்.

இதில் உள்ள முக்கியப் பிரச்சனைகள்

  • AI நிறுவனங்கள் மீதான பொருளாதார அழுத்தம் – பெரிய அளவிலான ஸ்கிராப்பிங் (scraping) பதிப்புரிமையை மீறுகிறது என்று நீதிமன்றங்கள் தீர்ப்பளித்தால், நிறுவனங்கள் குறிப்பிடத்தக்க நிதி இழப்புகளைச் சந்திக்க நேரிடும், இது தரவுப் பாதைகளில் (data pipelines) மாற்றங்களை ஏற்படுத்தக்கூடும்.

  • நீதிமன்றத் தாக்கல் மற்றும் வெளிப்படுத்துதல் (discovery) – அடுத்த கட்ட ஆவணங்கள் எந்தெந்தத் தலைப்புகள் மற்றும் படங்கள் பயன்படுத்தப்பட்டன என்பதைத் துல்லியமாக வெளிப்படுத்தும், இது தரவு அறுவடை (data harvesting) அளவின் தெளிவான படத்தை வழங்கும்.