പകർപ്പവകാശമുള്ള പുസ്തകങ്ങളും ലേഖനങ്ങളും അനുമതിയില്ലാതെ ഉപയോഗിച്ച് തങ്ങളുടെ മോഡലുകൾ പരിശീലിപ്പിച്ചു എന്ന് ആരോപിച്ച് ന്യൂയോർക്ക് ഫെഡറൽ കോടതിയിൽ ഗൂഗിളിന്റെ Gemini AI-യ്ക്കെതിരെ ഒരു ക്ലാസ്-ആക്ഷൻ ഹർജി ഫയൽ ചെയ്തിരിക്കുന്നു. പ്രമുഖ പ്രസാധകരും എഴുത്തുകാരനായ സ്കോട്ട് ട്യൂറോയും ഉൾപ്പെട്ട ഒരു കൂട്ടായ്മയാണ് ഈ പരാതി സമർപ്പിച്ചത്. തങ്ങളുടെ ജനറേറ്റീവ്-AI സിസ്റ്റത്തിൽ "മോഷണം നടത്തിയ സാമഗ്രികൾ" ഉപയോഗിക്കുന്നത് മറച്ചുവെക്കാൻ ഗൂഗിൾ ബോധപൂർവ്വം പകർപ്പവകാശ വിവരങ്ങൾ നീക്കം ചെയ്തുവെന്ന് പരാതിയിൽ പറയുന്നു.

നിയമനടപടിയും അതിന്റെ പ്രധാന വാദങ്ങളും

സതേൺ ഡിസ്ട്രിക്റ്റ് ഓഫ് ന്യൂയോർക്ക് യു.എസ്. ഡിസ്ട്രിക്റ്റ് കോടതിയിൽ സമർപ്പിച്ച ഹർജിയിൽ ഹാച്ചെറ്റ് (Hachette), സെൻകേജ് (Cencage), എൽസെവിയർ (Elsevier), S.C.R.I.B.E. കളക്റ്റീവ്, ട്യൂറോ എന്നിവരെ വാദികളായി ചേർത്തിട്ടുണ്ട്. Google Books-ൽ നിലവിലുണ്ടായിരുന്ന "സ്നിപ്പറ്റ് മാത്രം" (snippet-only) എന്ന വ്യവസ്ഥയ്ക്ക് അപ്പുറത്തേക്ക് ഗൂഗിൾ പോയി എന്നും, Gemini പരിശീലിപ്പിക്കുന്നതിനായി ആ ആർക്കൈവിൽ നിന്നുള്ള പൂർണ്ണരൂപത്തിലുള്ള കൃതികളും Google Play-ൽ അപ്‌ലോഡ് ചെയ്ത പുസ്തകങ്ങളും ഉപയോഗിച്ചു എന്നും അവർ ആരോപിക്കുന്നു. പരാതി പ്രകാരം, ഗൂഗിൾ ഉള്ളടക്കം ശേഖരിക്കുക മാത്രമല്ല, പകർപ്പവകാശ മെറ്റാഡാറ്റയിൽ മാറ്റം വരുത്തുകയോ നീക്കം ചെയ്യുകയോ ചെയ്തു; പകർപ്പവകാശ ലംഘനം മറച്ചുവെക്കാനാണ് ഇത്തരമൊരു നീക്കം നടത്തിയതെന്ന് വാദികൾ പറയുന്നു.

AI പരിശീലനത്തിനായി പകർപ്പവകാശമുള്ള പുസ്തകങ്ങൾ ഉപയോഗിക്കുന്നത് "വളരെ പ്രശ്നകരമായ" കാര്യമാണെന്നും കമ്പനിയെ 10 ബില്യൺ ഡോളർ മുതൽ 100 ബില്യൺ ഡോളർ വരെയുള്ള പിഴകൾ നേരിടാൻ പ്രേരിപ്പിക്കുമെന്നും സൂചിപ്പിക്കുന്ന ഒരു ആഭ്യന്തര ഗൂഗിൾ മെമ്മോ ഈ കേസിൽ പരാമർശിക്കുന്നുണ്ട്. അനധികൃത ഡാറ്റാ ഉപയോഗത്തിന് മറ്റൊരു AI കമ്പനിക്ക് ലഭിച്ച സമീപകാലത്തെ 1.5 ബില്യൺ ഡോളറിന്റെ പിഴയെ, വരാനിരിക്കുന്ന വലിയ സാമ്പത്തിക ബാധ്യതയുടെ അളവുകോലായി വാദികൾ ചൂണ്ടിക്കാട്ടുന്നു.

ഇത് എങ്ങനെ സംഭവിച്ചു

പുസ്തക പ്രസാധകരുമായുള്ള ഗൂഗിളിന്റെ ബന്ധം ആരംഭിച്ചത് Google Books വഴിയാണ്. ഇത് തിരയാൻ കഴിയുന്ന ഒരു ഇൻഡക്സ് ആയിരുന്നു; ഇതിൽ പുസ്തകങ്ങളുടെ ചെറിയ ഭാഗങ്ങളും ബിബ്ലിയോഗ്രാഫിക് വിവരങ്ങളും മാത്രമേ കാണിക്കുമായിരുന്നുള്ളൂ, എന്നാൽ പൂർണ്ണരൂപം കാണുന്നതിന് പണമടയ്ക്കേണ്ടി വരുമായിരുന്നു (paywall). ഗൂഗിളിന് ചെറിയ ഭാഗങ്ങൾ (snippets) മാത്രം പ്രദർശിപ്പിക്കാൻ അനുവദിക്കുന്ന ലൈസൻസിംഗ് കരാറുകളെയാണ് ഈ മാതൃക ആശ്രയിച്ചിരുന്നത്. വർഷങ്ങൾ കടന്നുപോകുമ്പോൾ, പ്രസാധകരും എഴുത്തുകാരും വിൽപനയ്ക്കായി പൂർണ്ണരൂപത്തിലുള്ള ഇ-ബുക്കുകൾ അപ്‌ലോഡ് ചെയ്യുന്ന Google Play സ്റ്റോറിലൂടെ ഗൂഗിൾ അതിന്റെ പ്രവർത്തനങ്ങൾ വിപുലീകരിച്ചു.

ഒരു "പരിധി നിശ്ചയിച്ച" (scope-limited) ഇൻഡക്സിംഗ് സേവനത്തിൽ നിന്ന് ലാർജ് ലാംഗ്വേജ് മോഡലുകൾ (LLMs) പരിശീലിപ്പിക്കുന്നതിനുള്ള ഡാറ്റാ സ്രോതസ്സിലേക്കുള്ള ഗൂഗിളിന്റെ മാറ്റം യഥാർത്ഥ കരാറുകളുടെ ലംഘനമാണെന്ന് വാദികൾ വാദിക്കുന്നു. Gemini-യുടെ പരിശീലന പ്രക്രിയയിലേക്ക് മുഴുവൻ കൃതികളും ഉൾപ്പെടുത്തുന്നതിന് ആവശ്യമായ വിപുലമായ അനുമതികൾ കമ്പനി ഒരിക്കലും നേടിയിട്ടില്ലെന്നും അവർ പറയുന്നു.

ഗൂഗിളിനും AI വ്യവസായത്തിനും എന്താണ് വെല്ലുവിളി

ലൈസൻസില്ലാതെ പകർപ്പവകാശമുള്ള സാമഗ്രികൾ ഉപയോഗിക്കുന്നത് പകർപ്പവകാശ നിയമത്തിന്റെ ലംഘനമാണെന്ന് കോടതി കണ്ടെത്തിയാൽ, AI ഡെവലപ്പർമാർ പരിശീലന ഡാറ്റ ശേഖരിക്കുന്ന രീതിയെ ആ തീരുമാനം മാറ്റിമറിച്ചേക്കാം.

സാധ്യമായ പ്രതിരോധങ്ങളും എതിർവാദങ്ങളും

വ്യാഖ്യാനം, വിമർശനം അല്ലെങ്കിൽ പരിവർത്തനം എന്നിവയ്ക്കായി പകർപ്പവകാശമുള്ള സാമഗ്രികൾ പരിമിതമായി ഉപയോഗിക്കാൻ അനുവദിക്കുന്ന "fair use" സിദ്ധാന്തത്തെ ഗൂഗിൾ ആശ്രയിച്ചേക്കാം. സമീപകാലത്തെ കാലിഫോർണിയ വിധികൾ AI പരിശീലനത്തെ ഒരു പരിവർത്തന പ്രവർത്തനമായി (transformative activity) കണക്കാക്കുകയും അതിന് fair-use സംരക്ഷണം നൽകുകയും ചെയ്തിട്ടുണ്ട്. ഈ മുൻവിധികൾ ഒഴിവാക്കാൻ ന്യൂയോർക്കിലെ വാദികൾ ആ അധികാരപരിധിക്ക് പുറത്താണ് കേസ് ഫയൽ ചെയ്തത്.

പകർപ്പവകാശ മെറ്റാഡാറ്റ നീക്കം ചെയ്തത് സ്രോതസ്സ് മറച്ചുവെക്കാനുള്ള ഉദ്ദേശ്യമാണെന്നും, ഇത് നല്ല വിശ്വാസത്തോടെയുള്ള പരിവർത്തനമെന്ന (good-faith transformation) വാദത്തെ തള്ളിക്കളയുന്നുവെന്നും വാദികൾ മറുപടി പറയുന്നു. ഗൂഗിൾ നിയമപരമായ അപകടസാധ്യത തിരിച്ചറിഞ്ഞിരുന്നു എന്നതിന് തെളിവായി അവർ ആഭ്യന്തര മെമ്മോയെയും ചൂണ്ടിക്കാട്ടുന്നു.

ഇനി ശ്രദ്ധിക്കേണ്ട കാര്യങ്ങൾ

കാലിഫോർണിയയിൽ ഉപയോഗിക്കുന്ന fair-use വിശകലനം കോടതി പ്രയോഗിക്കുമോ അതോ മറ്റൊരു മാനദണ്ഡം സ്വീകരിക്കുമോ എന്നത് ഉൾപ്പെടെ, ഇരുഭാഗത്തിനും ലഭ്യമായ വാദങ്ങളെ രൂപപ്പെടുത്താൻ സഹായിക്കുന്ന വിചാരണയ്ക്ക് മുൻപുള്ള നടപടികളിലൂടെ (pre-trial motions) ഈ കേസ് മുന്നോട്ട് പോകും. അധികാരപരിധിയെക്കുറിച്ചുള്ള (jurisdiction) ഒരു വിധി, AI സംബന്ധമായ പകർപ്പവകാശ തർക്കങ്ങളുടെ പ്രധാന വേദിയായി ന്യൂയോർക്ക് കോടതികൾ മാറുമോ എന്ന് തീരുമാനിച്ചേക്കാം.

ചുരുക്കത്തിൽ: ഗൂഗിളിന്റെ Gemini-യ്ക്കെതിരായ ന്യൂയോർക്ക് ഹർജി, അനുവദനീയമായ ഡാറ്റാ ഉപയോഗത്തിനും പകർപ്പവകാശ ലംഘനത്തിനും ഇടയിലുള്ള അതിർവരമ്പുകൾ പുനർനിർണ്ണയിച്ചേക്കാം. ഇത് തങ്ങളുടെ മോഡലുകൾക്ക് ആവശ്യമായ വിവരങ്ങൾ എങ്ങനെ ശേഖരിക്കണം എന്ന് AI ഡെവലപ്പർമാരെ പുനർചിന്തിപ്പിക്കുകയും മുഴുവൻ വ്യവസായത്തിന്റെയും സാമ്പത്തിക ഘടനയെ മാറ്റിമറിക്കുകയും ചെയ്തേക്കാം.