સર્જનાત્મક સમુદાય હવે નિષ્ક્રિય રીતે જોઈ રહ્યો નથી કે તેમનું જીવનભરનું કાર્ય વિશાળ તાલીમ ડેટાસેટ્સમાં સમાવિષ્ટ થઈ રહ્યું છે. પ્રખ્યાત લેખકોથી લઈને ડિજિટલ ઇલસ્ટ્રેટર્સ સુધી, કાયદાકીય કાર્યવાહીનું વધતું મોજું AI જાયન્ટ્સ દ્વારા બૌદ્ધિક સંપત્તિના અનધિકૃત સ્ક્રેપિંગને ન્યાયી ઠેરવવા માટે વપરાતા "fair use" બચાવને પડકારી રહ્યું છે.
અનધિકૃત તાલીમ સેટ્સની શોધ
સર્જકો અને AI ડેવલપર્સ વચ્ચેનો તણાવ The Atlantic ના અહેવાલો પછી ઉગ્ર બન્યો હતો, જેણે લાર્જ લેંગ્વેજ મોડલ્સને તાલીમ આપવા માટે વપરાયેલા કાર્યોની વિગતવાર માહિતી આપતો સર્ચેબલ ડેટાસેટ પ્રકાશિત કર્યો હતો. Kirk Wallace Johnson જેવા લેખકો માટે, આ શોધ વ્યક્તિગત અને ગહન હતી. Johnson, જેઓ The Feather Thief અને The Fishermen and the Dragon જેવા ઊંડાણપૂર્વક સંશોધિત નોન-ફિક્શન કાર્યો માટે જાણીતા છે, તેમણે જોયું કે વર્ષોના સખત સંશોધન અને લેખનને તેમની સંમતિ અથવા વળતર વિના પાયરેટેડ કરીને ચેટબોટ્સમાં નાખવામાં આવ્યું હતું.
આ ઘટના કોઈ એકલવ ઘટના નથી પરંતુ એક વ્યવસ્થિત પ્રથા છે. સર્જનાત્મક વ્યાવસાયિકો શોધી રહ્યા છે કે તેમના માલિકીના કાર્યો—જે ઘણીવાર વર્ષોના પરિશ્રમનું પરિણામ હોય છે—તેનો ઉપયોગ "galactically wealthy" કોર્પોરેશનો બનાવવા માટે કરવામાં આવી રહ્યો છે. આ સમજણ માત્ર ચિંતાથી સક્રિય કાયદાકીય લડાઈમાં બદલાઈ ગઈ છે, કારણ કે કલાકારો તેમની બૌદ્ધિક સંપત્તિ પર ફરીથી નિયંત્રણ મેળવવાનો પ્રયાસ કરી રહ્યા છે.
વ્યૂહાત્મક કાયદાકીય લડાઈ: ટેક જાયન્ટ્સને લક્ષ્ય બનાવવું
કાયદાકીય હુમલો બહુપક્ષીય છે, જે જનરેટિવ AI મોડલ્સ કેવી રીતે બનાવવામાં આવે છે તેની મુખ્ય પદ્ધતિઓને લક્ષ્ય બનાવે છે. કલાકારો માત્ર કોપીરાઈટ ઉલ્લંઘનના દાવાઓ પર જ નિર્ભર નથી; તેઓ કંપનીઓને જવાબદાર ઠેરવવા માટે terms of service ના ઉલ્લંઘન જેવા માર્ગો પણ શોધી રહ્યા છે.
ઉચ્ચ-સ્તરની કાયદાકીય લડાઈઓ પહેલેથી જ ચાલુ છે. ઘણા સર્જકોએ Susman Godfrey જેવી વિશિષ્ટ કાયદાકીય ટીમો સાથે જોડાણ કર્યું છે, જે હાલમાં વિવિધ લેખકો વતી Anthropic સામે મહત્વના કેસનું નેતૃત્વ કરી રહી છે. આ ચળવળના અન્ય પ્રણેતાઓ ઇલસ્ટ્રેટર અને કાર્ટૂનિસ્ટ Sarah Andersen છે, જેઓ AI જાયન્ટ્સને સીધી રીતે પડકારનારા પ્રથમ લોકોમાંના એક હતા. આ દાવાઓનો ઉદ્દેશ્ય ઉદ્દેશ્ય વગરના ડેટા સ્ક્રેપિંગ પર ઉદ્યોગની નિર્ભરતાને તોડવાનો અને તાલીમ સેટ્સ કેવી રીતે તૈયાર કરવા તે માટે નવો ધોરણ સ્થાપિત કરવાનો છે.
"Fair Use" નું યુદ્ધક્ષેત્ર
આ અદાલતોમાં મુખ્ય તણાવ "fair use" ની કાયદાકીય વ્યાખ્યામાં રહેલો છે. AI કંપનીઓ દલીલ કરે છે કે અસ્તિત્વમાં રહેલા ડેટા પર મોડલને તાલીમ આપવી એ પરિવર્તનશીલ (transformative) છે અને કાયદાકીય સુરક્ષા હેઠળ આવે છે. જોકે, સર્જકો દલીલ કરે છે કે જ્યારે AI કોઈ કલાકારની ચોક્કસ શૈલી અથવા લેખકની અનોખી અવાજની નકલ કરી શકે છે, ત્યારે તે પરિવર્તનશીલ રહેતું નથી અને સીધા બજારના વિકલ્પ (market substitute) તરીકે કાર્ય કરે છે જે મૂળ કાર્યનું મૂલ્ય ઘટાડે છે.
જેમ જેમ આ કેસો આગળ વધશે, તેમ તેમ તેઓ AI લેન્ડસ્કેપનું ભવિષ્ય નક્કી કરશે. પરિણામો એ નક્કી કરશે કે "AI slop"—ઓછી ગુણવત્તાવાળા, ડેરિવેટિવ કન્ટેન્ટનું સામૂહિક ઉત્પાદન—નો વર્તમાન માર્ગ કાયદેસર રીતે ટકી શકે તેમ છે, અથવા માહિતી અર્થતંત્રના કેન્દ્રમાં રહેલા માનવ સર્જકોના રક્ષણ માટે લાઇસન્સ પ્રાપ્ત, નૈતિક ડેટા સંપાદનનો નવો યુગ ઉદભવવો જોઈએ.
મુખ્ય મુદ્દાઓ
- વ્યવસ્થિત ડેટા સ્ક્રેપિંગ: મુખ્ય AI મોડલ્સ સર્જકની સંમતિ વિના ઊંડાણપૂર્વક સંશોધિત પુસ્તકો અને માલિકીના આર્ટવર્ક ધરાવતા પાયરેટેડ ડેટાસેટ્સનો ઉપયોગ કરતા હોવાનું મળી આવ્યું છે.
- વિવિધ કાયદાકીય વ્યૂહરચનાઓ: કાયદાકીય દાવાઓ કોપીરાઈટ ઉલ્લંઘન,
terms of serviceના ઉલ્લંઘન અને "fair use" સિદ્ધાંતને પડકાર દ્વારા AI કંપનીઓને લક્ષ્ય બનાવી રહ્યા છે. - IP માટે નિર્ણાયક ક્ષણ: Anthropic જેવી કંપનીઓ સામે ચાલી રહેલા કેસોના પરિણામો જનરેટિવ AI ના યુગમાં બૌદ્ધિક સંપત્તિનું મૂલ્ય કેવી રીતે નક્કી કરવામાં આવશે તેના માટે કાયદાકીય પૂર્વવર્તી (precedent) સ્થાપિત કરશે.
વિવાદ કેવી રીતે ફાટી નીકળ્યો
વિવાદ ત્યારે શરૂ થયો જ્યારે એક મોટી મેગેઝીને એ પુસ્તકો, લેખો અને આર્ટવર્કની સર્ચેબલ યાદી પ્રકાશિત કરી જેના પર લાર્જ લેંગ્વેજ મોડલ્સને તાલીમ આપવામાં આવી હતી. લેખક Kirk Wallace Johnson માટે, જેમની નોન-ફિક્શન પુસ્તકો માટે વર્ષોના સંશોધન અને મુસાફરીની જરૂર પડી હતી, આ ખુલાસો વ્યક્તિગત હતો. તેમણે જોયું કે જે શબ્દોને સંપૂર્ણ બનાવવા માટે તેમણે એક દાયકા આપ્યો હતો, તે ડેટાનો ભાગ હતા જે ચેટબોટ્સને સજ્જ કરે છે જે કોઈપણ રોયલ્ટી અથવા સ્વીકૃતિ વિના તેમની શૈલીને માંગ પર ફરીથી રજૂ કરી શકે છે.
Johnson નો અનુભવ કોઈ એકલવ ઘટના નથી. સાહિત્ય, ઇલસ્ટ્રેશન, સંગીત અને ફિલ્મ ક્ષેત્રના સર્જકો રિપોર્ટ કરી રહ્યા છે કે તેમના કોપીરાઈટ ધરાવતા કાર્યને મોટા પાયે એકત્ર કરવામાં આવ્યું છે. આ પ્રથા, જેને ઉદ્યોગના અંદરના લોકો "પાયરેટેડ ડેટાસેટ્સ" ના વ્યવસ્થિત નિષ્કર્ષણ તરીકે વર્ણવે છે, તેણે ચિંતાને સંકલિત કાયદાકીય કાર્યવાહીમાં ફેરવી દીધી છે. કલાકારો હવે દલીલ કરે છે કે તેઓ જે મૂલ્ય બનાવે છે તે "galactically wealthy" ટેક કોંગ્લોમરેટ્સમાં શોષવામાં આવી રહ્યું છે જે તેમના શ્રમનો લાભ લે છે જ્યારે સર્જકોને કંઈ મળતું નથી.
લડાઈને આકાર આપતા કાયદાકીય કેસો
આ કાયદાકીય હુમલો જનરેટિવ AI મોડલ્સ કેવી રીતે બનાવવામાં આવે છે તેના મૂળ પર લક્ષિત છે. વાદીઓ માત્ર કૉપિરાઇટ ઉલ્લંઘન માટે જ નહીં, પરંતુ પ્લેટફોર્મની પોતાની સેવાઓની શરતોના ભંગ માટે પણ દાવા કરી રહ્યા છે. ઇલસ્ટ્રેટર અને કાર્ટૂનિસ્ટ સારા એન્ડરસન, જેમનું કાર્ય ઇન્ટરનેટ સંસ્કૃતિનો એક મુખ્ય ભાગ બની ગયું છે, તેઓ AI કંપની સામે સીધો કાયદાકીય દાવો કરનાર પ્રથમ વિઝ્યુઅલ આર્ટિસ્ટ્સમાંના એક હતા. તેમની અરજીમાં દલીલ કરવામાં આવી છે કે મોડલની તેમની વિશિષ્ટ રેખાકલા અને રમૂજની નકલ કરવાની ક્ષમતા તેમના મૂળ કોમિક્સના બજારને નુકસાન પહોંચાડે છે, જે અસરકારક રીતે તેમના બ્રાન્ડને મફત સંસાધનમાં ફેરવી નાખે છે.
આ કેસો એવા વકીલો દ્વારા સંચાલિત કરવામાં આવી રહ્યા છે જે બૌદ્ધિક સંપત્તિના વિવાદોમાં નિષ્ણાત છે અને જેમનો ટેક જાયન્ટ્સને પડકારવાનો અનુભવ છે. તેમની વ્યૂહરચના એ છે કે ઉપયોગમાં લેવાયેલા ચોક્કસ ડેટાસેટ્સની વિગતો બહાર લાવવી, કંપનીઓને વિવાદિત સામગ્રીનો ઉપયોગ રોકવા માટે મજબૂર કરવી અને ચોરાયેલી સામગ્રીના વ્યાપારી મૂલ્યને પ્રતિબિંબિત કરતા નુકસાન વળતરની માંગ કરવી.
“ફેર યુઝ” (fair use) દલીલ મુશ્કેલીમાં
AI ડેવલપર્સનો દાવો છે કે સાર્વજનિક રીતે ઉપલબ્ધ ડેટા પર મોડલને તાલીમ આપવી એ એક પરિવર્તનશીલ ઉપયોગ છે જેને કાયદો રક્ષણ આપે છે. તેઓ દલીલ કરે છે કે મોડલ કોઈપણ સિંગલ કાર્યને શબ્દશઃ પુનઃઉત્પાદિત કરતું નથી; તેના બદલે, તે એવા પેટર્ન શીખે છે જે તેને નવો ટેક્સ્ટ અથવા ઈમેજ જનરેટ કરવામાં સક્ષમ બનાવે છે. તે દૃષ્ટિકોણથી, આ પ્રક્રિયા પુસ્તકોની નકલ કરવાને બદલે, જ્ઞાન મેળવવા માટે ઘણા પુસ્તકો વાંચતા સંશોધક જેવી છે.
સર્જકો સામે દલીલ કરે છે કે જ્યારે આઉટપુટ લેખકની શૈલી અથવા કલાકારની શૈલીની લગભગ સમાન નકલ હોઈ શકે છે, ત્યારે 'પરિવર્તન' એ માત્ર એક નબળો બચાવ છે. જ્યારે ચેટબોટ કોઈ નવલકથાકારની જાણીતી લય અને શબ્દપ્રયોગ સાથે પ્રશ્નનો જવાબ આપી શકે છે, અથવા જ્યારે ઈમેજ-જનરેટર એવા ચિત્રો બનાવી શકે છે જે જીવંત ઇલસ્ટ્રેટરના પોર્ટફોલિયોથી અલગ ન કરી શકાય તેવા હોય, ત્યારે તેનું પરિણામ બજારના વિકલ્પ તરીકે કામ કરે છે. વાદીઓ દલીલ કરે છે કે આ અવેજીકરણ તેમની પુસ્તકો, કમિશન અને લાયસન્સિંગ ડીલ્સ વેચવાની ક્ષમતાને નુકસાન પહોંચાડે છે, અને "ફેર યુઝ" નો બચાવ વ્યાપારી પ્રભાવના ભાર હેઠળ તૂટી પડે છે.
શું જોખમમાં છે
AI કંપનીઓ પર આર્થિક દબાણ – જો અદાલતો એવો ચુકાદો આપે કે મોટા પાયે સ્ક્રેપિંગ કૉપિરાઇટનું ઉલ્લંઘન કરે છે, તો કંપનીઓને નોંધપાત્ર નાણાકીય પરિણામોનો સામનો કરવો પડી શકે છે, જે સંભવતઃ ડેટા પાઇપલાઇન્સમાં ફેરફાર કરવા પ્રેરી શકે છે.
કોર્ટ ફાઇલિંગ્સ અને ડિસ્કવરી – દસ્તાવેજોની આગામી લહેર ચોક્કસપણે કયા શીર્ષકો અને છબીઓનો ઉપયોગ કરવામાં આવ્યો હતો તે જાહેર કરશે, જે ડેટા હાર્વેસ્ટિંગના સ્કેલનું સ્પષ્ટ ચિત્ર આપશે.
