Anthropicનું $1.5 બિલિયનનું પાયરસી સેટલમેન્ટ: એક રેકોર્ડબ્રેક નુકસાન અને વ્યૂહાત્મક જીત
તેના મોડેલ્સને તાલીમ આપવા માટે પાયરેટેડ (ચોરાયેલા) ડેટાબેઝનો ઉપયોગ કરવાના આરોપો બાદ, Anthropic પુસ્તક લેખકોના એક જૂથ સાથે $1.5 બિલિયનનું ઐતિહાસિક સેટલમેન્ટ કર્યું છે. જોકે આ મોટું પેઆઉટ આર્થિક રીતે મોટો ફટકો છે, પરંતુ આ કેસની કાનૂની વિગતો વાસ્તવમાં 'ફેર યુઝ' (fair use) ના સંદર્ભમાં સમગ્ર AI ઉદ્યોગ માટે એક મહત્વપૂર્ણ વિજય સાબિત થઈ શકે છે.
રેકોર્ડબ્રેક સેટલમેન્ટની વિગતો
સેન ફ્રાન્સિસ્કોની ફેડરલ કોર્ટે એક ઐતિહાસિક સેટલમેન્ટને મંજૂરી આપી છે, કારણ કે પુરાવાઓ દર્શાવે છે કે Anthropic એ 2021 અને 2022 વચ્ચે કુખ્યાત પાયરસી ડેટાબેઝ, ખાસ કરીને LibGen અને PiLiMi માંથી પુસ્તકો ડાઉનલોડ કર્યા હતા. આ સેટલમેન્ટનું પ્રમાણ ક્લાસ એક્શન ઇતિહાસમાં અભૂતપૂર્વ છે, જે અંદાજે 482,460 સૂચિબદ્ધ કૃતિઓને આવરી લે છે.
સામેલ કુલ કૃતિઓમાંથી, 91.3 ટકા માટે લેખકોએ સફળતાપૂર્વક દાવો કર્યો હતો. દરેક દાવાખોરને અંદાજે $3,000 મળશે, જે આંકડો વૈધાનિક લઘુત્તમ રકમ કરતા ચાર ગણો છે. કાનૂની ઉકેલના ભાગરૂપે, Anthropic એ આ સમયગાળા દરમિયાન ઉપયોગમાં લેવાયેલી પાયરેટેડ ફાઇલોનો નાશ કરવો જરૂરી છે. મહત્વની વાત એ છે કે, આ સેટલમેન્ટ કંપનીને સંપૂર્ણ છૂટ આપતું નથી; જો AI ના આઉટપુટ મૂળ કૃતિઓની નકલ કરે અથવા જો Anthropic ની ભવિષ્યની ડેટા પ્રાપ્તિની પદ્ધતિઓ કોપીરાઈટ કાયદાનું ઉલ્લંઘન કરે, તો લેખકો દાવો કરવાનો અધિકાર જાળવી રાખે છે.
એક ટેકનિકલ બાબત જે AI વિકાસના પક્ષમાં છે
$1.5 બિલિયનના આ વિશાળ ખર્ચ છતાં, આ કેસ દ્વારા સ્થાપિત કાનૂની દાખલો આશ્ચર્યજનક રીતે AI લેબ્સ માટે અનુકૂળ છે. આ સેટલમેન્ટ પાયરેટેડ સ્ત્રોતોના ઉપયોગના ચોક્કસ કૃત્યને સંબોધિત કરે છે, પરંતુ તે AI તાલીમની કાનૂનીતા પર કોઈ નિર્ણય આપતું નથી.
જજ અલ્સપ દ્વારા અગાઉ એક મહત્વપૂર્ણ તફાવત સ્થાપિત કરવામાં આવ્યો હતો: કાયદેસર રીતે મેળવેલા પુસ્તકો પર AI ને તાલીમ આપવી એ "પરિવર્તનકારી (transformative)—ખૂબ જ અદભૂત રીતે"—છે અને તે સીધું જ 'ફેર યુઝ'ના સિદ્ધાંત હેઠળ આવે છે. આ તફાવત OpenAI, Google અને Meta જેવી કંપનીઓ માટે અત્યંત મહત્વપૂર્ણ છે. તે સૂચવે છે કે જોકે ડેટાનો સ્ત્રોત (પાયરસી વિરુદ્ધ કાયદેસર પ્રાપ્તિ) જવાબદારી હોઈ શકે છે, પરંતુ ભાષા અને પેટર્નને સમજવા માટે મોડેલને તાલીમ આપવાની પ્રક્રિયા કાનૂની રીતે બચાવી શકાય તેવી છે.
માસ સ્ક્રેપિંગનું અનિર્ણિત ક્ષેત્ર
જોકે આ ચુકાદો વિશાળ ડેટાસેટ્સ પર તાલીમ મેળવનાર લેબ્સ માટે જીવનરક્ષક સમાન છે, પરંતુ "કાયદેસર પ્રાપ્તિ" અંગેની કાનૂની લડાઈ હજુ પૂરી થઈ નથી. મુખ્ય પ્રશ્ન એ જ છે: વેબસાઇટ માલિકોની સ્પષ્ટ સંમતિ વિના ઇન્ટરનેટ કન્ટેન્ટનું માસ સ્ક્રેપિંગ કરવું એ કાયદેસરની પ્રાપ્તિ ગણાય કે કોપીરાઈટનું ઉલ્લંઘન?
આ સેટલમેન્ટ AI ઉદ્યોગ માટે વિભાજિત કાનૂની વાસ્તવિકતાને પ્રકાશિત કરે છે. કંપનીઓ તેમના ડેટા પાઇપલાઇન્સમાંથી જાણીતા પાયરેટેડ રિપોઝીટરીઝને દૂર કરીને મોટા દંડથી બચી શકે છે, પરંતુ વેબ પ્રકાશકો અને કન્ટેન્ટ ક્રિએટર્સના અધિકારો અંગે તેઓ હજુ પણ અનિશ્ચિત પરિસ્થિતિનો સામનો કરી રહ્યા છે. જેમ જેમ AI લેબ્સનું વિસ્તરણ થશે, તેમ તેમ પરિવર્તનકારી તકનીકી પ્રગતિ અને બૌદ્ધિક સંપદા અધિકારો વચ્ચેનો તણાવ ઉદ્યોગ માટે સૌથી મોટો કાનૂની અવરોધ બની રહેશે.
મુખ્ય મુદ્દાઓ
- રેકોર્ડબ્રેક પેઆઉટ: LibGen જેવા પાયરેટેડ ડેટાબેઝનો ઉપયોગ કર્યા પછી Anthropic લેખકોને $1.5 બિલિયન ચૂકવશે, જે ક્લાસ એક્શન ઇતિહાસમાં સૌથી મોટું કોપીરાઈટ સેટલમેન્ટ છે.
- ફેર યુઝ પ્રિસિડન્ટ: કોર્ટે પુષ્ટિ કરી છે કે કાયદેસર રીતે મેળવેલા ડેટા પર AI ને તાલીમ આપવી એ "અદભૂત રીતે પરિવર્તનકારી" છે, જે કાયદેસરની AI તાલીમ માટે મોટું કાનૂની કવચ પૂરું પાડે છે.
- ડેટાની અખંડિતતા મહત્વપૂર્ણ છે: ચુકાદો ભાર મૂકે છે કે AI તાલીમની કાનૂનીતા ઘણીવાર તાલીમ પ્રક્રિયાને બદલે તાલીમ ડેટાના સ્ત્રોત પર આધારિત હોય છે.
