గూగుల్ యొక్క Gemini AI పై న్యూయార్క్ ఫెడరల్ కోర్టులో క్లాస్-యాక్షన్ దావా దాఖలైంది. అనుమతి లేకుండా కాపీరైట్ చేయబడిన పుస్తకాలు మరియు వ్యాసాలపై తన మోడళ్లను శిక్షణ ఇవ్వడానికి కంపెనీ ఉపయోగించిందని ఈ దావా ఆరోపిస్తోంది. ప్రముఖ ప్రచురణకర్తలు మరియు రచయిత స్కాట్ ట్యూరో (Scott Turow) ఉన్న ఒక కూటమి దాఖలు చేసిన ఈ ఫిర్యాదు ప్రకారం, గూగుల్ తన జనరేటివ్-AI సిస్టమ్లో "దొంగిలించబడిన మెటీరియల్" వినియోగాన్ని దాచడానికి కాపీరైట్ సమాచారాన్ని ఉద్దేశపూర్వకంగా తొలగించింది.
దావా మరియు దాని ప్రధాన వాదనలు
న్యూయార్క్ సదరన్ డిస్ట్రిక్ట్ యు.ఎస్. డిస్ట్రిక్ట్ కోర్టులో దాఖలైన ఈ ఫిర్యాదులో Hachette, Cencage, Elsevier, S.C.R.I.B.E. కలెక్టివ్ మరియు Turowలను వాదులుగా పేర్కొన్నారు. Google Booksని నియంత్రించే "స్నిప్పెట్-ఓన్లీ" (snippet-only) ఒప్పందాన్ని మించి, ఆ ఆర్కైవ్ నుండి మరియు Google Playకి అప్లోడ్ చేసిన టైటిల్స్ నుండి పూర్తి పాఠ్య రచనలను (full-text works) ఉపయోగించి Geminiకి శిక్షణ ఇచ్చారని వారు ఆరోపిస్తున్నారు. ఫిర్యాదు ప్రకారం, గూగుల్ కంటెంట్ను స్క్రాప్ చేయడమే కాకుండా, కాపీరైట్ మెటాడేటాను మార్చింది లేదా తొలగించింది; ఈ చర్య ఉల్లంఘనను దాచడానికి ఉద్దేశించబడిందని వాదులు చెబుతున్నారు.
దావాలో పేర్కొన్న గూగుల్ అంతర్గత మెమో ప్రకారం, AI శిక్షణ కోసం కాపీరైట్ చేయబడిన పుస్తకాలను ఉపయోగించడం "చాలా సమస్యలతో కూడుకున్నది" అని మరియు ఇది కంపెనీని $10 బిలియన్ల నుండి $100 బిలియన్ల వరకు జరిమానాలకు గురిచేయవచ్చని హెచ్చరించింది. అనధికారిక డేటా వినియోగం కారణంగా మరొక AI సంస్థపై ఇటీవల విధించిన $1.5 బిలియన్ల పెనాల్టీని, సంభావ్య బాధ్యత యొక్క పరిమాణానికి ఒక ప్రమాణంగా వాదులు పేర్కొన్నారు.
ఇది ఎలా జరిగింది
పుస్తక ప్రచురణకర్తలతో గూగుల్ సంబంధం Google Booksతో ప్రారంభమైంది. ఇది శోధించదగిన ఇండెక్స్, ఇది పూర్తి పాఠ్యాన్ని పేవాల్ (paywall) వెనుక ఉంచి, చిన్న సారాంశాలు (excerpts) మరియు బిబ్లియోగ్రాఫిక్ వివరాలను మాత్రమే ప్రదర్శించేది. ఆ మోడల్ గూగుల్ కేవలం స్నిప్పెట్లను మాత్రమే ప్రదర్శించడానికి పరిమితం చేసే లైసెన్సింగ్ ఒప్పందాలపై ఆధారపడి ఉండేది. సంవత్సరాలుగా, గూగుల్ Google Play స్టోర్ ద్వారా తన పరిధిని విస్తరించింది, అక్కడ ప్రచురణకర్తలు మరియు రచయితలు అమ్మకం కోసం పూర్తి పాఠ్య ఇ-బుక్స్ను అప్లోడ్ చేస్తారు.
గూగుల్ యొక్క "పరిమిత పరిధి కలిగిన" (scope-limited) ఇండెక్సింగ్ సర్వీస్ నుండి లార్జ్ లాంగ్వేజ్ మోడల్స్ (LLMs) శిక్షణ కోసం డేటా మూలంగా మారడం అసలు ఒప్పందాలను ఉల్లంఘిస్తోందని వాదులు వాదిస్తున్నారు. Gemini యొక్క ట్రైనింగ్ పైప్లైన్లోకి మొత్తం రచనలను చేర్చడానికి అవసరమైన విస్తృత అనుమతులను కంపెనీ ఎన్నడూ పొందలేదని వారు చెబుతున్నారు.
Google మరియు AI పరిశ్రమకు ఇందులో ఉన్న రిస్క్ ఏమిటి?
లైసెన్స్ లేకుండా కాపీరైట్ చేసిన మెటీరియల్ని ఉపయోగించడం కాపీరైట్ చట్టాన్ని ఉల్లంఘిస్తుందని కోర్టు తేల్చితే, AI డెవలపర్లు ట్రైనింగ్ డేటాను ఎలా సేకరించాలనే దానిపై ఆ నిర్ణయం కొత్త రూపునివ్వవచ్చు.
సాధ్యమయ్యే రక్షణ వాదనలు మరియు ప్రతివాదనలు
గూగుల్ బహుశా "ఫెయిర్ యూజ్" (fair use) సిద్ధాంతంపై ఆధారపడే అవకాశం ఉంది, ఇది వ్యాఖ్యానం, విమర్శ లేదా రూపాంతరం కోసం కాపీరైట్ చేయబడిన మెటీరియల్ని పరిమితంగా ఉపయోగించడానికి అనుమతిస్తుంది. ఇటీవలి కాలిఫోర్నియా తీర్పులు AI శిక్షణను ఒక రూపాంతర కార్యకలాపంగా పరిగణించి, దానికి ఫెయిర్-యూజ్ రక్షణను కల్పించాయి. ఆ పూర్వ ఉదాహరణలను (precedents) నివారించడానికి న్యూయార్క్ వాదులు ఆ అధికార పరిధి వెలుపల దావా వేశారు.
కాపీరైట్ మెటాడేటాను తొలగించడం అనేది మూలాన్ని దాచాలనే ఉద్దేశాన్ని చూపుతుందని, ఇది సదుద్దేశంతో కూడిన రూపాంతరానికి సంబంధించిన ఏ వాదననైనా బలహీనపరుస్తుందని వాదులు ప్రతిస్పందించారు. గూగుల్ చట్టపరమైన రిస్క్ను గుర్తించిందని నిరూపించడానికి వారు అంతర్గత మెమోను కూడా ఉదహరించారు.
తదుపరి ఏం జరగవచ్చు
ఈ కేసు ప్రీ-ట్రయల్ మోషన్స్ (pre-trial motions) ద్వారా ముందుకు సాగుతుంది, ఇవి రెండు వైపుల వాదనలను ప్రభావితం చేయవచ్చు. కోర్టు కాలిఫోర్నియాలో ఉపయోగించిన ఫెయిర్-యూజ్ విశ్లేషణను వర్తింపజేస్తుందా లేదా వేరే ప్రమాణాన్ని అవలంబిస్తుందా అనేది ఇందులో కీలకం. అధికార పరిధిపై తీర్పు, AIకి సంబంధించిన కాపీరైట్ వివాదాలకు న్యూయార్క్ కోర్టులే ప్రధాన వేదికగా మారుతాయా లేదా అనేది నిర్ణయించవచ్చు.
ముఖ్య అంశం: గూగుల్ Geminiపై న్యూయార్క్ దావా, అనుమతించబడిన డేటా వినియోగం మరియు కాపీరైట్ ఉల్లంఘన మధ్య ఉన్న గీతను మళ్ళీ గీయవచ్చు. ఇది AI డెవలపర్లు తమ మోడళ్లకు శక్తినిచ్చే ముడి పదార్థాలను ఎలా సేకరించాలనే దానిపై మళ్ళీ ఆలోచించేలా చేస్తుంది మరియు మొత్తం పరిశ్రమ యొక్క ఆర్థిక వ్యవస్థను మారుస్తుంది.
