గూగుల్ యొక్క Gemini AI పై న్యూయార్క్ ఫెడరల్ కోర్టులో క్లాస్-యాక్షన్ దావా దాఖలైంది. అనుమతి లేకుండా కాపీరైట్ చేయబడిన పుస్తకాలు మరియు వ్యాసాలపై తన మోడళ్లను శిక్షణ ఇవ్వడానికి కంపెనీ ఉపయోగించిందని ఈ దావా ఆరోపిస్తోంది. ప్రముఖ ప్రచురణకర్తలు మరియు రచయిత స్కాట్ ట్యూరో (Scott Turow) ఉన్న ఒక కూటమి దాఖలు చేసిన ఈ ఫిర్యాదు ప్రకారం, గూగుల్ తన జనరేటివ్-AI సిస్టమ్‌లో "దొంగిలించబడిన మెటీరియల్" వినియోగాన్ని దాచడానికి కాపీరైట్ సమాచారాన్ని ఉద్దేశపూర్వకంగా తొలగించింది.

దావా మరియు దాని ప్రధాన వాదనలు

న్యూయార్క్ సదరన్ డిస్ట్రిక్ట్ యు.ఎస్. డిస్ట్రిక్ట్ కోర్టులో దాఖలైన ఈ ఫిర్యాదులో Hachette, Cencage, Elsevier, S.C.R.I.B.E. కలెక్టివ్ మరియు Turowలను వాదులుగా పేర్కొన్నారు. Google Booksని నియంత్రించే "స్నిప్పెట్-ఓన్లీ" (snippet-only) ఒప్పందాన్ని మించి, ఆ ఆర్కైవ్ నుండి మరియు Google Playకి అప్‌లోడ్ చేసిన టైటిల్స్ నుండి పూర్తి పాఠ్య రచనలను (full-text works) ఉపయోగించి Geminiకి శిక్షణ ఇచ్చారని వారు ఆరోపిస్తున్నారు. ఫిర్యాదు ప్రకారం, గూగుల్ కంటెంట్‌ను స్క్రాప్ చేయడమే కాకుండా, కాపీరైట్ మెటాడేటాను మార్చింది లేదా తొలగించింది; ఈ చర్య ఉల్లంఘనను దాచడానికి ఉద్దేశించబడిందని వాదులు చెబుతున్నారు.

దావాలో పేర్కొన్న గూగుల్ అంతర్గత మెమో ప్రకారం, AI శిక్షణ కోసం కాపీరైట్ చేయబడిన పుస్తకాలను ఉపయోగించడం "చాలా సమస్యలతో కూడుకున్నది" అని మరియు ఇది కంపెనీని $10 బిలియన్ల నుండి $100 బిలియన్ల వరకు జరిమానాలకు గురిచేయవచ్చని హెచ్చరించింది. అనధికారిక డేటా వినియోగం కారణంగా మరొక AI సంస్థపై ఇటీవల విధించిన $1.5 బిలియన్ల పెనాల్టీని, సంభావ్య బాధ్యత యొక్క పరిమాణానికి ఒక ప్రమాణంగా వాదులు పేర్కొన్నారు.

ఇది ఎలా జరిగింది

పుస్తక ప్రచురణకర్తలతో గూగుల్ సంబంధం Google Booksతో ప్రారంభమైంది. ఇది శోధించదగిన ఇండెక్స్, ఇది పూర్తి పాఠ్యాన్ని పేవాల్ (paywall) వెనుక ఉంచి, చిన్న సారాంశాలు (excerpts) మరియు బిబ్లియోగ్రాఫిక్ వివరాలను మాత్రమే ప్రదర్శించేది. ఆ మోడల్ గూగుల్ కేవలం స్నిప్పెట్‌లను మాత్రమే ప్రదర్శించడానికి పరిమితం చేసే లైసెన్సింగ్ ఒప్పందాలపై ఆధారపడి ఉండేది. సంవత్సరాలుగా, గూగుల్ Google Play స్టోర్ ద్వారా తన పరిధిని విస్తరించింది, అక్కడ ప్రచురణకర్తలు మరియు రచయితలు అమ్మకం కోసం పూర్తి పాఠ్య ఇ-బుక్స్‌ను అప్‌లోడ్ చేస్తారు.

గూగుల్ యొక్క "పరిమిత పరిధి కలిగిన" (scope-limited) ఇండెక్సింగ్ సర్వీస్ నుండి లార్జ్ లాంగ్వేజ్ మోడల్స్ (LLMs) శిక్షణ కోసం డేటా మూలంగా మారడం అసలు ఒప్పందాలను ఉల్లంఘిస్తోందని వాదులు వాదిస్తున్నారు. Gemini యొక్క ట్రైనింగ్ పైప్‌లైన్‌లోకి మొత్తం రచనలను చేర్చడానికి అవసరమైన విస్తృత అనుమతులను కంపెనీ ఎన్నడూ పొందలేదని వారు చెబుతున్నారు.

Google మరియు AI పరిశ్రమకు ఇందులో ఉన్న రిస్క్ ఏమిటి?

లైసెన్స్ లేకుండా కాపీరైట్ చేసిన మెటీరియల్‌ని ఉపయోగించడం కాపీరైట్ చట్టాన్ని ఉల్లంఘిస్తుందని కోర్టు తేల్చితే, AI డెవలపర్లు ట్రైనింగ్ డేటాను ఎలా సేకరించాలనే దానిపై ఆ నిర్ణయం కొత్త రూపునివ్వవచ్చు.

సాధ్యమయ్యే రక్షణ వాదనలు మరియు ప్రతివాదనలు

గూగుల్ బహుశా "ఫెయిర్ యూజ్" (fair use) సిద్ధాంతంపై ఆధారపడే అవకాశం ఉంది, ఇది వ్యాఖ్యానం, విమర్శ లేదా రూపాంతరం కోసం కాపీరైట్ చేయబడిన మెటీరియల్‌ని పరిమితంగా ఉపయోగించడానికి అనుమతిస్తుంది. ఇటీవలి కాలిఫోర్నియా తీర్పులు AI శిక్షణను ఒక రూపాంతర కార్యకలాపంగా పరిగణించి, దానికి ఫెయిర్-యూజ్ రక్షణను కల్పించాయి. ఆ పూర్వ ఉదాహరణలను (precedents) నివారించడానికి న్యూయార్క్ వాదులు ఆ అధికార పరిధి వెలుపల దావా వేశారు.

కాపీరైట్ మెటాడేటాను తొలగించడం అనేది మూలాన్ని దాచాలనే ఉద్దేశాన్ని చూపుతుందని, ఇది సదుద్దేశంతో కూడిన రూపాంతరానికి సంబంధించిన ఏ వాదననైనా బలహీనపరుస్తుందని వాదులు ప్రతిస్పందించారు. గూగుల్ చట్టపరమైన రిస్క్‌ను గుర్తించిందని నిరూపించడానికి వారు అంతర్గత మెమోను కూడా ఉదహరించారు.

తదుపరి ఏం జరగవచ్చు

ఈ కేసు ప్రీ-ట్రయల్ మోషన్స్ (pre-trial motions) ద్వారా ముందుకు సాగుతుంది, ఇవి రెండు వైపుల వాదనలను ప్రభావితం చేయవచ్చు. కోర్టు కాలిఫోర్నియాలో ఉపయోగించిన ఫెయిర్-యూజ్ విశ్లేషణను వర్తింపజేస్తుందా లేదా వేరే ప్రమాణాన్ని అవలంబిస్తుందా అనేది ఇందులో కీలకం. అధికార పరిధిపై తీర్పు, AIకి సంబంధించిన కాపీరైట్ వివాదాలకు న్యూయార్క్ కోర్టులే ప్రధాన వేదికగా మారుతాయా లేదా అనేది నిర్ణయించవచ్చు.

ముఖ్య అంశం: గూగుల్ Geminiపై న్యూయార్క్ దావా, అనుమతించబడిన డేటా వినియోగం మరియు కాపీరైట్ ఉల్లంఘన మధ్య ఉన్న గీతను మళ్ళీ గీయవచ్చు. ఇది AI డెవలపర్లు తమ మోడళ్లకు శక్తినిచ్చే ముడి పదార్థాలను ఎలా సేకరించాలనే దానిపై మళ్ళీ ఆలోచించేలా చేస్తుంది మరియు మొత్తం పరిశ్రమ యొక్క ఆర్థిక వ్యవస్థను మారుస్తుంది.