Google ನ Gemini AI ಯು ನ್ಯೂಯಾರ್ಕ್ ಫೆಡರಲ್ ನ್ಯಾಯಾಲಯದಲ್ಲಿ ದಾಖಲಾದ ಸಮೂಹ ದಾವೆಯನ್ನು (class-action lawsuit) ಎದುರಿಸುತ್ತಿದೆ. ಅನುಮತಿಯಿಲ್ಲದೆ ಕಾಪಿರೈಟ್ ಹೊಂದಿರುವ ಪುಸ್ತಕಗಳು ಮತ್ತು ಲೇಖನಗಳನ್ನು ತನ್ನ ಮಾಡೆಲ್ಗಳಿಗೆ ತರಬೇತಿ ನೀಡಲು ಬಳಸಿಕೊಂಡಿದೆ ಎಂದು ಈ ದಾವೆಯು ಕಂಪನಿಯನ್ನು ಆರೋಪಿಸುತ್ತದೆ. ಪ್ರಮುಖ ಪ್ರಕಾಶಕರು ಮತ್ತು ಲೇಖಕ Scott Turow ಸೇರಿದ ಒಕ್ಕೂಟವು ಸಲ್ಲಿಸಿರುವ ಈ ದೂರಿಗೆ, ತನ್ನ generative-AI ವ್ಯವಸ್ಥೆಯಲ್ಲಿ "ಕಳವು ಮಾಡಲಾದ ಸಾಮಗ್ರಿಗಳನ್ನು" ಬಳಸಿದ್ದನ್ನು ಮರೆಮಾಚಲು Google ಉದ್ದೇಶಪೂರ್ವಕವಾಗಿ ಕಾಪಿರೈಟ್ ಮಾಹಿತಿಯನ್ನು ತೆಗೆದುಹಾಕಿದೆ ಎಂದು ಹೇಳುತ್ತದೆ.
ದಾವೆ ಮತ್ತು ಅದರ ಪ್ರಮುಖ ಆರೋಪಗಳು
ನ್ಯೂಯಾರ್ಕ್ನ ದಕ್ಷಿಣ ಜಿಲ್ಲೆಯ ಯು.ಎಸ್. ಡಿಸ್ಟ್ರಿಕ್ಟ್ ಕೋರ್ಟ್ನಲ್ಲಿ ಸಲ್ಲಿಸಲಾದ ಈ ದಾವೆಯಲ್ಲಿ Hachette, Cencage, Elsevier, S.C.R.I.B.E. collective ಮತ್ತು Turow ಅನ್ನು ವಾದಿಗಳೆಂದು ಪಟ್ಟಿ ಮಾಡಲಾಗಿದೆ. Google Books ಅನ್ನು ನಿಯಂತ್ರಿಸುತ್ತಿದ್ದ "ಸ್ನಿಪ್ಪೆಟ್-ಮಾತ್ರ" (snippet-only) ವ್ಯವಸ್ಥೆಯನ್ನು ಮೀರಿ, Gemini ಗೆ ತರಬೇತಿ ನೀಡಲು ಆ ಆರ್ಕೈವ್ನ ಪೂರ್ಣ-ಪಠ್ಯ ಕೃತಿಗಳನ್ನು ಮತ್ತು Google Play ಗೆ ಅಪ್ಲೋಡ್ ಮಾಡಲಾದ ಶೀರ್ಷಿಕೆಗಳನ್ನು ಬಳಸಿಕೊಂಡಿದೆ ಎಂದು ಅವರು ಆರೋಪಿಸಿದ್ದಾರೆ. ದೂರಿಗೆ අනුව, Google ಕೇವಲ ವಿಷಯವನ್ನು ಸ್ಕ್ರೇಪ್ ಮಾಡಿದ್ದಲ್ಲದೆ, ಕಾಪಿರೈಟ್ ಮೆಟಾಡೇಟಾವನ್ನು ಬದಲಾಯಿಸಿದೆ ಅಥವಾ ತೆಗೆದುಹಾಕಿದೆ; ಉಲ್ಲಂಘನೆಯನ್ನು ಮರೆಮಾಚಲು ಈ ಕ್ರಮವನ್ನು ಕೈಗೊಳ್ಳಲಾಗಿದೆ ಎಂದು ವಾದಿಗಳು ಹೇಳುತ್ತಾರೆ.
ದಾವೆಯಲ್ಲಿ ಉಲ್ಲೇಖಿಸಲಾದ Google ನ ಆಂತರಿಕ ಮೆಮೊವು, AI ತರಬೇತಿಗಾಗಿ ಕಾಪಿರೈಟ್ ಹೊಂದಿರುವ ಪುಸ್ತಕಗಳನ್ನು ಬಳಸುವುದು "ಅತ್ಯಂತ ಸಮಸ್ಯೆಮಯ"ವಾಗಬಹುದು ಮತ್ತು ಕಂಪನಿಗೆ $10 ಬಿಲಿಯನ್ನಿಂದ $100 ಬಿಲಿಯನ್ ವರೆಗಿನ ದಂಡವನ್ನು ಎದುರಿಸಬೇಕಾಗಬಹುದು ಎಂದು ಎಚ್ಚರಿಸುತ್ತದೆ. ಅನಧಿಕೃತ ಡೇಟಾ ಬಳಕೆಗೆ ಸಂಬಂಧಿಸಿದಂತೆ ಮತ್ತೊಂದು AI ಸಂಸ್ಥೆಗೆ ವಿಧಿಸಲಾದ ಇತ್ತೀಚಿನ $1.5 ಬಿಲಿಯನ್ ದಂಡವನ್ನು ಸಂಭಾವ್ಯ ಹೊಣೆಗಾರಿಕೆಯ ಪ್ರಮಾಣಕ್ಕೆ ಮಾನದಂಡವಾಗಿ ವಾದಿಗಳು ಉಲ್ಲೇಖಿಸಿದ್ದಾರೆ.
ಇದು ಹೇಗೆ ಸಂಭವಿಸಿತು
ಪುಸ್ತಕ ಪ್ರಕಾಶಕರೊಂದಿಗೆ Google ನ ಸಂಬಂಧವು Google Books ಮೂಲಕ ಪ್ರಾರಂಭವಾಯಿತು. ಇದು ಪೂರ್ಣ ಪಠ್ಯವನ್ನು ಪೇವಾಲ್ (paywall) ಹಿಂದೆ ಇರಿಸುತ್ತಾ, ಸಂಕ್ಷಿಪ್ತ ಭಾಗಗಳು ಮತ್ತು ಗ್ರಂಥಸೂಚಿ ವಿವರಗಳನ್ನು ಪ್ರದರ್ಶಿಸುವ ಹುಡುಕಬಹುದಾದ ಸೂಚ್ಯಂಕವಾಗಿತ್ತು. ಆ ಮಾದರಿಯು Google ಗೆ ಸ್ನಿಪ್ಪೆಟ್ಗಳನ್ನು ಪ್ರದರ್ಶಿಸಲು ಮಾತ್ರ ಸೀಮಿತಗೊಳಿಸುವ ಪರವಾನಗಿ ಒಪ್ಪಂದಗಳನ್ನು ಅವಲಂಬಿಸಿತ್ತು. ವರ್ಷಗಳೆಳೆದು, Google Play ಸ್ಟೋರ್ ಮೂಲಕ Google ತನ್ನ ವ್ಯಾಪ್ತಿಯನ್ನು ವಿಸ್ತರಿಸಿತು, ಅಲ್ಲಿ ಪ್ರಕಾಶಕರು ಮತ್ತು ಲೇಖಕರು ಮಾರಾಟಕ್ಕಾಗಿ ಪೂರ್ಣ-ಪಠ್ಯ ಇ-ಪುಸ್ತಕಗಳನ್ನು ಅಪ್ಲೋಡ್ ಮಾಡುತ್ತಾರೆ.
"ವ್ಯಾಪ್ತಿ-ಸೀಮಿತ" (scope-limited) ಇಂಡೆಕ್ಸಿಂಗ್ ಸೇವೆಯಿಂದ ದೊಡ್ಡ ಭಾಷಾ ಮಾದರಿಗಳ (LLMs) ತರಬೇತಿಗಾಗಿ ಡೇಟಾ ಮೂಲವಾಗಿ ಬದಲಾಗಿದ್ದು ಮೂಲ ಒಪ್ಪಂದಗಳ ಉಲ್ಲಂಘನೆಯಾಗಿದೆ ಎಂದು ವಾದಿಗಳು ವಾದಿಸುತ್ತಾರೆ. Gemini ನ ತರಬೇತಿ ಪ್ರಕ್ರಿಯೆಗೆ (training pipeline) ಇಡೀ ಕೃತಿಗಳನ್ನು ಬಳಸಿಕೊಳ್ಳಲು ಅಗತ್ಯವಾದ ವ್ಯಾಪಕ ಅನುಮತಿಗಳನ್ನು ಕಂಪನಿಯು ಎಂದಿಗೂ ಪಡೆದುಕೊಂಡಿಲ್ಲ ಎಂದು ಅವರು ಹೇಳುತ್ತಾರೆ.
Google ಮತ್ತು AI ಉದ್ಯಮಕ್ಕೆ ಏನಿದೆ ಪಣ?
ಪರವಾನಗಿ ಇಲ್ಲದೆ ಕಾಪಿರೈಟ್ ಹೊಂದಿರುವ ಸಾಮಗ್ರಿಗಳನ್ನು ಬಳಸುವುದು ಕಾಪಿರೈಟ್ ಕಾನೂನನ್ನು ಉಲ್ಲಂಘಿಸುತ್ತದೆ ಎಂದು ನ್ಯಾಯಾಲಯವು ಕಂಡುಕೊಂಡರೆ, AI ಡೆವಲಪರ್ಗಳು ತರಬೇತಿ ಡೇಟಾವನ್ನು ಹೇಗೆ ಸಂಗ್ರಹಿಸುತ್ತಾರೆ ಎಂಬುದನ್ನು ಈ ನಿರ್ಧಾರವು ಮರುರೂಪಿಸಬಹುದು.
ಸಂಭವನೀಯ ರಕ್ಷಣಾತ್ಮಕ ವಾದಗಳು ಮತ್ತು ಪ್ರತಿವಾದಗಳು
Google ಬಹುಶಃ "ನ್ಯಾಯಯುತ ಬಳಕೆ" (fair use) ಸಿದ್ಧಾಂತವನ್ನು ಅವಲಂಬಿಸಬಹುದು, ಇದು ವ್ಯಾಖ್ಯಾನ, ಟೀಕೆ ಅಥವಾ ರೂಪಾಂತರಕ್ಕಾಗಿ ಕಾಪಿರೈಟ್ ಹೊಂದಿರುವ ಸಾಮಗ್ರಿಗಳನ್ನು ಸೀಮಿತವಾಗಿ ಬಳಸಲು ಅನುಮತಿಸುತ್ತದೆ. ಇತ್ತೀಚಿನ ಕ್ಯಾಲಿಫೋರ್ನಿಯಾ ತೀರ್ಪುಗಳು AI ತರಬೇತಿಯನ್ನು ಒಂದು ರೂಪಾಂತರಕಾರಿ ಚಟುವಟಿಕೆಯೆಂದು ಪರಿಗಣಿಸಿ, ಅದಕ್ಕೆ 'fair-use' ರಕ್ಷಣೆಯನ್ನು ನೀಡಿದೆವು. ನ್ಯೂಯಾರ್ಕ್ನ ವಾದಿಗಳು ಅಂತಹ ಪೂರ್ವನಿಯಮಗಳನ್ನು ತಪ್ಪಿಸಲು ಆ ನ್ಯಾಯಾಂಗ ವ್ಯಾಪ್ತಿಯ ಹೊರಗೆ ದಾವೆ ಹೂಡಿದ್ದಾರೆ.
ಕಾಪಿರೈಟ್ ಮೆಟಾಡೇಟಾವನ್ನು ತೆಗೆದುಹಾಕುತ್ತಿರುವುದು ಮೂಲವನ್ನು ಮರೆಮಾಚುವ ಉದ್ದೇಶವನ್ನು ತೋರಿಸುತ್ತದೆ ಮತ್ತು ಇದು ಸದ್ಭಾವನೆಯ ರೂಪಾಂತರದ (good-faith transformation) ಯಾವುದೇ ವಾದವನ್ನು ದುರ್ಬಲಗೊಳಿಸುತ್ತದೆ ಎಂದು ವಾದಿಗಳು ಪ್ರತಿ возраಧಿಸುತ್ತಾರೆ. Google ಕಾನೂನು ಅಪಾಯವನ್ನು ಗುರುತಿಸಿತ್ತು ಎಂಬುದಕ್ಕೆ ಅವರು ಆಂತರಿಕ ಮೆಮೋವನ್ನು ಪುರಾವೆಯಾಗಿ ಉಲ್ಲೇಖಿಸುತ್ತಾರೆ.
ಮುಂದೆ ಏನಾಗಬಹುದು?
ಈ ಪ್ರಕರಣವು ವಿಚಾರಣೆಗೆ ಮುನ್ನ ನಡೆಯುವ ಅರ್ಜಿಗಳ (pre-trial motions) ಮೂಲಕ ಸಾಗುತ್ತದೆ, ಇದು ಎರಡೂ ಕಡೆಯ ವಾದಗಳನ್ನು ರೂಪಿಸಬಹುದು; ಇದರಲ್ಲಿ ನ್ಯಾಯಾಲಯವು ಕ್ಯಾಲಿಫೋರ್ನಿಯಾದಲ್ಲಿ ಬಳಸಿದ 'fair-use' ವಿಶ್ಲೇಷಣೆಯನ್ನು ಅನ್ವಯಿಸುತ್ತದೆಯೇ ಅಥವಾ ಬೇರೆ ಮಾನದಂಡವನ್ನು ಅಳವಡಿಸಿಕೊಳ್ಳುತ್ತದೆಯೇ ಎಂಬುದು ಸೇರಿದೆ. ನ್ಯಾಯಾಂಗ ವ್ಯಾಪ್ತಿಯ ಕುರಿತಾದ ತೀರ್ಪುವು, AI ಸಂಬಂಧಿತ ಕಾಪಿರೈಟ್ ವಿವಾದಗಳಿಗೆ ನ್ಯೂಯಾರ್ಕ್ ನ್ಯಾಯಾಲಯಗಳು ಪ್ರಮುಖ ವೇದಿಕೆಯಾಗುತ್ತವೆಯೇ ಎಂಬುದನ್ನು ನಿರ್ಧರಿಸಬಹುದು.
ಸಾರಾಂಶ: Google ನ Gemini ವಿರುದ್ಧದ ನ್ಯೂಯಾರ್ಕ್ ದಾವೆಯು ಅನುಮತಿಸಬಹುದಾದ ಡೇಟಾ ಬಳಕೆ ಮತ್ತು ಕಾಪಿರೈಟ್ ಉಲ್ಲಂಘನೆಯ ನಡುವಿನ ಗಡಿಯನ್ನು ಮರುರೂಪಿಸಬಹುದು, ಇದು AI ಡೆವಲಪರ್ಗಳು ತಮ್ಮ ಮಾಡೆಲ್ಗಳಿಗೆ ಶಕ್ತಿ ನೀಡುವ ಕಚ್ಚಾ ಸಾಮಗ್ರಿಗಳನ್ನು ಹೇಗೆ ಪಡೆಯುತ್ತಾರೆ ಎಂಬುದನ್ನು ಮರುಪರಿಶೀಲಿಸಲು ಒತ್ತಾಯಿಸಬಹುದು ಮತ್ತು ಇಡೀ ಉದ್ಯಮದ ಆರ್ಥಿಕತೆಯನ್ನು ಮರುರೂಪಿಸಬಹುದು.
