Anthropic ನ $1.5 ಬಿಲಿಯನ್ ಪೈರಸಿ ಇತ್ಯರ್ಥ: ದಾಖಲೆ ಮಟ್ಟದ ನಷ್ಟ ಮತ್ತು ಕಾರ್ಯತಂತ್ರದ ಗೆಲುವು

ತನ್ನ ಮಾದರಿಗಳನ್ನು (models) ತರಬೇತಿಗೊಳಿಸಲು ಪೈರಟೆಡ್ (pirated) ಡೇಟಾಬೇಸ್‌ಗಳನ್ನು ಬಳಸಿದ ಆರೋಪದ ನಂತರ, Anthropic ತನ್ನ ಪುಸ್ತಕ ಲೇಖಕರ ಗುಂಪಿನೊಂದಿಗೆ ಐತಿಹಾಸಿಕ $1.5 ಬಿಲಿಯನ್ ಇತ್ಯರ್ಥಕ್ಕೆ ತಲುಪಿದೆ. ಈ ಬೃಹತ್ ಪಾವತಿಯು ಆರ್ಥಿಕವಾಗಿ ದೊಡ್ಡ ಹೊಡೆತವಾದರೂ, ಈ ಪ್ರಕರಣದ ಕಾನೂನು ಸೂಕ್ಷ್ಮತೆಗಳು 'ನ್ಯಾಯಯುತ ಬಳಕೆ' (fair use) ಕುರಿತು ವಿಶಾಲವಾದ AI ಉದ್ಯಮಕ್ಕೆ ಗಮನಾರ್ಹ ಗೆಲುವನ್ನು ನೀಡಬಹುದು.

ದಾಖಲೆ ಮಟ್ಟದ ಇತ್ಯರ್ಥದ ವಿವರಗಳು

2021 ಮತ್ತು 2022 ರ ನಡುವೆ Anthropic ಕಂಪನಿಯು LibGen ಮತ್ತು PiLiMi ನಂತಹ ಕುಖ್ಯಾತ ಪೈರಸಿ ಡೇಟಾಬೇಸ್‌ಗಳಿಂದ ಪುಸ್ತಕಗಳನ್ನು ಡೌನ್‌ಲೋಡ್ ಮಾಡಿದೆ ಎಂಬ ಪುರಾವೆಗಳು ಲಭ್ಯವಾದ ನಂತರ, ಸ್ಯಾನ್ ಫ್ರಾನ್ಸಿಸ್ಕೋದಲ್ಲಿನ ಫೆಡರಲ್ ನ್ಯಾಯಾಲಯವು ಈ ಐತಿಹಾಸಿಕ ಇತ್ಯರ್ಥವನ್ನು ಅನುಮೋದಿಸಿದೆ. ಈ ಇತ್ಯರ್ಥದ ಪ್ರಮಾಣವು ಕ್ಲಾಸ್ ಆಕ್ಷನ್ (class action) ಇತಿಹಾಸದಲ್ಲೇ ಅಭೂತಪೂರ್ವವಾಗಿದ್ದು, ಇದು ಸುಮಾರು 482,460 ಪಟ್ಟಿ ಮಾಡಲಾದ ಕೃತಿಗಳನ್ನು ಒಳಗೊಂಡಿದೆ.

ಒಳಗೊಂಡಿರುವ ಒಟ್ಟು ಕೃತಿಗಳಲ್ಲಿ, 91.3 ಪ್ರತಿಶತವನ್ನು ಲೇಖಕರು ಯಶಸ್ವಿಯಾಗಿ ಕ್ಲೈಮ್ ಮಾಡಿದ್ದಾರೆ. ಪ್ರತಿ ಕ್ಲೈಮೆಂಟ್ (claimant) ಸುಮಾರು $3,000 ಪಡೆಯಲಿದ್ದಾರೆ, ಇದು ಶಾಸನಬದ್ಧ ಕನಿಷ್ಠ ಮೊತ್ತಕ್ಕಿಂತ ನಾಲ್ಕು ಪಟ್ಟು ಹೆಚ್ಚು. ಕಾನೂನು ಪರಿಹಾರದ ಭಾಗವಾಗಿ, ಈ ಅವಧಿಯಲ್ಲಿ ಬಳಸಲಾದ ಪೈರಟೆಡ್ ಫೈಲ್‌ಗಳನ್ನು ನಾಶಪಡಿಸಲು Anthropic ಗೆ ಸೂಚಿಸಲಾಗಿದೆ. ಮುಖ್ಯವಾಗಿ, ಈ ಇತ್ಯರ್ಥವು ಕಂಪನಿಗೆ ಸಂಪೂರ್ಣ ರಕ್ಷಣೆ ನೀಡುವುದಿಲ್ಲ; ಒಂದು ವೇಳೆ AI ನೀಡುವ ಫಲಿತಾಂಶಗಳು ಮೂಲ ಕೃತಿಗಳನ್ನು ಪುನರಾವರ್ತಿಸಿದರೆ ಅಥವಾ Anthropic ನ ಭವಿಷ್ಯದ ಡೇಟಾ ಸಂಗ್ರಹಣಾ ಪದ್ಧತಿಗಳು ಕಾಪಿರೈಟ್ ಕಾನೂನುಗಳನ್ನು ಉಲ್ಲಂಘಿಸಿದರೆ, ದೂರು ತರಲು ಲೇಖಕರಿಗೆ ಹಕ್ಕಿದೆ.

AI ಅಭಿವೃದ್ಧಿಗೆ ಪೂರಕವಾದ ತಾಂತ್ರಿಕ ಅಂಶ

$1.5 ಬಿಲಿಯನ್ ಎಂಬ ಭಾರಿ ಮೊತ್ತವಿದ್ದರೂ ಸಹ, ಈ ಪ್ರಕರಣವು ರೂಪಿಸಿದ ಕಾನೂನು ಪೂರ್ವಾವಾದವು (precedent) AI ಪ್ರಯೋಗಾಲಯಗಳಿಗೆ ಆಶ್ಚರ್ಯಕರವಾಗಿ ಪೂರಕವಾಗಿದೆ. ಈ ಇತ್ಯರ್ಥವು ಪೈರಟೆಡ್ ಮೂಲಗಳನ್ನು ಬಳಸುವ ನಿರ್ದಿಷ್ಟ ಕೃತ್ಯವನ್ನು ಮಾತ್ರ ಉದ್ದೇಶಿಸಿದೆ, ಆದರೆ AI ತರಬೇತಿಯ ಕಾನೂನುಬದ್ಧತೆಯ ಬಗ್ಗೆ ತೀರ್ಪು ನೀಡಿಲ್ಲ.

ನ್ಯಾಯಾಧೀಶರಾದ Alsup ಅವರು ಈ ಹಿಂದೆ ಒಂದು ನಿರ್ಣಾಯಕ ವ್ಯತ್ಯಾಸವನ್ನು ಗುರುತಿಸಿದ್ದರು: ಕಾನೂನುಬದ್ಧವಾಗಿ ಪಡೆದ ಪುಸ್ತಕಗಳ ಮೇಲೆ AI ಗೆ ತರಬೇತಿ ನೀಡುವುದು "ಪರಿವರ್ತನಾತ್ಮಕವಾಗಿದೆ (transformative)—ಅತ್ಯಂತ ಅದ್ಭುತವಾಗಿ உள்ளது"—ಮತ್ತು ಇದು ನೇರವಾಗಿ 'ನ್ಯಾಯಯುತ ಬಳಕೆ' (fair use) ಸಿದ್ಧಾಂತದ ಅಡಿಯಲ್ಲಿ ಬರುತ್ತದೆ. OpenAI, Google ಮತ್ತು Meta ನಂತಹ ಕಂಪನಿಗಳಿಗೆ ಈ ವ್ಯತ್ಯಾಸವು ಅತ್ಯಗತ್ಯವಾಗಿದೆ. ಇದು ಡೇಟಾದ ಮೂಲವು (ಪೈರಸಿ vs ಕಾನೂನುಬದ್ಧ ಸ್ವಾಧೀನ) ಹೊಣೆಗಾರಿಕೆಯಾಗಿದ್ದರೂ, ಭಾಷೆ ಮತ್ತು ಮಾದರಿಗಳನ್ನು ಅರ್ಥಮಾಡಿಕೊಳ್ಳಲು ಮಾಡಲಾಗುವ ಮಾದರಿಯ ತರಬೇತಿ ಪ್ರಕ್ರಿಯೆಯು ಕಾನೂನುಬದ್ಧವಾಗಿ ಸಮರ್ಥನೀಯವಾಗಿದೆ ಎಂದು ಸೂಚಿಸುತ್ತದೆ.

ಮಾಸ್ ಸ್ಕ್ರೇಪಿಂಗ್‌ನ (Mass Scraping) ಪರಿಹಾರವಾಗದ ಸವಾಲು

ಈ ತೀರ್ಪು ಬೃಹತ್ ಡೇಟಾ ಸೆಟ್‌ಗಳ ಮೇಲೆ ತರಬೇತಿ ಪಡೆದ ಪ್ರಯೋಗಾಲಯಗಳಿಗೆ ಒಂದು ಜೀವನಾಡಿಯನ್ನು ನೀಡಿದ್ದರೂ, "ಕಾನೂನುಬದ್ಧ ಸ್ವಾಧೀನ" ಕುರಿತಾದ ಕಾನೂನು ಹೋರಾಟ ಇನ್ನೂ ಮುಗಿದಿಲ್ಲ. ಪ್ರಮುಖ ಪ್ರಶ್ನೆಯೆಂದರೆ: ವೆಬ್‌ಸೈಟ್ ಮಾಲೀಕರಿಂದ ಸ್ಪಷ್ಟ ಸಮ್ಮತಿಯಿಲ್ಲದೆ ಇಂಟರ್ನೆಟ್ ಕಂಟೆಂಟ್ ಅನ್ನು ಮಾಸ್ ಸ್ಕ್ರೇಪಿಂಗ್ ಮಾಡುವುದು ಕಾನೂನುಬದ್ಧ ಸ್ವಾಧೀನವೇ ಅಥವಾ ಕಾಪಿರೈಟ್ ಉಲ್ಲಂಘನೆಯೇ?

ಈ ಇತ್ಯರ್ಥವು AI ಉದ್ಯಮಕ್ಕೆ ವಿಭಜಿತವಾದ ಕಾನೂನು ವಾಸ್ತವವನ್ನು ಎತ್ತಿ ತೋರಿಸುತ್ತದೆ. ಕಂಪನಿಗಳು ತಮ್ಮ ಡೇಟಾ ಪೈಪ್‌ಲೈನ್‌ಗಳಿಂದ ಪೈರಟೆಡ್ ರೆಪೊಸಿಟರಿಗಳನ್ನು ತೆಗೆದುಹಾಕುವ ಮೂಲಕ ಭಾರಿ ದಂಡವನ್ನು ತಪ್ಪಿಸಬಹುದು, ಆದರೆ ವೆಬ್ ಪ್ರಕಾಶಕರು ಮತ್ತು ಕಂಟೆಂಟ್ ಕ್ರಿಯೇಟರ್‌ಗಳ ಹಕ್ಕುಗಳ ವಿಷಯದಲ್ಲಿ ಅವರು ಇನ್ನೂ ಅನಿಶ್ಚಿತ ಪರಿಸ್ಥಿತಿಯನ್ನು ಎದುರಿಸುತ್ತಿದ್ದಾರೆ. AI ಪ್ರಯೋಗಾಲಯಗಳು ವಿಸ್ತರಿಸುತ್ತಾ ಹೋದಂತೆ, ಪರಿವರ್ತನಾತ್ಮಕ ತಾಂತ್ರಿಕ ಪ್ರಗತಿ ಮತ್ತು ಬೌದ್ಧಿಕ ಆಸ್ತಿ ಹಕ್ಕುಗಳ ನಡುವಿನ ಸಂಘರ್ಷವು ಉದ್ಯಮದ ಅತ್ಯಂತ ದೊಡ್ಡ ಕಾನೂನು ಅಡಚಣೆಯಾಗಿ ಉಳಿಯಲಿದೆ.

ಪ್ರಮುಖ ಅಂಶಗಳು

  • ದಾಖಲೆ ಮಟ್ಟದ ಪಾವತಿ: LibGen ನಂತಹ ಪೈರಟೆಡ್ ಡೇಟಾಬೇಸ್‌ಗಳನ್ನು ಬಳಸಿದ ನಂತರ Anthropic ಲೇಖಕರಿಗೆ $1.5 ಬಿಲಿಯನ್ ಪಾವತಿಸಲಿದೆ, ಇದು ಕ್ಲಾಸ್ ಆಕ್ಷನ್ ಇತಿಹಾಸದಲ್ಲಿ ಅತಿದೊಡ್ಡ ಕಾಪಿರೈಟ್ ಇತ್ಯರ್ಥವಾಗಿದೆ.
  • ನ್ಯಾಯಯುತ ಬಳಕೆಯ ಪೂರ್ವಾವಾದ: ಕಾನೂನುಬದ್ಧವಾಗಿ ಪಡೆದ ಡೇಟಾದ ಮೇಲೆ AI ಗೆ ತರಬೇತಿ ನೀಡುವುದು "ಅತ್ಯಂತ ಪರಿವರ್ತನಾತ್ಮಕವಾಗಿದೆ" ಎಂದು ನ್ಯಾಯಾಲಯವು ದೃಢಪಡಿಸಿದೆ, ಇದು ಕಾನೂನುಬದ್ಧ AI ತರಬೇತಿಗೆ ದೊಡ್ಡ ಕಾನೂನು ರಕ್ಷಣೆಯನ್ನು ನೀಡುತ್ತದೆ.
  • ಡೇಟಾ ಸಮಗ್ರತೆಯು ನಿರ್ಣಾಯಕ: AI ತರಬೇತಿಯ ಕಾನೂನುಬದ್ಧತೆಯು ತರಬೇತಿ ಪ್ರಕ್ರಿಯೆಗಿಂತ ಹೆಚ್ಚಾಗಿ ತರಬೇತಿ ಡೇಟಾದ ಮೂಲದ ಮೇಲೆ ಅವಲಂಬಿತವಾಗಿರುತ್ತದೆ ಎಂದು ಈ ತೀರ್ಪು ಒತ್ತಿಹೇಳುತ್ತದೆ.