Anthropic का $1.5B का पायरेसी समझौता: एक रिकॉर्ड नुकसान और रणनीतिक जीत
अपने मॉडल्स को प्रशिक्षित करने के लिए पायरेटेड डेटाबेस का उपयोग करने के आरोपों के बाद, Anthropic ने लेखकों के एक समूह के साथ $1.5 बिलियन का ऐतिहासिक समझौता किया है। हालांकि यह भारी भुगतान एक वित्तीय झटका है, लेकिन इस मामले की कानूनी बारीकियां वास्तव में 'फेयर यूज़' (fair use) के संबंध में व्यापक AI उद्योग के लिए एक महत्वपूर्ण जीत प्रदान कर सकती हैं।
रिकॉर्ड तोड़ने वाले समझौते का विवरण
सैन फ्रांसिस्को की एक संघीय अदालत ने एक ऐतिहासिक समझौते को मंजूरी दी है, क्योंकि सबूतों से पता चला है कि Anthropic ने 2021 और 2022 के बीच कुख्यात पायरेसी डेटाबेस, विशेष रूप से LibGen और PiLiMi से किताबें डाउनलोड की थीं। इस समझौते का पैमाना क्लास एक्शन इतिहास में अभूतपूर्व है, जिसमें लगभग 482,460 सूचीबद्ध कृतियाँ शामिल हैं।
शामिल कुल कृतियों में से, 91.3 प्रतिशत पर लेखकों ने सफलतापूर्वक दावा किया। प्रत्येक दावेदार को लगभग $3,000 प्राप्त होने वाले हैं, जो वैधानिक न्यूनतम राशि का चार गुना है। कानूनी समाधान के हिस्से के रूप में, Anthropic को इस अवधि के दौरान उपयोग की गई पायरेटेड फाइलों को नष्ट करना होगा। महत्वपूर्ण बात यह है कि यह समझौता कंपनी को पूरी तरह से छूट नहीं देता है; यदि AI आउटपुट मूल कृतियों को पुनरुत्पादित करते हैं या यदि Anthropic की भविष्य की डेटा अधिग्रहण प्रथाएं कॉपीराइट कानूनों का उल्लंघन करती हैं, तो लेखकों के पास दावे करने का अधिकार सुरक्षित है।
एक तकनीकी पहलू जो AI विकास के पक्ष में है
$1.5 बिलियन की चौंका देने वाली कीमत के बावजूद, इस मामले द्वारा स्थापित कानूनी मिसाल AI लैब्स के लिए आश्चर्यजनक रूप से अनुकूल है। यह समझौता पायरेटेड स्रोतों के उपयोग के विशिष्ट कार्य को संबोधित करता है, लेकिन यह स्वयं AI प्रशिक्षण की वैधता पर निर्णय नहीं देता है।
जज अलसुप (Judge Alsup) ने पहले एक महत्वपूर्ण अंतर स्थापित किया था: कानूनी रूप से प्राप्त पुस्तकों पर AI को प्रशिक्षित करना "परिवर्तनकारी (transformative)—बेहद प्रभावशाली रूप से"—है और यह सीधे तौर पर 'फेयर यूज़' के सिद्धांत के अंतर्गत आता है। यह अंतर OpenAI, Google और Meta जैसी कंपनियों के लिए अत्यंत महत्वपूर्ण है। यह सुझाव देता है कि हालांकि डेटा का स्रोत (पायरेसी बनाम कानूनी अधिग्रहण) एक दायित्व (liability) है, लेकिन भाषा और पैटर्न को समझने के लिए मॉडल को प्रशिक्षित करने की प्रक्रिया कानूनी रूप से बचाव योग्य है।
मास स्क्रैपिंग (Mass Scraping) का अनसुलझा मोर्चा
हालांकि यह फैसला उन लैब्स के लिए जीवनदान है जिन्होंने विशाल डेटासेट पर प्रशिक्षण लिया है, लेकिन "कानूनी अधिग्रहण" पर कानूनी लड़ाई अभी खत्म नहीं हुई है। मुख्य प्रश्न अभी भी बना हुआ है: क्या वेबसाइट मालिकों की स्पष्ट सहमति के बिना इंटरनेट सामग्री की मास स्क्रैपिंग कानूनी अधिग्रहण है या कॉपीराइट का उल्लंघन?
यह समझौता AI उद्योग के लिए एक द्विभाजित (bifurcated) कानूनी वास्तविकता को उजागर करता है। कंपनियां यह सुनिश्चित करके भारी जुर्माने से बच सकती हैं कि उनके डेटा पाइपलाइन ज्ञात पायरेटेड रिपॉजिटरी से मुक्त हों, लेकिन उन्हें वेब प्रकाशकों और सामग्री निर्माताओं के अधिकारों के संबंध में अभी भी अनिश्चित परिदृश्य का सामना करना पड़ेगा। जैसे-जैसे AI लैब्स का विस्तार जारी रहेगा, परिवर्तनकारी तकनीकी प्रगति और बौद्धिक संपदा अधिकारों के बीच का तनाव उद्योग की सबसे महत्वपूर्ण कानूनी बाधा बना रहेगा।
मुख्य बातें
- रिकॉर्ड तोड़ने वाला भुगतान: LibGen जैसे पायरेटेड डेटाबेस का उपयोग करने के बाद Anthropic लेखकों को $1.5 बिलियन का भुगतान करेगा, जो क्लास एक्शन इतिहास में सबसे बड़ा कॉपीराइट समझौता है।
- फेयर यूज़ मिसाल: अदालत ने पुष्टि की कि कानूनी रूप से प्राप्त डेटा पर AI को प्रशिक्षित करना "बेहद परिवर्तनकारी" है, जो वैध AI प्रशिक्षण के लिए एक बड़ा कानूनी कवच प्रदान करता है।
- डेटा अखंडता महत्वपूर्ण है: यह फैसला इस बात पर जोर देता है कि AI प्रशिक्षण की वैधता अक्सर प्रशिक्षण प्रक्रिया के बजाय प्रशिक्षण डेटा की उत्पत्ति (provenance) पर निर्भर करती है।
