Google-এর Gemini AI নিউ ইয়র্ক ফেডারেল আদালতে একটি ক্লাস-অ্যাকশন মামলার সম্মুখীন হয়েছে, যেখানে কোম্পানিটির বিরুদ্ধে অনুমতি ছাড়া কপিরাইটযুক্ত বই এবং নিবন্ধ ব্যবহার করে তাদের মডেলগুলোকে প্রশিক্ষণ দেওয়ার অভিযোগ আনা হয়েছে। প্রধান প্রকাশনা সংস্থা এবং লেখক Scott Turow-সহ একটি জোটের মাধ্যমে আনা এই অভিযোগে বলা হয়েছে যে, Google তাদের জেনারেটিভ-AI সিস্টেমে "চুরি করা উপকরণ" ব্যবহারের বিষয়টি গোপন করার জন্য উদ্দেশ্যপ্রণোদিতভাবে কপিরাইট তথ্য মুছে ফেলেছে।

মামলা এবং এর মূল দাবিগুলো

ইউএস ডিস্ট্রিক্ট কোর্ট ফর দ্য সাউদার্ন ডিস্ট্রিক্ট অফ নিউ ইয়র্কে করা এই আবেদনে Hachette, Cencage, Elsevier, S.C.R.I.B.E. collective এবং Turow-কে বাদী হিসেবে তালিকাভুক্ত করা হয়েছে। তাদের অভিযোগ, Google Books-এর ক্ষেত্রে প্রযোজ্য "শুধুমাত্র স্নিপেট" (snippet-only) ব্যবস্থার বাইরে গিয়ে Google Gemini-কে প্রশিক্ষণ দেওয়ার জন্য সেই আর্কাইভ এবং Google Play-তে আপলোড করা শিরোনাম থেকে পূর্ণাঙ্গ টেক্সট ব্যবহার করেছে। অভিযোগ অনুযায়ী, Google কেবল কন্টেন্টগুলো স্ক্র্যাপই করেনি, বরং কপিরাইট মেটাডেটা পরিবর্তন বা মুছেও ফেলেছে, যা বাদীদের মতে কপিরাইট লঙ্ঘন গোপন করার একটি পদক্ষেপ ছিল।

মামলায় উল্লিখিত Google-এর একটি অভ্যন্তরীণ মেমো সতর্ক করেছে যে, AI প্রশিক্ষণের জন্য কপিরাইটযুক্ত বই ব্যবহার করা "অত্যন্ত সমস্যাযুক্ত" হতে পারে এবং এর ফলে কোম্পানিটি ১০ বিলিয়ন থেকে ১০০ বিলিয়ন ডলার পর্যন্ত জরিমানার সম্মুখীন হতে পারে। সম্ভাব্য দায়ের মাত্রা বোঝার জন্য বাদীপক্ষ অননুমোদিত ডেটা ব্যবহারের জন্য অন্য একটি AI ফার্মের বিরুদ্ধে সাম্প্রতিক ১.৫ বিলিয়ন ডলারের জরিমানাকে একটি মানদণ্ড হিসেবে উল্লেখ করেছে।

আমরা এখানে কীভাবে পৌঁছালাম

বই প্রকাশকদের সাথে Google-এর সম্পর্ক শুরু হয়েছিল Google Books-এর মাধ্যমে, যা ছিল একটি অনুসন্ধানযোগ্য ইনডেক্স যেখানে ছোট ছোট অংশ এবং গ্রন্থপঞ্জি সংক্রান্ত তথ্য দেখানো হতো, কিন্তু মূল টেক্সটটি পে-ওয়াল (paywall)-এর পেছনে রাখা হতো। সেই মডেলটি লাইসেন্সিং চুক্তির ওপর নির্ভরশীল ছিল যা Google-কে শুধুমাত্র স্নিপেট দেখানোর মধ্যে সীমাবদ্ধ রাখত। বছরের পর বছর ধরে, Google তার কার্যক্রম Google Play স্টোরের মাধ্যমে সম্প্রসারিত করেছে, যেখানে প্রকাশনা সংস্থা এবং লেখকরা বিক্রয়ের জন্য পূর্ণাঙ্গ ই-বুক আপলোড করেন।

বাদীপক্ষের যুক্তি হলো, Google-এর একটি "সীমিত পরিসরের" ইনডেক্সিং পরিষেবা থেকে লার্জ ল্যাঙ্গুয়েজ মডেল (LLM) প্রশিক্ষণের ডেটা সোর্স হিসেবে পরিবর্তিত হওয়া মূল চুক্তিগুলোর লঙ্ঘন। তারা বলছে যে, Gemini-এর ট্রেনিং পাইপলাইনে সম্পূর্ণ কাজগুলো অন্তর্ভুক্ত করার জন্য প্রয়োজনীয় ব্যাপক অনুমতি কোম্পানিটি কখনোই সংগ্রহ করেনি।

Google এবং AI শিল্পের জন্য কী ঝুঁকির মুখে রয়েছে

যদি আদালত রায় দেয় যে লাইসেন্স ছাড়া কপিরাইটযুক্ত উপকরণ ব্যবহার করা কপিরাইট আইন লঙ্ঘন করে, তবে সেই সিদ্ধান্ত AI ডেভেলপাররা কীভাবে প্রশিক্ষণের ডেটা সংগ্রহ করবেন তা পুনর্গঠিত করতে পারে।

সম্ভাব্য প্রতিরক্ষা এবং পাল্টা যুক্তি

Google সম্ভবত "ফেয়ার ইউজ" (fair use) নীতির ওপর নির্ভর করবে, যা মন্তব্য, সমালোচনা বা রূপান্তরের জন্য কপিরাইটযুক্ত উপকরণের সীমিত ব্যবহারের অনুমতি দেয়। ক্যালিফোর্নিয়ার সাম্প্রতিক রায়গুলোতে AI প্রশিক্ষণকে একটি রূপান্তরমূলক কার্যক্রম হিসেবে গণ্য করা হয়েছে, যা একে ফেয়ার-ইউজ সুরক্ষা প্রদান করেছে। নিউ ইয়র্কের বাদীপক্ষ সেই নজিরগুলো এড়ানোর জন্য সেই এখতিয়ারের বাইরে মামলাটি দায়ের করেছে।

বাদীপক্ষ পাল্টা যুক্তি দিচ্ছে যে, কপিরাইট মেটাডেটা মুছে ফেলা উৎস গোপন করার অভিপ্রায় প্রকাশ করে, যা সরল বিশ্বাসে রূপান্তরের যেকোনো দাবিকে খর্ব করে। তারা Google-এর আইনি ঝুঁকি সম্পর্কে অবগত ছিল তার প্রমাণ হিসেবে অভ্যন্তরীণ মেমোটির কথাও উল্লেখ করেছে।

পরবর্তীতে কী নজর রাখা উচিত

মামলাটি প্রি-ট্রায়াল মোশন বা শুনানির মধ্য দিয়ে এগোবে যা উভয় পক্ষের যুক্তিগুলোকে প্রভাবিত করতে পারে, যার মধ্যে রয়েছে আদালত ক্যালিফোর্নিয়ায় ব্যবহৃত ফেয়ার-ইউজ বিশ্লেষণ প্রয়োগ করবে নাকি অন্য কোনো মানদণ্ড গ্রহণ করবে। এখতিয়ার সংক্রান্ত একটি রায় নির্ধারণ করতে পারে যে নিউ ইয়র্কের আদালতগুলো AI-সংক্রান্ত কপিরাইট বিরোধের প্রধান কেন্দ্র হবে কি না।

সারকথা: Google-এর Gemini-এর বিরুদ্ধে নিউ ইয়র্কের এই মামলা অনুমোদিত ডেটা ব্যবহার এবং কপিরাইট লঙ্ঘনের মধ্যে সীমারেখা নতুন করে নির্ধারণ করতে পারে, যা AI ডেভেলপারদের তাদের মডেল চালিত কাঁচামাল সংগ্রহের পদ্ধতি নিয়ে পুনরায় ভাবতে বাধ্য করবে এবং পুরো শিল্পের অর্থনীতিকে পুনর্গঠিত করবে।