Google খেলার নিয়ম বদলে দিয়েছে। আপনি যদি গত সপ্তাহে Google Lens-এর মাধ্যমে কোনো ছবি তোলেন, Google Translate-এ কোনো স্প্যানিশ বাক্য উচ্চস্বরে অনুশীলন করেন, অথবা Maps-কে দুপুরের খাবারের জায়গা খুঁজে দিতে বলেন, তবে সেই কন্টেন্টগুলো এখন কোম্পানির জেনারেটিভ AI মডেলগুলোকে প্রশিক্ষণ দেওয়ার জন্য একটি কিউতে (queue) থাকতে পারে। গুগল সম্প্রতি তার প্রাইভেসী আর্কিটেকচার পুনর্গঠন করেছে যাতে ব্যবহারকারীরা তাদের ইকোসিস্টেম জুড়ে যে ছবি, অডিও ক্লিপ এবং ভিডিও আপলোড করেন, সেগুলো সংরক্ষণ করা যায় এবং মেশিন লার্নিং সিস্টেম তৈরির কাজে ব্যবহার করা যায়। এটি পাবলিক ওয়েব পেজ স্ক্র্যাপ করার পরিবর্তে প্রতিদিন মানুষ Google প্রোডাক্টের সাথে যে সরাসরি এবং সুনির্দিষ্ট উদ্দেশ্যমূলক মিথস্ক্রিয়া করে, তা সংগ্রহ করার দিকে একটি সুপরিকল্পিত পরিবর্তন।
নিঃশব্দ নীতি পরিবর্তন
এটি কোনো সাধারণ 'terms-of-service' আপডেট নয়। বছরের পর বছর ধরে, বড় AI মডেলগুলোকে প্রশিক্ষিত করার প্রথাগত পদ্ধতি ছিল কোটি কোটি পাবলিক ওয়েবপেজ ক্রল করা এবং সেখান থেকে টেক্সট, ছবি ও লিঙ্ক সংগ্রহ করা যা ইতিমধ্যেই বিশ্বের কাছে দৃশ্যমান ছিল। সেই পদ্ধতির একটি সীমাবদ্ধতা রয়েছে। উন্মুক্ত ওয়েব (open web) সীমিত, এবং অনেক ক্ষেত্রে সবচেয়ে মূল্যবান পাবলিক ডেটা ইতিমধ্যেই সংগ্রহ করে বিদ্যমান সিস্টেমে অন্তর্ভুক্ত করা হয়েছে। Meta-র মতো প্রতিযোগীরা সম্প্রতি ইউজার-জেনারেটেড কন্টেন্ট ব্যবহারের দিকে ঝুঁকেছে এবং গুগল এখন একই পথে এগোচ্ছে।
গ্রাহকদের পাঠানো একটি ইমেলের মাধ্যমে এই আপডেটটি জানানো হয়েছে, যেখানে দুটি নতুন প্রাইভেসী কন্ট্রোল বা নিয়ন্ত্রণ ব্যবস্থা আনা হয়েছে: Search Services History এবং Personalized Recommendations। ওপরের দিকে দেখলে মনে হতে পারে এগুলো সাধারণ পার্সোনালাইজেশন টুল যা আপনার পরবর্তী সার্চ দ্রুত করতে বা আপনার রিকমেন্ডেশন উন্নত করতে সাহায্য করবে। তবে সূক্ষ্ম বিষয়গুলো পড়লে এর আসল পরিধি স্পষ্ট হয়ে ওঠে। গুগল জানিয়েছে যে, সংরক্ষিত মিডিয়া "AI মডেল এবং সুরক্ষা ব্যবস্থা সহ Google পরিষেবা এবং প্রযুক্তি উন্নত ও বিকাশে" ব্যবহার করা যেতে পারে। এর ভাষা অত্যন্ত ব্যাপক, ডিফল্ট সেটিংসটি 'অন' থাকে এবং এটি বন্ধ করতে হলে আপনাকে জানতে হবে কোথায় খুঁজতে হবে।
গুগল আসলে আপনার কাছ থেকে কী চায়
ডেটা সংগ্রহের এই পরিধি আপনার ব্যবহৃত প্রায় প্রতিটি প্রধান Google পরিষেবাকে অন্তর্ভুক্ত করে। একজন পর্যটক যখন কোনো বিদেশি রাস্তার সাইনবোর্ড বা ডিনার মেনুর দিকে Google Lens তাক করেন, তখন ফলাফল আসার পর সেই ভিজ্যুয়াল ইনপুটটি কেবল হারিয়ে যায় না। একজন শিক্ষার্থী যখন Google Translate ব্যবহার করে উচ্চস্বরে কথা বলার অনুশীলন করেন, তখন সেই সেশনের সময় রেকর্ড করা অডিওগুলো সংরক্ষণের জন্য যোগ্য বলে বিবেচিত হয়। Search Live বা সাধারণ ভয়েস সার্চের মাধ্যমে পাঠানো ভয়েস কুয়েরিগুলোও একই নীতির আওতায় পড়ে। এমনকি Maps, Shopping, Flights, Hotels এবং News-এর সাথে সাধারণ মিথস্ক্রিয়া থেকেও এমন মিডিয়া তৈরি হতে পারে যা গুগল এখন প্রশিক্ষণের উপকরণ হিসেবে শ্রেণীবদ্ধ করে।
আগে, যারা প্রাইভেসী নিয়ে সচেতন ছিলেন তারা Web & App Activity সুইচটি ব্যবহার করে গুগল কতটুকু ইন্টারঅ্যাকশন ডেটা সংগ্রহ করতে পারবে তা নিয়ন্ত্রণ করতে পারতেন। সেই কৌশলটি এখন আর কাজ করবে না। গুগল স্পষ্টভাবে এই নতুন সেটিংসগুলোকে Web & App Activity থেকে আলাদা করে দিয়েছে। Search Services History একটি স্বতন্ত্র নিয়ন্ত্রণ ব্যবস্থা। এটি ডিফল্টভাবে 'অন' থাকে এবং দুই বা তিন বছর আগে আপনার প্রাইভেসী ড্যাশবোর্ডে আপনি যা-ই সিদ্ধান্ত নিয়ে থাকুন না কেন, তা আপনার সার্চ-সংক্রান্ত মিডিয়া AI প্রশিক্ষণের জন্য সংরক্ষিত হওয়া বন্ধ করতে পারবে না। পুরনো 'অফ' সুইচটি এখন আর এই নির্দিষ্ট প্রক্রিয়াটি নিয়ন্ত্রণ করে না।
কীভাবে প্রকৃতপক্ষে অপ্ট-আউট করবেন
গুগল ম্যানুয়াল ওভাররাইড বা হাতে কলমে পরিবর্তনের সুযোগ দেয়, তবে এর পুরো দায়িত্ব আপনার ওপর। এক ক্লিকেই AI ট্রেনিং ডেটা সংগ্রহ বন্ধ করার মতো কোনো অ্যাকাউন্ট-ব্যাপী টগল বা সুইচ নেই। আপনাকে আপনার গুগল অ্যাকাউন্ট ড্যাশবোর্ডের দুটি নির্দিষ্ট পেজে যেতে হবে: Search Services History পেজ এবং Search Services Personalization পেজ।
একবার আপনি Search Services History-তে প্রবেশ করলে, "Save Media" চেক বক্সটি না পাওয়া পর্যন্ত স্ক্রল করুন। এটি আনচেক (uncheck) করে দিন। এই একটি মাত্র পদক্ষেপই ভবিষ্যতে ছবি, অডিও এবং ভিডিও সংরক্ষণ এবং মডেল প্রশিক্ষণে ব্যবহারের সম্ভাবনা রোধ করবে। মনে করবেন না যে Web & App Activity বন্ধ করলেই এই সমস্যার সমাধান হয়ে যাবে। তা হবে না। এই বিভাজনটি অত্যন্ত স্পষ্ট কিন্তু সহজে এড়িয়ে যাওয়ার মতো, যার মানে হলো অনেক ব্যবহারকারী মনে করবেন তারা অপ্ট-আউট করেছেন, অথচ আসলে তা হয়নি।
মিডিয়া সেভিং বন্ধ করার পর, একই ড্যাশবোর্ডে থাকা অবস্থায় আপনার অটো-ডিলিট (auto-delete) পছন্দগুলো কনফিগার করুন। গুগল তিনটি বিকল্প দেয়: ৩ মাস, ১৮ মাস বা ৩৬ মাস পর ডেটা মুছে ফেলা। আপনি যদি সবচেয়ে কঠোর নিয়ন্ত্রণ চান, তবে তিন মাসের সময়সীমা বেছে নিন। এটি গুগলের দেওয়া সবচেয়ে সংক্ষিপ্ত ক্লিনআপ সাইকেল এবং এটি আপনার পুরনো ইন্টারঅ্যাকশনগুলোর ব্যাকলগ সীমিত করে। মনে রাখবেন যে, 'Save Media' বন্ধ করলে কেবল ভবিষ্যৎ ডেটা সংগ্রহ বন্ধ হবে। আগের সেটিংস অনুযায়ী গুগল ইতিমধ্যে যা কিছু লগ করেছে, তা আপনার বিদ্যমান হিস্ট্রি ম্যানুয়ালি ডিলিট না করা পর্যন্ত স্টোরেজে থেকে যেতে পারে।
আপনি যদি একটি শেয়ার করা ফ্যামিলি অ্যাকাউন্ট বা এমন কোনো ওয়ার্কস্পেস পরিচালনা করেন যেখানে একাধিক ব্যক্তি Google পরিষেবা ব্যবহার করেন, তবে যাদের অ্যাক্সেস আছে তাদের প্রত্যেকের উচিত ব্যক্তিগতভাবে এই সেটিংসগুলো পরীক্ষা করা। পার্সোনালাইজেশন কন্ট্রোলগুলো অ্যাকাউন্টের সাথে যুক্ত, ডিভাইসের সাথে নয়, এবং ডিফল্ট অপ্ট-ইন (opt-in) নিয়মটি সবার জন্য প্রযোজ্য।
এটি AI-এর পরবর্তী পর্যায় সম্পর্কে আমাদের কী জানায়
এই নীতি পরিবর্তনটি শিল্পটি কোন দিকে যাচ্ছে সে সম্পর্কে একটি স্পষ্ট সংকেত। প্রশিক্ষণের উপাদানের জন্য পাবলিক ওয়েবকে ইতিমধ্যেই পুঙ্খানুপুঙ্খভাবে ব্যবহার করা হয়েছে। লার্জ ল্যাঙ্গুয়েজ মডেল (large language models) এবং মাল্টিমোডাল সিস্টেমগুলোর উন্নতির পরবর্তী ধাপ হলো ক্লোজড প্ল্যাটফর্মের ভেতরে বাস্তব মানুষের তৈরি করা প্রোপাইটারি ডেটা (proprietary data)। আপনার ভিজ্যুয়াল সার্চগুলোতে স্থানিক প্রেক্ষাপট (spatial context) থাকে। আপনার অনুবাদ অনুশীলনের সেশনগুলোতে উচ্চারণের ধরন এবং কথোপকথনের উদ্দেশ্য থাকে। আপনার ভয়েস কুয়েরিগুলোতে এমন সুর, শব্দচয়ন এবং জরুরি ভাব থাকে যা স্থির ওয়েব টেক্সট দিয়ে অনুকরণ করা সম্ভব নয়।
ডেভেলপার, প্রতিষ্ঠাতা এবং প্রতিযোগিতামূলক পরিস্থিতির ওপর নজর রাখা যে কারও জন্য এর তাৎপর্য অত্যন্ত স্পষ্ট। একটি লার্জ ল্যাঙ্গুয়েজ মডেলকে অন্যটি থেকে আলাদা করার জন্য যে "ডেটা মোট" (data moat) বা তথ্যের সুরক্ষা প্রাচীর প্রয়োজন, তা ক্রমশ একটি প্ল্যাটফর্মের নিজস্ব ব্যবহারকারীদের ব্যক্তিগত মিথস্ক্রিয়া এবং আপলোড করা ডেটা থেকে তৈরি করা হচ্ছে। ওপেন-সোর্স ওয়েব ক্রলগুলো এখনও কার্যকর, তবে বর্তমানে সবচেয়ে মূল্যবান ডেটা হলো সেই ধরনের তথ্য যা আপনি কোনো সার্ভিসে লগ-ইন থাকা অবস্থায় কোনো কাজ সম্পন্ন করার জন্য সক্রিয়ভাবে তৈরি করেন।
মূল কথা
আপনার পুরনো প্রাইভেসির নিয়মগুলো এখন সেকেলে হয়ে গেছে। Google-এর নতুন ট্রেনিং ডেটা ব্যবস্থার ক্ষেত্রে Search Services History-র ভেতরে 'Save Media' বক্সটি আনচেক করার মাধ্যমে একটি সুনির্দিষ্ট এবং সচেতনভাবে অপ্ট-আউট (opt-out) করা প্রয়োজন। এই পদক্ষেপটি এবং একটি সংক্ষিপ্ত অটো-ডিলিট উইন্ডো ব্যবহার করাই হলো আপনার আপলোড করা ছবি, অডিও এবং ভিডিওকে Google-এর AI ট্রেনিং পাইপলাইন থেকে দূরে রাখার একমাত্র নির্ভরযোগ্য উপায়। এটি অন্যদেরও জানান। ডিফল্ট সেটিংস এখন আর আপনার পক্ষে নেই।