گوگل نے کھیل کے اصول بدل دیے ہیں۔ اگر آپ نے گزشتہ ہفتے Google Lens کے ذریعے کوئی تصویر کھینچی، Google Translate میں بلند آواز میں کوئی ہسپانوی جملہ دہرایا، یا Maps سے لنچ کی جگہ تلاش کرنے کو کہا، تو وہ مواد اب کمپنی کے جنریٹو AI ماڈلز کو تربیت دینے کے لیے ایک قطار میں ہو سکتا ہے۔ گوگل نے حال ہی میں اپنے پرائیویسی ڈھانچے کی ایسی تنظیم کی ہے کہ اس کے ایکوسسٹم میں صارفین کے اپ لوڈ کردہ امیجز، آڈیو کلپس اور ویڈیوز کو محفوظ کیا جا سکے اور مشین لرننگ سسٹمز بنانے کے لیے استعمال کیا جا سکے۔ یہ عوامی ویب صفحات کو اسکریپ کرنے کے بجائے لوگوں کے گوگل مصنوعات کے ساتھ روزانہ کے براہ راست اور اعلیٰ مقصد والے تعاملات (interactions) سے ڈیٹا حاصل کرنے کی طرف ایک دانستہ تبدیلی ہے۔

خاموش پالیسی تبدیلی

یہ سروس کی شرائط میں کوئی معمول کی اپ ڈیٹ نہیں ہے۔ برسوں تک، بڑے AI ماڈلز کی تربیت کے لیے معیاری طریقہ کار میں اربوں عوامی ویب صفحات کو کرال کرنا، متن، تصاویر اور لنکس جمع کرنا شامل تھا جو پہلے سے ہی دنیا کے سامنے موجود تھے۔ اس طریقے کی حدود ہیں۔ اوپن ویب محدود ہے، اور بہت سے شعبوں میں سب سے قیمتی عوامی ڈیٹا پہلے ہی نکالا جا چکا ہے اور موجودہ سسٹمز میں شامل کیا جا چکا ہے۔ Meta جیسے حریفوں نے حال ہی میں صارف کے تیار کردہ مواد (user-generated content) کے استعمال کی طرف قدم بڑھایا ہے، اور گوگل اب اسی سمت میں بڑھ رہا ہے۔

یہ اپ ڈیٹ صارفین تک ایک ای میل کے ذریعے پہنچی جس میں دو نئے پرائیویسی کنٹرولز متعارف کرائے گئے: Search Services History اور Personalized Recommendations۔ بظاہر، یہ معیاری پرسنلائزیشن ٹولز معلوم ہوتے ہیں جن کا مقصد آپ کی اگلی تلاش کو تیز کرنا یا آپ کی سفارشات کو بہتر بنانا ہے۔ تاہم، اگر آپ باریک بینی سے پڑھیں تو اس کا دائرہ کار واضح ہو جاتا ہے۔ گوگل کا کہنا ہے کہ محفوظ شدہ میڈیا کو "گوگل کی خدمات اور ٹیکنالوجیز کو تیار کرنے اور بہتر بنانے کے لیے استعمال کیا جا سکتا ہے، بشمول AI ماڈلز اور حفاظتی اقدامات۔" الفاظ کا چناؤ وسیع ہے، ڈیفالٹ سیٹنگ آن ہے، اور اس سے الگ ہونے (opt out) کے لیے آپ کو یہ جاننا ہوگا کہ کہاں دیکھنا ہے۔

گوگل اصل میں آپ سے کیا چاہتا ہے

ڈیٹا اکٹھا کرنے کا یہ دائرہ کار تقریباً ہر بڑی گوگل سروس پر محیط ہے جسے آپ استعمال کرتے ہیں۔ جب کوئی سیاح Google Lens کو کسی غیر ملکی اسٹریٹ سائن یا ڈنر مینو پر کرتا ہے، تو نتائج ظاہر ہونے کے بعد بصری ان پٹ (visual input) محض غائب نہیں ہو جاتا۔ جب کوئی طالب علم بلند آواز میں بولنے کی مشق کرنے کے لیے Google Translate استعمال کرتا ہے، تو ان سیشنز کے دوران ریکارڈ کی گئی آڈیو ریکارڈنگز کو محفوظ کرنے کے لیے استعمال کیا جا سکتا ہے۔ Search Live یا معیاری وائس سرچ کے ذریعے بھیجی گئی آواز کے سوالات بھی اسی پالیسی کے تحت آتے ہیں۔ یہاں تک کہ Maps، Shopping، Flights، Hotels اور News کے ساتھ معمول کے تعاملات بھی ایسا میڈیا تیار کر سکتے ہیں جسے گوگل اب ٹریننگ مواد کے طور پر درجہ بندی کرتا ہے۔

پہلے، وہ صارفین جو پرائیویسی کے بارے میں سنجیدہ تھے، وہ گوگل کے پاس اس تعامل کے ڈیٹا کو محدود کرنے کے لیے Web & App Activity سوئچ پر بھروسہ کر سکتے تھے۔ وہ حکمت عملی اب کام نہیں کرتی۔ گوگل نے واضح طور پر ان نئی سیٹنگز کو Web & App Activity سے الگ کر دیا ہے۔ Search Services History ایک آزاد کنٹرول ہے۔ یہ ڈیفالٹ طور پر آن ہے، اور دو یا تین سال پہلے آپ نے اپنے پرائیویسی ڈیش بورڈ میں جو بھی انتخاب کیے ہوں گے، وہ آپ کے سرچ سے متعلق میڈیا کو AI ٹریننگ کے لیے محفوظ کرنے سے نہیں روک سکیں گے۔ پرانا آف سوئچ اب اس مخصوص سرکٹ کو کنٹرول نہیں کرتا۔

اصل میں آپشن آؤٹ کیسے کریں

گوگل دستی طور پر اسے روکنے کا طریقہ فراہم کرتا ہے، لیکن اس کی تمام تر ذمہ داری آپ پر ہے۔ ایسا کوئی اکاؤنٹ کے پیمانے پر ٹوگل (toggle) نہیں ہے جو ایک کلک میں AI ٹریننگ ڈیٹا اکٹھا کرنے کو غیر فعال کر دے۔ آپ کو اپنے گوگل اکاؤنٹ ڈیش بورڈ کے اندر دو مخصوص صفحات پر جانا ہوگا: Search Services History کا صفحہ اور Search Services Personalization کا صفحہ۔

جب آپ Search Services History کے اندر ہوں، تو اس وقت تک نیچے اسکرول کریں جب تک آپ کو "Save Media" کا چیک باکس نہ مل جائے۔ اسے ان چیک (uncheck) کر دیں۔ یہی وہ واحد عمل ہے جو مستقبل کی تصاویر، آڈیو اور ویڈیو کو محفوظ ہونے اور ممکنہ طور پر ماڈل ٹریننگ میں شامل ہونے سے روکتا ہے۔ یہ فرض نہ کریں کہ Web & App Activity کو غیر فعال کرنے سے یہ کام ہو جائے گا۔ ایسا نہیں ہوگا۔ اسے الگ کرنا واضح ہے لیکن اسے نظر انداز کرنا آسان ہے، جس کا مطلب ہے کہ بہت سے صارفین یہ سمجھیں گے کہ انہوں نے آپشن آؤٹ کر لیا ہے جبکہ انہوں نے نہیں کیا ہوگا۔

میڈیا سیونگ کو غیر فعال کرنے کے بعد، جب آپ اسی ڈیش بورڈ میں ہوں تو اپنی آٹو ڈیلیٹ ترجیحات ترتیب دیں۔ گوگل تین انتخاب پیش کرتا ہے: 3 ماہ، 18 ماہ، یا 36 ماہ کے بعد ڈیٹا حذف کریں۔ اگر آپ سب سے زیادہ کنٹرول چاہتے ہیں، تو تین ماہ کا وقفہ منتخب کریں۔ یہ وہ مختصر ترین صفائی کا چکر ہے جو گوگل اس کنٹرول کے ذریعے فراہم کرتا ہے، اور یہ آپ کے تاریخی تعاملات کے بیک لاگ کو محدود کرتا ہے۔ یاد رکھیں کہ Save Media کو بند کرنے سے مستقبل میں ڈیٹا کا حصول رک جاتا ہے۔ گوگل نے پچھلی سیٹنگز کے تحت پہلے ہی جو کچھ بھی لاگ کیا ہے، وہ اسٹوریج میں رہ سکتا ہے جب تک کہ آپ خود اسی اکاؤنٹ ٹولز کے ذریعے اپنی موجودہ ہسٹری کو دستی طور پر حذف نہ کر دیں۔

اگر آپ کوئی مشترکہ فیملی اکاؤنٹ یا ایسا ورک اسپیس مینیج کرتے ہیں جہاں متعدد لوگ Google کی سروسز استعمال کرتے ہیں، تو رسائی رکھنے والے ہر فرد کو ان سیٹنگز کو انفرادی طور پر چیک کرنا چاہیے۔ پرسنلائزیشن کنٹرولز اکاؤنٹ سے منسلک ہوتے ہیں، نہ کہ ڈیوائس سے، اور ڈیفالٹ آپٹ ان (opt-in) تمام جگہوں پر لاگو ہوتا ہے۔

یہ ہمیں AI کے اگلے مرحلے کے بارے میں کیا بتاتا ہے

پالیسی میں یہ تبدیلی اس بات کا واضح اشارہ ہے کہ صنعت کس سمت میں جا رہی ہے۔ ٹریننگ مواد کے لیے عوامی ویب (public web) کا بھرپور استعمال کیا جا چکا ہے۔ لارج لینگویج ماڈلز (large language models) اور ملٹی موڈل سسٹم (multimodal systems) کو بہتر بنانے کے لیے اگلی سرحد وہ پراپرائٹری ڈیٹا (proprietary data) ہے جو بند پلیٹ فارمز کے اندر حقیقی لوگوں کے ذریعے تیار کیا جاتا ہے۔ آپ کی بصری تلاش (visual searches) میں مکانی سیاق و سباق (spatial context) شامل ہوتا ہے۔ آپ کے ترجمے کی مشق کے سیشنز میں تلفظ کے انداز اور بات چیت کا مقصد شامل ہوتا ہے۔ آپ کی آواز سے کی جانے والی پوچھ گچھ (voice queries) میں وہ لہجہ، جملہ سازی اور عجلت شامل ہوتی ہے جسے ساکن ویب متن (static web text) نقل نہیں کر سکتا۔

ڈویلپرز، بانیوں (founders) اور مسابقتی منظرنامے پر نظر رکھنے والے کسی بھی شخص کے لیے اس کا مطلب بالکل واضح ہے۔ وہ "data moat" جو ایک لارج لینگویج ماڈل کو دوسرے سے الگ کرتا ہے، تیزی سے کسی پلیٹ فارم کے اپنے صارفین کے نجی تعاملات اور اپ لوڈز سے حاصل کیا جا رہا ہے۔ اوپن سورس ویب کرولز (open-source web crawls) اب بھی مفید ہیں، لیکن سب سے زیادہ قیمتی ڈیٹا وہ ہے جو آپ کسی سروس میں لاگ ان رہتے ہوئے اور فعال طور پر کوئی کام کرنے کی کوشش کے دوران تخلیق کرتے ہیں۔

خلاصہ

آپ کا پرانا پرائیویسی پلان (privacy playbook) اب پرانا ہو چکا ہے۔ Google کے ٹریننگ ڈیٹا کے نئے نظام کے لیے Search Services History کے اندر 'Save Media' باکس کو ان چیک (uncheck) کر کے ایک مخصوص اور دانستہ طور پر آپٹ آؤٹ (opt-out) کرنا ضروری ہے۔ یہ عمل، ایک مختصر آٹو ڈیلیٹ ونڈو (auto-delete window) کے ساتھ مل کر، آپ کی اپ لوڈ کردہ تصاویر، آڈیو اور ویڈیو کو Google کے AI ٹریننگ پائپ لائن سے دور رکھنے کا واحد قابل اعتماد طریقہ ہے۔ اسے آگے پہنچائیں۔ اب ڈیفالٹ سیٹنگز آپ کے حق میں نہیں ہیں۔