ഗൂഗിൾ കളിയുടെ നിയമങ്ങൾ മാറ്റി. കഴിഞ്ഞ ആഴ്ച നിങ്ങൾ Google Lens ഉപയോഗിച്ച് ഒരു ഫോട്ടോ എടുത്തതോ, Google Translate ഉപയോഗിച്ച് ഒരു സ്പാനിഷ് വാചകം ഉച്ചത്തിൽ പറഞ്ഞു പരിശീലിച്ചതോ, അല്ലെങ്കിൽ ഒരു ഉച്ചഭക്ഷണ സ്ഥലം കണ്ടെത്താൻ Maps-നോട് ആവശ്യപ്പെട്ടതോ ആണെങ്കിൽ, ആ ഉള്ളടക്കം ഇപ്പോൾ കമ്പനിയുടെ ജനറേറ്റീവ് AI മോഡലുകളെ പരിശീലിപ്പിക്കുന്നതിനായി ഒരു ക്യൂവിൽ ഇരിക്കാൻ സാധ്യതയുണ്ട്. ഉപയോക്താക്കൾ അതിന്റെ ഇക്കോസിസ്റ്റത്തിലൂടെ അപ്‌ലോഡ് ചെയ്യുന്ന ചിത്രങ്ങൾ, ഓഡിയോ ക്ലിപ്പുകൾ, വീഡിയോകൾ എന്നിവ സൂക്ഷിച്ചുവെക്കാനും മെഷീൻ ലേണിംഗ് സിസ്റ്റങ്ങൾ നിർമ്മിക്കാൻ ഉപയോഗിക്കാനും പാകത്തിൽ ഗൂഗിൾ അടുത്തിടെ അതിന്റെ പ്രൈവസി ആർക്കിടെക്ചർ പുനഃക്രമീകരിച്ചു. പൊതുവായ വെബ് പേജുകൾ സ്ക്രാപ്പ് ചെയ്യുന്നതിൽ നിന്ന് മാറി, ആളുകൾ ഓരോ ദിവസവും ഗൂഗിൾ ഉൽപ്പന്നങ്ങളുമായി നടത്തുന്ന നേരിട്ടുള്ളതും ഉയർന്ന ലക്ഷ്യബോധമുള്ളതുമായ (high-intent) ഇടപെടലുകൾ ശേഖരിക്കുന്നതിലേക്കുള്ള ബോധപൂർവ്വമായ ഒരു മാറ്റമാണിത്.

നിശബ്ദമായ പോളിസി മാറ്റം

ഇതൊരു സാധാരണ സേവന നിബന്ധനകളിലെ (terms-of-service) മാറ്റമല്ല. വർഷങ്ങളായി, വലിയ AI മോഡലുകളെ പരിശീലിപ്പിക്കുന്നതിനുള്ള സാധാരണ രീതി എന്നത് കോടിക്കണക്കിന് പൊതു വെബ് പേജുകൾ പരിശോധിക്കുകയും ലോകത്തിന് മുന്നിൽ നേരത്തെ തന്നെ ലഭ്യമായ ടെക്സ്റ്റ്, ചിത്രങ്ങൾ, ലിങ്കുകൾ എന്നിവ ശേഖരിക്കുകയും ചെയ്യുക എന്നതായിരുന്നു. ആ രീതിക്ക് പരിധികളുണ്ട്. തുറന്ന വെബ് (open web) പരിമിതമാണ്, കൂടാതെ പല മേഖലകളിലും ഏറ്റവും മൂല്യമുള്ള പൊതു ഡാറ്റ ഇതിനകം തന്നെ വേർതിരിച്ചെടുത്ത് നിലവിലുള്ള സിസ്റ്റങ്ങളിൽ ഉൾപ്പെടുത്തിയിട്ടുണ്ട്. Meta പോലുള്ള എതിരാളികൾ അടുത്തിടെ ഉപയോക്താക്കൾ നിർമ്മിക്കുന്ന ഉള്ളടക്കം (user-generated content) ഉപയോഗിക്കുന്നതിലേക്ക് ശ്രദ്ധ കേന്ദ്രീകരിച്ചപ്പോൾ, ഗൂഗിളും ഇപ്പോൾ അതേ ദിശയിലേക്ക് നീങ്ങുകയാണ്.

രണ്ട് പുതിയ പ്രൈവസി കൺട്രോളുകൾ അവതരിപ്പിച്ചുകൊണ്ടുള്ള ഒരു ഇമെയിൽ വഴിയാണ് ഈ മാറ്റം ഉപയോക്താക്കളിലെത്തിയത്: Search Services History, Personalized Recommendations. പുറമെ നിന്ന് നോക്കുമ്പോൾ, നിങ്ങളുടെ അടുത്ത തിരയൽ വേഗത്തിലാക്കാനോ നിർദ്ദേശങ്ങൾ മെച്ചപ്പെടുത്താനോ ഉള്ള സാധാരണ പേഴ്സണലൈസേഷൻ ടൂളുകളായാണ് ഇവ തോന്നുന്നത്. എങ്കിലും, സൂക്ഷ്മമായി പരിശോധിച്ചാൽ ഇതിന്റെ വ്യാപ്തി വ്യക്തമാകും. സേവ് ചെയ്ത മീഡിയ ഉപയോഗിച്ച് "AI മോഡലുകളും സുരക്ഷാ സംവിധാനങ്ങളും ഉൾപ്പെടെയുള്ള ഗൂഗിൾ സേവനങ്ങളും സാങ്കേതികവിദ്യകളും വികസിപ്പിക്കാനും മെച്ചപ്പെടുത്താനും" കഴിയുമെന്ന് ഗൂഗിൾ പ്രസ്താവിക്കുന്നു. ഇതിലെ പദപ്രയോഗങ്ങൾ വളരെ വിപുലമാണ്, ഡിഫോൾട്ട് സെറ്റിംഗ് 'ഓൺ' ആണ്, കൂടാതെ ഇത് ഓഫ് ചെയ്യാൻ എവിടെ നോക്കണമെന്ന് നിങ്ങൾ തന്നെ കണ്ടെത്തേണ്ടതുണ്ട്.

ഗൂഗിൾ യഥാർത്ഥത്തിൽ നിങ്ങളിൽ നിന്ന് എന്താണ് ആഗ്രഹിക്കുന്നത്

ഡാറ്റ ശേഖരണത്തിന്റെ ഈ പരിധി നിങ്ങൾ ഉപയോഗിക്കുന്ന മിക്കവാറും എല്ലാ പ്രധാന ഗൂഗിൾ സേവനങ്ങളെയും ഉൾക്കൊള്ളുന്നു. ഒരു വിനോദസഞ്ചാരി വിദേശത്തെ ഒരു തെരുവുബോർഡിലേക്കോ ഭക്ഷണ മെനുവിലേക്കോ Google Lens തിരിക്കുമ്പോൾ, ഫലങ്ങൾ കാണിച്ചതിന് ശേഷം ആ വിഷ്വൽ ഇൻപുട്ട് വെറുതെ അപ്രത്യക്ഷമാകുന്നില്ല. ഒരു വിദ്യാർത്ഥി സംസാരിക്കാൻ പരിശീലിക്കാൻ Google Translate ഉപയോഗിക്കുമ്പോൾ, ആ സെഷനുകളിൽ പകർത്തിയ ഓഡിയോ റെക്കോർഡിംഗുകൾ സൂക്ഷിച്ചുവെക്കാൻ അർഹമാണ്. Search Live വഴിയോ സാധാരണ വോയ്‌സ് സെർച്ച് വഴിയോ അയക്കുന്ന വോയ്‌സ് ക്വറികൾ ഇതേ പോളിസിക്ക് കീഴിലാണ് വരുന്നത്. Maps, Shopping, Flights, Hotels, News എന്നിവയുമായുള്ള പതിവ് ഇടപെടലുകൾ പോലും ഗൂഗിൾ ഇപ്പോൾ പരിശീലന സാമഗ്രിയായി (training material) തരംതിരിക്കുന്ന മീഡിയ നിർമ്മിച്ചേക്കാം.

മുമ്പ്, പ്രൈവസിയുടെ കാര്യത്തിൽ ഗൗരവമുള്ള ഉപയോക്താക്കൾക്ക് ഈ ഇടപെടൽ ഡാറ്റ എത്രത്തോളം ഗൂഗിൾ കൈവശം വെക്കണം എന്ന് നിയന്ത്രിക്കാൻ Web & App Activity സ്വിച്ച് ഉപയോഗിക്കാമായിരുന്നു. ആ തന്ത്രം ഇപ്പോൾ ഫലിക്കില്ല. ഗൂഗിൾ ഈ പുതിയ സെറ്റിംഗുകളെ Web & App Activity-യിൽ നിന്ന് വ്യക്തമായി വേർതിരിച്ചിരിക്കുന്നു. Search Services History എന്നത് ഒരു സ്വതന്ത്ര നിയന്ത്രണമാണ്. ഇത് ഡിഫോൾട്ട് ആയി ഓൺ ആണ്, കൂടാതെ രണ്ട് മൂന്ന് വർഷങ്ങൾക്ക് മുമ്പ് നിങ്ങളുടെ പ്രൈവസി ഡാഷ്‌ബോർഡിൽ നിങ്ങൾ എന്ത് തീരുമാനമെടുത്താലും, നിങ്ങളുടെ സെർച്ച് സംബന്ധമായ മീഡിയ AI പരിശീലനത്തിനായി സംഭരിക്കപ്പെടുന്നത് തടയാൻ കഴിയില്ല. പഴയ ഓഫ് സ്വിച്ച് ഇനി ഈ പ്രത്യേക സർക്യൂട്ടിനെ നിയന്ത്രിക്കുന്നില്ല.

എങ്ങനെ യഥാർത്ഥത്തിൽ ഇതിൽ നിന്ന് ഒഴിവാകാം

ഗൂഗിൾ ഒരു മാനുവൽ ഓവർറൈഡ് നൽകുന്നുണ്ടെങ്കിലും, അതിന്റെ ഉത്തരവാദിത്തം പൂർണ്ണമായും നിങ്ങളുടേതാണ്. AI പരിശീലന ഡാറ്റ ശേഖരണം ഒറ്റ ക്ലിക്കിൽ നിർത്തലാക്കാൻ അക്കൗണ്ട് മുഴുവൻ ബാധകമായ ഒരു ടോഗിൾ ഇല്ല. നിങ്ങളുടെ ഗൂഗിൾ അക്കൗണ്ട് ഡാഷ്‌ബോർഡിലെ രണ്ട് പ്രത്യേക പേജുകൾ സന്ദർശിക്കേണ്ടതുണ്ട്: Search Services History പേജും Search Services Personalization പേജും.

Search Services History-യിൽ എത്തിയ ശേഷം, "Save Media" ചെക്ക്ബോക്സ് കാണുന്നത് വരെ താഴേക്ക് സ്ക്രോൾ ചെയ്യുക. അത് അൺചെക്ക് ചെയ്യുക. ഭാവിയിലെ ചിത്രങ്ങൾ, ഓഡിയോ, വീഡിയോ എന്നിവ സംഭരിക്കപ്പെടുന്നതും മോഡൽ പരിശീലനത്തിനായി ഉപയോഗിക്കപ്പെടുന്നതും തടയുന്ന ഏക നടപടി ഇതാണ്. Web & App Activity ഓഫ് ചെയ്യുന്നത് ഇതിന് പരിഹാരമാകുമെന്ന് കരുതരുത്. അത് ഫലിക്കില്ല. ഇവ തമ്മിലുള്ള വേർതിരിവ് വളരെ വ്യക്തമാണ്, എന്നാൽ അത് ശ്രദ്ധിക്കാതെ പോകാനും സാധ്യതയുണ്ട്. ഇതിനർത്ഥം പല ഉപയോക്താക്കളും തങ്ങൾ ഇതിൽ നിന്ന് ഒഴിവാകിയെന്ന് വിശ്വസിക്കുന്നുണ്ടെങ്കിലും യഥാർത്ഥത്തിൽ അങ്ങനെ ആയിരിക്കില്ല എന്നാണ്.

മീഡിയ സേവിംഗ് ഓഫ് ചെയ്ത ശേഷം, അതേ ഡാഷ്‌ബോർഡിൽ ഇരിക്കുമ്പോൾ തന്നെ നിങ്ങളുടെ ഓട്ടോ-ഡിലീറ്റ് മുൻഗണനകൾ ക്രമീകരിക്കുക. ഗൂഗിൾ മൂന്ന് ഓപ്ഷനുകൾ നൽകുന്നു: 3 മാസം, 18 മാസം അല്ലെങ്കിൽ 36 മാസത്തിന് ശേഷം ഡാറ്റ ഡിലീറ്റ് ചെയ്യുക. നിങ്ങൾക്ക് ഏറ്റവും കർശനമായ നിയന്ത്രണം വേണമെങ്കിൽ, മൂന്ന് മാസത്തെ കാലാവധി തിരഞ്ഞെടുക്കുക. ഗൂഗിൾ അനുവദിക്കുന്ന ഏറ്റവും കുറഞ്ഞ ക്ലീനപ്പ് സൈക്കിളാണിത്, ഇത് നിങ്ങളുടെ പഴയ ഇടപെടലുകളുടെ ശേഖരം പരിമിതപ്പെടുത്തുന്നു. Save Media ഓഫ് ചെയ്യുന്നത് ഭാവിയിലെ ശേഖരണം മാത്രമേ തടയുകയുള്ളൂ എന്ന് ഓർക്കുക. മുൻപത്തെ സെറ്റിംഗുകൾ പ്രകാരം ഗൂഗിൾ ഇതിനകം തന്നെ രേഖപ്പെടുത്തിയവ, നിങ്ങൾ അക്കൗണ്ട് ടൂളുകൾ ഉപയോഗിച്ച് നിലവിലുള്ള ഹിസ്റ്ററി മാനുവലായി ഡിലീറ്റ് ചെയ്യാത്തിടത്തോളം കാലം സ്റ്റോറേജിൽ തന്നെ തുടരാം.

നിങ്ങൾ ഒരു പങ്കിട്ട ഫാമിലി അക്കൗണ്ടോ അല്ലെങ്കിൽ ഒന്നിലധികം ആളുകൾ Google സേവനങ്ങൾ ഉപയോഗിക്കുന്ന ഒരു വർക്ക്സ്പേസോ ആണ് കൈകാര്യം ചെയ്യുന്നതെങ്കിൽ, ആക്‌സസ് ഉള്ള എല്ലാവരും ഈ ക്രമീകരണങ്ങൾ വ്യക്തിഗതമായി പരിശോധിക്കേണ്ടതുണ്ട്. പേഴ്സണലൈസേഷൻ കൺട്രോളുകൾ അക്കൗണ്ടുമായി ബന്ധപ്പെട്ടതാണ്, ഉപകരണവുമാല്ല; കൂടാതെ ഡിഫോൾട്ട് ഓപ്റ്റ്-ഇൻ (opt-in) എല്ലാത്തിനും ബാധകമാണ്.

ഇത് AI-യുടെ അടുത്ത ഘട്ടത്തെക്കുറിച്ച് നമ്മോട് പറയുന്നത്

ഈ പോളിസി മാറ്റം വ്യവസായം എങ്ങോട്ടാണ് നീങ്ങുന്നത് എന്നതിനെക്കുറിച്ചുള്ള വ്യക്തമായ സൂചനയാണ്. ട്രെയിനിംഗ് മെറ്റീരിയലുകൾക്കായി പബ്ലിക് വെബ് പൂർണ്ണമായും ഉപയോഗിക്കപ്പെട്ടു കഴിഞ്ഞു. ലാർജ് ലാംഗ്വേജ് മോഡലുകളും (large language models) മൾട്ടിമോഡൽ സിസ്റ്റങ്ങളും മെച്ചപ്പെടുത്തുന്നതിനുള്ള അടുത്ത ഘട്ടം, ക്ലോസ്ഡ് പ്ലാറ്റ്‌ഫോമുകൾക്കുള്ളിലെ യഥാർത്ഥ ആളുകൾ നിർമ്മിക്കുന്ന പ്രൊപ്രൈറ്ററി ഡാറ്റയാണ് (proprietary data). നിങ്ങളുടെ വിഷ്വൽ സെർച്ചുകളിൽ സ്പേഷ്യൽ കോൺടെക്സ്റ്റ് (spatial context) അടങ്ങിയിരിക്കുന്നു. നിങ്ങളുടെ വിവർത്തന പരിശീലന സെഷനുകളിൽ ഉച്ചാരണ രീതികളും സംഭാഷണ ഉദ്ദേശ്യങ്ങളും അടങ്ങിയിരിക്കുന്നു. നിങ്ങളുടെ വോയ്‌സ് ക്വറികളിൽ സ്റ്റാറ്റിക് വെബ് ടെക്സ്റ്റുകൾക്ക് പകർത്താൻ കഴിയാത്ത ടോണും ശൈലിയും അടിയന്തര സ്വഭാവവും അടങ്ങിയിരിക്കുന്നു.

ഡെവലപ്പർമാർക്കും സ്ഥാപകർക്കും മത്സരസാഹചര്യം നിരീക്ഷിക്കുന്ന മറ്റെല്ലാവർക്കും ഇതിന്റെ അർത്ഥം ലളിതമാണ്. ഒരു ലാർജ് ലാംഗ്വേജ് മോഡലിനെ മറ്റൊന്നിൽ നിന്ന് വേർതിരിക്കുന്ന "ഡാറ്റാ മോട്ടും" (data moat) ഒരു പ്ലാറ്റ്‌ഫോമിലെ ഉപയോക്താക്കളുടെ സ്വകാര്യ ഇടപെടലുകളിൽ നിന്നും അപ്‌ലോഡുകളിൽ നിന്നുമാണ് കൂടുതൽ നിർമ്മിക്കപ്പെടുന്നത്. ഓപ്പൺ സോഴ്‌സ് വെബ് ക്രോളുകൾ ഇപ്പോഴും ഉപയോഗപ്രദമാണ്, എന്നാൽ ഏറ്റവും മൂല്യമുള്ള ഡാറ്റ എന്നത് നിങ്ങൾ ഒരു സർവീസിൽ ലോഗിൻ ചെയ്ത് എന്തെങ്കിലും കാര്യങ്ങൾ ചെയ്യാൻ ശ്രമിക്കുമ്പോൾ സൃഷ്ടിക്കുന്ന ഡാറ്റയാണ്.

ചുരുക്കത്തിൽ

നിങ്ങളുടെ പഴയ പ്രൈവസി രീതികൾ ഇപ്പോൾ കാലഹരണപ്പെട്ടു. Google-ന്റെ പുതിയ ട്രെയിനിംഗ് ഡാറ്റാ രീതി അനുസരിച്ച്, Search Services History-യിൽ 'Save Media' ബോക്സ് അൺചെക്ക് ചെയ്തുകൊണ്ട് കൃത്യമായ ഒരു ഓപ്റ്റ്-ഔട്ട് (opt-out) ചെയ്യേണ്ടതുണ്ട്. അപ്‌ലോഡ് ചെയ്ത ചിത്രങ്ങളും ഓഡിയോയും വീഡിയോയും Google-ന്റെ AI ട്രെയിനിംഗ് പൈപ്പ്‌ലൈനിൽ നിന്ന് ഒഴിവാക്കാനുള്ള ഏക വിശ്വസനീയമായ മാർഗ്ഗം ആ നടപടിയും അതോടൊപ്പം കൃത്യമായ ഒരു ഓട്ടോ-ഡിലീറ്റ് വിൻഡോയും (auto-delete window) ക്രമീകരിക്കുന്നതുമാണ്. ഇത് മറ്റുള്ളവരിലേക്കും എത്തിക്കുക. ഡിഫോൾട്ട് ക്രമീകരണങ്ങൾ ഇനി നിങ്ങളുടെ താൽപ്പര്യത്തിനനുസരിച്ചല്ല.