Anthropic-ന്റെ ഏറ്റവും പുതിയ Claude മോഡലുകൾ നിർമ്മിക്കപ്പെടുന്ന ഓരോ ടെക്സ്റ്റിലും ഒരു അദൃശ്യ വാട്ടർമാർക്ക് (invisible watermark) ഉൾപ്പെടുത്തുന്നു. ഓഗസ്റ്റ് 2-ന് പുതുക്കിയ ഡോക്യുമെന്റേഷനിലൂടെ പ്രഖ്യാപിച്ച ഈ മാറ്റം, വാക്കുകളുടെ തിരഞ്ഞെടുപ്പിലും വാചക ഘടനയിലും നേരിട്ട് ഒരു സ്റ്റാറ്റിസ്റ്റിക്കൽ സിഗ്നൽ (statistical signal) ഉൾപ്പെടുത്തുന്നു—ഇതൊരു ദൃശ്യമായ ടാഗോ മെറ്റാഡാറ്റാ ഫീൽഡോ അല്ല.

എന്താണ് ഈ വാട്ടർമാർക്ക്

ഭാഷയിൽ തന്നെ ഇഴചേർക്കപ്പെട്ട സൂക്ഷ്മമായ ഒരു പാറ്റേൺ ആണ് ഈ വാട്ടർമാർക്ക്. ചില പര്യായപദങ്ങൾ (synonyms), ചിഹ്നങ്ങളുടെ ഉപയോഗം (punctuation), അല്ലെങ്കിൽ വാചകങ്ങളുടെ താളം എന്നിവയിലേക്ക് മോഡലിനെ നയിക്കുന്നതിലൂടെ, സാധാരണ കോപ്പി-പേസ്റ്റ് ചെയ്യലുകളിലും ചെറിയ എഡിറ്റിംഗുകളിലും പോലും മായാതെ നിൽക്കുന്ന ഒരു ഫിംഗർപ്രിന്റ് Anthropic നിർമ്മിക്കുന്നു. വലിയ തോതിലുള്ള പുനർരചന (heavy rewriting), ഒന്നിലധികം തവണയുള്ള വിവർത്തനം, അല്ലെങ്കിൽ മനുഷ്യർ എഴുതിയ വലിയൊരു ഭാഗവുമായി ഇത് കൂട്ടിച്ചേർക്കുക എന്നിവയിലൂടെ മാത്രമേ ഈ സിഗ്നൽ ഇല്ലാതാക്കാൻ കഴിയൂ.

വാട്ടർമാർക്ക് ടെക്സ്റ്റിനുള്ളിൽ തന്നെ ഉള്ളതുകൊണ്ട്, ആ ഉള്ളടക്കം എവിടെപ്പോയാലും അത് കൂടെയുണ്ടാകും—അത് Claude.ai വെബ് UI വഴിയായാലും, API, Claude Code, അല്ലെങ്കിൽ Anthropic മോഡലുകളെ ആശ്രയിക്കുന്ന AWS അല്ലെങ്കിൽ Google Cloud എന്നിവയിലെ ഉപയോഗങ്ങളിലായാലും.

എഡിറ്റിംഗിനെ ഇത് എങ്ങനെ അതിജീവിക്കുന്നു

സാധാരണയായി മനുഷ്യർ ചെയ്യുന്ന പ്രൂഫ് റീഡിംഗ് (proofreading), ടോൺ ക്രമീകരിക്കുക, അല്ലെങ്കിൽ ചില വാക്കുകൾക്ക് പകരം പര്യായപദങ്ങൾ ഉപയോഗിക്കുക തുടങ്ങിയ കാര്യങ്ങൾ വാട്ടർമാർക്കിനെ ഇല്ലാതാക്കില്ല. ഇത്തരം ചെറിയ മാറ്റങ്ങൾ "സിഗ്നലിനെ നീക്കം ചെയ്യില്ല" എന്ന് Anthropic-ന്റെ ഡോക്യുമെന്റേഷൻ പറയുന്നു, അതായത് ഒരു റിവ്യൂവർ പരിശോധനയ്ക്ക് ശേഷം മാറ്റം വരുത്തിയാലും ആ ഔട്ട്പുട്ട് Claude നിർമ്മിച്ചതാണെന്ന് തിരിച്ചറിയാൻ സാധിക്കും.

കൂടുതൽ ശക്തമായ മാറ്റങ്ങൾ ഈ പാറ്റേണിനെ തകർക്കും:

  • വാചകങ്ങൾ ആദ്യം മുതൽ തന്നെ പുതിയ രീതിയിൽ എഴുതുക
  • ടെക്സ്റ്റ് മറ്റൊരു ഭാഷയിലേക്ക് വിവർത്തനം ചെയ്യുകയും വീണ്ടും പഴയ ഭാഷയിലേക്ക് കൊണ്ടുവരികയും ചെയ്യുക
  • മനുഷ്യർ എഴുതിയ വലിയ ഭാഗങ്ങൾ ഉൾപ്പെടുത്തുക

ഇത്തരം പ്രവർത്തനങ്ങൾ സമയമോ അധ്വാനമോ ആവശ്യപ്പെടുന്നു, കൂടാതെ അവ യഥാർത്ഥ ഔട്ട്പുട്ടിന്റെ ഗുണനിലവാരത്തെയോ ഉദ്ദേശത്തെയോ ബാധിച്ചേക്കാം.

ഡെവലപ്പർമാരുടെ പ്രവർത്തനരീതിയിലുള്ള സ്വാധീനം

ഔട്ട്‌ലൈനുകൾ തയ്യാറാക്കാനോ, കോഡ് കമന്റുകൾ എഴുതാനോ, മാർക്കറ്റിംഗ് കോപ്പി തയ്യാറാക്കാനോ Claude-നെ ആശ്രയിക്കുന്ന ഡെവലപ്പർമാർ ഇപ്പോൾ ഒരു പുതിയ നിയമപരമായ വെല്ലുവിളി നേരിടുന്നു. AI നിർമ്മിച്ച ഉള്ളടക്കത്തിന് സുതാര്യത ഉറപ്പാക്കാൻ നിർദ്ദേശിക്കുന്ന EU AI Act ആണ് Anthropic-ന്റെ ഈ നീക്കത്തിന് നിയമപരമായ പശ്ചാത്തലം നൽകുന്നത്, ഇത് വാട്ടർമാർക്കിനെ ഒരു നിയന്ത്രണ സുരക്ഷാ സംവിധാനമാക്കി മാറ്റുന്നു.

ഇതിനെ നേരിടാൻ മൂന്ന് തന്ത്രങ്ങൾ രൂപപ്പെട്ടിട്ടുണ്ട്:

  1. Translation chains – വാട്ടർമാർക്കിനെ മായ്ച്ചുകളയാൻ Claude ഔട്ട്പുട്ട് ഒന്നിലധികം ഭാഷകളിലൂടെ വിവർത്തനം ചെയ്യുക. ഈ രീതിക്ക് കൂടുതൽ സമയമെടുക്കും കൂടാതെ വിവർത്തന പിശകുകൾ വരാനും സാധ്യതയുണ്ട്.
  2. Manual retyping – ഒളിഞ്ഞിരിക്കുന്ന പാറ്റേൺ ഇല്ലാതാക്കാൻ ടെക്സ്റ്റ് കൈകൊണ്ട് ടൈപ്പ് ചെയ്യുക. ഇത് ഫലപ്രദമാണെങ്കിലും വലിയ അളവിലുള്ള ഉള്ളടക്കത്തിന് ഇത് പ്രായോഗികമല്ല.
  3. Full rewriting – ആശയങ്ങൾക്കോ ഘടനയ്ക്കോ വേണ്ടി Claude ഉപയോഗിക്കുക, തുടർന്ന് ഓരോ വാചകവും സ്വയം എഴുതുക. ഇത് സർഗ്ഗാത്മകത നിലനിർത്തുന്നതോടൊപ്പം തന്നെ അന്തിമ ടെക്സ്റ്റിൽ വാട്ടർമാർക്ക് ഇല്ലെന്ന് ഉറപ്പാക്കുകയും ചെയ്യുന്നു. കൂടുതൽ എഴുതേണ്ടി വരുമെങ്കിലും ഡെവലപ്പർമാർ ഇതിനെയാണ് ഏറ്റവും പ്രായോഗികമായ രീതിയായി കാണുന്നത്.

ഓരോ രീതിയും വേഗത, ചിലവ്, ഒറിജിനൽ ഔട്ട്പുട്ടിനോടുള്ള വിശ്വസ്തത എന്നിവയിൽ വിട്ടുവീഴ്ചകൾ ആവശ്യപ്പെടുന്നു.

ഫാൽസ് പോസിറ്റീവുകളും കണ്ടെത്തലിലെ പ്രതിസന്ധിയും

വാട്ടർമാർക്കിന്റെ സ്റ്റാറ്റിസ്റ്റിക്കൽ സ്വഭാവം യഥാർത്ഥ മനുഷ്യ എഴുത്തുകളുമായി സാമ്യമുള്ളതാകാം എന്നത് ഒരു ആശങ്കയാണ്. Claude പൊതുവായി ലഭ്യമായ ടെക്സ്റ്റുകളിൽ നിന്നാണ് പഠിക്കുന്നത്, അതിനാൽ അതിന്റെ ശൈലി ചിലപ്പോൾ മനുഷ്യരുടെ ശൈലിയോട് സാമ്യമുള്ളതാകാം. വാട്ടർമാർക്ക് കണ്ടെത്താനുള്ള ടൂളുകൾ മനുഷ്യർ എഴുതിയ കാര്യങ്ങളെ AI നിർമ്മിച്ചതാണെന്ന് തെറ്റായി അടയാളപ്പെടുത്തിയേക്കാം—ഇത് അനാവശ്യമായ നിയമപരമായ പരിശോധനകൾക്ക് കാരണമായേക്കാവുന്ന ഒരു 'ഫാൽസ് പോസിറ്റീവ്' ആണ്.

Anthropic സ്വന്തമായി ഒരു ഡിറ്റക്ഷൻ ടൂൾ വികസിപ്പിക്കുന്നുണ്ടെങ്കിലും അത് ഇതുവരെ പുറത്തിറങ്ങിയിട്ടില്ല. ഒരു പരിശോധനാ സംവിധാനമില്ലാതെ, തങ്ങൾ ഉപയോഗിക്കുന്ന രീതി വാട്ടർമാർക്ക് നീക്കം ചെയ്യുന്നുണ്ടോ അതോ തങ്ങളുടെ ഉള്ളടക്കം തെറ്റായി അടയാളപ്പെടുത്തപ്പെടുമോ എന്ന് ഡെവലപ്പർമാർക്ക് പരിശോധിക്കാൻ കഴിയില്ല.

ഇനി ശ്രദ്ധിക്കേണ്ട കാര്യങ്ങൾ

  • Anthropic-ന്റെ ഡിറ്റക്ടർ പുറത്തിറങ്ങുന്നത് – ഇത് ലഭ്യമായാൽ, ടീമുകൾക്ക് അവരുടെ പ്രവർത്തനരീതികളെ ഔദ്യോഗിക മാനദണ്ഡങ്ങളുമായി താരതമ്യം ചെയ്യാൻ സാധിക്കും.

ചുരുക്കത്തിൽ

Anthropic-ന്റെ അദൃശ്യ വാട്ടർമാർക്ക് "നിർമ്മിക്കുക-പ്രസിദ്ധീകരിക്കുക" (generate-and-publish) എന്ന രീതിയിൽ നിന്ന് "നിർമ്മിക്കുക-പരിശോധിക്കുക" (generate-and-scrutinize) എന്ന രീതിയിലേക്കുള്ള മാറ്റത്തിന് നിർബന്ധമാക്കുന്നു. AI എഴുതിയതാണെന്ന അടയാളപ്പെടുത്തലുകളിൽ നിന്ന് ഒഴിവാകാൻ വിവർത്തന രീതികളിലോ, മാനുവൽ ടൈപ്പിംഗിലോ, അല്ലെങ്കിൽ പൂർണ്ണമായ പുനർരചനയിലോ നിക്ഷേപിക്കണോ എന്ന് ഡെവലപ്പർമാർ തീരുമാനിക്കേണ്ടതുണ്ട്. അതോടൊപ്പം തന്നെ, മനുഷ്യർ എഴുതിയ കാര്യങ്ങൾ യന്ത്രം നിർമ്മിച്ചതാണെന്ന് തെറ്റായി അടയാളപ്പെടുത്തുന്ന ഫാൽസ് പോസിറ്റീവുകളുടെ അപകടസാധ്യതയും അവർ നേരിടേണ്ടി വരും.