EU AI Act-ன் தேவையைப் பூர்த்தி செய்யும் வகையில், Claude மூலம் உருவாக்கப்பட்ட உரைகளுக்கு Anthropic ஒரு நீர் அடையாளத்தை (watermark) அறிமுகப்படுத்தியுள்ளது. செயற்கை முறையில் உருவாக்கப்பட்ட உள்ளடக்கங்கள் (synthetic content) இயந்திரங்களால் வாசிக்கக்கூடிய வகையில் (machine-readable) தெளிவாகக் குறிக்கப்பட வேண்டும் என்பது அந்தச் சட்டத்தின் நிபந்தனை. இந்தத் தொழில்நுட்பம், மாதிரியின் (model) வேகத்தைக் குறைக்காமலும் அல்லது கூடுதல் டோக்கன்களைப் (tokens) பயன்படுத்தாமலும் AI-ஆல் எழுதப்பட்ட உரைகளைக் கண்டறியும் என்று நிறுவனம் கூறுகிறது; இந்தத் தகவலை ஒழுங்குமுறை அமைப்புகளும் போட்டியாளர்களும் விரைவில் சோதித்துப் பார்ப்பார்கள்.

இந்த நீர் அடையாளம் ஏன் முக்கியமானது

இந்த நீர் அடையாளம், ஒரு ரகசியத் திறவுகோல் (private key) மற்றும் சூழலைப் பயன்படுத்தி வார்த்தைத் தேர்வுகளில் ஒரு குறிப்பிட்ட அமைப்பை உருவாக்குகிறது. வாசகர்களால் இந்த அமைப்பைக் காண முடியாது, ஆனால் அந்தத் திறவுகோலை அறிந்த ஒரு சரிபார்ப்பவரால் (verifier) இதைக் கண்டறிய முடியும். நடைமுறையில், ஒரு கருவி ஆவணத்தைப் பரிசோதித்து, அது Claude மூலம் உருவாக்கப்பட்டதா இல்லையா என்பதைத் தெரிவிக்கும்.

ஒழுங்குமுறை அழுத்தம்

EU AI Act, உருவாக்கத் திறன் கொண்ட அமைப்புகளை (generative systems) வழங்கும் நிறுவனங்கள், செயற்கை உள்ளடக்கத்தில் கண்டறியக்கூடிய சமிக்ஞைகளை (detectable signals) இணைக்கக் கட்டாயப்படுத்துகிறது.

வணிக ரீதியான சவால்கள்

இத்தகைய அடையாளங்களை ஏற்றுக்கொள்வதைப் பற்றி முடிவெடுக்கும்போது, நிறுவனங்கள் மூன்று முக்கியக் கவலைகளைக் கையாளுகின்றன:

  • கண்டறியும் திறன் வரம்புகள் (Traceability limits) – இந்த நீர் அடையாளம் உரை ஒரு AI மாதிரியிலிருந்து வந்ததை உறுதிப்படுத்துகிறது, ஆனால் அந்த வெளியீட்டை ஒரு குறிப்பிட்ட பயனர் அல்லது கணக்குடன் இணைக்க முடியாது. AI மூலம் உருவாக்கப்பட்ட உள்ளடக்கம் தவறாகப் பயன்படுத்தப்படும்போது, இந்த இடைவெளி பொறுப்புக்கூறலை (accountability) கேள்விக்குறியாக்குகிறது.
  • வருவாய் அபாயம் (Revenue risk) – சில நிறுவனங்கள், கண்ணுக்குத் தெரியும் நீர் அடையாளங்கள் தங்கள் வாடிக்கையாளர்களில் மூன்றில் ஒரு பகுதியினரைத் தள்ளிவிடும் என்று அஞ்சுகின்றன; ஏனெனில் போட்டி அல்லது தனியுரிமை காரணங்களுக்காக அவர்கள் அடையாளங்கள் இல்லாத உரைகளையே விரும்புகிறார்கள்.
  • தொழில்நுட்பக் கட்டுப்பாடுகள் (Technical constraints) – ஒரு குறிப்பிட்ட அமைப்பை இணைப்பது மாதிரியின் வெளியீட்டில் உள்ள படைப்பாற்றலைக் குறைக்கலாம், குறிப்பாக மிகச் சிறிய உரைகளில் நீர் அடையாளத்தைப் பயன்படுத்த வார்த்தைகள் குறைவாக இருக்கும்போது இது அதிகம் நிகழும். மேலும், பயனர்கள் உரையின் சில பகுதிகளைத் தாங்களாகவே மாற்றி அமைப்பதன் மூலம் (re-phrasing) அந்தச் சமிக்ஞையின் வலிமையைக் குறைத்து, கண்டறிவதைக் கடினமாக்க முடியும்.

Anthropic தனது அணுகுமுறை இந்தத் தீமைகளில் பெரும்பாலானவற்றைத் தவிர்க்கும் என்று நம்புகிறது. அந்தத் திறவுகோலை டோக்கன் தேர்வுச் செயல்பாட்டிலேயே (token-selection process) இணைப்பதன் மூலம், தாமதக் குறைபாடு (latency penalty) மற்றும் கூடுதல் டோக்கன் செலவு எதுவும் இருக்காது என்றும், பணம் செலுத்தும் வாடிக்கையாளர்கள் எதிர்பார்க்கும் பயனர் அனுபவத்தைப் பாதுகாக்கும் என்றும் நிறுவனம் கூறுகிறது.

தொழில்நுட்பச் சவால்கள்

கண்டறியும் திறன் என்பது, உருவாக்கும்போது பயன்படுத்தப்பட்ட அதே ரகசியத் திறவுகோல் சரிபார்ப்பவரிடம் இருக்கிறதா என்பதையே சார்ந்துள்ளது. குறுகிய உரைகள் இப்போதும் ஒரு பலவீனமான பகுதியாகவே உள்ளன, ஏனெனில் அவற்றில் புள்ளிவிவர அமைப்பு (statistical pattern) குறைவாகவே இருக்கும், இது தவறான எதிர்மறை விகிதங்களை (false-negative rates) அதிகரிக்கும். மேலும், இந்த நீர் அடையாளம் பிந்தைய மாற்றங்களைத் (downstream editing) தடுக்காது; ஒரு பயனர் பத்தியில் பாதியை மாற்றி எழுதினால், அந்த அடையாளத்தை எளிதாக அழித்துவிட முடியும்.

சுருக்கம்: Anthropic-ன் நீர் அடையாளம் ஒரு புதிய சட்டக் கட்டளையை நிறைவு செய்கிறது, ஆனால் அதன் தாக்கம், கண்டறியும் திறனுக்கும், குறைவான நெகிழ்வுத்தன்மை மற்றும் தவிர்க்கப்படும் அபாயத்திற்கும் இடையே அது எவ்வளவு சிறப்பாகச் சமநிலையைப் பேணுகிறது என்பதைப் பொறுத்தே அமையும்.