Anthropic ने जागतिक स्तरावर Claude मॉडेलच्या सर्व आउटपुट्सवर वॉटरमार्क देण्याचे वचन देऊन AI पारदर्शकतेमध्ये एक मोठा बदल जाहीर केला आहे. EU AI Act Code of Practice द्वारे प्रेरित असलेल्या या पावलाचा उद्देश त्याच्या संपूर्ण उत्पादन परिसंस्थेमध्ये (product ecosystem) AI-व्युत्पन्न मजकूर आणि फाइल्ससाठी स्पष्ट उगम (provenance) प्रदान करणे हा आहे.
उगम आणि पारदर्शकतेसाठी जागतिक मानक
जरी हा आदेश EU AI Act कडून आला असला, तरी Anthropic हे संरक्षण केवळ युरोपियन वापरकर्त्यांपुरते मर्यादित ठेवत नाहीये. ऑगस्ट २०२६ पासून, सर्व नवीन Claude मॉडेल्समध्ये इन-बिल्ट लेबलिंग (built-in labeling) असेल. या रोलआउटमध्ये Claude API, Claude Code, Claude Cowork आणि Claude Tag सह संपूर्ण Claude सुईटचा समावेश असेल.
ही रणनीती ओळखीसाठी दुहेरी-स्तराचा (dual-layered) दृष्टिकोन वापरते. मजकुरासाठी, Anthropic मॉडेल स्तरावर लागू केलेला एक अदृश्य वॉटरमार्क कार्यान्वित करेल. हा वॉटरमार्क गैर-हस्तक्षेप करणारा (non-intrusive) असेल, जेणेकरून मजकुराचा अर्थ, गुणवत्ता आणि वाचनीयता अबाधित राहील. महत्त्वाचे म्हणजे, Anthropic चा दावा आहे की मजकूर कॉपी, पेस्ट किंवा किरकोळ संपादन केल्यानंतरही हे मार्क कायम राहू शकतात.
व्हिज्युअल आणि स्ट्रक्चर्ड डेटासाठी, Anthropic ओपन C2PA (Coalition for Content Provenance and Authenticity) मानकाचा वापर करेल. .svg, .png आणि .jpg सारख्या समर्थित फाईल फॉरमॅट्समध्ये डिजिटल स्वाक्षरी असलेले प्रोव्हेनन्स मेटाडेटा (provenance metadata) असेल. ही स्वाक्षरी एक पडताळण्यायोग्य रेकॉर्ड म्हणून काम करते की Claude ने ती फाईल प्रोसेस केली आहे आणि त्यानंतरच्या छेडछाडीचा (tampering) शोध घेण्यास मदत करू शकते.
तांत्रिक आव्हाने आणि शोधण्याच्या मर्यादा
मजबूत तांत्रिक आराखडा असूनही, Anthropic वॉटरमार्किंगच्या मर्यादांबाबत वास्तववादी भूमिका घेत आहे. शोधलेला वॉटरमार्क हा केवळ Claude ने मजकूर तयार केला आहे याचा पुरावा नाही; वापरकर्ते अनेकदा भाषांतर, सारांश किंवा प्रूफरीडिंग यांसारख्या दुय्यम कामांसाठी Claude चा वापर करतात, ज्यामुळे मानवी कल्पनेवरही वॉटरमार्क ट्रिगर होऊ शकतो.
याउलट, वॉटरमार्क नसणे म्हणजे तो मानवी लेखनाचा पुरावा आहेच, अशी खात्री देता येत नाही. खालील घटकांमुळे हे संकेत काढून टाकले जाऊ शकतात किंवा अस्पष्ट होऊ शकतात:
- मोठ्या प्रमाणावर मॅन्युअल संपादन किंवा व्यापक पुनरनुवाद.
- विश्वसनीय सांख्यिकीय शोध घेण्यासाठी खूप लहान मजकूर भाग.
- फॉरमॅट रूपांतरण दरम्यान किंवा स्क्रीनशॉटद्वारे मेटाडेटा काढून टाकणे.
यामुळे डेव्हलपर्ससाठी एक गुंतागुंतीची परिस्थिती निर्माण होते. जे लोक Claude ला थर्ड-पार्टी सेवांमध्ये समाविष्ट करत आहेत, त्यांनी EU AI Act च्या कोणत्या Article 50 च्या आवश्यकता त्यांच्या विशिष्ट अंमलबजावणीला लागू होतात, याचे काळजीपूर्वक मूल्यांकन केले पाहिजे.
व्यापक AI परिदृश्य: स्पर्धा आणि नैतिकता
Anthropic च्या या पावलामुळे सुरक्षितता आणि पारदर्शकतेच्या बाबतीत ते इतर उद्योग क्षेत्रातील दिग्गज कंपन्यांशी थेट स्पर्धेत आले आहे. Google DeepMind ने आधीच त्यांच्या Gemini मॉडेल्समध्ये SynthID सिस्टम समाविष्ट केली आहे, जी वॉटरमार्क एम्बेड करण्यासाठी टोकन प्रेडिक्शन प्रोबॅबिलिटीमध्ये बदल करते. दरम्यान, OpenAI ने फॉल्स पॉझिटिव्ह (false positives) आणि वापरकर्ते पुनरलेखनाद्वारे (rewriting) अशा साधनांना सहजपणे बगल देऊ शकतात, या चिंतेचे कारण देऊन स्वतःचे उच्च-अचूकता असलेले टेक्स्ट डिटेक्टर रिलीज करण्यास विलंब केला आहे.
शिक्षण क्षेत्रात याचे महत्त्व विशेषतः जास्त आहे. संस्थांना AI-सहाय्यित साहित्यिक चोरी (plagiarism) आणि आर्थिक मदतीतील फसवणुकीशी संबंधित "AI-चालित" घोटाळ्यांशी संघर्ष करावा लागत असल्याने, विश्वसनीय शोध घेण्याची गरज तातडीची आहे. तथापि, उद्योगाने या गरजेचा आणि खोट्या आरोपांच्या जोखमीचा समतोल राखणे आवश्यक आहे. थर्ड-पार्टीसाठी पडताळणी साधने रिलीज करून, Anthic उद्योगाला कंटेंट ऑथेंटिकेशनच्या प्रमाणित आणि पडताळण्यायोग्य पद्धतीकडे नेण्याचा प्रयत्न करत आहे.
मुख्य निष्कर्ष
- जागतिक अंमलबजावणी: Anthropic चे वॉटरमार्किंग केवळ EU मध्येच नाही, तर API सह जागतिक स्तरावर सर्व Claude उत्पादनांना लागू होईल.
- दुहेरी-पद्धतीचा दृष्टिकोन: कंपनी मजकुरासाठी अदृश्य वॉटरमार्क आणि इमेज फाइल्ससाठी (.png, .jpg, .svg) C2PA-मानक स्वाक्षरीकृत मेटाडेटा वापरणार आहे.
- टिकून राहणे विरुद्ध विश्वासार्हता: वॉटरमार्क कॉपी आणि किरकोळ संपादनानंतरही टिकून राहण्यासाठी डिझाइन केलेले असले तरी, ते पूर्णपणे अचूक नाहीत आणि मोठ्या प्रमाणावर रीफॉर्मॅटिंग किंवा भाषांतराद्वारे त्यांना बगल दिली जाऊ शकते.
