Anthropic आता प्रत्येक Claude प्रतिसादात एक लपलेला सांख्यिकीय नमुना—SynthID-Text—समाविष्ट करत आहे. कंपनीचे म्हणणे आहे की ही पावले EU AI Act च्या Transparency Code चे पालन करतात आणि डेव्हलपर्सना एखादा मजकूर AI मॉडेलमधून आला आहे हे सिद्ध करण्याचा मार्ग देतात. हा वॉटरमार्क सामान्य संपादनानंतरही टिकून राहतो, परंतु मानवी वाचकांसाठी मजकुराच्या ओघात कोणताही बदल होत नाही.

वॉटरमार्क का जोडला जात आहे

युरोपियन नियामक संस्थांनी (regulators) large-language-model (LLM) प्रदात्यांवर AI-निर्मित मजकूर मानवी लेखनापासून वेगळा करता येईल असा करण्यासाठी दबाव आणला आहे. EU AI Act चा Transparency Code, जो लवकरच संपूर्ण युरोपमध्ये लागू होणार आहे, त्यानुसार डेव्हलपर्सना त्यांच्या मॉडेल्सद्वारे तयार केलेल्या कोणत्याही मजकुरासाठी एक विश्वसनीय शोध पद्धत (detection method) प्रदान करणे बंधनकारक आहे. Anthropic ने गेल्या वर्षी Google DeepMind ने प्रथम वर्णन केलेल्या SynthID-Text तंत्राचा अवलंब करून याचे उत्तर दिले आहे.

या निर्णयामुळे Reddit आणि X वर चर्चेला उधाण आले, जिथे वापरकर्त्यांना अशी भीती वाटली की वॉटरमार्कमुळे आउटपुटची गुणवत्ता घसरू शकते किंवा तो देखरेखीसाठी (surveillance) एक बॅकडोअर ठरू शकतो. Anthropic यावर असे प्रतिपादन करते की हा नमुना वाचकांना दिसत नाही, यामुळे विलंब (latency) वाढत नाही आणि खाजगी उपयोगासाठी (private deployments) तो बंद देखील करता येतो. तांत्रिक तपशील प्रकाशित करून, कंपनीला केवळ तर्कवितर्क शांत करण्याची आणि उद्योगासाठी एक मानक (benchmark) स्थापित करण्याची आशा आहे.

SynthID-Text कसे कार्य करते

पारंपारिक AI डिटेक्टर्स भाषिक वैशिष्ट्ये शोधतात—जसे की पुनरावृत्ती होणारी वाक्यरचना, विचित्र विरामचिन्हे किंवा मानवी लेखनापासूनचे सांख्यिकीय विचलन. एखादा माणूस परिच्छेद पुन्हा लिहिल्यावर हे संकेत लगेच नाहीसे होतात, ज्यामुळे हे डिटेक्टर्स अविश्वसनीय ठरतात. याउलट, SynthID-Text मॉडेलच्या token-selection टप्प्यादरम्यान एक गुप्त संकेत समाविष्ट करते.

जेव्हा Claude दोन समान संभाव्य टोकन्समध्ये निवड करते—समजा “overcast” विरुद्ध “grey”—तेव्हा सिस्टम त्या निर्णयाला एका पूर्व-संगणित बायनरी पॅटर्नशी जुळणाऱ्या टोकनकडे वळवते. संपूर्ण दस्तऐवजाच्या लांबीमध्ये, हे बदल (nudges) बिट्सचा असा एक क्रम तयार करतात जो नंतर डिटेक्शन API द्वारे काढला जाऊ शकतो. हा नमुना जाणीवपूर्वक कमी प्रभावाचा ठेवला आहे: निवडलेला समानार्थी शब्द अजूनही पूर्णपणे नैसर्गिक असतो, त्यामुळे मजकुराचा ओघ बदलत नाही. वॉटरमार्क पृष्ठभागावरील मजकुराऐवजी token stream मध्ये असल्याने, प्रत्येक टोकन बदलले जात नाही अशा बहुतेक प्रक्रियांतून तो सुरक्षित राहतो.

संपादनाप्रती प्रतिकार: काय टिकते आणि काय नाही

एक सामान्य टीका अशी आहे की वापरकर्ते वॉटरमार्क पुसण्यासाठी AI-निर्मित मजकूर सहजपणे संपादित करू शकतात. Anthropic च्या अंतर्गत चाचणीमध्ये तीन संपादकीय परिस्थितींचे वर्णन केले आहे:

  • Light editing – टायपिंगच्या चुका सुधारणे, काही विशेषणे बदलणे किंवा वाक्यांचा क्रम बदलणे. वॉटरमार्कची सांख्यिकीय स्वाक्षरी (statistical signature) मोठ्या प्रमाणात अखंड राहते कारण बहुतेक टोकन्स बदलले जात नाहीत.
  • Heavy Claude-assisted editing – आधीच AI-निर्मित वाक्ये असलेल्या मसुद्याला पुन्हा लिहिण्यासाठी Claude ला सूचना देणे. जर वापरकर्त्याने शब्दांवर नियंत्रण ठेवले, तर नवीन, मानवाने निवडलेल्या मजकुराच्या प्रमाणात वॉटरमार्कचा संकेत कमकुवत होतो.
  • Complete rewriting – प्रत्येक टोकन नवीन जनरेशनने किंवा मॅन्युअल पद्धतीने बदलणे. त्या वेळी मूळ वॉटरमार्क नष्ट होतो, परंतु तयार झालेला मजकूर आता EU च्या “AI-निर्मित” व्याख्येमध्ये बसत नाही कारण मूळ मॉडेल आउटपुटचा कोणताही अंश उरत नाही.

निष्कर्ष: वॉटरमार्क सामान्य पॉलिशिंगला (polishing) प्रतिकार करतो, परंतु मजकुराच्या पूर्ण पुनरुत्पादनाला (regeneration) नाही.

कोड जनरेशन: वॉटरमार्क कुठे असतो

Claude चा कोडिंग असिस्टंट म्हणून मोठ्या प्रमाणावर वापर केला जातो, जो एक-ओळीचे स्निपेट्सपासून ते फुल-स्टॅक मॉड्यूल्सपर्यंत सर्व काही तयार करतो. प्रोग्रामिंग भाषांमध्ये समानार्थी शब्दांच्या निवडीसाठी फारसा वाव नसतो; “for” ऐवजी “while” सारखे टोकन बदलल्यास लॉजिक बदलू शकते. त्यामुळे Anthropic ला अशी अपेक्षा आहे की वॉटरमार्क प्रामुख्याने अशा विभागांमध्ये दिसेल जिथे मॉडेलला शब्द निवडण्याचे स्वातंत्र्य आहे—जसे की कमेंट्स (comments), डॉकस्ट्रिंग्स (docstrings) आणि कोडसोबत असणारा स्पष्टीकरणात्मक मजकूर.

कोडचा कार्यात्मक भाग (functional part) न बदलल्यामुळे, डेव्हलपर्सना अचूकता किंवा कामगिरीमध्ये कोणतीही घट दिसून येणार नाही. वॉटरमार्कची उपस्थिती केवळ पूरक मजकुरापुरती मर्यादित आहे जो मानवांना कोड समजून घेण्यास मदत करतो, ज्यामुळे उपयुक्तता कमी न करता पारदर्शकतेची आवश्यकता पूर्ण होते.

उद्योगावरील परिणाम

Anthropic एकटाच हे पाऊल उचलत नाहीये. इतर अनेक LLM डेव्हलपर्सनी देखील त्याच Code of Practice वर स्वाक्षरी केली आहे, ज्यामध्ये प्रमाणित डिटेक्शन API ची मागणी केली आहे. जर EU ची अंमलबजावणीची कालमर्यादा नियोजनानुसार पुढे गेली, तर वॉटरमार्किंग हे LLM स्टॅक मधील एक डीफॉल्ट लेयर बनू शकते, जसे आज डेटा ट्रान्समिशनसाठी एन्क्रिप्शन असते. या आवश्यकतेकडे दुर्लक्ष करणाऱ्या कंपन्यांना दंड, युरोपमधील बाजारपेठेतील प्रवेश गमावणे किंवा त्यांच्या सेवा जबरदस्तीने काढून टाकण्याचा धोका आहे.

वादाचे मुद्दे

टीकाकारांचे असे म्हणणे आहे की, एक लपलेली स्वाक्षरी (hidden signature), जरी ती अदृश्य असली तरी, नियामक अनुपालनाच्या (regulatory compliance) पलीकडे ट्रॅकिंग किंवा एट्रिब्युशनसाठी वापरली जाऊ शकते. त्यांना 'फॉल्स पॉझिटिव्ह'ची (false positives) देखील भीती वाटते: एखादे डिटेक्शन API जर मानवी-लिखित मजकुराला चुकीच्या पद्धतीने लेबल करत असेल, तर त्या सिग्नलवर अवलंबून असलेल्या प्लॅटफॉर्मवरील विश्वास कमी होऊ शकतो. Anthropic या जोखमींची दखल घेते आणि असे सांगते की डिटेक्शन अल्गोरिदम ओपन-सोर्स असेल, ज्यामुळे स्वतंत्र ऑडिट आणि कॅलिब्रेशन करणे शक्य होईल.

वॉटरमार्क तयार करण्याचा संगणकीय भार (computational overhead) ही दुसरी एक व्यावहारिक चिंता आहे. Anthropic च्या अहवालानुसार, अतिरिक्त प्रक्रियेमुळे इन्फरन्स टाइममध्ये (inference time) एका टक्क्याच्याही कमी भाग वाढतो, या दाव्याची लवकरच तृतीय-पक्ष बेंचमार्कद्वारे चाचणी केली जाईल.

पुढे काय पाहावे

  • API रोलआउट – Anthropic कडून एक सार्वजनिक एंडपॉइंट (public endpoint) रिलीज करण्याची योजना आहे, जो कोणत्याही Claude आउटपुटमधून लपलेला बिट पॅटर्न (bit pattern) काढू शकेल. डेव्हलपर्स हे तपासणीचे तंत्र कंटेंट-मॉडरेशन पाइपलाइनमध्ये समाविष्ट करू शकतील.
  • प्रमाणीकरण प्रयत्न (Standardization efforts) – नियामक संस्था आणि उद्योग समूह वॉटरमार्क मेटाडेटासाठी एक सामान्य फॉरमॅट तयार करत आहेत, ज्यामुळे क्रॉस-मॉडेल डिटेक्शन सोपे होऊ शकते.
  • अनुभवजन्य अभ्यास (Empirical studies) – स्वतंत्र संशोधक ॲडव्हर्सरिअल रीरायटिंग टूल्सच्या (adversarial rewriting tools) विरुद्ध SynthID-Text च्या लवचिकतेची (resilience) तपासणी करण्यास सुरुवात करत आहेत. त्यांचे निष्कर्ष प्लॅटफॉर्म्स या सिग्नलवर किती विश्वास ठेवतील हे ठरवतील.

सारांश

Anthropic ने SynthID-Text चा स्वीकार केल्यामुळे AI समुदायाला Claude च्या आउटपुटची गुणवत्ता कायम ठेवत आगामी युरोपियन पारदर्शकता नियमांचे पालन करण्यासाठी एक ठोस साधन मिळाले आहे. हा वॉटरमार्क दैनंदिन प्रूफरीडिंगमध्ये टिकून राहतो, परंतु मजकूर पूर्णपणे पुन्हा तयार (regenerate) केल्यावर निघून जातो; तसेच, प्रोग्रामिंग आउटपुटमधील नॉन-कोड भागांमध्ये तो असतो, जिथे तो कार्यक्षमतेत अडथळा आणत नाही. हा दृष्टिकोन उद्योगाचा मानक (industry norm) बनेल की नाही, हे डिटेक्शन API प्रत्यक्ष परिस्थितीत किती चांगल्या प्रकारे काम करते आणि गोपनीयता व चुकीच्या सूचनांबाबतच्या (false alarms) चिंतांचे निराकरण करता येते की नाही यावर अवलंबून असेल.