Anthropic अपने Claude मॉडल्स द्वारा तैयार किए गए टेक्स्ट और फ़ाइल के हर हिस्से में एक छिपा हुआ डिजिटल सिग्नेचर शामिल करेगा, यह कदम यूरोपीय संघ (EU) के नए AI पारदर्शिता नियमों को पूरा करने के लिए उठाया गया है। यह बदलाव 2 अगस्त को EU AI Act के Transparency Code के लागू होने के बाद रिलीज़ किए गए सभी मॉडल्स के लिए प्रभावी होगा, और यह Claude के API, Code, Cowork और Tag इंटरफेस पर स्वचालित रूप से दिखाई देगा।
EU नियम क्यों महत्वपूर्ण है
Transparency Code डेवलपर्स को AI-जनरेटेड या एडिट किए गए कंटेंट को मार्क करने के लिए बाध्य करता है ताकि डाउनस्ट्रीम सिस्टम इसके सिंथेटिक मूल (synthetic origin) को पहचान सकें। इस नियम का उद्देश्य गलत सूचनाओं पर लगाम लगाना और उपयोगकर्ताओं को स्पष्ट संकेत देना है जब वे मशीन द्वारा तैयार की गई सामग्री का सामना कर रहे हों। Anthropic की प्रतिक्रिया—मॉडल-लेवल वॉटरमार्किंग—मार्कर को किसी प्रोडक्ट UI में जोड़ने के बजाय सीधे आउटपुट में ही शामिल कर देती है।
अन्य AI दिग्गज भी इसी तरह के वादे कर रहे हैं। Google, Meta, Microsoft, OpenAI और Black Forest Labs ने सभी कहा है कि वे EU के मानकों को पूरा करेंगे। नॉन-टेक्स्ट एसेट्स के लिए, Anthropic C2PA ओपन स्टैंडर्ड का उपयोग करेगा, जो इमेज, वीडियो और अन्य मीडिया में प्रोवेनेंस डेटा (provenance data) को एम्बेड करने की एक सार्वजनिक रूप से प्रलेखित विधि है। एक ओपन स्पेसिफिकेशन का पालन करके, Anthropic को उम्मीद है कि उसके मार्क उन टूल्स के साथ काम करेंगे जिनका उपयोग पत्रकार, प्लेटफॉर्म और फैक्ट-चेकर्स पहले से ही कर रहे हैं।
वॉटरमार्क कैसे काम करता है
Anthropic का कहना है कि वॉटरमार्क मॉडल की टेक्स्ट-जनरेशन प्रक्रिया में ही समाहित होता है। व्यवहार में, यह सिग्नेचर उस टोकन स्ट्रीम का हिस्सा बन जाता है जिसे मॉडल उत्सर्जित करता है। जब कोई उपयोगकर्ता टेक्स्ट को वर्ड प्रोसेसर, ईमेल या सोशल-मीडिया पोस्ट में कॉपी करता है, तो वह छिपा हुआ पैटर्न भी उसके साथ चला जाता है। कंपनी ने उल्लेख किया है कि वॉटरमार्क मामूली एडिटिंग के बाद भी बना रह सकता है, लेकिन उसने यह खुलासा नहीं किया है कि मार्क के गायब होने से पहले कितने कैरेक्टर बदलना आवश्यक है।
“Claudefishing” की चिंता
Anthropic का यह रोलआउट ऐसे समय में आया है जब लार्ज लैंग्वेज मॉडल्स (LLMs) के दुरुपयोग को लेकर चिंता बढ़ रही है। Substack के CEO Chris Best ने हाल ही में "Claudefishing" शब्द गढ़ा है, जो AI का उपयोग करके ऐसा भ्रामक कंटेंट बनाने को दर्शाता है जो किसी विशेष लेखक की शैली की नकल करता है। जैसे-जैसे सिंथेटिक टेक्स्ट को मानवीय लेखन से अलग करना कठिन होता जा रहा है, प्रोवेनेंस का स्वचालित पता लगाना रक्षा की एक महत्वपूर्ण पंक्ति बन जाता है।
सुरक्षा उपाय जोड़ने में Anthropic अकेला नहीं है। म्यूजिक-जनरेशन प्लेटफॉर्म Suno और न्यूज़लेटर सेवा Substack ने फ्लैगिंग मैकेनिज्म पेश किए हैं जो पाठकों को सचेत करते हैं जब कोई सामग्री AI द्वारा बनाई गई होती है। वॉटरमार्क को स्रोत पर ही एम्बेड करके, Anthropic का लक्ष्य सिग्नल को हटाना कठिन बनाना और डाउनस्ट्रीम फिल्टर के लिए उस पर कार्रवाई करना आसान बनाना है।
मुख्य बातें
- नियामक अनुपालन (Regulatory Compliance): Anthropic EU AI Act के Transparency Code को पूरा करने के लिए वॉटरमार्किंग लागू कर रहा है, जो 2 अगस्त से प्रभावी हुआ है।
- मॉडल-लेवल इंटीग्रेशन: वॉटरमार्क मॉडल स्तर पर लागू किए जाते हैं, इसलिए वे सभी उत्पादों (API, Claude Code, आदि) में बने रहते हैं और कॉपी-पेस्ट करने पर भी नहीं हटते।
- मानकीकृत फ़ाइल मार्किंग: फ़ाइलों के लिए, Anthropic डिजिटल कंटेंट में इंटरऑपरेबिलिटी और पारदर्शिता सुनिश्चित करने के लिए C2PA ओपन स्टैंडर्ड का उपयोग करेगा।
