Anthropic తన Claude మోడల్స్ ద్వారా ఉత్పత్తి చేయబడే ప్రతి టెక్స్ట్ మరియు ఫైల్లో ఒక రహస్య డిజిటల్ సంతకాన్ని (digital signature) పొందుపరుస్తుంది. యూరోపియన్ యూనియన్ యొక్క కొత్త AI పారదర్శకత నిబంధనలను (transparency rules) పాటించేందుకు ఈ చర్యను తీసుకుంది. ఆగస్టు 2న EU AI Act యొక్క Transparency Code అమలులోకి వచ్చిన తర్వాత విడుదల చేసిన అన్ని మోడల్స్కు ఈ మార్పు వర్తిస్తుంది. ఇది Claude యొక్క API, Code, Cowork మరియు Tag ఇంటర్ఫేస్లలో ఆటోమేటిక్గా కనిపిస్తుంది.
EU నిబంధన ఎందుకు ముఖ్యమైనది
AI ద్వారా సృష్టించబడిన లేదా సవరించబడిన కంటెంట్ను డెవలపర్లు గుర్తించేలా చేయడం Transparency Code యొక్క నిబంధన. దీనివల్ల తదుపరి వ్యవస్థలు (downstream systems) ఆ కంటెంట్ కృత్రిమమైనదని గుర్తించగలవు. తప్పుడు సమాచారాన్ని (misinformation) అరికట్టడం మరియు వినియోగదారులు యంత్రం ద్వారా సృష్టించబడిన సమాచారంతో వ్యవహరిస్తున్నప్పుడు వారికి స్పష్టమైన సంకేతాన్ని అందించడం ఈ నిబంధన యొక్క లక్ష్యం. Anthropic ప్రతిస్పందనగా—మోడల్-లెవల్ వాటర్మార్కింగ్ను (model-level watermarking) ప్రవేశపెట్టింది. ఇది కేవలం ప్రొడక్ట్ UIలో మాత్రమే కాకుండా, నేరుగా అవుట్పుట్లో మార్కర్ను పొందుపరుస్తుంది.
ఇతర AI దిగ్గజాలు కూడా ఇటువంటి వాగ్దానాలు చేస్తున్నాయి. Google, Meta, Microsoft, OpenAI మరియు Black Forest Labs అన్నీ EU ప్రమాణాలను పాటిస్తామని తెలిపాయి. టెక్స్ట్ కాని అసెట్స్ (non-text assets) కోసం, Anthropic C2PA ఓపెన్ స్టాండర్డ్ను ఉపయోగిస్తుంది. ఇది చిత్రాలు, వీడియోలు మరియు ఇతర మీడియాలో మూల సమాచారాన్ని (provenance data) పొందుపరచడానికి ఉపయోగించే బహిరంగంగా డాక్యుమెంట్ చేయబడిన పద్ధతి. ఒక ఓపెన్ స్పెసిఫికేషన్ను అనుసరించడం ద్వారా, జర్నలిస్టులు, ప్లాట్ఫారమ్లు మరియు ఫ్యాక్ట్-చెక్ చేసేవారు ఇప్పటికే ఉపయోగిస్తున్న సాధనాలతో (tools) తన మార్కింగ్లు కలిసి పనిచేస్తాయని Anthropic ఆశిస్తోంది.
వాటర్మార్క్ ఎలా పనిచేస్తుంది
వాటర్మార్క్ మోడల్ యొక్క టెక్స్ట్-జనరేషన్ ప్రక్రియలోనే అంతర్భాగంగా ఉంటుందని Anthropic చెబుతోంది. ఆచరణలో, మోడల్ విడుదల చేసే టోకెన్ స్ట్రీమ్ (token stream) లో ఈ సంతకం ఒక భాగంగా మారుతుంది. వినియోగదారుడు ఆ టెక్స్ట్ను వర్డ్ ప్రాసెసర్, ఈమెయిల్ లేదా సోషల్ మీడియా పోస్ట్లోకి కాపీ చేసినప్పుడు, ఆ రహస్య నమూనా (hidden pattern) దానితో పాటే వెళ్తుంది. స్వల్పంగా ఎడిట్ చేసినా వాటర్మార్క్ అలాగే ఉంటుందని కంపెనీ పేర్కొంది, కానీ ఆ గుర్తు కనిపించకుండా పోవాలంటే ఎన్ని అక్షరాలు మార్చాలో మాత్రం వెల్లడించలేదు.
“Claudefishing” ఆందోళన
లార్జ్ లాంగ్వేజ్ మోడల్స్ (LLMs) దుర్వినియోగంపై ఆందోళన పెరుగుతున్న తరుణంలో Anthropic ఈ కొత్త ఫీచర్ను విడుదల చేసింది. ఒక నిర్దిష్ట రచయిత శైలిని అనుకరిస్తూ, మోసపూరితమైన కంటెంట్ను సృష్టించడానికి AIని ఉపయోగించడాన్ని వివరించడానికి Substack CEO Chris Best ఇటీవల “Claudefishing” అనే పదాన్ని ఉపయోగించారు. కృత్రిమ టెక్స్ట్ను మానవ రచన నుండి వేరు చేయడం కష్టమవుతున్న కొద్దీ, మూలాలను (provenance) ఆటోమేటెడ్ పద్ధతిలో గుర్తించడం ఒక కీలకమైన రక్షణ కవచంగా మారుతుంది.
భద్రతా చర్యలను తీసుకువడంలో Anthropic ఒక్కటే కాదు. మ్యూజిక్-జనరేషన్ ప్లాట్ఫారమ్ Suno మరియు న్యూస్లెటర్ సర్వీస్ Substack కూడా ఏదైనా కంటెంట్ AI ద్వారా సృష్టించబడితే పాఠకులను హెచ్చరించే ఫ్లాగింగ్ మెకానిజమ్స్ను (flagging mechanisms) ప్రవేశపెట్టాయి. మూలంలోనే వాటర్మార్క్ను పొందుపరచడం ద్వారా, ఆ సంకేతాన్ని తొలగించడం కష్టతరం చేయాలని మరియు తదుపరి ఫిల్టర్లు (downstream filters) దానిని సులభంగా గుర్తించేలా చేయాలని Anthropic లక్ష్యంగా పెట్టుకుంది.
ముఖ్య అంశాలు
- నిబంధనల అమలు (Regulatory Compliance): ఆగస్టు 2 నుండి అమలులోకి వచ్చిన EU AI Act యొక్క Transparency Code నిబంధనలను పాటించడానికి Anthropic వాటర్మార్కింగ్ను అమలు చేస్తోంది.
- మోడల్-లెవల్ ఇంటిగ్రేషన్ (Model-Level Integration): వాటర్మార్క్లు మోడల్ స్థాయిలో వర్తి చేయబడతాయి, కాబట్టి అవి అన్ని ఉత్పత్తులలో (API, Claude Code, మొదలైనవి) నిలిచి ఉంటాయి మరియు కాపీ-పేస్ట్ చేసినా కూడా అలాగే ఉంటాయి.
- ప్రామాణీకరించబడిన ఫైల్ మార్కింగ్ (Standardized File Marking): ఫైల్ల కోసం, డిజిటల్ కంటెంట్లో పరస్పర అనుకూలత (interoperability) మరియు పారదర్శకతను నిర్ధారించడానికి Anthropic C2PA ఓపెన్ స్టాండర్డ్ను ఉపయోగిస్తుంది.
