Anthropic نے AI شفافیت کو بڑھانے اور ابھرتی ہوئی ضوابط کی تعمیل کے لیے اپنے Claude ماڈل فیملی میں باضابطہ طور پر ٹیکسٹ واٹر مارکنگ کا نفاذ شروع کر دیا ہے۔ اگرچہ کمپنی ہموار انضمام کا وعدہ کرتی ہے، لیکن لسانی درستگی پر اثرات اور قابلِ شناخت AI تخلیق کاری کے قانونی اثرات کے حوالے سے ایک بڑھتی ہوئی بحث جنم لے رہی ہے۔

اسٹیلتھ واٹر مارکنگ کے طریقہ کار

Anthropic کا طریقہ کار Google DeepMind کی SynthID-Text میتھڈولوجی پر مبنی ہے۔ روایتی واٹر مارکنگ کے برعکس، جو شاید نظر آنے والے لیبل یا چھپے ہوئے Unicode حروف شامل کرے، یہ سسٹم Large Language Model (LLM) کی احتمالی سطح پر کام کرتا ہے۔ یہ ٹوکن کے انتخاب کے دوران استعمال ہونے والے رینڈم نیس (randomness) کے ذریعے باریک بینی سے تبدیلی کر کے کام کرتا ہے۔ مخصوص الفاظ کے انتخاب کے امکان کو ایڈجسٹ کر کے، یہ سسٹم ایک ایسا شماریاتی طور پر قابلِ شناخت پیٹرن تخلیق کرتا ہے جسے متن کی ظاہری شکل کو تبدیل کیے بغیر خصوصی سافٹ ویئر کے ذریعے پہچانا جا سکتا ہے۔

Anthropic کا دعویٰ ہے کہ اس عمل کا Claude کے آؤٹ پٹ کی تخلیقی صلاحیت یا پڑھنے کی صلاحیت پر کوئی قابلِ پیمائش اثر نہیں پڑتا۔ اعلیٰ درستگی والے ماحول میں خطرات کو کم کرنے کے لیے، کمپنی نوٹ کرتی ہے کہ حقائق سے بھرپور اقتباسات میں واٹر مارکنگ "کم" (sparser) ہوتی ہے جہاں ذخیرہ الفاظ معنی کے لحاظ سے محدود ہوتے ہیں۔

لسانی تنقید: درستگی بمقابلہ پیٹرننگ

Anthropic کے یقین دہانیوں کے باوجود، Daring Fireball کے John Gruber جیسے ممتاز ٹیک ناقدین کا کہنا ہے کہ "ناقابلِ محسوس" ہونے کا دعویٰ غلط ہے۔ اس بحث کا مرکز معنیاتی باریکی (semantic nuance) ہے: کوئی بھی دو مترادف الفاظ مکمل طور پر ایک دوسرے کی جگہ استعمال نہیں کیے جا سکتے۔ اگر واٹر مارکنگ الگورتھم شماریاتی پیٹرن کو برقرار رکھنے کے لیے کسی مخصوص ٹوکن کو ترجیح دیتا ہے، تو یہ واٹر مارک کے لیے شماریاتی طور پر "درست" لفظ کے حق میں زیادہ درست لفظ کو نظر انداز کر سکتا ہے۔

Gruber کا مشورہ ہے کہ اس سے متن کے معیار میں معمولی کمی آ سکتی ہے، اور وہ نوٹ کرتے ہیں کہ SynthID جیسے سسٹمز کی تصدیق کے لیے استعمال ہونے والے موجودہ پیمانے—جیسے صارفین کی "thumbs-up/down" ریٹنگز—ناکافی ہیں۔ ایک صارف کے لیے کسی ماڈل کو "overcast" کے بجائے "grey" منتخب کرنے پر سزا دینا مشکل ہے، چاہے دوسرا لفظ بہتر اسلوب کی گہرائی فراہم کرتا ہو، جس کا مطلب ہے کہ متن کا "معیار" ان طریقوں سے کم ہو سکتا ہے جنہیں معیاری بینچ مارکس پکڑنے میں ناکام رہتے ہیں۔

قانونی اثرات اور نشانات کی "چپکنے" والی نوعیت

یہ آغاز پیشہ ورانہ شعبوں، خاص طور پر قانون کے لیے اہم پیچیدگیاں پیدا کرتا ہے۔ Artificial Lawyer کے مطابق، اگرچہ زیادہ تر کلائنٹس AI کی مدد سے بے نیاز ہیں، لیکن AI کی شمولیت کو ثابت کرنے کی صلاحیت ان معاملات میں ایک ذمہ داری (liability) بن جاتی ہے جہاں جج یا کلائنٹ کی جانب سے AI کے استعمال کی واضح طور پر ممانعت ہو۔

ایک اہم تکنیکی چیلنج ان واٹر مارکس کا "مستقل رہنا" (persistence) ہے۔ چونکہ نشانات متن کے اندر ہی شامل ہوتے ہیں، اس لیے وہ دستاویزات میں پھیل سکتے ہیں۔ ایک انسان کے تیار کردہ معاہدے میں اگر AI سے تیار کردہ شق (clause) شامل ہو، تو وہ اس واٹر مارک کو آگے لے جائے گا، جس سے ممکنہ طور پر مستقبل کے ٹیمپلیٹس متاثر ہو سکتے ہیں۔ مزید برآں، چونکہ قانونی پیشہ ور افراد متعدد LLMs استعمال کرتے ہیں، اس لیے دستاویزات میں آخر کار مختلف فراہم کنندگان کے ہم آہنگ (overlapping) واٹر مارکس شامل ہو سکتے ہیں، جو شفافیت کے آڈٹ کے لیے ایک فارنزک ڈراونا خواب بن سکتا ہے۔

تعمیل اور بچاؤ کے حربے

یہ اقدام زیادہ تر EU AI Act کی تعمیل کی ضرورت کے تحت کیا گیا ہے، اگرچہ Anthropic علاقائی تقسیم سے بچنے کے لیے اس فیچر کو عالمی سطح پر لاگو کر رہا ہے۔ 2 اگست کے بعد ریلیز کیے گئے تمام Claude ماڈلز پہلے ہی واٹر مارکنگ کو سپورٹ کرتے ہیں، جبکہ پرانے ماڈلز کو بھی اس کے لیے تیار کرنے کا منصوبہ ہے۔ تاہم، سسٹم کی تاثیر اب بھی متنازع ہے؛ Declaude جیسے ٹولز کا استعمال پہلے ہی پیرافریزنگ (paraphrasing) کے ذریعے ان نشانات کو ہٹانے کے لیے کیا جا رہا ہے، جو یہ ظاہر کرتا ہے کہ اگرچہ واٹر مارکنگ ریگولیٹرز کو مطمئن کر سکتی ہے، لیکن یہ جان بوجھ کر کیے جانے والے بچاؤ کے حربوں کو روکنے میں مشکل محسوس کر سکتی ہے۔

اہم نکات

  • احتمالی شناخت (Probabilistic Detection): Anthropic ایک SynthID طرز کا طریقہ استعمال کرتا ہے جو نظر آنے والے حروف شامل کرنے کے بجائے ٹوکن کے انتخاب کی رینڈم نیس کو تبدیل کرتا ہے، جس سے واٹر مارک شماریاتی طور پر قابلِ شناخت لیکن بصری طور پر پوشیدہ رہتا ہے۔
  • معیار کے حوالے سے سمجھوتہ: ناقدین کا کہنا ہے کہ واٹر مارک پیٹرن کو برقرار رکھنے کے لیے مخصوص الفاظ کے انتخاب پر مجبور کرنا بنیادی طور پر معنیاتی درستگی اور اسلوب کی باریکیوں کی قربانی دیتا ہے۔
  • قانونی ذمہ داری: واٹر مارکس کی "چپکنے" والی نوعیت کا مطلب ہے کہ AI سے تیار کردہ متن مستقبل کی دستاویزات میں قابلِ شناخت پیٹرن لے جا سکتا ہے، جس سے قانون دانوں اور انتہائی ریگولیٹڈ صنعتوں کے لیے شفافیت کے خطرات پیدا ہوتے ہیں۔