Anthropic نے اپنے Fable 5 ماڈل میں ایک اہم اپ ڈیٹ نافذ کی ہے، جس سے اس کے حفاظتی تہوں (safety layers) کے ذریعے بلاک ہونے والے غیر نقصان دہ حیاتیاتی سوالات کی تعداد میں نمایاں کمی آئی ہے۔ اس تزویراتی تبدیلی کا مقصد اعلیٰ خطرے والے حیاتیاتی خطرات کے خلاف سخت حفاظتی اقدامات برقرار رکھتے ہوئے جائز سائنسی تحقیق کے لیے افادیت کو بحال کرنا ہے۔
سائنسی تحقیق کے لیے رکاوٹوں میں کمی
سائنسی برادری کی جانب سے ہونے والی تنقید کے نتیجے میں اٹھائے گئے قدم کے تحت، Anthropic نے Fable 5 کے حیاتیاتی حفاظتی فلٹرز میں غلط مثبت (false positives) نتائج میں تقریباً 85 فیصد کمی کی ہے۔ اس سے قبل، ماڈل کا حفاظتی کلاسیفائر ضرورت سے زیادہ سخت تھا، جو اکثر جائز سائنسی پوچھ گچھ کو بلاک کر دیتا تھا اور صارفین کو کم صلاحیت والے Opus 5 ماڈل کی طرف موڑ دیتا تھا۔
یہ اپ ڈیٹ محققین اور طبی پیشہ ور افراد کو مختلف غیر نقصان دہ کاموں کے لیے Fable 5 کی مکمل استدلال کی صلاحیتوں سے فائدہ اٹھانے کی اجازت دیتی ہے۔ صارفین اب لیبارٹری کے نتائج کی تشریح، طبی علامات کا تجزیہ، اور پیچیدہ طبی سوالات کے جوابات دینے جیسے مشکل کام بغیر کسی ایسی "حفاظتی دیوار" (safety wall) سے ٹکرائے انجام دے سکتے ہیں جو پہلے پیداواری صلاحیت میں رکاوٹ بنتی تھی۔
دوہرے استعمال کے خطرات پر حفاظتی حدود برقرار رکھنا
عام حیاتیاتی پابندیوں میں نرمی کے باوجود، Anthropic "دوہرے استعمال" (dual-use) کی تحقیق پر سخت موقف برقرار رکھے ہوئے ہے—یعنی ایسی معلومات جنہیں نقصان پہنچانے کے لیے دوبارہ استعمال کیا جا سکتا ہے۔ کمپنی نے وائرسวิทยา (virology)، زہرวิทยา (toxicology)، اور جدید مالیکیولر ڈیزائن سمیت انتہائی حساس موضوعات پر پابندیاں ختم نہیں کی ہیں۔
Anthropic کی استدلال حیاتیاتی خطرات کی منفرد نوعیت پر مبنی ہے۔ سائبر حملے کے برعکس، جسے پیچز (patches) اور سسٹم شٹ ڈاؤن کے ذریعے کم کیا جا سکتا ہے، ایک خارج شدہ حیاتیاتی ایجنٹ کو پھیلنا شروع ہونے کے بعد "بند کرنا" تقریباً ناممکن ہوتا ہے۔ کمپنی نے اس احتیاط کے پیچھے کئی اہم خدشات کا ذکر کیا ہے، جن میں شامل ہیں:
- امریکی انٹیلی جنس ایجنسیوں کی جانب سے حیاتیاتی خطرات کے حوالے سے تجزیہ۔
- ایسی تحقیق جو ظاہر کرتی ہے کہ AI کو مکمل طور پر مصنوعی وائرس ڈیزائن کرنے کے لیے استعمال کیا جا سکتا ہے۔
- موجودہ LLMs سے حیاتیاتی ہتھیاروں کی ہدایات حاصل کرنے کے لیے صارفین کی دستاویزی کوششیں۔
حفاظتی اقدامات اور خصوصی رسائی کے درمیان توازن
AI لیبز کے لیے چیلنج کھلی سائنسی ترقی اور تباہ کن غلط استعمال کی روک تھام کے درمیان تناؤ کو سنبھالنا ہے۔ Anthropic خصوصی رسائی کے پروگرام تیار کر کے اس مسئلے کو حل کرنے کی کوشش کر رہا ہے۔ یہ پروگرام تصدیق شدہ محققین کو ایک کنٹرول شدہ اور آڈٹ شدہ ماحول کے اندر محدود فیچرز—جیسے وائرسวิทยา یا مالیکیولر ماڈلنگ سے متعلق فیچرز— تک رسائی فراہم کرنے کے لیے بنائے گئے ہیں۔
غیر نقصان دہ طبی پوچھ گچھ اور خطرناک دوہرے استعمال کی تحقیق کے درمیان فرق کر کے، Anthropic اس بات کی مثال قائم کرنے کی کوشش کر رہا ہے کہ جدید ترین (frontier) ماڈلز "حیاتیاتی سرحد" (biological frontier) کو کیسے سنبھالتے ہیں، تاکہ اس بات کو یقینی بنایا جا سکے کہ جدید طب کے آلات غیر ارادی طور پر حیاتیاتی دہشت گردی کے آلات نہ بن جائیں۔
اہم نکات
- غلط مثبت نتائج میں 85% کمی: Anthropic نے جائز حیاتیاتی سوالات کے لیے رکاوٹ کو نمایاں طور پر کم کر دیا ہے، جس سے صارفین کو کم تر Opus 5 سے دور کر دیا گیا ہے۔
- اعلیٰ خطرے والے شعبوں پر سخت حفاظتی حدود: حیاتیاتی ہتھیاروں کی تیاری کو روکنے کے لیے وائرسวิทยา، زہرวิทยา، اور مالیکیولر ڈیزائن کے لیے سخت پابندیاں برقرار ہیں۔
- محققین کے لیے کنٹرول شدہ رسائی: Anthropic مخصوص رسائی کے پروگرام بنا رہا ہے تاکہ تصدیق شدہ سائنسدانوں کو وہ محدود صلاحیتیں فراہم کی جا سکیں جن کی انہیں جائز تحقیق کے لیے ضرورت ہے۔
Anthropic نے اپنے Fable 5 ماڈل میں غیر نقصان دہ حیاتیاتی سوالات پر غلط مثبت بلاکس میں تقریباً 85 فیصد کمی کی ہے، جس سے محققین کے لیے ماڈل کی مکمل استدلال کی صلاحیتوں تک رسائی بحال ہو گئی ہے۔ یہ تبدیلی دوہرے استعمال کے حیاتیاتی موضوعات پر سخت حفاظتی اقدامات کو برقرار رکھتی ہے، جس سے ماڈل کو ایسی ہدایات فراہم کرنے سے روکا جاتا ہے جو حیاتیاتی ہتھیاروں کے استعمال کے قابل بنا سکیں۔
یہ اپ ڈیٹ کیوں اہم ہے
Fable 5 کی حفاظتی تہہ کو اصل میں احتیاط کے طور پر ترتیب دیا گیا تھا، جو کہ جائز سائنسی سوالات کے ایک بڑے حصے کو اعلیٰ خطرہ قرار دے دیتی تھی۔ وہ صارفین جو معمول کے لیبارٹری نتائج کی تشریح یا طبی علامات کے تجزیے کے بارے میں پوچھتے تھے، انہیں باقاعدگی سے کم صلاحیت والے Opus 5 ماڈل کی طرف موڑ دیا جاتا تھا۔ ضرورت سے زیادہ بلاک کرنے کے عمل نے سائنسی برادری کی جانب سے تنقید کو جنم دیا، جس کا کہنا تھا کہ اس رکاوٹ نے حقیقی تحقیق میں مداخلت کی اور طبی فیصلہ سازی کو سست کر دیا۔ غلط مثبت شرح میں تقریباً چار پانچ حصے کی کمی کر کے، Anthropic کا مقصد ماڈل کی جدید استدلال کو ڈاکٹروں، ماہرین حیاتیات اور دیگر پیشہ ور افراد کے ہاتھوں میں واپس لانا ہے جنہیں روزمرہ کے کاموں کے لیے اس کی ضرورت ہوتی ہے۔
فلٹرز کو کیسے تبدیل کیا گیا
یہ بہتری ایک ری ٹون شدہ کلاسیفائر (classifier) کی وجہ سے آئی ہے جو عام بائیومیڈیکل سوالات اور ان سوالات کے درمیان فرق کرتا ہے جو "دوہرے استعمال" (dual-use) والی تحقیق سے متعلق ہوں—یعنی ایسی معلومات جنہیں نقصان پہنچانے کے لیے دوبارہ استعمال کیا جا سکتا ہے۔ نیا کلاسیفائر اب بھی وائروولوجی، ٹاکسیکولوجی اور جدید مالیکیولر ڈیزائن سے متعلق درخواستوں کو روکتا ہے، لیکن یہ معیاری تشخیص (diagnostics)، علامات کی درجہ بندی (symptom triage) اور ڈیٹا کی تشریح سے متعلق سوالات کو گزرنے دیتا ہے۔
Anthropic کے انجینئرز نے نوٹ کیا کہ حیاتیاتی خطرات سائبر خطرات سے مختلف ہیں: ایک بار جب کوئی پییتھوجن (pathogen) خارج ہو جائے، تو اسے پیچ (patch) نہیں کیا جا سکتا اور نہ ہی بند کیا جا سکتا ہے۔ اسی حقیقت نے زیادہ خطرے والے شعبوں پر سخت لائن برقرار رکھنے اور معمول کے طبی سوالات کے گرد پابندیوں کو نرم کرنے کا فیصلہ کرنے پر اکسایا۔
کیا چیزیں ممنوع رہیں گی
ماڈل ان درخواستوں کو مسترد کرنا جاری رکھے گا جو نقصان دہ ایجنٹس کی تیاری میں سہولت فراہم کر سکتی ہیں۔ خاص طور پر، کوئی بھی ایسا پرامپٹ جو درج ذیل کی تلاش میں ہو:
- وائروولوجی کے تفصیلی پروٹوکولز جو وائرس کی تیاری میں مدد دے سکیں،
- ہتھیار بنانے کے قابل کیمیکلز کے لیے ٹاکسیکولوجی کے طریقے، یا
- مالیکیولر انجینئرنگ کی مرحلہ وار ہدایات۔
Anthropic نے اپنی احتیاط کے لیے تین ذرائع کا حوالہ دیا: امریکی انٹیلی جنس ایجنسیوں کے تجزیے جو حیاتیاتی خطرے کو اجاگر کرتے ہیں، ایسی تحقیق جو ظاہر کرتی ہے کہ AI مکمل طور پر مصنوعی وائرس ڈیزائن کر سکتا ہے، اور موجودہ لینگویج ماڈلز سے حیاتیاتی ہتھیاروں کی ہدایات حاصل کرنے کے لیے صارفین کی دستاویزی کوششیں۔
تصدیق شدہ سائنسدانوں کے لیے رسائی کا پروگرام
کھلی تحقیق اور سیکیورٹی کے درمیان توازن برقرار رکھنے کے لیے، Anthropic ایک خصوصی رسائی کا پروگرام متعارف کروا رہا ہے۔ تصدیق شدہ محققین ایک کنٹرول شدہ ماحول کے لیے درخواست دے سکتے ہیں جہاں آڈٹ کے تحت محدود صلاحیتوں کو کھول دیا جائے گا۔ یہ پروگرام اس لیے ڈیزائن کیا گیا ہے تاکہ مستند سائنسدان زیادہ خطرے والے موضوعات—جیسے کہ نئے ویکسین پلیٹ فارمز یا پییتھوجن ماڈلنگ—کی تحقیق کر سکیں، بغیر عام عوام کو خطرناک رہنمائی کے سامنے لائے۔
خلاصہ
دوہرے استعمال پر سخت پابندیوں کو برقرار رکھتے ہوئے، غلط طور پر بلاک کیے جانے والے کیسز (false-positive blocks) میں 85 فیصد کمی کر کے، Anthropic کا مقصد محققین کو اپنے سب سے باصلاحیت ماڈل کی طاقت فراہم کرنا ہے، بغیر حیاتیاتی ہتھیاروں کے ڈیزائن کا راستہ کھولے۔ اس متوازن حفاظتی حکمت عملی کی کامیابی اس بات کا نمونہ بن سکتی ہے کہ جدید ترین AI ماڈلز دیگر انتہائی حساس سائنسی شعبوں کو کس طرح سنبھالتے ہیں۔
