Anthropic اور OpenAI دونوں نے تحقیق کا ایک نیا راستہ (track) کھولا ہے جو منظور شدہ سیکیورٹی ٹیموں کو ایسے AI ماڈلز کے ساتھ کام کرنے کی اجازت دیتا ہے جن سے زیادہ تر حفاظتی فلٹرز (safety filters) ہٹا دیے گئے ہیں۔ Anthropic کا "Cyber Verification Program" اور OpenAI کا "Trusted Access for Cyber" منظور شدہ محققین کو طاقتور لینگویج ماڈلز تک براہ راست رسائی فراہم کرتے ہیں جو غیر محدود کوڈ، پرامپٹس اور ہدایات تیار کر سکتے ہیں۔ یہ اقدام اس لیے اہم ہے کیونکہ یہ AI سپلائی چین میں ایک واضح فرق پیدا کرتا ہے: چند اندرونی افراد کمزور ترین ورژنوں کی جانچ کر سکتے ہیں جبکہ باقی دنیا مضبوط حفاظتی رکاوٹوں (guardrails) کے پیچھے رہتی ہے۔

یہ پروگرام کیوں سامنے آئے

دونوں کمپنیوں کا کہنا ہے کہ ان اقدامات کا مقصد ان کمزوریوں (vulnerabilities) کی دریافت کو تیز کرنا ہے جنہیں ان کی خدمات کے خلاف ہتھیار کے طور پر استعمال کیا جا سکتا ہے۔ ماہرین کے ایک کنٹرول شدہ گروپ کو کم پابندیوں والا 'سینڈ باکس' (sandbox) فراہم کر کے، وہ امید کرتے ہیں کہ بدنیتی پر مبنی عناصر (malicious actors) کے ان کا پتہ لگانے سے پہلے ہی حملے کے راستوں (attack vectors) کو سامنے لا سکیں گے۔ یہ طریقہ کار روایتی سافٹ ویئر سیکیورٹی کی عکاسی کرتا ہے، جہاں ڈویلپرز ایک منتخب سامعین کے لیے "bug-bounty" بلڈز جاری کرتے ہیں۔

دفاع کرنے والوں کے لیے خطرے کا نیا حساب کتاب

اس کا دوسرا رخ رسائی کا ایک دو سطحی ماڈل ہے جو ہر تنظیم کو "محقق" (researcher) اور "ہیکر" (hacker) کے درمیان ایک لکیر کھینچنے پر مجبور کرتا ہے۔ وہ لکیر اب حملے کی ایک ممکنہ سطح (attack surface) بن جاتی ہے۔ اگر کوئی حملہ آور کریڈنشلز (credentials) چرا لیتا ہے، کسی اندرونی فرد کی رسائی کا فائدہ اٹھاتا ہے، یا جانچ کے عمل کو دھوکہ دیتا ہے، تو وہ ان حفاظتی رکاوٹوں سے گزر سکتا ہے جو زیادہ تر صارفین کی حفاظت کرتی ہیں۔ ایک بار اندر داخل ہونے کے بعد، غیر محدود ماڈل کو درج ذیل کاموں کے لیے اکسایا جا سکتا ہے:

  • ایسے فشنگ اسکرپٹس (phishing scripts) تیار کرنا جو پکڑے جانے سے بچ سکیں
  • تفصیلی کوڈ اسنیپٹس کے ساتھ zero-day exploits تیار کرنا
  • مخصوص اہداف کے لیے تیار کردہ قائل کرنے والے social-engineering prompts پیدا کرنا

سیکیورٹی ٹیمیں جنہوں نے اس مفروضے پر دفاعی نظام بنائے تھے کہ AI کے نتائج ہمیشہ فلٹر شدہ ہوتے ہیں، انہیں اس مفروضے پر نظر ثانی کرنی ہوگی۔

دفاع کرنے والے کیسے جواب دے سکتے ہیں

  • پروگراموں کو خطرے کے ایک ذریعے (threat vector) کے طور پر دیکھیں۔ یہ فرض کریں کہ مخالفین جانچ کے عمل (vetting pipeline) میں داخل ہونے کی کوشش کریں گے اور AI پلیٹ فارمز پر غیر معمولی لاگ ان پیٹرنز کی نگرانی کریں۔
  • کلاؤڈ سے آگے تشخیص کو وسعت دیں۔ آؤٹ باؤنڈ ٹریفک میں AI سے تیار کردہ کوڈ یا متن تلاش کریں، خاص طور پر مراعات یافتہ اکاؤنٹس (privileged accounts) سے۔
  • پالیسی کنٹرولز کو سختی سے نافذ کریں۔ بیرونی AI خدمات کے کسی بھی اندرونی استعمال کے لیے سخت "least-privilege" کے قواعد نافذ کریں، اور ان ماحول کو الگ کریں جن تک کسی سمجھوتہ شدہ کریڈنشل کے ذریعے پہنچا جا سکتا ہے۔
  • وینڈرز کے ساتھ تعاون کریں۔ رسائی کے معیار میں تبدیلیوں یا دریافت ہونے والے غلط استعمال کے بارے میں الرٹس حاصل کرنے کے لیے Anthropic اور OpenAI کے سیکیورٹی رابطہ چینلز کے ساتھ رابطے میں رہیں۔

دوسرا پہلو

حامیوں کا استدلال ہے کہ گہری جانچ کے لیے محفوظ چینل کے بغیر، کمزوریاں اس وقت تک چھپی رہیں گی جب تک کہ انہیں عملی طور پر استعمال نہ کیا جائے۔ اس لیے، یہ پروگرام نقصانات کو جلد سامنے لا کر مجموعی حملے کی سطح کو کم کر سکتے ہیں۔ اس کا نقصان یہ ہے کہ ایک "کم حفاظتی" سطح موقع پرستوں کے غلط استعمال کو دعوت دیتی ہے۔

کن چیزوں پر نظر رکھنی چاہیے

  • دونوں کمپنیوں کی جانب سے جانچ کے عمل (vetting process) میں اپ ڈیٹس
  • ان پروگراموں سے پیدا ہونے والے غلط استعمال کی رپورٹس
  • AI سے متعلقہ حملے کی سطحوں کی درجہ بندی کے طریقوں میں صنعت گیر تبدیلیوں

خلاصہ یہ کہ: تحقیق کے نئے راستے سیکیورٹی محققین کو طاقتور ٹولز دیتے ہیں، لیکن وہ یہی ٹولز ہر اس شخص کو بھی دے دیتے ہیں جو دروازے سے گزرنے میں کامیاب ہو جائے۔ دفاعی ٹیموں کو ان پروگراموں کو بصیرت کے ذریعے اور حملے کے ایک نئے راستے، دونوں کے طور پر دیکھنا چاہیے۔