Anthropic आणि OpenAI ने प्रत्येकी एक नवीन संशोधन मार्ग (research track) सुरू केला आहे, ज्यामुळे तपासलेले सुरक्षा संघ (vetted security teams) बहुतेक सुरक्षा फिल्टर नसलेल्या AI मॉडेल्सवर काम करू शकतील. Anthropic चा “Cyber Verification Program” आणि OpenAI चा “Trusted Access for Cyber” हे मंजूर संशोधकांना अशा शक्तिशाली लँग्वेज मॉडेल्सपर्यंत थेट पोहोच देतात, जे अनियंत्रित कोड, प्रॉम्प्ट्स आणि सूचना तयार करू शकतात. हा बदल महत्त्वाचा आहे कारण यामुळे AI सप्लाय चेनमध्ये एक स्पष्ट विभाग पडतो: काही मोजके इनसाइडर्स सर्वात कमकुवत आवृत्त्यांची तपासणी करू शकतात, तर उर्वरित जग अधिक मजबूत गार्डरेल्सच्या (guardrails) मागे राहते.

हे कार्यक्रम का सुरू झाले

दोन्ही कंपन्यांचे म्हणणे आहे की, या उपक्रमांचा उद्देश त्यांच्या सेवांविरुद्ध वापरल्या जाऊ शकणाऱ्या त्रुटींचा (vulnerabilities) शोध घेण्याच्या प्रक्रियेला गती देणे हा आहे. तज्ज्ञांच्या एका नियंत्रित गटाला कमी निर्बंधांसह 'सँडबॉक्स' (sandbox) उपलब्ध करून देऊन, दुर्भावनापूर्ण हल्लेखोर (malicious actors) त्या शोधण्यापूर्वीच हल्ल्याचे मार्ग (attack vectors) समोर आणण्याची त्यांची आशा आहे. हा दृष्टिकोन पारंपारिक सॉफ्टवेअर सुरक्षेसारखाच आहे, जिथे डेव्हलपर्स निवडक प्रेक्षकांसाठी “bug-bounty” बिल्ड्स रिलीज करतात.

संरक्षकांसाठी (defenders) नवीन जोखीम मोजणी

याचा दुसरा पैलू म्हणजे 'टू-टियर ॲक्सेस मॉडेल' (two-tier access model), जे प्रत्येक संस्थेला “संशोधक” आणि “हॅकर” यांच्यामध्ये एक रेषा ओढण्यास भाग पाडते. ती रेषा आता एक संभाव्य 'अटॅक सरफेस' (attack surface) बनली आहे. जर एखाद्या हल्लेखोराने क्रेडेंशियल्स चोरले, एखाद्या इनसाइडरच्या ॲक्सेसचा गैरवापर केला किंवा तपासणी प्रक्रियेला फसवले, तर ते बहुतांश वापरकर्त्यांचे संरक्षण करणाऱ्या गार्डरेल्सना बगल देऊ शकतात. एकदा आत शिरल्यानंतर, अनियंत्रित मॉडेलचा वापर खालील गोष्टींसाठी केला जाऊ शकतो:

  • शोध टाळतील असे फिशिंग स्क्रिप्ट्स (phishing scripts) तयार करणे
  • तपशीलवार कोड स्निपेट्ससह 'झिरो-डे एक्सप्लॉइट्स' (zero-day exploits) तयार करणे
  • विशिष्ट लक्ष्यांसाठी तयार केलेले पटवून देणारे 'सोशल-इंजिनिअरिंग प्रॉम्प्ट्स' तयार करणे

AI आउटपुट नेहमी फिल्टर केलेले असते या गृहितकावर संरक्षण यंत्रणा उभारणाऱ्या सुरक्षा संघांना आता या गृहितकाचा पुनर्विचार करावा लागेल.

संरक्षकांनी कसा प्रतिसाद देऊ शकतो

  • या कार्यक्रमांना एक 'थ्रेट वेक्टर' (threat vector) म्हणून पहा. शत्रू तपासणी प्रक्रियेत शिरकाव करण्याचा प्रयत्न करतील असे गृहीत धरून AI प्लॅटफॉर्मवरील असामान्य लॉगिन पॅटर्नवर लक्ष ठेवा.
  • क्लाउडच्या पलीकडे शोध विस्तारणे. आउटबाउंड ट्रॅफिकमध्ये, विशेषतः विशेषाधिकार प्राप्त (privileged) खात्यांमधून, AI-निर्मित कोड किंवा मजकूर शोधा.
  • धोरणात्मक नियंत्रणे (policy controls) कडक करा. बाह्य AI सेवांच्या कोणत्याही अंतर्गत वापरासाठी कडक “कमीतकमी विशेषाधिकार” (least-privilege) नियम लागू करा आणि ज्या वातावरणापर्यंत समझौता केलेल्या क्रेडेंशियल्सद्वारे पोहोचता येऊ शकते, अशा वातावरणांचे विभाजन (segment) करा.
  • विक्रेत्यांशी सहकार्य करा. प्रवेश निकषांमधील बदल किंवा आढळलेल्या गैरवापरांबद्दल अलर्ट मिळवण्यासाठी Anthropic आणि OpenAI च्या सुरक्षा संपर्क (security liaison) चॅनेलशी जोडलेले राहा.

प्रतिवाद

समर्थकांचा असा युक्तिवाद आहे की, सखोल तपासणीसाठी सुरक्षित मार्ग नसल्यास, त्रुटी प्रत्यक्षात वापरल्या जाईपर्यंत त्या लपलेल्या राहतील. त्यामुळे, त्रुटी लवकर समोर आणून हे कार्यक्रम एकूण 'अटॅक सरफेस' कमी करू शकतात. मात्र, याचा तोटा असा आहे की, “कमी-संरक्षित” स्तर संधीसाधू गैरवापराला आमंत्रण देतो.

काय लक्ष ठेवायचे

  • दोन्ही कंपन्यांकडून तपासणी प्रक्रियेतील अपडेट्स
  • या कार्यक्रमांमुळे होणाऱ्या गैरवापराचे अहवाल
  • AI-संबंधित 'अटॅक सरफेस'ची नोंदणी करण्याच्या पद्धतीत उद्योग-व्यापी बदल

थोडक्यात सांगायचे तर: नवीन संशोधन मार्ग सुरक्षा संशोधकांना शक्तिशाली साधने देतात, परंतु तेच साधने गेटमधून आत शिरू शकणाऱ्या कोणालाही उपलब्ध करून देतात. संरक्षण पथकांनी या कार्यक्रमांकडे माहितीचा स्रोत आणि हल्ल्याचा नवीन मार्ग या दोन्ही दृष्टीकोनातून पाहिले पाहिजे.