Anthropic-ഉം OpenAI-യും പരിശോധനകൾക്ക് വിധേയരായ സുരക്ഷാ ടീമുകൾക്കായി സുരക്ഷാ ഫിൽട്ടറുകൾ ഒഴിവാക്കിയ AI മോഡലുകൾ ഉപയോഗിക്കാൻ കഴിയുന്ന പുതിയ റിസർച്ച് ട്രാക്കുകൾ ആരംഭിച്ചു. Anthropic-ന്റെ “Cyber Verification Program”-ഉം OpenAI-യുടെ “Trusted Access for Cyber”-ഉം അംഗീകൃത ഗവേഷകർക്ക് നിയന്ത്രണങ്ങളില്ലാത്ത കോഡുകളും പ്രോംപ്റ്റുകളും നിർദ്ദേശങ്ങളും നിർമ്മിക്കാൻ കഴിയുന്ന ശക്തമായ ലാംഗ്വേജ് മോഡലുകളിലേക്ക് നേരിട്ടുള്ള പ്രവേശനം നൽകുന്നു. ഈ നീക്കം AI സപ്ലൈ ചെയിനിൽ (supply chain) വ്യക്തമായ ഒരു വിഭജനം സൃഷ്ടിക്കുന്നതുകൊണ്ട് തന്നെ പ്രധാനമാണ്: ഒരു ചെറിയ വിഭാഗം ആളുകൾക്ക് ഏറ്റവും ദുർബലമായ പതിപ്പുകൾ പരിശോധിക്കാൻ കഴിയുമ്പോൾ, ലോകത്തിന്റെ ബാക്കി ഭാഗം ശക്തമായ സുരക്ഷാ കവചങ്ങൾക്കുള്ളിൽ (guardrails) തുടരേണ്ടി വരുന്നു.

ഈ പ്രോഗ്രാമുകൾ വന്നതിന്റെ കാരണം

തങ്ങളുടെ സേവനങ്ങൾക്ക് എതിരെ ഉപയോഗിക്കാൻ സാധ്യതയുള്ള സുരക്ഷാ വീഴ്ചകൾ (vulnerabilities) വേഗത്തിൽ കണ്ടെത്തുക എന്നതാണ് ഈ സംരംഭങ്ങളുടെ ലക്ഷ്യമെന്ന് ഇരു കമ്പനികളും പറയുന്നു. നിയന്ത്രണങ്ങൾ കുറഞ്ഞ ഒരു സാൻഡ്ബോക്സ് (sandbox) വിദഗ്ധർക്ക് നൽകുന്നതിലൂടെ, ദുരുപയോഗം ചെയ്യുന്നവർ കണ്ടെത്തുന്നതിന് മുമ്പ് തന്നെ ആക്രമണ സാധ്യതകൾ (attack vectors) കണ്ടെത്താൻ അവർ പ്രതീക്ഷിക്കുന്നു. ഡെവലപ്പർമാർ തിരഞ്ഞെടുത്ത ആളുകൾക്കായി “bug-bounty” ബിൽഡുകൾ പുറത്തിറക്കുന്ന പരമ്പരാഗത സോഫ്റ്റ്‌വെയർ സുരക്ഷാ രീതിയെയാണ് ഈ സമീപനം അനുകരിക്കുന്നത്.

പ്രതിരോധിക്കുന്നവർക്കുള്ള പുതിയ വെല്ലുവിളികൾ

ഇതിന്റെ മറുവശം, ഓരോ സ്ഥാപനവും “ഗവേഷകൻ” (researcher), “ഹാക്കർ” (hacker) എന്നിവർ തമ്മിൽ ഒരു അതിർവരമ്പ് നിശ്ചയിക്കാൻ നിർബന്ധിതമാക്കുന്ന ഒരു ടു-ടയർ ആക്സസ് മോഡലാണ്. ആ അതിർവരമ്പ് ഇപ്പോൾ ഒരു ആക്രമണ സാധ്യതയായി (attack surface) മാറുന്നു. ഒരു ആക്രമണകാരി ക്രെഡൻഷ്യലുകൾ മോഷ്ടിക്കുകയോ, ഒരു ഇൻസൈഡറുടെ ആക്സസ് ദുരുപയോഗം ചെയ്യുകയോ, പരിശോധനാ പ്രക്രിയയെ (vetting process) വഞ്ചിക്കുകയോ ചെയ്താൽ, സാധാരണ ഉപയോക്താക്കളെ സംരക്ഷിക്കുന്ന സുരക്ഷാ കവചങ്ങളെ മറികടക്കാൻ അവർക്ക് സാധിക്കും. ഒരിക്കൽ ഉള്ളിൽ എത്തിക്കഴിഞ്ഞാൽ, നിയന്ത്രണങ്ങളില്ലാത്ത മോഡലുകളെ താഴെ പറയുന്നവയ്ക്കായി ഉപയോഗിക്കാം:

  • കണ്ടെത്തലുകളെ മറികടക്കുന്ന ഫിഷിംഗ് സ്ക്രിപ്റ്റുകൾ (phishing scripts) നിർമ്മിക്കാൻ
  • വിശദമായ കോഡ് സ്നിപ്പറ്റുകൾ ഉപയോഗിച്ച് സീറോ-ഡേ എക്സ്പ്ലോയിറ്റുകൾ (zero-day exploits) തയ്യാറാക്കാൻ
  • പ്രത്യേക ലക്ഷ്യങ്ങൾക്കായി രൂപകൽപ്പന ചെയ്ത സോഷ്യൽ എഞ്ചിനീയറിംഗ് പ്രോംപ്റ്റുകൾ നിർമ്മിക്കാൻ

AI ഔട്ട്‌പുട്ടുകൾ എപ്പോഴും ഫിൽട്ടർ ചെയ്യപ്പെടുന്നു എന്ന അനുമാനത്തിൽ സുരക്ഷാ സംവിധാനങ്ങൾ കെട്ടിപ്പടുത്ത ടീമുകൾ ഈ ധാരണ പുനർചിന്തനം ചെയ്യേണ്ടതുണ്ട്.

പ്രതിരോധിക്കുന്നവർക്ക് എന്തുചെയ്യാൻ കഴിയും

  • ഈ പ്രോഗ്രാമുകളെ ഒരു ഭീഷണി സാധ്യതയായി (threat vector) കാണുക. ശത്രുക്കൾ പരിശോധനാ പ്രക്രിയയിൽ (vetting pipeline) കടന്നുകയറാൻ ശ്രമിക്കുമെന്ന് കരുതുക, കൂടാതെ AI പ്ലാറ്റ്‌ഫോമുകളിലെ അസാധാരണമായ ലോഗിൻ പാറ്റേണുകൾ നിരീക്ഷിക്കുക.
  • ക്ലൗഡിന് പുറത്തുള്ള കാര്യങ്ങളിലും കണ്ടെത്തലുകൾ വ്യാപിപ്പിക്കുക. ഔട്ട്‌ബൗണ്ട് ട്രാഫിക്കിൽ (outbound traffic), പ്രത്യേകിച്ച് ഉയർന്ന അധികാരമുള്ള അക്കൗണ്ടുകളിൽ (privileged accounts) നിന്ന് വരുന്ന AI നിർമ്മിത കോഡുകളോ ടെക്സ്റ്റുകളോ പരിശോധിക്കുക.
  • പോളിസി നിയന്ത്രണങ്ങൾ കർശനമാക്കുക. ബാഹ്യ AI സേവനങ്ങൾ ആഭ്യന്തരമായി ഉപയോഗിക്കുമ്പോൾ കർശനമായ “least-privilege” നിയമങ്ങൾ നടപ്പിലാക്കുക, കൂടാതെ ഒരു അക്കൗണ്ട് ഹാക്ക് ചെയ്യപ്പെട്ടാൽ അത് ബാധിക്കാത്ത രീതിയിൽ എൻവയോൺമെന്റുകൾ വേർതിരിക്കുക (segment).
  • വെണ്ടർമാരുമായി സഹകരിക്കുക. ആക്സസ് മാനദണ്ഡങ്ങളിലെ മാറ്റങ്ങളെക്കുറിച്ചോ കണ്ടെത്തിയ ദുരുപയോഗങ്ങളെക്കുറിച്ചോ ഉള്ള അറിയിപ്പുകൾ ലഭിക്കുന്നതിനായി Anthropic, OpenAI എന്നിവരുടെ സുരക്ഷാ വിഭാഗങ്ങളുമായി ബന്ധം നിലനിർത്തുക.

വിരുദ്ധ വാദം

ആഴത്തിലുള്ള പരിശോധനയ്ക്കായി സുരക്ഷിതമായ ഒരു മാർഗ്ഗമില്ലെങ്കിൽ, സുരക്ഷാ വീഴ്ചകൾ പ്രായോഗികമായി ഉപയോഗിക്കപ്പെടുന്നത് വരെ അവ മറഞ്ഞിരിക്കുമെന്ന് അനുകൂലിക്കുന്നവർ വാദിക്കുന്നു. അതുകൊണ്ട് തന്നെ, പിഴവുകൾ നേരത്തെ കണ്ടെത്തുന്നതിലൂടെ ഈ പ്രോഗ്രാമുകൾ മൊത്തത്തിലുള്ള ആക്രമണ സാധ്യത കുറയ്ക്കാൻ സഹായിച്ചേക്കാം. എന്നാൽ ഇതിന്റെ പോരായ്മ, കുറഞ്ഞ സുരക്ഷയുള്ള ഈ വിഭാഗം ദുരുപയോഗത്തിന് സാധ്യതയുണ്ടാക്കുന്നു എന്നതാണ്.

ശ്രദ്ധിക്കേണ്ട കാര്യങ്ങൾ

  • കമ്പനികളിൽ നിന്നുള്ള പരിശോധനാ പ്രക്രിയയിലെ (vetting process) മാറ്റങ്ങൾ
  • ഈ പ്രോഗ്രാമുകളിൽ നിന്നുള്ള ദുരുപയോഗ റിപ്പോർട്ടുകൾ
  • AI സംബന്ധമായ ആക്രമണ സാധ്യതകൾ രേഖപ്പെടുത്തുന്ന രീതിയിലുള്ള വ്യവസായ മാറ്റങ്ങൾ

ചുരുക്കത്തിൽ: പുതിയ റിസർച്ച് ട്രാക്കുകൾ സുരക്ഷാ ഗവേഷകർക്ക് ശക്തമായ ഉപകരണങ്ങൾ നൽകുന്നുണ്ടെങ്കിലും, സുരക്ഷാ കവചം മറികടക്കാൻ കഴിയുന്ന ആർക്കും അതേ ഉപകരണങ്ങൾ ലഭിക്കുന്നുമുണ്ട്. പ്രതിരോധ ടീമുകൾ ഈ പ്രോഗ്രാമുകളെ അറിവ് നൽകുന്ന സ്രോതസ്സ് എന്ന നിലയിലും പുതിയൊരു ആക്രമണ മാർഗ്ഗം എന്ന നിലയിലും കാണേണ്ടതുണ്ട്.