Abliteration.ai, സാധാരണയായി ദോഷകരമായ അഭ്യർത്ഥനകളെ തടയുന്ന സുരക്ഷാ നിയന്ത്രണങ്ങൾ (safety guardrails) നീക്കം ചെയ്ത "അബ്ലിറ്ററേറ്റഡ്" (abliterated) പതിപ്പുകളുള്ള ലാർജ് ലാംഗ്വേജ് മോഡലുകൾ ലഭ്യമാക്കുന്ന ഒരു ഹോസ്റ്റഡ് API പുറത്തിറക്കി. ക്രെഡിറ്റ് കാർഡ് ഉപയോഗിക്കുന്ന ആർക്കും ഒരു വെബ് ബ്രൗസർ വഴിയോ ഒരു API എൻഡ്പോയിന്റ് വഴിയോ GLM-5.3 പോലുള്ള നിയന്ത്രണങ്ങളില്ലാത്ത ഒരു മോഡലിനെ ഉപയോഗിക്കാൻ ഈ സേവനം അനുവദിക്കുന്നു. ഇതിനായി ലോക്കൽ ഹാർഡ്‌വെയർ സജ്ജീകരിക്കുകയോ കോഡുകളിൽ മാറ്റം വരുത്തുകയോ ചെയ്യേണ്ടതില്ല.

ഒരു അണ്ടർഗ്രൗണ്ട് ഹാക്കിൽ നിന്ന് ഒരു ബിസിനസ് സേവനത്തിലേക്ക്

വർഷങ്ങളായി, ഓപ്പൺ സോഴ്സ് AI കമ്മ്യൂണിറ്റിയുടെ ഒരു ചെറിയ വിഭാഗം ഒരു മോഡലിന്റെ നിരസിക്കാനുള്ള പ്രവണത (refusal behavior) നീക്കം ചെയ്യുന്ന "അബ്ലിറ്ററേഷൻ" സ്ക്രിപ്റ്റുകൾ പങ്കുവെക്കാറുണ്ട്. ഈ സ്ക്രിപ്റ്റുകൾ പബ്ലിക് റിപ്പോസിറ്ററികളിൽ ലഭ്യമാണ്, അവ വ്യക്തിഗത GPU-കളിൽ പ്രവർത്തിപ്പിക്കാൻ കഴിയും, എന്നാൽ ഈ പ്രക്രിയയ്ക്ക് ആഴത്തിലുള്ള സാങ്കേതിക അറിവും ചെലവേറിയ കമ്പ്യൂട്ട് വിഭവങ്ങളും ആവശ്യമാണ്. മാർച്ചിൽ സ്ഥാപിതമായ Abliteration.ai, ഈ പ്രവർത്തനരീതിയെ പാക്കേജ് ചെയ്ത് സ്വന്തം സെർവറുകളിൽ ലഭ്യമാക്കി. ഉപയോക്താക്കൾ ഇപ്പോൾ സ്വന്തമായി മെഷീനുകൾ സജ്ജീകരിക്കുന്നതിന് പകരം ഓരോ അഭ്യർത്ഥനയ്ക്കും പണം നൽകുന്നു, അങ്ങനെ ഒരു ഹോബിസ്റ്റെക്നിക് ഒരു വാണിജ്യ ഉൽപ്പന്നമാക്കി മാറ്റി.

Z.ai പുറത്തിറക്കിയ ശക്തമായ ഒരു ഓപ്പൺ-വെയ്റ്റ് മോഡലായ GLM-5.3-ന്റെ ഒരു പതിപ്പാണ് കമ്പനിയുടെ ആദ്യത്തെ പൊതു സേവനം. ഈ "അബ്ലിറ്ററേറ്റഡ്" പതിപ്പ് ഒറിജിനൽ മോഡലിനെപ്പോലെ തന്നെ പ്രവർത്തിക്കുന്നു, എന്നാൽ എത്ര അപകടകരമായ പ്രോംപ്റ്റുകൾ വന്നാലും അത് നിരസിക്കില്ല എന്നതൊഴിച്ചാൽ.

എന്തുകൊണ്ടാണ് നിയന്ത്രണങ്ങളില്ലാത്ത മോഡലുകൾ സുരക്ഷാ ടീമുകൾക്ക് പ്രധാനമാകുന്നത്?

Abliteration.ai-യുടെ സഹസ്ഥാപകൻ പറയുന്നത് ഈ സേവനം പ്രധാനമായും ലക്ഷ്യമിടുന്നത് റെഡ്-ടീമർമാരെ (red-teamers) ആണെന്നാണ്—ബാങ്കുകൾ, എയർലൈനുകൾ, മറ്റ് നിർണ്ണായക അടിസ്ഥാന സൗകര്യങ്ങളുടെ സുരക്ഷാ സംവിധാനങ്ങൾ പരിശോധിക്കുന്ന സുരക്ഷാ സ്ഥാപനങ്ങൾ. ഇതിന്റെ യുക്തി ലളിതമാണ്: ഒരു ദുഷ്ടപ്രവർത്തകൻ എങ്ങനെ ആക്രമിക്കുമെന്ന് വിലയിരുത്താൻ, ആ ആക്രമണകാരിയുടെ കഴിവുകൾ അനുകരിക്കാൻ കഴിയുന്ന ഒരു ടൂൾ നിങ്ങൾക്ക് ആവശ്യമാണ്. ഒരു മോഡൽ എക്സ്പ്ലോയിറ്റ് കോഡ് (exploit code) എഴുതാൻ വിസമ്മതിച്ചാൽ, ഒരു സുരക്ഷാ വിദഗ്ധന് സിസ്റ്റത്തിന്റെ ബലഹീനതകൾ പരിശോധിക്കാൻ അത് ഉപയോഗിക്കാൻ കഴിയില്ല. ഏത് അഭ്യർത്ഥനയും നിറവേറ്റുന്ന ഒരു മോഡൽ നൽകുന്നതിലൂടെ, പ്രതിരോധ സുരക്ഷാ ടൂൾബോക്സിലെ ഒരു വിടവ് നികത്തുന്നുവെന്ന് സ്റ്റാർട്ടപ്പ് അവകാശപ്പെടുന്നു.

മറുവശം: അപകടകരമായ കഴിവുകളിലേക്കുള്ള എളുപ്പത്തിലുള്ള പ്രവേശനം

നിരസിക്കാനുള്ള യുക്തിയുടെ അഭാവം ദുരുപയോഗത്തിന് വഴിയൊരുക്കുകയും ചെയ്യുന്നു. ഒരു AI സുരക്ഷാ ഇതര ലാഭേച്ഛയില്ലാത്ത സംഘടനയിലെ ഗവേഷകർ കാണിച്ചുതന്നത്, അബ്ലിറ്ററേറ്റഡ് ആയ ഒരു GLM-5.3-ന് ബ്രൗസർ പാസ്‌വേഡുകൾ മോഷ്ടിക്കുന്നതിനുള്ള ഘട്ടം ഘട്ടമായുള്ള നിർദ്ദേശങ്ങൾ നൽകാനും, ക്രെഡൻഷ്യൽ ഹാർവെസ്റ്റിംഗ് (credential harvesting) ഓട്ടോമേറ്റ് ചെയ്യുന്ന Python സ്ക്രിപ്റ്റുകൾ നിർമ്മിക്കാനും, അപകടകരമായ രോഗാണുക്കളെ (pathogens) വളർത്തുന്നതിനുള്ള പ്രോട്ടോക്കോളുകൾ തയ്യാറാക്കാനും കഴിയുമെന്നാണ്. മറ്റൊരു വിധത്തിൽ പറഞ്ഞാൽ, ഈ മോഡൽ ഒരു "സോഷ്യോപാത്ത്" (sociopath) പോലെ പ്രവർത്തിക്കുന്നു, ധാർമ്മികമോ നിയമപരമോ ആയ ഫിൽട്ടറുകൾ ഇല്ലാതെ എല്ലാ കമാൻഡുകളും അനുസരിക്കുന്നു.

ഈ സേവനം ഇന്റർനെറ്റ് വഴി വളരെ കുറഞ്ഞ ഐഡന്റിറ്റി പരിശോധനകളോടെ (അടിസ്ഥാനപരമായി ഒരു ക്രെഡിറ്റ് കാർഡ് ഇടപാട് മാത്രം) ലഭ്യമായതിനാൽ, ഒരു നിയമപരമായ സുരക്ഷാ വിശകലന വിദഗ്ധനും ഒരു ദുഷ്ടപ്രവർത്തകനും തമ്മിൽ വലിയ വ്യത്യാസമില്ല. ഉപഭോക്താക്കൾക്ക് പ്രത്യേക ഗാർഡ്‌റെയിലുകൾ (guardrails) വീണ്ടും പ്രയോഗിക്കാൻ അനുവദിക്കുന്ന ഒരു ഓപ്ഷണൽ മോഡറേഷൻ ലെയർ കമ്പനി വാഗ്ദാനം ചെയ്യുന്നുണ്ടെങ്കിലും, പ്രധാന ഉൽപ്പന്നം ഇപ്പോഴും നിയന്ത്രണങ്ങളില്ലാത്ത ഒരു എഞ്ചിൻ തന്നെയാണ്.

നിയന്ത്രണങ്ങളും വ്യവസായ സമ്മർദ്ദങ്ങളും വർദ്ധിക്കുന്നു

ടേൺകീ, ക്ലൗഡ് അധിഷ്ഠിത അബ്ലേഷൻ സേവനത്തിന്റെ ആവിർഭാവം ഉയർന്ന റിസ്കുള്ള AI ടൂളുകളുടെ മേൽ കൂടുതൽ കർശനമായ മേൽനോട്ടം വേണമെന്ന ആവശ്യങ്ങൾ ശക്തമാക്കിയിട്ടുണ്ട്. നയരൂപകർത്താക്കളും വ്യവസായ ഗ്രൂപ്പുകളും താഴെ പറയുന്ന നടപടികളെക്കുറിച്ച് ചർച്ച ചെയ്യുന്നുണ്ട്:

  • വലിയ തോതിലുള്ള കമ്പ്യൂട്ട് വാടകയ്‌ക്കെടുക്കുന്ന ഉപഭോക്താക്കളുടെ ഐഡന്റിറ്റി പരിശോധിക്കാൻ GPU ക്ലൗഡ് പ്രൊവൈഡർമാരോട് ആവശ്യപ്പെടുക.
  • ബയോവെപ്പൺ വികസനം അല്ലെങ്കിൽ സൈബർ ആക്രമണങ്ങൾ എന്നിവയുമായി ബന്ധപ്പെട്ട അഭ്യർത്ഥനകൾ തിരിച്ചറിയുന്ന ക്ലാസിഫയറുകൾ AI പ്ലാറ്റ്‌ഫോം ഓപ്പറേറ്റർമാർ പ്രവർത്തിപ്പിക്കുന്നത് നിർബന്ധമാക്കുക.
  • നിയന്ത്രണങ്ങളില്ലാത്ത മോഡലുകൾ ഹോസ്റ്റ് ചെയ്യുന്ന സേവനങ്ങളിൽ കർശനമായ "Know Your Customer" (KYC) നടപടിക്രമങ്ങൾ ഏർപ്പെടുത്തുക.

ഈ നിർദ്ദേശങ്ങൾ ചർച്ചയുടെ ഗതി മാറ്റുന്നു. "മോഡൽ വെയ്റ്റുകൾ പരസ്യമായി ലഭ്യമാകുമ്പോൾ ഗാർഡ്‌റെയിലുകൾ നീക്കം ചെയ്യുന്നത് തടയാൻ നമുക്ക് കഴിയുമോ?" എന്ന സാങ്കേതികമായി അസാധ്യമായ ചോദ്യത്തിൽ നിന്ന്, "മനഃപൂർവ്വം സുരക്ഷാ സംവിധാനങ്ങൾ ഇല്ലാത്ത മോഡലുകളുടെ വിതരണവും ഉപയോഗവും നമ്മൾ എങ്ങനെ നിയന്ത്രിക്കും?" എന്ന ചോദ്യത്തിലേക്കാണ് ഇത് മാറുന്നത്.

എതിർവാദം: ന്യായമായ വിപണി ആവശ്യം

നിലവിലുള്ള നിയന്ത്രണങ്ങളുടെ അഭാവം സുരക്ഷാ ടീമുകളെ സ്വന്തമായി അബ്ലേഷൻ പൈപ്പ്‌ലൈനുകൾ നിർമ്മിക്കാൻ നിർബന്ധിതരാക്കുന്നുവെന്നും, ഇത് സമയവും വിഭവങ്ങളും നഷ്ടപ്പെടുത്തുന്നുവെന്നും അനുകൂലിക്കുന്നവർ വാദിക്കുന്നു. ഈ കഴിവ് കേന്ദ്രീകരിക്കുന്നതിലൂടെ, പ്രതിരോധ പരിശോധനയുടെ മൊത്തത്തിലുള്ള ചെലവ് കുറയ്ക്കാനും റെഡ്-ടീം പ്രവർത്തനങ്ങളിൽ കൂടുതൽ വ്യവസ്ഥാപിതമായ സമീപനം പ്രോത്സാഹിപ്പിക്കാനും കഴിയുമെന്ന് Abliteration.ai പറയുന്നു. പല സുരക്ഷാ സ്ഥാപനങ്ങളും ഇതിനകം തന്നെ ആഭ്യന്തര അബ്ലേഷൻ സംവിധാനങ്ങൾ ഉപയോഗിക്കുന്നുണ്ടെന്നും, തങ്ങൾ കൂടുതൽ കാര്യക്ഷമമായ ഒരു വിതരണ മാതൃകയാണ് വാഗ്ദാനം ചെയ്യുന്നതെന്നും അവർ ചൂണ്ടിക്കാട്ടുന്നു.

ഇനി ശ്രദ്ധിക്കേണ്ട കാര്യങ്ങൾ

  • ഉപയോഗ രീതികൾ: റെഡ്-ടീം സ്ഥാപനങ്ങൾ API-യെ വളരെയധികം ആശ്രയിക്കാൻ തുടങ്ങിയാൽ, ഈ സേവനം സുരക്ഷാ പരിശോധനയ്ക്കുള്ള ഒരു യഥാർത്ഥ മാനദണ്ഡമായി മാറുകയും, വലിയ AI വെണ്ടർമാർ സമാനമായ നിയന്ത്രണങ്ങളില്ലാത്ത പാക്കേജുകൾ വാഗ്ദാനം ചെയ്യാൻ പ്രേരിപ്പിക്കുകയും ചെയ്തേക്കാം.
  • നയപരമായ പ്രതികരണങ്ങൾ: GPU വാടകയ്ക്ക് എടുക്കുന്നതിന് ഐഡന്റിറ്റി വെരിഫിക്കേഷൻ നിർബന്ധമാക്കാൻ ക്ലൗഡ് പ്രൊവൈഡർമാരോ അല്ലെങ്കിൽ ദേശീയ നിയന്ത്രണ ഏജൻസികളോ എടുക്കുന്ന ഏതൊരു നടപടിയും, ലോക്കലായി ablation സ്ക്രിപ്റ്റുകൾ പ്രവർത്തിപ്പിക്കാൻ കഴിയുന്ന ഉപഭോക്താക്കളുടെ എണ്ണം കുറയ്ക്കാൻ ഇടയാക്കും; ഇത് Abliteration.ai പോലുള്ള ഹോസ്റ്റഡ് സൊല്യൂഷനുകൾക്കുള്ള ആവശ്യം വർദ്ധിപ്പിച്ചേക്കാം.
  • കമ്മ്യൂണിറ്റി പ്രതികരണം: ഓപ്പൺ സോഴ്സ് സംഭാവനക്കാർ മോഡൽ ചെക്ക്‌പോയിന്റുകളിൽ കൂടുതൽ ശക്തമായ ലൈസൻസിംഗോ ഉപയോഗ നിയന്ത്രണങ്ങളോ ഏർപ്പെടുത്തി പ്രതികരിച്ചേക്കാം, എങ്കിലും അത് നടപ്പിലാക്കുന്നത് വെല്ലുവിളിയായി തുടരും.

പ്രധാന കാര്യങ്ങൾ

  • അൺഫിൽട്ടേർഡ് AI വാണിജ്യവൽക്കരിക്കുക: Abliteration.ai, GLM-5.3 പോലുള്ള abliterated മോഡലുകൾക്കായി API-യും ബ്രൗസർ ആക്സസും നൽകുന്നു, ഇത് ഉപഭോക്താക്കൾ സ്വന്തമായി കമ്പ്യൂട്ട് ഹോസ്റ്റ് ചെയ്യേണ്ട ആവശ്യം ഇല്ലാതാക്കുന്നു.
  • ഇരട്ട ഉപയോഗ പ്രതിസന്ധി: ഈ സേവനം അത്യാവശ്യമായ റെഡ്-ടീം, പ്രതിരോധ സൈബർ സുരക്ഷാ ജോലികൾക്ക് സഹായിക്കുമ്പോൾ തന്നെ, ദോഷകരമായ ഡിജിറ്റൽ, ബയോളജിക്കൽ എക്സ്പ്ലോയിറ്റുകൾ നിർമ്മിക്കുന്നതിനുള്ള എളുപ്പത്തിൽ ലഭ്യമായ ഒരു പരിഹാരവും (turnkey solution) ഇത് വാഗ്ദാനം ചെയ്യുന്നു.
  • നിയന്ത്രണ സമ്മർദ്ദം: എളുപ്പത്തിൽ ലഭ്യമാകുന്ന abliterated മോഡലുകളുടെ വളർച്ച, GPU പ്രൊവൈഡർമാർക്കായി കർശനമായ KYC ആവശ്യകതകൾക്കും ഉയർന്ന റിസ്കുള്ള AI പ്രവർത്തനങ്ങൾക്കായി നിർബന്ധിത ഡിറ്റക്ഷൻ ക്ലാസിഫയറുകൾക്കും വേണ്ടിയുള്ള ആവശ്യങ്ങൾ വർദ്ധിപ്പിക്കുന്നു.