Anthropic അതിന്റെ Fable 5 മോഡലിൽ സുപ്രധാനമായ ഒരു അപ്‌ഡേറ്റ് നടപ്പിലാക്കിയിട്ടുണ്ട്. ഇതിലൂടെ സുരക്ഷാ പാളികൾ (safety layers) കാരണം തടയപ്പെട്ടിരുന്ന ദോഷകരമല്ലാത്ത ജൈവ സംബന്ധിയായ ചോദ്യങ്ങളുടെ എണ്ണം ഗണ്യമായി കുറച്ചിരിക്കുന്നു. ഉയർന്ന അപകടസാധ്യതയുള്ള ജൈവ ഭീഷണികൾക്കെതിരെയുള്ള കർശനമായ സുരക്ഷാ മാനദണ്ഡങ്ങൾ നിലനിർത്തിക്കൊണ്ടുതന്നെ, നിയമാനുസൃതമായ ശാസ്ത്രീയ ഗവേഷണങ്ങൾ സുഗമമാക്കുക എന്ന ലക്ഷ്യത്തോടെയാണ് ഈ തന്ത്രപരമായ മാറ്റം വരുത്തിയിരിക്കുന്നത്.

ശാസ്ത്രീയ ഗവേഷണത്തിനായുള്ള തടസ്സങ്ങൾ കുറയ്ക്കുന്നു

ശാസ്ത്രീയ സമൂഹത്തിൽ നിന്നുള്ള വിമർശനങ്ങളെത്തുടർന്ന്, Fable 5-ന്റെ ബയോളജി സുരക്ഷാ ഫിൽട്ടറുകളിലെ തെറ്റായ തിരിച്ചറിയലുകൾ (false positives) ഏകദേശം 85 ശതമാനം കുറയ്ക്കാൻ Anthropic വിജയകരമായി കഴിഞ്ഞു. മുൻപ്, മോഡലിന്റെ സുരക്ഷാ ക്ലാസിഫയർ അമിതമായി കർശനമായിരുന്നു; ഇത് പലപ്പോഴും നിയമാനുസൃതമായ ശാസ്ത്രീയ അന്വേഷണങ്ങളെ തടയുകയും ഉപയോക്താക്കളെ കുറഞ്ഞ ശേഷിയുള്ള Opus 5 മോഡലിലേക്ക് തിരിച്ചുവിടുകയും ചെയ്തിരുന്നു.

ഈ അപ്‌ഡേറ്റ് ഗവേഷകർക്കും മെഡിക്കൽ പ്രൊഫഷണലുകൾക്കും വൈവിധ്യമാർന്ന ദോഷകരമല്ലാത്ത ജോലികൾക്കായി Fable 5-ന്റെ പൂർണ്ണമായ യുക്തിസഹമായ കഴിവുകൾ പ്രയോജനപ്പെടുത്താൻ അനുവദിക്കുന്നു. ലാബ് ഫലങ്ങൾ വിശകലനം ചെയ്യുക, ക്ലിനിക്കൽ ലക്ഷണങ്ങൾ പരിശോധിക്കുക, സങ്കീർണ്ണമായ വൈദ്യശാസ്ത്ര ചോദ്യങ്ങൾക്ക് ഉത്തരം കണ്ടെത്തുക തുടങ്ങിയ ജോലികൾ, മുൻപ് ഉൽപ്പാദനക്ഷമതയെ തടസ്സപ്പെടുത്തിയിരുന്ന "സുരക്ഷാ മതിൽ" (safety wall) നേരിടാതെ തന്നെ ഇപ്പോൾ ചെയ്യാൻ ഉപയോക്താക്കൾക്ക് സാധിക്കും.

ഇരട്ട ഉപയോഗ സാധ്യതയുള്ള (Dual-Use) അപകടസാധ്യതകളിൽ നിയന്ത്രണം നിലനിർത്തുന്നു

പൊതുവായ ബയോളജി നിയന്ത്രണങ്ങളിൽ ഇളവ് വരുത്തിയിട്ടുണ്ടെങ്കിലും, "ഇരട്ട ഉപയോഗ സാധ്യതയുള്ള" (dual-use) ഗവേഷണങ്ങളിൽ—അതായത് ദോഷകരമായ കാര്യങ്ങൾക്കായി ഉപയോഗിക്കാൻ സാധ്യതയുള്ള വിവരങ്ങൾ—Anthropic കർശനമായ നിലപാട് സ്വീകരിക്കുന്നു. വൈറോളജി, ടോക്സിക്കോളജി, അഡ്വാൻസ്ഡ് മോളിക്യുലാർ ഡിസൈൻ തുടങ്ങിയ അതീവ സെൻസിറ്റീവ് ആയ വിഷയങ്ങളിലെ നിയന്ത്രണങ്ങൾ കമ്പനി നീക്കം ചെയ്തിട്ടില്ല.

ജൈവ ഭീഷണികളുടെ സവിശേഷമായ സ്വഭാവമാണ് Anthropic-ന്റെ ഈ തീരുമാനത്തിന് പിന്നിലെ കാരണം. ഒരു സൈബർ ആക്രമണത്തെ പാച്ചുകളിലൂടെയോ (patches) സിസ്റ്റം ഷട്ട്ഡൗണിലൂടെയോ തടയാനാവുമെങ്കിലും, ഒരിക്കൽ പുറത്തുവിടപ്പെട്ട ഒരു ജൈവ ഏജന്റിനെ (biological agent) അതിന്റെ വ്യാപനം തടയാൻ പ്രയാസമാണ്. ഈ ജാഗ്രതയ്ക്ക് കാരണമായ ചില പ്രധാന ആശങ്കകൾ കമ്പനി ചൂണ്ടിക്കാട്ടുന്നു:

  • ജൈവപരമായ അപകടസാധ്യതകളെക്കുറിച്ചുള്ള യു.എസ് ഇന്റലിജൻസ് ഏജൻസികളുടെ വിശകലനങ്ങൾ.
  • പൂർണ്ണമായും കൃത്രിമമായി നിർമ്മിച്ച വൈറസുകൾ രൂപകൽപ്പന ചെയ്യാൻ AI ഉപയോഗിക്കാമെന്ന് തെളിയിക്കുന്ന ഗവേഷണങ്ങൾ.
  • നിലവിലുള്ള LLM-കളിൽ നിന്ന് ജൈവ ആയുധ നിർമ്മാണത്തിനുള്ള നിർദ്ദേശങ്ങൾ ചോദിച്ചെടുക്കാൻ ഉപയോക്താക്കൾ നടത്തിയ ശ്രമങ്ങൾ.

സുരക്ഷയും പ്രത്യേക ആക്സസും തമ്മിലുള്ള സന്തുലിതാവസ്ഥ

തുറന്ന ശാസ്ത്രീയ പുരോഗതിയും വലിയ ദുരന്തങ്ങൾ ഉണ്ടാക്കാൻ സാധ്യതയുള്ള ദുരുപയോഗവും തമ്മിലുള്ള സംഘർഷം പരിഹരിക്കുക എന്നത് AI ലാബുകളുടെ മുന്നിലുള്ള വലിയ വെല്ലുവിളിയാണ്. പ്രത്യേക ആക്സസ് പ്രോഗ്രാമുകൾ വികസിപ്പിച്ചുകൊണ്ട് Anthropic ഇതിന് പരിഹാരം കാണാൻ ശ്രമിക്കുന്നു. സാക്ഷ്യപ്പെടുത്തിയ ഗവേഷകർക്ക് നിയന്ത്രിതവും ഓഡിറ്റ് ചെയ്തതുമായ ഒരു സാഹചര്യത്തിനുള്ളിൽ വൈറോളജി അല്ലെങ്കിൽ മോളിക്യുലാർ മോഡലിംഗ് പോലുള്ള നിയന്ത്രിത ഫീച്ചറുകൾ ഉപയോഗിക്കാൻ ഈ പ്രോഗ്രാമുകൾ രൂപകൽപ്പന ചെയ്തിരിക്കുന്നു.

ദോഷകരമല്ലാത്ത വൈദ്യശാസ്ത്രപരമായ അന്വേഷണങ്ങളും അപകടകരമായ ഇരട്ട ഉപയോഗ ഗവേഷണങ്ങളും തമ്മിലുള്ള വ്യത്യാസം തിരിച്ചറിഞ്ഞുകൊണ്ട്, ആധുനിക വൈദ്യശാസ്ത്രത്തിനുള്ള ഉപകരണങ്ങൾ അപ്രതീക്ഷിതമായി ബയോടെററിസത്തിന്റെ (bioterrorism) ഉപകരണങ്ങളായി മാറുന്നില്ലെന്ന് ഉറപ്പാക്കാൻ Anthropic ശ്രമിക്കുന്നു.

പ്രധാന കാര്യങ്ങൾ

  • തെറ്റായ തിരിച്ചറിയലുകളിൽ 85% കുറവ്: നിയമാനുസൃതമായ ബയോളജി സംബന്ധിയായ ചോദ്യങ്ങൾക്കുള്ള തടസ്സങ്ങൾ Anthropic ഗണ്യമായി കുറച്ചു, ഇത് ഉപയോക്താക്കളെ കുറഞ്ഞ ശേഷിയുള്ള Opus 5-ൽ നിന്ന് മോഡലിന്റെ പൂർണ്ണ ശേഷിയിലേക്ക് തിരികെ കൊണ്ടുവരുന്നു.
  • ഉയർന്ന അപകടസാധ്യതയുള്ള മേഖലകളിൽ കർശനമായ നിയന്ത്രണങ്ങൾ: ജൈവ ആയുധങ്ങളുടെ നിർമ്മാണം തടയുന്നതിനായി വൈറോളജി, ടോക്സിക്കോളജി, മോളിക്യുലാർ ഡിസൈൻ എന്നിവയിൽ കർശനമായ നിയന്ത്രണങ്ങൾ നിലനിൽക്കുന്നു.
  • ഗവേഷകർക്കായി നിയന്ത്രിത ആക്സസ്: നിയമാനുസൃതമായ ഗവേഷണത്തിന് ആവശ്യമായ നിയന്ത്രിത കഴിവുകൾ അംഗീകൃത ശാസ്ത്രജ്ഞർക്ക് നൽകുന്നതിനായി Anthropic പ്രത്യേക ആക്സസ് പ്രോഗ്രാമുകൾ വികസിപ്പിക്കുന്നു.

Anthropic അതിന്റെ Fable 5 മോഡലിലെ ദോഷകരമല്ലാത്ത ജൈവ സംബന്ധിയായ ചോദ്യങ്ങളിലെ തെറ്റായ ബ്ലോക്കുകൾ ഏകദേശം 85 ശതമാനം കുറച്ചു, ഇത് ഗവേഷകർക്ക് മോഡലിന്റെ പൂർണ്ണമായ യുക്തിസഹമായ കഴിവുകൾ ഉപയോഗിക്കാൻ അവസരമൊരുക്കുന്നു. ഈ മാറ്റം ഇരട്ട ഉപയോഗ സാധ്യതയുള്ള ജൈവ വിഷയങ്ങളിൽ കർശനമായ സുരക്ഷാ മാനദണ്ഡങ്ങൾ നിലനിർത്തുന്നു, കൂടാതെ ജൈവ ആയുധ നിർമ്മാണത്തിന് സഹായിക്കുന്ന നിർദ്ദേശങ്ങൾ നൽകുന്നതിൽ നിന്ന് മോഡലിനെ തടയുകയും ചെയ്യുന്നു.

എന്തുകൊണ്ടാണ് ഈ അപ്‌ഡേറ്റ് പ്രസക്തമാകുന്നത്

Fable 5-ന്റെ സുരക്ഷാ പാളി യഥാർത്ഥത്തിൽ മുൻകരുതൽ എടുക്കുന്ന രീതിയിൽ ക്രമീകരിച്ചിരുന്നതാണ്, ഇത് വലിയൊരു വിഭാഗം നിയമാനുസൃതമായ ശാസ്ത്രീയ ചോദ്യങ്ങളെ ഉയർന്ന അപകടസാധ്യതയുള്ളവയായി അടയാളപ്പെടുത്തിയിരുന്നു. സാധാരണ ലാബ് ഫലങ്ങൾ വിശകലനം ചെയ്യാനോ ക്ലിനിക്കൽ ലക്ഷണങ്ങൾ പരിശോധിക്കാനോ ആവശ്യപ്പെട്ട ഉപയോക്താക്കളെ പതിവായി കുറഞ്ഞ ശേഷിയുള്ള Opus 5 മോഡലിലേക്ക് തിരിച്ചുവിടുകയായിരുന്നു ചെയ്തിരുന്നത്. ഈ അമിതമായ തടസ്സങ്ങൾ ശാസ്ത്രീയ സമൂഹത്തിൽ നിന്ന് വിമർശനങ്ങൾക്കും കാരണമായി. ഇത് യഥാർത്ഥ ഗവേഷണങ്ങളെ തടസ്സപ്പെടുത്തുകയും വൈദ്യശാസ്ത്രപരമായ തീരുമാനങ്ങൾ എടുക്കുന്നത് സാവധാനത്തിലാക്കുകയും ചെയ്യുന്നു എന്ന് അവർ വാദിച്ചു. തെറ്റായ തിരിച്ചറിയൽ നിരക്ക് ഏകദേശം നാലിലൊന്ന് ഭാഗമായി കുറയ്ക്കുന്നതിലൂടെ, മോഡലിന്റെ അത്യാധുനിക യുക്തിസഹമായ കഴിവുകൾ ഡോക്ടർമാർക്കും ജീവശാസ്ത്രജ്ഞർക്കും മറ്റ് പ്രൊഫഷണലുകൾക്കും അവരുടെ ദൈനംദിന ജോലികൾക്കായി തിരികെ നൽകാൻ Anthropic ലക്ഷ്യമിടുന്നു.

ഫിൽട്ടറുകളിൽ വരുത്തിയ മാറ്റങ്ങൾ

സാധാരണ ബയോമെഡിക്കൽ ചോദ്യങ്ങളും, ദോഷകരമായ ആവശ്യങ്ങൾക്കായി ഉപയോഗിക്കാൻ സാധ്യതയുള്ള "dual-use" ഗവേഷണങ്ങളെക്കുറിച്ചുള്ള ചോദ്യങ്ങളും തമ്മിൽ വേർതിരിച്ചറിയാൻ കഴിയുന്ന രീതിയിൽ പുതുക്കിയ ഒരു ക്ലാസിഫയർ വഴിയാണ് ഈ പുരോഗതി ഉണ്ടായത്. പുതിയ ക്ലാസിഫയർ ഇപ്പോഴും വൈറോളജി, ടോക്സിക്കോളജി, അഡ്വാൻസ്ഡ് മോളിക്യുലാർ ഡിസൈൻ എന്നിവയുമായി ബന്ധപ്പെട്ട അഭ്യർത്ഥനകൾ തടയുന്നുണ്ടെങ്കിലും, സാധാരണ രോഗനിർണ്ണയം, ലക്ഷണങ്ങൾ തരംതിരിക്കൽ (symptom triage), ഡാറ്റാ വ്യാഖ്യാനം എന്നിവയെക്കുറിച്ചുള്ള ചോദ്യങ്ങൾ അനുവദിക്കുന്നു.

ബയോളജിക്കൽ ഭീഷണികൾ സൈബർ ഭീഷണികളിൽ നിന്ന് വ്യത്യസ്തമാണെന്ന് Anthropic-ന്റെ എഞ്ചിനീയർമാർ നിരീക്ഷിച്ചു: ഒരിക്കൽ ഒരു പതജൻ (pathogen) പുറത്തുവിട്ടാൽ, അത് പാച്ച് ചെയ്യാനോ അല്ലെങ്കിൽ നിർത്താനോ കഴിയില്ല. ഈ യാഥാർത്ഥ്യമാണ് ഉയർന്ന റിസ്ക് ഉള്ള മേഖലകളിൽ കർശനമായ നിലപാട് സ്വീകരിക്കാനും എന്നാൽ സാധാരണ വൈദ്യശാസ്ത്രപരമായ അന്വേഷണങ്ങളിൽ നിയന്ത്രണങ്ങൾ ലഘൂകരിക്കാനും തീരുമാനമെടുക്കാൻ പ്രേരിപ്പിച്ചത്.

നിരോധിക്കപ്പെട്ടവ

ദോഷകരമായ ഏജന്റുകളുടെ നിർമ്മാണത്തിന് സഹായിക്കുന്ന അഭ്യർത്ഥനകൾ ഈ മോഡൽ നിരസിക്കുന്നത് തുടരും. പ്രത്യേകിച്ച്, താഴെ പറയുന്നവ ആവശ്യപ്പെടുന്ന പ്രോംപ്റ്റുകൾ:

  • വൈറസ് നിർമ്മാണത്തിന് സഹായിക്കുന്ന വിശദമായ വൈറോളജി പ്രോട്ടോക്കോളുകൾ,
  • ആയുധമാക്കാൻ കഴിയുന്ന രാസവസ്തുക്കളുടെ ടോക്സിക്കോളജി പാതകൾ, അല്ലെങ്കിൽ
  • ഘട്ടം ഘട്ടമായുള്ള മോളിക്യുലാർ എഞ്ചിനീയറിംഗ് നിർദ്ദേശങ്ങൾ.

ഈ മുൻകരുതലിനായി Anthropic മൂന്ന് സ്രോതസ്സുകളെ ഉദ്ധരിച്ചു: ജൈവപരമായ അപകടസാധ്യതകൾ ചൂണ്ടിക്കാണിക്കുന്ന യുഎസ് ഇന്റലിജൻസ് ഏജൻസികളുടെ വിശകലനങ്ങൾ, AI-ക്ക് പൂർണ്ണമായും സിന്തറ്റിക് വൈറസുകൾ രൂപകൽപ്പന ചെയ്യാൻ കഴിയുമെന്ന് കാണിക്കുന്ന ഗവേഷണങ്ങൾ, കൂടാതെ നിലവിലുള്ള ലാംഗ്വേജ് മോഡലുകളിൽ നിന്ന് ബയോവെപ്പൺ നിർദ്ദേശങ്ങൾ ചോദിച്ചറിയാൻ ഉപയോക്താക്കൾ നടത്തിയ രേഖപ്പെടുത്തപ്പെട്ട ശ്രമങ്ങൾ.

പരിശോധിക്കപ്പെട്ട ശാസ്ത്രജ്ഞർക്കായുള്ള ആക്സസ് പ്രോഗ്രാം

തുറന്ന ഗവേഷണവും സുരക്ഷയും തമ്മിൽ സന്തുലിതാവസ്ഥ നിലനിർത്തുന്നതിനായി Anthropic ഒരു പ്രത്യേക ആക്സസ് പ്രോഗ്രാം അവതരിപ്പിക്കുന്നു. പരിശോധിക്കപ്പെട്ട ഗവേഷകർക്ക് നിയന്ത്രിത സാഹചര്യങ്ങളിൽ (controlled environment) ഈ പരിമിതപ്പെടുത്തപ്പെട്ട കഴിവുകൾ ഉപയോഗിക്കാൻ അപേക്ഷിക്കാം. അപകടകരമായ നിർദ്ദേശങ്ങൾ പൊതുജനങ്ങളിലേക്ക് എത്താതിരിക്കെ തന്നെ, പുതിയ വാക്സിൻ പ്ലാറ്റ്‌ഫോമുകൾ അല്ലെങ്കിൽ പതജൻ മോഡലിംഗ് പോലുള്ള ഉയർന്ന റിസ്ക് ഉള്ള വിഷയങ്ങൾ നിയമപരമായ ശാസ്ത്രജ്ഞർക്ക് പര്യവേക്ഷണം ചെയ്യാൻ പാകത്തിലാണ് ഈ പ്രോഗ്രാം രൂപകൽപ്പന ചെയ്തിരിക്കുന്നത്.

ചുരുക്കത്തിൽ

കർശനമായ "dual-use" നിരോധനങ്ങൾ നിലനിർത്തിക്കൊണ്ടുതന്നെ, തെറ്റായ തടസ്സങ്ങൾ (false-positive blocks) 85% കുറയ്ക്കുന്നതിലൂടെ, ബയോവെപ്പൺ രൂപകൽപ്പനയ്ക്കുള്ള വാതിൽ തുറക്കാതെ തന്നെ ഗവേഷകർക്ക് അതിന്റെ ഏറ്റവും മികച്ച മോഡലിന്റെ കരുത്ത് നൽകാൻ Anthropic ലക്ഷ്യമിടുന്നു. ഈ കൃത്യതയാർന്ന സുരക്ഷാ തന്ത്രത്തിന്റെ വിജയം, മറ്റ് നിർണ്ണായകമായ ശാസ്ത്രമേഖലകളിൽ ഫ്രോണ്ടിയർ AI മോഡലുകൾ എങ്ങനെ പ്രവർത്തിക്കണം എന്നതിന് ഒരു മാതൃകയാകും.