Nous Research പുറത്തിറക്കിയ ഒരു ഓപ്പൺ സോഴ്സ് AI അസിസ്റ്റന്റ് ഫ്രെയിംവർക്കായ Hermes Agent, ഡെവലപ്പർമാർക്ക് അവരുടെ സ്വന്തം മെഷീനിലോ സെർവറിലോ ഒരു പേഴ്സണൽ അസിസ്റ്റന്റ് പ്രവർത്തിപ്പിക്കാനും ആവശ്യമായ ടൂളുകൾ ഇതിലേക്ക് ഘടിപ്പിക്കാനും അനുവദിക്കുന്നു. ഇതിന്റെ കോഡ് GitHub-ൽ ലഭ്യമാണ്.
എന്തുകൊണ്ടാണ് ഒരു പുതിയ ഫ്രെയിംവർക്ക് പ്രസക്തമാകുന്നത്
ഉപഭോക്താക്കൾക്കായി രൂപകൽപ്പന ചെയ്തിട്ടുള്ള മിക്ക അസിസ്റ്റന്റുകളും അവയുടെ പ്രവർത്തനരീതികൾ പ്രൊപ്രൈറ്ററി (proprietary) API-കൾക്ക് പിന്നിൽ ഒളിപ്പിച്ചു വെച്ചിരിക്കുകയാണ്. നിങ്ങൾ ഒരു പ്രോംപ്റ്റ് അയക്കുന്നു, ഏത് മോഡൽ ഉപയോഗിക്കണം എന്നും ഏത് നടപടികൾ സ്വീകരിക്കണം എന്നും ആ സേവനം തീരുമാനിക്കുന്നു, തുടർന്ന് നിങ്ങൾക്ക് പരിശോധിക്കാനോ മാറ്റം വരുത്താനോ കഴിയാത്ത ഒരു മറുപടി ലഭിക്കുന്നു. ഇത് സാധാരണ ഉപഭോക്താക്കൾക്ക് അനുയോജ്യമാണെങ്കിലും, വർക്ക്ഫ്ലോകൾ ഓട്ടോമേറ്റ് ചെയ്യാനോ, സ്വകാര്യ ഡാറ്റാ സ്റ്റോറുകളുമായി സംയോജിപ്പിക്കാനോ, കർശനമായ സുരക്ഷാ നയങ്ങൾ നടപ്പിലാക്കാനോ ആഗ്രഹിക്കുന്ന ഡെവലപ്പർമാരെ ഇത് നിരാശപ്പെടുത്തുന്നു. Hermes Agent ഈ രീതിയെ തിരുത്തുന്നു: ഇത് ഉപയോക്താവിനും ലാംഗ്വേജ് മോഡലിനും ഇടയിൽ ഇരിക്കുന്നു, തീരുമാനമെടുക്കുന്ന പ്രക്രിയ വെളിപ്പെടുത്തുകയും നിങ്ങൾക്ക് ഇഷ്ടമുള്ള "ടൂളുകൾ" – സ്ക്രിപ്റ്റുകൾ, ഫയൽ-സിസ്റ്റം കമാൻഡുകൾ അല്ലെങ്കിൽ തേർഡ് പാർട്ടി സേവനങ്ങൾ – ഏജന്റിന് വേണ്ടി പ്രവർത്തിപ്പിക്കാൻ അനുവദിക്കുകയും ചെയ്യുന്നു.
ഇതിന്റെ പ്രായോഗിക നേട്ടം ഉടനടി ലഭിക്കുന്നതാണ്. ഒരു ഡെവലപ്പർക്ക് Hermes ലോഞ്ച് ചെയ്യാനും, അത് ഒരു ലോക്കൽ LLM-ലേക്കോ അല്ലെങ്കിൽ OpenRouter പോലുള്ള ഒരു API-ലേക്കോ ബന്ധിപ്പിക്കാനും, തുടർന്ന് ഒരു ലോഗ് ഫയൽ പരിശോധിക്കാനോ (grep), സ്റ്റാറ്റിക്-അനാലിസിസ് ടൂൾ പ്രവർത്തിപ്പിക്കാനോ, അല്ലെങ്കിൽ ഒരു Docker കണ്ടെയ്നർ സജ്ജീകരിക്കാനോ ആവശ്യപ്പെടാം. ഏജന്റ് സംഭാഷണത്തിന്റെ പശ്ചാത്തലം (context) ഓർമ്മിച്ചുവെക്കുകയും, ഏത് ടൂൾ ആണ് ആവശ്യത്തിന് അനുയോജ്യമെന്ന് തീരുമാനിക്കുകയും, ഒരു ഘടനയുള്ള (structured) മറുപടി നൽകുകയും ചെയ്യുന്നു. ചുരുക്കത്തിൽ, ഇത് "മറുപടി മാത്രം നൽകുന്ന" ചാറ്റ്ബോട്ടുകളിൽ നിന്ന് "പ്രവർത്തനങ്ങൾ നടത്തുന്ന" (action-oriented) അസിസ്റ്റന്റുകളിലേക്ക് മാറുന്നു.
എങ്ങനെയാണ് Hermes Agent നിർമ്മിച്ചിരിക്കുന്നത്
- Core – ഉപയോക്താവിന്റെ ഇൻപുട്ട് സ്വീകരിക്കുകയും, സംഭാഷണ ചരിത്രം ട്രാക്ക് ചെയ്യുകയും, മോഡലിന്റെ നിർദ്ദേശത്തിന്റെ അടിസ്ഥാനത്തിൽ അനുയോജ്യമായ ടൂൾ തിരഞ്ഞെടുക്കുകയും ചെയ്യുന്ന ഓർക്കസ്ട്രേറ്റർ.
- Model – ഉദ്ദേശ്യവും (intent) സാധ്യമായ നടപടികളും നിർമ്മിക്കുന്ന ലാംഗ്വേജ് മോഡൽ. ലോക്കൽ ആയി ഹോസ്റ്റ് ചെയ്ത ഓപ്പൺ സോഴ്സ് LLM മുതൽ ഒരു ക്ലൗഡ് എൻഡ്പോയിന്റ് വരെ നിങ്ങൾക്ക് നിയന്ത്രിക്കാൻ കഴിയുന്ന ഏത് മോഡലും ഇതിലേക്ക് ഘടിപ്പിക്കാം.
- Tools – പ്രവർത്തിപ്പിക്കാവുന്ന നടപടികൾക്കുള്ള ലളിതമായ കവചങ്ങൾ (wrappers). ഒരു ടൂളിന് ഒരു ഫയൽ വായിക്കാനോ, ഒരു REST API വിളിക്കാനോ, അല്ലെങ്കിൽ ഒരു ഷെൽ കമാൻഡ് പ്രവർത്തിപ്പിക്കാനോ കഴിയും. ഒരു പുതിയ ടൂൾ ചേർക്കുന്നത് ഒരു പൈത്തൺ (Python) ഫംഗ്ഷൻ എഴുതി അത് ഫ്രെയിംവർക്കിൽ രജിസ്റ്റർ ചെയ്യുന്നത് പോലെ ലളിതമാണ്.
- Skills – ഏജന്റിന് സിസ്റ്റം-അഡ്മിനിസ്ട്രേഷൻ സഹായം അല്ലെങ്കിൽ കോഡ്-റിവ്യൂ ഓട്ടോമേഷൻ പോലുള്ള പ്രത്യേക മേഖലകളിലുള്ള കഴിവുകൾ നൽകുന്ന അനുബന്ധ ടൂളുകളുടെ ശേഖരം.
ഈ ആർക്കിടെക്ചർ മൂന്ന് കാര്യങ്ങളെയും വേർതിരിച്ചു നിർത്തുന്നു: മോഡൽ ടെക്സ്റ്റ് രൂപത്തിൽ മാത്രം നിലനിൽക്കുന്നു, കോർ (core) പ്രവർത്തനങ്ങൾ നിയന്ത്രിക്കുന്നു, ടൂളുകൾ പ്രധാന ജോലികൾ ചെയ്യുന്നു. ഈ വേർതിരിക്കൽ കാരണം സിസ്റ്റം തകരാതെ തന്നെ ഘടകങ്ങൾ എളുപ്പത്തിൽ മാറ്റാൻ സാധിക്കുന്നു.
Hermes എങ്ങനെ പ്രവർത്തിപ്പിക്കാം
- റിപ്പോസിറ്ററി ക്ലോൺ ചെയ്യുക –
git clone https://github.com/NousResearch/hermes-agent.git - ഡയറക്ടറിയിലേക്ക് പ്രവേശിക്കുക –
cd hermes-agent - ഡിപെൻഡൻസികൾ ഇൻസ്റ്റാൾ ചെയ്യുക –
pip install -r requirements.txt - എൻവയോൺമെന്റ് കോൺഫിഗർ ചെയ്യുക –
.env.exampleഫയൽ.envആയി കോപ്പി ചെയ്യുക, ആവശ്യമായ API കീകൾ (OpenRouter അല്ലെങ്കിൽ നിങ്ങൾ ഉപയോഗിക്കാൻ ഉദ്ദേശിക്കുന്ന മറ്റ് സേവനങ്ങൾക്കായി) നൽകുക. - ലോഞ്ച് ചെയ്യുക – കമാൻഡ് ലൈനിൽ നിന്ന്
hermesപ്രവർത്തിപ്പിക്കുക.
അസിസ്റ്റന്റിനെ വികസിപ്പിക്കുക
പുതിയൊരു കഴിവ് ചേർക്കുന്നത് മൂന്ന് ഘട്ടങ്ങളുള്ള ഒരു രീതിയാണ്:
സുരക്ഷാ കാര്യങ്ങൾ
കമാൻഡുകൾ പ്രവർത്തിപ്പിക്കാൻ കഴിയുന്ന ഒരു AI ഏജന്റ് ഒരു പ്രിവിലെജ്ഡ് യൂസറെപ്പോലെ (privileged user) പ്രവർത്തിക്കുന്നു. .env ഫയലിൽ API കീകൾ വെളിപ്പെടുത്തുന്നതോ ഏജന്റിന് നിയന്ത്രണങ്ങളില്ലാത്ത ഫയൽ-സിസ്റ്റം ആക്സസ് നൽകുന്നതോ, മോഡൽ ഹാക്ക് ചെയ്യപ്പെടുകയോ അല്ലെങ്കിൽ തെറ്റായ പ്രോംപ്റ്റുകൾ കടന്നുവരികയോ ചെയ്താൽ സുരക്ഷാ ഭീഷണി ഉയർത്താം. ഈ റിസ്ക് കുറയ്ക്കാൻ:
- നിർണ്ണായകമായ സേവനങ്ങളിൽ നിന്ന് ഒറ്റപ്പെട്ട ഒരു കണ്ടെയ്നറിനുള്ളിലോ (container) അല്ലെങ്കിൽ ഒരു വെർച്വൽ മെഷീനുള്ളിലോ ഏജന്റിനെ പ്രവർത്തിപ്പിക്കുക.
- രഹസ്യ വിവരങ്ങൾ (secrets) എൻവയോൺമെന്റ് വേരിയബിളുകളിൽ സൂക്ഷിക്കുക, സാധ്യമാകുന്നിടത്തോളം അവ റീഡ്-ഓൺലി (read-only) ആയി ക്രമീകരിക്കുക.
- നിങ്ങളുടെ വർക്ക്ഫ്ലോയ്ക്ക് ആവശ്യമായ ഏറ്റവും കുറഞ്ഞ ടൂളുകൾ മാത്രം രജിസ്റ്റർ ചെയ്യുക.
- അപ്രതീക്ഷിതമായ ടൂൾ ഉപയോഗങ്ങൾ കണ്ടെത്താൻ ഏജന്റിന്റെ ലോഗുകൾ കൃത്യമായി പരിശോധിക്കുക.
ഗുണദോഷങ്ങൾ: തുറന്ന സമീപനവും സൗകര്യവും തമ്മിലുള്ള വ്യത്യാസം
Hermes Agent-ന്റെ തുറന്ന സമീപനം ഡെവലപ്പർമാർക്ക് പൂർണ്ണ നിയന്ത്രണം നൽകുന്നു, എന്നാൽ ഹോസ്റ്റഡ് അസിസ്റ്റന്റുകൾ നൽകുന്ന എളുപ്പത്തിലുള്ള അനുഭവം (turnkey experience) ഇതിൽ ലഭിക്കില്ല എന്നതിനർത്ഥമുണ്ട്. മോഡൽ അപ്ഡേറ്റുകൾ, സ്കെയിലിംഗ്, സുരക്ഷാ പാച്ചുകൾ എന്നിവ നിങ്ങൾ തന്നെ കൈകാര്യം ചെയ്യണം. ഡെഡിക്കേറ്റഡ് DevOps റിസോഴ്സുകൾ ഇല്ലാത്ത ടീമുകൾക്ക് മാനേജ്ഡ് സർവീസുകൾ (managed services) കൂടുതൽ താൽപ്പര്യമുണ്ടാകാം.
നേരെമറിച്ച്, സെൻസിറ്റീവ് ഡാറ്റ കൈകാര്യം ചെയ്യുന്ന സംരംഭങ്ങൾക്ക് (enterprises), തീരുമാനമെടുക്കുന്ന ഓരോ ഘട്ടവും പരിശോധിക്കാൻ കഴിയുന്നത് വളരെ പ്രധാനമാണ്. ഇതിന്റെ മോഡുലാർ ഡിസൈൻ കമ്മ്യൂണിറ്റി പങ്കാളിത്തത്തിന് വഴിയൊരുക്കുന്നു, ഇത് ഏതൊരു ഒറ്റ കമ്പനിയെക്കാളും വേഗത്തിൽ ടൂൾ ഇക്കോസിസ്റ്റം വളരാൻ സഹായിച്ചേക്കാം.
നിലവിൽ, സ്വന്തം ഹാർഡ്വെയറിൽ പ്രവർത്തിക്കുന്ന, പ്രത്യേക വർക്ക്ഫ്ലോകൾക്കായി രൂപപ്പെടുത്താൻ കഴിയുന്ന, സുതാര്യമായ ഒരു AI അസിസ്റ്റന്റ് ആഗ്രഹിക്കുന്നവർക്ക് ഈ ഫ്രെയിംവർക്ക് ഒരു വ്യക്തമായ പാത വാഗ്ദാനം ചെയ്യുന്നു. അടുത്ത ഘട്ടം ലളിതമാണ്: റിപ്പോസിറ്ററി ക്ലോൺ ചെയ്യുക, അത് പ്രവർത്തിപ്പിക്കുക, കൂടാതെ എല്ലാ ആഴ്ചയും നിങ്ങൾ മണിക്കൂറുകൾ ചിലവഴിക്കുന്ന ജോലികൾ എങ്ങനെ ചെയ്യണമെന്ന് നിങ്ങളുടെ പുതിയ അസിസ്റ്റന്റിനെ പഠിപ്പിക്കാൻ തുടങ്ങുക.
