ഒരു സെമി-ഓട്ടോണമസ് (semi-autonomous), നാല് ഏജന്റുകൾ അടങ്ങിയ പൈപ്പ്ലൈൻ ഉപയോഗിക്കുന്നതിലൂടെ എക്സ്പ്ലോറേറ്ററി ഡാറ്റ അനാലിസിസിലെ (EDA) ഹാലുസിനേഷനുകൾ (hallucinations) കുറയ്ക്കാൻ സാധിക്കും. ഇതിനായി ലാർജ് ലാംഗ്വേജ് മോഡലുകളെ (LLMs) കണക്കുകൂട്ടലുകളിൽ നിന്ന് മാറ്റി വെച്ച്, തീരുമാനങ്ങൾ എടുക്കുന്ന കാര്യങ്ങളിൽ മാത്രം കേന്ദ്രീകരിക്കുന്നു. ഈ ഡിസൈൻ പ്രകാരം, എന്ത് പരിശോധിക്കണം എന്ന് മോഡൽ തീരുമാനിക്കുന്നു, എന്നാൽ യഥാർത്ഥ കണക്കുകൂട്ടലുകൾ ഒരു സാൻഡ്ബോക്സിൽ (sandbox) പ്രവർത്തിക്കുന്ന കോഡ് ചെയ്യുന്നു. ഇത് ഘട്ടം ഘട്ടമായി പരിശോധിക്കാവുന്ന ഫലങ്ങൾ നൽകുന്നു.
എന്തുകൊണ്ടാണ് ഒരു സിംഗിൾ LLM കോൾ അപകടസാധ്യതയുള്ളതാകുന്നത്
"ഈ സ്പ്രെഡ്ഷീറ്റ് നോക്കി ഇതിൽ രസകരമായ കാര്യങ്ങൾ എന്താണെന്ന് പറയൂ" എന്ന് ഒരു LLM-നോട് ആവശ്യപ്പെടുമ്പോൾ ലഭിക്കുന്നത് ഒരു ടെക്സ്റ്റ് ബ്ലോക്ക് മാത്രമാണ്. മോഡൽ നമ്പറുകൾ സ്വയം നിർമ്മിക്കുകയും, യുക്തിയും ഔട്ട്പുട്ടും തമ്മിൽ കൂട്ടിക്കലർത്തുകയും ചെയ്യുന്നു, കൂടാതെ ഒരു നിഗമനത്തിൽ എങ്ങനെ എത്തിച്ചേർന്നു എന്നതിന്റെ തെളിവുകളൊന്നും നൽകുന്നതുമില്ല. മോഡൽ തെറ്റായ വിവരങ്ങൾ (hallucinations) നൽകുകയാണെങ്കിൽ—അതായത് വ്യാജമായ സ്ഥിതിവിവരക്കണക്കുകളോ തെറ്റായ ബന്ധങ്ങളോ (spurious correlation)—ഉപയോക്താവിലേക്ക് എത്തുന്നതിന് മുമ്പ് അത് പിടികൂടാൻ ഒരു സംവിധാനവുമില്ല.
ഒരു സെമി-ഓട്ടോണമസ് പൈപ്പ്ലൈനിന് പിന്നിലെ ആശയം
പുതിയ വർക്ക്ഫ്ലോ EDA-യെ നാല് നിശ്ചിത ഘട്ടങ്ങളായി തിരിക്കുന്നു, ഓരോ ഘട്ടവും ഓരോ ഏജന്റാണ് കൈകാര്യം ചെയ്യുന്നത്. ഈ ഏജന്റുകൾ "പ്ലാൻ-ദെൻ-ആക്ട്" (plan-then-act) എന്ന രീതിയാണ് പിന്തുടരുന്നത്: ആദ്യം ഏത് ഓപ്പറേഷൻ ആണ് വേണ്ടതെന്ന് അവർ തീരുമാനിക്കുന്നു, തുടർന്ന് അത് പ്രവർത്തിപ്പിക്കാനായി സാൻഡ്ബോക്സ് കോഡിന് കൈമാറുന്നു. LLM ഒരിക്കലും കണക്കുകൂട്ടലുകളോ ഫയൽ കൈകാര്യം ചെയ്യലോ ചെയ്യുന്നില്ല; പ്രസക്തിയെക്കുറിച്ചുള്ള തീരുമാനങ്ങൾ മാത്രമേ അത് എടുക്കുന്നുള്ളൂ.
നാല് ഏജന്റുകൾ
- ഡാറ്റാ-ക്ലീനിംഗ് ഏജന്റ് – കോളങ്ങളുടെ തരങ്ങൾ പരിശോധിക്കുന്നു, വിട്ടുപോയ മൂല്യങ്ങളെ (missing values) അടയാളപ്പെടുത്തുന്നു, കൂടാതെ ഇംപ്യൂട്ടേഷൻ (imputation) അല്ലെങ്കിൽ ടൈപ്പ് കൺവേർഷൻ തന്ത്രങ്ങൾ തീരുമാനിക്കുന്നു.
- കോളൺ-അനാലിസിസ് ഏജന്റ് – ഓരോ വേരിയബിളിന്റെയും ഡാറ്റാ ടൈപ്പ്, വിതരണം (distribution) എന്നിവയുടെ അടിസ്ഥാനത്തിൽ അനുയോജ്യമായ വിഷ്വലൈസേഷനുകൾ (ഹിസ്റ്റോഗ്രാമുകൾ, ബോക്സ് പ്ലോട്ടുകൾ മുതലായവ) തിരഞ്ഞെടുക്കുന്നു.
- റിലേഷൻഷിപ്പ്-അനാലിസിസ് ഏജന്റ് – ഓരോ ജോഡി കോളങ്ങളെയും വിലയിരുത്തുന്നു, ഏതെല്ലാം ജോഡികൾക്ക് കൂടുതൽ സ്റ്റാറ്റിസ്റ്റിക്കൽ ടെസ്റ്റുകൾ ആവശ്യമാണെന്ന് തീരുമാനിക്കുന്നു, അവയെ ലഭിക്കാവുന്ന ഉൾക്കാഴ്ചകളുടെ (insights) അടിസ്ഥാനത്തിൽ ക്രമീകരിക്കുന്നു.
- റിപ്പോർട്ട്-റൈറ്റിംഗ് ഏജന്റ് – നിർമ്മിച്ച ചാർട്ടുകളെയും കണക്കാക്കിയ സ്ഥിതിവിവരക്കണക്കുകളെയും സ്വാഭാവിക ഭാഷയിലുള്ള വിശദീകരണങ്ങളാക്കി മാറ്റുന്നു, ശ്രദ്ധേയമായ പാറ്റേണുകളും മുന്നറിയിപ്പുകളും ഇതിൽ എടുത്തു കാണിക്കുന്നു.
ഓരോ ഘട്ടവും സ്വതന്ത്രമായി പ്രവർത്തിക്കുന്നതിനാൽ, കോളൺ-അനാലിസിസ്, റിലേഷൻഷിപ്പ്-അനാലിസിസ് ഏജന്റുകൾക്ക് ഒരേസമയം (parallel) പ്രവർത്തിക്കാൻ കഴിയും, ഇത് മൊത്തത്തിലുള്ള സമയ ലാഭത്തിന് സഹായിക്കുന്നു.
സ്വയംഭരണാധികാരം എങ്ങനെ നിയന്ത്രിക്കുന്നു
ഈ പൈപ്പ്ലൈനിന്റെ സുരക്ഷാ നിയമം ലളിതമാണ്: മോഡൽ എഴുതുന്ന ഏതൊരു കോഡും ഹോസ്റ്റ് സിസ്റ്റത്തിൽ നിന്ന് വേർതിരിക്കുന്ന ഒരു സാൻഡ്ബോക്സിനുള്ളിലാണ് പ്രവർത്തിക്കുന്നത്. എക്സിക്യൂഷൻ പരാജയപ്പെട്ടാൽ, ആ പിശക് മോഡലിന് തിരികെ ലഭിക്കും. പൈപ്പ്ലൈൻ നിർത്തുന്നതിന് മുമ്പ് സ്ക്രിപ്റ്റ് തിരുത്താൻ മോഡലിന് രണ്ട് അവസരങ്ങൾ ലഭിക്കും. ഇത് അനാവശ്യമായ ലൂപ്പുകൾ (runaway loops) തടയുകയും മോഡൽ ഒരിക്കലും ഫയലുകൾ നേരിട്ട് കൈകാര്യം ചെയ്യുന്നില്ലെന്ന് ഉറപ്പാക്കുകയും ചെയ്യുന്നു.
എന്ത് കണക്കുകൂട്ടണം എന്ന് തീരുമാനിക്കുന്നതിൽ മാത്രമാണ് മോഡലിന്റെ പങ്ക് എന്നതിനാൽ, യഥാർത്ഥ നമ്പറുകൾ എപ്പോഴും ഡെറ്റർമിനിസ്റ്റിക് (deterministic) കോഡിൽ നിന്നാണ് വരുന്നത്. റിലേഷൻഷിപ്പ്-അനാലിസിസ് ഏജന്റ് "Order ID", "Month" എന്നിവ തമ്മിൽ ബന്ധമുണ്ടെന്ന് സംശയിക്കുകയാണെങ്കിൽ, സാൻഡ്ബോക്സ് ഒരു കോറിലേഷൻ ഫംഗ്ഷൻ പ്രവർത്തിപ്പിക്കുകയും കൃത്യമായ മൂല്യം നൽകുകയും ചെയ്യുന്നു. അതിനുശേഷം മാത്രമേ ആ ബന്ധം കാരണത്താലാണോ (causal) അതോ യാദൃശ്ചികമാണോ (coincidental) എന്ന് മോഡൽ അഭിപ്രായപ്പെടുകയുള്ളൂ.
ഇത് എന്തിനെ പരിഹരിക്കുന്നു – ഇതിന്റെ വെല്ലുവിളികൾ എന്തൊക്കെയാണ്?
ഹാലുസിനേഷനുകൾ കുറയുന്നു. യുക്തിചിന്തയെയും കണക്കുകൂട്ടലുകളെയും വേർതിരിക്കുന്നതിലൂടെ, വ്യാജമായ സ്ഥിതിവിവരക്കണക്കുകൾ ഉണ്ടാകാനുള്ള പ്രധാന കാരണം ഇല്ലാതാക്കുന്നു: അതായത് കോഡ് ഉപയോഗിച്ച് നമ്പറുകൾ നിർമ്മിക്കുന്നതിന് പകരം മോഡൽ നമ്പറുകൾ ഊഹിച്ചു പറയുന്ന അവസ്ഥ ഒഴിവാക്കുന്നു.
മോഡുലാരിറ്റി (Modularity). ഒരു പുതിയ ഘട്ടം—ഉദാഹരണത്തിന്, ഒരു ടൈം-സീരീസ് ഫോർകാസ്റ്റിംഗ് ഏജന്റ്—ചേർക്കാൻ മുഴുവൻ പ്രോംപ്റ്റും വീണ്ടും എഴുതേണ്ടതില്ല. ഓരോ ഏജന്റും നിശ്ചിത ക്രമത്തിൽ ഘടിപ്പിക്കാവുന്ന സ്വതന്ത്രമായ മൊഡ്യൂളുകളാണ്.
വേഗത വർദ്ധിക്കുന്നു. ഓരോ ഘട്ടവും ക്രമമായി ചെയ്യേണ്ടി വരുന്ന ഒരു സിംഗിൾ LLM കോളിനെ അപേക്ഷിച്ച്, സ്വതന്ത്ര ഏജന്റുകളുടെ പാരലൽ എക്സിക്യൂഷൻ സമയം ലാഭിക്കുന്നു.
സങ്കീർണ്ണത (Complexity overhead). ഇതിന്റെ പകരമായി കൂടുതൽ സങ്കീർണ്ണമായ ഒരു ആർക്കിടെക്ചർ ആവശ്യമായി വരുന്നു. സാൻഡ്ബോക്സ് എൻവയോൺമെന്റ് പരിപാലിക്കാനും, എറർ-റിട്ടേൺ ലൂപ്പുകൾ കൈകാര്യം ചെയ്യാനും, ഒന്നിലധികം ഏജന്റുകളെ ഏകോപിപ്പിക്കാനും ടീമുകൾക്ക് സാധിക്കണം.
ഇനി ശ്രദ്ധിക്കേണ്ട കാര്യങ്ങൾ
- ടൂളിംഗ് ഇന്റഗ്രേഷനുകൾ (Tooling integrations). സാൻഡ്ബോക്സ് എക്സിക്യൂഷൻ ഘട്ടം ലഘൂകരിക്കുന്ന ഓപ്പൺ സോഴ്സ് ഫ്രെയിംവർക്കുകൾ എൻജിനീയറിംഗ് ജോലിഭാരം കുറയ്ക്കുകയും ഈ രീതി കൂടുതൽ എളുപ്പത്തിൽ ലഭ്യമാക്കുകയും ചെയ്യും.
- സ്റ്റാൻഡേർഡൈസ്ഡ് ഏജന്റ് കോൺട്രാക്റ്റുകൾ (Standardised agent contracts). കൂടുതൽ ടീമുകൾ മൾട്ടി-ഏജന്റ് പൈപ്പ്ലൈനുകൾ ഉപയോഗിക്കുമ്പോൾ, "പ്ലാൻ-ദെൻ-ആക്ട്" ഏജന്റുകൾക്കായി പൊതുവായ ഇന്റർഫേസുകൾ രൂപപ്പെടുകയും അവ തമ്മിലുള്ള പ്രവർത്തനം എളുപ്പമാവുകയും ചെയ്യും.
ഇതിലെ പ്രധാന പാഠം വ്യക്തമാണ്: LLM-ന് ചിന്തിക്കാനുള്ള സ്വാതന്ത്ര്യം നൽകുക, കണക്കുകൂട്ടാനുള്ള അധികാരം നൽകരുത്. അതിന്റെ സ്വയംഭരണാധികാരം തീരുമാനങ്ങൾ എടുക്കുന്നതിൽ മാത്രമായി പരിമിതപ്പെടുത്തുകയും ഓരോ നമ്പറും ഐസൊലേറ്റഡ് കോഡിലൂടെ കടത്തിവിടുകയും ചെയ്യുന്നതിലൂടെ, ഒരു സെമി-ഓട്ടോണമസ് EDA പൈപ്പ്ലൈൻ നിങ്ങൾക്ക് പരിശോധിക്കാനും വിശ്വസിക്കാനും ഭയമില്ലാതെ പങ്കുവെക്കാനും കഴിയുന്ന ഫലങ്ങൾ നൽകുന്നു.
Source: https://dev.to/sraveend/agentic-but-only-semi-autonomous-designing-an-eda-pipeline-you-can-trust-4ha9
Community discussion: https://t.me/GyaanSetuAi
