திறந்த மூல சமூகம் (open-source community) இப்போது பெரிய மொழி மாதிரிகளை (LLMs) prompt-injection தாக்குதல்களிலிருந்து பாதுகாப்பதற்கான தனது முதல் கூட்டமைக்கப்பட்ட அச்சுறுத்தல்-தகவல் (federated threat-intel) தொகுப்பைப் பெற்றுள்ளது. prompt-shield v0.6.0 உடன் வெளியிடப்பட்ட இந்தத் தொகுப்பு, ed25519 சாவியால் (key) கையொப்பமிடப்பட்ட 56 தேர்ந்தெடுக்கப்பட்ட தாக்குதல் அடையாளங்களைக் (attack signatures) கொண்டுள்ளது; இதை ஒரு இலகுரக Python client மூலம் இலவச CDN-லிருந்து பெற முடியும்.

LLM பாதுகாப்பிற்கு ஏன் ஒரு பகிரப்பட்ட தகவல் ஆதாரம் இல்லை

பாரம்பரிய பாதுகாப்பு அடுக்குகள் பொதுவான, அவ்வப்போது புதுப்பிக்கப்படும் அடையாளங்களைச் சார்ந்துள்ளன. Web-application firewalls OWASP முறைகளைப் பயன்படுத்துகின்றன; antivirus மென்பொருள்கள் ClamAV புதுப்பிப்புகளைப் பெறுகின்றன. அந்தத் தொகுப்புகள் பாதுகாப்பைத் தற்போதைய நிலையில் வைத்திருக்க உதவுகின்றன. இதற்கு நேர்மாறாக, LLM பாதுகாப்பு கருவிகள் தனித்தனியாகச் செயல்படுகின்றன; ஒவ்வொரு விற்பனையாளரும் அல்லது ஆராய்ச்சியாளரும் தீய நோக்கமுள்ள prompts-களின் தனிப்பட்ட பட்டியலைப் பராமரிக்கின்றனர்.

இந்த இடைவெளி தொழில்நுட்ப ரீதியானது அல்ல. வணிக ரீதியான விற்பனையாளர்கள் அச்சுறுத்தல் தரவை ஒரு தயாரிப்பாகக் கருதுகின்றனர், எனவே அதைத் தனிப்பட்ட முறையில் வைத்திருக்கின்றனர். பெரிய ஆராய்ச்சி குழுக்களுக்கு, ஒரு பொதுத் தொகுப்பிற்குத் தேவையான "சலிப்பூட்டும்" உள்கட்டமைப்பை (infrastructure) இயக்குவதற்கான வசதி இல்லை. தற்போதுள்ள validator சந்தைகள் ஒரு வழி மையங்களாகச் செயல்படுகின்றன; அவை நிகழ்நேர, சமூகம் சார்ந்த ஓட்டத்திற்குப் பதிலாக நிலையான (static) புதுப்பிப்புகளை மட்டுமே வழங்குகின்றன. இதன் விளைவாக: புதிய prompt-injection நுட்பங்கள் கவனிக்கப்படாமல் ஊடுருவக்கூடிய ஒரு சிதறிய பாதுகாப்புத் தளம் உருவாகிறது.

புதிய தொகுப்பு எவ்வாறு செயல்படுகிறது

இந்தத் திட்டம் ஒரு பொது GitHub repository-இல் உள்ளது மற்றும் இதில் மூன்று கோப்புகள் உள்ளன:

  • signatures.json – 56 தாக்குதல் அடையாளங்கள், ஒவ்வொன்றும் ஒரு LLM-இன் வெளியீட்டைத் திசைதிருப்பக்கூடிய ஒரு முறையை விவரிக்கின்றன.
  • signatures.json.minisig – JSON கோப்பை பராமரிப்பாளரின் (maintainer) தனிப்பட்ட சாவியுடன் இணைக்கும் ஒரு ed25519 கையொப்பம்.
  • public.key – கையொப்பத்தைச் சரிபார்க்க client libraries பயன்படுத்தும் பொதுச் சாவி (public key).

200 வரிகள் கொண்ட ஒரு pure-Python client, JSON-ஐப் பெற்று, public key மூலம் minisig-ஐச் சரிபார்த்து, புதிய விதிகளை prompt-shield engine-உடன் இணைக்கிறது. சரிபார்ப்பு தோல்வியடைந்தால், client கடைசியாகத் தெரிந்த சரியான cache-ஐப் பயன்படுத்துகிறது, இதனால் நம்பகத்தன்மையற்ற தரவு பாதுகாப்பு அடுக்கை அடையாது.

மூன்று வடிவமைப்புத் தூண்கள் இந்தத் தொகுப்பைத் தனித்துவமாக்குகின்றன:

  1. Zero telemetry – client ஒருமுறை மட்டுமே HTTP GET கோரிக்கையை அனுப்புகிறது; இது அடையாளங்காட்டிகள் (identifiers), API keys அல்லது பயன்பாட்டு அளவீடுகளை (usage metrics) ஒருபோதும் அனுப்பாது.
  2. Cryptographic verification – எவரும் இந்தத் தொகுப்பைப் பதிவிறக்கம் செய்யலாம், ஆனால் பராமரிப்பாளரின் தனிப்பட்ட சாவியால் கையொப்பமிடப்பட்ட தரவு மட்டுமே ஏற்றுக்கொள்ளப்படும்.
  3. Fail-safe behavior – ஒரு தவறான கையொப்பம் shield-ஐ முடக்கிவிடாது; அமைப்பு முந்தைய சரிபார்க்கப்பட்ட விதிகளைத் தொடர்ந்து பயன்படுத்தும்.

இந்த அடையாளங்கள் பல புகழ்பெற்ற ஆதாரங்களிலிருந்து பெறப்படுகின்றன: NVIDIA-இன் Garak red-team corpus, OWASP LLM Top 10 உதாரணங்கள், HackerOne-இல் உள்ள பொதுத் தகவல்கள் மற்றும் பராமரிப்பாரால் சரிபார்க்கப்பட்ட சமூகப் பங்களிப்புகள்.

யாருக்குப் பயன் மற்றும் இதில் உள்ள சவால்கள்

LLM மூலம் இயங்கும் செயலிகளை உருவாக்கும் டெவலப்பர்களுக்கு, இப்போது ஒரே கட்டளை மூலம் (pip install prompt-shield-ai) ஒருங்கிணைக்கக்கூடிய, இலவசமான மற்றும் சரிபார்க்கக்கூடிய prompt-injection முறைகளின் ஆதாரம் கிடைத்துள்ளது. ஒரு காலத்தில் தனியுரிம (proprietary), மூடிய மூல (closed-source) தகவல்களைச் சார்ந்திருந்த நிறுவனங்கள், இப்போது சமூகத்தால் பராமரிக்கப்படும் மாற்றுத் தொகுப்பைக் கொண்டு அவற்றைப் பலப்படுத்தலாம் அல்லது மாற்றிக்கொள்ளலாம்.

இந்தத் திட்டத்தின் "bus factor"—யாராவது ஒரு நபர் விலகினால் திட்டம் முடங்கிவிடும் என்பதைக் குறிக்கும் அளவு—தற்போது ஒன்றுதான். பராமரிப்பாளர் புதுப்பிப்புகளைக் கையொப்பமிடுவதை நிறுத்தினால், இந்தத் தொகுப்பு தேக்கமடையும், இதனால் பயனர்களுக்குப் புதிய அடையாளங்கள் கிடைக்காது. இந்தத் திட்டத்தை ஒரு தனிநபர் முயற்சியிலிருந்து நிலையான சமூகச் சொத்தாக மாற்ற, கூடுதல் பொறியாளர்கள் களஞ்சியத்தைப் (repository) இணைந்து பராமரிக்க வேண்டும் என்று ஆசிரியர் வெளிப்படையாகக் கேட்டுக்கொண்டுள்ளார்.

முக்கியக் கருத்து: LLM prompt injection-க்கான பொதுப்படையாகச் சரிபார்க்கக்கூடிய, சமூகம் சார்ந்த அச்சுறுத்தல்-தகவல் தொகுப்பு இப்போது கிடைக்கிறது. இது தனியுரிமத் தீர்வுகளுக்குக் குறைந்த செலவிலான, வெளிப்படையான மாற்றாக அமையும்—சமூகம் இதைத் தொடர்ந்து உயிர்ப்புடன் வைத்திருக்க முன்வந்தால் மட்டுமே இது சாத்தியம்.