ওপেন-সোর্স কমিউনিটি এখন প্রম্পট-ইনজেকশন (prompt-injection) আক্রমণের বিরুদ্ধে লার্জ ল্যাঙ্গুয়েজ মডেলগুলোকে (LLMs) রক্ষা করার জন্য তাদের প্রথম ফেডারেশনড থ্রেট-ইনটেল (threat-intel) ফিড পেয়েছে। prompt-shield v0.6.0-এর সাথে মুক্তি পাওয়া এই ফিডে ৫৬টি কিউরেটেড অ্যাটাক সিগনেচার রয়েছে, যার প্রতিটি একটি ed25519 কী দিয়ে সাইন করা। একটি লাইটওয়েট Python ক্লায়েন্টের মাধ্যমে একটি ফ্রি CDN থেকে এটি সংগ্রহ করা সম্ভব।
কেন LLM সুরক্ষায় একটি শেয়ার্ড ইনটেল সোর্সের অভাব ছিল
প্রথাগত নিরাপত্তা স্তরগুলো পাবলিক এবং নিয়মিত আপডেট করা সিগনেচারের ওপর নির্ভর করে। ওয়েব-অ্যাপ্লিকেশন ফায়ারওয়ালগুলো OWASP প্যাটার্ন ব্যবহার করে; অ্যান্টিভাইরাস প্রোগ্রামগুলো ClamAV আপডেট গ্রহণ করে। এই ফিডগুলো নিরাপত্তাকে আপ-টু-ডেট রাখে। এর বিপরীতে, LLM সিকিউরিটি টুলগুলো বিচ্ছিন্নভাবে কাজ করে, যেখানে প্রতিটি ভেন্ডর বা গবেষক ক্ষতিকারক প্রম্পটের একটি নিজস্ব তালিকা বজায় রাখেন।
এই ঘাটতিটি প্রযুক্তিগত নয়। বাণিজ্যিক ভেন্ডররা থ্রেট ডেটাকে একটি পণ্য হিসেবে বিবেচনা করে, তাই তারা এটি গোপন রাখে। বড় গবেষণা গ্রুপগুলোর একটি পাবলিক ফিডের জন্য প্রয়োজনীয় "একঘেয়ে" অবকাঠামো চালানোর মতো পর্যাপ্ত সক্ষমতা নেই। বিদ্যমান ভ্যালিডেটর মার্কেটপ্লেসগুলো ওয়ান-ওয়ে হাব হিসেবে কাজ করে, যা রিয়েল-টাইম বা কমিউনিটি-চালিত স্ট্রিমের পরিবর্তে স্ট্যাটিক আপডেট প্রদান করে। এর ফলে একটি খণ্ডিত প্রতিরক্ষা ব্যবস্থা তৈরি হয় যেখানে নতুন প্রম্পট-ইনজেকশন কৌশলগুলো ধরা না পড়েই বেরিয়ে যেতে পারে।
নতুন ফিডটি যেভাবে কাজ করে
প্রজেক্টটি একটি পাবলিক GitHub রিপোজিটরিতে রয়েছে এবং এতে তিনটি ফাইল অন্তর্ভুক্ত রয়েছে:
- signatures.json – ৫৬টি অ্যাটাক সিগনেচার, যার প্রতিটি একটি প্যাটার্ন বর্ণনা করে যা একটি LLM-এর আউটপুট হাইজ্যাক করতে পারে।
- signatures.json.minisig – একটি
ed25519সিগনেচার যা JSON ফাইলটিকে মেইনটেইনারের প্রাইভেট কী-র সাথে যুক্ত করে। - public.key – পাবলিক কী যা ক্লায়েন্ট লাইব্রেরিগুলো সিগনেচার যাচাই করতে ব্যবহার করে।
একটি ২০০ লাইনের পিওর-Python ক্লায়েন্ট JSON ফাইলটি সংগ্রহ করে, পাবলিক কী-র মাধ্যমে minisig যাচাই করে এবং যেকোনো নতুন রুল prompt-shield ইঞ্জিনে যুক্ত করে। যদি যাচাইকরণ ব্যর্থ হয়, তবে ক্লায়েন্টটি সর্বশেষ পরিচিত ভালো (known-good) ক্যাশ ব্যবহার করে, যাতে অনির্ভরযোগ্য ডেটা কখনোই প্রতিরক্ষা স্তরে না পৌঁছায়।
তিনটি ডিজাইনের মূল স্তম্ভ এই ফিডটিকে আলাদা করে তুলেছে:
- Zero telemetry – ক্লায়েন্টটি একটি মাত্র
HTTP GETরিকোয়েস্ট পাঠায়; এটি কখনোই আইডেন্টিফায়ার, API কী বা ব্যবহারের মেট্রিক্স পাঠায় না। - Cryptographic verification – যে কেউ ফিডটি ডাউনলোড করতে পারে, কিন্তু শুধুমাত্র মেইনটেইনারের প্রাইভেট কী দিয়ে সাইন করা ডেটা গ্রহণ করা হয়।
- Fail-safe behavior – একটি ত্রুটিপূর্ণ সিগনেচার শিল্ডকে নিষ্ক্রিয় করে না; সিস্টেমটি কেবল পূর্ববর্তী যাচাইকৃত রুলগুলো ব্যবহার করা চালিয়ে যায়।
সিগনেচারগুলো বেশ কিছু নির্ভরযোগ্য উৎস থেকে নেওয়া হয়েছে: NVIDIA-র Garak রেড-টিম কর্পাস, OWASP LLM Top 10-এর উদাহরণ, HackerOne-এর পাবলিক ডিসক্লোজার এবং মেইনটেইনার কর্তৃক যাচাইকৃত কমিউনিটি সাবমিশন।
কারা উপকৃত হবে এবং ঝুঁকির বিষয়গুলো কী
যারা LLM-চালিত অ্যাপ তৈরি করছেন, তারা এখন প্রম্পট-ইনজেকশন প্যাটার্নের একটি ফ্রি এবং যাচাইযোগ্য উৎস পাচ্ছেন যা একটি মাত্র কমান্ডের (pip install prompt-shield-ai) মাধ্যমে ইন্টিগ্রেট করা যায়। যেসব সংস্থা একসময় প্রোপাইটরি বা ক্লোজড-সোর্স ইনটেলের ওপর নির্ভর করত, তারা এখন সেই ফিডগুলোকে একটি কমিউনিটি-রক্ষিত বিকল্প দিয়ে পরিপূরক করতে পারে বা প্রতিস্থাপন করতে পারে।
প্রজেক্টটির "bus factor"—অর্থাৎ কতজন মানুষ হারিয়ে গেলে এটি অচল হয়ে পড়বে—তা বর্তমানে মাত্র একজন। যদি মেইনটেইনার আপডেট সাইন করা বন্ধ করে দেন, তবে ফিডটি স্থবির হয়ে পড়বে এবং ডাউনস্ট্রিম ব্যবহারকারীরা নতুন সিগনেচার থেকে বঞ্চিত হবেন। লেখক স্পষ্টভাবে রিপোজিটরিটি সহ-রক্ষণাবেক্ষণ (co-maintain) করার জন্য অতিরিক্ত ইঞ্জিনিয়ারদের অনুরোধ করেছেন, যাতে একটি একক প্রচেষ্টা একটি টেকসই কমিউনিটি সম্পদে পরিণত হয়।
মূল কথা: LLM প্রম্পট ইনজেকশনের জন্য একটি পাবলিকলি যাচাইযোগ্য, কমিউনিটি-চালিত থ্রেট-ইনটেল ফিড এখন উপলব্ধ, যা প্রোপাইটরি সমাধানের একটি স্বল্পমূল্যের এবং স্বচ্ছ বিকল্প প্রদান করে—যদি কমিউনিটি এটিকে সচল এবং প্রাসঙ্গিক রাখতে এগিয়ে আসে।
