ಪ್ರಾಂಪ್ಟ್-ಇಂಜೆಕ್ಷನ್ ದಾಳಿಗಳಿಂದ ದೊಡ್ಡ ಭಾಷಾ ಮಾದರಿಗಳನ್ನು (LLMs) ರಕ್ಷಿಸಲು ಮುಕ್ತ ಮೂಲ ಸಮುದಾಯವು ಈಗ ತನ್ನ ಮೊದಲ ಫೆಡರೇಟೆಡ್ ಬೆದರಿಕೆ-ಮಾಹಿತಿ (threat-intel) ಫೀಡ್ ಅನ್ನು ಹೊಂದಿದೆ. prompt-shield v0.6.0 ರೊಂದಿಗೆ ಬಿಡುಗಡೆಯಾದ ಈ ಫೀಡ್, 56 ಸಂಕಲಿತ ದಾಳಿ ಸಹಿಗಳನ್ನು (attack signatures) ಒಳಗೊಂಡಿದೆ, ಪ್ರತಿಯೊಂದೂ ed25519 ಕೀ ಮೂಲಕ ಸಹಿ ಮಾಡಲ್ಪಟ್ಟಿದೆ ಮತ್ತು ಇದನ್ನು ಲಘು ತೂಕದ Python ಕ್ಲೈಂಟ್ ಮೂಲಕ ಉಚಿತ CDN ನಿಂದ ಪಡೆಯಬಹುದು.

LLM ರಕ್ಷಣಾ ವ್ಯವಸ್ಥೆಗಳಿಗೆ ಏಕೆ ಹಂಚಿಕೆಯ ಮಾಹಿತಿ ಮೂಲದ ಕೊರತೆ ಇತ್ತು

ಸಾಂಪ್ರದಾಯಿಕ ಭದ್ರತಾ ಪದರಗಳು ಸಾರ್ವಜನಿಕವಾಗಿ, ನಿಯಮಿತವಾಗಿ ಅಪ್‌ಡೇಟ್ ಆಗುವ ಸಹಿಗಳನ್ನು ಅವಲಂಬಿಸಿವೆ. Web-application firewalls ಗಳು OWASP ಮಾದರಿಗಳನ್ನು ಬಳಸುತ್ತವೆ; antivirus ಪ್ರೋಗ್ರಾಂಗಳು ClamAV ಅಪ್‌ಡೇಟ್‌ಗಳನ್ನು ಪಡೆದುಕೊಳ್ಳುತ್ತವೆ. ಅಂತಹ ಫೀಡ್‌ಗಳು ರಕ್ಷಣೆಯನ್ನು ನವೀಕೃತವಾಗಿಡುತ್ತವೆ. ಇದಕ್ಕೆ ವ್ಯತಿರಿಕ್ತವಾಗಿ, LLM ಭದ್ರತಾ ಸಾಧನಗಳು ಪ್ರತ್ಯೇಕವಾಗಿ ಕಾರ್ಯನಿರ್ವಹಿಸುತ್ತವೆ, ಪ್ರತಿಯೊಬ್ಬ ಮಾರಾಟಗಾರ ಅಥವಾ ಸಂಶೋಧಕರು ದುಷ್ಟ ಪ್ರಾಂಪ್ಟ್‌ಗಳ ಖಾಸಗಿ ಪಟ್ಟಿಯನ್ನು ನಿರ್ವಹಿಸುತ್ತಾರೆ.

ಈ ಕೊರತೆಯು ತಾಂತ್ರಿಕವಾದುದಲ್ಲ. ವಾಣಿಜ್ಯ ಮಾರಾಟಗಾರರು ಬೆದರಿಕೆ ಡೇಟಾವನ್ನು ಒಂದು ಉತ್ಪನ್ನವಾಗಿ ಪರಿಗಣಿಸುತ್ತಾರೆ, ಆದ್ದರಿಂದ ಅವರು ಅದನ್ನು ಮುಚ್ಚಿಡುತ್ತಾರೆ. ದೊಡ್ಡ ಸಂಶೋಧನಾ ಗುಂಪುಗಳಿಗೆ ಸಾರ್ವಜನಿಕ ಫೀಡ್ ಬಯಸುವ "ಬೋರಿಂಗ್" ಮೂಲಸೌಕರ್ಯವನ್ನು ನಡೆಸಲು ಅಗತ್ಯವಿರುವ ಸಾಮರ್ಥ್ಯ ಇರುವುದಿಲ್ಲ. ಅಸ್ತಿತ್ವದಲ್ಲಿರುವ ವ್ಯಾಲಿಡೇಟರ್ ಮಾರುಕಟ್ಟೆಗಳು ಏಕಮುಖ ಕೇಂದ್ರಗಳಂತೆ ಕಾರ್ಯನಿರ್ವಹಿಸುತ್ತವೆ, ನೈಜ-ಸಮಯದ, ಸಮುದಾಯ-ಚಾಲಿತ ಸ್ಟ್ರೀಮ್ ಬದಲಿಗೆ ಸ್ಥಿರ ಅಪ್‌ಡೇಟ್‌ಗಳನ್ನು ಮಾತ್ರ ನೀಡುತ್ತವೆ. ಇದರ ಪರಿಣಾಮ: ಹೊಸ ಪ್ರಾಂಪ್ಟ್-ಇಂಜೆಕ್ಷನ್ ತಂತ್ರಗಳು ಗಮನಕ್ಕೆ ಬಾರದೆ ಜಾರಿಕೊಳ್ಳುವ ಒಂದು ವಿಭಜಿತ ರಕ್ಷಣಾ ಮೇಲ್ಮೈ (fragmented defense surface).

ಹೊಸ ಫೀಡ್ ಹೇಗೆ ಕೆಲಸ ಮಾಡುತ್ತದೆ

ಈ ಯೋಜನೆಯು ಸಾರ್ವಜನಿಕ GitHub ರೆಪೊಸಿಟರಿಯಲ್ಲಿ ಲಭ್ಯವಿದ್ದು, ಮೂರು ಫೈಲ್‌ಗಳನ್ನು ಒಳಗೊಂಡಿದೆ:

  • signatures.json – 56 ದಾಳಿ ಸಹಿಗಳು, ಪ್ರತಿಯೊಂದೂ LLM ನ ಔಟ್‌ಪುಟ್ ಅನ್ನು ಹೈಜಾಕ್ ಮಾಡಬಹುದಾದ ಮಾದರಿಯನ್ನು ವಿವರಿಸುತ್ತದೆ.
  • signatures.json.minisig – JSON ಫೈಲ್ ಅನ್ನು ನಿರ್ವಾಹಕರ (maintainer) ಖಾಸಗಿ ಕೀಗೆ ಜೋಡಿಸುವ ed25519 ಸಹಿ.
  • public.key – ಸಹಿಯನ್ನು ಪರಿಶೀಲಿಸಲು ಕ್ಲೈಂಟ್ ಲೈಬ್ರರಿಗಳು ಬಳಸುವ ಪಬ್ಲಿಕ್ ಕೀ.

200 ಸಾಲುಗಳ ಪ್ಯೂರ್-Python ಕ್ಲೈಂಟ್ JSON ಅನ್ನು ಪಡೆದುಕೊಳ್ಳುತ್ತದೆ, ಪಬ್ಲಿಕ್ ಕೀ ಮೂಲಕ minisig ಅನ್ನು ಪರಿಶೀಲಿಸುತ್ತದೆ ಮತ್ತು ಯಾವುದೇ ಹೊಸ ನಿಯಮಗಳನ್ನು prompt-shield ಇಂಜಿನ್‌ಗೆ ವಿಲೀನಗೊಳಿಸುತ್ತದೆ. ಪರಿಶೀಲನೆ ವಿಫಲವಾದರೆ, ಕ್ಲೈಂಟ್ ಕೊನೆಯ ಬಾರಿ ತಿಳಿದಿರುವ ಸರಿಯಾದ ಕ್ಯಾಶ್ (cache) ಅನ್ನು ಬಳಸುತ್ತದೆ, ಇದರಿಂದಾಗಿ ನಂಬಲರ್ಹವಲ್ಲದ ಡೇಟಾ ಎಂದಿಗೂ ರಕ್ಷಣಾ ಪದರವನ್ನು ತಲುಪುವುದಿಲ್ಲ.

ಮೂರು ವಿನ್ಯಾಸದ ಸ್ತಂಭಗಳು ಈ ಫೀಡ್ ಅನ್ನು ವಿಭಿನ್ನವಾಗಿಸುತ್ತವೆ:

  1. Zero telemetry – ಕ್ಲೈಂಟ್ ಕೇವಲ ಒಂದು HTTP GET ವಿನಂತಿಯನ್ನು ಮಾಡುತ್ತದೆ; ಇದು ಎಂದಿಗೂ ಐಡೆಂಟಿಫೈಯರ್‌ಗಳು, API ಕೀಗಳು ಅಥವಾ ಬಳಕೆಯ ಮೆಟ್ರಿಕ್‌ಗಳನ್ನು ಕಳುಹಿಸುವುದಿಲ್ಲ.
  2. Cryptographic verification – ಯಾರೇ ಫೀಡ್ ಅನ್ನು ಡೌನ್‌ಲೋಡ್ ಮಾಡಬಹುದು, ಆದರೆ ನಿರ್ವಾಹಕರ ಖಾಸಗಿ ಕೀ ಮೂಲಕ ಸಹಿ ಮಾಡಲಾದ ಡೇಟಾವನ್ನು ಮಾತ್ರ ಸ್ವೀಕರಿಸಲಾಗುತ್ತದೆ.
  3. Fail-safe behavior – ದೋಷಪೂರಿತ ಸಹಿಯು ಶೀಲ್ಡ್ ಅನ್ನು ನಿಷ್ಕ್ರಿಯಗೊಳಿಸುವುದಿಲ್ಲ; ಸಿಸ್ಟಮ್ ಕೇವಲ ಈ ಮೊದಲು ಪರಿಶೀಲಿಸಲಾದ ನಿಯಮಗಳನ್ನು ಬಳಸುವುದನ್ನು ಮುಂದುವರಿಸುತ್ತದೆ.

ಈ ಸಹಿಗಳು ಹಲವಾರು ಪ್ರತಿಷ್ಠಿತ ಮೂಲಗಳಿಂದ ಪಡೆದುಕೊಳ್ಳಲಾಗಿದೆ: NVIDIA ನ Garak red-team corpus, OWASP LLM Top 10 ಉದಾಹರಣೆಗಳು, HackerOne ಮೇಲಿನ ಸಾರ್ವಜನಿಕ ಬಹಿರಂಗಪಡಿಸುವಿಕೆಗಳು ಮತ್ತು ನಿರ್ವಾಹಕರಿಂದ ಪರಿಶೀಲಿಸಲ್ಪಟ್ಟ ಸಮುದಾಯದ ಸಲ್ಲಿಕೆಗಳು.

ಯಾರು ಪ್ರಯೋಜನ ಪಡೆಯುತ್ತಾರೆ ಮತ್ತು ಏನಿದೆ ಪಣ?

LLM ಚಾಲಿತ ಅಪ್ಲಿಕೇಶನ್‌ಗಳನ್ನು ನಿರ್ಮಿಸುವ ಡೆವಲಪರ್‌ಗಳು ಈಗ ಕೇವಲ ಒಂದು ಕಮಾಂಡ್ (pip install prompt-shield-ai) ಮೂಲಕ ಸಂಯೋಜಿಸಬಹುದಾದ ಪ್ರಾಂಪ್ಟ್-ಇಂಜೆಕ್ಷನ್ ಮಾದರಿಗಳ ಉಚಿತ ಮತ್ತು ಪರಿಶೀಲಿಸಬಹುದಾದ ಮೂಲವನ್ನು ಹೊಂದಿದ್ದಾರೆ. ಒಮ್ಮೆ ಮಾಲೀಕತ್ವದ (proprietary), ಮುಚ್ಚಿದ ಮೂಲದ ಮಾಹಿತಿಯನ್ನು ಅವಲಂಬಿಸಿದ್ದ ಸಂಸ್ಥೆಗಳು ಈಗ ಆ ಫೀಡ್‌ಗಳನ್ನು ಸಮುದಾಯವು ನಿರ್ವಹಿಸುವ ಪರ್ಯಾಯದೊಂದಿಗೆ ಹೆಚ್ಚಿಸಬಹುದು ಅಥವಾ ಬದಲಾಯಿಸಬಹುದು.

ಈ ಯೋಜನೆಯ "bus factor"—ಯಾರ ನಷ್ಟವು ಯೋಜನೆಯನ್ನು ಕುಂಠಿತಗೊಳಿಸಬಲ್ಲದು ಎಂಬ ವ್ಯಕ್ತಿಗಳ ಸಂಖ್ಯೆ—ಪ್ರಸ್ತುತ ಒಂದಾಗಿದೆ. ನಿರ್ವಾಹಕರು ಅಪ್‌ಡೇಟ್‌ಗಳಿಗೆ ಸಹಿ ಮಾಡುವುದನ್ನು ನಿಲ್ಲಿಸಿದರೆ, ಫೀಡ್ ಸ್ಥಗಿತಗೊಳ್ಳುತ್ತದೆ ಮತ್ತು ಡೌನ್‌ಸ್ಟ್ರೀಮ್ ಬಳಕೆದಾರರಿಗೆ ಹೊಸ ಸಹಿಗಳು ಸಿಗುವುದಿಲ್ಲ. ಈ ಯೋಜನೆಯನ್ನು ಏಕಾಂಗಿ ಪ್ರಯತ್ನದಿಂದ ಸುಸ್ಥಿರ ಸಮುದಾಯದ ಆಸ್ತಿಯನ್ನಾಗಿ ಪರಿವರ್ತಿಸಲು, ಲೇಖಕರು ರೆಪೊಸಿಟರಿಯನ್ನು ಸಹ-ನಿರ್ವಹಿಸಲು ಹೆಚ್ಚುವರಿ ಎಂಜಿನಿಯರ್‌ಗಳನ್ನು ಸ್ಪಷ್ಟವಾಗಿ ಕೇಳಿಕೊಳ್ಳುತ್ತಿದ್ದಾರೆ.

Takeaway: LLM ಪ್ರಾಂಪ್ಟ್ ಇಂಜೆಕ್ಷನ್‌ಗಾಗಿ ಸಾರ್ವಜನಿಕವಾಗಿ ಪರಿಶೀಲಿಸಬಹುದಾದ, ಸಮುದಾಯ-ಚಾಲಿತ ಬೆದರಿಕೆ-ಮಾಹಿತಿ ಫೀಡ್ ಈಗ ಲಭ್ಯವಿದೆ. ಇದು ಮಾಲೀಕತ್ವದ ಪರಿಹಾರಗಳಿಗೆ ಕಡಿಮೆ ವೆಚ್ಚದ, ಪಾರದರ್ಶಕ ಪರ್ಯಾಯವನ್ನು ನೀಡುತ್ತದೆ—ಆದರೆ ಸಮುದಾಯವು ಇದನ್ನು ಜೀವಂತವಾಗಿ ಮತ್ತು ಪ್ರಸ್ತುತವಾಗಿಡಲು ಮುಂದಾಗಬೇಕಿದೆ.