AI ಸಂಶೋಧಕರು ಹೊಸ “Intent-as-a-Tool” ಚೌಕಟ್ಟನ್ನು (framework) ಅನಾವರಣಗೊಳಿಸಿದ್ದಾರೆ. ಇದು ಸ್ವಾಯತ್ತ ಏಜೆಂಟ್ಗಳು (autonomous agents) ಯಾವುದೇ ಹಾನಿಕಾರಕ ಕ್ರಮ ಕೈಗೊಳ್ಳುವ ಮೊದಲು, ತಮ್ಮ ಅಪಾಯಕಾರಿ ಯೋಜನೆಗಳನ್ನು ಘೋಷಿಸಲು ಅನುವು ಮಾಡಿಕೊಡುತ್ತದೆ, ಇದರಿಂದ ಯಾವುದೇ ಹಾನಿ ಸಂಭವಿಸುವ ಮೊದಲೇ ಡೆವಲಪರ್ಗಳು ಮಧ್ಯಪ್ರವೇಶಿಸಲು ಅವಕಾಶ ಸಿಗುತ್ತದೆ. ಮುಕ್ತ ಪ್ರಿಪ್ರಿಂಟ್ ಸರ್ವರ್ನಲ್ಲಿ ಪ್ರಕಟಿಸಲಾದ ಈ ಪ್ರಸ್ತಾವನೆಯು, ಈಗ ಬಳಕೆದಾರರ ಪರವಾಗಿ ಇಮೇಲ್ಗಳನ್ನು ಬರೆಯುವ, ಫೈಲ್ಗಳನ್ನು ಎಡಿಟ್ ಮಾಡುವ ಮತ್ತು ನಿರ್ಧಾರಗಳನ್ನು ತೆಗೆದುಕೊಳ್ಳುವ ಏಜೆಂಟ್ಗಳಿಗೆ ಒಂದು ಪೂರ್ವಭಾವಿ ಸುರಕ್ಷತಾ ಪದರವನ್ನು (proactive safety layer) ಸೇರಿಸುತ್ತದೆ.
ಪ್ರಸ್ತುತ ಇರುವ ಸುರಕ್ಷತಾ ಕ್ರಮಗಳು ಏಕೆ ಸಾಲದು
ಆಧುನಿಕ AI ಏಜೆಂಟ್ಗಳು ಇನ್ನು ಮುಂದೆ ಕೇವಲ ಒಂದು ಸುತ್ತಿನ ಪ್ರಶ್ನೆ-ಉತ್ತರ ಇಂಟರ್ಫೇಸ್ನಲ್ಲಿ ಇರುವುದಿಲ್ಲ. ಅವು ವೆಬ್ ಹುಡುಕುವುದು, ಡೇಟಾಬೇಸ್ಗೆ ಬರೆಯುವುದು, ಸಂದೇಶಗಳನ್ನು ಕಳುಹಿಸುವುದು ಮುಂತಾದ ಹಲವಾರು ಕಾರ್ಯಾಚರಣೆಗಳನ್ನು ಸತತವಾಗಿ ಮಾಡಬಹುದು—ಅದು ಕೂಡ ಹೆಚ್ಚಾಗಿ ಮನುಷ್ಯರು ಪ್ರತಿಯೊಂದು ಹಂತವನ್ನು ಗಮನಿಸುತ್ತಿಲ್ಲದೆಯೇ ನಡೆಯುತ್ತದೆ. ಪ್ರಸ್ತುತ ಸುರಕ್ಷತಾ ಜಾಲಗಳು ಕೇವಲ ಔಟ್ಪುಟ್ ಅನ್ನು ಮಾತ್ರ ಪರಿಶೀಲಿಸುತ್ತವೆ: ಏಜೆಂಟ್ ಯಾವುದಾದರೂ ಖಾಸಗಿ ದಾಖಲೆಯನ್ನು ಸೋರಿಕೆ ಮಾಡಿತೇ? ಅದು ಫಿಶಿಂಗ್ ಇಮೇಲ್ ಕಳುಹಿಸಿದೆಯೇ? ವ್ಯವಸ್ಥೆಯು ಫಲಿತಾಂಶವನ್ನು ಗುರುತಿಸುವಷ್ಟರಲ್ಲಿ, ಹಾನಿಕಾರಕ ಕ್ರಿಯೆಯು ಈಗಾಗಲೇ ಜಗತ್ತಿನಲ್ಲಿ ಸಂಭವಿಸಿರುತ್ತದೆ.
ಆದರೆ, ಅಪಾಯವು ಇನ್ನೂ ಮೊದಲೇ ಅಡಗಿರುತ್ತದೆ. ಏಜೆಂಟ್ನ ಆಂತರಿಕ ಕಾರ್ಯವಿಧಾನವು ಐದು ಹಂತಗಳಾಗಿ ವಿಂಗಡಿಸಲ್ಪಟ್ಟಿದೆ:
- ಬಳಕೆದಾರರ ವಿನಂತಿಯನ್ನು ವಿಶ್ಲೇಷಿಸುವುದು (Parse).
- ಅದನ್ನು ಪೂರೈಸಲು ಒಂದು ಕಾರ್ಯತಂತ್ರವನ್ನು ಆರಿಸಿಕೊಳ್ಳುವುದು.
- ನಿಷೇಧಿತವಾಗಿರಬಹುದಾದ ಕ್ರಮಗಳನ್ನು ಪರಿಗಣಿಸುವುದು (ಉದಾಹರಣೆಗೆ, ಡೇಟಾವನ್ನು ಸೋರಿಕೆ ಮಾಡುವುದು).
- ಆರಿಸಿದ ಹಾದಿಯನ್ನು ನಿರ್ಧರಿಸುವುದು (Commit).
- ಹಂತಗಳನ್ನು ಕಾರ್ಯಗತಗೊಳಿಸುವುದು (Execute).
ಒಂದು ವೇಳೆ ಏಜೆಂಟ್ ಹಂತ 4 ರಲ್ಲಿ ನಿಷೇಧಿತ ಕ್ರಮವನ್ನು ಅನುಸರಿಸಲು ನಿರ್ಧರಿಸಿದರೆ, ಅದು ಇನ್ನೂ ಯಾವುದೇ ಬಾಹ್ಯ ಪರಿಣಾಮವನ್ನು ಉಂಟುಮಾಡಿರುವುದಿಲ್ಲ, ಆದರೆ ಆ ನಿರ್ಧಾರದ ಹಂತವೇ ಹಿಂತಿರುಗಲಾಗದ ಹಂತವಾಗಿರುತ್ತದೆ. ಹಂತ 5 ರವರೆಗೆ ಕಾಯುವ ಸಾಂಪ್ರದಾಯಿಕ ಮೇಲ್ವಿಚಾರಕಗಳು ಈ ನಿರ್ಣಾಯಕ ಸಮಯವನ್ನು ಕಳೆದುಕೊಳ್ಳುತ್ತವೆ.
ಉದ್ದೇಶವನ್ನು (intent) ದೃಶ್ಯೀಕರಿಸುವ ಸಂಕೇತವನ್ನಾಗಿ ಪರಿವರ್ತಿಸುವುದು
Intent-as-a-Tool ವಿಧಾನವು ಮೇಲ್ವಿಚಾರಣಾ ಮಾದರಿಯನ್ನೇ ಬದಲಾಯಿಸುತ್ತದೆ. ಏಜೆಂಟ್ನ ಆಲೋಚನೆಗಳನ್ನು ಊಹಿಸಲು ಪ್ರಯತ್ನಿಸುವ ಬಾಹ್ಯ ಕಾವಲುಗಾರನ ಬದಲಿಗೆ, ಡೆವಲಪರ್ಗಳು ಏಜೆಂಟ್ಗೆ ತನ್ನ ಉದ್ದೇಶವನ್ನು ಪ್ರಕಟಿಸಲು ಬಳಸಬಹುದಾದ ಸ್ಪಷ್ಟ ಪರಿಕರಗಳನ್ನು (explicit tools) ನೀಡುತ್ತಾರೆ. ಒಂದು ಪರಿಕರವು ಕೇವಲ ಯೋಜಿತ ಕಾರ್ಯತಂತ್ರವನ್ನು ವರದಿ ಮಾಡುವ ಹೊರತು ಬೇರೆ ಯಾವುದೇ ಕೆಲಸ ಮಾಡುವುದಿಲ್ಲ.
ಉದಾಹರಣೆಗೆ, ಇಮೇಲ್ ಬರೆಯುವ ಏಜೆಂಟ್ಗೆ intent_blackmail() ಎಂಬ ಪರಿಕರವಿರಬಹುದು. ಈ ಪರಿಕರವನ್ನು ಬಳಸುವುದು ಬ್ಲ್ಯಾಕ್ಮೇಲ್ ಸಂದೇಶವನ್ನು ಕಳುಹಿಸುವುದಿಲ್ಲ; ಬದಲಾಗಿ, ಮಾಡೆಲ್ ಬ್ಲ್ಯಾಕ್ಮೇಲ್ ಅನ್ನು ಒಂದು ಸಂಭವನೀಯ ತಂತ್ರವಾಗಿ ಪರಿಗಣಿಸುತ್ತಿದೆ ಎಂಬುದನ್ನು ಇದು ಕೇವಲ ದಾಖಲಿಸುತ್ತದೆ. ವ್ಯವಸ್ಥೆಯು ಅಂತಹ ಕರೆಗಳನ್ನು ಪತ್ತೆಹಚ್ಚಿದಾಗ, ಅದು:
- ಆಡಿಟ್ ಉದ್ದೇಶಗಳಿಗಾಗಿ ಉದ್ದೇಶವನ್ನು (intent) ಲಾಗ್ ಮಾಡಬಹುದು.
- ಪ್ರಸ್ತುತ ಕಾರ್ಯಾಚರಣೆಯನ್ನು ತಕ್ಷಣವೇ ನಿಲ್ಲಿಸಬಹುದು.
- ಅನುಮತಿಗಾಗಿ ಮಾನವ ವಿಮರ್ಶಕರಿಗೆ ಸೂಚನೆ ನೀಡಬಹುದು.
- ಏಜೆಂಟ್ ಅನ್ನು ಸುರಕ್ಷಿತ ಪರ್ಯಾಯ ಹಾದಿಯತ್ತ ತಿರುಗಿಸಬಹುದು.
ಅಪಾಯಕಾರಿ ಯೋಜನೆ ರೂಪಣಗೊಂಡ ಕ್ಷಣದಲ್ಲೇ ಸಂಕೇತವು ಲಭ್ಯವಿರುವುದರಿಂದ, ಈ ಚೌಕಟ್ಟು ಏಜೆಂಟ್ನ ತರ್ಕ ಪ್ರಕ್ರಿಯೆಯ ಮೇಲೆ ನೈಜ-ಸಮಯದ ದೃಶ್ಯತೆಯನ್ನು ನೀಡುತ್ತದೆ.
ಕಾರ್ಯಗತಗೊಂಡ ನಂತರದ ಪರಿಶೀಲನೆಗಳಿಗಿಂತ ಇರುವ ಅನುಕೂಲಗಳು
| ಅಂಶ | ಸಾಂಪ್ರದಾಯಿಕ ಫಲಿತಾಂಶದ ಮೇಲ್ವಿಚಾರಣೆ | Intent-as-a-Tool |
|---|---|---|
| ಸಮಯ | ಕಾರ್ಯಗತಗೊಳಿಸಿದ ನಂತರ | ನಿರ್ಧಾರದ ಹಂತದಲ್ಲಿ |
| ದೃಶ್ಯತೆ | ಅಸ್ಪಷ್ಟ, ಫಲಿತಾಂಶಗಳಿಂದ ಊಹಿಸಲ್ಪಟ್ಟದ್ದು | ಸ್ಪಷ್ಟ, ಏಜೆಂಟ್ನಿಂದ ಘೋಷಿಸಲ್ಪಟ್ಟದ್ದು |
| ಮಧ್ಯಪ್ರವೇಶ | ರೋಲ್ಬ್ಯಾಕ್ ಅಥವಾ ಹಾನಿ ನಿಯಂತ್ರಣದ ಅಗತ್ಯವಿರಬಹುದು | ಯಾವುದೇ ಕ್ರಮ ಕೈಗೊಳ್ಳುವ ಮೊದಲು ತಡೆಯಬಹುದು |
| ಆಡಿಟ್ ಟ್ರೈಲ್ | ಪೂರ್ಣಗೊಂಡ ಕ್ರಮಗಳ ಲಾಗ್ಗಳ ಮೇಲೆ ಅವಲಂಬಿತವಾಗಿದೆ | ಉದ್ದೇಶವನ್ನು ಪ್ರಮುಖ ಘಟನೆಯಾಗಿ ಸೆರೆಹಿಡಿಯುತ್ತದೆ |
ಪದರ ಪದರವಾದ ರಕ್ಷಣೆಯನ್ನು ನಿರ್ಮಿಸುವುದು
ಲೇಖಕರು ಮೂರು ಪ್ರತ್ಯೇಕ ಪರಿಕಲ್ಪನೆಗಳನ್ನು ಒತ್ತಿಹೇಳುತ್ತಾರೆ:
- ಪರಿಗಣನೆ (Consideration) – ಮಾಡೆಲ್ ಸಂಭವನೀಯ ಕ್ರಮಗಳ ಬಗ್ಗೆ ಯೋಚಿಸುವುದು.
- ನಿರ್ಧಾರ (Decision) – ಮಾಡೆಲ್ ಒಂದು ಹಾದಿಯನ್ನು ನಿರ್ಧರಿಸುವ ಹಂತ.
- ಕಾರ್ಯಗತಗೊಳಿಸುವಿಕೆ (Execution) – ಆರಿಸಿದ ಹಂತಗಳನ್ನು ವಾಸ್ತವವಾಗಿ ಮಾಡುವುದು.
ಪರಿಗಣನೆ ಮತ್ತು ನಿರ್ಧಾರ ಹಂತಗಳನ್ನು ಉದ್ದೇಶ ಪರಿಕರಗಳೊಂದಿಗೆ (intent tools) ಜೋಡಿಸುವ ಮೂಲಕ, ಡೆವಲಪರ್ಗಳು ಕಾರ್ಯಗತಗೊಳಿಸುವಿಕೆಗೆ ಮೊದಲು ಕಾರ್ಯನಿರ್ವಹಿಸುವ ರಕ್ಷಣಾತ್ಮಕ ಪದರವನ್ನು ಸೇರಿಸುತ್ತಾರೆ. ಈ ವಿನ್ಯಾಸವು "defense in depth" ತತ್ವವನ್ನು ಅನುಸರಿಸುತ್ತದೆ: ಒಂದು ವೇಳೆ ಏಜೆಂಟ್ ಒಂದು ಕಾವಲುಗಾರನನ್ನು ದಾಟಿದರೆ, ಇನ್ನೊಂದು ಕಾವಲುಗಾರನು ತಪ್ಪನ್ನು ಹಿಡಿಯಬಹುದು.
ಮಿತಿಗಳು ಮತ್ತು ಮುಕ್ತ ಸವಾಲುಗಳು
ಈ ಪ್ರಸ್ತಾವನೆಯು ಎಲ್ಲಾ ಸಮಸ್ಯೆಗಳಿಗೂ ಒಂದೇ ಪರಿಹಾರ ಎಂದು ಹೇಳಿಕೊಳ್ಳುವುದಿಲ್ಲ. ಒಂದು ಬುದ್ಧಿವಂತ ಏಜೆಂಟ್, ಹಾನಿಕಾರಕ ಕ್ರಮಗಳನ್ನು ಮಾಡುತ್ತಲೇ ಉದ್ದೇಶ ಪರಿಕರಗಳನ್ನು (intent tools) ಬಳಸದಂತೆ ಕಲಿಯಬಹುದು. ಆದ್ದರಿಂದ, ಡೆವಲಪರ್ಗಳು ಈ ಚೌಕಟ್ಟನ್ನು ಈ ಕೆಳಗಿನವುಗಳೊಂದಿಗೆ ಸಂಯೋಜಿಸಬೇಕು:
- ಬಾಹ್ಯ ನೀತಿ ಎಂಜಿನ್ಗಳು (External policy engines) – ಇವು ಉದ್ದೇಶದ ಸಂಕೇತಗಳಿಗಿಂತ ಮಿಗಿಲಾಗಿ ಉನ್ನತ ಮಟ್ಟದ ನಿಯಮಗಳನ್ನು ಜಾರಿಗೆ ತರುತ್ತವೆ.
- ಮಾನವ ಮೇಲ್ವಿಚಾರಣೆ – ಸ್ವಯಂಚಾಲಿತ ಪರಿಶೀಲನೆಗಳು ಸಾಲದಂತಹ ಹೆಚ್ಚಿನ ಅಪಾಯವಿರುವ ಕ್ಷೇತ್ರಗಳಿಗೆ.
- ಬಲಿಷ್ಠ ಪರಿಕರಗಳು (Robust tooling) – ಮಾಡೆಲ್ ಉದ್ದೇಶದ ಕರೆಗಳನ್ನು ಅಡಗಿಸಲು ಅಥವಾ ಮರೆಮಾಡಲು ಕಷ್ಟವಾಗುವಂತೆ ಮಾಡುವುದು.
ಪ್ರಮುಖ ಅಂಶ
ಏಜೆಂಟ್ನ ಅಪಾಯಕಾರಿ ಆಲೋಚನೆಗಳು ರೂಪಣಗೊಂಡ ಕ್ಷಣದಲ್ಲೇ ಅವುಗಳನ್ನು ಗಮನಿಸಲು ಸಾಧ್ಯವಾಗುವಂತೆ ಮಾಡುವ ಮೂಲಕ, Intent-as-a-Tool ಡೆವಲಪರ್ಗಳಿಗೆ ಹಾನಿಕಾರಕ ಕ್ರಮಗಳು ಸಂಭವಿಸುವ ಮೊದಲೇ ಅವುಗಳನ್ನು ತಡೆಯಲು ಒಂದು ಪ್ರಾಯೋಗಿಕ ಸಾಧನವನ್ನು ನೀಡುತ್ತದೆ. ಇದು ಅಡಗಿರುವ ನಿರ್ಧಾರದ ಹಂತವನ್ನು ನಿಯಂತ್ರಿಸಬಹುದಾದ ಘಟನೆಯನ್ನಾಗಿ ಪರಿವರ್ತಿಸುತ್ತದೆ. ಈ ವಿಧಾನವು ಅಸ್ತಿತ್ವದಲ್ಲಿರುವ ನೀತಿ ಮತ್ತು ಮೇಲ್ವಿಚಾರಣಾ ವ್ಯವಸ್ಥೆಗಳನ್ನು ಬದಲಿಸುವ ಬದಲು, ಅವುಗಳಿಗೆ ಪೂರಕವಾಗಿ ನೈಜ-ಸಮಯದ ಸುರಕ್ಷತಾ ಚೆಕ್ಪಾಯಿಂಟ್ ಅನ್ನು ಸೇರಿಸುತ್ತದೆ. ಸ್ವಾಯತ್ತ ಏಜೆಂಟ್ಗಳು ಹೆಚ್ಚಿನ ಜವಾಬ್ದಾರಿಯನ್ನು ವಹಿಸಿಕೊಳ್ಳುತ್ತಿದ್ದಂತೆ, ಅವುಗಳ ಕ್ರಮಗಳು ಮಾನವ ಉದ್ದೇಶಕ್ಕೆ ಅನುಗುಣವಾಗಿರಲು ಇಂತಹ ಪೂರ್ವಭಾವಿ ರಕ್ಷಣೆಗಳು ಅತ್ಯಗತ್ಯವಾಗಬಹುದು.
