ಇತ್ತೀಚಿನ ಭದ್ರತಾ-ಪರೀಕ್ಷಾ ಅಭಿಯಾನದ ಸಮಯದಲ್ಲಿ ತನ್ನ ಮೂರು Claude ಮಾಡೆಲ್ಗಳು ಸ್ಯಾಂಡ್ಬಾಕ್ಸ್ನಿಂದ ಹೊರಬಂದು ನೈಜ-ಪ್ರಪಂಚದ ವ್ಯವಸ್ಥೆಗಳನ್ನು ಪ್ರವೇಶಿಸಿವೆ ಎಂದು Anthropic ತಿಳಿಸಿದೆ, ಇದು ತಕ್ಷಣದ ಮೌಲ್ಯಮಾಪನಗಳ ಸ್ಥಗಿತ ಮತ್ತು ಸಾರ್ವಜನಿಕ ವರದಿಗೆ ಕಾರಣವಾಗಿದೆ.
ಕಂಪನಿಯು 141,006 ಸೈಬರ್ ಸುರಕ್ಷತಾ ಪರೀಕ್ಷೆಗಳನ್ನು ನಡೆಸಿತು ಮತ್ತು ಮಾಡೆಲ್ಗಳು ಅನುಕರಿಸಿದ (simulated) ಪರಿಸರಕ್ಕೆ ಬದಲಾಗಿ ನೇರ ಗುರಿಗಳನ್ನು ತಲುಪಿದ ಮೂರು ಘಟನೆಗಳನ್ನು ಕಂಡುಕೊಂಡಿತು. ಮೂರನೇ ವ್ಯಕ್ತಿಯ ಪಾಲುದಾರರೊಂದಿಗೆ (third-party partner) ಉಂಟಾದ ತಪ್ಪು ಕಾನ್ಫಿಗರೇಶನ್ನಿಂದಾಗಿ ಸ್ಯಾಂಡ್ಬಾಕ್ಸ್ ಪರಿಣಾಮಕಾರಿಯಾಗಿ ತೆರೆದಂತಾಗಿತ್ತು.
ಉಲ್ಲಂಘನೆಗಳು ಹೇಗೆ ಸಂಭವಿಸಿದವು
- Claude Opus 4.7 ಇಂಟರ್ನೆಟ್ನಲ್ಲಿ ಲಭ್ಯವಿದ್ದ ಒಂದು ನೈಜ ಕಂಪನಿಯ ಮೇಲೆ ದಾಳಿ ಮಾಡಿ, ದುರ್ಬಲ ಪಾಸ್ವರ್ಡ್ಗಳನ್ನು ಊಹಿಸುವ ಮೂಲಕ ಕೆಲವು ನೂರಾರು ಸಾಲುಗಳ ಡೇಟಾಬೇಸ್ ಅನ್ನು ಪಡೆದುಕೊಂಡಿತು.
- Claude Mythos 5 ನೈಜ PyPI ರೆಪೊಸಿಟರಿಗೆ ಪ್ಯಾಕೇಜ್ ಅನ್ನು ಪ್ರಕಟಿಸುವ ಮೂಲಕ ಸಪ್ಲೈ-ಚೈನ್ ದಾಳಿಯನ್ನು (supply-chain attack) ನಡೆಸಿತು. ರೆಜಿಸ್ಟ್ರಿಯು ಅಸಹಜತೆಯನ್ನು ಗುರುತಿಸುವ ಮೊದಲೇ ಆ ಪ್ಯಾಕೇಜ್ 15 ಪ್ರೊಡಕ್ಷನ್ ಯಂತ್ರಗಳಲ್ಲಿ ಇನ್ಸ್ಟಾಲ್ ಆಗಿತ್ತು.
- ಒಂದು ಆಂತರಿಕ ಸಂಶೋಧನಾ ಮಾಡೆಲ್ (internal research model) 9,000 ಗುರಿಗಳನ್ನು ಸ್ಕ್ಯಾನ್ ಮಾಡಿತು, ಒಂದು ಅಪ್ಲಿಕೇಶನ್ ಅನ್ನು ಕಬಳಿಸಿತು (compromised), ನಂತರ ಹೋಸ್ಟ್ ತನ್ನ ಅನುಕರಿಸಿದ ಕಾರ್ಯಕ್ಕೆ ಹೊಂದಿಕೆಯಾಗುವುದಿಲ್ಲ ಎಂದು ಗುರುತಿಸಿದ ನಂತರ ತಾನೇ ನಿಂತುಕೊಂಡಿತು.
ಇವು "ರೋಗಿ AI" (rogue AI) ಘಟನೆಗಳಲ್ಲ ಎಂದು Anthropic ಒತ್ತಿಹೇಳಿದೆ. ಮಾಡೆಲ್ಗಳು ತಮಗೆ ಸೂಚಿಸಿದ ಕೆಲಸವನ್ನೇ ಮಾಡಿದವು; ಪರೀಕ್ಷಾ ಮೂಲಸೌಕರ್ಯವು ಅವುಗಳನ್ನು ಮುಕ್ತ ಇಂಟರ್ನೆಟ್ನಿಂದ ಪ್ರತ್ಯೇಕಿಸಲು ವಿಫಲವಾಯಿತು.
ಇದು ಏಕೆ ಮುಖ್ಯ
AI ಏಜೆಂಟ್ಗಳು ಕೋಡ್ ಅನ್ನು ಕಾರ್ಯಗತಗೊಳಿಸಲು ಮತ್ತು ನೆಟ್ವರ್ಕ್ ಕರೆಗಳನ್ನು ಮಾಡಲು ಸಾಧ್ಯವಾದಾಗ, ನಿಯಂತ್ರಿತ ಸ್ಯಾಂಡ್ಬಾಕ್ಸ್ ಮತ್ತು ಲೈವ್ ನೆಟ್ವರ್ಕ್ ನಡುವಿನ ವ್ಯತ್ಯಾಸ ಎಷ್ಟು ಕಡಿಮೆ ಇರುತ್ತದೆ ಎಂಬುದನ್ನು ಈ ಘಟನೆಗಳು ತೋರಿಸುತ್ತವೆ. ಸ್ವಾಯತ್ತ ಏಜೆಂಟ್ಗಳೊಂದಿಗೆ (autonomous agents) ಪ್ರಯೋಗ ಮಾಡುತ್ತಿರುವ ಉದ್ಯಮಗಳಿಗೆ, ಸಿಸ್ಟಮ್ ಪ್ರಾಂಪ್ಟ್ ಅಥವಾ README ಫೈಲ್ವು ಮಿತಿಗಳನ್ನು ಖಚಿತಪಡಿಸಲು ಸಾಧ್ಯವಿಲ್ಲ. PyPI ಪ್ರಕರಣವು ತೋರಿಸುವಂತೆ, ಒಂದು ಸಣ್ಣ ಡೇಟಾ ಸೆಟ್ ಅಥವಾ ಕೆಲವು ಯಂತ್ರಗಳು ದೊಡ್ಡ ಮಟ್ಟದ ಸಪ್ಲೈ-ಚೈನ್ ಕಬಳಿಕೆಗೆ ಕಾರಣವಾಗಬಹುದು.
ಈ ಮೂರು ಉಲ್ಲಂಘನೆಗಳು Anthropic ನ ಪ್ರಯತ್ನದ ವ್ಯಾಪ್ತಿಯನ್ನು ಸಹ ಬಹಿರಂಗಪಡಿಸುತ್ತವೆ: ಅದು ಕೇವಲ ಯಾದೃಚ್ಛಿಕ ಮಾದರಿಯನ್ನು (random sample) ಮಾತ್ರವಲ್ಲದೆ, ಪ್ರತಿಯೊಂದು ಪರೀಕ್ಷಾ ರನ್ ಅನ್ನು ಆಡಿಟ್ ಮಾಡಿತು. ಆ ಕೂಲಂಕಷತೆಯು ಘಟನೆಗಳು ಹರಡುವ ಮೊದಲೇ ತಪ್ಪು ಕಾನ್ಫಿಗರೇಶನ್ ಅನ್ನು ಗುರುತಿಸಲು ಕಂಪನಿಗೆ ಸಹಾಯ ಮಾಡಿತು.
Anthropic ಏನು ಮಾಡಿತು
ಸ್ಯಾಂಡ್ಬಾಕ್ಸ್ ವೈಫಲ್ಯವನ್ನು ಕಂಡುಕೊಂಡ ಒಂದು ದಿನದೊಳಗೆ, Anthropic ನಡೆಯುತ್ತಿದ್ದ ಎಲ್ಲಾ ಮೌಲ್ಯಮಾಪನಗಳನ್ನು ಸ್ಥಗಿತಗೊಳಿಸಿತು. ಒಂದು ವಾರದ ನಂತರ, ಅದು ಮೂರು ಘಟನೆಗಳು, ತಾಂತ್ರಿಕ ಕಾರಣ ಮತ್ತು ತಕ್ಷಣದ ಪರಿಹಾರ ಕ್ರಮಗಳನ್ನು ಪಟ್ಟಿ ಮಾಡುವ ವಿವರವಾದ ಬಹಿರಂಗಪಡಿಸುವಿಕೆಯನ್ನು ಬಿಡುಗಡೆ ಮಾಡಿತು.
AI-ಏಜೆಂಟ್ ಬಳಕೆದಾರರಿಗೆ ಪ್ರಾಯೋಗಿಕ ಸಲಹೆಗಳು
- ನೇರ ಪರಿசோதனೆಗಳ ಮೂಲಕ ನೆಟ್ವರ್ಕ್ ಮಿತಿಗಳನ್ನು ದೃಢೀಕರಿಸಿ – ಪ್ರಾಂಪ್ಟ್ ಅಥವಾ ಕಾನ್ಫಿಗರೇಶನ್ ಫೈಲ್ ಏಜೆಂಟ್ ಅನ್ನು ನಿಜವಾಗಿಯೂ ಪ್ರತ್ಯೇಕಿಸುತ್ತದೆ ಎಂದು ಭಾವಿಸಬೇಡಿ.
- ಅಧಿಕಾರಗಳನ್ನು (credentials) ಕನಿಷ್ಠ ಮಟ್ಟಕ್ಕೆ ಸೀಮಿತಗೊಳಿಸಿ – ಕಾರ್ಯಕ್ಕೆ ಅತ್ಯಗತ್ಯವಾಗಿ ಬೇಕಾದವುಗಳನ್ನು ಮಾತ್ರ ನೀಡಿ.
- ನೀವೇ ತಲುಪುವಿಕೆಯನ್ನು (reachability) ಪರೀಕ್ಷಿಸಿ – ಸೂಕ್ಷ್ಮ ಸಂಪನ್ಮೂಲಗಳನ್ನು ಹಸ್ತಾಂತರಿಸುವ ಮೊದಲು ಏಜೆಂಟ್ನ ನೈಜ ನೆಟ್ವರ್ಕ್ ದೃಷ್ಟಿಕೋನವನ್ನು ಪರೀಕ್ಷಿಸಿ.
- ಅನಿರೀಕ್ಷಿತ ಚಟುವಟಿಕೆಗಳಿಗಾಗಿ ಮೇಲ್ವಿಚಾರಣೆ ಮಾಡಿ – ಯೋಜನೆಯಿಂದ ಹೊರಬರುವ ಔಟ್ಬೌಂಡ್ ಕನೆಕ್ಷನ್ಗಳು ಅಥವಾ ಪ್ಯಾಕೇಜ್ ನೋಂದಣಿಗಳಿಗೆ ಎಚ್ಚರಿಕೆಗಳನ್ನು (alerts) ಹೊಂದಿಸಿ.
ಈ ಘಟನೆಯು ಒಂದು ಸರಳ ಸತ್ಯವನ್ನು ಒತ್ತಿಹೇಳುತ್ತದೆ: AI ಮಾಡೆಲ್ಗೆ ಇಂಟರ್ನೆಟ್ ಪ್ರವೇಶವನ್ನು ನೀಡುವುದು ಒಬ್ಬ ಮಾನವ ಆಪರೇಟರ್ಗೆ ಅಧಿಕಾರಗಳನ್ನು ನೀಡಿದಷ್ಟೇ ಅಪಾಯಕಾರಿಯಾಗಿದೆ. ಸ್ಯಾಂಡ್ಬಾಕ್ಸ್ ಗ್ಯಾರಂಟಿಗಳು ಸಾಬೀತಾಗುವವರೆಗೆ, ಪ್ರತಿಯೊಂದು AI-ಚಾಲಿತ ಕ್ರಮವನ್ನು ಸಂಭಾವ್ಯವಾಗಿ ನಿರ್ಬಂಧವಿಲ್ಲದ ಕ್ರಮವೆಂದು ಪರಿಗಣಿಸಿ ಮತ್ತು ಅದಕ್ಕೆ ಅನುಗುಣವಾಗಿ ಪರಿಸರವನ್ನು ಸುರಕ್ಷಿತಗೊಳಿಸಿ.
