AI కోడ్ అసిస్టెంట్లు లేని ప్యాకేజీ పేర్లను ఇస్తున్నాయి, మరియు దాడి చేసేవారు ఆ భ్రమలను (hallucinations) నిజమైన సప్లై-చైన్ రిస్క్లుగా మారుస్తున్నారు.
Lasso Security కి చెందిన సెక్యూరిటీ రీసెర్చర్ Bar Lanyado, ఒక AI-ఆధారిత కోడింగ్ టూల్ను Python క్లయింట్ కోసం అడిగినప్పుడు, ఆ మోడల్ huggingface-cliని ఇన్స్టాల్ చేయమని సూచించింది. ఆ ప్యాకేజీ అనేది ఒక ఫాంటమ్ (phantom); అసలైన లైబ్రరీ huggingface_hub అనే పేరుతో ఉంటుంది. ఈ ప్రమాదాన్ని నిరూపించడానికి, Lanyado ఆ నకిలీ పేరును Python Package Index (PyPI)లో ఒక ఖాళీ ప్లేస్హోల్డర్గా నమోదు చేశారు. మూడు నెలల లోపే ఆ ప్లేస్హోల్డర్ 30,000 కంటే ఎక్కువ డౌన్లోడ్లను పొందింది, పబ్లిక్ డాక్యుమెంటేషన్లో కనిపించింది మరియు Alibaba యొక్క రిపోజిటరీల నుండి సేకరించిన కోడ్ శాంపిల్స్లో కూడా కనిపించింది.
ఒక ఫాంటమ్ ప్యాకేజీ నిజమైన ముప్పుగా ఎలా మారుతుంది
- Prompt → hallucination – ఒక డెవలపర్ AI సహాయం కోరతారు. నాయిసీ ఇంటర్నెట్ డేటాపై శిక్షణ పొందిన మోడల్, వినడానికి నమ్మదగినట్లుగా ఉండే ఒక ప్యాకేజీ పేరును సృష్టిస్తుంది.
- Copy-paste → documentation – ఆ సూచన README, Stack Overflow సమాధానం లేదా అంతర్గత వికీలో చేరుతుంది. ఒకసారి రాసిన తర్వాత, ఆ పేరు కమ్యూనిటీ అంతటా వ్యాపిస్తుంది.
- Code integration – AIని నమ్మే డెవలపర్, ఆ పేరును requirements ఫైల్లో జోడించి ప్రొడక్షన్కు పంపిస్తారు.
ప్రస్తుత రక్షణ చర్యలు ఈ సమస్యను ఎందుకు గుర్తించలేవు
Static analysis టూల్స్ మరియు vulnerability స్కానర్లు తెలిసిన CVEలు మరియు విడుదల చరిత్ర ఉన్న లైబ్రరీల కోసం వెతుకుతాయి. AI సూచన కంటే ముందు సున్నా డౌన్లోడ్లు ఉన్న కొత్తగా ప్రచురించబడిన ప్యాకేజీకి ఎటువంటి CVE ఉండదు, ఎటువంటి పేరు (reputation) ఉండదు, కాబట్టి అది క్లీన్గా కనిపిస్తుంది. ప్రామాణికమైన “is the version vulnerable?” చెక్ 'false' అని చూపిస్తుంది, దీనివల్ల డెవలపర్లకు తప్పుడు భద్రతా భావం కలుగుతుంది.
ఈ ప్రయోగం ఏమిని నిరూపిస్తుంది
- AI-కల్పించిన పేర్లు ప్రొడక్షన్కు చేరుతాయి – 30,000 కంటే ఎక్కువ డౌన్లోడ్లు డెవలపర్లు నిజంగానే ఈ ఫాంటమ్ ప్యాకేజీలను ఉపయోగిస్తున్నారని చూపుతున్నాయి.
- Hallucinations డాక్యుమెంటేషన్గా మారుతాయి – ఒకసారి నకిలీ పేరు పబ్లిక్ గైడ్లో కనిపిస్తే, అది ఎంతకాలమైనా అలాగే ఉండి, తప్పును వ్యాపింపజేస్తుంది.
- రిజిస్ట్రేషన్ చాలా సులభం – PyPIలో ప్యాకేజీని ప్రచురించడానికి ఎటువంటి ఖర్చు ఉండదు మరియు కేవలం నిమిషాల్లోనే పూర్తవుతుంది, ఇది సప్లై-చైన్ దుర్వినియోగానికి మార్గం సుగమం చేస్తుంది.
నిజంగా పనిచేసే రక్షణ చర్యలు
- ప్రతి డిపెండెన్సీని ధృవీకరించండి – కొత్త రిక్వైర్మెంట్ను జోడించే ముందు, ప్యాకేజీ ఇండెక్స్లో వెతికి, ఆ పేరు ఇప్పటికే ఉన్న, డాక్యుమెంట్ చేయబడిన లైబ్రరీతో సరిపోలుతుందో లేదో నిర్ధారించుకోండి.
- అధికారిక మూలాలతో సరిచూసుకోండి – సూచించబడిన పేరును వెండర్ యొక్క రిపోజిటరీ లేదా అధికారిక ఇన్స్టాలేషన్ గైడ్తో పోల్చి చూడండి.
- తక్కువ వాడకం ఉన్న కొత్త ప్యాకేజీలను అధిక రిస్క్గా పరిగణించండి – అతి తక్కువ డౌన్లోడ్లు ఉన్న లేదా చాలా ఇటీవల విడుదలైన ఏ డిపెండెన్సీనైనా మాన్యువల్ రివ్యూ కోసం ఫ్లాగ్ చేయండి.
తదుపరి ఏమి గమనించాలి
దీని సారాంశం సరళమైనది: AI సూచన అనేది గ్యారెంటీ కాదు. ప్రతి కొత్త డిపెండెన్సీని తనిఖీ చేయని థర్డ్-పార్టీ కాంపోనెంట్గా పరిగణించండి, దాని మూలాన్ని (provenance) ధృవీకరించండి మరియు ఫాంటమ్ ప్యాకేజీ ప్రొడక్షన్లోకి వెళ్లకుండా సప్లై చైన్పై నిఘా ఉంచండి.
