இன்று ஒவ்வொரு முக்கிய நகரமும் வீடியோக்களின் அடிப்படையிலேயே இயங்குகிறது. போக்குவரத்து சந்திப்புகள், சப்வே நடைமேடைகள், பொதுப் பூங்காக்கள் மற்றும் வணிகப் பகுதிகள் ஆகியவை நகராட்சி கட்டுப்பாட்டு அறைகளுக்குத் தொடர்ச்சியான காட்சிகளை வழங்குகின்றன. இதன் அளவு மலைக்க வைக்கிறது. சரியான விளக்கம் இல்லையென்றால், அந்தப் படத் தொகுப்புகள் சர்வர் இடத்தைப் பயன்படுத்தும் விலையுயர்ந்த கோப்புகளாக மட்டுமே இருக்கும். Deep learning இந்தச் சூழலை மாற்றியுள்ளது. இது நகர்ப்புற அமைப்புகளுக்கு நிகழ்வுகளைக் கவனிப்பதற்கும், புரிந்துகொள்வதற்கும் மற்றும் அவை நடக்கும்போதே எதிர்வினையாற்றுவதற்கும் திறன் அளிக்கிறது, இதன் மூலம் செயலற்ற பதிவுகளைச் செயல்படும் உள்கட்டமைப்பாக மாற்றுகிறது.

பிக்சல்களிலிருந்து முடிவுகள் வரை

பாரம்பரிய Computer vision முறைகள் கைமுறையாக உருவாக்கப்பட்ட விதிகளைச் சார்ந்திருந்தன. குறிப்பிட்ட வடிவங்கள், வண்ணங்கள் அல்லது இயக்க முறைகளைத் தேடுமாறு பொறியாளர்கள் அமைப்புகளைத் திட்டமிட்டனர். இந்த முறைகள் கட்டுப்படுத்தப்பட்ட ஆய்வகங்களில் வேலை செய்தன, ஆனால் நகரங்கள் சிக்கலானவை. நிழல்கள் மாறுகின்றன. மழை லென்ஸ்களை மங்கலாக்குகிறது. பயிற்சியளிக்கப்பட்ட வரைபடங்களுடன் தொடர்பில்லாத குடைகளைத் தாங்கி பாதசாரிகள் கூடுகிறார்கள். விதி அடிப்படையிலான அமைப்புகள் தொடர்ந்து தோல்வியடைந்து, தவறான எச்சரிக்கைகளால் (false positives) இயக்குபவர்களைத் திணறடித்தன.

Deep learning இந்தப் பிரச்சினையை வேறு விதமாக அணுகுகிறது. Convolutional neural networks மற்றும் அவற்றின் வழித்தோன்றல்கள் தரவிலிருந்து நேரடியாக அம்சங்களைக் கற்றுக்கொள்கின்றன. ஒரு மிதிவண்டி எப்படி இருக்கும் என்று கணினிக்குச் சொல்வதற்குப் பதிலாக, அந்த மாதிரி (model) மிதிவண்டியின் சொந்த உள்க்கருத்தைப் பெறும் வரை பொறியாளர்கள் மில்லியன் கணக்கான லேபிளிடப்பட்ட உதாரணங்களை அதற்கு வழங்குகிறார்கள். இதன் விளைவாக, நிஜ உலக மாற்றங்களைச் சிதையாமல் கையாளக்கூடிய ஒரு அமைப்பு உருவாகிறது. நெரிசலான ஒரு வீதியில் பொருத்தப்பட்ட கேமரா, அந்திப் பொழுது அல்லது லேசான மூடுபனியில் கூட, ஒரு டெலிவரி வேனை (delivery van) பேருந்திலிருந்து வேறுபடுத்திப் பார்க்க முடியும், அல்லது வாகனங்கள் ஒன்றுடன் ஒன்று மேலோங்கி இருக்கும்போதும் கூடச் சரியாகக் கண்டறியும். மிக முக்கியமாக, இந்த மாதிரி வெறும் பிக்சல்களைத் தராமல், confidence scores மற்றும் கட்டமைக்கப்பட்ட metadata ஆகியவற்றை வெளியிடுகிறது, இதன் மூலம் அடுத்தகட்ட மென்பொருள்கள் எச்சரிக்கைகளைத் தூண்டவோ, டேஷ்போர்டுகளைப் புதுப்பிக்கவோ அல்லது போக்குவரத்து கட்டுப்பாட்டு வன்பொருளுக்கு நேரடியாகத் தரவுகளை வழங்கவோ முடியும்.

போக்குவரத்து மேலாண்மை மற்றும் ஓட்டக் கட்டுப்பாடு

நகர்ப்புறப் போக்குவரத்து என்பது வீடியோ பகுப்பாய்வின் (video analytics) மிகத் தெளிவான வெற்றிகளில் ஒன்றாகும். நிலையான நேரக் கட்டுப்பாட்டு போக்குவரத்து விளக்குகள் பல தசாப்தங்களுக்கு முன்பே கணிக்கக்கூடிய போக்குவரத்து நேரங்களுக்காக வடிவமைக்கப்பட்டன. ஒரு இசை நிகழ்ச்சி இரண்டு மணிநேரம் முன்னதாகவே முடிந்து மக்கள் வீதிகளுக்கு வரும்போதோ அல்லது ஒரு சிறிய விபத்து நடுப்பாதையைத் தடுக்கும்போதோ அவற்றால் மாற்றங்களுக்கு ஏற்பச் செயல்பட முடியாது.

சந்திப்புகளில் பொருத்தப்பட்டுள்ள Deep learning அமைப்புகள் வாகனங்களை அவற்றின் வகையைப் பொறுத்து எண்ணுகின்றன, சிவப்பு விளக்குகளின் போது வரிசையின் நீளத்தை அளவிடுகின்றன மற்றும் காத்திருப்பு நேரத்தைக் கணிக்கின்றன. ஒரு சாலை பிஸியாக இருக்கிறது என்பதை மட்டுமல்லாமல், அது ஏன் பிஸியாக இருக்கிறது என்பதையும் நகரப் பொறியாளர்களால் காண முடியும். அந்தத் தேக்கம் போக்குவரத்து நெரிசலாலா, பாதுகாக்கப்பட்ட சிக்னல்கள் இல்லாத இடத்திலுள்ள இடதுபுறத் திருப்பங்களா அல்லது சிக்னலுக்கு எதிராகக் கடக்கும் பாதசாரிகளாலா ஏற்படுகிறது? Onboard inference வசதி கொண்ட கேமராக்கள், உண்மையில் அதிகப் போக்குவரத்தைக் கொண்டு செல்லும் திசைக்கு முன்னுரிமை அளிக்கும் வகையில் சிக்னல் ஃபேசிங்கில் (signal phasing) நிகழ்நேரத்தில் மாற்றியமைக்க முடியும். சில அமைப்புகள் விபத்துகளை உடனடியாகக் கண்டறிகின்றன—தவறான திசையில் செல்லும் ஓட்டுநர், பழுதான வாகனம் அல்லது சாலையில் உள்ள இடிபாடுகள் போன்றவற்றை—ஒரு மனிதர் பல மானிட்டர்களைப் பார்த்துச் செயல்படுவதை விட வேகமாகக் கண்டறிகின்றன.

இந்தத் கருவிகள் விரிவான நகர்ப்புறத் திட்டமிடலுடனும் ஒருங்கிணைக்கப்படுகின்றன. வாரக்கணக்கில் வீடியோக்களைப் பகுப்பாய்வு செய்வதன் மூலம், புதிய திருப்பப் பாதைகள் அல்லது மாற்றியமைக்கப்பட்ட வேக வரம்புகளின் தேவையை உணர்த்தும் தொடர்ச்சியான நெரிசல்களை நகரங்கள் அடையாளம் காண்கின்றன, இதன் மூலம் யூகங்களுக்குப் பதிலாகக் கண்கூடாகக் காணப்படும் நடத்தையை அடிப்படையாகக் கொண்டு முடிவெடுக்க முடிகிறது.

பொதுப் பாதுகாப்பு மற்றும் கண்காணிப்பு

பாதுகாப்புப் பயன்பாடுகள் வெறும் இயக்கத்தைக் கண்டறிவதைத் தாண்டி விரிந்துள்ளன. நவீன பகுப்பாய்வு முறைகளால் விபத்துகள் அல்லது குற்றங்களுக்கு முந்தைய அறிகுறிகளைக் கண்டறிய முடியும். ஒரு ரயில் நடைமேடையில் ஒரு பேக்‌பேக் (backpack) குறிப்பிட்ட நேரத்திற்கு மேல் கைவிடப்பட்டிருந்தால் அது ஒரு அறிவிப்பைத் தூண்டும். ஆற்றங்கரை கேமராக்களில் காணப்படும் புகை அல்லது மக்கள் திடீரென சிதறி ஓடுவது, யாராவது அழைப்பதற்கு முன்பே அவசர நிலையைத் தெரிவிக்கலாம்.

இதில் முக்கிய முன்னேற்றம் என்பதுத் தேர்ந்தெடுக்கும் திறன் (selectivity) ஆகும். பழைய அமைப்புகள் ஒவ்வொரு அணிலுக்கும் அல்லது அசையும் மரக்கிளைக்கும் எச்சரிக்கை விடுத்தன. Deep learning மாதிரிகள் தேவையற்ற இயக்கங்களை வடிகட்டி, உண்மையான அசாதாரண நடத்தைகளைக் கண்டறிகின்றன. ஒரு பொது இடத்தில் நடக்கும் சண்டை, நண்பர்கள் விளையாடுவது அல்லது ஒரு தெருக் கலைஞரின் சாகசக் கலை ஆகியவற்றிலிருந்து முற்றிலும் மாறுபட்ட ஒரு இயக்கத் தன்மையைக் (kinetic signature) கொண்டிருக்கும். பாதுகாப்புப் பணியாளர்கள் நூற்றுக்கணக்கான தவறான எச்சரிக்கைகளைத் துரத்துவதற்குப் பதிலாக, சரிபார்க்கப்பட்ட சில முக்கிய நிகழ்வுகளில் மட்டும் தங்கள் கவனத்தைச் செலுத்த முடியும்.

கூட்டத்தைக் கண்காணித்தல் மற்றும் அடர்த்தி பகுப்பாய்வு

பெரிய பொதுக் கூட்டங்கள் தனித்துவமான அபாயங்களை ஏற்படுத்துகின்றன. விளையாட்டு மைதான வெளியேறும் வழிகள், திருவிழா இடங்கள் மற்றும் விடுமுறை காலங்களில் போக்குவரத்து மையங்கள் ஆகியவை மக்கள் அடர்த்தி பாதுகாப்பான அளவைத் தாண்டும்போது ஆபத்தானதாக மாறக்கூடும். Deep learning அமைப்புகள் ஒரு காட்சியில் மக்களின் பரவலான விநியோகத்தைப் பகுப்பாய்வு செய்வதன் மூலம் கூட்டத்தைக் கணக்கிடுதல் மற்றும் அடர்த்தியை மதிப்பிடுதல் போன்ற பணிகளைச் செய்கின்றன.

இந்தக் கருவிகள் கூட்ட நெரிசல் எங்கு அதிகமாக உள்ளது என்பதைக் காட்டும் வெப்ப வரைபடங்களை (heatmaps) நிகழ்நேரத்தில் உருவாக்குகின்றன. நிகழ்வு ஒருங்கிணைப்பாளர்கள் மற்றும் காவல்துறையினர் கூடுதல் வெளியேறும் வழிகளைத் திறக்கலாம், பாதசாரிகளின் நடமாட்டத்தை மாற்றியமைக்கலாம் அல்லது ஆபத்தான நெரிசல் உருவாவதற்கு முன்பே வருகைகளைக் குறைக்கலாம். வழக்கமான காலங்களில், இதே தொழில்நுட்பம் சில்லறை விற்பனைப் பாதைகள் அல்லது போக்குவரத்து இடைநிலைத் தளங்கள் வழியாக பாதசாரிகளின் ஓட்டத்தை அளவிடுகிறது, இது கட்டிடக் கலைஞர்கள் மற்றும் நகரத் திட்டமிடுபவர்கள் மக்கள் பொது இடங்கள் வழியாக எவ்வாறு உண்மையில் நகர்கிறார்கள் என்பதைப் புரிந்துகொள்ள உதவுகிறது. விமான நிலையங்கள் மற்றும் அரசு அலுவலகங்களில் வரிசையின் நீளத்தைக் கணிப்பது, வரிசைகள் மிக நீளமாக மாறுவதற்கு முன்பே பணியாளர்கள் கூடுதல் சேவை சாளரங்களைத் திறக்க அனுமதிக்கிறது.

நகர்ப்புற சூழல்களில் பொருள் கண்டறிதல் மற்றும் கண்காணிப்பு (Object Detection and Tracking in Urban Settings)

நகரங்கள் நகரும் பாகங்களால் நிறைந்தவை: பாதசாரிகள், மிதிவண்டி ஓட்டுநர்கள், ஸ்கூட்டர்கள், செல்லப்பிராணிகள், டெலிவரி ரோபோக்கள் மற்றும் அனைத்து அளவிலான வாகனங்கள். Deep learning அமைப்புகள் இந்த பொருட்களை ஒரு தனிச் சட்டகத்தில் (single frame) கண்டறிவது மட்டுமல்லாமல், காலப்போக்கில் மற்றும் கேமரா நெட்வொர்க்குகள் முழுவதும் அவற்றைக் கண்காணிக்கின்றன.

Multi-object tracking என்பது ஒரு காட்சி வழியாக நகரும் பொருட்கள் அல்லது நபர்களுக்குத் தொடர்ச்சியான அடையாளங்களை வழங்குகிறது. நிறுத்தப்பட்ட ஒரு வேனுக்குப் பின்னால் செல்லும் பாதசாரி அமைப்பின் விழிப்புணர்விலிருந்து மறைந்துவிடவில்லை; அந்த மாதிரி (model) பாதையை முன்னறிவித்து, மீண்டும் தெரியும்போது இலக்கைக் கண்டறிகிறது. ஒன்றையொன்று கடந்து செல்லும் பார்வைகளைக் கொண்ட கேமரா நெட்வொர்க்குகளில் இது விரிவுபடுத்தப்படும்போது, 'person re-identification' மூலம் ஒரு நகரத்தால் ஒரு நலிந்த தனிநபரைப் பின்தொடரவோ அல்லது காணாமல் போன குழந்தையைக் கண்டறியவோ முடியும்; இதற்கு ஒரு ஆபரேட்டர் பல மணிநேர வீடியோக்களைத் தேடிப் பார்க்க வேண்டிய அவசியமில்லை.

இந்தத் திறன்கள் தளவாடங்கள் (logistics) மற்றும் சட்ட அமலாக்கத்திற்கும் அடிப்படையாக அமைகின்றன. தானியங்கி வாகன எண் பலகை அங்கீகாரம் (Automated license plate recognition) ஏற்கனவே பொதுவானது, ஆனால் புதிய வாகன மறுஅடையாளக் கண்டறிதல் (vehicle re-identification) அமைப்புகள், எண் பலகையைப் படிக்காமலேயே, பம்பர் ஸ்டிக்கர்கள், ரூஃப் ரேக்குகள் அல்லது சக்கர வடிவங்கள் போன்ற வேறுபடுத்தும் அம்சங்களைப் பயன்படுத்தி ஒரு குறிப்பிட்ட காரின் பயணத்தைக் கண்காணிக்க முடியும். இது சட்ட அமலாக்கத்திற்கு மிகவும் சக்தி வாய்ந்தது, ஆனால் இது செயல்பாட்டின் எல்லை மற்றும் மேற்பார்வை குறித்த நியாயமான கேள்விகளையும் எழுப்புகிறது, இதை நகர நிர்வாகிகள் கடுமையான கொள்கைகள் மூலம் கையாள வேண்டும்.

உள்கட்டமைப்பு சவால் (The Infrastructure Challenge)

நகர அளவில் இத்தகைய அமைப்புகளைப் பயன்படுத்துவது என்பது மென்பொருள் சார்ந்த பிரச்சனை மட்டுமல்ல. உயர் தெளிவுத்திறன் கொண்ட வீடியோக்களை வழங்கும் ஆயிரக்கணக்கான கேமராக்கள் பெட்டாபைட் அளவிலான தரவுகளை உருவாக்குகின்றன. பகுப்பாய்விற்காக அனைத்தையும் ஒரு மைய கிளவுடுக்கு (central cloud) அனுப்புவது செலவு மிக்கது மற்றும் மெதுவானது. கணக்கீட்டுத் திறனை விட (compute) நெட்வொர்க் அலைவரிசை (bandwidth) ஒரு தடையாக மாறுகிறது.

நகரங்கள் edge computing மூலம் இதற்குப் பதிலளிக்கின்றன. நவீன ஸ்மார்ட் கேமராக்களில் பிரத்யேக inference accelerators உள்ளன, அவை மாதிரிகளை உள்ளூரிலேயே (locally) இயக்கி, எச்சரிக்கைகள், எண்ணிக்கைகள் அல்லது சுருக்கப்பட்ட மெட்டாடேட்டாவை (metadata) மட்டுமே தலைமையகத்திற்குத் திருப்பி அனுப்புகின்றன. இது அலைவரிசைச் செலவைக் குறைக்கிறது மற்றும் தாமதத்தை (latency) வினாடிகளிலிருந்து மில்லி விநாடிகளாகக் குறைக்கிறது, இது போக்குவரத்து சிக்னல்களைச் சரிசெய்யும்போதோ அல்லது ஒரு ரயிலை நிறுத்தும்போதோ மிக முக்கியமானது.

பராமரிப்பு என்பது மற்றொரு தடையாகும். வெளிப்புற கேமராக்களில் அழுக்கு, பனி மற்றும் சிலந்தி வலைகள் சேர்கின்றன. தூய்மையான படங்களைக் கொண்டு பயிற்சி அளிக்கப்பட்ட ஒரு மாதிரி, லென்ஸ் அழுக்காக இருக்கும்போது அதன் செயல்திறன் குறைகிறது. நம்பகமான பயன்பாட்டிற்குத் தானியங்கி ஆரோக்கிய கண்காணிப்பு மற்றும் களப் பராமரிப்பு அட்டவணைகள் தேவைப்படுகின்றன. Firmware புதுப்பிப்புகள், உள்ளூர் தரவுகளுடன் மாதிரியை மறுபயிற்சி செய்தல் மற்றும் பாதுகாப்புத் திருத்தங்கள் ஆகியவை தொடர்ச்சியான செயல்பாட்டுச் செலவுகளைச் சேர்க்கின்றன, இதை முன்னோடித் திட்டங்களின் போது கொள்முதல் குழுக்கள் பெரும்பாலும் குறைத்து மதிப்பிடுகின்றனர்.

தனியுரிமை மற்றும் மனித அம்சம் (Privacy and the Human Element)

நகர்ப்புற வீடியோ பகுப்பாய்வு பற்றிய எந்தவொரு விவாதமும் தனியுரிமையைத் தவிர்க்க முடியாது. பாதசாரிகளை எண்ணும் அதே மாதிரிகள் முகங்களை அடையாளம் காண முடியும். காணாமல் போன நபரைத் தேடும் அதே கண்காணிப்பு ஒரு போராட்டக்காரரைப் பின்தொடரவும் முடியும். இத்தகைய கருவிகளைப் பயன்படுத்தும் நகரங்கள் தெளிவான தரவுப் பாதுகாப்பு வரம்புகளை நிறுவ வேண்டும், முக அங்கீகாரத்தை வாரண்ட் அல்லது சம்மதத்தின் கீழ் வரையறுக்கப்பட்ட சூழ்நிலைகளுக்கு மட்டுமே கட்டுப்படுத்த வேண்டும் மற்றும் கேமரா இருப்பிடங்கள் மற்றும் அமைப்பின் திறன்கள் பற்றிய வெளிப்படைத்தன்மை அறிக்கைகளை வெளியிட வேண்டும்.

அநாமதேயமாக்கல் (Anonymization) நுட்பங்கள் உதவுகின்றன. போக்குவரத்து அல்லது பாதுகாப்பு மேலாண்மைக்குத் தேவையான நடத்தை சார்ந்த மெட்டாடேட்டாவை மட்டும் பிரித்தெடுத்து, முகங்கள் மற்றும் வாகன எண் பலகைகளை இயல்பாகவே மங்கலாக்கும் வகையில் மாதிரிகளை அமைக்கலாம். வார வாரியாகப் பல மூல வீடியோக்களை ஒரு மைய சேமிப்பகத்தில் சேமிப்பதற்குப் பதிலாக, தரவை எட்ஜில் (edge) உள்ளூரிலேயே செயலாக்குவது, வெகுஜனக் கண்காணிப்பு மற்றும் தரவு மீறல்களின் அபாயத்தைக் குறைக்கிறது.

இங்கே ஆய்வு செய்யப்பட்ட அல்காரிதம்கள் மற்றும் பயன்பாடுகள் பற்றிய ஆழமான பார்வைக்கு, முழுமையான ஆராய்ச்சித் தாள் source paper on Dev.to-இல் கிடைக்கிறது. நகர்ப்புற AI மற்றும் கம்ப்யூட்டர் விஷன் துறையில் பணியாற்றும் மற்றவர்களுடன் இந்த யோசனைகளைப் பற்றி விவாதிக்க விரும்பினால், GyaanSetu Telegram community-இல் இணைந்து உரையாடுங்கள்.

மாதிரி பயிற்சியளிக்கப்பட்ட பிறகுதான் உண்மையான வேலை தொடங்குகிறது (The Real Work Starts After the Model Is Trained)

டீப் லேர்னிங், வீடியோ பகுப்பாய்வை ஒரு அறிவியல் சோதனையிலிருந்து செயல்பாட்டு யதார்த்தமாக மாற்றியுள்ளது. ஸ்மார்ட் நகரங்களில் உள்ள கேமராக்கள் இனி வெறும் பதிவுகளை மட்டும் செய்வதில்லை; அவை தகவல்களைப் புரிந்துகொள்கின்றன, அளவிடுகின்றன மற்றும் அதற்கேற்ப செயல்படுகின்றன. ஏற்கனவே பதிவு செய்யப்பட்டு வந்த வீடியோக்களைப் பயன்படுத்தி, போக்குவரத்து ஓட்டத்தை நிர்வகிக்கவும், கூட்ட நெரிசல் தொடர்பான பேரழிவுகளைத் தடுக்கவும் மற்றும் அவசர காலப் பதிலளிப்பை விரைவுபடுத்தவும் தேவையான தொழில்நுட்பம் இப்போது உள்ளது.

ஆனால், வன்பொருளும் அல்காரிதம்களும் இந்த வேலையின் ஒரு பகுதி மட்டுமே. பராமரிப்புத் திட்டங்கள் இன்றி, அலைக்கற்றை வரம்புகளை மதிக்கும் நெட்வொர்க் கட்டமைப்பு இன்றி மற்றும் தனியுரிமைப் பாதுகாப்பு வழிமுறைகள் இன்றி இக்கருவிகளைப் பயன்படுத்தும் ஒரு நகரம், ஒன்று விலையுயர்ந்த தோல்வியையோ அல்லது ஊடுருவும் கண்காணிப்பு அமைப்பையோ உருவாக்கும். இந்த வித்தியாசம் அவற்றைச் செயல்படுத்துவதில் உள்ள நுணுக்கங்களிலேயே உள்ளது. டீப் லேர்னிங் கண்களை வழங்குகிறது; ஆனால் நகரத் திட்டமிடுபவர்களும் பொறியாளர்களுமே சரியான முடிவுகளை எடுக்கிறார்கள்.