Twitch தனது பயனர்களுக்கு “Training for Generative AI” என்ற புதிய toggle வசதியை வழங்கியுள்ளது. இதன் மூலம் ஸ்ட்ரீமர்கள் தங்களது நேரலை ஒளிபரப்புகள், VOD-கள், கிளிப்புகள் மற்றும் சாட் (chat) ஆகியவற்றை Amazon-ன் generative-AI மாதிரிகளுக்குப் பயிற்சியளிக்கப் பயன்படுத்துவதைத் தடுக்க முடியும். இந்தச் செயல்முறை Security and Privacy தாவலில் உள்ளது மற்றும் இது இயல்பாகவே (on by default) ஆன் செய்யப்பட்டிருக்கும். இதன் மூலம், உரை, ஆடியோ, படம் மற்றும் வீடியோ தொகுப்பு கருவிகளுக்குத் தேவையான தரவு சேகரிப்பிலிருந்து (data harvesting) விலக விரும்பும் படைப்பாளர்கள் ஒரே ஒரு கிளிக்கில் சம்மதத்தைத் திரும்பப் பெற முடியும்.
இந்தத் தேர்வு (Toggle) எதைக் கட்டுப்படுத்துகிறது
ஒரு படைப்பாளர் இந்தத் தேர்வை மாற்றும்போது, தனது சேனலின் எந்தவொரு உள்ளடக்கத்தையும் Amazon-ன் AI வழித்தடங்களுக்கு (pipelines) அனுப்புவதை Twitch நிறுத்திவிடும். அதாவது, நேரலை ஒளிபரப்பின் மூல வீடியோ, சேமிக்கப்பட்ட பதிவுகள், குறுகிய ஹைலைட் கிளிப்புகள் மற்றும் ஒவ்வொரு சாட் வரிகளும் இதில் இருந்து விலக்கப்படும். ஸ்ட்ரீமர் பதிவேற்றும் எந்தவொரு உரை அல்லது படங்களுக்கும் இதே கட்டுப்பாடு பொருந்தும். நடைமுறையில், ஸ்ட்ரீமர் தனது டிஜிட்டல் தடத்தைச் சுற்றியுள்ள ஒரு எல்லையை வகுப்பதன் மூலம், அடுத்த தலைமுறை செயற்கை ஊடகங்களை (synthetic media) இயக்கும் பிரம்மாண்டமான multimodal தரவுத்தொகுப்புகளிலிருந்து தனது தரவைப் பாதுகாக்கிறார்.
தொடர்ந்து செயல்படும் AI அம்சங்கள்
இந்தத் தேர்வில் இருந்து விலகுவது (Opting out) தளத்தின் AI சார்ந்த கருவிகளை முடக்கிவிடாது. இந்தத் தேர்வு எந்த நிலையில் இருந்தாலும், moderation bots, பரிந்துரை இயந்திரங்கள் (recommendation engines), ஸ்பான்சர்ஷிப் உதவி சேவைகள் மற்றும் தானியங்கி சப்-டைட்டில்கள் (automatic captioning) போன்ற சேவைகள் அனைத்து சேனல்களிலும் தொடர்ந்து இயங்கும் என்று Twitch கூறுகிறது. இந்தச் சேவைகள் தரவை தளத்திற்குள்ளான செயல்பாடுகளுக்காக மட்டுமே பயன்படுத்துகின்றன, வெளிப்புற மாதிரிகளுக்குப் பயிற்சியளிக்கப் பயன்படுத்துவதில்லை. ஒரு பார்வையாளர், உரிமையாளர் விலகியிருக்கும் (opted out) ஒரு ஸ்ட்ரீமில் சாட் செய்தால், அந்தச் சாட் துண்டை எதிர்கால மாதிரிப் பயிற்சிக்காகப் பயன்படுத்தலாமா என்பதை அந்த உரிமையாளரின் தனியுரிமை அமைப்பே தீர்மானிக்கும்.
இந்த மாற்றம் ஏன் முக்கியமானது
தொழில்நுட்ப ஜாம்பவான்கள் பெரிய மொழி மாதிரிகள் (large language models) மற்றும் வீடியோ உருவாக்கும் அமைப்புகளை மேம்படுத்த, பொதுவில் கிடைக்கும் உள்ளடக்கங்களை எவ்வாறு சேகரிக்கின்றன (scrape) என்ற விவாதம் அதிகரித்து வரும் சூழலில் இந்த நடவடிக்கை எடுக்கப்பட்டுள்ளது. சந்தாக்கள், விளம்பரங்கள் மற்றும் ஸ்பான்சர்ஷிப் மூலம் வருமானம் ஈட்டும் தங்களது படைப்புகளை, வெளிப்படையான அனுமதி இன்றி மறுசுழற்சி செய்யக்கூடாது என்று படைப்பாளர்கள் வாதிடுகின்றனர். ஸ்ட்ரீமர்களுக்குத் தளத்திலேயே விலகும் வசதியை (opt-out) வழங்குவதன் மூலம், சம்மதத்தின் அடிப்படையிலான தரவு சேகரிப்பை நோக்கித் Twitch நகர்வதை உணர்த்துகிறது. இது பயனர் உருவாக்கும் ஊடகங்களை வழங்கும் பிற தளங்களுக்கும் ஒரு தரநிலையாக மாறக்கூடும்.
Amazon-ன் AI குழுக்களைப் பொறுத்தவரை, இந்தத் தேர்வு பல்வேறு வகையான நிகழ்நேரத் தரவு ஆதாரத்தைத் துண்டிக்கிறது. உயர்தர generative மாதிரிகளுக்குப் பயிற்சியளிக்க பொதுவாக பில்லியன் கணக்கான மணிநேர வீடியோ மற்றும் சாட் பதிவுகள் தேவைப்படுகின்றன. Twitch-ன் சூழலில் ஒரு குறிப்பிடத்தக்கப் பகுதி தரவுப் பகிர்வை நிறுத்திவிட்டால், டெவலப்பர்கள் மாற்றுத் தரவுத்தொகுப்புகளைத் தேட வேண்டியிருக்கலாம், உரிம ஒப்பந்தங்களை (licensing deals) மேற்கொள்ள வேண்டியிருக்கலாம் அல்லது செயற்கை தரவு உருவாக்கத்தில் (synthetic data generation) முதலீடு செய்ய வேண்டியிருக்கலாம். இதன் விளைவு, புதிய multimodal AI திறன்கள் எவ்வளவு விரைவாக உருவாகின்றன என்பதை மாற்றியமைக்கக்கூடும்.
சாத்தியமான குறைபாடுகள்
இந்தத் தேர்வு அனைத்து வகையான தரவுப் பயன்பாட்டையும் நீக்கிவிடாது. AI மூலம் இயங்கும் moderation, discovery மற்றும் அணுகல்தன்மை கருவிகள் இன்னும் உள்ளடக்கத்தை ஆய்வு செய்கின்றன, எனவே படைப்பாளர்கள் அந்த அமைப்புகளின் நடைமுறைப் பயன்களைத் தொடர்ந்து பெற முடியும். இருப்பினும், பயிற்சிப் பொருட்களின் அளவு குறைவது, பரந்த நடத்தை சமிக்ஞைகளை (behavioral signals) நம்பியிருக்கும் பரிந்துரை அல்காரிதம்களின் நீண்டகாலத் துல்லியத்தைக் குறைக்கக்கூடும். மாதிரிகளிடம் கற்றுக்கொள்வதற்குத் தரவுகள் குறைவாக இருந்தால், வளர்ந்து வரும் போக்குகளுக்கு (trends) அவை இணையும் வேகம் குறையலாம் என்று பார்வையாளர்கள் உணரக்கூடும்.
இந்த வசதி இயல்பாகவே ஆன் செய்யப்பட்டிருப்பதால், விலக விரும்பும் பொறுப்பு ஸ்ட்ரீமரின் மீதே உள்ளது. இந்தத் தேர்வு பற்றித் தெரியாதவர்கள் தங்களது படைப்புகளைத் தெரியாமலேயே AI பயிற்சிக்கு பங்களிக்கக்கூடும். தரவைப் பகிர்ந்து கொள்ளும் சேனல்களுக்கே பரிந்துரை இயந்திரங்கள் முன்னுரிமை அளிக்கும் என்று கருதி, விலகிச் செல்வது தனது வெளிப்பாட்டைக் (exposure) குறைக்கக்கூடும் என்று சில படைப்பாளர்கள் அஞ்சுகின்றனர் — ஆனால் இந்தத் தகவலை Twitch உறுதிப்படுத்தவில்லை.
அடுத்து கவனிக்க வேண்டியவை
இந்தத் தேர்வை மற்ற Amazon சார்ந்த சேவைகளுக்கும் விரிவாக்குவதற்கான காலக்கெடுவை Twitch இன்னும் அறிவிக்கவில்லை, மேலும் விலகியிருப்பதை (opt-out) எவ்வாறு தணிக்கை செய்யப் போகிறது என்பதையும் விளக்கவில்லை. பார்வையாளர்கள் இதன் தத்தெடுப்பு விகிதங்களைக் கவனிப்பார்கள்: எத்தனை சேனல்கள் உண்மையில் பயிற்சியைத் தடுக்கின்றன, மற்றும் அது பார்வையாளர்களின் எண்ணிக்கை அல்லது வருவாயில் மாற்றங்களை ஏற்படுத்துகிறதா என்பதைப் பார்ப்பார்கள். Amazon-ன் பதில் — அதாவது அது தனது தரவு உள்ளீட்டு வழித்தடங்களை (data-ingestion pipelines) மாற்றியமைக்கிறதா அல்லது புதிய கூட்டாண்மைகளைத் தேடுகிறதா என்பது — இந்தத் தொழில் துறை Twitch சூழலை ஒரு பயிற்சி ஆதாரமாக எவ்வளவு மதிக்கிறது என்பதைக் காட்டும்.
இன்னும் பல தளங்கள் இதே போன்ற சம்மத வழிமுறைகளைத் தத்தெடுத்தால், AI டெவலப்பர்கள் தரவு சேகரிப்பு உத்திகளை மறுவடிவமைப்பு செய்ய வேண்டியிருக்கும்; அவர்கள் வெளிப்படையான உரிம ஒப்பந்தங்கள் மற்றும் படைப்பாளர்களுக்கான ஊக்கத்தொகைகளுக்கு அதிக முக்கியத்துவம் அளிக்க வேண்டியிருக்கும். விரைவான கண்டுபிடிப்புகளுக்கான திறந்த தரவு மற்றும் படைப்பாளிகளின் உரிமைகளை மதித்தல் ஆகியவற்றுக்கு இடையிலான சமநிலை, AI சமூகத்தில் ஒரு முக்கிய விவாதமாக மாற உள்ளது.
சுருக்கமாக: Twitch-ன் புதிய தனியுரிமைத் தேர்வு (privacy toggle), தங்களது உள்ளடக்கங்கள் Amazon-ன் generative-AI மாதிரிகளுக்கு எரிபொருளாக இருக்கலாமா என்பதை ஸ்ட்ரீமர்கள் நேரடியாகத் தீர்மானிக்க அனுமதிக்கிறது. இது தளத்திற்குள்ளான AI கருவிகளுக்கான அணுகலைத் தக்கவைப்பதோடு மட்டுமல்லாமல், எதிர்கால செயற்கை ஊடகங்களின் அடிப்படையான தரவு விநியோகச் சங்கிலியையும் மாற்றியமைக்கக்கூடும்.
