Anthropic தனது Fable 5 மாடலில் ஒரு குறிப்பிடத்தக்க மாற்றத்தை நடைமுறைப்படுத்தியுள்ளது, இதன் மூலம் அதன் பாதுகாப்பு அடுக்குகளால் (safety layers) தடுக்கப்பட்ட சாதாரண உயிரியல் வினவல்களின் (benign biological queries) எண்ணிக்கையை பெருமளவு குறைத்துள்ளது. இந்த மூலோபாய மாற்றமானது, அதிக ஆபத்துள்ள உயிரியல் அச்சுறுத்தல்களுக்கு எதிரான கடுமையான பாதுகாப்புகளைத் தக்கவைத்துக் கொள்ளும் அதே வேளையில், முறையான அறிவியல் ஆராய்ச்சிக்குத் தேவையான பயன்பாட்டை மீட்டெடுப்பதை நோக்கமாகக் கொண்டுள்ளது.
அறிவியல் ஆராய்ச்சிக்கான தடைகளைக் குறைத்தல்
அறிவியல் சமூகத்திடமிருந்து வந்த விமர்சனங்களின் விளைவாக எடுக்கப்பட்ட நடவடிக்கையாக, Anthropic தனது Fable 5-க்கான உயிரியல் பாதுகாப்பு வடிகட்டிகளில் (biology safety filters) தவறான நேர்மறைகளை (false positives) சுமார் 85 சதவீதம் வெற்றிகரமாகக் குறைத்துள்ளது. இதற்கு முன்பு, மாடலின் பாதுகாப்பு வகைப்படுத்தி (safety classifier) மிகவும் தீவிரமாகச் செயல்பட்டது, இதனால் முறையான அறிவியல் விசாரணைகள் அடிக்கடி தடுக்கப்பட்டு, பயனர்கள் குறைந்த திறன் கொண்ட Opus 5 மாடலுக்குத் திருப்பி விடப்பட்டனர்.
இந்தத் திருத்தம் ஆராய்ச்சியாளர்கள் மற்றும் மருத்துவ நிபுணர்கள் பல்வேறு சாதாரண பணிகளுக்காக Fable 5-ன் முழுமையான பகுத்தறியும் திறனைப் பயன்படுத்த அனுமதிக்கிறது. பயனர்கள் இப்போது ஆய்வக முடிவுகளை விளக்குதல், மருத்துவ அறிகுறிகளைப் பகுப்பாய்வு செய்தல் மற்றும் சிக்கலான மருத்துவக் கேள்விகளுக்குப் பதிலளித்தல் போன்ற கடினமான செயல்பாடுகளை, முன்பு உற்பத்தித் திறனைத் தடுத்த அந்த "பாதுகாப்புச் சுவரை" (safety wall) சந்திக்காமல் மேற்கொள்ள முடியும்.
இரட்டைப் பயன்பாட்டு அபாயங்களுக்கான கட்டுப்பாடுகளைத் தக்கவைத்தல்
பொதுவான உயிரியல் கட்டுப்பாடுகள் தளர்த்தப்பட்ட போதிலும், Anthropic "இரட்டைப் பயன்பாட்டு" (dual-use) ஆராய்ச்சியில்—அதாவது தீங்கிற்காகத் தவறாகப் பயன்படுத்தப்படக்கூடிய தகவல்கள்—கடுமையான போக்கைக் கடைப்பிடிக்கிறது. வைரולוגி (virology), நச்சுயியல் (toxicology) மற்றும் மேம்பட்ட மூலக்கூறு வடிவமைப்பு (advanced molecular design) உள்ளிட்ட மிகவும் உணர்திறன் வாய்ந்த தலைப்புகளில் நிறுவனம் கட்டுப்பாடுகளை நீக்கவில்லை.
Anthropic-ன் இந்த முடிவு உயிரியல் அச்சுறுத்தல்களின் தனித்துவமான தன்மையின் அடிப்படையில் அமைந்துள்ளது. பேட்ச்கள் (patches) மற்றும் சிஸ்டம் ஷட்டவுன்கள் மூலம் தணிக்கப்படக்கூடிய சைபர் தாக்குதலைப் போலல்லாமல், ஒருமுறை பரவத் தொடங்கிய உயிரியல் காரணியை (biological agent) "நிறுத்துவது" என்பது கிட்டத்தட்ட சாத்தியமற்றது. இந்த எச்சரிக்கைக்குக் காரணமான பல முக்கியமான கவலைகளை நிறுவனம் குறிப்பிட்டுள்ளது, அவை:
- உயிரியல் அபாயங்கள் குறித்த அமெரிக்க உளவு அமைப்புகளின் பகுப்பாய்வு.
- AI-யைப் பயன்படுத்தி முழுமையான செயற்கை வைரஸ்களை வடிவமைக்க முடியும் என்பதைக் காட்டும் ஆராய்ச்சி.
- தற்போதுள்ள LLM-களிடமிருந்து உயிரியல் ஆயுதங்களுக்கான வழிமுறைகளைக் கோருவதற்கு பயனர்கள் மேற்கொண்ட ஆவணப்படுத்தப்பட்ட முயற்சிகள்.
பாதுகாப்பிற்கும் சிறப்பு அணுகலுக்கும் இடையிலான சமநிலை
திறந்த அறிவியல் முன்னேற்றத்திற்கும், பேரழிவை ஏற்படுத்தும் தவறான பயன்பாட்டைத் தடுப்பதற்கும் இடையிலான பதற்றத்தை நிர்வகிப்பதே AI ஆய்வகங்களுக்கு உள்ள சவாலாகும். சிறப்பு அணுகல் திட்டங்களை (specialized access programs) உருவாக்குவதன் மூலம் Anthropic இதைத் தீர்க்க முயற்சிக்கிறது. இந்தத் திட்டங்கள் சரிபார்க்கப்பட்ட ஆராய்ச்சியாளர்கள், வைரולוגி அல்லது மூலக்கூறு மாதிரியாக்கம் (molecular modeling) போன்ற கட்டுப்பாடான மற்றும் தணிக்கை செய்யப்பட்ட சூழலில் உள்ள தடைசெய்யப்பட்ட அம்சங்களைப் பயன்படுத்த அனுமதிக்கும் வகையில் வடிவமைக்கப்பட்டுள்ளன.
சாதாரண மருத்துவ விசாரணைக்கும் ஆபத்தான இரட்டைப் பயன்பாட்டு ஆராய்ச்சிக்கும் இடையிலான வேறுபாட்டைப் பிரித்தறிவதன் மூலம், நவீன மருத்துவக் கருவிகள் தற்செயலாக உயிரியல் பயங்கரவாதக் கருவிகளாக மாறிவிடாமல் இருப்பதை உறுதி செய்வதோடு, "உயிரியல் எல்லைகளை" (biological frontier) முன்னணி மாடல்கள் எவ்வாறு கையாள வேண்டும் என்பதற்கான ஒரு முன்மாதிரியை Anthropic அமைக்க முயற்சிக்கிறது.
முக்கியக் குறிப்புகள்
- 85% தவறான நேர்மறைகள் குறைப்பு: Anthic முறையான உயிரியல் வினவல்களுக்கான தடையை கணிசமாகக் குறைத்துள்ளது, இதன் மூலம் பயனர்களைக் குறைவான திறன் கொண்ட Opus 5-லிருந்து விடுவித்துள்ளது.
- அதிக ஆபத்துள்ள துறைகளில் கடுமையான கட்டுப்பாடுகள்: உயிரியல் ஆயுதங்கள் உருவாக்கப்படுவதைத் தடுக்க வைரולוגி, நச்சுயியல் மற்றும் மூலக்கூறு வடிவமைப்பு ஆகியவற்றிற்கு கடுமையான கட்டுப்பாடுகள் தொடர்ந்து நடைமுறையில் உள்ளன.
- ஆராய்ச்சியாளர்களுக்கான கட்டுப்படுத்தப்பட்ட அணுகல்: சரிபார்க்கப்பட்ட விஞ்ஞானிகளுக்கு முறையான ஆராய்ச்சிக்குத் தேவையான தடைசெய்யப்பட்ட திறன்களை வழங்க Anthropic குறிப்பிட்ட அணுகல் திட்டங்களை உருவாக்கி வருகிறது.
Anthropic தனது Fable 5 மாடலில் சாதாரண உயிரியல் வினவல்களின் மீதான தவறான நேர்மறைத் தடைகளை சுமார் 85 சதவீதம் குறைத்துள்ளது, இதன் மூலம் ஆராய்ச்சியாளர்களுக்கு மாடலின் முழுமையான பகுத்தறியும் திறனை மீண்டும் வழங்கியுள்ளது. இந்த மாற்றம் இரட்டைப் பயன்பாட்டு உயிரியல் தலைப்புகளில் கடுமையான பாதுகாப்புகளைத் தக்கவைத்துக் கொள்கிறது, உயிரியல் ஆயுதங்களை உருவாக்க உதவும் வழிமுறைகளை வழங்குவதைத் தடுக்கும் வகையில் மாடலைத் தடுத்து வைக்கிறது.
இந்தத் திருத்தம் ஏன் முக்கியமானது
Fable 5-ன் பாதுகாப்பு அடுக்கு ஆரம்பத்தில் மிகவும் எச்சரிக்கையாகச் செயல்படும் வகையில் வடிவமைக்கப்பட்டிருந்தது, இது பல முறையான அறிவியல் கேள்விகளை அதிக ஆபத்துள்ளதாகக் குறியிட்டது. வழக்கமான ஆய்வக முடிவுகளின் விளக்கங்கள் அல்லது மருத்துவ அறிகுறிகளின் பகுப்பாய்வுகளைக் கேட்ட பயனர்கள், வழக்கமாக குறைந்த திறன் கொண்ட Opus 5 மாடலுக்குத் திருப்பி விடப்பட்டனர். இந்த அதிகப்படியானத் தடுப்பு அறிவியல் சமூகத்திடமிருந்து விமர்சனங்களை எழுப்பியது; இது உண்மையான ஆராய்ச்சியைத் தடுத்ததோடு மருத்துவ முடிவெடுப்பதையும் தாமதப்படுத்துவதாக அவர்கள் வாதிட்டனர். தவறான நேர்மறை விகிதத்தை ஏறத்தாழ நான்கில் ஒரு பங்கு மட்டுமே இருக்குமாறு குறைப்பதன் மூலம், மாடலின் மேம்பட்ட பகுத்தறியும் திறனை மருத்துவர்கள், உயிரியலாளர்கள் மற்றும் அன்றாடப் பணிகளுக்குத் தேவைப்படும் பிற நிபுணர்களின் கைகளுக்கே Anthropic கொண்டு சேர்க்க இலக்கு வைத்துள்ளது.
வடிகட்டிகள் எவ்வாறு மாற்றப்பட்டன
இந்த முன்னேற்றம், சாதாரண உயிரிய மருத்துவக் கேள்விகளுக்கும், “இரட்டைப் பயன்பாட்டு” (dual-use) ஆராய்ச்சி தொடர்பான கேள்விகளுக்கும் இடையிலான வேறுபாட்டைத் தீர்மானிக்கும் வகையில் மறுசீரமைக்கப்பட்ட ஒரு வகைப்படுத்தியிலிருந்து (classifier) கிடைக்கிறது—அதாவது, தீங்காகப் பயன்படுத்தப்படக்கூடிய தகவல்கள். புதிய வகைப்படுத்தி இன்னும் வைரולוגி, நச்சுயியல் மற்றும் மேம்பட்ட மூலக்கூறு வடிவமைப்பு தொடர்பான கோரிக்கைகளைத் தடுக்கிறது, ஆனால் சாதாரண நோயறிதல், அறிகுறிகளை வகைப்படுத்துதல் மற்றும் தரவு விளக்கம் குறித்த கேள்விகளை அனுமதிக்கிறது.
உயிரியல் அச்சுறுத்தல்கள் சைபர் அச்சுறுத்தல்களிலிருந்து வேறுபட்டவை: ஒரு நோய்க்கிருமி பரவிவிட்டால், அதைச் சரிசெய்யவோ அல்லது முடக்கவோ முடியாது என்று Anthropic பொறியாளர்கள் குறிப்பிட்டுள்ளனர். இந்த யதார்த்தமே, வழக்கமான மருத்துவக் கேள்விகள் மீதான கட்டுப்பாடுகளைத் தளர்த்தும் அதே வேளையில், அதிக ஆபத்துள்ள துறைகளில் கடுமையான கட்டுப்பாடுகளைத் தொடர முடிவெடுக்கத் தூண்டியது.
எவை தடை செய்யப்பட்டுள்ளன
தீங்கு விளைவிக்கும் காரணிகளின் உருவாக்கத்திற்கு வழிவகுக்கும் கோரிக்கைகளை இந்த மாதிரி தொடர்ந்து மறுக்கிறது. குறிப்பாக, பின்வருவனவற்றைக் கோரும் எந்தவொரு தூண்டுதலும் (prompt):
- வைரஸ் தொகுப்பிற்கு உதவக்கூடிய விரிவான வைரולוגி நெறிமுறைகள்,
- ஆயுதமாக மாற்றக்கூடிய வேதிப்பொருட்களுக்கான நச்சுயியல் வழிமுறைகள், அல்லது
- படிப்படியான மூலக்கூறு பொறியியல் வழிமுறைகள்.
Anthropic தனது எச்சரிக்கைக்கு மூன்று ஆதாரங்களைக் குறிப்பிட்டது: உயிரியல் அபாயத்தை முன்னிலைப்படுத்தும் அமெரிக்க உளவு அமைப்புகளின் பகுப்பாய்வுகள், AI மூலம் முழுமையான செயற்கை வைரஸ்களை வடிவமைக்க முடியும் என்பதைக் காட்டும் ஆராய்ச்சி, மற்றும் ஏற்கனவே உள்ள மொழி மாதிரிகளிடமிருந்து உயிரியல் ஆயுத வழிமுறைகளைக் கோருவதற்கு பயனர்கள் மேற்கொண்ட ஆவணப்படுத்தப்பட்ட முயற்சிகள்.
சரிபார்க்கப்பட்ட விஞ்ஞானிகளுக்கான அணுகல் திட்டம்
திறந்த ஆராய்ச்சியையும் பாதுகாப்பையும் சமநிலைப்படுத்த, Anthropic ஒரு சிறப்பு அணுகல் திட்டத்தை அறிமுகப்படுத்துகிறது. சரிபார்க்கப்பட்ட ஆராய்ச்சியாளர்கள், தணிக்கையின் கீழ் கட்டுப்படுத்தப்பட்ட திறன்கள் அனுமதிக்கப்படும் ஒரு கட்டுப்பாட்டுச் சூழலுக்கு விண்ணப்பிக்கலாம். இந்தத் திட்டம், புதிய தடுப்பூசி தளங்கள் அல்லது நோய்க்கிருமி மாதிரியாக்கம் போன்ற அதிக ஆபத்துள்ள தலைப்புகளை, பொதுமக்களுக்கு ஆபத்தான வழிகாட்டுதல்களை வெளிப்படுத்தாமல், உண்மையான விஞ்ஞானிகள் ஆராய அனுமதிக்கும் வகையில் வடிவமைக்கப்பட்டுள்ளது.
முக்கிய கருத்து
கடுமையான இரட்டைப் பயன்பாட்டுத் தடைகளைத் தொடரும் அதே வேளையில், 85% தவறான நேர்மறைத் தடைகளைக் (false-positive blocks) குறைப்பதன் மூலம், உயிரியல் ஆயுத வடிவமைப்பிற்கு வழிவகுக்காமல், ஆராய்ச்சியாளர்களுக்குத் தனது மிகவும் திறன்மிக்க மாதிரியின் ஆற்றலை வழங்க Anthropic இலக்கு வைத்துள்ளது. இந்தச் சரிசெய்யப்பட்ட பாதுகாப்பு உத்தியின் வெற்றி, முன்னணி AI மாதிரிகள் மற்ற முக்கியமான அறிவியல் துறைகளை எவ்வாறு கையாள வேண்டும் என்பதற்கான ஒரு முன்மாதிரியாக அமையக்கூடும்.
