Anthropic ने त्यांच्या Fable 5 मॉडेलमध्ये एक महत्त्वपूर्ण अपडेट लागू केले आहे, ज्यामुळे त्यांच्या सुरक्षा थरांद्वारे (safety layers) रोखल्या जाणाऱ्या अहानिकारक जैविक (benign biological) प्रश्नांची संख्या लक्षणीयरीत्या कमी झाली आहे. हा धोरणात्मक बदल उच्च-जोखीम असलेल्या जैविक धोक्यांविरुद्ध कडक सुरक्षा कायम ठेवून, वैध वैज्ञानिक संशोधनासाठी उपयुक्तता पुन्हा स्थापित करण्याचे उद्दिष्ट ठेवतो.
वैज्ञानिक संशोधनासाठी अडथळे कमी करणे
वैज्ञानिक समुदायाकडून आलेल्या टीकेमुळे घेतलेल्या निर्णयानुसार, Anthropic ने Fable 5 च्या बायोलॉजी सेफ्टी फिल्टर्समधील 'फॉल्स पॉझिटिव्ह' (false positives) प्रमाण अंदाजे ८५ टक्क्यांनी यशस्वीरित्या कमी केले आहे. यापूर्वी, मॉडेलचे सेफ्टी क्लासिफायर अतिशय आक्रमक होते, ज्यामुळे अनेकदा वैध वैज्ञानिक चौकशी रोखल्या जात होत्या आणि वापरकर्त्यांना कमी सक्षम असलेल्या Opus 5 मॉडेलकडे वळवले जात होते.
हे अपडेट संशोधकांना आणि वैद्यकीय व्यावसायिकांना विविध अहानिकारक कामांसाठी Fable 5 च्या पूर्ण तर्कक्षमतेचा (reasoning capabilities) लाभ घेण्यास अनुमती देते. वापरकर्ते आता प्रयोगशाळेतील निकालांचा अर्थ लावणे, क्लिनिकल लक्षणांचे विश्लेषण करणे आणि प्रगत वैद्यकीय प्रश्नांची उत्तरे देणे यांसारखी जटिल कामे, पूर्वी उत्पादकता रोखणाऱ्या "सेफ्टी वॉल" (safety wall) शिवाय करू शकतात.
'ड्युअल-युज' (Dual-Use) जोखमींवर नियंत्रण राखणे
सामान्य जीवशास्त्र निर्बंध शिथिल करूनही, Anthropic "ड्युअल-युज" संशोधनावर—अशी माहिती ज्याचा गैरवापर हानी पोहोचवण्यासाठी केला जाऊ शकतो—कठोर भूमिका घेत आहे. कंपनीने विषाणूशास्त्र (virology), विषशास्त्र (toxicology) आणि प्रगत रेणू डिझाइन (advanced molecular design) यांसारख्या अत्यंत संवेदनशील विषयांवरील निर्बंध उठवलेले नाहीत.
Anthropic चे तर्क जैविक धोक्यांच्या अद्वितीय स्वरूपावर आधारित आहेत. सायबर हल्ल्याच्या उलट, जो पॅचेस आणि सिस्टम शटडाउनद्वारे रोखता येतो, एकदा जैविक घटक पसरण्यास सुरुवात झाली की त्याला "शटडाउन" करणे जवळजवळ अशक्य असते. कंपनीने या सावधगिरीमागे काही महत्त्वाच्या चिंतेचा उल्लेख केला आहे, ज्यामध्ये खालील गोष्टींचा समावेश आहे:
- जैविक जोखमींबाबत अमेरिकन इंटेलिजन्स एजन्सींचे विश्लेषण.
- AI चा वापर पूर्णपणे कृत्रिम विषाणू तयार करण्यासाठी केला जाऊ शकतो, हे दर्शवणारे संशोधन.
- वापरकर्त्यांकडून विद्यमान LLMs कडून जैविक शस्त्रे तयार करण्याच्या सूचना मागवण्याचे नोंदवलेले प्रयत्न.
सुरक्षा आणि विशेष प्रवेश यांच्यात संतुलन राखणे
AI लॅब्ससाठी आव्हान म्हणजे मुक्त वैज्ञानिक प्रगती आणि विनाशकारी गैरवापर रोखणे यातील तणावाचा मार्ग शोधणे. Anthropic हे विशेष प्रवेश कार्यक्रम (specialized access programs) विकसित करून सोडवण्याचा प्रयत्न करत आहे. हे कार्यक्रम प्रमाणित संशोधकांना नियंत्रित आणि ऑडिट केलेल्या वातावरणात विषाणूशास्त्र किंवा रेणू मॉडेलिंगशी संबंधित वैशिष्ट्यांचा वापर करण्याची परवानगी देण्यासाठी डिझाइन केलेले आहेत.
निरपराध वैद्यकीय चौकशी आणि धोकादायक 'ड्युअल-युज' संशोधन यातील फरक करून, Anthropic हे 'फ्रंटियर मॉडेल्स' जैविक सीमांचे (biological frontier) व्यवस्थापन कसे करतात यासाठी एक आदर्श स्थापित करण्याचा प्रयत्न करत आहे, जेणेकरून आधुनिक वैद्यकशास्त्राची साधने नकळत जैव-दहशतवादाची (bioterrorism) साधने बनणार नाहीत याची खात्री होईल.
मुख्य निष्कर्ष
- फॉल्स पॉझिटिव्हमध्ये ८५% घट: Anthic ने वैध जीवशास्त्र प्रश्नांसाठीचा अडथळा लक्षणीयरीत्या कमी केला आहे, ज्यामुळे वापरकर्ते कमी दर्जाच्या Opus 5 कडून दूर होतील.
- उच्च-जोखीम क्षेत्रांवर कठोर निर्बंध: जैविक शस्त्रे तयार करणे रोखण्यासाठी विषाणूशास्त्र, विषशास्त्र आणि रेणू डिझाइनसाठी कडक निर्बंध कायम आहेत.
- संशोधकांसाठी नियंत्रित प्रवेश: Anthropic प्रमाणित शास्त्रज्ञांना त्यांच्या वैध संशोधनासाठी आवश्यक असलेली प्रतिबंधित क्षमता प्रदान करण्यासाठी विशिष्ट प्रवेश कार्यक्रम तयार करत आहे.
Anthropic ने त्यांच्या Fable 5 मॉडेलमधील अहानिकारक जीवशास्त्र प्रश्नांवरील फॉल्स-पॉझिटिव्ह ब्लॉक्स अंदाजे ८५ टक्क्यांनी कमी केले आहेत, ज्यामुळे संशोधकांसाठी मॉडेलच्या पूर्ण तर्कक्षमतेचा वापर पुन्हा शक्य झाला आहे. हा बदल 'ड्युअल-युज' जैविक विषयांवरील कडक सुरक्षा कायम ठेवतो, ज्यामुळे मॉडेलला जैविक शस्त्रे तयार करण्यास मदत करू शकतील अशा सूचना देण्यापासून रोखले जाते.
हे अपडेट का महत्त्वाचे आहे
Fable 5 चा सेफ्टी लेयर मूळतः सावधगिरीचा विचार करून कॅलिब्रेट करण्यात आला होता, ज्यामुळे अनेक वैध वैज्ञानिक प्रश्नांना उच्च-जोखीम म्हणून चिन्हांकित केले जात होते. जे वापरकर्ते नियमित प्रयोगशाळा-निकाल अर्थ लावणे किंवा क्लिनिकल लक्षणांचे विश्लेषण विचारत होते, त्यांना नियमितपणे कमी सक्षम असलेल्या Opus 5 मॉडेलकडे वळवले जात होते. या अति-प्रतिबंधामुळे (over-blocking) वैज्ञानिक समुदायाकडून टीका झाली, ज्यांनी असा युक्तिवाद केला की यामुळे वास्तविक संशोधनात अडथळा येत होता आणि वैद्यकीय निर्णय घेण्याची प्रक्रिया मंदावत होती. फॉल्स-पॉझिटिव्ह दर अंदाजे चार पंचमांशने कमी करून, Anthropic चे उद्दिष्ट मॉडेलची प्रगत तर्कक्षमता डॉक्टर, जीवशास्त्रज्ञ आणि इतर व्यावसायिकांच्या हाती परत देणे आहे ज्यांना दैनंदिन कामांसाठी याची गरज आहे.
फिल्टर्समध्ये कसे बदल करण्यात आले
ही सुधारणा एका पुन्हा ट्यून केलेल्या क्लासिफायरमुळे झाली आहे जो सामान्य बायोमेडिकल प्रश्न आणि "दुहेरी वापराचे" (dual-use) संशोधन—अशी माहिती जी हानीसाठी वापरली जाऊ शकते—यांच्यातील फरक ओळखतो. नवीन क्लासिफायर अजूनही वायरोलॉजी, टॉक्सिकॉलॉजी आणि प्रगत मॉलिक्युलर डिझाइनशी संबंधित विनंत्या रोखतो, परंतु तो प्रमाणित निदान, लक्षणांचे वर्गीकरण (symptom triage) आणि डेटा इंटरप्रिटेशन यांसारख्या प्रश्नांना परवानगी देतो.
Anthropic च्या अभियंत्यांनी नमूद केले की जैविक धोके हे सायबर धोक्यांपेक्षा वेगळे आहेत: एकदा रोगजनक (pathogen) पसरला की, तो 'पॅच' करता येत नाही किंवा बंद करता येत नाही. या वास्तवामुळे उच्च-जोखीम असलेल्या क्षेत्रांवर कडक निर्बंध ठेवण्याचा आणि नियमित वैद्यकीय चौकशीवरील निर्बंध शिथिल करण्याचा निर्णय घेण्यात आला.
काय प्रतिबंधित राहील
हानिकारक घटक तयार करण्यास मदत करू शकणाऱ्या विनंत्यांना मॉडेल नकार देत राहील. विशेषतः, खालील गोष्टींची मागणी करणाऱ्या कोणत्याही प्रॉम्प्टला:
- विषाणू संश्लेषणास (virus synthesis) मदत करू शकणारे तपशीलवार वायरोलॉजी प्रोटोकॉल,
- शस्त्रास्त्र म्हणून वापरता येण्याजोग्या रसायनांसाठी टॉक्सिकॉलॉजी मार्ग, किंवा
- टप्प्याटप्प्याने दिलेल्या मॉलिक्युलर इंजिनिअरिंग सूचना.
Anthropic ने आपल्या सावधगिरीसाठी तीन स्रोत दिले आहेत: जैविक जोखमीवर प्रकाश टाकणारे अमेरिकन गुप्तचर संस्थांचे विश्लेषण, AI पूर्णपणे कृत्रिम विषाणू तयार करू शकते हे दर्शवणारे संशोधन आणि विद्यमान लँग्वेज मॉडेल्सकडून जैविक शस्त्रास्त्रांच्या सूचना मिळवण्याचे वापरकर्त्यांनी केलेले नोंदवलेले प्रयत्न.
तपासलेले (vetted) शास्त्रज्ञांसाठी प्रवेश कार्यक्रम
मुक्त संशोधन आणि सुरक्षा यांचा समतोल राखण्यासाठी, Anthropic एक विशेष प्रवेश कार्यक्रम राबवत आहे. प्रमाणित संशोधक नियंत्रित वातावरणासाठी अर्ज करू शकतात, जिथे ऑडिटच्या अंतर्गत प्रतिबंधित क्षमता अनलॉक केल्या जातील. हा कार्यक्रम कायदेशीर शास्त्रज्ञांना नवीन लस प्लॅटफॉर्म किंवा रोगजनक मॉडेलिंग यांसारख्या उच्च-जोखीम असलेल्या विषयांचा शोध घेण्यास अनुमती देतो, जेणेकरून सर्वसामान्य जनता धोकादायक मार्गदर्शनाशी संपर्क येणार नाही.
निष्कर्ष
'ड्युअल-युज' (dual-use) बंदी कडक ठेवून आणि ८५% चुकीचे निर्बंध (false-positive blocks) कमी करून, Anthropic चे उद्दिष्ट संशोधकांना त्यांच्या सर्वात सक्षम मॉडेलची शक्ती प्रदान करणे आहे, परंतु जैविक शस्त्रास्त्रांच्या निर्मितीसाठी दार उघडणे नाही. या कॅलिब्रेटेड सुरक्षा धोरणाचे यश हे इतर उच्च-जोखीम असलेल्या वैज्ञानिक क्षेत्रांमध्ये फ्रंटियर AI मॉडेल्स कसे वागतील, यासाठी एक नमुना (template) ठरू शकते.
