Anthropic એ તેના Fable 5 મોડેલમાં એક મહત્વપૂર્ણ અપડેટ અમલમાં મૂક્યું છે, જેનાથી તેના સેફ્ટી લેયર્સ દ્વારા બ્લોક કરવામાં આવતી નિર્દોષ જૈવિક (biological) ક્વેરીઝની સંખ્યામાં મોટો ઘટાડો થયો છે. આ વ્યૂહાત્મક ફેરફારનો હેતુ ઉચ્ચ-જોખમી જૈવિક જોખમો સામે કડક સુરક્ષા જાળવી રાખીને કાયદેસરના વૈજ્ઞાનિક સંશોધન માટે ઉપયોગિતા પુનઃસ્થાપિત કરવાનો છે.

વૈજ્ઞાનિક સંશોધન માટે અવરોધો ઘટાડવા

વૈજ્ઞાનિક સમુદાયના વિરોધને પગલે લીધેલા પગલામાં, Anthropic એ Fable 5 માટે તેના બાયોલોજી સેફ્ટી ફિલ્ટર્સમાં 'ફોલ્સ પોઝિટિવ્સ' (ખોટી રીતે બ્લોક થતા પ્રશ્નો) માં અંદાજે 85 ટકાનો ઘટાડો સફળતાપૂર્વક કર્યો છે. અગાઉ, મોડેલનું સેફ્ટી ક્લાસિફાયર અત્યંત આક્રમક હતું, જે વારંવાર કાયદેસરના વૈજ્ઞાનિક પ્રશ્નોને બ્લોક કરતું હતું અને વપરાશકર્તાઓને ઓછી સક્ષમ Opus 5 મોડેલ તરફ રીડાયરેક્ટ કરતું હતું.

આ અપડેટ સંશોધકો અને તબીબી વ્યાવસાયિકોને વિવિધ નિર્દોષ કાર્યો માટે Fable 5 ની સંપૂર્ણ તર્કશક્તિનો ઉપયોગ કરવાની મંજૂરી આપે છે. વપરાશકર્તાઓ હવે લેબોરેટરીના પરિણામોનું અર્થઘટન કરવા, ક્લિનિકલ લક્ષણોનું વિશ્લેષણ કરવા અને જટિલ તબીબી પ્રશ્નોના જવાબ આપવા જેવા જટિલ કાર્યો કરી શકે છે, જેના કારણે અગાઉ તેમની ઉત્પાદકતામાં અવરોધ આવતો હતો તેવા "સેફ્ટી વોલ" (safety wall) નો સામનો કરવો પડશે નહીં.

'ડ્યુઅલ-યુઝ' જોખમો પર ગાર્ડરેલ્સ જાળવી રાખવા

સામાન્ય બાયોલોજીના પ્રતિબંધોમાં છૂટછાટ આપવા છતાં, Anthropic "ડ્યુઅલ-યુઝ" સંશોધન—એવી માહિતી જેનો ઉપયોગ નુકસાન માટે ફરીથી થઈ શકે છે—તેના પર કડક વલણ જાળવી રાખી રહ્યું છે. કંપનીએ વાયરોલોજી, ટોક્સિકોલોજી અને એડવાન્સ્ડ મોલેક્યુલર ડિઝાઇન સહિતના અત્યંત સંવેદનશીલ વિષયો પરના પ્રતિબંધો હટાવ્યા નથી.

Anthropic નું તર્ક જૈવિક જોખમોના વિશિષ્ટ સ્વરૂપ પર આધારિત છે. સાયબર એટેકથી વિપરીત, જેને પેચ અને સિસ્ટમ શટડાઉન દ્વારા રોકી શકાય છે, એકવાર જૈવિક એજન્ટ ફેલાવવાનું શરૂ થાય પછી તેને "શટ ડાઉન" કરવું લગભગ અશક્ય છે. કંપનીએ આ સાવચેતી પાછળના કેટલાક ઉચ્ચ-જોખમ ધરાવતા કારણો દર્શાવ્યા છે, જેમાં નીચેનાનો સમાવેશ થાય છે:

  • જૈવિક જોખમો અંગે યુએસ ઇન્ટેલિજન્સ એજન્સીઓના વિશ્લેષણ.
  • એવું સંશોધન જે દર્શાવે છે કે AI નો ઉપયોગ સંપૂર્ણ કૃત્રિમ વાયરસ ડિઝાઇન કરવા માટે થઈ શકે છે.
  • વપરાશકર્તાઓ દ્વારા હાલના LLMs પાસેથી જૈવિક હથિયારો (bioweapon) માટેની સૂચનાઓ મેળવવાનો દસ્તાવેજી પ્રયાસ.

વિશિષ્ટ એક્સેસ સાથે સુરક્ષાનું સંતુલન જાળવવું

AI લેબ્સ માટે પડકાર ખુલ્લા વૈજ્ઞાનિક વિકાસ અને વિનાશક દુરુપયોગને રોકવા વચ્ચેના તણાવને સંભાળવાનો છે. Anthropic આ સમસ્યાને વિશિષ્ટ એક્સેસ પ્રોગ્રામ્સ વિકસાવીને ઉકેલવાનો પ્રયાસ કરી રહી છે. આ પ્રોગ્રામ્સ પ્રમાણિત સંશોધકોને નિયંત્રિત અને ઓડિટ કરેલા વાતાવરણમાં વાયરોલોજી અથવા મોલેક્યુલર મોડેલિંગ જેવા પ્રતિબંધિત ફીચર્સનો ઉપયોગ કરવાની મંજૂરી આપવા માટે બનાવવામાં આવ્યા છે.

નિર્દોષ તબીબી પૂછપરછ અને જોખમી ડ્યુઅલ-યુઝ સંશોધન વચ્ચે તફાવત કરીને, Anthropic એ પ્રારંભિક મોડેલ્સ "બાયોલોજીકલ ફ્રન્ટિયર" ને કેવી રીતે હેન્ડલ કરે છે તેના માટે એક નમૂનો સ્થાપિત કરવાનો પ્રયાસ કરી રહી છે, જેથી આધુનિક તબીબી સાધનો અજાણતા બાયોટેરરિઝમ (bioterrorism) ના સાધનો ન બની જાય તેની ખાતરી કરી શકાય.

મુખ્ય મુદ્દાઓ

  • 85% ફોલ્સ પોઝિટિવ્સમાં ઘટાડો: Anthropic એ કાયદેસરની બાયોલોજી ક્વેરીઝ માટે અવરોધો નોંધપાત્ર રીતે ઘટાડ્યા છે, જેનાથી વપરાશકર્તાઓ ડાઉનગ્રેડ કરેલા Opus 5 થી દૂર જઈ શકે છે.
  • ઉચ્ચ-જોખમ ધરાવતા ક્ષેત્રો પર કડક ગાર્ડરેલ્સ: જૈવિક હથિયારોના નિર્માણને રોકવા માટે વાયરોલોજી, ટોક્સિકોલોજી અને મોલેક્યુલર ડિઝાઇન માટે કડક પ્રતિબંધો યથાવત છે.
  • સંશોધકો માટે નિયંત્રિત એક્સેસ: Anthropic પ્રમાણિત વૈજ્ઞાનિકોને કાયદેસરના સંશોધન માટે જરૂરી પ્રતિબંધિત ક્ષમતાઓ પૂરી પાડવા માટે ચોક્કસ એક્સેસ પ્રોગ્રામ્સ બનાવી રહી છે.

Anthropic એ તેના Fable 5 મોડેલમાં નિર્દોષ બાયોલોજી ક્વેરીઝ પરના ફોલ્સ-પોઝિટિવ બ્લોક્સમાં લગભગ 85 ટકાનો ઘટાડો કર્યો છે, જેનાથી સંશોધકો માટે મોડેલની સંપૂર્ણ તર્કશક્તિનો ઉપયોગ કરવાની સુવિધા પુનઃસ્થાપિત થઈ છે. આ ફેરફાર ડ્યુઅલ-યુઝ જૈવિક વિષયો પર કડક સુરક્ષા જાળવી રાખે છે, જેથી મોડેલ એવા સૂચનો આપતા અટકાવી શકાય જે બાયોવેપન્સ (bioweapons) સક્ષમ બનાવી શકે.

આ અપડેટ શા માટે મહત્વપૂર્ણ છે

Fable 5 ના સેફ્ટી લેયરને મૂળરૂપે સાવચેતીના પક્ષમાં રાખવા માટે કેલિબ્રેટ કરવામાં આવ્યું હતું, જે ઘણા કાયદેસરના વૈજ્ઞાનિક પ્રશ્નોને ઉચ્ચ-જોખમ તરીકે ફ્લેગ કરતું હતું. જે વપરાશકર્તાઓ રૂટિન લેબ-પરિણામોના અર્થઘટન અથવા ક્લિનિકલ લક્ષણોના વિશ્લેષણ માટે પૂછતા હતા, તેમને નિયમિતપણે ઓછી સક્ષમ Opus 5 મોડેલ તરફ રીડાયરેક્ટ કરવામાં આવતા હતા. આ વધુ પડતા બ્લોકિંગથી વૈજ્ઞાનિક સમુદાય તરફથી ટીકા થઈ હતી, જેમણે દલીલ કરી હતી કે આ અવરોધ સાચા સંશોધનમાં અવરોધ લાવે છે અને તબીબી નિર્ણય લેવાની પ્રક્રિયાને ધીમી પાડે છે. ફોલ્સ-પોઝિટિવ રેટમાં અંદાજે ચાર-પાંચમા ભાગનો ઘટાડો કરીને, Anthropic આ મોડેલની અદ્યતન તર્કશક્તિને ડોકટરો, જીવવિજ્ઞાનીઓ અને અન્ય વ્યાવસાયિકોના હાથમાં પરત લાવવાનું લક્ષ્ય રાખે છે જેમને રોજિંદા કાર્યો માટે તેની જરૂર હોય છે.

ફિલ્ટર્સ કેવી રીતે બદલવામાં આવ્યા

આ સુધારો એક રીટ્યુન કરેલ ક્લાસિફાયરને કારણે આવ્યો છે જે સામાન્ય બાયોમેડિકલ પ્રશ્નો અને "બેવડા ઉપયોગ" (dual-use) ધરાવતા સંશોધન — જે માહિતીનો ઉપયોગ નુકસાન માટે કરી શકાય છે — તે વચ્ચે તફાવત કરે છે. નવો ક્લાસિફાયર હજુ પણ વાયરોલોજી, ટોક્સિકોલોજી અને અદ્યતન મોલેક્યુલર ડિઝાઇન સાથે સંબંધિત વિનંતીઓને રોકે છે, પરંતુ તે પ્રમાણભૂત નિદાન, લક્ષણોનું તારણ (symptom triage) અને ડેટાના અર્થઘટન વિશેના પ્રશ્નોને પસાર થવા દે છે.

Anthropic ના એન્જિનિયરોએ નોંધ્યું છે કે જૈવિક જોખમો સાયબર જોખમોથી અલગ છે: એકવાર રોગકારક સૂક્ષ્મજીવ (pathogen) મુક્ત થઈ જાય પછી, તેને પેચ કરી શકાતો નથી અથવા બંધ કરી શકાતો નથી. આ વાસ્તવિકતાએ ઉચ્ચ જોખમ ધરાવતા ક્ષેત્રો પર કડક નિયંત્રણ રાખવાનો અને સાથે સાથે સામાન્ય તબીબી પૂછપરછ પરના નિયંત્રણોમાં છૂટછાટ આપવાનો નિર્ણય લેવામાં મદદ કરી.

શું પ્રતિબંધિત રહેશે

મોડલ હજુ પણ એવા વિનંતીઓને નકારવાનું ચાલુ રાખશે જે હાનિકારક એજન્ટોના નિર્માણમાં મદદ કરી શકે છે. ખાસ કરીને, કોઈપણ પ્રોમ્પ્ટ જે નીચે મુજબની માંગ કરે છે:

  • વાયરસના સંશ્લેષણમાં મદદ કરી શકે તેવા વિગતવાર વાયરોલોજી પ્રોટોકોલ્સ,
  • હથિયાર તરીકે વાપરી શકાય તેવા રસાયણો માટેના ટોક્સિકોલોજી માર્ગો, અથવા
  • સ્ટેપ-બાય-સ્ટેપ મોલેક્યુલર એન્જિનિયરિંગ સૂચનાઓ.

Anthropic એ તેની સાવચેતી માટે ત્રણ સ્ત્રોતોનો ઉલ્લેખ કર્યો છે: જૈવિક જોખમો પર પ્રકાશ પાડતી યુએસ ઇન્ટેલિજન્સ એજન્સીઓના વિશ્લેષણો, AI સંપૂર્ણ કૃત્રિમ વાયરસ ડિઝાઇન કરી શકે છે તે દર્શાવતું સંશોધન, અને હાલના લેંગ્વેજ મોડલ્સ પાસેથી જૈવિક હથિયારની સૂચનાઓ મેળવવાનો વપરાશકર્તાઓ દ્વારા કરવામાં આવેલ દસ્તાવેજી પ્રયાસો.

પ્રમાણિત વૈજ્ઞાનિકો માટે એક્સેસ પ્રોગ્રામ

ખુલ્લા સંશોધન અને સુરક્ષા વચ્ચે સંતુલન જાળવવા માટે, Anthropic એક વિશિષ્ટ એક્સેસ પ્રોગ્રામ રજૂ કરી રહ્યું છે. પ્રમાણિત સંશોધકો નિયંત્રિત વાતાવરણ માટે અરજી કરી શકે છે જ્યાં ઓડિટ હેઠળ મર્યાદિત ક્ષમતાઓ અનલોક કરવામાં આવે છે. આ પ્રોગ્રામ વ્યાજબી વૈજ્ઞાનિકોને ઉચ્ચ જોખમ ધરાવતા વિષયો — જેમ કે નવી રસી પ્લેટફોર્મ્સ અથવા પેથોજન મોડેલિંગ — ને સામાન્ય જનતાને જોખમી માર્ગદર્શનથી ખુલ્લી મૂક્યા વિના શોધવા દેવા માટે રચાયેલ છે.

મુખ્ય સારાંશ

કડક બેવડા ઉપયોગના પ્રતિબંધો જાળવી રાખીને 85% ખોટા પોઝિટિવ બ્લોક્સ ઘટાડીને, Anthic નો હેતુ જૈવિક હથિયારની ડિઝાઇન માટે દર ખોલ્યા વિના સંશોધકોને તેના સૌથી સક્ષમ મોડલની શક્તિ આપવાનો છે. આ કેલિબ્રેટેડ સુરક્ષા વ્યૂહરચનાની સફળતા અન્ય ઉચ્ચ જોખમ ધરાવતા વૈજ્ઞાનિક ક્ષેત્રોને ફ્રન્ટિયર AI મોડલ્સ કેવી રીતે સંભાળે છે તેનો નમૂનો સેટ કરી શકે છે.