Anthropic తన Fable 5 మోడల్‌లో ఒక ముఖ్యమైన అప్‌డేట్‌ను అమలు చేసింది, దీని ద్వారా దాని సేఫ్టీ లేయర్‌ల (safety layers) ద్వారా బ్లాక్ చేయబడిన హానిలేని బయోలాజికల్ క్వెరీల (biological queries) సంఖ్యను గణనీయంగా తగ్గించింది. ఈ వ్యూహాత్మక సర్దుబాటు, అధిక-రిస్క్ కలిగిన బయోలాజికల్ ముప్పులకు వ్యతిరేకంగా కఠినమైన రక్షణ చర్యలను కొనసాగిస్తూనే, చట్టబద్ధమైన శాస్త్రీయ పరిశోధనల కోసం దీని ఉపయోగితను పునరుద్ధరించాలని లక్ష్యంగా పెట్టుకుంది.

శాస్త్రీయ పరిశోధనల కోసం అడ్డంకులను తగ్గించడం

శాస్త్రీయ వర్గాల నుండి వచ్చిన విమర్శల నేపథ్యంలో, Anthropic తన Fable 5 యొక్క బయాలజీ సేఫ్టీ ఫిల్టర్లలోని ఫాల్స్ పాజిటివ్స్ (false positives) సంఖ్యను సుమారు 85 శాతం విజయవంతంగా తగ్గించింది. గతంలో, మోడల్ యొక్క సేఫ్టీ క్లాసిఫైయర్ అతిగా స్పందిస్తూ, తరచుగా చట్టబద్ధమైన శాస్త్రీయ విచారణలను బ్లాక్ చేస్తూ, వినియోగదారులను తక్కువ సామర్థ్యం కలిగిన Opus 5 మోడల్‌కు మళ్ళించేది.

ఈ అప్‌డేట్ వల్ల పరిశోధకులు మరియు వైద్య నిపుణులు అనేక రకాల హానిలేని పనుల కోసం Fable 5 యొక్క పూర్తి రీజనింగ్ సామర్థ్యాలను ఉపయోగించుకోవచ్చు. వినియోగదారులు ఇప్పుడు ల్యాబొరేటరీ ఫలితాలను విశ్లేషించడం, క్లినికల్ లక్షణాలను పరిశీలించడం మరియు సంక్లిష్టమైన వైద్య ప్రశ్నలకు సమాధానం చెప్పడం వంటి క్లిష్టమైన పనులను, గతంలో ఉత్పాదకతను అడ్డుకున్న "సేఫ్టీ వాల్" (safety wall) ఎదురుకాకుండా చేయవచ్చు.

డ్యూయల్-యూజ్ (Dual-Use) రిస్క్‌లపై రక్షణ చర్యలను కొనసాగించడం

సాధారణ బయాలజీ పరిమితులను సడలించినప్పటికీ, Anthropic "డ్యూయల్-యూజ్" (dual-use) పరిశోధనలపై—అంటే హాని చేయడానికి ఉపయోగపడే సమాచారంపై—కఠినమైన వైఖరిని కొనసాగిస్తోంది. వైరాలజీ, టాక్సికాలజీ మరియు అడ్వాన్స్‌డ్ మాలిక్యులర్ డిజైన్ వంటి అత్యంత సున్నితమైన అంశాలపై కంపెనీ పరిమితులను తొలగించలేదు.

బయోలాజికల్ ముప్పుల ప్రత్యేక స్వభావం ఆధారంగా Anthropic ఈ నిర్ణయం తీసుకుంది. సైబర్ దాడిని ప్యాచెస్ మరియు సిస్టమ్ షట్‌డౌన్‌ల ద్వారా అరికట్టవచ్చు, కానీ ఒకసారి వ్యాప్తి చెందడం ప్రారంభించిన బయోలాజికల్ ఏజెంట్‌ను "షట్‌డౌన్" చేయడం దాదాపు అసాధ్యం. ఈ జాగ్రత్తకు కారణమైన కొన్ని కీలక ఆందోళనలను కంపెనీ పేర్కొంది:

  • బయోలాజికల్ రిస్క్‌ల గురించి U.S. ఇంటెలిజెన్స్ ఏజెన్సీల విశ్లేషణ.
  • AIని ఉపయోగించి పూర్తిగా సింథటిక్ వైరస్‌లను రూపొందించవచ్చని నిరూపించే పరిశోధనలు.
  • ప్రస్తుతం ఉన్న LLMల నుండి బయోవెపన్ (bioweapon) సూచనలను పొందడానికి వినియోగదారులు చేసిన ప్రయత్నాల ఆధారాలు.

ప్రత్యేక యాక్సెస్‌తో భద్రతను సమతుల్యం చేయడం

బహిరంగ శాస్త్రీయ పురోగతికి మరియు వినాశకరమైన దుర్వినియోగాన్ని నిరోధించడానికి మధ్య ఉన్న ఉద్రిక్తతను అధిగమించడం AI ల్యాబ్‌లకు ఒక సవాలు. Anthropic దీనిని ప్రత్యేక యాక్సెస్ ప్రోగ్రామ్‌లను అభివృద్ధి చేయడం ద్వారా పరిష్కరించడానికి ప్రయత్నిస్తోంది. ఈ ప్రోగ్రామ్‌లు ధృవీకరించబడిన పరిశోధకులు వైరాలజీ లేదా మాలిక్యులర్ మోడలింగ్‌కు సంబంధించిన పరిమిత ఫీచర్లను నియంత్రిత మరియు ఆడిట్ చేయబడిన వాతావరణంలో ఉపయోగించుకోవడానికి వీలుగా రూపొందించబడ్డాయి.

హానిలేని వైద్య విచారణలకు మరియు ప్రమాదకరమైన డ్యూయల్-యూజ్ పరిశోధనలకు మధ్య వ్యత్యాసాన్ని గుర్తించడం ద్వారా, ఫ్రాంటియర్ మోడల్స్ (frontier models) "బయోలాజికల్ ఫ్రాంటియర్"ను ఎలా ఎదుర్కోవాలో Anthropic ఒక నమూనాను (precedent) ఏర్పాటు చేయడానికి ప్రయత్నిస్తోంది. దీనివల్ల ఆధునిక వైద్య సాధనాలు అనుకోకుండా బయోటెర్రరిజం (bioterrorism) సాధనాలుగా మారకుండా చూసే అవకాశం ఉంటుంది.

ముఖ్య అంశాలు

  • 85% ఫాల్స్ పాజిటివ్స్ తగ్గింపు: Anthropic చట్టబద్ధమైన బయాలజీ క్వెరీల కోసం ఉన్న అడ్డంకులను గణనీయంగా తగ్గించింది, తద్వారా వినియోగదారులు తక్కువ సామర్థ్యం కలిగిన Opus 5 నుండి బయటపడటంలో సహాయపడింది.
  • అధిక-రిస్క్ డొమైన్‌లపై కఠినమైన రక్షణ చర్యలు: బయోలాజికల్ ఆయుధాల తయారీని నిరోధించడానికి వైరాలజీ, టాక్సికాలజీ మరియు మాలిక్యులర్ డిజైన్‌లపై కఠినమైన పరిమితులు కొనసాగుతున్నాయి.
  • పరిశోధకుల కోసం నియంత్రిత యాక్సెస్: ధృవీకరించబడిన శాస్త్రవేత్తలకు చట్టబద్ధమైన పరిశోధనల కోసం అవసరమైన పరిమిత సామర్థ్యాలను అందించడానికి Anthropic ప్రత్యేక యాక్సెస్ ప్రోగ్రామ్‌లను రూపొందిస్తోంది.

Anthropic తన Fable 5 మోడల్‌లో హానిలేని బయాలజీ క్వెరీలపై ఫాల్స్-పాజిటివ్ బ్లాక్‌లను సుమారు 85 శాతం తగ్గించింది, తద్వారా పరిశోధకులకు మోడల్ యొక్క పూర్తి రీజనింగ్ సామర్థ్యాలను తిరిగి అందించింది. ఈ మార్పు డ్యూయల్-యూజ్ బయోలాజికల్ అంశాలపై కఠినమైన రక్షణ చర్యలను కొనసాగిస్తూనే, బయోవెపన్లకు (bioweapons) దారితీసే సూచనలను అందించకుండా మోడల్‌ను నియంత్రిస్తుంది.

ఈ అప్‌డేట్ ఎందుకు ముఖ్యం

Fable 5 యొక్క సేఫ్టీ లేయర్ మొదట జాగ్రత్తగా ఉండటం కోసం రూపొందించబడింది, దీనివల్ల అనేక చట్టబద్ధమైన శాస్త్రీయ ప్రశ్నలను కూడా హై-రిస్క్ (high-risk) గా గుర్తించేది. సాధారణ ల్యాబ్-రిజల్ట్ వివరణలు లేదా క్లినికల్ లక్షణాల విశ్లేషణలను అడిగే వినియోగదారులు తరచుగా తక్కువ సామర్థ్యం కలిగిన Opus 5 మోడల్‌కు మళ్ళించబడేవారు. ఈ అతిగా బ్లాక్ చేయడం వల్ల శాస్త్రీయ వర్గాల నుండి విమర్శలు వచ్చాయి; ఇది నిజమైన పరిశోధనను అడ్డుకుంటుందని మరియు వైద్య నిర్ణయ ప్రక్రియను నెమ్మదింపజేస్తుందని వారు వాదించారు. ఫాల్స్-పాజిటివ్ రేటును దాదాపు నాలుగు ఐదవ వంతు తగ్గించడం ద్వారా, Anthropic ఈ మోడల్ యొక్క అధునాతన రీజనింగ్‌ను వైద్యులు, జీవశాస్త్రవేత్తలు మరియు రోజువారీ పనుల కోసం దీని అవసరం ఉన్న ఇతర నిపుణుల చేతుల్లోకి అందించాలని లక్ష్యంగా పెట్టుకుంది.

ఫిల్టర్లను ఎలా మార్చారు

ఈ మెరుగుదల, సాధారణ బయోమెడికల్ ప్రశ్నలకు మరియు హానికరమైన ప్రయోజనాల కోసం మళ్ళించబడే “ద్వంద్వ వినియోగ” (dual-use) పరిశోధనలకు మధ్య తేడాను గుర్తించేలా తిరిగి సర్దుబాటు చేయబడిన క్లాసిఫైయర్ వల్ల కలిగింది. కొత్త క్లాసిఫైయర్ ఇప్పటికీ వైరాలజీ, టాక్సికాలజీ మరియు అధునాతన మాలిక్యులర్ డిజైన్‌కు సంబంధించిన అభ్యర్థనలను అడ్డుకుంటుంది, కానీ ప్రామాణిక డయాగ్నోస్టిక్స్, లక్షణాల వర్గీకరణ (symptom triage) మరియు డేటా వివరణకు సంబంధించిన ప్రశ్నలను అనుమతిస్తుంది.

Anthropic ఇంజనీర్లు జీవసంబంధిత ముప్పులు సైబర్ ముప్పుల కంటే భిన్నంగా ఉంటాయని పేర్కొన్నారు: ఒకసారి పాథోజెన్ విడుదలైన తర్వాత, దానిని ప్యాచ్ చేయడం లేదా నిలిపివేయడం సాధ్యం కాదు. ఈ వాస్తవమే, సాధారణ వైద్య విచారణల విషయంలో నిబంధనలను సడలించినప్పటికీ, అధిక-రిస్క్ డొమైన్‌లపై కఠినమైన నిబంధనలను కొనసాగించాలని నిర్ణయించడానికి దారితీసింది.

ఏవి నిషేధించబడ్డాయి

హానికరమైన ఏజెంట్ల సృష్టికి తోడ్పడే అభ్యర్థనలను ఈ మోడల్ నిరంతరం తిరస్కరిస్తుంది. ప్రత్యేకంగా, ఈ క్రింది వాటిని కోరే ఏ ప్రాంప్ట్ అయినా:

  • వైరస్ సంశ్లేషణకు (synthesis) తోడ్పడే వివరణాత్మక వైరాలజీ ప్రోటోకాల్స్,
  • ఆయుధాలుగా మార్చగలిగే రసాయనాల కోసం టాక్సికాలజీ మార్గాలు, లేదా
  • దశలవారీ మాలిక్యులర్ ఇంజనీరింగ్ సూచనలు.

Anthropic తన జాగ్రత్త కోసం మూడు మూలాలను పేర్కొంది: జీవసంబంధిత రిస్క్‌ను హైలైట్ చేసే U.S. ఇంటెలిజెన్స్ ఏజెన్సీల విశ్లేషణలు, AI పూర్తిగా సింథటిక్ వైరస్‌లను రూపొందించగలదని చూపే పరిశోధనలు, మరియు ఇప్పటికే ఉన్న లాంగ్వేజ్ మోడల్స్ నుండి బయోవెపన్ సూచనలను పొందడానికి వినియోగదారులు చేసిన ప్రయత్నాల డాక్యుమెంటేషన్.

ధృవీకరించబడిన శాస్త్రవేత్తల కోసం యాక్సెస్ ప్రోగ్రామ్

ఓపెన్ రీసెర్చ్ మరియు భద్రత మధ్య సమతుల్యతను పాటించడానికి, Anthropic ఒక ప్రత్యేక యాక్సెస్ ప్రోగ్రామ్‌ను ప్రారంభిస్తోంది. ధృవీకరించబడిన పరిశోధకులు నియంత్రిత వాతావరణం కోసం దరఖాస్తు చేసుకోవచ్చు, అక్కడ ఆడిట్ కింద పరిమిత సామర్థ్యాలను అన్‌లాక్ చేయవచ్చు. ఈ ప్రోగ్రామ్, నిజమైన శాస్త్రవేత్తలు నూతన వ్యాక్సిన్ ప్లాట్‌ఫారమ్‌లు లేదా పాథోజెన్ మోడలింగ్ వంటి అధిక-రిస్క్ అంశాలను అన్వేషించడానికి రూపొందించబడింది, తద్వారా సాధారణ ప్రజలు ప్రమాదకరమైన మార్గదర్శకాలకు గురికాకుండా చూడవచ్చు.

సారాంశం

కఠినమైన ద్వంద్వ వినియోగ నిషేధాలను కొనసాగిస్తూనే, తప్పుడు పాజిటివ్ బ్లాక్‌లను 85% తగ్గించడం ద్వారా, బయోవెపన్ డిజైన్‌కు తలుపులు తెరవకుండానే పరిశోధకులకు తన అత్యంత సామర్థ్యం కలిగిన మోడల్ శక్తిని అందించాలని Anthropic లక్ష్యంగా పెట్టుకుంది. ఈ కాలిబ్రేటెడ్ సేఫ్టీ స్ట్రాటజీ యొక్క విజయం, ఫ్రంటియర్ AI మోడల్స్ ఇతర హై-స్టేక్స్ శాస్త్రీయ రంగాలను ఎలా హ్యాండిల్ చేయాలనే దానికి ఒక నమూనాగా నిలవవచ్చు.