Anthropic ਨੇ ਆਪਣੇ Fable 5 ਮਾਡਲ ਵਿੱਚ ਇੱਕ ਮਹੱਤਵਪੂਰਨ ਅਪਡੇਟ ਲਾਗੂ ਕੀਤਾ ਹੈ, ਜਿਸ ਨਾਲ ਇਸਦੀਆਂ ਸੁਰੱਖਿਆ ਪਰਤਾਂ (safety layers) ਦੁਆਰਾ ਰੋਕੀਆਂ ਗਈਆਂ ਨਿਰਦੋਸ਼ ਜੈਵਿਕ ਪੁੱਛਗਿੱਛਾਂ (benign biological queries) ਦੀ ਗਿਣਤੀ ਵਿੱਚ ਭਾਰੀ ਕਮੀ ਆਈ ਹੈ। ਇਸ ਰਣਨੀਤਕ ਸਮਾਯੋਜਨ ਦਾ ਉਦੇਸ਼ ਉੱਚ-ਜੋਖਮ ਵਾਲੇ ਜੈਵਿਕ ਖਤਰਿਆਂ ਵਿਰੁੱਧ ਸਖ਼ਤ ਸੁਰੱਖਿਆਵਾਂ ਨੂੰ ਬਣਾਈ ਰੱਖਦੇ ਹੋਏ ਜਾਇਜ਼ ਵਿਗਿਆਨਕ ਖੋਜ ਲਈ ਉਪਯੋਗਤਾ ਨੂੰ ਬਹਾਲ ਕਰਨਾ ਹੈ।

ਵਿਗਿਆਨਕ ਖੋਜ ਲਈ ਰੁਕਾਵਟਾਂ ਨੂੰ ਘਟਾਉਣਾ

ਵਿਗਿਆਨਕ ਭਾਈਚਾਰੇ ਦੀ ਆਲੋਚਨਾ ਕਾਰਨ ਲਏ ਗਏ ਇੱਕ ਕਦਮ ਵਿੱਚ, Anthropic ਨੇ Fable 5 ਲਈ ਆਪਣੇ ਜੀਵ ਵਿਗਿਆਨ ਸੁਰੱਖਿਆ ਫਿਲਟਰਾਂ ਵਿੱਚ ਗਲਤ ਪਛਾਣ (false positives) ਨੂੰ ਲਗਭਗ 85 ਪ੍ਰਤੀਸ਼ਤ ਤੱਕ ਸਫਲਤਾਪੂਰਵਕ ਘਟਾ ਦਿੱਤਾ ਹੈ। ਪਹਿਲਾਂ, ਮਾਡਲ ਦਾ ਸੁਰੱਖਿਆ ਕਲਾਸੀਫਾਇਰ ਬਹੁਤ ਜ਼ਿਆਦਾ ਹਮਲਾਵਰ ਸੀ, ਜੋ ਅਕਸਰ ਜਾਇਜ਼ ਵਿਗਿਆਨਕ ਪੁੱਛਗਿੱਛਾਂ ਨੂੰ ਰੋਕ ਦਿੰਦਾ ਸੀ ਅਤੇ ਉਪਯੋਗਕਰਤਾਵਾਂ ਨੂੰ ਘੱਟ ਸਮਰੱਥ Opus 5 ਮਾਡਲ ਵੱਲ ਰੀਡਾਇਰੈਕਟ ਕਰ ਦਿੰਦਾ ਸੀ।

ਇਹ ਅਪਡੇਟ ਖੋਜਕਰਤਾਵਾਂ ਅਤੇ ਮੈਡੀਕਲ ਪੇਸ਼ੇਵਰਾਂ ਨੂੰ ਕਈ ਤਰ੍ਹਾਂ ਦੇ ਨਿਰਦੋਸ਼ ਕੰਮਾਂ ਲਈ Fable 5 ਦੀਆਂ ਪੂਰੀਆਂ ਤਰਕਸ਼ੀਲ ਸਮਰੱਥਾਵਾਂ (reasoning capabilities) ਦਾ ਲਾਭ ਉਠਾਉਣ ਦੀ ਇਜਾਜ਼ਤ ਦਿੰਦਾ ਹੈ। ਉਪਯੋਗਕਰਤਾ ਹੁਣ ਪ੍ਰਯੋਗਸ਼ਾਲਾ ਦੇ ਨਤੀਜਿਆਂ ਦੀ ਵਿਆਖਿਆ ਕਰਨ, ਕਲੀਨਿਕਲ ਲੱਛਣਾਂ ਦਾ ਵਿਸ਼ਲੇਸ਼ਣ ਕਰਨ ਅਤੇ ਗੁੰਝਲਦਾਰ ਮੈਡੀਕਲ ਸਵਾਲਾਂ ਦੇ ਜਵਾਬ ਦੇਣ ਵਰਗੇ ਗੁੰਝਲਦਾਰ ਕੰਮਾਂ ਨੂੰ ਉਸ "ਸੁਰੱਖਿਆ ਕੰਧ" (safety wall) ਨਾਲ ਟਕਰਾਏ ਬਿਨਾਂ ਕਰ ਸਕਦੇ ਹਨ, ਜਿਸ ਨੇ ਪਹਿਲਾਂ ਉਤਪਾਦਕਤਾ ਵਿੱਚ ਰੁਕਾਵਟ ਪਾਈ ਸੀ।

ਦੋਹਰੇ-ਵਰਤੋਂ (Dual-Use) ਦੇ ਜੋਖਮਾਂ 'ਤੇ ਗਾਰਡਰੇਲ ਬਣਾਈ ਰੱਖਣਾ

ਆਮ ਜੀਵ ਵਿਗਿਆਨ ਦੀਆਂ ਪਾਬੰਦੀਆਂ ਵਿੱਚ ਢਿੱਲ ਦੇ ਬਾਵਜੂਦ, Anthropic "ਦੋਹਰੇ-ਵਰਤੋਂ" ਵਾਲੀ ਖੋਜ—ਜੋ ਜਾਣਕਾਰੀ ਨੁਕਸਾਨ ਪਹੁੰਚਾਉਣ ਲਈ ਦੁਬਾਰਾ ਵਰਤੀ ਜਾ ਸਕਦੀ ਹੈ—ਤੇ ਸਖ਼ਤ ਰੁਖ ਬਣਾਈ ਰੱਖ ਰਿਹਾ ਹੈ। ਕੰਪਨੀ ਨੇ ਵਾਇਰੋਲੋਜੀ, ਟੌਕਸੀਕੋਲੋਜੀ ਅਤੇ ਉੱਨਤ ਅਣੂ ਡਿਜ਼ਾਈਨ ਸਮੇਤ ਬਹੁਤ ਹੀ ਸੰਵੇਦਨਸ਼ੀਲ ਵਿਸ਼ਿਆਂ 'ਤੇ ਪਾਬੰਦੀਆਂ ਨਹੀਂ ਹਟਾਈਆਂ ਹਨ।

Anthropic ਦਾ ਤਰਕ ਜੈਵਿਕ ਖਤਰਿਆਂ ਦੀ ਵਿਲੱਖਣ ਪ੍ਰਕਿਰਤੀ 'ਤੇ ਅਧਾਰਤ ਹੈ। ਇੱਕ ਸਾਈਬਰ ਹਮਲੇ ਦੇ ਉਲਟ, ਜਿਸ ਨੂੰ ਪੈਚਾਂ ਅਤੇ ਸਿਸਟਮ ਸ਼ਟਡਾਊਨ ਰਾਹੀਂ ਘਟਾਇਆ ਜਾ ਸਕਦਾ ਹੈ, ਇੱਕ ਰਿਲੀਜ਼ ਕੀਤਾ ਗਿਆ ਜੈਵਿਕ ਏਜੰਟ ਫੈਲਣਾ ਸ਼ੁਰੂ ਹੋਣ ਤੋਂ ਬਾਅਦ ਉਸਨੂੰ "ਬੰਦ ਕਰਨਾ" ਲਗਭਗ ਅਸੰਭਵ ਹੁੰਦਾ ਹੈ। ਕੰਪਨੀ ਨੇ ਇਸ ਸਾਵਧਾਨੀ ਦੇ ਪਿੱਛੇ ਕਈ ਉੱਚ-ਜੋਖਮ ਵਾਲੀਆਂ ਚਿੰਤਾਵਾਂ ਦਾ ਹਵਾਲਾ ਦਿੱਤਾ ਹੈ, ਜਿਨ੍ਹਾਂ ਵਿੱਚ ਸ਼ਾਮਲ ਹਨ:

  • ਜੈਵਿਕ ਜੋਖਮਾਂ ਦੇ ਸਬੰਧ ਵਿੱਚ ਅਮਰੀਕੀ ਖੁਫੀਆ ਏਜੰਸੀਆਂ ਦਾ ਵਿਸ਼ਲੇਸ਼ਣ।
  • ਖੋਜ ਜੋ ਸਾਬਤ ਕਰਦੀ ਹੈ ਕਿ AI ਦੀ ਵਰਤੋਂ ਪੂਰੀ ਤਰ੍ਹਾਂ ਸਿੰਥੈਟਿਕ ਵਾਇਰਸ ਡਿਜ਼ਾਈਨ ਕਰਨ ਲਈ ਕੀਤੀ ਜਾ ਸਕਦੀ ਹੈ।
  • ਮੌਜੂਦਾ LLMs ਤੋਂ ਜੈਵਿਕ ਹਥਿਆਰਾਂ ਦੇ ਨਿਰਦੇਸ਼ ਮੰਗਣ ਲਈ ਉਪਯੋਗਕਰਤਾਵਾਂ ਦੁਆਰਾ ਕੀਤੇ ਗਏ ਦਸਤਾਵੇਜ਼ੀ ਯਤਨ।

ਵਿਸ਼ੇਸ਼ ਪਹੁੰਚ ਨਾਲ ਸੁਰੱਖਿਆ ਦਾ ਸੰਤੁਲਨ ਬਣਾਉਣਾ

AI ਲੈਬਾਂ ਲਈ ਚੁਣੌਤੀ ਖੁੱਲ੍ਹੀ ਵਿਗਿਆਨਕ ਤਰੱਕੀ ਅਤੇ ਭਿਆਨਕ ਦੁਰਵਰਤੋਂ ਨੂੰ ਰੋਕਣ ਦੇ ਵਿਚਕਾਰ ਤਣਾਅ ਨੂੰ ਸੰਭਾਲਣਾ ਹੈ। Anthropic ਵਿਸ਼ੇਸ਼ ਪਹੁੰਚ ਪ੍ਰੋਗਰਾਮ ਵਿਕਸਿਤ ਕਰਕੇ ਇਸ ਨੂੰ ਹੱਲ ਕਰਨ ਦੀ ਕੋਸ਼ਿਸ਼ ਕਰ ਰਿਹਾ ਹੈ। ਇਹ ਪ੍ਰੋਗਰਾਮ ਪ੍ਰਮਾਣਿਤ ਖੋਜਕਰਤਾਵਾਂ ਨੂੰ ਇੱਕ ਨਿਯੰਤਰਿਤ ਅਤੇ ਆਡਿਟ ਕੀਤੇ ਵਾਤਾਵਰਣ ਦੇ ਅੰਦਰ—ਜਿਵੇਂ ਕਿ ਵਾਇਰੋਲੋਜੀ ਜਾਂ ਅਣੂ ਮਾਡਲਿੰਗ ਨਾਲ ਸਬੰਧਤ ਵਿਸ਼ੇਸ਼ਤਾਵਾਂ—ਪਾਬੰਦੀਸ਼ੁਦਾ ਵਿਸ਼ੇਸ਼ਤਾਵਾਂ ਤੱਕ ਪਹੁੰਚ ਕਰਨ ਦੀ ਇਜਾਜ਼ਤ ਦੇਣ ਲਈ ਤਿਆਰ ਕੀਤੇ ਗਏ ਹਨ।

ਨਿਰਦੋਸ਼ ਮੈਡੀਕਲ ਪੁੱਛਗਿੱਛ ਅਤੇ ਖ਼ਤਰਨਾਕ ਦੋਹਰੇ-ਵਰਤੋਂ ਵਾਲੀ ਖੋਜ ਵਿਚਕਾਰ ਅੰਤਰ ਕਰਕੇ, Anthropic ਇਸ ਗੱਲ ਦਾ ਇੱਕ ਨਮੂਨਾ ਸੈੱਟ ਕਰਨ ਦੀ ਕੋਸ਼ਿਸ਼ ਕਰ ਰਿਹਾ ਹੈ ਕਿ ਫਰੰਟੀਅਰ ਮਾਡਲ "ਜੈਵਿਕ ਸਰਹੱਦ" ਨੂੰ ਕਿਵੇਂ ਸੰਭਾਲਦੇ ਹਨ, ਇਹ ਯਕੀਨੀ ਬਣਾਉਂਦੇ ਹੋਏ ਕਿ ਆਧੁਨਿਕ ਦਵਾਈ ਦੇ ਸਾਧਨ ਅਣਜਾਣੇ ਵਿੱਚ ਬਾਇਓ-ਟਰਰਰਿਜ਼ਮ ਦੇ ਸਾਧਨ ਨਾ ਬਣ ਜਾਣ।

ਮੁੱਖ ਗੱਲਾਂ

  • 85% ਗਲਤ ਪਛਾਣ (False Positives) ਵਿੱਚ ਕਮੀ: Anthropic ਨੇ ਜਾਇਜ਼ ਜੀਵ ਵਿਗਿਆਨ ਪੁੱਛਗਿੱਛਾਂ ਲਈ ਰੁਕਾਵਟਾਂ ਨੂੰ ਕਾਫ਼ੀ ਹੱਦ ਤੱਕ ਘਟਾ ਦਿੱਤਾ ਹੈ, ਜਿਸ ਨਾਲ ਉਪਯੋਗਕਰਤਾਵਾਂ ਨੂੰ ਘੱਟ ਰੇਟਿੰਗ ਵਾਲੇ Opus 5 ਤੋਂ ਦੂਰ ਲਿਆਂਦਾ ਗਿਆ ਹੈ।
  • ਉੱਚ-ਜੋਖਮ ਵਾਲੇ ਖੇਤਰਾਂ 'ਤੇ ਸਖ਼ਤ ਗਾਰਡਰੇਲ: ਜੈਵਿਕ ਹਥਿਆਰਾਂ ਦੇ ਨਿਰਮਾਣ ਨੂੰ ਰੋਕਣ ਲਈ ਵਾਇਰੋਲੋਜੀ, ਟੌਕਸੀਕੋਲੋਜੀ ਅਤੇ ਅਣੂ ਡਿਜ਼ਾਈਨ ਲਈ ਸਖ਼ਤ ਪਾਬੰਦੀਆਂ ਲਾਗੂ ਹਨ।
  • ਖੋਜਕਰਤਾਵਾਂ ਲਈ ਨਿਯੰਤਰਿਤ ਪਹੁੰਚ: Anthropic ਵਿਸ਼ੇਸ਼ ਪਹੁੰਚ ਪ੍ਰੋਗਰਾਮ ਬਣਾ ਰਿਹਾ ਹੈ ਤਾਂ ਜੋ ਪ੍ਰਮਾਣਿਤ ਵਿਗਿਆਨੀਆਂ ਨੂੰ ਉਹ ਪਾਬੰਦੀਸ਼ੁਦਾ ਸਮਰੱਥਾਵਾਂ ਪ੍ਰਦਾਨ ਕੀਤੀਆਂ ਜਾ ਸਕਣ ਜੋ ਉਹਨਾਂ ਨੂੰ ਜਾਇਜ਼ ਖੋਜ ਲਈ ਚਾਹੀਦੀਆਂ ਹਨ।

Anthropic ਨੇ ਆਪਣੇ Fable 5 ਮਾਡਲ ਵਿੱਚ ਨਿਰਦੋਸ਼ ਜੀਵ ਵਿਗਿਆਨ ਪੁੱਛਗਿੱਛਾਂ 'ਤੇ ਗਲਤ ਪਛਾਣ ਵਾਲੇ ਬਲਾਕਾਂ ਨੂੰ ਲਗਭਗ 85 ਪ੍ਰਤੀਸ਼ਤ ਤੱਕ ਘਟਾ ਦਿੱਤਾ ਹੈ, ਜਿਸ ਨਾਲ ਖੋਜਕਰਤਾਵਾਂ ਲਈ ਮਾਡਲ ਦੀਆਂ ਪੂਰੀਆਂ ਤਰਕਸ਼ੀਲ ਸਮਰੱਥਾਵਾਂ ਤੱਕ ਪਹੁੰਚ ਬਹਾਲ ਹੋ ਗਈ ਹੈ। ਇਹ ਤਬਦੀਲੀ ਦੋਹਰੇ-ਵਰਤੋਂ ਵਾਲੇ ਜੈਵਿਕ ਵਿਸ਼ਿਆਂ 'ਤੇ ਸਖ਼ਤ ਸੁਰੱਖਿਆਵਾਂ ਨੂੰ ਬਰਕਰਾਰ ਰੱਖਦੀ ਹੈ, ਜਿਸ ਨਾਲ ਮਾਡਲ ਨੂੰ ਅਜਿਹੇ ਨਿਰਦੇਸ਼ ਪ੍ਰਦਾਨ ਕਰਨ ਤੋਂ ਰੋਕਿਆ ਜਾਂਦਾ ਹੈ ਜੋ ਜੈਵਿਕ ਹਥਿਆਰਾਂ ਨੂੰ ਸਮਰੱਥ ਬਣਾ ਸਕਦੇ ਹਨ।

ਇਹ ਅਪਡੇਟ ਕਿਉਂ ਮਹੱਤਵਪੂਰਨ ਹੈ

Fable 5 ਦੀ ਸੁਰੱਖਿਆ ਪਰਤ ਨੂੰ ਸ਼ੁਰੂ ਵਿੱਚ ਸਾਵਧਾਨੀ ਦੇ ਪੱਖ ਵਿੱਚ ਰੱਖਣ ਲਈ ਕੈਲੀਬਰ ਕੀਤਾ ਗਿਆ ਸੀ, ਜੋ ਕਿ ਕਈ ਜਾਇਜ਼ ਵਿਗਿਆਨਕ ਸਵਾਲਾਂ ਨੂੰ ਉੱਚ-ਜੋਖਮ ਵਾਲਾ ਦੱਸ ਕੇ ਫਲੈਗ ਕਰ ਦਿੰਦੀ ਸੀ। ਉਹ ਉਪਯੋਗਕਰਤਾ ਜੋ ਰੁਟੀਨ ਲੈਬ-ਨਤੀਜਿਆਂ ਦੀ ਵਿਆਖਿਆ ਜਾਂ ਕਲੀਨਿਕਲ ਲੱਛਣਾਂ ਦੇ ਵਿਸ਼ਲੇਸ਼ਣ ਲਈ ਪੁੱਛਦੇ ਸਨ, ਉਹਨਾਂ ਨੂੰ ਰੁਟੀਨ ਦੇ ਤੌਰ 'ਤੇ ਘੱਟ ਸਮਰੱਥ Opus 5 ਮਾਡਲ ਵੱਲ ਰੀਡਾਇਰੈਕਟ ਕੀਤਾ ਜਾਂਦਾ ਸੀ। ਜ਼ਿਆਦਾ ਬਲਾਕਿੰਗ ਕਾਰਨ ਵਿਗਿਆਨਕ ਭਾਈਚਾਰੇ ਤੋਂ ਆਲੋਚਨਾ ਹੋਈ, ਜਿਸ ਨੇ ਦਲੀਲ ਦਿੱਤੀ ਕਿ ਇਸ ਰੁਕਾਵਟ ਨੇ ਅਸਲ

ਇਹ ਸੁਧਾਰ ਇੱਕ ਮੁੜ-ਤਿਆਰ ਕੀਤੇ ਗਏ ਕਲਾਸੀਫਾਇਰ ਕਾਰਨ ਹੋਇਆ ਹੈ ਜੋ ਆਮ ਬਾਇਓਮੈਡੀਕਲ ਸਵਾਲਾਂ ਅਤੇ ਉਹਨਾਂ ਦੇ ਵਿਚਕਾਰ ਅੰਤਰ ਕਰਦਾ ਹੈ ਜੋ "ਦੋਹਰੇ ਉਦੇਸ਼" (dual-use) ਵਾਲੀ ਖੋਜ ਨਾਲ ਸਬੰਧਤ ਹਨ—ਅਜਿਹੀ ਜਾਣਕਾਰੀ ਜਿਸਦੀ ਵਰਤੋਂ ਨੁਕਸਾਨ ਪਹੁੰਚਾਉਣ ਲਈ ਕੀਤੀ ਜਾ ਸਕਦੀ ਹੈ। ਨਵਾਂ ਕਲਾਸੀਫਾਇਰ ਅਜੇ ਵੀ ਵਾਇਰੋਲੋਜੀ, ਟੌਕਸੀਕੋਲੋਜੀ ਅਤੇ ਉੱਨਤ ਮੌਲੀਕਿਊਲਰ ਡਿਜ਼ਾਈਨ ਨਾਲ ਸਬੰਧਤ ਬੇਨਤੀਆਂ ਨੂੰ ਰੋਕਦਾ ਹੈ, ਪਰ ਇਹ ਸਟੈਂਡਰਡ ਡਾਇਗਨੌਸਟਿਕਸ, ਲੱਛਣਾਂ ਦੀ ਛਾਂਟਣੀ (symptom triage), ਅਤੇ ਡਾਟਾ ਦੀ ਵਿਆਖਿਆ ਬਾਰੇ ਸਵਾਲਾਂ ਨੂੰ ਲੰਘਣ ਦਿੰਦਾ ਹੈ।

Anthropic ਦੇ ਇੰਜੀਨੀਅਰਾਂ ਨੇ ਨੋਟ ਕੀਤਾ ਕਿ ਜੀਵ ਵਿਗਿਆਨਕ ਖ਼ਤਰੇ ਸਾਈਬਰ ਖ਼ਤਰਿਆਂ ਨਾਲੋਂ ਵੱਖਰੇ ਹੁੰਦੇ ਹਨ: ਇੱਕ ਵਾਰ ਜਦੋਂ ਕੋਈ ਪਾਥੋਜਨ (pathogen) ਫੈਲ ਜਾਂਦਾ ਹੈ, ਤਾਂ ਇਸਨੂੰ ਪੈਚ (patch) ਨਹੀਂ ਕੀਤਾ ਜਾ ਸਕਦਾ ਜਾਂ ਬੰਦ ਨਹੀਂ ਕੀਤਾ ਜਾ ਸਕਦਾ। ਇਸ ਅਸਲੀਅਤ ਨੇ ਉੱਚ-ਜੋਖਮ ਵਾਲੇ ਖੇਤਰਾਂ 'ਤੇ ਸਖ਼ਤ ਰਹਿਣ ਅਤੇ ਰੋਜ਼ਾਨਾ ਡਾਕਟਰੀ ਪੁੱਛਗਿੱਛਾਂ ਲਈ ਜਾਲ ਨੂੰ ਢਿੱਲਾ ਕਰਨ ਦਾ ਫੈਸਲਾ ਲਿਆ।

ਕੀ ਵਰਜਿਤ ਰਹਿੰਦਾ ਹੈ

ਮਾਡਲ ਉਹਨਾਂ ਬੇਨਤੀਆਂ ਨੂੰ ਰੱਦ ਕਰਨਾ ਜਾਰੀ ਰੱਖਦਾ ਹੈ ਜੋ ਹਾਨੀਕਾਰਕ ਏਜੰਟਾਂ ਦੇ ਨਿਰਮਾਣ ਵਿੱਚ ਸਹੂਲਤ ਦੇ ਸਕਦੀਆਂ ਹਨ। ਖਾਸ ਤੌਰ 'ਤੇ, ਕੋਈ ਵੀ ਪ੍ਰੋਂਪਟ ਜੋ ਇਹ ਮੰਗਦਾ ਹੈ:

  • ਵਿਸਤ੍ਰਿਤ ਵਾਇਰੋਲੋਜੀ ਪ੍ਰੋਟੋਕੋਲ ਜੋ ਵਾਇਰਸ ਦੇ ਨਿਰਮਾਣ ਵਿੱਚ ਮਦਦ ਕਰ ਸਕਦੇ ਹਨ,
  • ਹਥਿਆਰ ਬਣਾਉਣ ਯੋਗ ਰਸਾਇਣਾਂ ਲਈ ਟੌਕਸੀਕੋਲੋਜੀ ਮਾਰਗ, ਜਾਂ
  • ਮੌਲੀਕਿਊਲਰ ਇੰਜੀਨੀਅਰਿੰਗ ਦੇ ਕਦਮ-ਦਰ-ਕਦਮ ਨਿਰਦੇਸ਼।

Anthropic ਨੇ ਆਪਣੀ ਸਾਵਧਾਨੀ ਲਈ ਤਿੰਨ ਸਰੋਤਾਂ ਦਾ ਹਵਾਲਾ ਦਿੱਤਾ: ਅਮਰੀਕੀ ਖੁਫੀਆ ਏਜੰਸੀਆਂ ਦੇ ਵਿਸ਼ਲੇਸ਼ਣ ਜੋ ਜੀਵ ਵਿਗਿਆਨਕ ਜੋਖਮ ਨੂੰ ਉਜਾਗਰ ਕਰਦੇ ਹਨ, ਉਹ ਖੋਜ ਜੋ ਦਿਖਾਉਂਦੀ ਹੈ ਕਿ AI ਪੂਰੀ ਤਰ੍ਹਾਂ ਸਿੰਥੈਟਿਕ ਵਾਇਰਸ ਡਿਜ਼ਾਈਨ ਕਰ ਸਕਦਾ ਹੈ, ਅਤੇ ਮੌਜੂਦਾ ਲੈਂਗੂਏਜ ਮਾਡਲਾਂ ਤੋਂ ਜੀਵ-ਹਥਿਆਰਾਂ ਦੇ ਨਿਰਦੇਸ਼ ਮੰਗਣ ਦੀਆਂ ਉਪਯੋਗਕਰਤਾਵਾਂ ਦੁਆਰਾ ਕੀਤੀਆਂ ਗਈਆਂ ਦਸਤਾਵੇਜ਼ੀ ਕੋਸ਼ਿਸ਼ਾਂ।

ਪ੍ਰਮਾਣਿਤ ਵਿਗਿਆਨੀਆਂ ਲਈ ਐਕਸੈਸ ਪ੍ਰੋਗਰਾਮ

ਖੁੱਲ੍ਹੀ ਖੋਜ ਅਤੇ ਸੁਰੱਖਿਆ ਵਿਚਕਾਰ ਸੰਤੁਲਨ ਬਣਾਉਣ ਲਈ, Anthropic ਇੱਕ ਵਿਸ਼ੇਸ਼ ਐਕਸੈਸ ਪ੍ਰੋਗਰਾਮ ਸ਼ੁਰੂ ਕਰ ਰਿਹਾ ਹੈ। ਪ੍ਰਮਾਣਿਤ ਖੋਜਕਰਤਾ ਇੱਕ ਨਿਯੰਤਰਿਤ ਮਾਹੌਲ ਲਈ ਅਪਲਾਈ ਕਰ ਸਕਦੇ ਹਨ ਜਿੱਥੇ ਆਡਿਟ ਦੇ ਅਧੀਨ ਪਾਬੰਦੀਸ਼ੁਦਾ ਸਮਰੱਥਾਵਾਂ ਨੂੰ ਅਨਲੌਕ ਕੀਤਾ ਜਾਂਦਾ ਹੈ। ਇਹ ਪ੍ਰੋਗਰਾਮ ਜਾਇਜ਼ ਵਿਗਿਆਨੀਆਂ ਨੂੰ ਉੱਚ-ਜੋਖਮ ਵਾਲੇ ਵਿਸ਼ਿਆਂ—ਜਿਵੇਂ ਕਿ ਨਵੇਂ ਵੈਕਸੀਨ ਪਲੇਟਫਾਰਮ ਜਾਂ ਪਾਥੋਜਨ ਮਾਡਲਿੰਗ—ਦੀ ਖੋਜ ਕਰਨ ਦੀ ਇਜਾਜ਼ਤ ਦੇਣ ਲਈ ਤਿਆਰ ਕੀਤਾ ਗਿਆ ਹੈ, ਤਾਂ ਜੋ ਆਮ ਜਨਤਾ ਨੂੰ ਖ਼ਤਰਨਾਕ ਮਾਰਗਦਰਸ਼ਨ ਤੋਂ ਬਚਾਇਆ ਜਾ ਸਕੇ।

ਮੁੱਖ ਨਿਸ਼ਕਰਸ਼

ਸਖ਼ਤ ਦੋਹਰੇ-ਵਰਤੋਂ ਦੇ ਪਾਬੰਦੀਆਂ ਨੂੰ ਬਰਕਰਾਰ ਰੱਖਦੇ ਹੋਏ, ਫਾਲਸ-ਪਾਜ਼ੇਟਿਵ (false-positive) ਬਲਾਕਾਂ ਨੂੰ 85% ਤੱਕ ਘਟਾ ਕੇ, Anthropic ਦਾ ਟੀਚਾ ਖੋਜਕਰਤਾਵਾਂ ਨੂੰ ਆਪਣੇ ਸਭ ਤੋਂ ਸਮਰੱਥ ਮਾਡਲ ਦੀ ਸ਼ਕਤੀ ਦੇਣਾ ਹੈ, ਬਿਨਾਂ ਜੀਵ-ਹਥਿਆਰ ਡਿਜ਼ਾਈਨ ਲਈ ਦਰਵਾਜ਼ਾ ਖੋਲ੍ਹੇ। ਇਸ ਕੈਲੀਬਰੇਟਡ ਸੁਰੱਖਿਆ ਰਣਨੀਤੀ ਦੀ ਸਫਲਤਾ ਇਸ ਗੱਲ ਦਾ ਨਮੂਨਾ ਬਣ ਸਕਦੀ ਹੈ ਕਿ ਫਰੰਟੀਅਰ AI ਮਾਡਲ ਹੋਰ ਉੱਚ-ਜੋਖਮ ਵਾਲੇ ਵਿਗਿਆਨਕ ਖੇਤਰਾਂ ਨੂੰ ਕਿਵੇਂ ਸੰਭਾਲਦੇ ਹਨ।