SpaceXAI ਦੇ Grok Build AI ਕੋਡਿੰਗ ਟੂਲ ਦੀ ਉਸ ਤੋਂ ਬਾਅਦ ਆਲੋਚਨਾ ਹੋਈ ਜਦੋਂ ਖੋਜਕਰਤਾਵਾਂ ਨੇ ਪਾਇਆ ਕਿ ਇਹ ਪੂਰੇ ਯੂਜ਼ਰ ਰੈਪੋਜ਼ੀਟਰੀਆਂ (repositories) ਨੂੰ Google Cloud ਸਟੋਰੇਜ 'ਤੇ ਅਪਲੋਡ ਕਰ ਰਿਹਾ ਸੀ। ਇਸ ਉਲੰਘਣਾ ਨੇ ਇਸ ਗੱਲ ਨੂੰ ਲੈ ਕੇ ਚਿੰਤਾ ਪੈਦਾ ਕਰ ਦਿੱਤੀ ਹੈ ਕਿ AI ਸਹਾਇਕ ਕਿੰਨਾ ਜ਼ਿਆਦਾ ਮਲਕੀਅਤ ਵਾਲਾ (proprietary) ਡੇਟਾ ਅੰਦਰ ਲੈ ਸਕਦੇ ਹਨ ਅਤੇ ਰੱਖ ਸਕਦੇ ਹਨ।

ਵਧੇਰੇ ਡੇਟਾ ਰਿਟੈਂਸ਼ਨ ਅਤੇ ਸੁਰੱਖਿਆ ਜੋਖਮ

Cereblab ਦੇ ਵਿਸ਼ਲੇਸ਼ਣ ਨੇ ਦਿਖਾਇਆ ਕਿ Grok Build command-line interface (CLI) ਪੂਰੇ codebase ਨੂੰ ਪੈਕ ਕਰਕੇ ਕਲਾਉਡ 'ਤੇ ਭੇਜ ਰਿਹਾ ਸੀ। ਇਸ ਤੋਂ ਵੀ ਵੱਧ ਚਿੰਤਾਜਨਕ ਗੱਲ ਇਹ ਸੀ ਕਿ ਟੂਲ ਨੇ ਉਹ ਫਾਈਲਾਂ ਵੀ ਖੋਲ੍ਹ ਦਿੱਤੀਆਂ ਜਿਨ੍ਹਾਂ ਨੂੰ ਇਗਨੋਰ (ignore) ਕਰਨ ਲਈ ਕਿਹਾ ਗਿਆ ਸੀ ਅਤੇ ਉਹ secrets ਕੱਢ ਲਏ ਜੋ ਡਿਵੈਲਪਰਾਂ ਨੇ git history ਤੋਂ ਮਿਟਾ ਦਿੱਤੇ ਸਨ।

ਡੇਟਾ ਇਕੱਠਾ ਕਰਨ ਦਾ ਇਹ ਪੱਧਰ Claude Code ਵਰਗੇ ਮੁਕਾਬਲੇਬਾਜ਼ਾਂ ਨਾਲੋਂ ਕਿਤੇ ਵੱਧ ਹੈ। King’s College London ਦੇ ਸੁਰੱਖਿਆ ਖੋਜਕਰਤਾ ਡਾ. Lukasz Olejnik ਨੇ ਚੇਤਾਵਨੀ ਦਿੱਤੀ ਕਿ ਅਜਿਹੀ ਇਕੱਤਰਤਾ ਸੋਰਸ ਕੋਡ, ਇਨਫਰਾਸਟ੍ਰਕਚਰ ਡਾਇਗ੍ਰਾਮ, ਕਮਜ਼ੋਰੀਆਂ (vulnerabilities) ਅਤੇ ਕ੍ਰੈਡੈਂਸ਼ੀਅਲਜ਼ (credentials) ਨੂੰ ਰਿਮੋਟ ਸਰਵਰਾਂ ਦੇ ਸਾਹਮਣੇ ਲਿਆ ਸਕਦੀ ਹੈ।

SpaceXAI ਅਤੇ Elon Musk ਦਾ ਜਵਾਬ

SpaceXAI ਨੇ ਅਪਲੋਡ ਫੀਚਰ ਨੂੰ ਬੰਦ ਕਰ ਦਿੱਤਾ ਹੈ। ਖੋਜਕਰਤਾ ਹੁਣ Grok ਦੇ ਸਰਵਰਾਂ 'ਤੇ disable_codebase_upload: true ਫਲੈਗ ਦੇਖ ਰਹੇ ਹਨ, ਜੋ ਇਸ ਗੱਲ ਦੀ ਪੁਸ਼ਟੀ ਕਰਦਾ ਹੈ ਕਿ ਆਟੋਮੈਟਿਕ ਪੁਸ਼ ਹੁਣ ਨਹੀਂ ਚੱਲ ਰਹੀ।

Elon Musk ਨੇ X 'ਤੇ ਪੋਸਟ ਕੀਤਾ ਕਿ ਪਹਿਲਾਂ ਅਪਲੋਡ ਕੀਤਾ ਗਿਆ ਸਾਰਾ ਡੇਟਾ "ਪੂਰੀ ਤਰ੍ਹਾਂ ਅਤੇ ਬਿਲਕੁਲ ਮਿਟਾ ਦਿੱਤਾ ਜਾਵੇਗਾ।" ਉਨ੍ਹਾਂ ਨੇ ਯੂਜ਼ਰਾਂ ਨੂੰ ਇਹ ਅਨੁਰੋਧ ਵੀ ਕੀਤਾ ਕਿ SpaceXAI ਨੂੰ "debugging issues" ਲਈ ਡੇਟਾ ਰੱਖਣ ਦਿੱਤਾ ਜਾਵੇ, ਇੱਕ ਅਜਿਹੀ ਮੰਗ ਜਿਸ ਨੂੰ ਕਈ ਲੋਕ ਵਿਰੋਧਾਭਾਸ ਵਜੋਂ ਦੇਖਦੇ ਹਨ।

ਕੰਪਨੀ ਨੇ ਰਿਟੈਂਸ਼ਨ ਨੂੰ ਪ੍ਰਬੰਧਿਤ ਕਰਨ ਲਈ /privacy CLI ਕਮਾਂਡ ਦੀ ਸਲਾਹ ਦਿੱਤੀ, ਪਰ Cereblab ਨੇ ਨੋਟ ਕੀਤਾ ਕਿ ਇਹ ਕਮਾਂਡ ਸਿਰਫ਼ per-session ਸਟੋਰੇਜ ਨੂੰ ਬਦਲਦੀ ਹੈ—ਇਹ ਉਹ ਸਿਸਟਮੈਟਿਕ ਰੈਪੋਜ਼ੀਟਰੀ ਅਪਲੋਡਸ ਨੂੰ ਨਹੀਂ ਰੋਕਦੀ ਜਿਸ ਕਾਰਨ ਇਹ ਵਿਵਾਦ ਖੜ੍ਹਾ ਹੋਇਆ।

ਡਿਵੈਲਪਰਾਂ ਅਤੇ ਉੱਦਮਾਂ (Enterprises) ਲਈ ਇਹ ਕਿਉਂ ਮਹੱਤਵਪੂਰਨ ਹੈ

ਇਹ ਘਟਨਾ ਡਿਵੈਲਪਰਾਂ ਅਤੇ ਉੱਦਮਾਂ ਨੂੰ ਚੇਤਾਵਨੀ ਦਿੰਦੀ ਹੈ ਕਿ AI-ਡਰਾਈਵਨ ਕੋਡਿੰਗ ਏਜੰਟ ਹੁਣ ਸਿਰਫ਼ ਸਧਾਰਨ autocomplete ਟੂਲ ਨਹੀਂ ਹਨ; ਉਹ ਆਪਣੇ ਆਪ ਕੋਡ ਪੜ੍ਹ ਸਕਦੇ ਹਨ, ਸੋਧ ਸਕਦੇ ਹਨ ਅਤੇ commit ਕਰ ਸਕਦੇ ਹਨ। ਜਦੋਂ ਕੋਈ ਏਜੰਟ ignore ਫਾਈਲਾਂ ਨੂੰ ਬਾਈਪਾਸ ਕਰਦਾ ਹੈ ਜਾਂ ਮਿਟਾਏ ਗਏ secrets ਨੂੰ ਦੁਬਾਰਾ ਲਿਆਉਂਦਾ ਹੈ, ਤਾਂ "zero data retention" ਦੇ ਕਿਸੇ ਵੀ ਦਾਅਵੇ ਨੂੰ ਤਕਨੀਕੀ ਟੈਸਟਾਂ ਨਾਲ ਸਾਬਤ ਕੀਤਾ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ, ਨਾ ਕਿ UI ਵਾਅਦਿਆਂ ਨਾਲ।

CTOs ਅਤੇ ਪ੍ਰੋਡਕਟ ਮਾਲਕਾਂ ਲਈ, ਇਹ ਘਟਨਾ ਹੇਠ ਲਿਖੀਆਂ ਚੀਜ਼ਾਂ ਦੀ ਲੋੜ 'ਤੇ ਜ਼ੋਰ ਦਿੰਦੀ ਹੈ:

  • ਅਸਲ codebase 'ਤੇ AI ਟੂਲਜ਼ ਦੇ ਸੁਤੰਤਰ ਆਡਿਟ (Independent audits)
  • ਦੇਣਦਾਰੀ ਵਾਲੀਆਂ ਸ਼ਰਤਾਂ (Contractual clauses) ਜੋ ਡੇਟਾ ਹੈਂਡਲਿੰਗ, ਰਿਟੈਂਸ਼ਨ ਪੀਰੀਅਡ ਅਤੇ ਡਿਲੀਸ਼ਨ ਦੀਆਂ ਗਾਰੰਟੀਜ਼ ਨੂੰ ਸਪੱਸ਼ਟ ਕਰਦੀਆਂ ਹਨ।
  • Runtime safeguards ਜੋ ਫਾਈਲ-ਲੈਵਲ ਪਰਮਿਸ਼ਨਾਂ ਨੂੰ ਲਾਗੂ ਕਰਦੇ ਹਨ, ਖਾਸ ਕਰਕੇ ਉਹਨਾਂ ਰੈਪੋਜ਼ੀਟਰੀਆਂ ਲਈ ਜਿਨ੍ਹਾਂ ਵਿੱਚ credentials ਜਾਂ ਪੇਟੈਂਟ ਕੀਤੇ ਅਲਗੋਰਿਦਮ ਹਨ।

ਮੁੱਖ ਗੱਲਾਂ (Key Takeaways)

  • ਅਣਚਾਹਿਆ ਡੇਟਾ ਸਕੋਪਿੰਗ (Unintended Data Scoping): Grok Build ਨੇ Google Cloud 'ਤੇ ਪੂਰੀਆਂ ਰੈਪੋਜ਼ੀਟਰੀਆਂ ਅਪਲੋਡ ਕੀਤੀਆਂ, ਜਿਸ ਵਿੱਚ ਸੀਮਤ ਫਾਈਲਾਂ ਅਤੇ ਮਿਟਾਏ ਗਏ secrets ਵੀ ਸ਼ਾਮਲ ਸਨ।
  • ਨਿਵਾਰਣ ਦੀ ਸਥਿਤੀ (Mitigation Status): SpaceXAI ਨੇ ਆਟੋਮੈਟਿਕ ਅਪਲੋਡ ਨੂੰ ਬੰਦ ਕਰ ਦਿੱਤਾ ਹੈ ਅਤੇ ਪਹਿਲਾਂ ਹੀ ਇਕੱਠੇ ਕੀਤੇ ਗਏ ਡੇਟਾ ਨੂੰ ਮਿਟਾਉਣ ਦਾ ਵਾਅਦਾ ਕੀਤਾ ਹੈ।
  • ਸੁਰੱਖਿਆ ਪ੍ਰਭਾਵ (Security Implications): ਇਹ ਉਲੰਘਣਾ AI ਕੋਡਿੰਗ ਏਜੰਟਾਂ ਵਿੱਚ ਵਧੇਰੇ ਡੇਟਾ ਰਿਟੈਂਸ਼ਨ ਦੇ ਖਤਰੇ ਨੂੰ ਉਜਾਗਰ ਕਰਦੀ ਹੈ, ਜੋ ਮਲਕੀਅਤ ਵਾਲੇ ਲੌਜਿਕ ਅਤੇ credentials ਨੂੰ ਲੀਕ ਕਰ ਸਕਦੇ ਹਨ।

SpaceXAI ਦਾ Grok Build ਟੂਲ ਚੁੱਪਚਾਪ ਪੂਰੇ ਯੂਜ਼ਰ codebase ਨੂੰ Google Cloud 'ਤੇ ਅਪਲੋਡ ਕਰਦੇ ਹੋਏ ਫੜਿਆ ਗਿਆ, ਜਿਸ ਨਾਲ ਮਲਕੀਅਤ ਵਾਲੀਆਂ ਸੋਰਸ ਫਾਈਲਾਂ ਅਤੇ ਮਿਟਾਏ ਗਏ secrets ਪ੍ਰਗਟ ਹੋ ਗਏ।

ਕੀ ਹੋਇਆ

Cereblab ਨੇ Grok Build CLI ਦੇ ਨੈੱਟਵਰਕ ਟ੍ਰੈਫਿਕ ਨੂੰ Google Cloud bucket ਤੱਕ ਟ੍ਰੇਸ ਕੀਤਾ ਅਤੇ ਪਾਇਆ ਕਿ ਇਹ ਅਪਲੋਡ ਕਰਨ ਲਈ ਪੂਰੀਆਂ git ਰੈਪੋਜ਼ੀਟਰੀਆਂ ਨੂੰ ਆਪਣੇ ਆਪ ਪੈਕ ਕਰ ਰਿਹਾ ਸੀ। ਸੰਖੇਪ ਵਿੱਚ, ਸਹਾਇਕ (assistant) ਨੇ ਉਹ ਡੇਟਾ ਕੱਢ ਲਿਆ ਜਿਸ ਨੂੰ ਇਗਨੋਰ ਕਰਨ ਲਈ ਕਿਹਾ ਗਿਆ ਸੀ।

ਉਲੰਘਣਾ ਦਾ ਪਤਾ ਕਿਵੇਂ ਲੱਗਿਆ

ਖੋਜਕਰਤਾਵਾਂ ਨੇ payloads ਦੀ ਜਾਂਚ ਕੀਤੀ ਅਤੇ ਦੇਖਿਆ ਕਿ ਅਪਲੋਡ ਫਲੈਗ ਡਿਫੌਲਟ ਰੂਪ ਵਿੱਚ ਚਾਲੂ ਸੀ, ਜਿਸ ਵਿੱਚ ਕੋਈ ਗਲੋਬਲ

  • ਅਸਲ ਕੋਡਬੇਸਾਂ (codebases) 'ਤੇ AI ਟੂਲ ਦੇ ਵਿਵਹਾਰ ਦੇ ਸੁਤੰਤਰ ਆਡਿਟ ਕਰਵਾਓ।
  • ਡਾਟਾ ਹੈਂਡਲਿੰਗ, ਰਿਟੈਂਸ਼ਨ ਪੀਰੀਅਡ ਅਤੇ ਡਿਲੀਸ਼ਨ ਗਾਰੰਟੀਜ਼ ਨੂੰ ਪਰਿਭਾਸ਼ਿਤ ਕਰਨ ਵਾਲੇ ਸਪੱਸ਼ਟ ਇਕਰਾਰਨਾਮੇ ਤਿਆਰ ਕਰੋ।
  • ਰਨਟਾਈਮ ਸੇਫਗਾਰਡਸ (runtime safeguards) ਲਾਗੂ ਕਰੋ ਜੋ ਸੰਵੇਦਨਸ਼ੀਲ ਰਿਪੋਜ਼ਟਰੀਆਂ ਲਈ ਫਾਈਲ-ਪੱਧਰ ਦੀਆਂ ਇਜਾਜ਼ਤਾਂ ਨੂੰ ਲਾਗੂ ਕਰਦੇ ਹਨ।

ਇਹ ਉਲੰਘਣਾ AI ਦੀ ਸਹੂਲਤ ਅਤੇ ਸੁਰੱਖਿਆ ਵਿਚਕਾਰ ਤਾਲਮੇਲ ਬਾਰੇ ਇੱਕ ਵਿਆਪਕ ਸਵਾਲ ਵੀ ਖੜ੍ਹਾ ਕਰਦੀ ਹੈ। SpaceXAI ਦਾ ਦਾਅਵਾ ਹੈ ਕਿ ਅੱਪਲੋਡ ਫੀਚਰ ਮਾਡਲ ਨੂੰ ਬਿਹਤਰ ਬਣਾਉਣ ਲਈ ਵਰਤੋਂ ਦੇ ਮੈਟ੍ਰਿਕਸ ਇਕੱਠੇ ਕਰਦਾ ਸੀ, ਅਤੇ ਇਸਨੇ ਇਸ ਫੀਚਰ ਨੂੰ ਬੰਦ ਕਰ ਦਿੱਤਾ ਹੈ ਅਤੇ ਮੌਜੂਦਾ ਅੱਪਲੋਡਸ ਨੂੰ ਮਿਟਾਉਣ ਦਾ ਵਾਅਦਾ ਕੀਤਾ ਹੈ। ਆਲੋਚਕਾਂ ਦਾ ਕਹਿਣਾ ਹੈ ਕਿ ਅਸਲ ਡਿਜ਼ਾਈਨ ਵਿੱਚ ਇੱਕ ਪਾਰਦਰਸ਼ੀ 'ਆਪਟ-ਆਊਟ' (opt-out) ਦੀ ਕਮੀ ਸੀ ਅਤੇ ਘਟਨਾ ਤੋਂ ਬਾਅਦ ਦਿੱਤਾ ਗਿਆ ਪ੍ਰਾਈਵੇਸੀ ਕਮਾਂਡ ਪਹਿਲਾਂ ਹੀ ਕਲਾਉਡ ਵਿੱਚ ਮੌਜੂਦ ਡਾਟਾ ਦੀ ਪਿਛਲੀ ਤਰੀਕ ਤੋਂ ਸੁਰੱਖਿਆ ਨਹੀਂ ਕਰਦਾ।

SpaceXAI ਦਾ ਉਲਟ ਪੱਖ

SpaceXAI ਦਾ ਤਰਕ ਹੈ ਕਿ ਅੱਪਲੋਡ ਫੀਚਰ ਦਾ ਮਕਸਦ ਮਾਡਲ ਵਿੱਚ ਸੁਧਾਰ ਲਈ ਵਰਤੋਂ ਦੇ ਮੈਟ੍ਰਿਕਸ ਇਕੱਠੇ ਕਰਨਾ ਸੀ। ਇਹ ਫੀਚਰ ਨੂੰ ਤੁਰੰਤ ਬੰਦ ਕਰਨ ਅਤੇ ਮੌਜੂਦਾ ਅੱਪਲੋਡਸ ਨੂੰ ਮਿਟਾਉਣ ਦੇ ਵਾਅਦੇ ਨੂੰ ਇੱਕ ਜ਼ਿੰਮੇਵਾਰ ਪ੍ਰਤੀਕਿਰਿਆ ਦੇ ਸਬੂਤ ਵਜੋਂ ਦਰਸਾਉਂਦਾ ਹੈ। ਆਲੋਚਕਾਂ ਦਾ ਉਲਟ ਤਰਕ ਹੈ ਕਿ ਸ਼ੁਰੂਆਤੀ ਡਿਜ਼ਾਈਨ ਵਿੱਚ ਕੋਈ ਸਪੱਸ਼ਟ 'ਆਪਟ-ਆਊਟ' ਨਹੀਂ ਸੀ ਅਤੇ ਪ੍ਰਾਈਵੇਸੀ ਕਮਾਂਡ ਕਲਾਉਡ ਵਿੱਚ ਪਹਿਲਾਂ ਤੋਂ ਸਟੋਰ ਕੀਤੇ ਡਾਟਾ ਦੀ ਰੱਖਿਆ ਕਰਨ ਵਿੱਚ ਅਸਫਲ ਰਹਿੰਦੀ ਹੈ।

ਸਿੱਖਿਆ (Takeaway)

ਜਦੋਂ ਇੱਕ AI ਕੋਡਿੰਗ ਸਹਾਇਕ ਚੁੱਪਚਾਪ ਪੂਰੀ ਰਿਪੋਜ਼ਟਰੀ ਨੂੰ ਚੋਰੀ ਕਰ ਸਕਦਾ ਹੈ, ਤਾਂ ਭਰੋਸਾ ਇੱਕ ਮਾਰਕੀਟਿੰਗ ਮੁੱਦਾ ਨਹੀਂ, ਸਗੋਂ ਇੱਕ ਤਕਨੀਕੀ ਮੁੱਦਾ ਬਣ ਜਾਂਦਾ ਹੈ। ਸੰਸਥਾਵਾਂ ਨੂੰ ਅਜਿਹੇ ਪ੍ਰਮਾਣਿਤ ਅਤੇ ਲਾਗੂ ਕਰਨ ਯੋਗ ਕੰਟਰੋਲ ਦੀ ਮੰਗ ਕਰਨੀ ਚਾਹੀਦੀ ਹੈ ਜੋ ਲੁਕਵੇਂ ਡਾਟਾ ਨਿਕਾਸ (data exfiltration) ਨੂੰ ਰੋਕ ਸਕਣ, ਨਹੀਂ ਤਾਂ ਉਹ ਉਸ ਕੋਡ ਨੂੰ ਖਤਰੇ ਵਿੱਚ ਪਾ ਸਕਦੇ ਹਨ ਜੋ ਉਨ੍ਹਾਂ ਨੂੰ ਮੁਕਾਬਲੇਬਾਜ਼ੀ ਵਿੱਚ ਅੱਗੇ ਰੱਖਦਾ ਹੈ।