Anthropic च्या Claude मध्ये गोपनीयतेची त्रुटी (privacy vulnerability) समोर आली आहे: खाजगी संभाषणे आणि "Artifacts" Google वर शोधण्यायोग्य (searchable) झाले आहेत. ही घटना AI च्या युगात वापरकर्त्यांनी केलेली शेअरिंग आणि वेब इंडेक्सिंग यांच्यातील संघर्षाला अधोरेखित करते.

माहिती उघड होण्याचे कारण

Reddit वापरकर्त्यांनी site:claude.ai/share सारख्या Google ऑपरेटर्सचा वापर करून ही त्रुटी शोधून काढली, ज्यामुळे "share chat" फीचरच्या मूळ गोपनीयतेचे उल्लंघन झाले. Claude चे ताकीद देते की "ज्यांच्याकडे लिंक आहे ते कोणीही पाहू शकतात," परंतु हे फीचर विशिष्ट व्यक्तींना शेअर करण्यासाठी आहे, जागतिक स्तरावर दृश्यमानतेसाठी नाही.

Google Docs च्या उलट, जे डिफॉल्टनुसार क्रॉलर्सना (crawlers) ब्लॉक करते, Claude च्या शेअर केलेल्या URLs Google द्वारे इंडेक्स केल्या गेल्या, ज्यामुळे कोणालाही सामान्य सर्चद्वारे संवेदनशील माहिती मिळू शकली.

धोक्यात आलेली संवेदनशील माहिती आणि मजकूर

Futurism आणि TechCrunch सारख्या माध्यमांनी दिलेल्या अहवालानुसार, इंडेक्स केलेल्या निकालांमध्ये खालील गोष्टींचा समावेश होता:

  • वैयक्तिक ओळखण्यायोग्य माहिती (PII): प्राथमिक शाळेत शिकणाऱ्या मुलांची नावे आणि फोन नंबर.
  • वैद्यकीय नोंदी: तपशीलवार क्लिनिकल-ट्रायल निकाल आणि प्रत्यक्ष रुग्णांचे अहवाल.
  • कॉर्पोरेट इंटेलिजन्स: "केवळ अंतर्गत वापरासाठी" (internal use only) असे चिन्हांकित केलेले दस्तऐवज आणि कर्मचाऱ्यांचे कामगिरी पुनरावलोकन (performance reviews).
  • तांत्रिक मालमत्ता: Claude च्या "Artifacts" फीचरमधील कोड स्निपेट्स (code snippets) आणि कामाच्या नोट्स.

काही उघड झालेल्या चॅट्स Anthropic च्या सेफ्टी फिल्टर्समधूनही निसटल्या, ज्यामध्ये लैंगिकदृष्ट्या स्पष्ट (sexually explicit) मजकूर दिसून आला आणि यामुळे मॉडरेशनबाबत अधिक चिंता निर्माण झाली आहे.

Anthropic आणि Google यांची प्रतिक्रिया

Anthropic ने आपल्या आर्किटेक्चरचे समर्थन केले आणि सांगितले की ते सर्च इंजिनसोबत चॅट डिरेक्टरीज किंवा साइटमॅप्स शेअर करत नाहीत. प्रवक्त्या Amie Rotherham यांनी स्पष्ट केले की, वापरकर्त्यांनी शेअर लिंक्स बाह्य, क्रॉल करण्यायोग्य प्लॅटफॉर्मवर पोस्ट केल्यानंतरच त्या सर्च रिझल्टमध्ये दिसतात आणि या URLs "अंदाज लावण्यायोग्य नाहीत" (not guessable). एकदा लिंक "सार्वजनिक" (out in the wild) झाली की, ती तृतीय पक्षांद्वारे संग्रहित (archive) केली जाऊ शकते.

Google चे प्रवक्ते Ned Adriance यांनीही असेच म्हटले की, जोपर्यंत साइट मालक स्पष्टपणे क्रॉलिंग ब्लॉक करत नाहीत, तोपर्यंत सर्च इंजिन त्यांना जे काही सापडते ते इंडेक्स करते. चाचण्यांनुसार ही माहिती Google च्या इंडेक्समधून काढून टाकण्यात आली आहे, परंतु गेल्या वर्षीही अशाच प्रकारच्या घटनेत शेकडो Claude चॅट्स इंडेक्स झाले होते.

AI वापरकर्त्यांसाठी हे का महत्त्वाचे आहे

LLMs समाविष्ट करणारे डेव्हलपर्स आणि संस्थापकांनी "शेअर केलेल्या लिंक्स" सुरक्षित नसून सार्वजनिक आहेत असे मानले पाहिजे. जसे AI टूल्स वैयक्तिक सहाय्यकांपासून एंटरप्राइझ कोलबोरेटर्समध्ये बदलत आहेत, तसे सार्वजनिक वेब कंटेंट आणि खाजगी डेटा यातील रेषा केवळ टूलटिप वॉर्निंगने नाही, तर तांत्रिक अंमलबजावणीद्वारे (technical enforcement) निश्चित करणे आवश्यक आहे.

महत्त्वाचे मुद्दे

  • तुमच्या सेटिंग्ज तपासा: Claude मध्ये Settings → Privacy → Shared Chats वर जा आणि सर्व सक्रिय सार्वजनिक लिंक्स रद्द करा.
  • शेअर लिंक्सना सार्वजनिक माना: AI द्वारे तयार केलेली कोणतीही लिंक सर्च इंजिनद्वारे इंडेक्स केली जाऊ शकते असे गृहीत धरा.
  • एंटरप्राइझ खबरदारी: मालकी हक्क असलेला कोड किंवा संवेदनशील PII गळती रोखण्यासाठी "शेअर" फीचर्सबाबत कडक धोरणे लागू करा.

Google ने Claude च्या शेअर-लिंक URLs इंडेक्स केल्यामुळे Anthropic च्या Claude AI प्लॅटफॉर्मवर खाजगी चॅट्स आणि “Artifacts” नकळत उघड झाले, ज्यामुळे संवेदनशील संभाषणे शोधण्यायोग्य झाली. Reddit वापरकर्त्यांनी साइट-विशिष्ट Google क्वेरीद्वारे ही गळती शोधली, ज्यामुळे वैयक्तिक, वैद्यकीय आणि कॉर्पोरेट डेटा उघड झाला.

माहिती उघड कशी झाली

Claude चे "share chat" फीचर एक URL तयार करते, ज्याबद्दल इंटरफेस असा इशारा देतो की ती लिंक ज्याच्याकडे असेल तो कोणीही पाहू शकतो. याचा उद्देश लिंक सहकाऱ्याला देणे हा आहे, ती प्रसारित करणे नाही. कारण या URLs claude.ai/share डोमेन अंतर्गत येतात, त्यामुळे कोणत्याही सार्वजनिकरित्या क्रॉल करण्यायोग्य साइटवर—फोरम, सोशल मीडिया किंवा Reddit कमेंटवर—लिंक पोस्ट केल्यास Google चा क्रॉलर त्याचा मागोवा घेऊ शकतो.

Reddit वापरकर्त्यांनी Google वर site:claude.ai/share शोधून ही समस्या शोधली, ज्यामध्ये खाजगी राहणे अपेक्षित असलेली संभाषणे समोर आली. Google Docs च्या उलट, ज्यांच्या शेअर केलेल्या लिंक्स डिफॉल्टनुसार इंडेक्सिंगपासून सुरक्षित असतात, Claude च्या लिंक्समध्ये त्या संरक्षणाचा अभाव होता, ज्यामुळे सर्च इंजिन त्यांना कॅटलॉग करू शकले.

काय उघड झाले

अनेक माध्यमांनी दिलेल्या अहवालानुसार, इंडेक्स केलेल्या निकालांमध्ये खालील गोष्टींचा समावेश होता:

  • वैयक्तिक ओळखण्यायोग्य माहिती (PII): प्राथमिक शाळेत शिकणाऱ्या मुलांची नावे आणि फोन नंबर.
  • वैद्यकीय नोंदी: तपशीलवार क्लिनिकल-ट्रायल डेटा आणि प्रत्यक्ष रुग्णांचे अहवाल.
  • कॉर्पोरेट इंटेलिजन्स: "केवळ अंतर्गत वापरासाठी" (internal use only) असे चिन्हांकित केलेले दस्तऐवज, कर्मचाऱ्यांचे कामगिरी पुनरावलोकन आणि इतर मालकीची माहिती.
  • तांत्रिक मालमत्ता: Claude च्या "Artifacts" फीचरमध्ये तयार केलेले कोड स्निपेट्स, कामाच्या नोट्स आणि इतर आर्टिफॅक्ट्स.

काही प्रकरणांमध्ये, सार्वजनिकरित्या दिसणाऱ्या चॅट्समध्ये Anthropic च्या सेफ्टी फिल्टर्समधून निसटलेला लैंगिकदृष्ट्या स्पष्ट मजकूर देखील समाविष्ट होता.

Anthropic ची प्रतिक्रिया

Anthropic चा असा दावा आहे की ते सर्च इंजिनसाठी चॅट डिरेक्टरीज किंवा साइटमॅप्स प्रकाशित करत नाहीत. कंपनीच्या प्रवक्त्याने स्पष्ट केले की, जेव्हा एखादा वापरकर्ता बाह्य आणि क्रॉल करण्यायोग्य (crawlable) प्लॅटफॉर्मवर URL पोस्ट करतो, तेव्हाच शेअर केलेल्या लिंक्स सर्च रिझल्टमध्ये दिसतात, आणि त्यांनी या गोष्टीवर भर दिला की हे URLs "अंदाज लावण्यायोग्य नाहीत" (not guessable). एकदा का एखादी लिंक जाणीवपूर्वक ऑनलाइन शेअर केली की, कंपनी तृतीय-पक्ष आर्काइव्हिंगवर (third-party archiving) नियंत्रण ठेवू शकत नाही.

Google चे धोरण

Google ने पुनरुच्चार केला की कोणते कंटेंट सार्वजनिक असावे याचा निर्णय ते घेत नाहीत; जोपर्यंत एखादी साइट स्पष्टपणे क्रॉलिंग रोखत नाही, तोपर्यंत त्यांना जे काही सापडते त्याचे ते इंडेक्सिंग करतात. कंपनीने म्हटले आहे की ते robots.txt किंवा मेटा टॅग्स सारख्या सूचनांचा आदर करतात ज्यामध्ये माहिती वगळण्याची विनंती केली जाते. या घटनेनंतरच्या प्राथमिक चाचण्या असे सूचित करतात की उघड झालेल्या URLs Google च्या इंडेक्समधून काढून टाकण्यात आल्या आहेत, तरीही Google ने कायमस्वरूपी सुधाराची (permanent fix) पुष्टी केलेली नाही.

AI वापरकर्त्यांसाठी हे का महत्त्वाचे आहे

लार्ज लँग्वेज मॉडेल्स वैयक्तिक सहाय्यकांपासून एंटरप्राइझ वर्कफ्लोमध्ये प्रवेश करत असताना, ही घटना एका व्यापक जोखमीवर प्रकाश टाकते. "शेअरेबल लिंक" ही एक सोयीची यंत्रणा आहे जी कोणताही क्रॉलर गोळा करू शकतो. नियमन केलेल्या डेटाचे व्यवस्थापन करणाऱ्या संस्थांसाठी—जसे की आरोग्य नोंदी, कर्मचारी मूल्यमापन, मालकीचा कोड (proprietary code)—लिंक "फक्त शेअर केली आहे" म्हणून ती सुरक्षित आहे असे मानणे महागड्या डेटा लीकला कारणीभूत ठरू शकते.

प्रतिवाद: प्लॅटफॉर्मच्या मर्यादा

Anthropic असा युक्तिवाद करते की लिंक प्रकाशित करण्याची जबाबदारी वापरकर्त्यांची आहे. प्लॅटफॉर्म असा इशारा देते की ज्याच्याकडे URL आहे तो कोणीही कंटेंट पाहू शकतो आणि ते सार्वजनिक डिरेक्टरीमध्ये URLs उघड करत नाहीत. Google याला प्रत्युत्तर देते की, समोर येणाऱ्या प्रत्येक खाजगी लिंकवर ते नियंत्रण ठेवू शकत नाहीत; सर्च रिझल्टमध्ये न येण्याबाबत साइट मालकांच्या विनंत्यांचे पालन करणे हीच त्यांची भूमिका आहे.

दोन्ही बाजू तांत्रिकदृष्ट्या अचूक आहेत, तरीही त्यांच्यात एक त्रुटी आहे: वापरकर्त्याचा अनुभव इंडेक्सिंगची जोखीम स्पष्टपणे दर्शवत नाही आणि प्लॅटफॉर्म शेअर केलेल्या पेजेसवर आपोआप "no-index" सूचना लागू करत नाही. त्यामुळे, अनवधानाने होणारी सार्वजनिक उघडता रोखण्याची जबाबदारी वापरकर्त्यांवर येते, ज्यांना कदाचित हे माहित नसेल की साध्या सर्च क्वेरीद्वारे लिंक किती सहजपणे शोधली जाऊ शकते.

पुढे काय पाहावे

वापरकर्त्यांसाठी व्यावहारिक पावले

  • सक्रिय लिंक्सची तपासणी करा (Audit Active Links): Claude च्या सेटिंग्ज उघडा, शेअर केलेल्या चॅट्ससाठी प्रायव्हसी सेक्शनमध्ये जा आणि तुम्हाला आता आवश्यक नसलेल्या सर्व URLs रद्द करा.
  • प्रत्येक शेअर लिंकला सार्वजनिक समजा: एकदा का लिंक ऑनलाइन कुठेही पोस्ट केली की, जोपर्यंत ती स्पष्टपणे ब्लॉक केली जात नाही, तोपर्यंत तिचे इंडेक्सिंग होऊ शकते असे गृहीत धरा.
  • एंटरप्राइझ कंट्रोल्स: असे मॉनिटरिंग टूल्स वापरा जे "PII," "confidential," किंवा "internal" सारख्या कीवर्ड्सचा समावेश असलेल्या शेअर लिंक्स तयार केल्यास सूचना देतात आणि अशा लिंक्स कॉर्पोरेट नेटवर्कच्या बाहेर जाण्यापूर्वी मंजुरीची प्रक्रिया (approval workflows) लागू करा.

Claude ची ही घटना आपल्याला आठवण करून देते की, जेव्हा वेब या लिंक्सना सामान्य पेजेसप्रमाणे हाताळते, तेव्हा त्वरित शेअर करण्याची सोय ही एक जोखीम (liability) बनू शकते. जोपर्यंत प्लॅटफॉर्म शेअर केलेल्या URLs चे आपोआप संरक्षण करत नाहीत, तोपर्यंत वापरकर्त्यांनी सतर्क राहणे आवश्यक आहे.