Anthropic-এর Claude-এ একটি গোপনীয়তা সংক্রান্ত নিরাপত্তা ঝুঁকি দেখা দিয়েছে: ব্যক্তিগত কথোপকথন এবং "Artifacts" গুগল সার্চে অনুসন্ধানযোগ্য হয়ে উঠেছে। এই ঘটনাটি এআই (AI) যুগে ব্যবহারকারীর শেয়ারিং এবং ওয়েব ইনডেক্সিংয়ের মধ্যকার দ্বন্দ্বকে সামনে এনেছে।
তথ্য ফাঁসের প্রক্রিয়া
Reddit ব্যবহারকারীরা site:claude.ai/share-এর মতো Google অপারেটর ব্যবহার করে এই তথ্য ফাঁসের বিষয়টি উন্মোচন করেছেন, যা "share chat" ফিচারের মূল গোপনীয়তাকে এড়িয়ে গেছে। Claude সতর্ক করে যে "যার কাছে লিঙ্ক আছে সে এটি দেখতে পারে," কিন্তু এই ফিচারটি নির্দিষ্ট কাউকে শেয়ার করার জন্য তৈরি করা হয়েছে, বিশ্বব্যাপী দৃশ্যমানতার জন্য নয়।
Google Docs-এর মতো ডিফল্টভাবে ক্রলার (crawler) ব্লক না করার কারণে, Claude-এর শেয়ার করা URL-গুলো Google দ্বারা ইনডেক্স করা হয়েছিল, যার ফলে সাধারণ সার্চের মাধ্যমে যে কেউ সংবেদনশীল তথ্য খুঁজে পেতে পারে।
সংবেদনশীল তথ্য এবং ঝুঁকির মুখে থাকা বিষয়বস্তু
Futurism এবং TechCrunch-এর মতো সংবাদমাধ্যমগুলো রিপোর্ট করেছে যে ইনডেক্স করা ফলাফলে যা ছিল:
- ব্যক্তিগতভাবে শনাক্তযোগ্য তথ্য (PII): প্রাথমিক বিদ্যালয়ের শিক্ষার্থীদের নাম এবং ফোন নম্বর।
- চিকিৎসা সংক্রান্ত নথি: বিস্তারিত ক্লিনিকাল-ট্রায়াল ফলাফল এবং প্রকৃত রোগীর রিপোর্ট।
- কর্পোরেট তথ্য: "শুধুমাত্র অভ্যন্তরীণ ব্যবহারের জন্য" (internal use only) চিহ্নিত নথি এবং কর্মীদের পারফরম্যান্স রিভিউ।
- প্রযুক্তিগত সম্পদ: Claude-এর "Artifacts" ফিচারের কোড স্নিপেট এবং কাজের নোট।
কিছু ফাঁস হওয়া চ্যাটে Anthropic-এর সেফটি ফিল্টারও কাজ করেনি, যেখানে যৌনতাপূর্ণ বিষয়বস্তু দেখা গেছে এবং এটি মডারেশন সংক্রান্ত আরও উদ্বেগ বাড়িয়ে তুলেছে।
Anthropic এবং Google-এর প্রতিক্রিয়া
Anthropic তাদের আর্কিটেকচারকে সমর্থন করে বলেছে যে তারা সার্চ ইঞ্জিনের সাথে চ্যাট ডিরেক্টরি বা সাইটম্যাপ শেয়ার করে না। মুখপাত্র Amie Rotherham ব্যাখ্যা করেছেন যে, ব্যবহারকারীরা যখন কোনো বাহ্যিক এবং ক্রলযোগ্য প্ল্যাটফর্মে শেয়ার লিঙ্কগুলো পোস্ট করেন, কেবল তখনই সেগুলো সার্চ রেজাল্টে দেখা যায় এবং এই URL-গুলো "অনুমান করা সম্ভব নয়" (not guessable)। একবার কোনো লিঙ্ক "প্রকাশ্যে চলে আসলে" (out in the wild), তা তৃতীয় পক্ষ দ্বারা আর্কাইভ করা হতে পারে।
Google-এর মুখপাত্র Ned Adriance-ও একই কথা বলেছেন যে, সাইট মালিকরা যদি স্পষ্টভাবে ক্রলিং ব্লক না করেন, তবে সার্চ ইঞ্জিন যা পায় তা ইনডেক্স করে। পরীক্ষা থেকে বোঝা গেছে যে এই তথ্যগুলো Google-এর ইনডেক্স থেকে সরিয়ে ফেলা হয়েছে, তবে গত বছরও একই ধরনের একটি ঘটনায় শত শত Claude চ্যাট ইনডেক্স করা হয়েছিল।
এআই (AI) ব্যবহারকারীদের জন্য এটি কেন গুরুত্বপূর্ণ
যারা LLM ইন্টিগ্রেট করছেন, সেই ডেভেলপার এবং ফাউন্ডারদের অবশ্যই "শেয়ার লিঙ্ক" গুলোকে পাবলিক বা প্রকাশ্য হিসেবে বিবেচনা করতে হবে, সুরক্ষিত হিসেবে নয়। AI টুলগুলো যখন ব্যক্তিগত সহকারী থেকে এন্টারপ্রাইজ সহযোগীতে রূপান্তরিত হচ্ছে, তখন পাবলিক ওয়েব কন্টেন্ট এবং ব্যক্তিগত তথ্যের মধ্যকার সীমারেখা কেবল একটি টুলটিপ (tooltip) সতর্কবার্তার মাধ্যমে নয়, বরং প্রযুক্তিগতভাবে কার্যকর করা প্রয়োজন।
মূল বিষয়সমূহ
- আপনার সেটিংস পরীক্ষা করুন: Claude-এ Settings → Privacy → Shared Chats-এ যান এবং যেকোনো সক্রিয় পাবলিক লিঙ্ক বাতিল করুন।
- শেয়ার লিঙ্কগুলোকে পাবলিক হিসেবে গণ্য করুন: ধরে নিন যে AI-জেনারেটেড যেকোনো লিঙ্ক সার্চ ইঞ্জিন দ্বারা ইনডেক্স করা হতে পারে।
- এন্টারপ্রাইজ সতর্কতা: মালিকানাধীন কোড বা সংবেদনশীল PII অনিচ্ছাকৃতভাবে ফাঁস রোধ করতে "শেয়ার" ফিচারের ক্ষেত্রে কঠোর নীতিমালা প্রয়োগ করুন।
Anthropic-এর Claude AI প্ল্যাটফর্মটি অনিচ্ছাকৃতভাবে ব্যক্তিগত চ্যাট এবং “Artifacts” প্রকাশ করে ফেলেছে কারণ Google এর শেয়ার-লিঙ্ক URL-গুলো ইনডেক্স করে ফেলেছে, যার ফলে সংবেদনশীল কথোপকথনগুলো অনুসন্ধানযোগ্য হয়ে উঠেছে। Reddit ব্যবহারকারীরা একটি সাইট-নির্দিষ্ট Google কুয়েরির মাধ্যমে এই লিকটি শনাক্ত করেছেন, যা ব্যক্তিগত, চিকিৎসা এবং কর্পোরেট তথ্য প্রকাশ করেছে।
তথ্য কীভাবে ফাঁস হলো
Claude-এর "share chat" ফিচারটি একটি URL তৈরি করে যা ইন্টারফেসটি সতর্ক করে যে যার কাছে এটি আছে সে এটি দেখতে পারে। এর উদ্দেশ্য হলো লিঙ্কটি কোনো সহকর্মীকে দেওয়া, এটি প্রচার করা নয়। যেহেতু URL-গুলো claude.ai/share ডোমেইনের অধীনে থাকে, তাই কোনো পাবলিকলি ক্রলযোগ্য সাইটে—ফোরাম, সোশ্যাল মিডিয়া বা Reddit কমেন্টে—লিঙ্কটি পোস্ট করলে Google-এর ক্রলার সেটি অনুসরণ করতে পারে।
Reddit ব্যবহারকারীরা Google-এ site:claude.ai/share লিখে সার্চ করে এই সমস্যাটি আবিষ্কার করেন, যা এমন সব কথোপকথন প্রদর্শন করেছিল যা ব্যক্তিগত থাকার কথা ছিল। Google Docs-এর মতো নয়, যার শেয়ার করা লিঙ্কগুলো ডিফল্টভাবে ইনডেক্সিং থেকে সুরক্ষিত থাকে, Claude-এর লিঙ্কগুলোতে সেই সুরক্ষা ছিল না, ফলে সার্চ ইঞ্জিন সেগুলো তালিকাভুক্ত করতে পেরেছে।
যা যা ফাঁস হয়েছে
একাধিক সংবাদমাধ্যম রিপোর্ট করেছে যে ইনডেক্স করা ফলাফলে যা ছিল:
- ব্যক্তিগতভাবে শনাক্তযোগ্য তথ্য (PII): প্রাথমিক বিদ্যালয়ের শিক্ষার্থীদের নাম এবং ফোন নম্বর।
- চিকিৎসা সংক্রান্ত নথি: বিস্তারিত ক্লিনিকাল-ট্রায়াল ডেটা এবং প্রকৃত রোগীর রিপোর্ট।
- কর্পোরেট তথ্য: "শুধুমাত্র অভ্যন্তরীণ ব্যবহারের জন্য" চিহ্নিত নথি, কর্মীদের পারফরম্যান্স রিভিউ এবং অন্যান্য মালিকানাধীন তথ্য।
- প্রযুক্তিগত সম্পদ: Claude-এর "Artifacts" ফিচারের মাধ্যমে তৈরি কোড স্নিপেট, কাজের নোট এবং অন্যান্য আর্টিফ্যাক্ট।
কিছু ক্ষেত্রে, জনসমক্ষে দৃশ্যমান চ্যাটগুলোতে এমন বিষয়বস্তুও ছিল যা Anthropic-এর সেফটি ফিল্টার এড়িয়ে গেছে এবং যৌনতাপূর্ণ বিষয়বস্তু তৈরি করেছে।
Anthropic-এর প্রতিক্রিয়া
Anthropic দাবি করে যে তারা সার্চ ইঞ্জিনের জন্য চ্যাট ডিরেক্টরি বা সাইটম্যাপ প্রকাশ করে না। কোম্পানির একজন মুখপাত্র ব্যাখ্যা করেছেন যে, শেয়ার করা লিঙ্কগুলো সার্চ রেজাল্টে তখনই দেখা যায় যখন কোনো ব্যবহারকারী একটি বাহ্যিক এবং ক্রলযোগ্য (crawlable) প্ল্যাটফর্মে সেই URL পোস্ট করেন, এবং তিনি জোর দিয়ে বলেন যে এই URLগুলো "অনুমান করা সম্ভব নয়"। একবার কোনো লিঙ্ক ইচ্ছাকৃতভাবে অনলাইনে শেয়ার করা হলে, কোম্পানি থার্ড-পার্টি আর্কাইভ করার বিষয়টি নিয়ন্ত্রণ করতে পারে না।
Google-এর অবস্থান
Google পুনরায় জানিয়েছে যে তারা কোন কন্টেন্ট পাবলিক হবে তা নির্ধারণ করে না; কোনো সাইট যদি স্পষ্টভাবে ক্রলিং ব্লক না করে, তবে তারা যা খুঁজে পায় তা ইনডেক্স করে। কোম্পানিটি বলেছে যে তারা robots.txt বা মেটা ট্যাগের মতো নির্দেশাবলী মেনে চলে যা বাদ দেওয়ার অনুরোধ জানায়। এই ঘটনার পর প্রাথমিক পরীক্ষাগুলোতে দেখা গেছে যে প্রকাশ হওয়া URLগুলো Google-এর ইনডেক্স থেকে সরিয়ে ফেলা হয়েছে, যদিও Google কোনো স্থায়ী সমাধানের কথা নিশ্চিত করেনি।
কেন এটি AI ব্যবহারকারীদের জন্য গুরুত্বপূর্ণ
এই ঘটনাটি একটি বৃহত্তর ঝুঁকির কথা তুলে ধরেছে কারণ লার্জ ল্যাঙ্গুয়েজ মডেলগুলো এখন ব্যক্তিগত সহকারী থেকে এন্টারপ্রাইজ ওয়ার্কফ্লোতে স্থানান্তরিত হচ্ছে। একটি "শেয়ারযোগ্য লিঙ্ক" হলো একটি সুবিধাজনক ব্যবস্থা যা যেকোনো ক্রলার সংগ্রহ করতে পারে। যেসব সংস্থা নিয়ন্ত্রিত ডেটা—যেমন স্বাস্থ্য রেকর্ড, কর্মচারীদের মূল্যায়ন, বা মালিকানাধীন কোড—হ্যান্ডেল করে, তাদের জন্য এই ধারণাটি যে একটি লিঙ্ক নিরাপদ কারণ এটি "শুধুমাত্র শেয়ার করা হয়েছে", তা মারাত্মক তথ্য ফাঁসের কারণ হতে পারে।
পাল্টা যুক্তি: প্ল্যাটফর্মের সীমাবদ্ধতা
Anthropic যুক্তি দেয় যে এর দায়ভার সেই ব্যবহারকারীদের ওপর বর্তায় যারা লিঙ্কটি প্রকাশ করেন। প্ল্যাটফর্মটি সতর্ক করে যে, যার কাছে URL আছে সে যে কেউ কন্টেন্টটি দেখতে পারে এবং তারা কোনো পাবলিক ডিরেক্টরিতে URL প্রকাশ করে না। Google এর পাল্টা জবাব দেয় যে, সামনে আসা প্রতিটি ব্যক্তিগত লিঙ্ক তারা নিয়ন্ত্রণ করতে পারে না; তাদের ভূমিকা হলো সার্চ রেজাল্ট থেকে দূরে থাকার জন্য সাইট মালিকদের অনুরোধ মেনে চলা।
উভয় অবস্থানই প্রযুক্তিগতভাবে সঠিক, তবুও এখানে একটি ফাঁক রয়ে গেছে: ইউজার এক্সপেরিয়েন্স ইনডেক্সিং ঝুঁকিটিকে স্পষ্ট করে তোলে না এবং প্ল্যাটফর্মটি শেয়ার করা পেজগুলোতে স্বয়ংক্রিয়ভাবে "no-index" নির্দেশাবলী প্রয়োগ করে না। ফলে, অনিচ্ছাকৃতভাবে তথ্য জনসমক্ষে প্রকাশ হওয়া রোধ করার দায়ভার ব্যবহারকারীদের ওপর পড়ে, যারা হয়তো বুঝতে পারেন না যে একটি সাধারণ সার্চ কোয়েরির মাধ্যমে কত সহজেই একটি লিঙ্ক খুঁজে পাওয়া সম্ভব।
পরবর্তীতে যা লক্ষ্য রাখতে হবে
ব্যবহারকারীদের জন্য ব্যবহারিক পদক্ষেপসমূহ
- সক্রিয় লিঙ্কগুলো অডিট করুন: Claude-এর সেটিংস খুলুন, শেয়ার করা চ্যাটের জন্য প্রাইভেসি সেকশনে যান এবং আপনার আর প্রয়োজন নেই এমন সব URL বাতিল করুন।
- প্রতিটি শেয়ার লিঙ্ককে পাবলিক হিসেবে গণ্য করুন: ধরে নিন যে একবার অনলাইনে কোথাও একটি লিঙ্ক পোস্ট করা হলে, সেটি স্পষ্টভাবে ব্লক না করা পর্যন্ত ইনডেক্স করা হতে পারে।
- এন্টারপ্রাইজ কন্ট্রোল: এমন মনিটরিং টুল ব্যবহার করুন যা "PII," "confidential," বা "internal"-এর মতো কিওয়ার্ড সম্বলিত শেয়ার লিঙ্ক তৈরির ক্ষেত্রে সতর্কবার্তা দেবে এবং এই ধরনের লিঙ্ক কর্পোরেট নেটওয়ার্ক থেকে বাইরে যাওয়ার আগে অনুমোদন প্রক্রিয়া নিশ্চিত করবে।
Claude-এর এই ঘটনাটি আমাদের মনে করিয়ে দেয় যে, তাৎক্ষণিক শেয়ার করার সুবিধাটি একটি ঝুঁকির কারণ হয়ে দাঁড়াতে পারে যখন ওয়েব সেই লিঙ্কগুলোকে সাধারণ পেজ হিসেবে গণ্য করে। যতক্ষণ না প্ল্যাটফর্মগুলো স্বয়ংক্রিয়ভাবে শেয়ার করা URL সুরক্ষিত করছে, ততক্ষণ ব্যবহারকারীদের সতর্ক থাকতে হবে।
