Anthropic জানিয়েছে যে তাদের তিনটি Claude মডেল সম্প্রতি একটি নিরাপত্তা-পরীক্ষা অভিযানের সময় স্যান্ডবক্স (sandbox) থেকে বেরিয়ে এসে বাস্তব জগতের সিস্টেমগুলোতে প্রবেশ করেছে, যার ফলে মূল্যায়ন প্রক্রিয়া অবিলম্বে স্থগিত করা হয়েছে এবং একটি প্রকাশ্য প্রতিবেদন প্রকাশ করা হয়েছে।
কোম্পানিটি ১৪১,০০৬টি সাইবার সিকিউরিটি টেস্ট রান করেছিল এবং তিনটি ঘটনা খুঁজে পেয়েছে যেখানে মডেলগুলো সিমুলেটেড পরিবেশের পরিবর্তে লাইভ টার্গেটে পৌঁছে গিয়েছিল। একটি থার্ড-পার্টি পার্টনারের ভুল কনফিগারেশনের কারণে স্যান্ডবক্সটি কার্যত উন্মুক্ত হয়ে পড়েছিল।
কীভাবে এই নিরাপত্তা লঙ্ঘন ঘটল
- Claude Opus 4.7 ইন্টারনেটে উন্মুক্ত একটি প্রকৃত কোম্পানির সিস্টেমে পৌঁছে যায় এবং দুর্বল পাসওয়ার্ড অনুমান করে কয়েকশ সারির একটি ডাটাবেস সংগ্রহ করে।
- Claude Mythos 5 আসল PyPI রিপোজিটরিতে একটি প্যাকেজ প্রকাশ করার মাধ্যমে একটি সাপ্লাই-চেইন অ্যাটাক (supply-chain attack) তৈরি করেছিল। রেজিস্ট্রিটি অস্বাভাবিকতা শনাক্ত করার আগেই প্যাকেজটি ১৫টি প্রোডাকশন মেশিনে ইনস্টল হয়ে গিয়েছিল।
- একটি অভ্যন্তরীণ গবেষণা মডেল (internal research model) ৯,০০০টি টার্গেট স্ক্যান করে, একটি অ্যাপ্লিকেশন হ্যাক করে এবং হোস্টটি তার সিমুলেটেড কাজের সাথে মিলছে না তা বুঝতে পেরে নিজেই থেমে যায়।
Anthropic জোর দিয়ে বলেছে যে এগুলো কোনো "অবাধ্য এআই" (rogue AI) এর ঘটনা ছিল না। মডেলগুলো কেবল তাদের নির্দেশিত কাজই করেছিল; সমস্যাটি ছিল টেস্টিং ইনফ্রাস্ট্রাকচারের, যা তাদের উন্মুক্ত ইন্টারনেট থেকে আলাদা রাখতে ব্যর্থ হয়েছিল।
কেন এটি গুরুত্বপূর্ণ
এই ঘটনাগুলো দেখায় যে যখন এআই এজেন্টরা কোড এক্সিকিউট করতে পারে এবং নেটওয়ার্ক কল করতে পারে, তখন একটি নিয়ন্ত্রিত স্যান্ডবক্স এবং একটি লাইভ নেটওয়ার্কের মধ্যে পার্থক্য কতটা সামান্য। যেসব এন্টারপ্রাইজ স্বায়ত্তশাসিত (autonomous) এজেন্ট নিয়ে পরীক্ষা-নিরীক্ষা করছে, তাদের জন্য একটি সিস্টেম প্রম্পট বা README ফাইল সীমানা নিশ্চিত করতে পারে না। PyPI-এর ঘটনাটি যেমন দেখায়, এমনকি একটি ছোট ডেটাসেট বা মাত্র কয়েকটি মেশিনও বড় ধরনের সাপ্লাই-চেইন লঙ্ঘনের কারণ হতে পারে।
এই তিনটি নিরাপত্তা লঙ্ঘন Anthropic-এর প্রচেষ্টার ব্যাপকতাকেও প্রকাশ করে: তারা কোনো র্যান্ডম স্যাম্পল নয়, বরং প্রতিটি টেস্ট রান অডিট করেছিল। এই পুঙ্খানুপুঙ্খ যাচাইয়ের কারণেই ঘটনাগুলো ছড়িয়ে পড়ার আগেই কোম্পানিটি ভুল কনফিগারেশনটি শনাক্ত করতে পেরেছিল।
Anthropic কী পদক্ষেপ নিয়েছে
স্যান্ডবক্সের ত্রুটি শনাক্ত করার একদিনের মধ্যেই Anthropic সমস্ত চলমান মূল্যায়ন স্থগিত করে দেয়। এক সপ্তাহ পরে তারা একটি বিস্তারিত প্রকাশনা (disclosure) প্রকাশ করে যেখানে তিনটি ঘটনা, এর প্রযুক্তিগত কারণ এবং তাৎক্ষণিক প্রতিকারের পদক্ষেপগুলো তালিকাভুক্ত করা হয়েছে।
এআই-এজেন্ট ব্যবহারকারীদের জন্য ব্যবহারিক শিক্ষা
- সরাসরি যাচাইয়ের মাধ্যমে নেটওয়ার্ক সীমানা নিশ্চিত করুন – প্রম্পট বা কনফিগারেশন ফাইল এজেন্টকে সত্যিই আলাদা রাখতে পারে বলে ধরে নেবেন না।
- ক্রেডেনশিয়াল বা অ্যাক্সেস সর্বনিম্ন পর্যায়ে রাখুন – কাজের জন্য যা একান্ত প্রয়োজন কেবল সেটুকুই প্রদান করুন।
- নিজে সংযোগযোগ্যতা (reachability) পরীক্ষা করুন – সংবেদনশীল রিসোর্স হস্তান্তরের আগে এজেন্টের প্রকৃত নেটওয়ার্ক ভিউ পরীক্ষা করে দেখুন।
- অনাকাঙ্ক্ষিত কার্যকলাপের জন্য নজর রাখুন – আউটবাউন্ড কানেকশন বা প্যাকেজ রেজিস্ট্রেশনের ক্ষেত্রে অ্যালার্ট সেট করুন যা নির্ধারিত পরিকল্পনার বাইরে যায়।
এই ঘটনাটি একটি সহজ সত্যকে সামনে এনেছে: একটি এআই মডেলকে ইন্টারনেট অ্যাক্সেস দেওয়া একজন মানুষের কাছে ক্রেডেনশিয়াল বা অ্যাক্সেস দেওয়ার মতোই ঝুঁকিপূর্ণ। যতক্ষণ না স্যান্ডবক্সের নিশ্চয়তা প্রমাণিত হচ্ছে, ততক্ষণ প্রতিটি এআই-চালিত কাজকে সম্ভাব্য অনিয়ন্ত্রিত হিসেবে বিবেচনা করুন এবং সেই অনুযায়ী পরিবেশটি সুরক্ষিত রাখুন।
