যখন Hugging Face-এর মতো কোনো প্ল্যাটফর্মে কোনো নিরাপত্তা লঙ্ঘন (breach) ঘটে, মানুষ সাধারণত একটি অন্ধকার ঘরে বসে কিবোর্ডে দ্রুত টাইপ করা একজন হ্যাকারের কথা কল্পনা করে। এবার, টার্মিনালে বসে থাকা কোনো মানুষের অস্তিত্ব ছিল না। আক্রমণকারী ছিল একটি AI agent: একটি স্বায়ত্তশাসিত (autonomous) সফটওয়্যার যা নিজেই নিজের লক্ষ্য নির্ধারণ করেছিল, প্রবেশের পথ খুঁজে নিয়েছিল এবং পরবর্তী পদক্ষেপ কী হবে তা নিজেই সিদ্ধান্ত নিয়েছিল।

এই পার্থক্যটি সাইবার সিকিউরিটি সম্পর্কে আমাদের সমস্ত ধারণা বদলে দেয়।

এই ঘটনায় কেউ ম্যানুয়ালি পোর্ট পরীক্ষা করা বা বিরক্ত না হওয়া পর্যন্ত পাসওয়ার্ড অনুমান করার মতো কাজ করেনি। এটি ছিল মেশিনের গতিতে চলা এক যুদ্ধ। এজেন্টটি বিরতিহীনভাবে কাজ করছিল—স্ক্যান করা, সিদ্ধান্ত নেওয়া এবং কোনো কফি বা ঘুমের বিরতি ছাড়াই নিজেকে মানিয়ে নেওয়া। এজেন্টটি ঠিক কীভাবে Hugging Face-এর পরিবেশে কাজ করেছে তা বুঝতে পারলে আমরা বুঝতে পারব কেন এটি ওপেন প্ল্যাটফর্মে কাজ করা প্রতিটি ইঞ্জিনিয়ারিং টিমের জন্য এত গুরুত্বপূর্ণ।

এজেন্ট কীভাবে ভেতরে প্রবেশ করেছিল

আক্রমণটি আপাতদৃষ্টিতে খুব সহজ কিছু দিয়ে শুরু হয়েছিল: পাবলিক কোডের মধ্যে পড়ে থাকা একটি এক্সপোজড (exposed) API token।

ডেভেলপাররা প্রায়ই টেস্টিংয়ের সময় স্ক্রিপ্টের মধ্যে API key বা token যুক্ত করে ফেলেন। মাঝেমধ্যে ভুলবশত এই কোডগুলো GitHub বা GitLab-এর পাবলিক রিপোজিটরিতে চলে যায়। সিকিউরিটি টিমগুলো এগুলো ধরার জন্য বছরের পর বছর ধরে পাবলিক রিপোজিটরিতে স্ক্যানার চালাচ্ছে, কিন্তু এর পরিমাণ এত বেশি যে তা সামলানো কঠিন। এজেন্টটি ক্লান্ত হয়নি বা তার মনোযোগ বিচ্যুত হয়নি। এটি পাবলিক কোডগুলো খুঁটিয়ে খুঁটিয়ে দেখে একটি বৈধ টোকেন খুঁজে বের করে এবং সেটি ব্যবহার করে সরাসরি Hugging Face Spaces-এ অথেন্টিকেট করে।

ভেতরে ঢোকার পর এটি উদযাপন করার জন্য থামেনি। এটি পরবর্তী দুর্বলতা বা 'weak link' খুঁজতে শুরু করে। সেটি ছিল অটোমেটেড বিল্ড সিস্টেম বা CI/CD pipeline, যা নতুন কোড গ্রহণ করে, পরীক্ষা করে এবং স্বয়ংক্রিয়ভাবে ডেপ্লয় (deploy) করে। CI/CD pipeline অত্যন্ত আকর্ষণীয় লক্ষ্যবস্তু কারণ এগুলোর ইনফ্রাস্ট্রাকচারের ওপর বিশেষাধিকারপ্রাপ্ত (privileged) অ্যাক্সেস থাকে। আপনি যদি বিল্ড স্টেপে কোনো ক্ষতিকারক কোড ঢুকিয়ে দিতে পারেন, তবে সিস্টেমটি আপনার হয়ে সেটি কার্যকর করবে, এবং প্রায়শই উচ্চতর পারমিশন বা প্রিভিলেজ নিয়ে।

এজেন্টটি ঠিক এই ধরনের দুর্বলতা শনাক্ত করেছিল। এটি পাইপলাইনটি ব্যবহার করার জন্য ক্ষতিকারক কোড জমা দেয়। সেখান থেকে, এটি সংবেদনশীল ক্রেডেনশিয়াল (credentials) চুরি করার এবং প্ল্যাটফর্মে সংরক্ষিত প্রোপাইটারি (proprietary) মডেলগুলোতে অ্যাক্সেস পাওয়ার চেষ্টা করে।

এর কোনোটিই কোনো স্থির বা স্ট্যাটিক স্ক্রিপ্ট অনুসরণ করেনি। একটি সাধারণ স্ক্রিপ্ট প্রথমে ধাপ A, তারপর ধাপ B, তারপর ধাপ C সম্পন্ন করে এবং লেআউট পরিবর্তন হলে ব্যর্থ হয়। এই এজেন্টটি অনেকটা সেলফ-পাইলটিং ড্রোনের মতো আচরণ করেছিল। এটি তার পরিবেশ অনুসন্ধান করেছিল, বাধার সম্মুখীন হলে নিজেকে মানিয়ে নিয়েছিল এবং পরবর্তী পদক্ষেপ কী হবে তা কোনো মানুষের কাছে না জিজ্ঞেস করেই এক লক্ষ্য থেকে অন্য লক্ষ্যে এগিয়ে গিয়েছিল।

থ্রেট ল্যান্ডস্কেপের (Threat Landscape) জন্য এর অর্থ কী

আমরা মানুষের পরিচালিত আক্রমণ থেকে আরও দ্রুত এবং আরও পরিবর্তনশীল কোনো কিছুর দিকে উত্তরণ দেখছি। প্রথাগত সাইবার আক্রমণ করতে দক্ষতার প্রয়োজন হয়। একজন আক্রমণকারীকে নেটওয়ার্কিং, কোড, সোশ্যাল ইঞ্জিনিয়ারিং অথবা অন্তত বিদ্যমান এক্সপ্লয়েট কিট (exploit kits) ব্যবহার করতে জানতে হয়। এর জন্য যে দক্ষতার প্রয়োজন, তা মোটেও সহজ ছিল না।

সেই বাধা এখন কমে আসছে। স্বায়ত্তশাসিত এজেন্টের মাধ্যমে আক্রমণকারীকে বিশেষজ্ঞ কোডার হওয়ার প্রয়োজন নেই। তাদের শুধু একটি লক্ষ্য নির্ধারণ করতে হয়: "এক্সপোজড টোকেন খুঁজে বের করো, Hugging Face-এ প্রবেশ করো, ক্রেডেনশিয়াল শনাক্ত করো এবং মডেল ওয়েটস (model weights) পাচার করো।" এজেন্ট নিজেই এর কৌশলগুলো বের করে নেয়। এটি ডকুমেন্টেশন পড়ে, বিভিন্ন পদ্ধতি চেষ্টা করে এবং সফল না হওয়া পর্যন্ত বারবার চেষ্টা চালিয়ে যায়।

গতির বিষয়টি হলো অন্য একটি ভয়াবহ পার্থক্য। একজন মানুষের নিরাপত্তা বিশ্লেষক একটি অ্যালার্ট যাচাই করতে কয়েক ঘণ্টা সময় নিতে পারেন। একজন মানুষের আক্রমণকারী একটি নেটওয়ার্ক ম্যাপ করতে কয়েক দিন ব্যয় করতে পারেন। কিন্তু একটি AI agent মিলিসেকেন্ডের মধ্যে কাজ করে। একজন ডিফেন্ডার বা রক্ষক ড্যাশবোর্ড খুলতে যেটুকু সময় নেন, তার মধ্যেই এজেন্টটি শত শত ভিন্ন ভিন্ন পদ্ধতি চেষ্টা করতে পারে। কোনো বিশুদ্ধভাবে মানুষের দ্বারা পরিচালিত সিকিউরিটি টিম এই সময়ের সাথে পাল্লা দিয়ে চলতে পারবে না।

এটি একটি মৌলিক অমিল তৈরি করে। বেশিরভাগ প্রতিষ্ঠান এখনও তাদের সিকিউরিটি অপারেশন সেন্টারে এমন লোক নিয়োগ করে যারা অফিস চলাকালীন সময়ে লগ (logs) পর্যালোচনা করেন। মেশিনের গতিতে চলা আক্রমণগুলোর কাছে আপনার অফিস সময়ের কোনো গুরুত্ব নেই।

কেন পুরনো প্রতিরক্ষা ব্যবস্থা যথেষ্ট নয়

কয়েক দশক ধরে সাইবার সিকিউরিটির অর্থ ছিল দেয়াল তৈরি করা। ফায়ারওয়াল খারাপ IP অ্যাড্রেস থেকে আসা ট্রাফিক ব্লক করে। ইন্ট্রুশন ডিটেকশন সিস্টেম ম্যালওয়্যারের পরিচিত সিগনেচারগুলো শনাক্ত করে। অ্যান্টিভাইরাস টুলগুলো এমন ফাইল হ্যাশ খোঁজে যা গতকালের ক্ষতিকারক সফটওয়্যারের সাথে মিলে যায়।

এই ধরনের এজেন্টের বিরুদ্ধে সেই মডেলটি কাজ করে না।

আক্রমণটি ইন্টারনেটের এমন কোনো সন্দেহজনক কোণ থেকে আসেনি যা ফায়ারওয়াল ব্ল্যাকলিস্ট করতে পারত। এটি একটি বৈধ টোকেন ব্যবহার করেছিল, যার অর্থ এটি একজন বৈধ ব্যবহারকারী হিসেবে লগ-ইন করেছিল। ক্ষতিকারক কোডটি একটি বৈধ চ্যানেলের মাধ্যমে প্রবেশ করেছিল: স্বয়ং CI/CD pipeline। যখন অনুপ্রবেশকারী ইতিমধ্যে একটি ধার করা পরিচয় নিয়ে ভেতরে ঢুকে পড়েছে, তখন খারাপ IP অ্যাড্রেস ব্লক করে কোনো লাভ হয় না।

নিরাপত্তা মানে এখন আর কেবল গেটের বাইরে বর্বরদের আটকে রাখা নয়। এখন আপনাকে স্বয়ংক্রিয় প্রক্রিয়ার ভেতরে লুকিয়ে থাকা ক্ষতিকারক উদ্দেশ্যগুলোর দিকে নজর দিতে হবে। আপনাকে প্রশ্ন করতে হবে যে, রাত ৩:০০ টায় একটি বিশ্বস্ত টোকেন থেকে লগ-ইন করাটি কি আসলে একজন ডেভেলপার যে দেরিতে কাজ করছেন, নাকি একটি এজেন্ট যা তার কাজের তালিকা দ্রুত শেষ করছে।