ব্রাউজার প্রম্পট ইনজেকশনে Anthropic-এর Opus 5 শূন্য শতাংশ সাফল্যের হার অর্জন করেছে

Opus 5 রিলিজের মাধ্যমে Anthropic AI নিরাপত্তায় একটি যুগান্তকারী সাফল্য অর্জন করেছে, যা সম্ভবত স্বায়ত্তশাসিত এজেন্টদের (autonomous agents) অন্যতম দীর্ঘস্থায়ী দুর্বলতা দূর করতে সক্ষম। একটি দ্বি-স্তরীয় প্রতিরক্ষা ব্যবস্থা (dual-layer defense system) প্রয়োগের মাধ্যমে, মডেলটি ব্রাউজার-ভিত্তিক প্রম্পট ইনজেকশন আক্রমণের বিরুদ্ধে প্রায় সম্পূর্ণ প্রতিরোধ ক্ষমতা প্রদর্শন করেছে।

AI এজেন্টদের মধ্যে প্রম্পট ইনজেকশন সংকট

প্রম্পট ইনজেকশন বর্তমান AI যুগের "Achilles' heel" বা অত্যন্ত দুর্বল দিক হিসেবে রয়ে গেছে। এই দুর্বলতাটি তখন ঘটে যখন একজন আক্রমণকারী একটি ওয়েবপেজের মধ্যে ক্ষতিকারক নির্দেশাবলী লুকিয়ে রাখে—প্রায়শই অদৃশ্য টেক্সটের মাধ্যমে—যা একটি AI এজেন্ট ব্রাউজ করার সময় পড়ে ফেলে। একবার প্রসেস হয়ে গেলে, এই নির্দেশাবলী মডেলটিকে হাইজ্যাক করতে পারে, যা মডেলটিকে নিরাপত্তা প্রোটোকল লঙ্ঘন করতে বা অননুমোদিত কাজ করতে বাধ্য করে। যদিও OpenAI-এর মতো শিল্প নেতৃবৃন্দ আগে পরামর্শ দিয়েছিলেন যে প্রম্পট ইনজেকশন LLM-এর একটি সমাধান অযোগ্য সহজাত ত্রুটি হতে পারে, Anthropic-এর সাম্প্রতিক তথ্য সেই হতাশাজনক দৃষ্টিভঙ্গিকে চ্যালেঞ্জ জানাচ্ছে।

শূন্য শতাংশ বেঞ্চমার্ক অর্জন

Anthropic-এর সিস্টেম কার্ড অনুযায়ী, ব্রাউজার এজেন্টদের জন্য বিশেষভাবে ডিজাইন করা ১২৯টি ভিন্ন ভিন্ন টেস্ট সিনারিওতে Opus 5 বিস্ময়কর ০% আক্রমণের সাফল্যের হার অর্জন করেছে। এটি পূর্ববর্তী সংস্করণগুলোর তুলনায় একটি উল্লেখযোগ্য অগ্রগতি। নিরাপত্তা সংস্থা Gray Swan দ্বারা পরিচালিত সাধারণ প্রম্পট ইনজেকশন পরীক্ষায়, Opus 5 তার পূর্বসূরীর তুলনায় নাটকীয় উন্নতি দেখিয়েছে; ১৫টি প্রচেষ্টার পর, আক্রমণকারীর সাফল্যের হার ৫.৫% (Opus 4.8-এ দেখা গেছে) থেকে কমে মাত্র ২.০% এ নেমে এসেছে।

এই পারফরম্যান্স Opus 5-কে Gray Swan IPI বেঞ্চমার্কে শীর্ষে স্থান দিয়েছে, যা Mythos 5 (২.৬%) এবং Fable 5 (২.৮%)-এর মতো অন্যান্য উচ্চ-স্তরের মডেলগুলোকে ছাড়িয়ে গেছে।

মূল রহস্য: Auto Mode এবং দ্বি-স্তরীয় প্রতিরক্ষা

এই সাফল্য শুধুমাত্র মডেলের বুদ্ধিমত্তার কারণে নয়, বরং বিশেষায়িত সফটওয়্যারের সাথে এর সমন্বয়ের কারণে। "শূন্য শতাংশ" সাফল্যের হারটি বিশেষভাবে Claude Cowork-এর মতো পণ্যগুলোতে Auto Mode ব্যবহারের সাথে যুক্ত। এজেন্টটিকে সুরক্ষিত করতে Anthropic একটি অত্যাধুনিক দ্বি-স্তরীয় প্রতিরক্ষা আর্কিটেকচার ব্যবহার করে:

  1. Pre-processing Scan: একটি ডেডিকেটেড লেয়ার প্রাথমিক LLM টেক্সটটি প্রসেস করার আগেই সমস্ত ইনকামিং ডেটা থেকে লুকানো বা কারসাজি করা নির্দেশাবলী স্ক্যান করে।
  2. Execution Blocking: একটি সেকেন্ডারি লেয়ার এজেন্টের পরিকল্পিত কাজগুলো পর্যবেক্ষণ করে এবং ব্রাউজার এনভায়রনমেন্টে কোনো বিপজ্জনক কমান্ড কার্যকর হওয়ার আগেই তা ব্লক করে দেয়।

মজার বিষয় হলো, তথ্য থেকে দেখা যায় যে শুধুমাত্র মডেলটি কোনো জাদুকরী সমাধান (silver bullet) নয়। এই সুরক্ষা সফটওয়্যার লেয়ারগুলো ছাড়া Opus 5-এর দুর্বলতার হার ৩.৭%। প্রকৃতপক্ষে, বিশেষায়িত Sonnet 5 মডেলটি বিচ্ছিন্নভাবে ০.৯৩% সাফল্যের হার নিয়ে কিছুটা ভালো পারফর্ম করে। মূল মডেল এবং ডিফেন্সিভ সফটওয়্যার স্ট্যাকের মধ্যকার সমন্বয়ই নিরাপত্তার স্তরকে প্রায় নিখুঁত পর্যায়ে নিয়ে গেছে।

কেন এটি AI-এর ভবিষ্যতের জন্য গুরুত্বপূর্ণ

যারা স্বায়ত্তশাসিত AI এজেন্ট তৈরি করছেন সেই সকল ডেভেলপার এবং ফাউন্ডারদের জন্য এই অগ্রগতি একটি প্যারাডাইম শিফট বা আমূল পরিবর্তন। যদি প্রম্পট ইনজেকশনকে শুধুমাত্র মডেল ট্রেনিংয়ের পরিবর্তে আর্কিটেকচারাল লেয়ারের মাধ্যমে প্রশমিত করা যায়, তবে নির্ভরযোগ্য, "agentic" ওয়ার্কফ্লো—যেখানে AI ইমেল, ব্রাউজার এবং সংবেদনশীল ডেটা পরিচালনা করে—অনেক বেশি নিরাপদ হয়ে উঠবে। শিল্পটি কীভাবে "অসমাধানযোগ্য" ধারণা থেকে বেরিয়ে এসে শক্তিশালী এবং প্রোডাকশন-রেডি AI স্বায়ত্তশাসনের দিকে এগোতে পারে, তার একটি ব্লুপ্রিন্ট প্রদান করেছে Anthropic।

মূল বিষয়সমূহ

  • শিল্প-নেতৃত্বকারী নিরাপত্তা: Auto Mode ব্যবহার করার সময় ১২৯টি ব্রাউজার-ভিত্তিক প্রম্পট ইনজেকশন সিনারিওতে Opus 5 ০% সাফল্যের হার অর্জন করেছে।
  • Defense-in-Depth: প্রাক-প্রক্রিয়াকরণ (pre-processing) ডেটা স্ক্যান এবং সক্রিয়ভাবে অ্যাকশন ব্লকিংয়ের মাধ্যমে এই নিরাপত্তা নিশ্চিত করা হয়েছে।
  • বেঞ্চমার্কে আধিপত্য: Opus 5 Gray Swan IPI বেঞ্চমার্কে শীর্ষে রয়েছে, যা পূর্ববর্তী মডেল সংস্করণগুলোর তুলনায় আক্রমণকারীর সাফল্যের হার উল্লেখযোগ্যভাবে হ্রাস করেছে।