Anthropic তাদের সিস্টেম-প্রম্পট নির্দেশাবলীর ৮০% বাদ দিয়েছে এবং Opus 5 চালু করেছে, যা একটি নতুন Claude Code মডেল। এটি দিন বা সপ্তাহব্যাপী স্বয়ংক্রিয়ভাবে চলতে পারে এবং Arc AGI বেঞ্চমার্কে ৩০% স্কোর করেছে। এই "press-delete" রিডিজাইন, যাকে কোম্পানিটি একটি "unhobbling" কৌশল হিসেবে অভিহিত করেছে, এআই-এর প্রকৃত সক্ষমতাকে প্রকাশ করতে সাহায্য করে, যা সাধারণত বড় ল্যাঙ্গুয়েজ মডেলগুলোকে শুধুমাত্র চ্যাট মোডে সীমাবদ্ধ রাখে।
কেন এই পরিবর্তনটি গুরুত্বপূর্ণ
Anthropic-এর প্রকৌশলীরা আগে Claude-এর সাথে অনেকগুলো গার্ডরেল (guardrails) যুক্ত করে রাখতেন—অর্থাৎ এমন কিছু সুনির্দিষ্ট প্রম্পট যা মডেলটিকে বলে দেয় কী বলতে হবে, কী বলা যাবে না এবং কীভাবে নির্দিষ্ট কাজে মনোনিবেশ করতে হবে। এই প্রম্পটগুলো একটি শিকলের মতো কাজ করে, যা মডেলটিকে পরীক্ষা না করা কোনো আচরণের দিকে যেতে বাধা দেয়, কিন্তু একই সাথে এর কাজের ক্ষমতাকেও সীমিত করে ফেলে। যখন Opus 5 এলো, দলটি পুরো প্রম্পট স্ট্যাকটি মুছে ফেলে এবং তারপর একে একে নির্দেশাবলী পুনরায় যোগ করতে থাকে, প্রতিটি নির্দেশনার প্রভাব পরিমাপ করে। যেহেতু নতুন মডেলটি অনেক বেশি সক্ষম, তাই তারা মূল নির্দেশাবলীর বেশিরভাগ অংশ বাদ দিয়েও নির্ভরযোগ্য ফলাফল পেয়েছেন। সিস্টেমটি এখন উচ্চ-স্তরের লক্ষ্য বুঝতে পারে এবং সম্পূর্ণ ফাইল ও ফিচার তৈরি করতে পারে।
প্রযুক্তিগত সাফল্য
- বেঞ্চমার্কে বড় লাফ – Opus 5 Arc AGI বেঞ্চমার্কে ৩০% স্কোর করেছে, যা একটি মডেলের নতুন সমস্যা সমাধানের ক্ষমতা পরিমাপ করে। এর আগের Claude সংস্করণগুলোর স্কোর এর চেয়ে অনেক কম ছিল, যা এর মৌলিক যুক্তিবোধের (reasoning power) ব্যাপক উন্নতি নির্দেশ করে।
- দীর্ঘস্থায়ী স্বায়ত্তশাসন – "Auto Mode" ফিচারটি মডেলটিকে দীর্ঘ সময় ধরে কাজ করার সুযোগ দেয়, যা নিজস্ব কনটেক্সট বজায় রেখে মানুষের ক্রমাগত হস্তক্ষেপ ছাড়াই কাজ চালিয়ে যেতে পারে। বাস্তবে, একজন ডেভেলপার মডেলটিকে একটি স্পেসিফিকেশন দিয়ে কয়েক দিন ধরে কাজ করতে ছেড়ে দিতে পারেন এবং কেবল কোনো মাইলফলক অর্জিত হলেই তা পরীক্ষা করতে পারেন।
- প্রম্পট ইনজেকশন প্রতিরোধে সক্ষমতা – প্রম্পট ইনজেকশন হলো ব্যবহারকারীর ইনপুটে ক্ষতিকারক নির্দেশাবলী ঢুকিয়ে মডেলটিকে তার নিরাপত্তা নিয়মগুলো উপেক্ষা করতে বাধ্য করার একটি কৌশল। Anthropic জানিয়েছে যে, অভ্যন্তরীণ গবেষণা এবং বিশেষায়িত ক্লাসিফায়ারের (classifiers) মাধ্যমে সন্দেহজনক প্যাটার্ন শনাক্ত করার ক্ষমতার কারণে Opus 5 তার পূর্ববর্তী সংস্করণগুলোর তুলনায় এই আক্রমণ আরও ভালোভাবে প্রতিরোধ করতে পারে। তারা লঞ্চ করার আগে 'exit criteria' এবং গার্ডরেল নির্ধারণ করার পরামর্শও দিয়েছেন।
ডেভেলপার এবং এন্টারপ্রাইজগুলোর জন্য গুরুত্ব
এআই-চালিত টুল তৈরি করা স্টার্টআপগুলোর জন্য এই পরিবর্তনটি "product overhang"-এর ব্যবধান বাড়িয়ে দেয়—অর্থাৎ একটি মডেল কী করতে পারে এবং আশেপাশের সফটওয়্যার তাকে কী করতে অনুমতি দেয়, তার মধ্যকার পার্থক্য। এই বাধা দূর করার মাধ্যমে, Claude Code একটি সাধারণ চ্যাট ইন্টারফেসকে একটি ফুল-স্ট্যাক ডেভেলপমেন্ট অ্যাসিস্ট্যান্টে পরিণত করতে পারে, যা স্বয়ংক্রিয়ভাবে কোড লেখা, পরীক্ষা করা এবং রিফ্যাক্টর (refactor) করতে সক্ষম। যেসব এন্টারপ্রাইজ এই মডেলটি গ্রহণ করবে, তারা পুনরাবৃত্তিমূলক কোডিং কাজে ব্যয়িত সময় কমিয়ে আনতে পারবে, ফলে প্রকৌশলীরা উচ্চ-স্তরের ডিজাইনের কাজে মনোনিবেশ করতে পারবেন।
"unhobbling" বলতে আসলে কী বোঝায়
সক্ষম একটি মডেলকে কৃত্রিম সীমাবদ্ধতা থেকে মুক্ত করা বোঝাতে Cherny "unhobbling" শব্দটি ব্যবহার করেছেন। অনেক এআই পণ্যে, ডেভেলপাররা ইচ্ছাকৃতভাবে মডেলের কাজের পরিধি সীমিত করে রাখেন কারণ ইউজার ইন্টারফেস (UI) বা পলিসি ফ্রেমওয়ার্ক মডেলটির পূর্ণ সক্ষমতা ব্যবহারের জন্য প্রস্তুত থাকে না। এর ফলে একটি "product overhang" তৈরি হয় যেখানে এআই তার অব্যবহৃত সম্ভাবনার স্তরে আটকে থাকে। Claude Code সেই সম্ভাবনাকে বাস্তবে রূপ দেয়, যা মডেলটিকে কেবল একটি প্রশ্ন-উত্তর প্রদানকারী বট হিসেবে নয়, বরং সফটওয়্যারের একজন সহ-লেখক (co-author) হিসেবে কাজ করার সুযোগ দেয়।
প্রতিষ্ঠাতা এবং শিক্ষার্থীদের জন্য পরামর্শ
- overhang চিহ্নিত করুন – এমন কাজগুলো খুঁজুন যেখানে বর্তমান এআই টুলগুলো তাদের সীমার ঠিক বাইরে গিয়ে হোঁচট খায়। এগুলোই হলো সহজ সুযোগ (low-hanging fruits), যেখানে "unhobbling" পদ্ধতি প্রয়োগ করলে অসাধারণ ফলাফল পাওয়া সম্ভব।
- মডেলের ক্ষমতা যাচাই করুন – এআই-কে এমন কাজ দিন যা তার বিজ্ঞাপিত ক্ষমতার সামান্য বাইরে বলে মনে হয়। প্রম্পটের বাধা বা ঘর্ষণ (friction) কমিয়ে দিলে মডেলটির অভ্যন্তরীণ যুক্তি বা reasoning আপনাকে অবাক করে দিতে পারে।
- সুস্পষ্ট গার্ডরেল নির্ধারণ করুন – মডেলটিকে তদারকিহীনভাবে চালানোর আগে, এর সমাপ্তির শর্তাবলী (যেমন: সর্বোচ্চ রানটাইম, রিসোর্স ক্যাপ) এবং নিরাপত্তা পরীক্ষাগুলো নির্ধারণ করে দিন। এটি ঝুঁকি নিয়ন্ত্রণে রেখে এআই-কে অন্বেষণ করার সুযোগ দেয়।
শিক্ষার্থীদের তাত্ত্বিক জ্ঞানের সাথে ব্যবহারিক প্রয়োগের সমন্বয় ঘটাতে হবে। অ্যালগরিদম আয়ত্ত করা মূল্যবান, তবে সেই জ্ঞানের সাথে প্রোডাক্ট থিংকিং এবং ডেটা-চালিত পরীক্ষামূলক পদ্ধতির সমন্বয় ঘটানোই পরবর্তী প্রজন্মের এআই-ফার্স্ট বিল্ডারদের তৈরি করবে।
পরবর্তীতে যা লক্ষ্য রাখতে হবে
সারকথা: সিস্টেম প্রম্পটের বেশিরভাগ অংশ মুছে ফেলে, Anthropic একটি বুদ্ধিমান মডেলকে অনেক কম নির্দেশনার মাধ্যমে কাজ করার সুযোগ দিয়েছে, যা Claude Code-কে একটি স্বয়ংক্রিয় কোডার হিসেবে রূপান্তরিত করেছে যা কয়েক সপ্তাহব্যাপী প্রজেক্ট সম্পন্ন করতে সক্ষম।
