প্রায় দুই বছর আগে প্রথম চ্যাটবট ড্রাফটটি একজন শিক্ষকের ইনবক্সে এসেছিল, এবং তারপর থেকে পরিস্থিতি আরও দ্রুততর হয়েছে। একজন শিক্ষার্থী এখন ChatGPT-কে গ্রেট ডিপ্রেশনের কারণ বা The Great Gatsby-এর প্রতীকী অর্থ নিয়ে পাঁচটি অনুচ্ছেদ তৈরি করতে বলতে পারে এবং একটি পেন্সিল শার্প করতে যে সময়ের প্রয়োজন তার চেয়েও কম সময়ে একটি সুসংগত উত্তর পেয়ে যায়। শিক্ষাবিদদের জন্য, এটি একাডেমিক সততার প্রকৃতি বদলে দিয়েছে। তারা এখন আর কেবল প্রথাগত প্লেজিয়ারিজম (plagiarism) বা চৌর্যবৃত্তি খুঁজছেন না, যেখানে একজন মানুষ অন্য মানুষের কাজ নকল করে। তারা সিন্থেটিক গদ্যও (synthetic prose) খুঁজছেন—এমন লেখা যা মানুষের মতো শোনায় কিন্তু কোনো বোধগম্যতা, স্মৃতি বা যুক্তির প্রতি কোনো দায়বদ্ধতা ছাড়াই একটি মডেল দ্বারা তৈরি করা হয়েছে।

যখন কণ্ঠস্বর হঠাৎ বদলে যায়

শিক্ষকরা প্রতি সেমিস্টারে শত শত শিক্ষার্থীর প্রবন্ধ পড়েন। সময়ের সাথে সাথে, তারা প্রতিটি শিক্ষার্থীর লেখার নিজস্ব ছন্দ বা শৈলী চিনে ফেলেন। তারা অভ্যাসবশত কমা ব্যবহারের ধরন, প্রিয় কিছু শব্দ বা বাক্যাংশ, এমনকি একজন নির্দিষ্ট শিক্ষার্থী কীভাবে একটি উপসংহার সাজায় তাও লক্ষ্য করেন। যখন এমন কোনো লেখা আসে যা তাদের প্রত্যাশিত শৈলীর সাথে মোটেও মেলে না, তখন সেটি আরও নিবিড়ভাবে পর্যালোচনার প্রয়োজন তৈরি করে।

এটি উন্নতির জন্য শাস্তি দেওয়ার বিষয় নয়। ভালো শিক্ষকরা শিক্ষার্থীদের উন্নতি দেখতেই ভালোবাসেন। কিন্তু একজন শিক্ষার্থী যে ধাপে ধাপে তার বাক্যগঠন উন্নত করেছে এবং এমন একজন শিক্ষার্থীর মধ্যে পার্থক্য আছে, যে আট মাস ধরে অগোছালো ও সহজ বাক্য লেখার পর হঠাৎ এমন একটি প্রবন্ধ জমা দেয় যা একটি মার্জিত আইনি দলিলে (legal brief)-র মতো শোনায়। গদ্যটি নিখুঁত হতে পারে, তবুও এটি ধার করা বলে মনে হয় কারণ এতে অনুশীলনের ছাপ বা বিবর্তনের ইতিহাস নেই। পরিশীলিত বা উন্নত মানের এই আকস্মিক ও ভিত্তিহীন লাফটিই প্রায়শই প্রথম সূত্র হয়ে দাঁড়ায়।

পেশাদারী উপরিভাগ, অন্তঃসারশূন্য কেন্দ্র

AI-জেনারেটেড লেখাগুলো সঠিকতার একটি অদ্ভুত বা 'uncanny valley' তৈরি করে। ব্যাকরণ সঠিক থাকে। বাক্যগুলোর মধ্যে সংযোগ থাকে। তবুও লেখাটি বিষয়বস্তুর গভীরে না গিয়ে কেবল উপরিভাগে ভেসে থাকে। শিক্ষকরা প্রায়শই এই গুণটিকে "পেশাদারী কিন্তু সাধারণ" (professionally generic) হিসেবে বর্ণনা করেন।

Romeo and Juliet-এর ওপর একটি প্রবন্ধের কথা ভাবুন। একজন শিক্ষার্থী হয়তো মারকুসিওর (Mercutio) গৌণ ভূমিকার ওপর গুরুত্ব দিতে পারে, কোনো একটি দৃশ্যকে মজার কোনো উপায়ে ভুলভাবে ব্যাখ্যা করতে পারে, অথবা পারিবারিক বিবাদকে তার নিজের সম্প্রদায়ের কোনো সংঘাতের সাথে তুলনা করতে পারে। তার মূল বক্তব্য (thesis) অগোছালো হতে পারে, কিন্তু এটি নিঃসন্দেহে পাঠ্যের সাথে লড়াই করা একটি একক মনের সৃষ্টি। বিপরীতে, একটি AI ড্রাফট প্রায়শই কাহিনীটি নির্ভুলভাবে সংক্ষেপ করে, তিনটি সার্বজনীন থিম বা বিষয় তালিকাভুক্ত করে এবং উপসংহারে বলে যে ভালোবাসার জন্য আত্মত্যাগ প্রয়োজন। এটি সঠিক। কিন্তু এটি অন্তঃসারশূন্য। কোনো ঝুঁকি না নেওয়া—যেমন কোনো অদ্ভুত মতামত বা ত্রুটিপূর্ণ কিন্তু খাঁটি অন্তর্দৃষ্টির অভাব—এটি একটি নির্ভরযোগ্য নির্দেশক যে লেখক শিক্ষার্থী নিজে নয়।

লক্ষ্যহীন তথ্যসূত্র

আরেকটি সতর্কবার্তা হলো কাল্পনিক বা 'hallucinated' সাইটেশন (citation)। ChatGPT এবং এই ধরনের টুলগুলো মাঝে মাঝে বই, জার্নাল আর্টিকেল এমনকি লেখকের নামও বানিয়ে ফেলে। এন্ট্রিগুলো দেখতে বিশ্বাসযোগ্য মনে হয়—একাডেমিক ধাঁচের শিরোনাম, প্রকাশকের নাম এবং প্রকাশের বছরসহ—কিন্তু বাস্তবে সেগুলোর কোনো অস্তিত্ব নেই।

অভিজ্ঞ শিক্ষকরা উৎস যাচাই করেন। তারা শিরোনামগুলো Google Scholar-এ খোঁজেন, ক্যাম্পাসের লাইব্রেরি ডেটাবেসে সার্চ করেন অথবা কেবল একটি সার্চ ইঞ্জিনে লেখকের নাম লিখে খোঁজেন। যখন প্রতিটি সাইটেশন কোনো ফলাফল ছাড়াই শেষ হয়ে যায়, তখন প্রবন্ধটির গ্রহণযোগ্যতা ধসে পড়ে। গ্রন্থপঞ্জি (bibliography) যাচাই করা সবসময়ই গবেষণার একটি গুরুত্বপূর্ণ অংশ ছিল, কিন্তু এখন ছোট বিশ্লেষণধর্মী প্রবন্ধের ক্ষেত্রেও এটি একটি সাধারণ চর্চায় পরিণত হচ্ছে। 'works-cited' পৃষ্ঠাটি এখন আর কেবল ফরম্যাটিং করার বিষয় নয়; এটি এখন সততা যাচাইয়ের একটি কেন্দ্রবিন্দু।

ডিটেকশন সফটওয়্যারের সীমাবদ্ধতা

সিন্থেটিক টেক্সটের এই জোয়ারের প্রতিক্রিয়ায় অনেক শিক্ষা জেলা AI-detection টুল ব্যবহারের লাইসেন্স নিয়েছে। এই প্রোগ্রামগুলো কিছু পরিসংখ্যানগত প্যাটার্ন খোঁজে—যেমন কম perplexity, অনুমেয় বাক্য গঠন, পুনরাবৃত্তিমূলক ছন্দ—যা মেশিন-জেনারেটেড গদ্যে সাধারণ। এগুলো কার্যকর হতে পারে। একটি উচ্চ সম্ভাব্যতা স্কোর (probability score) একজন শিক্ষককে আরও সতর্কভাবে দেখার কারণ দেয়।

কিন্তু শিক্ষকরা জানেন যে এই টুলগুলো নিখুঁত নয়। এগুলো মাঝে মাঝে ভুল ফলাফল (false positives) দেয়, বিশেষ করে যারা ইংরেজি প্রথম ভাষা নয় এমন বক্তা বা যারা প্রাকৃতিকভাবেই আনুষ্ঠানিক ও পরিমিত শৈলী পছন্দ করেন, তাদের লেখা গদ্যের ক্ষেত্রে। ডিটেকশন পার্সেন্টেজ বা শনাক্তকরণ শতাংশকে কখনোই এককভাবে প্রতারণার প্রমাণ হিসেবে দেখা উচিত নয়। বেশিরভাগ শিক্ষাবিদ এই সফটওয়্যারটিকে অনেকগুলো সংকেতের মধ্যে একটি হিসেবে ব্যবহার করেন, কোনো অকাট্য প্রমাণ (smoking gun) হিসেবে নয়। টুলটি মানুষের বিচারবুদ্ধিকে সহায়তা করে; এটি মানুষের বিকল্প হতে পারে না।

চিন্তাবিদহীন বিশ্লেষণ

Large language models তথ্য খুব ভালোভাবে সংক্ষেপ করতে পারে। কিন্তু তারা যা দিতে হিমশিম খায় তা হলো দীর্ঘস্থায়ী সমালোচনামূলক চিন্তা বা খাঁটি ব্যক্তিগত প্রতিফলন।

উদাহরণস্বরূপ, ইতিহাসের একটি অ্যাসাইনমেন্টে একটি AI হয়তো একটি বিপ্লবের অর্থনৈতিক, রাজনৈতিক এবং সামাজিক কারণগুলো পাঠ্যবইয়ের নিখুঁত নির্ভুলতার সাথে তালিকাভুক্ত করতে পারে। যা এটি সহজে করতে পারে না তা হলো সেই কারণগুলোর মধ্যে তুলনা করা, প্রচলিত ধারাকে চ্যালেঞ্জ করা, অথবা ঘটনাটিকে শিক্ষার্থীর কাছে গুরুত্বপূর্ণ কোনো সমসাময়িক বিষয়ের সাথে যুক্ত করা। মানুষের লেখকদের লেখার সুনির্দিষ্টতা তাদের পরিচয় বুঝিয়ে দেয়। তারা হয়তো দেখা কোনো ডকুমেন্টারি, বাবা-মায়ের সাথে কোনো কথোপকথন, অথবা তিনটি ভিন্ন ইউনিটে লক্ষ্য করা কোনো প্যাটার্নের কথা উল্লেখ করেন। AI-জেনারেটেড টেক্সটে খুব কমই এই ধরণের ভিত্তি বা সূত্র দেখা যায়, কারণ মেশিনের কোনো অভিজ্ঞতা নেই যা থেকে সে কিছু নিতে পারে এবং কোনো মতামত নেই যা তাকে রক্ষা করতে হবে।

পাঁচ মিনিটের কথোপকথন

সবচেয়ে পুরনো পদ্ধতিগুলোর মধ্যে একটি এখনও সবচেয়ে কার্যকর: শিক্ষার্থীকে তার কাজ সম্পর্কে কথা বলতে বলা।

একজন শিক্ষক হয়তো কোনো সময় শিক্ষার্থীকে আলাদা করে ডেকে...