OpenAI-এর ChatGPT-এ 'Health' ফিচার চালু: ফ্রি এবং পেইড পরামর্শের মধ্যে ব্যবধান
১৮ বছর বা তার বেশি বয়সী মার্কিন ব্যবহারকারীদের জন্য "Health in ChatGPT" চালু করার মাধ্যমে OpenAI আনুষ্ঠানিকভাবে চিকিৎসা পরামর্শের ক্ষেত্রে প্রবেশ করছে। যদিও এই ফিচারটি ব্যক্তিগত সুস্থতা সংক্রান্ত তথ্যের (wellness data) সাথে অভূতপূর্ব সমন্বয় প্রদান করে, তবে এটি একটি বিতর্কিত দ্বি-স্তরীয় ব্যবস্থা চালু করেছে যেখানে চিকিৎসার অন্তর্দৃষ্টির মান সরাসরি আপনার সাবস্ক্রিপশন স্ট্যাটাসের ওপর নির্ভর করে।
গুণমানের ব্যবধান: GPT-5.5 Instant বনাম GPT-5.6 Sol
OpenAI-এর নতুন স্বাস্থ্য পরিষেবার মূল ভিত্তি হলো মডেলগুলোর সক্ষমতার মধ্যে একটি উল্লেখযোগ্য বৈষম্য। ফ্রি ব্যবহারকারীরা GPT-5.5 Instant দ্বারা পরিচালিত হন, যা গতির জন্য অপ্টিমাইজ করা হলেও ক্লিনিক্যাল নির্ভুলতা কিছুটা কম। বিপরীতে, পেইড সাবস্ক্রাইবাররা GPT-5.6 Sol ব্যবহারের সুযোগ পান, যা উচ্চ-স্তরের যুক্তি এবং স্বাস্থ্য সংক্রান্ত বেঞ্চমার্কের জন্য বিশেষভাবে ডিজাইন করা একটি নতুন ফ্ল্যাগশিপ মডেল।
HealthBench Professional টেস্টের মাধ্যমে এই পারফরম্যান্সের ব্যবধান পরিমাপ করা সম্ভব। এই বেঞ্চমার্কে, GPT-5.6 Sol সব বিভাগেই চিকিৎসকদের লেখা উত্তর এবং পুরনো GPT-4o ও GPT-5.5 Instant মডেল উভয়কেই ছাড়িয়ে গেছে। সবচেয়ে উল্লেখযোগ্যভাবে, মডেলটি নিচের ক্ষেত্রগুলোতে বিশাল ব্যবধান প্রদর্শন করেছে:
- Completeness (পূর্ণতা): Sol-এর জন্য ৮৮.০% বনাম Instant-এর জন্য ৫৩.২%।
- Health Decision Helpfulness (স্বাস্থ্য সংক্রান্ত সিদ্ধান্ত গ্রহণে সহায়ক): Sol-এর জন্য ৮৩.০% বনাম Instant-এর জন্য ৫০.৮%।
যদিও OpenAI অর্থনৈতিক কারণে এই স্তরভিত্তিক অ্যাক্সেসকে সমর্থন করতে পারে, তবে এটি এমন একটি বাস্তবতা তৈরি করে যেখানে সবচেয়ে নির্ভুল এবং ব্যাপক চিকিৎসা বিশ্লেষণ একটি পে-ওয়াল (paywall)-এর পেছনে আটকে থাকে।
গভীর সমন্বয় এবং ডেটা গোপনীয়তা
সাধারণ টেক্সট কুয়েরির বাইরেও, "Health in ChatGPT" ব্যবহারকারীদের Apple Health, মেডিকেল রেকর্ড এবং বিভিন্ন ওয়েলনেস অ্যাপের সাথে সিঙ্ক করার সুবিধা দেয়। এটি AI-কে ল্যাব রিপোর্ট বিশ্লেষণ করতে, ঘুমের ধরণ পর্যবেক্ষণ করতে এবং ব্যবহারকারীদের আসন্ন ডাক্তার অ্যাপয়েন্টমেন্টের জন্য প্রস্তুতি নিতে সাহায্য করে।
এই তথ্যের সংবেদনশীলতা মোকাবিলা করতে OpenAI একটি কঠোর গোপনীয়তা নীতির প্রতিশ্রুতি দিয়েছে: সংযুক্ত স্বাস্থ্য সংক্রান্ত ডেটা মডেল ট্রেনিং বা টার্গেটেড বিজ্ঞাপনের জন্য ব্যবহার করা হবে না। বিশ্বাস অর্জনের জন্য এটি একটি অত্যন্ত গুরুত্বপূর্ণ পদক্ষেপ, বিশেষ করে যেহেতু জানুয়ারি থেকে স্বাস্থ্য সংক্রান্ত কুয়েরি ২৩০ মিলিয়ন থেকে বেড়ে প্রতি সপ্তাহে ৩০০ মিলিয়নেরও বেশি হয়েছে।
ক্লিনিক্যাল ক্ষেত্রে AI-এর সীমাবদ্ধতা
চিত্তাকর্ষক বেঞ্চমার্ক স্কোর থাকা সত্ত্বেও প্রযুক্তি শিল্প সতর্ক রয়েছে। AI-এর চিকিৎসা ক্ষেত্রে গ্রহণের ক্ষেত্রে একটি বড় বাধা হলো "অতিরিক্ত আত্মবিশ্বাসের" (overconfidence) সমস্যা। RadLE 2.0 রেডিওলজি বেঞ্চমার্কে, পরীক্ষিত ১৬টি AI মডেলের কোনোটিই মানব রেডিওলজিস্টদের পারফরম্যান্সের সাথে পাল্লা দিতে পারেনি, যার প্রধান কারণ হলো চ্যাটবটগুলো অনিশ্চয়তা স্বীকার করার পরিবর্তে প্রায়শই উচ্চ আত্মবিশ্বাসের সাথে ভুল ফলাফল প্রদান করে।
তদুপরি, সরাসরি পরীক্ষার সময় একজন মানব চিকিৎসক যে ধরনের অমৌখিক সংকেত (nonverbal cues) বা বছরের পর বছর ধরে অর্জিত ক্লিনিক্যাল ইনটুইশন ব্যবহার করেন, AI-এর সেই ক্ষমতা নেই। OpenAI এই ফিচারের উন্নয়নে ২৬০ জনেরও বেশি চিকিৎসককে অন্তর্ভুক্ত করে এই ঝুঁকি কিছুটা কমিয়েছে, তবুও তারা একটি স্পষ্ট সতর্কবার্তা প্রদান করেছে: ChatGPT পেশাদার চিকিৎসা পরামর্শের বিকল্প নয়।
নিয়ন্ত্রক বাধা এবং বিশ্বব্যাপী প্রাপ্যতা
মার্কিন ব্যবহারকারীরা এটি ব্যবহারের সুযোগ পেলেও ইউরোপীয় অর্থনৈতিক অঞ্চল, সুইজারল্যান্ড এবং যুক্তরাজ্যে এই ফিচারটি এখনও অনুপলব্ধ। এর প্রধান কারণ হলো GDPR-এর কঠোর ডেটা গোপনীয়তা নির্দেশিকা এবং EU AI Act-এর অধীনে এই ধরনের টুলগুলোকে "উচ্চ-ঝুঁকিপূর্ণ" হিসেবে শ্রেণীবদ্ধ করার সম্ভাবনা। AI যখন চিকিৎসার ক্ষেত্রে আরও কাছাকাছি আসছে, তখন প্রযুক্তিগত সক্ষমতা এবং নিয়ন্ত্রক সম্মতির মধ্যে উত্তেজনা আরও বৃদ্ধি পাবে।
মূল বিষয়সমূহ
- স্তরভিত্তিক বুদ্ধিমত্তা: পেইড ব্যবহারকারীরা GPT-5.6 Sol-এর মাধ্যমে উন্নত চিকিৎসা যুক্তি পান, যা HealthBench Professional-এ ফ্রি GPT-5.5 Instant মডেলের তুলনায় উল্লেখযোগ্যভাবে ভালো পারফর্ম করে।
- ডেটা সিঙ্কিং: এই ফিচারটি Apple Health এবং মেডিকেল রেকর্ডের সাথে গভীর সমন্বয় করার সুবিধা দেয়, যদিও OpenAI প্রতিশ্রুতি দিয়েছে যে এই ডেটা ট্রেনিংয়ের জন্য ব্যবহার করা হবে না।
- ক্লিনিক্যাল সীমাবদ্ধতা: উচ্চ বেঞ্চমার্ক স্কোর থাকা সত্ত্বেও, AI এখনও "ভ্রান্ত আত্মবিশ্বাস" (hallucinated confidence)-এর সাথে লড়াই করে এবং মানুষের মতো সূক্ষ্ম শারীরিক পরীক্ষা করার ক্ষমতা এর নেই।
