OpenAI نے ChatGPT میں Health متعارف کروا دیا: مفت اور بامعاوضہ مشوروں کے درمیان فرق

OpenAI نے 18 سال اور اس سے زیادہ عمر کے امریکی صارفین کے لیے "Health in ChatGPT" کے آغاز کے ساتھ باضابطہ طور پر طبی مشاورتی شعبے میں قدم رکھ دیا ہے۔ اگرچہ یہ فیچر ذاتی صحت کے ڈیٹا کے ساتھ بے مثال انضمام (integration) پیش کرتا ہے، لیکن یہ ایک متنازعہ دو سطحی نظام متعارف کرواتا ہے جہاں طبی معلومات کا معیار براہ راست آپ کی سبسکرپشن کی حیثیت سے جڑا ہوا ہے۔

معیار کا فرق: GPT-5.5 Instant بمقابلہ GPT-5.6 Sol

OpenAI کی نئی صحت سے متعلق پیشکش کا اصل مرکز ماڈلز کی صلاحیتوں کے درمیان ایک نمایاں فرق ہے۔ مفت صارفین GPT-5.5 Instant استعمال کرتے ہیں، جو کہ رفتار کے لیے بہتر بنایا گیا ہے لیکن اس کی طبی درستگی کم ہے۔ اس کے برعکس، بامعاوضہ سبسکرائبرز کو GPT-5.6 Sol تک رسائی حاصل ہوتی ہے، جو کہ ایک نیا فلیگ شپ ماڈل ہے جسے خاص طور پر اعلیٰ درجے کی استدلال (reasoning) اور صحت کے معیار (benchmarks) کے لیے ڈیزائن کیا گیا ہے۔

کارکردگی کا یہ فرق HealthBench Professional ٹیسٹ کے ذریعے ناپا جا سکتا ہے۔ اس بینچ مارک میں، GPT-5.6 Sol نے تمام زمروں میں ڈاکٹروں کے لکھے ہوئے جوابات اور پرانے GPT-4o اور GPT-5.5 Instant ماڈلز دونوں کو پیچھے چھوڑ دیا۔ سب سے نمایاں طور پر، اس ماڈل نے درج ذیل میں بڑی برتری دکھائی:

  • مکمل ہونا (Completeness): Sol کے لیے 88.0% بمقابلہ Instant کے لیے 53.2%۔
  • صحت کے فیصلوں میں مددگاری (Health Decision Helpfulness): Sol کے لیے 83.0% بمقابلہ Instant کے لیے 50.8%۔

اگرچہ OpenAI معاشی بنیادوں پر اس دو سطحی رسائی کا دفاع کر سکتا ہے، لیکن یہ ایک ایسی حقیقت پیدا کرتا ہے جہاں سب سے درست اور جامع طبی تجزیہ 'پے وال' (paywall) کے پیچھے مقفل ہے۔

گہرا انضمام اور ڈیٹا کی رازداری

سادہ ٹیکسٹ سوالات سے ہٹ کر، "Health in ChatGPT" صارفین کو Apple Health، طبی ریکارڈز، اور مختلف ویلنس ایپس کے ساتھ سنک (sync) کرنے کی اجازت دیتا ہے۔ اس سے AI کو لیب کے نتائج کا تجزیہ کرنے، نیند کے پیٹرن کی نگرانی کرنے، اور صارفین کو ڈاکٹر کے آنے والے اپوائنٹمنٹس کے لیے تیار کرنے میں مدد ملتی ہے۔

اس معلومات کی حساسیت کو مدنظر رکھتے ہوئے، OpenAI نے ایک سخت رازداری کی پالیسی کا عہد کیا ہے: منسلک طبی ڈیٹا کو ماڈل کی تربیت یا ٹارگٹڈ اشتہارات کے لیے استعمال نہیں کیا جائے گا۔ اعتماد سازی کے لیے یہ ایک اہم قدم ہے، خاص طور پر جب سے جنوری سے صحت سے متعلق سوالات کی تعداد 230 ملین سے بڑھ کر ہفتہ وار 300 ملین سے زیادہ ہو گئی ہے۔

طبی ماحول میں AI کی حدود

متاثر کن بینچ مارک اسکورز کے باوجود، ٹیک انڈسٹری محتاط ہے۔ AI کے طبی استعمال میں ایک بڑی رکاوٹ "حد سے زیادہ اعتماد" (overconfidence) کا مسئلہ ہے۔ RadLE 2.0 ریڈیولوجی بینچ مارک میں، آزمائے گئے 16 AI ماڈلز میں سے کوئی بھی انسانی ریڈیالوجسٹ کی کارکردگی کا مقابلہ نہ کر سکا، بنیادی وجہ یہ ہے کہ چیٹ بوٹس اکثر غیر یقینی صورتحال کو تسلیم کرنے کے بجائے بڑے اعتماد کے ساتھ غلط نتائج فراہم کرتے ہیں۔

مزید برآں، AI میں غیر لفظی اشاروں (nonverbal cues) کو سمجھنے یا برسوں کی طبی بصیرت (clinical intuition) استعمال کرنے کی صلاحیت نہیں ہے جو ایک انسانی معالج آمنے سامنے کے معائنے کے دوران فراہم کرتا ہے۔ OpenAI نے اس فیچر کی تیاری میں 260 سے زیادہ ڈاکٹروں کو شامل کر کے اس خطرے کو کم کرنے کی کوشش کی ہے، تاہم انہوں نے ایک واضح ڈسکلیمر (disclaimer) برقرار رکھا ہے: ChatGPT پیشہ ورانہ طبی مشورے کا متبادل نہیں ہے۔

ریگولیٹری رکاوٹیں اور عالمی دستیابی

اگرچہ امریکی صارفین کو اس تک رسائی حاصل ہے، لیکن یہ فیچر یورپی اقتصادی علاقہ (European Economic Area)، سوئٹزرلینڈ اور برطانیہ میں دستیاب نہیں ہے۔ اس کی بڑی وجہ GDPR کے سخت ڈیٹا پرائیویسی قوانین اور EU AI Act کے تحت ایسے ٹولز کو "اعلیٰ خطرے" (high-risk) کے طور پر درجہ بندی کیے جانے کا امکان ہے۔ جیسے جیسے AI طبی علاج کے قریب پہنچ رہا ہے، تکنیکی صلاحیت اور ریگولیٹری تعمیل کے درمیان تناؤ مزید بڑھے گا۔

اہم نکات

  • دو سطحی ذہانت: بامعاوضہ صارفین GPT-5.6 Sol کے ذریعے بہتر طبی استدلال حاصل کرتے ہیں، جو HealthBench Professional پر مفت GPT-5.5 Instant ماڈل کے مقابلے میں نمایاں طور پر بہتر کارکردگی دکھاتا ہے۔
  • ڈیٹا سنکنگ: یہ فیچر Apple Health اور طبی ریکارڈز کے ساتھ گہرے انضمام کی اجازت دیتا ہے، اگرچہ OpenAI کا وعدہ ہے کہ اس ڈیٹا کو تربیت کے لیے استعمال نہیں کیا جائے گا۔
  • طبی حدود: اعلیٰ بینچ مارک اسکورز کے باوجود، AI اب بھی "خیالی اعتماد" (hallucinated confidence) کے مسئلے سے لڑ رہا ہے اور اس میں انسانی ڈاکٹروں جیسی باریک بینی سے جسمانی معائنہ کرنے کی صلاحیت نہیں ہے۔