OpenAI قابلیت Health را در ChatGPT راهاندازی کرد: شکاف میان توصیههای رایگان و پولی
OpenAI با عرضه قابلیت "Health in ChatGPT" برای کاربران بالای ۱۸ سال در ایالات متحده، رسماً وارد حوزه مشاوره پزشکی میشود. اگرچه این ویژگی ادغام بیسابقهای با دادههای سلامت شخصی ارائه میدهد، اما یک سیستم دو سطحی بحثبرانگیز را معرفی میکند که در آن کیفیت تحلیلهای پزشکی مستقیماً به وضعیت اشتراک شما بستگی دارد.
شکاف کیفیت: GPT-5.5 Instant در مقابل GPT-5.6 Sol
هسته اصلی پیشنهاد سلامت جدید OpenAI در تفاوت قابل توجه میان توانمندیهای مدلها نهفته است. کاربران رایگان از GPT-5.5 Instant استفاده میکنند؛ مدلی که برای سرعت بهینه شده اما دقت بالینی کمتری دارد. در مقابل، مشترکین پولی به GPT-5.6 Sol دسترسی پیدا میکنند، مدل پرچمدار جدیدی که بهطور ویژه برای استدلال سطح بالا و معیارهای سنجش سلامت طراحی شده است.
شکاف عملکرد از طریق آزمون HealthBench Professional قابل اندازهگیری است. در این بنچمارک، GPT-5.6 Sol در تمامی دستهها، هم از پاسخهای نوشتهشده توسط پزشکان و هم از مدلهای قدیمیتر GPT-4o و GPT-5.5 Instant عملکرد بهتری داشت. قابل توجهتر اینکه، این مدل برتری چشمگیری در موارد زیر نشان داد:
- کامل بودن (Completeness): ۸۸.۰٪ برای Sol در مقابل ۵۳.۲٪ برای Instant.
- مفید بودن در تصمیمگیریهای سلامت (Health Decision Helpfulness): ۸۳.۰٪ برای Sol در مقابل ۵۰.۸٪ برای Instant.
اگرچه OpenAI ممکن است از این دسترسی سطحی با دلایل اقتصادی دفاع کند، اما این امر واقعیتی را ایجاد میکند که در آن دقیقترین و جامعترین تحلیلهای پزشکی پشت یک دیوار پرداخت (paywall) محصور شدهاند.
ادغام عمیق و حریم خصوصی دادهها
فراتر از پرسوجوهای متنی ساده، "Health in ChatGPT" به کاربران اجازه میدهد تا Apple Health، پروندههای پزشکی و اپلیکیشنهای مختلف سلامت را همگامسازی کنند. این امر هوش مصنوعی را قادر میسازد تا نتایج آزمایشگاه را تحلیل کند، الگوهای خواب را زیر نظر بگیرد و به کاربران در آمادهسازی برای قرار ملاقاتهای پزشکی آتی کمک کند.
برای رسیدگی به حساسیت این اطلاعات، OpenAI به یک سیاست حریم خصوصی سختگیرانه متعهد شده است: دادههای سلامت متصلشده برای آموزش مدل یا تبلیغات هدفمند استفاده نخواهند شد. این یک اقدام حیاتی برای جلب اعتماد است، بهویژه از زمانی که پرسوجوهای مرتبط با سلامت از ۲۳۰ میلیون به بیش از ۳۰۰ میلیون در هفته از ماه ژانویه رسیده است.
محدودیتهای هوش مصنوعی در محیطهای بالینی
علیرغم امتیازات خیرهکننده در بنچمارکها، صنعت فناوری همچنان محتاط است. یکی از موانع اصلی در پذیرش هوش مصنوعی در پزشکی، مشکل «اعتمادبهنفس کاذب» (overconfidence) است. در بنچمارک رادیولوژی RadLE 2.0، هیچیک از ۱۶ مدل هوش مصنوعی آزمایششده با عملکرد رادیولوژیستهای انسانی برابری نکردند؛ عمدتاً به این دلیل که چتباتها اغلب به جای اذعان به عدم قطعیت، یافتههای نادرست را با اطمینان بالا ارائه میدادند.
علاوه بر این، هوش مصنوعی فاقد توانایی درک نشانههای غیرکلامی یا بهرهگیری از سالها شهود بالینی است که یک پزشک انسانی در طول معاینه حضوری ارائه میدهد. OpenAI با مشارکت بیش از ۲۶۰ پزشک در توسعه این قابلیت، این مسئله را تا حدی تعدیل کرده است، با این حال یک سلب مسئولیت واضح را حفظ کرده است: ChatGPT جایگزینی برای توصیههای پزشکی حرفهای نیست.
موانع نظارتی و در دسترس بودن جهانی
در حالی که کاربران ایالات متحده به این قابلیت دسترسی پیدا میکنند، این ویژگی در منطقه اقتصادی اروپا، سوئیس و بریتانیا همچنان در دسترس نیست. این موضوع عمدتاً به دلیل الزامات سختگیرانه حریم خصوصی دادهها در GDPR و احتمال طبقهبندی چنین ابزارهایی به عنوان «پرخطر» تحت EU AI Act است. با نزدیکتر شدن هوش مصنوعی به تخت بیمار، تنش میان توانمندیهای تکنولوژیک و رعایت مقررات تنها شدت خواهد یافت.
نکات کلیدی
- هوش سطحیبندی شده: کاربران پولی از طریق GPT-5.6 Sol به استدلال پزشکی برتری دسترسی دارند که در بنچمارک HealthBench Professional بهطور قابل توجهی از مدل رایگان GPT-5.5 Instant بهتر عمل میکند.
- همگامسازی دادهها: این قابلیت اجازه ادغام عمیق با Apple Health و پروندههای پزشکی را میدهد، اگرچه OpenAI وعده میدهد که از این دادهها برای آموزش استفاده نخواهد شد.
- محدودیتهای بالینی: علیرغم امتیازات بالای بنچمارک، هوش مصنوعی همچنان با مشکل «اعتمادبهنفس توهمآمیز» (hallucinated confidence) دستوپنجه نرم میکند و فاقد تواناییهای ارزیابی فیزیکی ظریف پزشکان انسانی است.
