OpenAI запускає Health у ChatGPT: розрив між безкоштовними та платними порадами
OpenAI офіційно виходить на ринок медичного консультування з запуском "Health in ChatGPT" для користувачів у США віком від 18 років і старше. Хоча ця функція пропонує безпрецедентну інтеграцію з персональними даними про самопочуття, вона впроваджує суперечливу двоступеневу систему, де якість медичних висновків безпосередньо залежить від вашого статусу підписки.
Розрив у якості: GPT-5.5 Instant проти GPT-5.6 Sol
Основа нової медичної пропозиції OpenAI полягає у значній розбіжності між можливостями моделей. Безкоштовні користувачі використовують GPT-5.5 Instant — модель, оптимізовану для швидкості, але з нижчою клінічною точністю. Натомість платні підписники отримують доступ до GPT-5.6 Sol, нової флагманської моделі, спеціально розробленої для високорівневого міркування та відповідності медичним стандартам.
Розрив у продуктивності можна виміряти за допомогою тесту HealthBench Professional. У цьому бенчмарку GPT-5.6 Sol перевершила як відповіді, написані лікарями, так і старіші моделі GPT-4o та GPT-5.5 Instant у всіх категоріях. Найбільш примітно, що модель продемонструвала величезну перевагу в таких аспектах:
- Повнота: 88,0% для Sol проти 53,2% для Instant.
- Корисність у прийнятті медичних рішень: 83,0% для Sol проти 50,8% для Instant.
Хоча OpenAI може виправдовувати такий багаторівневий доступ економічними причинами, це створює реальність, у якій найточніший і найвичерпніший медичний аналіз заблоковано платним бар'єром (paywall).
Глибока інтеграція та конфіденційність даних
Окрім простих текстових запитів, "Health in ChatGPT" дозволяє користувачам синхронізувати дані Apple Health, медичні картки та різні додатки для відстеження стану здоров'я. Це дає можливість ШІ аналізувати результати лабораторних досліджень, відстежувати режими сну та допомагати користувачам готуватися до майбутніх візитів до лікаря.
Щоб врахувати чутливість цієї інформації, OpenAI зобов'язалася дотримуватися суворої політики конфіденційності: підключені дані про здоров'я не використовуватимуться для навчання моделей або таргетованої реклами. Це вирішальний крок для розбудови довіри, особливо з огляду на те, що кількість запитів, пов'язаних зі здоров'ям, зросла з 230 мільйонів до понад 300 мільйонів щотижня з січня.
Обмеження ШІ в клінічних умовах
Попри вражаючі результати бенчмарків, технологічна індустрія залишається обережною. Головною перешкодою для впровадження ШІ в медицині є проблема «надмірної впевненості». У радіологічному бенчмарку RadLE 2.0 жодна з 16 протестованих моделей ШІ не зрівнялася за продуктивністю з лікарями-радіологами, переважно тому, що чат-боти часто надавали неправильні висновки з високою впевненістю, замість того, щоб визнати невпевненість.
Крім того, ШІ не здатний зчитувати невербальні сигнали або використовувати багаторічну клінічну інтуїцію, яку лікар застосовує під час очного огляду. OpenAI пом'якшила це, залучивши понад 260 лікарів до розробки функції, проте компанія зберігає чітке застереження: ChatGPT не є заміною професійній медичній консультації.
Регуляторні перешкоди та глобальна доступність
У той час як користувачі в США отримують доступ, функція залишається недоступною в Європейській економічній зоні, Швейцарії та Великій Британії. Це здебільшого зумовлено суворими вимогами GDPR щодо конфіденційності даних та потенційною класифікацією таких інструментів як «високоризикових» згідно з EU AI Act. Оскільки ШІ стає все ближчим до ліжка пацієнта, напруженість між технологічними можливостями та дотриманням нормативних вимог лише зростатиме.
Основні висновки
- Багаторівневий інтелект: Платні користувачі отримують краще медичне мислення завдяки GPT-5.6 Sol, яка значно перевершує безкоштовну модель GPT-5.5 Instant у тесті HealthBench Professional.
- Синхронізація даних: Функція дозволяє глибоку інтеграцію з Apple Health та медичними записами, хоча OpenAI обіцяє, що ці дані не використовуватимуться для навчання.
- Клінічні обмеження: Попри високі показники бенчмарків, ШІ все ще стикається з проблемою «галюцинаторної впевненості» та не має можливостей для тонкої фізичної оцінки, притаманних лікарям.
