OpenAI lance Health in ChatGPT : la fracture entre conseils gratuits et payants

OpenAI pénètre officiellement le domaine du conseil médical avec le déploiement de « Health in ChatGPT » pour les utilisateurs américains âgés de 18 ans et plus. Bien que cette fonctionnalité offre une intégration sans précédent avec les données de bien-être personnel, elle introduit un système controversé à deux niveaux où la qualité des informations médicales est directement liée à votre statut d'abonnement.

L'écart de qualité : GPT-5.5 Instant vs GPT-5.6 Sol

Le cœur de la nouvelle offre de santé d'OpenAI réside dans une disparité significative entre les capacités des modèles. Les utilisateurs gratuits utilisent GPT-5.5 Instant, un modèle optimisé pour la rapidité mais doté d'une précision clinique moindre. En revanche, les abonnés payants ont accès à GPT-5.6 Sol, le nouveau modèle phare spécifiquement conçu pour le raisonnement de haut niveau et les critères de référence en santé.

L'écart de performance est quantifiable via le test HealthBench Professional. Dans ce benchmark, GPT-5.6 Sol a surpassé tant les réponses rédigées par des médecins que les anciens modèles GPT-4o et GPT-5.5 Instant dans toutes les catégories. Plus notablement, le modèle a démontré un avantage massif en matière de :

  • Complétude : 88,0 % pour Sol contre 53,2 % pour Instant.
  • Utilité pour la prise de décision de santé : 83,0 % pour Sol contre 50,8 % pour Instant.

Bien qu'OpenAI puisse défendre cet accès échelonné pour des raisons économiques, cela crée une réalité où l'analyse médicale la plus précise et la plus complète est verrouillée derrière un mur de paiement.

Intégration profonde et confidentialité des données

Au-delà de simples requêtes textuelles, « Health in ChatGPT » permet aux utilisateurs de synchroniser Apple Health, leurs dossiers médicaux et diverses applications de bien-être. Cela permet à l'IA d'analyser des résultats de laboratoire, de surveiller les cycles de sommeil et d'aider les utilisateurs à préparer leurs prochains rendez-vous médicaux.

Pour répondre à la sensibilité de ces informations, OpenAI s'est engagé à respecter une politique de confidentialité stricte : les données de santé connectées ne seront pas utilisées pour l'entraînement des modèles ou la publicité ciblée. Il s'agit d'une étape cruciale pour instaurer la confiance, d'autant plus que les requêtes liées à la santé ont bondi de 230 millions à plus de 300 millions par semaine depuis janvier.

Les limites de l'IA en milieu clinique

Malgré des scores de benchmark impressionnants, l'industrie technologique reste prudente. Un obstacle majeur à l'adoption de l'IA en médecine est le problème de la « surconfiance ». Dans le benchmark de radiologie RadLE 2.0, aucun des 16 modèles d'IA testés n'a égalé la performance des radiologues humains, principalement parce que les chatbots fournissaient souvent des conclusions erronées avec un haut degré de confiance plutôt que de reconnaître leur incertitude.

De plus, l'IA n'a pas la capacité de percevoir les indices non verbaux ou d'utiliser les années d'intuition clinique qu'un médecin humain apporte lors d'un examen en personne. OpenAI a atténué ce risque en impliquant plus de 260 médecins dans le développement de la fonctionnalité, tout en maintenant une clause de non-responsabilité claire : ChatGPT ne remplace pas un avis médical professionnel.

Obstacles réglementaires et disponibilité mondiale

Alors que les utilisateurs américains y ont accès, la fonctionnalité reste indisponible dans l'Espace économique européen, en Suisse et au Royaume-Uni. Cela est dû en grande partie aux mandats stricts de protection des données du RGPD et à la classification potentielle de tels outils comme étant à « haut risque » en vertu de l'EU AI Act. À mesure que l'IA se rapproche du chevet du patient, la tension entre les capacités technologiques et la conformité réglementaire ne fera que s'intensifier.

Points clés à retenir

  • Intelligence échelonnée : Les utilisateurs payants bénéficient d'un raisonnement médical supérieur via GPT-5.6 Sol, qui surpasse nettement le modèle gratuit GPT-5.5 Instant sur HealthBench Professional.
  • Synchronisation des données : La fonctionnalité permet une intégration profonde avec Apple Health et les dossiers médicaux, bien qu'OpenAI promette que ces données ne seront pas utilisées pour l'entraînement.
  • Limites cliniques : Malgré des scores de benchmark élevés, l'IA est toujours confrontée à une « confiance hallucinatoire » et manque des capacités d'évaluation physique nuancées des médecins humains.