OpenAIがChatGPTに「Health」機能を導入:無料版と有料版のアドバイスにおける格差
OpenAIは、18歳以上の米国ユーザーを対象に「Health in ChatGPT」をロールアウトし、正式に医療アドバイザリー分野へ参入します。この機能は個人のウェルネスデータとのこれまでにない統合を実現する一方で、医療情報の質がサブスクリプションのステータスに直接紐付けられるという、議論を呼ぶ二層構造のシステムを導入しています。
品質の格差:GPT-5.5 Instant vs. GPT-5.6 Sol
OpenAIの新しいヘルスケア機能の核心は、モデルの能力における顕著な格差にあります。無料ユーザーは、速度に最適化されているものの臨床的な正確性は低いGPT-5.5 Instantを使用します。対照的に、有料サブスクリプションのユーザーは、高度な推論とヘルスケアのベンチマーク向けに特別に設計された新しいフラッグシップモデル、GPT-5.6 Solを利用できます。
パフォーマンスの差は、HealthBench Professionalテストを通じて数値化できます。このベンチマークにおいて、GPT-5.6 Solは、医師による回答、および旧モデルであるGPT-4oやGPT-5.5 Instantの両方を、すべてのカテゴリーで上回りました。特に、以下の項目で圧倒的な優位性を示しました。
- Completeness(網羅性): Solは88.0%、Instantは53.2%
- Health Decision Helpfulness(健康上の意思決定への有用性): Solは83.0%、Instantは50.8%
OpenAIは経済的な理由からこの階層化されたアクセスを正当化するかもしれませんが、最も正確で包括的な医療分析がペイウォール(支払い障壁)の向こう側に封じ込められているという現実を生み出しています。
深い統合とデータプライバシー
単なるテキストによるクエリを超えて、「Health in ChatGPT」はApple Health、医療記録、およびさまざまなウェルネスアプリとの同期を可能にします。これにより、AIは検査結果の分析、睡眠パターンのモニタリング、そしてユーザーが次回の医師の診察に備えるためのサポートを行うことができます。
この情報の機密性に対処するため、OpenAIは厳格なプライバシーポリシーを約束しています。接続されたヘルスケアデータは、モデルのトレーニングやターゲット広告には使用されません。これは信頼を構築するための極めて重要な動きであり、特に健康関連のクエリが1月から週に2億3,000万件から3億件以上へと急増している状況において重要です。
臨床現場におけるAIの限界
目覚ましいベンチマークスコアにもかかわらず、テック業界は依然として慎重な姿勢を崩していません。AIの医療導入における大きな障害は「過剰な自信(overconfidence)」の問題です。放射線学のベンチマークであるRadLE 2.0では、テストされた16のAIモデルのうち、人間の放射線科医のパフォーマンスに匹敵したものは一つもありませんでした。その主な理由は、チャットボットが不確実性を認めるのではなく、高い自信を持って誤った所見を提示することが多かったためです。
さらに、AIには非言語的な手がかりを読み取ったり、対面診察中に人間の医師が提供する長年の臨床的直感を利用したりする能力が欠けています。OpenAIは、この機能の開発に260人以上の医師を関与させることでこのリスクを軽減していますが、ChatGPTは専門的な医療アドバイスの代わりになるものではないという明確な免責事項を維持しています。
規制のハードルとグローバルな展開
米国のユーザーは利用可能になる一方で、この機能は欧州経済領域(EEA)、スイス、および英国では利用できないままです。これは主に、GDPRによる厳格なデータプライバシーの義務付けや、EU AI Actの下でこのようなツールが「ハイリスク」に分類される可能性があるためです。AIがより臨床の現場(ベッドサイド)に近づくにつれ、技術的能力と規制遵守の間の緊張は高まる一方でしょう。
主なポイント
- 階層化されたインテリジェンス: 有料ユーザーは、GPT-5.6 Solを通じて優れた医療推論を受けることができ、これはHealthBench Professionalにおいて無料のGPT-5.5 Instantモデルを大幅に上回ります。
- データの同期: この機能により、Apple Healthや医療記録との深い統合が可能になりますが、OpenAIはこのデータがトレーニングに使用されないことを約束しています。
- 臨床的な限界: 高いベンチマークスコアにもかかわらず、AIは依然として「幻覚による自信(hallucinated confidence)」に苦しみ、人間の医師のような微細な身体診察能力を欠いています。
