OpenAI lancia "Health in ChatGPT": il divario tra consigli gratuiti e a pagamento
OpenAI sta entrando ufficialmente nel settore della consulenza medica con il rilascio di "Health in ChatGPT" per gli utenti statunitensi di età pari o superiore a 18 anni. Sebbene la funzione offra un'integrazione senza precedenti con i dati personali sul benessere, introduce un controverso sistema a due livelli in cui la qualità delle informazioni mediche è direttamente legata allo stato dell'abbonamento.
Il divario di qualità: GPT-5.5 Instant vs. GPT-5.6 Sol
Il cuore della nuova offerta sanitaria di OpenAI risiede in una significativa disparità tra le capacità dei modelli. Gli utenti gratuiti utilizzano GPT-5.5 Instant, un modello ottimizzato per la velocità ma con una minore accuratezza clinica. Al contrario, gli abbonati paganti hanno accesso a GPT-5.6 Sol, il nuovo modello di punta progettato specificamente per il ragionamento di alto livello e i benchmark sanitari.
Il divario di prestazioni è quantificabile tramite il test HealthBench Professional. In questo benchmark, GPT-5.6 Sol ha superato sia le risposte scritte dai medici sia i modelli precedenti GPT-4o e GPT-5.5 Instant in tutte le categorie. In particolare, il modello ha dimostrato un enorme vantaggio in:
- Completezza: 88,0% per Sol rispetto al 53,2% per Instant.
- Utilità nelle decisioni sanitarie: 83,0% per Sol rispetto al 50,8% per Instant.
Sebbene OpenAI possa difendere questo accesso a livelli per ragioni economiche, ciò crea una realtà in cui l'analisi medica più accurata e completa è bloccata da un paywall.
Integrazione profonda e privacy dei dati
Oltre alle semplici query testuali, "Health in ChatGPT" consente agli utenti di sincronizzare Apple Health, cartelle cliniche e varie app per il benessere. Ciò consente all'IA di analizzare i risultati degli esami di laboratorio, monitorare i modelli del sonno e aiutare gli utenti a prepararsi per le prossime visite mediche.
Per affrontare la delicatezza di queste informazioni, OpenAI si è impegnata in una rigorosa politica sulla privacy: i dati sanitari collegati non saranno utilizzati per l'addestramento dei modelli o per la pubblicità mirata. Si tratta di una mossa cruciale per costruire fiducia, specialmente considerando che le query relative alla salute sono passate da 230 milioni a oltre 300 milioni settimanali da gennaio.
I limiti dell'IA in contesti clinici
Nonostante gli impressionanti punteggi nei benchmark, l'industria tecnologica rimane cauta. Un ostacolo importante nell'adozione dell'IA in ambito medico è il problema dell' "eccessiva sicurezza" (overconfidence). Nel benchmark radiologico RadLE 2.0, nessuno dei 16 modelli di IA testati ha egu
