OpenAI Melancarkan Health in ChatGPT: Jurang Antara Nasihat Percuma dan Berbayar
OpenAI secara rasmi memasuki ruang nasihat perubatan dengan pelancaran "Health in ChatGPT" untuk pengguna di AS yang berumur 18 tahun ke atas. Walaupun ciri ini menawarkan integrasi yang belum pernah berlaku sebelum ini dengan data kesejahteraan peribadi, ia memperkenalkan sistem dua peringkat yang kontroversi di mana kualiti wawasan perubatan dikaitkan secara langsung dengan status langganan anda.
Jurang Kualiti: GPT-5.5 Instant lwn. GPT-5.6 Sol
Teras tawaran kesihatan baharu OpenAI terletak pada perbezaan ketara antara keupayaan model. Pengguna percuma dikuasakan oleh GPT-5.5 Instant, sebuah model yang dioptimumkan untuk kelajuan tetapi mempunyai ketepatan klinikal yang lebih rendah. Sebaliknya, pelanggan berbayar mendapat akses kepada GPT-5.6 Sol, model perdana baharu yang direka khusus untuk penaakulan tahap tinggi dan penanda aras kesihatan.
Jurang prestasi ini boleh diukur melalui ujian HealthBench Professional. Dalam penanda aras ini, GPT-5.6 Sol mengatasi kedua-dua jawapan yang ditulis oleh doktor serta model GPT-4o dan GPT-5.5 Instant yang lebih lama dalam semua kategori. Paling ketara, model tersebut menunjukkan kelebihan besar dalam:
- Kelengkapan: 88.0% untuk Sol lwn. 53.2% untuk Instant.
- Keberkesanan Keputusan Kesihatan: 83.0% untuk Sol lwn. 50.8% untuk Instant.
Walaupun OpenAI mungkin mempertahankan akses bertingkat ini atas faktor ekonomi, ia mewujudkan realiti di mana analisis perubatan yang paling tepat dan komprehensif dikunci di sebalik dinding pembayaran (paywall).
Integrasi Mendalam dan Privasi Data
Selain pertanyaan teks ringkas, "Health in ChatGPT" membolehkan pengguna menyelaraskan (sync) Apple Health, rekod perubatan, dan pelbagai aplikasi kesejahteraan. Ini membolehkan AI menganalisis keputusan makmal, memantau corak tidur, dan membantu pengguna bersedia untuk janji temu doktor yang akan datang.
Bagi menangani sensitiviti maklumat ini, OpenAI telah komited kepada dasar privasi yang ketat: data kesihatan yang disambungkan tidak akan digunakan untuk latihan model atau pengiklanan bersasaran. Ini adalah langkah penting untuk membina kepercayaan, terutamanya apabila pertanyaan berkaitan kesihatan telah melonjak daripada 230 juta kepada lebih 300 juta setiap minggu sejak Januari.
Had AI dalam Tetapan Klinikal
Walaupun mempunyai skor penanda aras yang mengagumkan, industri teknologi kekal berwaspada. Halangan utama dalam penggunaan perubatan AI ialah masalah "keyakinan berlebihan" (overconfidence). Dalam penanda aras radiologi RadLE 2.0, tiada satu pun daripada 16 model AI yang diuji menyamai prestasi pakar radiologi manusia, terutamanya kerana bot sembang sering memberikan penemuan yang salah dengan keyakinan tinggi daripada mengakui ketidakpastian.
Tambahan pula, AI kekurangan keupayaan untuk mengesan isyarat bukan lisan atau menggunakan gerak hati klinikal bertahun-tahun yang diberikan oleh doktor manusia semasa pemeriksaan bersemuka. OpenAI telah mengurangkan risiko ini dengan melibatkan lebih daripada 260 doktor dalam pembangunan ciri tersebut, namun mereka mengekalkan penafian yang jelas: ChatGPT bukan pengganti nasihat perubatan profesional.
Halangan Kawal Selia dan Ketersediaan Global
Walaupun pengguna di AS mendapat akses, ciri ini masih tidak tersedia di Kawasan Ekonomi Eropah, Switzerland, dan United Kingdom. Ini sebahagian besarnya disebabkan oleh mandat privasi data yang ketat di bawah GDPR dan potensi pengelasan alat sedemikian sebagai "berisiko tinggi" di bawah EU AI Act. Apabila AI semakin mendekati penjagaan pesakit, ketegangan antara keupayaan teknologi dan pematuhan kawal selia akan semakin meningkat.
Ringkasan Utama
- Kecerdasan Bertingkat: Pengguna berbayar menerima penaakulan perubatan yang lebih unggul melalui GPT-5.6 Sol, yang mengatasi model percuma GPT-5.5 Instant secara signifikan dalam HealthBench Professional.
- Penyelarasan Data: Ciri ini membolehkan integrasi mendalam dengan Apple Health dan rekod perubatan, walaupun OpenAI berjanji data ini tidak akan digunakan untuk latihan.
- Had Klinikal: Walaupun mempunyai skor penanda aras yang tinggi, AI masih bergelut dengan "keyakinan halusinasi" (hallucinated confidence) dan kekurangan keupayaan penilaian fizikal yang bernuansa seperti doktor manusia.
