Kotak Hitam Keselamatan AI: Bagaimana Sol OpenAI Mendapat Lampu Hijau
Apabila OpenAI melancarkan model perintis terbaharunya, Sol, satu persoalan kritikal sedang menghantui industri teknologi: bagaimanakah sebenarnya kerajaan memutuskan bahawa model ini selamat untuk pelancaran awam? Walaupun Sol bertujuan untuk menyaingi Fable milik Anthropic—sebuah model yang sebelum ini disekat oleh Rumah Putih—kurangnya ketelusan mengenai proses kelulusan sedang mencetuskan perdebatan sengit dalam kalangan pengawal selia dan penyelidik.
Kekurangan Protokol Keselamatan yang Terpiawai
Walaupun terdapat risiko tinggi dalam penggunaan model perintis, buat masa ini tiada rangka kerja yang bersatu dan telus untuk pensijilan keselamatan AI. Walaupun CEO OpenAI Sam Altman mengesahkan bahawa perbincangan telah diadakan dengan pegawai berpangkat tinggi—termasuk Setiausaha Perdagangan Howard Lutnick dan Pengarah Siber Kebangsaan AS Sean Cairncross—penanda aras teknikal khusus yang digunakan untuk mengesahkan Sol masih tidak diketahui.
Landskap kawal selia semasa disifatkan oleh pakar sebagai "ad hoc". Walaupun satu perintah eksekutif baru-baru ini telah menggariskan pelan tindakan untuk menilai model perintis, butiran khususnya masih dalam proses penyempurnaan. Perkara yang paling penting, tiada "FDA untuk AI", satu sentimen yang turut disuarakan oleh bekas penasihat AI Rumah Putih, Sriram Krishnan. Ketiadaan badan kawal selia berpusat ini bermakna penilaian keselamatan pada masa ini bergantung kepada gabungan proses dalaman syarikat dan audit luaran secara sukarela.
Ketegangan Antara Inovasi dan Kawal Selia
Pelancaran Fable oleh Anthropic menonjolkan ketidaktentuan persekitaran yang tidak dikawal selia ini. Fable telah disekat seketika daripada akses awam bagi warganegara asing disebabkan kebimbangan mengenai keupayaan "jailbreaking" yang boleh memudahkan penggodaman. Sebaliknya, Sol milik OpenAI telah beralih ke arah pelancaran meluas selepas tempoh pratonton model tersebut untuk pengguna kerajaan terpilih.
Perbezaan ini telah menimbulkan tanda tanya mengenai pengaruh hubungan politik. Laporan mengenai kepimpinan OpenAI yang berurusan dengan pihak pentadbiran telah menyebabkan beberapa pemerhati mempersoalkan sama ada pendekatan kawal selia yang "lebih longgar" sedang digunakan. Bagi pembangun dan pengasas, ini mewujudkan persekitaran yang tidak menentu di mana penggunaan model mungkin lebih bergantung kepada manuver politik berbanding metrik keselamatan teknikal yang terpiawai.
Menuju ke Arah Pengauditan Pihak Ketiga dan Ruang Terbuka (Open Commons)
Pemimpin industri sedang menyeru peralihan struktur untuk mengelakkan "gatekeeping" oleh segelintir pembuat keputusan. Pakar sains komputer Andy Konwinski mencadangkan bahawa proses semasa kekurangan input yang mencukupi daripada pakar sebenar: penyelidik keselamatan, penyelarasan (alignment), dan kebolehtafsiran (interpretability).
Untuk menyelesaikan masalah ini, dua model utama untuk masa hadapan telah muncul:
- Model Institusi: Meniru FDA atau NIH, ini akan melibatkan perhimpunan penyelidik, pegawai kerajaan, dan syarikat swasta untuk mencapai konsensus mengenai piawaian keselamatan.
- Model Pengauditan Pihak Ketiga: Seperti yang dicadangkan oleh bekas penasihat dasar Dean W. Ball, kerajaan boleh memberi lesen kepada organisasi pengauditan bebas untuk menilai protokol keselamatan makmal perintis.
Agar ekosistem AI dapat mencapai kestabilan jangka panjang, industri mesti beralih daripada rundingan peribadi kepada rangka kerja yang boleh diramal dan dipacu oleh pakar yang mengimbangi tanggungjawab fidusiari dengan keselamatan awam.
Ringkasan Utama
- Ketidakpastian Kawal Selia: Buat masa ini, tiada "lesen keselamatan" yang terpiawai atau agensi berpusat (seperti FDA) yang mengawal selia pelancaran model perintis seperti Sol.
- Jurang Ketelusan: Walaupun OpenAI memetik penilaian luaran daripada UK AISI dan SecureBio, dialog kerajaan yang khusus dan keperluan teknikal untuk kelulusan model tetap kabur.
- Seruan untuk Pakar: Pakar industri sedang menyokong pengauditan pihak ketiga dan rangka kerja "open commons" untuk memastikan keputusan keselamatan dibuat oleh penyelidik dan bukannya perantara politik.
