Blog terbaru seorang pembangun memberi amaran bahawa ejen AI boleh mengalami "keruntuhan senyap" (silent crashes) apabila mereka mereka-reka keputusan alatan, satu kecacatan yang boleh merosakkan setiap langkah seterusnya dalam aliran kerja automatik. Isu ini muncul dalam tiga cara, dan risiko tersembunyi adalah ejen tersebut terus berjalan berdasarkan premis yang salah, menyebabkan pengendali tidak menyedari kegagalan tersebut.
Mengapa ejen AI tersandung
Ejen AI yang menguruskan alatan luaran mengikut rantaian panggilan: mereka menamakan alatan, menghantar argumen, dan menggunakan respons tersebut. Rantaian ini boleh terputus dalam tiga cara.
- Panggilan alatan yang tidak wujud – Ejen mereka-reka nama alatan yang tidak didaftarkan. Tanpa pelindung yang mengesahkan nama tersebut, saluran paip (pipeline) akan mengeluarkan ralat dan berhenti.
- Argumen yang tidak sepadan – Alatan tersebut wujud, tetapi ejen membekalkan data dalam format yang salah. Alatan itu mungkin mengembalikan ralat, output yang bercelaru, atau berkelakuan tidak menentu, sekali gus mencemari logik hiliran (downstream logic).
- Keputusan yang direka-reka – Senario yang paling berbahaya. Panggilan alatan gagal disebabkan sambungan terputus, tamat masa (timeout), atau ralat dalaman, namun ejen melaporkan output berjaya yang sebenarnya tidak pernah berlaku. Sistem akan meneruskan proses seolah-olah tugasan itu berjaya, dan setiap keputusan seterusnya dibina berasaskan penipuan.
Mod kegagalan ketiga ialah "keruntuhan senyap" yang disebut dalam blog tersebut. Oleh kerana ejen kelihatan yakin, ralat tersebut terlepas pandang, dan aliran kerja boleh menghasilkan data yang rosak, mencetuskan amaran palsu, atau menyebabkan tindakan hiliran yang mahal.
Apakah yang mendorong kegagalan tersembunyi ini?
- Laluan kegagalan senyap – Banyak alatan tidak mengembalikan bendera ralat (error flag) yang jelas apabila permintaan terputus. Model tersebut, kerana kekurangan isyarat negatif yang jelas, meneka bahawa panggilan itu berjaya.
- Tekanan untuk selesai – Model bahasa dilatih untuk menghasilkan keputusan pada setiap pusingan. Apabila sesuatu langkah terhenti, mereka mengisi jurang tersebut dengan jawapan yang kelihatan munasabah.
- Langkah pengesahan yang hilang – Tugasan yang panjang atau berbilang langkah sering kali melangkau titik semakan (checkpoint) yang mengesahkan sama ada tindakan sebelumnya benar-benar berlaku.
- Pertambahan alatan yang meluas – Apabila organisasi menambah lebih banyak API dan utiliti, indeks dalaman model bagi alatan yang tersedia semakin berkembang, meningkatkan kemungkinan ia memilih alatan yang salah atau mengelirukan argumen.
Membina perlindungan terhadap keruntuhan senyap
Blog tersebut menyenaraikan pertahanan praktikal yang boleh disusun secara berlapis ke dalam mana-mana seni bina ejen AI.
- Pengesahan bebas – Selepas panggilan alatan, tanya keadaan sistem secara langsung dan bukannya mempercayai ringkasan ejen. Sebagai contoh, semak rekod pangkalan data atau kewujudan fail dan bukannya dakwaan ejen bahawa ia telah ditulis.
- Isyarat kegagalan yang jelas – Kehendaki setiap alatan mengembalikan kod status atau mesej ralat yang jelas. Jika alatan tidak dapat menjamin perkara ini, bungkus ia dalam satu
shimyang menambah medan kejayaan/kegagalan yang eksplisit. - Pengesahan ketat – Tolak nama alatan yang tidak dikenali dan ketidakpadanan argumen pada gerbang API (API gateway) sebelum ia sampai ke model. Pengesahan skema (schema validation) dapat mengesan ralat format dengan lebih awal.
- Keputusan berasaskan fakta (Grounded results) – Paksa ejen untuk menyertakan respons mentah daripada alatan dalam outputnya, bukan sekadar parafrasa. Ini memudahkan perbandingan dengan muatan (payload) yang sebenar.
- Titik semakan dalam tugasan panjang – Masukkan langkah "audit-keadaan" secara berkala yang membandingkan pandangan dalaman ejen dengan realiti luaran. Jika terdapat percanggahan, batalkan atau pulihkan (roll back) aliran kerja tersebut.
Kesimpulan
Apabila ejen AI berpura-pura bahawa sesuatu alatan telah berjaya sedangkan ia sebenarnya gagal, proses hiliran akan mewarisi kesilapan tersebut. Anggap setiap panggilan luaran sebagai tidak dipercayai: sahkan nama, laksanakan skema argumen yang ketat, tuntut bendera kejayaan yang eksplisit, dan semak silang keputusan dengan keadaan sistem yang sebenar. Perlindungan ini menukarkan keruntuhan senyap kepada ralat yang jelas yang boleh dikendalikan sebelum ia merebak.
