CTO Arcee Mencabar Kebimbangan Terhadap Model AI Open-Weight China

Memandangkan model open-weight China seperti Qwen daripada Alibaba dan Kimi K3 daripada Moonshot AI semakin popular, satu perdebatan hangat telah timbul mengenai implikasi keselamatannya. Walaupun ada yang bimbang model ini boleh menjadi vektor untuk serangan siber, yang membawa kepada potensi larangan oleh kerajaan AS, pakar-pakar menolak idea bahawa model tersebut berbahaya secara semula jadi.

Membongkar Naratif "Niat Jahat"

Kebimbangan utama yang dinyatakan oleh pengkritik adalah model yang dibangunkan oleh China mungkin mengandungi "niat tersembunyi" atau pintu belakang (backdoor) yang dikodkan oleh pihak yang berniat jahat. Walau bagaimanapun, Lucas Atkins, CTO makmal AI berpangkalan di AS, Arcee, berhujah bahawa salah faham ini pada dasarnya salah menggambarkan cara Model Bahasa Besar (LLM) berfungsi.

Berbeza dengan perisian tradisional, di mana pembangun boleh mengodkan arahan berniat jahat yang khusus secara eksplisit, LLM adalah hasil daripada proses latihan. Atkins menyatakan bahawa sebaik sahaja model open-weight dimuat turun dan dijalankan dalam persekitaran tempatan yang peribadi, pembangun asal tidak mempunyai cara untuk mengakses atau mengawal instans tersebut. Pemisahan antara pemberat model (model weights) dan infrastruktur pengguna ini menyediakan lapisan keselamatan kritikal yang tidak dimiliki oleh perisian tradisional.

Realiti Teknikal Keselamatan Model

Walaupun perdebatan berterusan, komuniti teknikal menekankan bahawa risiko tingkah laku AI yang "halus" adalah sangat rendah. Satu kebimbangan teori adalah sama ada model pengekodan boleh dilatih untuk menyuntik perisian hasad (malware) ke dalam pangkalan kod tertentu. Walaupun Atkins mengakui perkara ini secara teorinya mungkin berlaku, beliau menyatakan ia memerlukan "pencapaian akrobatik" kejuruteraan yang pada masa ini tidak praktikal.

Tambahan pula, sifat LLM adalah probabilistik dan kreatif, menjadikan "ribut sempurna" yang diperlukan untuk mencetuskan tindak balas berniat jahat yang khusus adalah sangat tidak mungkin. Bagi perusahaan, keselamatan diuruskan melalui beberapa lapisan standard:

  • Ujian Keselamatan: Organisasi besar menjalankan proses pemeriksaan yang ketat terhadap teras model.
  • Pasca-Latihan: Syarikat melakukan penalaan halus (fine-tune) pada model untuk tugas khusus, membolehkan mereka mengaudit bias, toksisiti, dan halusinasi.
  • Agnostik Model: Seni bina AI moden semakin bersifat agnostik model, bermakna perusahaan boleh menukar model China kepada alternatif AS tanpa perlu membina semula keseluruhan timbunan (stack) teknologi mereka.

Persaingan Melalui Inovasi, Bukan Kawal Selia

Arcee, yang membina model terbuka untuk menyediakan alternatif tempatan kepada syarikat-syarikat AS, berada dalam kedudukan yang unik. Walaupun larangan terhadap model China secara teorinya akan memberi manfaat kepada perniagaan mereka, Atkins berhujah bahawa tumpuan harus beralih daripada larangan kepada memupuk ekosistem domestik yang teguh.

Menariknya, kebangkitan model China yang berprestasi tinggi sebenarnya mempercepatkan inovasi di Barat. Arcee menggunakan model open-weight ini untuk belajar daripada seni bina dan keupayaannya, memacu kitaran penambahbaikan berterusan. Menurut Atkins, cara terbaik untuk makmal AS bersaing bukanlah melalui dasar, tetapi melalui prestasi: "Cara untuk bersaing dengan model China adalah dengan mengeluarkan model yang lebih baik."

Ringkasan Utama

  • Keselamatan melalui Pengasingan: Sebaik sahaja model open-weight digunakan dalam pusat data peribadi, pembangun asal tidak mempunyai mekanisme untuk mengakses atau memanipulasi persekitaran tempatan tersebut.
  • Risiko Teori vs. Praktikal: Walaupun "latihan tersembunyi" untuk suntikan kod berniat jahat adalah mungkin secara teori, ia kekal sebagai pencapaian yang sangat kompleks dan tidak mungkin berlaku dalam seni bina LLM semasa.
  • Inovasi melalui Persaingan: Daripada mengejar larangan, sektor AI AS boleh mendapat manfaat daripada tekanan persaingan dan perkongsian pengetahuan yang disediakan oleh model open-weight berprestasi tinggi dari China.