Bagaimana penyalahgunaan tersebut terbongkar

Pemantauan dalaman Anthropic telah menandakan siri pertanyaan “kegunaan dwi-fungsi” (dual-use)—permintaan yang boleh menyokong penyelidikan sah tetapi juga membolehkan aplikasi berbahaya. Seorang penyelidik meminta Claude untuk mereka bentuk mutasi yang akan menjadikan virus Chikungunya lebih mudah berjangkit. Susunan kata permintaan tersebut dan ujian berulang kali ke atas haiwan hidup menunjukkan konteks penyelidikan ketenteraan, bukannya usaha kesihatan awam. Untuk menyembunyikan niat sebenar, pengguna tersebut menggunakan frasa yang mengelirukan, yang mendorong Anthropic untuk memperketat kawalan keselamatan biologi pada model-model terbaharunya yang lebih berupaya.

Siasatan selari mendedahkan percubaan untuk menjana skematik dan kod sumber bagi senjata api, sistem panduan peluru berpandu, dron bersenjata dan komponen bom. Enam pertanyaan dikesan berpunca daripada alamat IP di China, Rusia dan Yaman; aktiviti di Yaman nampaknya berkaitan dengan gerakan Houthi yang disokong oleh Iran. Dalam satu cabang berasingan, Anthropic mengenal pasti kempen disinformasi dipacu AI: aktor kerajaan China dan Iran menggunakan Claude untuk memantau komuniti diaspora, manakala media milik negara Rusia menggunakan model tersebut untuk menghasilkan artikel “bebas” yang menyebarkan dakwaan palsu tentang pilihan raya di Moldova.

Mengapa laporan ini penting

Pendedahan ini muncul ketika model AI berkembang daripada bot sembang kepada alat yang mampu melakukan penaakulan saintifik. Bagi kerajaan, risikonya adalah dua kali ganda. Pertama, akses mudah kepada AI canggih merendahkan halangan bagi aktor negara atau bukan negara untuk melancarkan program senjata haram. Kedua, model yang sama menjadi vektor untuk peperangan maklumat, membolehkan propaganda canggih yang sukar dikesan. Laporan ini menambah tekanan kepada penggubal dasar untuk menganggap AI sebagai teknologi kegunaan dwi-fungsi yang tertakluk kepada kawalan eksport, peraturan keselamatan biologi dan strategi pertahanan siber.

Tindak balas Anthropic dan ketegangan dalaman

Sebagai tindak balas, Anthropic telah melancarkan kawalan keselamatan yang lebih ketat pada keluarga model terbaharunya, dengan menyekat secara eksplisit pertanyaan yang meminta manipulasi patogen atau reka bentuk senjata.

Laporan tersebut muncul di tengah-tengah geseran dalaman. Penyelidik Jacob Coxon meletak jawatan awal tahun ini, memberi amaran bahawa dorongan pantas industri ke arah sistem yang lebih berkuasa mengatasi pembangunan rangkaian keselamatan. Peletakan jawatannya menekankan perdebatan yang lebih luas: firma AI swasta bertindak sebagai “polis digital” de facto, memutuskan apa yang dianggap sebagai ancaman keselamatan tanpa rangka kerja kerajaan yang jelas. Pengkritik berhujah bahawa kawal selia kendiri tidak dapat menandingi kebijaksanaan musuh, manakala penyokong menunjukkan perubahan polisi Anthropic yang pantas sebagai bukti bahawa industri boleh menyesuaikan diri dengan cepat.

Apakah implikasi penemuan ini terhadap India

  • Kewaspadaan keselamatan biologi – Sektor bioteknologi India yang sedang berkembang akan semakin bergantung pada AI untuk penemuan ubat dan analisis patogen. Menanamkan pemantauan dipacu AI ke dalam protokol keselamatan biologi sedia ada boleh mengesan percubaan untuk menyalahgunakan alatan domestik bagi penyelidikan kegunaan dwi-fungsi.
  • Mempertahankan wacana demokratik – Penggunaan Claude untuk memantau kumpulan diaspora dan menyebarkan pembohongan berkaitan pilihan raya menandakan keperluan untuk langkah pertahanan siber yang lebih kuat dan kempen kesedaran awam yang dapat mengesan disinformasi janaan AI.
  • Membina keupayaan AI berdaulat – Kebergantungan kepada model berasaskan AS untuk kerja saintifik berisiko tinggi menonjolkan jurang strategik. Membangunkan model tempatan yang menerapkan piawaian keselamatan dan garis panduan etika India boleh mengurangkan pendedahan kepada pengaruh asing dan mengawal aliran keupayaan AI yang sensitif.

Sudut pandangan berbeza: hujah untuk kawal selia kendiri

Pelancaran penapis baharu Anthropic yang pantas menunjukkan bahawa firma swasta boleh bergerak lebih laju daripada banyak badan perundangan. Syarikat itu berhujah bahawa polisi “penggunaan bertanggungjawab” mereka, digabungkan dengan ujian pasukan merah (red-team) yang berterusan, menyediakan penyelesaian sementara yang pragmatik sementara kerajaan membincangkan peraturan formal. Penyokong menyatakan bahawa undang-undang yang terlalu mengongkong boleh menyekat inovasi, terutamanya dalam bidang di mana AI mempercepatkan penemuan perubatan. Cabarannya adalah untuk mencapai keseimbangan di mana kawalan keselamatan industri adalah telus dan boleh diaudit, tanpa menghalang aplikasi bermanfaat yang dijanjikan oleh AI.

Apa yang perlu diperhatikan seterusnya

  • Langkah kawal selia – Jangkakan penelitian yang lebih ketat daripada agensi kawalan eksport dan pengawal selia keselamatan biologi, yang berpotensi membawa kepada garis panduan baharu yang melayan model generatif termaju sebagai teknologi terkawal.
  • Kerjasama industri – Anthropic mungkin menyertai atau memperluas koalisi keselamatan AI sedia ada untuk berkongsi risikan ancaman, satu langkah yang boleh menyeragamkan pelaporan percubaan penggunaan dwi-guna di seluruh sektor.
  • Tindak balas negara – Negara-negara yang dikenal pasti dalam laporan tersebut berkemungkinan akan menafikan penglibatan mereka dan mungkin mempercepatkan program pembangunan AI mereka sendiri, mewujudkan gelung maklum balas yang boleh mengaburkan lagi garis pemisah antara penggunaan AI untuk pertahanan dan serangan.

Laporan Anthropic menunjukkan bahawa kuasa generatif yang sama yang membantu saintis memodelkan protein juga boleh dijadikan senjata, dan bahawa keselamatan AI kini terletak sepenuhnya dalam ranah geopolitik. Bulan-bulan mendatang akan menguji sama ada kawal selia kendiri, dasar kerajaan, atau pendekatan hibrid dapat menghalang teknologi tersebut daripada menjadi alat konflik.