Bug kebocoran prompt Anthropic mengekspos data pengguna selama satu minggu.

Mengapa pelanggaran ini penting

Antarmuka model Anthropic memungkinkan pengembang mengirimkan “prompt”—teks yang mengarahkan respons model bahasa. Dalam insiden tersebut, celah penyimpanan memungkinkan pihak yang tidak berwenang membaca prompt tersebut selama tujuh hari. Kebocoran ini tidak melibatkan peretasan besar-besaran; sebuah kelalaian kecil dalam cara prompt disimpan dan diambil telah membuka celah tersebut.

Apa yang salah

Memisahkan data pengguna dari bobot model (model weights) dapat membatasi paparan. Membangun jejak audit (audit trails) dapat mendeteksi aktivitas tidak biasa lebih dini.

Tindakan segera untuk startup AI

  • Perkuat penanganan prompt – Perlakukan setiap prompt yang masuk sebagai input sensitif. Enkripsi saat data disimpan (at rest), batasi hak baca/tulis ke set layanan terkecil, dan pastikan hanya mesin eksekusi model yang dapat mengambilnya.
  • Pisahkan data pengguna dari bobot model – Simpan prompt dalam repositori khusus yang secara fisik dan logis terpisah dari file model. Pemisahan ini membatasi radius dampak (blast radius) dari setiap pelanggaran tunggal.
  • Buat jejak audit – Catat setiap akses ke penyimpanan prompt dengan stempel waktu, ID pengguna, dan IP sumber. Jalankan analitik real-time yang memicu peringatan pada volume pembacaan yang tidak normal atau akses dari layanan yang tidak terduga.

Apa yang perlu diperhatikan selanjutnya

Intinya: Satu celah penanganan prompt dapat berujung pada paparan data selama seminggu. Pendiri AI harus menerapkan ketelitian yang sama pada penyimpanan prompt seperti halnya pada sistem data pengguna lainnya, atau mereka akan mengulangi kesalahan mahal Anthropic.