SpaceXAI’s Grok Build AI coding tool menuai kritik setelah para peneliti menemukan bahwa alat tersebut mengunggah seluruh repositori pengguna ke penyimpanan Google Cloud. Pelanggaran ini memicu kekhawatiran tentang seberapa banyak data milik perusahaan yang dapat diserap dan disimpan oleh asisten AI.

Retensi Data Berlebihan dan Risiko Keamanan

Analisis Cereblab menunjukkan bahwa antarmuka baris perintah (CLI) Grok Build mengemas dan mengirimkan seluruh basis kode ke cloud. Yang lebih meresahkan, alat tersebut membuka file yang seharusnya diabaikan dan mengambil rahasia (secrets) yang telah dihapus pengembang dari riwayat git.

Tingkat penimbunan data tersebut jauh melampaui pesaing seperti Claude Code. Dr. Lukasz Olejnik, seorang peneliti keamanan di King’s College London, memperingatkan bahwa pengumpulan semacam itu dapat mengekspos kode sumber, diagram infrastruktur, kerentanan, dan kredensial ke server jarak jauh.

Tanggapan dari SpaceXAI dan Elon Musk

SpaceXAI telah menonaktifkan fitur unggah tersebut. Para peneliti kini melihat adanya flag disable_codebase_upload: true pada server Grok, yang mengonfirmasi bahwa pengunggahan otomatis tidak lagi berjalan.

Elon Musk mengunggah pernyataan di X bahwa semua data yang telah diunggah sebelumnya akan "dihapus sepenuhnya dan secara total." Ia juga mendesak pengguna untuk membiarkan SpaceXAI menyimpan data untuk "masalah debugging," sebuah permintaan yang dianggap kontradiktif oleh banyak pihak.

Perusahaan menyarankan perintah CLI /privacy untuk mengelola retensi, namun Cereblab mencatat bahwa perintah tersebut hanya mengaktifkan/menonaktifkan penyimpanan per sesi—perintah itu tidak menghentikan pengunggahan repositori secara sistematis yang memicu skandal tersebut.

Mengapa Hal Ini Penting bagi Pengembang dan Perusahaan

Peristiwa ini memperingatkan para pengembang dan perusahaan bahwa agen pengodean berbasis AI bukan lagi sekadar alat pelengkap otomatis (autocomplete) sederhana; mereka dapat membaca, memodifikasi, dan melakukan commit kode secara mandiri. Ketika sebuah agen melewati file ignore atau menghidupkan kembali rahasia yang telah dihapus, klaim apa pun tentang "zero data retention" harus dibuktikan dengan pengujian teknis, bukan sekadar janji antarmuka pengguna (UI).

Bagi CTO dan pemilik produk, insiden ini menggarisbawahi perlunya:

  • Audit independen terhadap alat AI pada basis kode nyata.
  • Klausul kontraktual yang merinci penanganan data, periode retensi, dan jaminan penghapusan.
  • Perlindungan runtime yang menegakkan izin tingkat file, terutama untuk repositori yang menyimpan kredensial atau algoritma yang dipatenkan.

Poin-Poin Penting

  • Cakupan Data yang Tidak Disengaja: Grok Build mengunggah seluruh repositori, termasuk file yang dibatasi dan rahasia yang telah dihapus, ke Google Cloud.
  • Status Mitigasi: SpaceXAI telah menonaktifkan pengunggahan otomatis dan berjanji untuk menghapus data yang telah dikumpulkan.
  • Implikasi Keamanan: Pelanggaran ini menyoroti bahaya retensi data yang berlebihan pada agen pengodean AI, yang dapat membocorkan logika milik perusahaan dan kredensial.

Alat Grok Build milik SpaceXAI tertangkap mengunggah seluruh basis kode pengguna secara diam-diam ke Google Cloud, mengekspos file sumber milik perusahaan dan rahasia yang telah dihapus.

Apa yang Terjadi

Cereblab melacak lalu lintas jaringan CLI Grok Build ke bucket Google Cloud dan menemukan bahwa alat tersebut secara otomatis mengemas repositori git lengkap untuk diunggah. Singkatnya, asisten tersebut mengambil data yang seharusnya diabaikan.

Bagaimana Pelanggaran Terungkap

Para peneliti memeriksa payload dan melihat bahwa flag unggah diaktifkan secara default, tanpa opsi penolakan (opt-out) global. Dr. Lukasz Olejnik memperingatkan bahwa "retensi data berlebihan" semacam itu dapat membocorkan logika bisnis, detail infrastruktur, dan token autentikasi. Dibandingkan dengan asisten pengodean AI lainnya—dengan Claude Code sebagai titik acuan—perilaku Grok Build jauh lebih invasif.

Tanggapan SpaceXAI

Setelah laporan tersebut dipublikasikan, SpaceXAI merilis pembaruan yang mengembalikan flag disable_codebase_upload: true, yang secara efektif mematikan fitur tersebut. Elon Musk mengumumkan di X bahwa semua data yang diunggah akan "dihapus sepenuhnya dan secara total" dan menegaskan kembali bahwa "pengaturan privasi selalu dihormati." Ia juga meminta pengguna untuk membiarkan perusahaan menyimpan data untuk "masalah debugging," sebuah permintaan yang dianggap kontradiktif oleh banyak orang.

Perusahaan menyarankan perintah CLI /privacy untuk mengontrol retensi, tetapi para peneliti menunjukkan bahwa perintah tersebut hanya mengaktifkan/menonaktifkan penyimpanan per sesi dan tidak menghentikan pengunggahan repositori secara sistematis.

Mengapa Hal Ini Penting bagi Pengembang dan Perusahaan

Agen pengodean berbasis AI sedang berevolusi dari sekadar autocomplete menjadi alat otonom yang dapat membaca, memodifikasi, dan melakukan commit kode. Ketika sebuah agen dapat melewati file ignore lokal atau menghidupkan kembali rahasia yang telah dihapus, janji apa pun tentang “zero data retention” harus diverifikasi dengan pengujian teknis, bukan hanya pengaturan UI. CTO dan pemilik produk harus:

  • Lakukan audit independen terhadap perilaku alat AI pada basis kode nyata.
  • Negosiasikan kontrak yang jelas yang menentukan penanganan data, periode retensi, dan jaminan penghapusan.
  • Implementasikan pengamanan runtime yang menegakkan izin tingkat file untuk repositori sensitif.

Pelanggaran ini juga menimbulkan pertanyaan yang lebih luas mengenai pertukaran (trade-off) antara kenyamanan AI dan keamanan. SpaceXAI mengklaim bahwa fitur unggah mengumpulkan metrik penggunaan untuk meningkatkan model, dan mereka telah menonaktifkan fitur tersebut serta berjanji untuk menghapus unggahan yang sudah ada. Para kritikus mencatat bahwa desain aslinya tidak memiliki opsi pembatalan (opt-out) yang transparan dan bahwa perintah privasi pasca-insiden tidak melindungi data yang sudah ada di cloud secara retroaktif.

Argumen Balasan dari SpaceXAI

SpaceXAI berargumen bahwa fitur unggah dimaksudkan untuk mengumpulkan metrik penggunaan guna peningkatan model. Mereka menunjukkan penonaktifan fitur yang cepat dan janji untuk menghapus unggahan yang ada sebagai bukti respons yang bertanggung jawab. Para kritikus menyanggah bahwa desain awal tidak menawarkan opsi pembatalan yang jelas dan perintah privasi tersebut gagal melindungi data yang sudah tersimpan di cloud.

Kesimpulan

Ketika asisten pengodean AI dapat menyedot seluruh repositori secara diam-diam, kepercayaan menjadi masalah teknis, bukan masalah pemasaran. Organisasi harus menuntut kontrol yang dapat diverifikasi dan ditegakkan untuk mencegah eksfiltrasi data tersembunyi, atau berisiko mengekspos kode yang justru memberikan mereka keunggulan kompetitif.