Google telah mengubah aturan mainnya. Jika Anda mengambil foto melalui Google Lens minggu lalu, melatih frasa bahasa Spanyol dengan suara keras di Google Translate, atau meminta Maps untuk mencari tempat makan siang, konten tersebut kini mungkin sedang berada dalam antrean untuk melatih model AI generatif perusahaan tersebut. Google baru-baru ini merestrukturisasi arsitektur privasinya sehingga gambar, klip audio, dan video yang diunggah pengguna di seluruh ekosistemnya dapat disimpan dan digunakan untuk membangun sistem pembelajaran mesin (machine learning). Ini adalah peralihan yang disengaja dari pengambilan data (scraping) halaman web publik menuju pemanenan interaksi langsung dengan intensitas tinggi yang dilakukan orang setiap hari dengan produk-produk Google.

Pergeseran Kebijakan yang Senyap

Ini bukan pembaruan ketentuan layanan (terms-of-service) rutin. Selama bertahun-tahun, strategi standar untuk melatih model AI besar melibatkan perayapan (crawling) miliaran halaman web publik, mengumpulkan teks, gambar, dan tautan yang sudah terlihat oleh dunia. Pendekatan tersebut memiliki batasan. Web terbuka bersifat terbatas, dan di banyak domain, data publik yang paling berharga telah diekstraksi dan dimasukkan ke dalam sistem yang sudah ada. Kompetitor seperti Meta baru-baru ini mendorong penggunaan konten buatan pengguna (user-generated content), dan Google kini bergerak ke arah yang sama.

Pembaruan ini sampai ke pengguna melalui email pelanggan yang memperkenalkan dua kontrol privasi baru: Search Services History dan Personalized Recommendations. Secara sekilas, ini terdengar seperti alat personalisasi standar yang dimaksudkan untuk mempercepat kueri Anda berikutnya atau menyempurnakan rekomendasi Anda. Namun, jika Anda membaca detail kecilnya, cakupannya menjadi jelas. Google menyatakan bahwa media yang disimpan dapat digunakan untuk "mengembangkan dan meningkatkan layanan dan teknologi Google, termasuk model AI dan langkah-langkah keamanan." Redaksinya sangat luas, pengaturan default-nya aktif, dan untuk membatalkannya (opting out), Anda harus tahu ke mana harus mencari.

Apa yang Sebenarnya Google Inginkan dari Anda

Payung pengumpulan data ini mencakup hampir setiap layanan utama Google yang Anda gunakan. Ketika seorang turis mengarahkan Google Lens ke papan jalan asing atau menu makan malam, input visual tersebut tidak sekadar menghilang setelah hasilnya muncul. Ketika seorang siswa menggunakan Google Translate untuk berlatih berbicara keras-keras, rekaman audio yang ditangkap selama sesi tersebut memenuhi syarat untuk disimpan. Kueri suara yang dikirim melalui Search Live atau pencarian suara standar juga termasuk dalam kebijakan yang sama. Bahkan interaksi rutin dengan Maps, Shopping, Flights, Hotels, dan News dapat menghasilkan media yang kini diklasifikasikan oleh Google sebagai materi pelatihan.

Sebelumnya, pengguna yang sangat peduli dengan privasi dapat mengandalkan sakelar Web & App Activity untuk membatasi seberapa banyak data interaksi ini yang disimpan oleh Google. Strategi tersebut tidak lagi berhasil. Google secara eksplisit telah memisahkan pengaturan baru ini dari Web & App Activity. Search Services History adalah kontrol mandiri. Pengaturannya aktif secara default, dan apa pun pilihan yang Anda buat di dasbor privasi Anda dua atau tiga tahun lalu tidak akan menghentikan media terkait pencarian Anda untuk disimpan guna pelatihan AI. Sakelar "off" yang lama tidak lagi mengontrol sirkuit khusus ini.

Cara Sebenarnya untuk Membatalkan (Opt Out)

Google memang menyediakan pembatalan manual, tetapi bebannya sepenuhnya ada pada Anda. Tidak ada sakelar tunggal di seluruh akun yang dapat menonaktifkan pengumpulan data pelatihan AI dalam satu klik. Anda perlu mengunjungi dua halaman khusus di dalam dasbor akun Google Anda: halaman Search Services History dan halaman Search Services Personalization.

Setelah Anda masuk ke Search Services History, gulir hingga Anda menemukan kotak centang "Save Media". Hapus centangnya. Tindakan tunggal itulah yang mencegah gambar, audio, dan video di masa mendatang disimpan dan berpotensi dimasukkan ke dalam pelatihan model. Jangan berasumsi bahwa menonaktifkan Web & App Activity akan menangani hal ini untuk Anda. Tidak akan. Pemisahan ini sangat eksplisit dan mudah terlewatkan, yang berarti banyak pengguna akan percaya bahwa mereka telah membatalkan (opt out) padahal sebenarnya belum.

Setelah Anda menonaktifkan penyimpanan media, atur preferensi hapus otomatis (auto-delete) selagi Anda masih di dasbor yang sama. Google menawarkan tiga pilihan: hapus data setelah 3 bulan, 18 bulan, atau 36 bulan. Jika Anda menginginkan kontrol yang paling ketat, pilih jendela tiga bulan. Itu adalah siklus pembersihan terpendek yang diizinkan Google melalui kontrol ini, dan hal itu membatasi tumpukan interaksi historis Anda. Perlu diingat bahwa mematikan Save Media menghentikan pengumpulan di masa mendatang. Apa pun yang telah dicatat Google di bawah pengaturan sebelumnya mungkin tetap tersimpan kecuali Anda menghapus riwayat yang ada secara manual melalui alat akun yang sama.

Jika Anda mengelola akun keluarga bersama atau ruang kerja di mana banyak orang berinteraksi dengan layanan Google, setiap orang yang memiliki akses harus memeriksa pengaturan ini secara individual. Kontrol personalisasi terikat pada akun, bukan perangkat, dan pilihan opt-in default berlaku untuk semuanya.

Apa yang Hal Ini Beritahukan kepada Kita Tentang Fase AI Berikutnya

Perubahan kebijakan ini adalah sinyal jelas tentang ke mana arah industri ini. Web publik telah digali secara menyeluruh untuk materi pelatihan. Batas baru untuk meningkatkan model bahasa besar (large language models) dan sistem multimodal adalah data kepemilikan yang dihasilkan oleh orang sungguhan di dalam platform tertutup. Pencarian visual Anda mengandung konteks spasial. Sesi latihan terjemahan Anda mengandung pola pengucapan dan maksud percakapan. Kueri suara Anda mengandung nada, frasa, dan urgensi yang tidak dapat direplikasi oleh teks web statis.

Bagi pengembang, pendiri, dan siapa pun yang mengamati lanskap kompetitif, implikasinya sangat jelas. "Parit data" (data moat) yang membedakan satu model bahasa besar dengan yang lainnya semakin banyak digali dari interaksi pribadi dan unggahan basis pengguna platform itu sendiri. Hasil perayapan web sumber terbuka (open-source web crawls) masih berguna, tetapi data dengan nilai tertinggi saat ini adalah jenis data yang Anda buat saat masuk ke sebuah layanan dan secara aktif mencoba menyelesaikan sesuatu.

Intinya

Panduan privasi lama Anda sudah usang. Rezim data pelatihan baru Google memerlukan pembatalan pilihan (opt-out) yang spesifik dan sengaja di dalam Search Services History dengan menghapus centang pada kotak Save Media. Tindakan tersebut, dikombinasikan dengan jendela penghapusan otomatis yang ketat, adalah satu-satunya cara andal untuk menjaga agar gambar, audio, dan video yang Anda unggah tetap berada di luar jalur pelatihan AI Google. Sebarkan informasi ini. Pengaturan default tidak lagi berpihak pada Anda.