Google zmienił zasady gry. Jeśli w zeszłym tygodniu zrobiłeś zdjęcie przez Google Lens, przećwiczyłeś na głos hiszpańską frazę w Google Translate lub poprosiłeś Maps o znalezienie miejsca na lunch, te treści mogą teraz znajdować się w kolejce do trenowania modeli generatywnej sztucznej inteligencji firmy. Google niedawno przebudowało swoją architekturę prywatności w taki sposób, aby obrazy, klipy audio i filmy przesyłane przez użytkowników w całym swoim ekosystemie mogły być przechowywane i wykorzystywane do budowy systemów uczenia maszynowego. Jest to celowy zwrot od scrapowania publicznych stron internetowych w stronę pozyskiwania bezpośrednich interakcji o wysokim stopniu intencjonalności, jakie ludzie codziennie wchodzą w relację z produktami Google.
Cicha zmiana polityki
To nie jest rutynowa aktualizacja regulaminu. Przez lata standardowy schemat trenowania dużych modeli AI polegał na przeszukiwaniu miliardów publicznych stron internetowych i zbieraniu tekstów, obrazów oraz linków, które były już widoczne dla świata. Takie podejście ma swoje ograniczenia. Otwarty internet jest skończony, a w wielu dziedzinach najcenniejsze publiczne dane zostały już wyekstrahowane i wprowadzone do istniejących systemów. Konkurenci, tacy jak Meta, niedawno postawili na wykorzystywanie treści generowanych przez użytkowników, a Google podąża teraz w tym samym kierunku.
Aktualizacja dotarła do użytkowników za pośrednictwem wiadomości e-mail, która wprowadziła dwie nowe funkcje kontroli prywatności: Search Services History oraz Personalized Recommendations. Na pierwszy rzut oka brzmią one jak standardowe narzędzia personalizacji, mające na celu przyspieszenie kolejnego zapytania lub doprecyzowanie rekomendacji. Jeśli jednak przeczytasz drobny druk, zakres staje się jasny. Google stwierdza, że zapisane multimedia mogą być używane do „rozwoju i ulepszania usług i technologii Google, w tym modeli AI i środków bezpieczeństwa”. Sformułowanie jest ogólne, domyślne ustawienie jest włączone, a aby zrezygnować, trzeba wiedzieć, gdzie szukać.
Czego Google tak naprawdę od Ciebie chce
Parasol zbierania danych obejmuje niemal każdą ważną usługę Google, z której korzystasz. Kiedy turysta kieruje Google Lens na zagraniczny znak drogowy lub menu w restauracji, dane wizualne nie znikają po wyświetleniu wyników. Kiedy uczeń używa Google Translate, aby ćwiczyć mówienie na głos, nagrania audio zarejestrowane podczas tych sesji mogą zostać zachowane. Zapytania głosowe przesyłane przez Search Live lub standardowe wyszukiwanie głosowe podlegają tej samej polityce. Nawet rutynowe interakcje z Maps, Shopping, Flights, Hotels i News mogą generować multimedia, które Google klasyfikuje teraz jako materiał treningowy.
Wcześniej użytkownicy, dla których prywatność była priorytetem, mogli polegać na przełączniku Web & App Activity, aby ograniczyć ilość przechowywanych przez Google danych z tych interakcji. Ta strategia już nie działa. Google wyraźnie oddzieliło te nowe ustawienia od Web & App Activity. Search Services History jest niezależną funkcją kontrolną. Jest ona włączona domyślnie, a jakiekolwiek wybory dokonane w panelu prywatności dwa lub trzy lata temu nie powstrzymają przechowywania multimediów związanych z wyszukiwaniem na potrzeby trenowania AI. Stary przełącznik „wyłącz” nie kontroluje już tego konkretnego obwodu.
Jak faktycznie zrezygnować
Google oferuje możliwość ręcznego nadpisania ustawień, ale cały ciężar spoczywa na Tobie. Nie ma jednego przełącznika dla całego konta, który jednym kliknięciem wyłączy zbieranie danych do trenowania AI. Musisz odwiedzić dwie konkretne strony w panelu zarządzania kontem Google: stronę Search Services History oraz stronę Search Services Personalization.
Po wejściu do Search Services History przewiń w dół, aż znajdziesz pole wyboru „Save Media”. Odznacz je. Ta pojedyncza czynność zapobiega przechowywaniu przyszłych obrazów, dźwięków i filmów oraz ich potencjalnemu wykorzystaniu w trenowaniu modeli. Nie zakładaj, że wyłączenie Web & App Activity załatwi to za Ciebie. Tak się nie stanie. Rozdzielenie tych funkcji jest wyraźne i łatwe do przeoczenia, co oznacza, że wielu użytkowników będzie wierzyć, że zrezygnowało, mimo że tak nie jest.
Po wyłączeniu zapisywania multimediów skonfiguruj preferencje automatycznego usuwania, będąc w tym samym panelu. Google oferuje trzy opcje: usuwanie danych po 3, 18 lub 36 miesiącach. Jeśli chcesz mieć najściślejszą kontrolę, wybierz okres trzech miesięcy. Jest to najkrótszy cykl czyszczenia danych, na jaki pozwala Google za pomocą tej funkcji, co ogranicza nagromadzenie Twoich historycznych interakcji. Pamiętaj, że wyłączenie „Save Media” zatrzymuje przyszłe zbieranie danych. Wszystko, co Google już zarejestrowało na podstawie poprzednich ustawień, może pozostać w pamięci, chyba że ręcznie usuniesz swoją dotychczasową historię za pomocą tych samych narzędzi konta.
Jeśli zarządzasz współdzielonym kontem rodzinnym lub przestrzenią roboczą, w której wiele osób korzysta z usług Google, każdy użytkownik z dostępem powinien indywidualnie sprawdzić te ustawienia. Kontrola personalizacji jest powiązana z kontem, a nie z urządzeniem, a domyślna zgoda (opt-in) obowiązuje we wszystkich przypadkach.
Co to mówi nam o kolejnej fazie rozwoju AI
Ta zmiana polityki jest jasnym sygnałem dotyczącym kierunku, w którym zmierza branża. Publiczny internet został już dokładnie przeszukany pod kątem materiałów treningowych. Kolejną granicą w doskonaleniu dużych modeli językowych i systemów multimodalnych są dane zastrzeżone, generowane przez prawdziwych ludzi wewnątrz zamkniętych platform. Twoje wyszukiwania wizualne zawierają kontekst przestrzenny. Twoje sesje ćwiczeń tłumaczeniowych zawierają wzorce wymowy i intencje konwersacyjne. Twoje zapytania głosowe zawierają ton, sformułowania i poczucie pilności, których statyczny tekst internetowy nie jest w stanie odtworzyć.
Dla programistów, założycieli firm i każdego, kto obserwuje krajobraz konkurencyjny, wniosek jest oczywisty. „Fosa danych” (data moat), która oddziela jeden duży model językowy od drugiego, jest coraz częściej budowana na bazie prywatnych interakcji i materiałów przesyłanych przez użytkowników danej platformy. Przeszukiwanie sieci typu open-source wciąż jest przydatne, ale dane o najwyższej wartości to obecnie te, które tworzysz, będąc zalogowanym do usługi i aktywnie próbując coś załatwić.
Podsumowanie
Twoje dotychczasowe zasady ochrony prywatności są już nieaktualne. Nowy reżim danych treningowych Google wymaga konkretnej, świadomej rezygnacji (opt-out) w ramach historii usług wyszukiwania (Search Services History) poprzez odznaczenie pola „Zapisuj multimedia” (Save Media). To działanie, w połączeniu z krótkim oknem automatycznego usuwania, jest jedynym niezawodnym sposobem na to, aby przesłane przez Ciebie obrazy, dźwięki i filmy nie trafiły do procesu trenowania AI Google. Podaj dalej. Domyślne ustawienia nie są już skonfigurowane na Twoją korzyść.