O Google mudou as regras do jogo. Se você tirou uma foto pelo Google Lens na semana passada, praticou uma frase em espanhol em voz alta no Google Translate ou pediu ao Maps para localizar um lugar para almoçar, esse conteúdo pode agora estar em uma fila para treinar os modelos de IA generativa da empresa. O Google reestruturou recentemente sua arquitetura de privacidade para que imagens, clipes de áudio e vídeos enviados pelos usuários em todo o seu ecossistema possam ser retidos e usados para construir sistemas de machine learning. É uma mudança deliberada, afastando-se da raspagem de páginas web públicas em direção à colheita das interações diretas e de alta intenção que as pessoas têm com os produtos do Google todos os dias.
A Mudança Silenciosa de Política
Esta não é uma atualização rotineira dos termos de serviço. Durante anos, o roteiro padrão para o treinamento de grandes modelos de IA envolvia rastrear bilhões de páginas web públicas, coletando textos, imagens e links que já estavam visíveis para o mundo. Essa abordagem tem limites. A web aberta é finita e, em muitos domínios, os dados públicos mais valiosos já foram extraídos e alimentados em sistemas existentes. Concorrentes como a Meta pressionaram recentemente para explorar o conteúdo gerado pelo usuário, e o Google agora está seguindo a mesma direção.
A atualização chegou aos usuários por meio de um e-mail de cliente que introduziu dois novos controles de privacidade: Search Services History e Personalized Recommendations. À primeira vista, parecem ferramentas de personalização padrão destinadas a agilizar sua próxima consulta ou refinar suas recomendações. Leia as letras miúdas, no entanto, e o escopo ficará claro. O Google afirma que a mídia salva pode ser usada para "desenvolver e melhorar os serviços e tecnologias do Google, incluindo modelos de IA e medidas de segurança". A redação é ampla, a configuração padrão está ativada e optar por sair exige que você saiba onde procurar.
O Que o Google Realmente Quer de Você
O guarda-chuva de coleta de dados abrange quase todos os principais serviços do Google que você utiliza. Quando um turista aponta o Google Lens para uma placa de rua estrangeira ou um cardápio de jantar, a entrada visual não simplesmente desaparece após o surgimento dos resultados. Quando um estudante usa o Google Translate para praticar a fala em voz alta, as gravações de áudio capturadas durante essas sessões são elegíveis para retenção. Consultas de voz enviadas através do Search Live ou da busca por voz padrão entram na mesma política. Mesmo interações rotineiras com Maps, Shopping, Flights, Hotels e News podem gerar mídia que o Google agora classifica como material de treinamento.
Anteriormente, os usuários que levavam a privacidade a sério podiam contar com a chave Web & App Activity para limitar quanto desses dados de interação o Google retinha. Essa estratégia não funciona mais. O Google desacoplou explicitamente essas novas configurações da Web & App Activity. O Search Services History é um controle independente. Ele vem ativado por padrão, e quaisquer escolhas que você tenha feito no seu painel de privacidade dois ou três anos atrás não impedirão que sua mídia relacionada à pesquisa seja armazenada para o treinamento de IA. O antigo interruptor de desligar não controla mais este circuito específico.
Como Realmente Desativar a Coleta
O Google oferece uma sobreposição manual, mas o ônus é inteiramente seu. Não existe uma chave única para toda a conta que desative a coleta de dados de treinamento de IA com um clique. Você precisa visitar duas páginas específicas dentro do painel da sua conta Google: a página Search Services History e a página Search Services Personalization.
Assim que estiver dentro do Search Services History, role até encontrar a caixa de seleção "Save Media". Desmarque-a. Essa única ação é o que impede que futuras imagens, áudios e vídeos sejam armazenados e potencialmente alimentados no treinamento de modelos. Não presuma que desativar a Web & App Activity resolverá isso para você. Não resolverá. O desacoplamento é explícito e fácil de passar despercebido, o que significa que muitos usuários acreditarão que optaram por sair quando, na verdade, não o fizeram.
Depois de desativar o salvamento de mídia, configure suas preferências de exclusão automática enquanto ainda estiver no mesmo painel. O Google oferece três opções: excluir dados após 3 meses, 18 meses ou 36 meses. Se você quiser o controle mais rigoroso, escolha a janela de três meses. Esse é o ciclo de limpeza mais curto que o Google permite por meio deste controle, e limita o acúmulo de suas interações históricas. Tenha em mente que desligar o "Save Media" interrompe a coleta futura. Qualquer coisa que o Google já tenha registrado sob as configurações anteriores pode permanecer armazenada, a menos que você exclua manualmente seu histórico existente por meio das mesmas ferramentas da conta.
Se você gerencia uma conta familiar compartilhada ou um espaço de trabalho onde várias pessoas interagem com os serviços do Google, todos com acesso devem verificar essas configurações individualmente. Os controles de personalização estão vinculados à conta, não ao dispositivo, e a opção de adesão (opt-in) padrão se aplica a todos.
O que isso nos diz sobre a próxima fase da IA
Esta mudança de política é um sinal claro de para onde a indústria está caminhando. A web pública foi exaustivamente minerada para obter material de treinamento. A próxima fronteira para o aprimoramento de grandes modelos de linguagem e sistemas multimodais são os dados proprietários gerados por pessoas reais dentro de plataformas fechadas. Suas buscas visuais contêm contexto espacial. Suas sessões de prática de tradução contêm padrões de pronúncia e intenção conversacional. Suas consultas de voz contêm tom, fraseado e urgência que o texto estático da web não consegue replicar.
Para desenvolvedores, fundadores e qualquer pessoa que esteja observando o cenário competitivo, a implicação é direta. O "fosso de dados" (data moat) que separa um grande modelo de linguagem de outro está sendo cada vez mais cavado a partir das interações privadas e uploads da própria base de usuários de uma plataforma. As varreduras de web de código aberto ainda são úteis, mas os dados de maior valor são agora o tipo que você cria enquanto está logado em um serviço e tentando ativamente realizar algo.
O ponto principal
Seu antigo manual de privacidade está desatualizado. O novo regime de dados de treinamento do Google exige uma exclusão (opt-out) específica e deliberada dentro do Histórico de Serviços de Pesquisa, desmarcando a caixa "Salvar mídia". Essa ação, combinada com uma janela de exclusão automática curta, é a única maneira confiável de manter suas imagens, áudios e vídeos enviados fora do pipeline de treinamento de IA do Google. Compartilhe isso. O padrão não está mais configurado a seu favor.