A equipe de SEO do marketplace reescreveu sua regra de indexação após uma política simples de “menos de 3 anúncios = noindex” fazer com que as páginas de categoria desaparecessem do Google e levassem semanas para retornar. Ao adicionar um registro de “desbloqueio” unidirecional que permite que uma página passe de noindex para index, mas nunca o contrário, o site interrompeu essa oscilação.
Por que a regra original deu errado
A plataforma de classificados gera muitas páginas de categoria e localização. Quando uma página aparece pela primeira vez, ela geralmente contém apenas alguns anúncios, então a equipe decidiu ocultá-la das buscas até que atingisse um limite mínimo de três itens. A lógica era direta:
- < 3 anúncios → adicionar uma meta tag
noindex - ≥ 3 anúncios → remover a tag (permitir indexação)
Inicialmente, isso manteve páginas de baixo valor e conteúdo raso fora dos resultados do Google. O problema surgiu conforme os anúncios expiravam. Uma página com cinco anúncios em um dia poderia cair para dois no dia seguinte, voltando instantaneamente para noindex. O Google obedeceu, removeu a URL de seu índice e a página perdeu qualquer posicionamento que tivesse construído. Quando um novo anúncio chegava, a página tornava-se indexável novamente, mas o processo de reentrada levava semanas.
O resultado foi um ciclo constante de “liga-desliga”: as páginas entravam no índice, desapareciam, reentravam e assim por diante.
A correção de “desbloqueio” unidirecional
A falha central era que a regra não tinha memória; ela recalculava o limite a cada requisição. A equipe introduziu uma pequena tabela de banco de dados — seo_unlocks — que registra quando uma página atinge pela primeira vez a marca de três anúncios. O novo fluxo de trabalho é:
- Verificar a contagem de anúncios. Se a página tiver três ou mais anúncios ativos, prossiga.
- Escrever uma linha de desbloqueio. Insira um registro para essa página em
seo_unlocks. - Tratar a página como permanentemente indexável. Mesmo que as contagens posteriores caiam abaixo de três, a presença de uma linha de desbloqueio mantém a página fora do fluxo de
noindex.
Como o desbloqueio só pode ser escrito uma vez, uma página pode passar de “noindex” para “index”, mas nunca o contrário. A equipe adicionou salvaguardas para que URLs filtradas (ex: resultados de busca com faixas de preço) não possam criar desbloqueios para suas categorias pai, e envolveu a chamada do banco de dados em um bloco try/catch para evitar que uma falha no DB derrubasse o site inteiro.
O que isso significa para o crawl budget e páginas de conteúdo raso
Um equívoco comum é que o noindex economiza crawl budget. O Google ainda precisa buscar a página, ler a tag e, então, removê-la do índice. Se o objetivo é impedir que o Google solicite um padrão de URL inteiro, a ferramenta correta é o robots.txt. Use noindex apenas quando quiser que o Google veja a página, mas não a exiba nos resultados de busca.
Para diretórios, quadros de empregos e marketplaces que dependem de um grande número de páginas geradas automaticamente, a lição é clara: regras para páginas de conteúdo raso devem ser combinadas com uma camada de persistência que lembre quando uma página conquistou um lugar no índice. Sem essa memória, uma queda temporária de conteúdo pode fazer com que uma página perca o ranking que construiu, e a reentrada pode levar semanas.
Conclusão
Uma regra estática de “se contagem < 3 então noindex” cria volatilidade de SEO para sites de anúncios dinâmicos. Adicionar um registro de desbloqueio unidirecional dá memória à regra, permitindo que as páginas conquistem e mantenham seu status de indexação, mesmo quando os anúncios flutuam. Combine isso com o uso adequado de robots.txt para uma economia real de crawl budget, e você poderá proteger tanto os rankings quanto os recursos do servidor.
