Il team SEO del marketplace ha riscritto la propria regola di indicizzazione dopo che una semplice policy "meno di 3 annunci = noindex" ha causato la scomparsa delle pagine di categoria da Google, richiedendo settimane per il loro rientro. Aggiungendo un record di "sblocco" unidirezionale che permette a una pagina di passare da noindex a index ma mai viceversa, il sito ha fermato l'effetto intermittente.
Perché la regola originale è stata controproducente
La piattaforma di annunci genera molte pagine categoria-e-località. Quando una pagina appare per la prima volta, spesso contiene solo pochi annunci, quindi il team ha deciso di nasconderla dai motori di ricerca finché non avesse raggiunto una soglia minima di tre elementi. La logica era semplice:
- < 3 annunci → aggiungi un meta tag
noindex - ≥ 3 annunci → rimuovi il tag (consenti l'indicizzazione)
Inizialmente, questo ha mantenuto le pagine thin e di basso valore fuori dai risultati di Google. Il problema è emerso con la scadenza degli annunci. Una pagina con cinque annunci un giorno poteva scendere a due il giorno successivo, tornando istantaneamente in noindex. Google ha obbedito, ha rimosso l'URL dal suo indice e la pagina ha perso ogni posizionamento precedentemente acquisito. Quando arrivava un nuovo annuncio, la pagina tornava indicizzabile, ma il processo di rientro richiedeva settimane.
Il risultato è stato un costante ciclo "on-off": le pagine entravano nell'indice, scomparivano, rientravano, e così via.
La soluzione dello "sblocco" unidirezionale
Il difetto principale era che la regola non aveva memoria; ricalcolava la soglia a ogni richiesta. Il team ha introdotto una piccola tabella del database — seo_unlocks — che registra quando una pagina raggiunge per la prima volta la soglia dei tre annunci. Il nuovo flusso di lavoro è:
- Controlla il numero di annunci. Se la pagina ha tre o più annunci attivi, procedi.
- Scrivi una riga di sblocco. Inserisci un record per quella pagina in
seo_unlocks. - Tratta la pagina come permanentemente indicizzabile. Anche se i conteggi successivi dovessero scendere sotto i tre, la presenza di una riga di sblocco mantiene la pagina fuori dal flusso
noindex.
Poiché lo sblocco può essere scritto solo una volta, una pagina può passare da "noindex" a "index" ma mai viceversa. Il team ha aggiunto delle protezioni affinché gli URL filtrati (ad esempio, i risultati di ricerca con intervalli di prezzo) non possano creare sblocchi per le loro categorie genitore, e ha racchiuso la chiamata al database in un blocco try/catch per evitare che un errore del DB faccia crashare l'intero sito.
Cosa significa per il crawl budget e le thin pages
Un errore comune è pensare che il noindex faccia risparmiare crawl budget. Google deve comunque recuperare la pagina, leggere il tag e poi rimuoverla dall'indice. Se l'obiettivo è impedire a Google di richiedere un intero pattern di URL, lo strumento corretto è robots.txt. Usa noindex solo quando vuoi che Google veda la pagina ma non la mostri nei risultati di ricerca.
Per directory, job board e marketplace che si affidano a un gran numero di pagine generate automaticamente, la lezione è chiara: le regole per le thin pages devono essere abbinate a uno strato di persistenza che ricordi quando una pagina ha guadagnato il suo posto nell'indice. Senza questa memoria, un calo temporaneo di contenuti può causare la perdita del posizionamento acquisito, e il rientro può richiedere settimane.
Conclusione
Una regola statica "se il conteggio < 3 allora noindex" crea volatilità SEO per i siti di annunci dinamici. L'aggiunta di un record di sblocco unidirezionale conferisce memoria alla regola, permettendo alle pagine di guadagnare e mantenere il proprio stato di indicizzazione anche quando gli annunci fluttuano. Abbina questo all'uso corretto di robots.txt per un vero risparmio del crawl budget, e potrai proteggere sia il posizionamento che le risorse del server.
