El equipo de SEO del marketplace reescribió su regla de indexación después de que una simple política de "menos de 3 anuncios = noindex" causara que las páginas de categoría desaparecieran de Google y tardaran semanas en volver. Al añadir un registro de "desbloqueo" unidireccional que permite que una página pase de noindex a index pero nunca a la inversa, el sitio detuvo ese parpadeo.

Por qué la regla original salió mal

La plataforma de anuncios clasificados genera muchas páginas de categoría y ubicación. Cuando una página aparece por primera vez, a menudo contiene solo un puñado de anuncios, por lo que el equipo decidió ocultarla de las búsquedas hasta que alcanzara un umbral mínimo de tres elementos. La lógica era sencilla:

  • < 3 anuncios → añadir una etiqueta meta noindex
  • ≥ 3 anuncios → eliminar la etiqueta (permitir la indexación)

Inicialmente, esto mantuvo fuera de los resultados de Google las páginas con poco contenido (thin pages) y de bajo valor. El problema surgió a medida que los anuncios expiraban. Una página con cinco anuncios un día podía bajar a dos al siguiente, volviendo instantáneamente a noindex. Google obedeció, eliminó la URL de su índice y la página perdió cualquier posicionamiento que hubiera construido. Cuando llegaba un nuevo anuncio, la página volvía a ser indexable, pero el proceso de reentrada tardaba semanas.

El resultado fue un ciclo constante de "encendido y apagado": las páginas entraban en el índice, desaparecían, volvían a entrar, y así sucesivamente.

La solución de "desbloqueo" unidireccional

El fallo principal era que la regla no tenía memoria; recalculaba el umbral en cada solicitud. El equipo introdujo una pequeña tabla de base de datos —seo_unlocks— que registra cuándo una página alcanza por primera vez la marca de los tres anuncios. El nuevo flujo de trabajo es:

  1. Comprobar el recuento de anuncios. Si la página tiene tres o más anuncios activos, proceder.
  2. Escribir una fila de desbloqueo. Insertar un registro para esa página en seo_unlocks.
  3. Tratar la página como permanentemente indexable. Incluso si los recuentos posteriores caen por debajo de tres, la presencia de una fila de desbloqueo mantiene la página fuera del flujo noindex.

Debido a que el desbloqueo solo se puede escribir una vez, una página puede pasar de "noindex" a "index" pero nunca a la inversa. El equipo añadió salvaguardas para que las URLs filtradas (por ejemplo, resultados de búsqueda con rangos de precios) no puedan crear desbloqueos para sus categorías padre, y envolvió la llamada a la base de datos en un bloque try/catch para evitar que un fallo de la DB hiciera colapsar todo el sitio.

Qué significa esto para el presupuesto de rastreo y las páginas con poco contenido

Una idea errónea común es que noindex ahorra presupuesto de rastreo (crawl budget). Google aún tiene que obtener la página, leer la etiqueta y luego eliminarla del índice. Si el objetivo es evitar que Google solicite un patrón de URL completo, la herramienta correcta es robots.txt. Utilice noindex solo cuando quiera que Google vea la página pero no la muestre en los resultados de búsqueda.

Para directorios, bolsas de trabajo y marketplaces que dependen de un gran número de páginas autogeneradas, la lección es clara: las reglas para páginas con poco contenido deben ir acompañadas de una capa de persistencia que recuerde cuándo una página se ha ganado un lugar en el índice. Sin esa memoria, una caída temporal de contenido puede hacer que una página pierda el posicionamiento que había construido, y la reentrada puede tardar semanas.

Conclusión

Una regla estática de "si el recuento < 3, entonces noindex" crea volatilidad de SEO para sitios de anuncios dinámicos. Añadir un registro de desbloqueo unidireccional le da memoria a la regla, permitiendo que las páginas ganen y mantengan su estado de indexación incluso cuando los anuncios fluctúan. Combine eso con un uso adecuado de robots.txt para obtener ahorros reales de presupuesto de rastreo, y podrá proteger tanto el posicionamiento como los recursos del servidor.