Tu página puede posicionarse en el #1 de Google y aun así ser invisible para ChatGPT

El rastreador de Google ejecuta tu JavaScript, extrae el HTML renderizado en su índice y puede colocar un sitio renderizado en el lado del cliente en la primera página de los resultados de búsqueda. La misma página, cuando se consulta a través de ChatGPT o la búsqueda con IA de Bing, desaparece porque los bots que impulsan esos servicios nunca ejecutan el JavaScript. El resultado es un sitio con un posicionamiento alto que ningún asistente de IA puede mostrar.

Por qué los rastreadores de IA no encuentran tu contenido

Dos de los rastreadores de IA más utilizados —GPTBot de OpenAI y ClaudeBot de Anthropic— no renderizan JavaScript en absoluto. Un estudio de diciembre de 2024 realizado por Vercel y MERJ mostró que ambos bots simplemente descargan el HTML sin procesar y cualquier archivo JavaScript enlazado, y luego se detienen. Los scripts nunca se ejecutan, por lo que los bots solo ven un cascarón vacío.

Googlebot, por el contrario, pone la página en cola, ejecuta los scripts e indexa el DOM resultante. Esa diferencia fundamental significa que un sitio construido con un framework puramente del lado del cliente (React, Vue, etc.) puede ser totalmente visible para Google, mientras permanece como una hoja en blanco para la búsqueda impulsada por IA.

Google vs. IA: La brecha de renderizado

Google ha invertido durante mucho tiempo en el renderizado headless. Su bot puede procesar aplicaciones de página única (SPA) complejas, hidratarlas y extraer datos estructurados que aparecen tras la carga inicial. Los rastreadores de IA, sin embargo, todavía están en un modo de "solo descarga". Pueden analizar JSON-LD que se inyecta mediante herramientas como react-helmet, pero solo si ese marcado está presente en el HTML sin procesar.

Las herramientas para desarrolladores pueden ser engañosas. El panel Elements en Chrome muestra la página después de que se haya ejecutado el JavaScript, dando la falsa impresión de que el marcado es parte del código fuente. Usar “view-source” (o curl sin un navegador) revela lo que un bot recibe realmente. Si el contenido o los datos estructurados no están allí, los rastreadores de IA nunca los verán.

Cómo se manifiesta el problema

Un sitio típico de React que depende del renderizado en el lado del cliente se posicionará alto en Google para palabras clave como “mejor cafetera” o “cómo arreglar un grifo que gotea”. Sin embargo, un usuario que pregunte a ChatGPT: “¿Cuáles son las mejores cafeteras?” recibirá respuestas que omiten ese sitio por completo. La misma brecha existe para la IA de Bing, que atiende aproximadamente el 92 % de las consultas de agentes de ChatGPT. Las capacidades de renderizado de JavaScript de Bing son limitadas, por lo que un sitio que solo funcione en el lado del cliente puede ser invisible para ambos proveedores principales de búsqueda con IA.

El problema es silencioso. Los paneles de control de SEO que rastrean el posicionamiento en Google informarán de una posición saludable, mientras que el tráfico del sitio proveniente de asistentes de IA seguirá siendo cero. Esa discrepancia puede costar a las empresas una parte creciente del tráfico de descubrimiento, especialmente a medida que más usuarios confían en interfaces conversacionales para obtener respuestas rápidas.

Qué están haciendo mal los desarrolladores

Muchos equipos asumen que si Google puede leer la página, cualquier rastreador también puede. A menudo:

  • Confían en react-helmet o librerías similares para inyectar JSON-LD después de que la página se carga, creyendo que el marcado “está ahí”.
  • Prueban solo en la vista Elements del navegador, no en el código fuente sin procesar.
  • Omiten una simple comprobación con curl, perdiendo de vista el hecho de que el titular o las frases clave nunca aparecen en la respuesta HTML inicial.

Estas prácticas dan la ilusión de una buena salud de SEO mientras dejan al sitio ciego ante la búsqueda por IA.

Cómo solucionarlo

El remedio es entregar el contenido real en la primera respuesta HTTP. Tres enfoques probados funcionan:

  • Server-Side Rendering (SSR) – El servidor ejecuta el JavaScript, renderiza el HTML completo y lo envía al cliente. La página llega ya poblada.
  • Static Generation – En el momento de la construcción (build time), el framework crea archivos HTML estáticos que incluyen todo el contenido. No se necesita renderizado en tiempo de ejecución.
  • Prerendering – Un servicio de middleware renderiza la página una vez, almacena el resultado en caché y sirve la instantánea estática a los rastreadores.

Frameworks como Next.js (React) y Nuxt (Vue) ofrecen soporte integrado para estas técnicas. Cambiar de un paquete puramente del lado del cliente a uno de los métodos anteriores garantiza que tanto Googlebot como los rastreadores de IA vean el mismo contenido.

Una prueba rápida de coherencia:

curl -s https://yourpage.com | grep "your headline text"

Si el comando no devuelve nada, el titular no está presente en el HTML sin procesar y los bots de IA no lo verán.

A qué prestar atención

El estado actual es un desajuste evidente: el motor de renderizado de Google es sofisticado; los rastreadores de IA no lo son. El estudio que descubrió esta brecha tiene solo unos pocos meses, y tanto OpenAI como Anthropic han señalado su interés en mejorar sus procesos de indexación. Sin embargo, ninguna hoja de ruta pública garantiza que la ejecución completa de JavaScript se añada pronto.

Mientras tanto, el costo de ignorar el problema ha cambiado. Hace diez años, la penalización era una indexación más lenta en Google; hoy, es la exclusión del canal de descubrimiento de más rápido crecimiento: la búsqueda impulsada por IA. Las empresas que dependen del tráfico orgánico deberían auditar sus páginas con herramientas de código fuente, adoptar SSR o generación estática donde sea factible, y monitorear los informes de indexación específicos para IA a medida que estén disponibles.

Conclusión: Un sitio que parece perfecto en los rankings de Google puede ser invisible para ChatGPT y Bing AI si depende únicamente del renderizado en el lado del cliente. Entregar el contenido en el HTML inicial —ya sea mediante SSR, generación estática o prerrenderizado— cierra esa brecha y asegura la visibilidad tanto en la búsqueda tradicional como en la de IA.