Indexación y rastreo: protocolo de diagnóstico SEO

Método para explicar por qué una URL se rastrea o indexa, priorizar reparaciones y medir el cambio sin inventar multiplicadores de tráfico.

“No está indexada” describe un estado, no una causa. La URL puede ser nueva, duplicada, bloqueada, redirigida, irrelevante o desconocida para Google. Esta versión elimina las afirmaciones de crecimiento que no tenían logs, inventario, fechas ni exportaciones de Search Console.

Primero se define qué debería indexarse

El denominador correcto no es el número total de URLs que puede generar la plataforma. Es el conjunto de URLs canónicas que aportan valor y que el sitio quiere mostrar en Google.

Decisión Ejemplo Tratamiento esperado
Indexar Producto disponible o guía original 200, self-canonical, enlazada y en sitemap
Consolidar Variante duplicada Canonical o redirect hacia la versión principal
Excluir Filtro sin demanda o página interna Noindex o restricción coherente con su función
Retirar Contenido eliminado sin reemplazo 404 o 410 real

El inventario debe guardar URL, plantilla, estado HTTP, canonical, robots, profundidad, enlaces entrantes, sitemap y decisión editorial. Con eso se distingue un problema técnico de una exclusión intencional.

Qué aporta Search Console

El informe de indexación de páginas agrupa URLs conocidas por Google y explica razones de exclusión. Google aclara que “no indexada” no siempre es un problema y que el objetivo es indexar la versión canónica de cada página importante.

La inspección de URL ayuda con ejemplos concretos, pero una muestra no describe todo el sitio. Se seleccionan URLs de cada plantilla, estado y nivel de profundidad. Los hallazgos se vuelcan al inventario con la fecha de inspección.

El informe de estadísticas de rastreo muestra solicitudes de Googlebot, respuestas del servidor y problemas de disponibilidad. Cuenta las URLs realmente solicitadas y cada salto de una cadena de redirects. No reemplaza los logs del servidor ni asigna por sí mismo valor comercial a una URL.

Qué revelan los logs

Los logs permiten responder preguntas que un crawl interno no cubre:

Antes de analizar, se valida el origen del bot y se conserva la zona horaria. Los datos se agrupan por plantilla y respuesta, pero se mantienen ejemplos de URL para investigar.

Orden de reparación

Primero se resuelven fallos de servidor, bloqueos accidentales y redirects incorrectos. Después se corrigen canonicals, duplicados y enlaces internos. El sitemap se limpia cuando las URLs ya reflejan la decisión editorial. Pedir indexación de manera repetida no compensa una arquitectura incoherente.

Aumentar el recuento de páginas indexadas no es un objetivo suficiente. Una tienda podría indexar miles de filtros inútiles y empeorar la calidad del inventario.

Cómo evaluar el cambio

Se fija una línea base por plantilla: URLs elegibles, URLs indexadas, clics, impresiones, solicitudes de Googlebot y errores. Tras la reparación se compara el mismo conjunto, incluyendo URLs nuevas y retiradas por separado.

El informe debe indicar qué datos no se recogieron. Si no hay logs, no se afirma que mejoró el rastreo. Si no hay GSC, no se afirma que Google indexó el conjunto. Si no hay analítica fiable, un cambio de sesiones no se presenta como efecto causal.

Evidencia necesaria para un caso real

Un caso de indexación requiere inventario antes y después, exportaciones fechadas, muestra de inspecciones, logs o su ausencia declarada, cambios desplegados y autorización para publicar. Hasta disponer de eso, esta URL funciona como protocolo de diagnóstico y no como testimonio de resultados.

Lecturas relacionadas