“No está indexada” describe un estado, no una causa. La URL puede ser nueva, duplicada, bloqueada, redirigida, irrelevante o desconocida para Google. Esta versión elimina las afirmaciones de crecimiento que no tenían logs, inventario, fechas ni exportaciones de Search Console.
Primero se define qué debería indexarse
El denominador correcto no es el número total de URLs que puede generar la plataforma. Es el conjunto de URLs canónicas que aportan valor y que el sitio quiere mostrar en Google.
| Decisión | Ejemplo | Tratamiento esperado |
|---|---|---|
| Indexar | Producto disponible o guía original | 200, self-canonical, enlazada y en sitemap |
| Consolidar | Variante duplicada | Canonical o redirect hacia la versión principal |
| Excluir | Filtro sin demanda o página interna | Noindex o restricción coherente con su función |
| Retirar | Contenido eliminado sin reemplazo | 404 o 410 real |
El inventario debe guardar URL, plantilla, estado HTTP, canonical, robots, profundidad, enlaces entrantes, sitemap y decisión editorial. Con eso se distingue un problema técnico de una exclusión intencional.
Qué aporta Search Console
El informe de indexación de páginas agrupa URLs conocidas por Google y explica razones de exclusión. Google aclara que “no indexada” no siempre es un problema y que el objetivo es indexar la versión canónica de cada página importante.
La inspección de URL ayuda con ejemplos concretos, pero una muestra no describe todo el sitio. Se seleccionan URLs de cada plantilla, estado y nivel de profundidad. Los hallazgos se vuelcan al inventario con la fecha de inspección.
El informe de estadísticas de rastreo muestra solicitudes de Googlebot, respuestas del servidor y problemas de disponibilidad. Cuenta las URLs realmente solicitadas y cada salto de una cadena de redirects. No reemplaza los logs del servidor ni asigna por sí mismo valor comercial a una URL.
Qué revelan los logs
Los logs permiten responder preguntas que un crawl interno no cubre:
- cuándo Googlebot solicitó una URL
- qué código recibió
- cuántas veces pasó por parámetros, filtros o cadenas
- qué plantillas concentran 5xx o latencia
- si páginas prioritarias reciben solicitudes durante el periodo.
Antes de analizar, se valida el origen del bot y se conserva la zona horaria. Los datos se agrupan por plantilla y respuesta, pero se mantienen ejemplos de URL para investigar.
Orden de reparación
Primero se resuelven fallos de servidor, bloqueos accidentales y redirects incorrectos. Después se corrigen canonicals, duplicados y enlaces internos. El sitemap se limpia cuando las URLs ya reflejan la decisión editorial. Pedir indexación de manera repetida no compensa una arquitectura incoherente.
Aumentar el recuento de páginas indexadas no es un objetivo suficiente. Una tienda podría indexar miles de filtros inútiles y empeorar la calidad del inventario.
Cómo evaluar el cambio
Se fija una línea base por plantilla: URLs elegibles, URLs indexadas, clics, impresiones, solicitudes de Googlebot y errores. Tras la reparación se compara el mismo conjunto, incluyendo URLs nuevas y retiradas por separado.
El informe debe indicar qué datos no se recogieron. Si no hay logs, no se afirma que mejoró el rastreo. Si no hay GSC, no se afirma que Google indexó el conjunto. Si no hay analítica fiable, un cambio de sesiones no se presenta como efecto causal.
Evidencia necesaria para un caso real
Un caso de indexación requiere inventario antes y después, exportaciones fechadas, muestra de inspecciones, logs o su ausencia declarada, cambios desplegados y autorización para publicar. Hasta disponer de eso, esta URL funciona como protocolo de diagnóstico y no como testimonio de resultados.
