Cuando revisamos el histórico de análisis previos de un cliente con 40.000 SKUs, encontramos siete informes anteriores. Ninguno mencionaba el problema real: 180.000 URLs indexadas de las que solo 12.000 tenían valor comercial. El resto era ruido facetado devorando presupuesto de rastreo.
Esa es la trampa. La mayoría de diagnósticos técnicos aplicados a tiendas online funcionan como plantillas heredadas de sitios corporativos, y las patologías propias del comercio electrónico quedan fuera del radar. En este texto explicamos, en el marco de una auditoría SEO para ecommerce, las siete que vemos con más frecuencia y cómo se diagnostican en serio, no con capturas de Screaming Frog decorativas.
El enfoque es el de nuestro equipo cuando entramos en una tienda con síntomas: primero leemos el paciente, después pedimos análisis, después tratamos. Y solo entonces revisamos si el tratamiento surte efecto a 90 días. Este trabajo lleva entre dos y cuatro semanas en catálogos medianos; menos tiempo es diagnóstico de escaparate.
Los síntomas que casi nadie sabe leer en una tienda online
Un diagnóstico técnico serio de una tienda online empieza por observar antes de medir: revisa síntomas visibles en Search Console, comportamiento del tráfico orgánico y estructura del catálogo antes de abrir Screaming Frog. Sin esa lectura previa, la herramienta escupe 400 warnings y ninguno prioritario.
Caídas de tráfico que no coinciden con actualizaciones de Google
Cuando un descenso orgánico no aparece en las cronologías de core updates, la causa suele ser interna. Rediseño del árbol de categorías, cambio del proveedor de plantillas o migración parcial son los tres sospechosos habituales.
En un caso de septiembre de 2023, un cliente perdió el 34% de visitas en 11 días sin motivo aparente. Al cruzar los logs con el historial de deployments, encontramos que un cambio en la plantilla de ficha había roto los breadcrumbs microformateados. Google dejó de entender la jerarquía y demovió medio catálogo.
URLs indexadas que se disparan sin que hayas creado contenido nuevo
Este síntoma es el más ignorado. Si el informe de Search Console muestra un crecimiento de páginas indexadas superior al ritmo de altas de producto, algo está generando URLs por su cuenta.
Casi siempre es la navegación por filtros. A veces son parámetros de tracking mal gestionados. En ambos casos, cada URL nueva compite por presupuesto de rastreo con las que sí importan.
Fichas con impresiones pero sin clics: la señal silenciosa
Miles de fichas con impresiones y CTR por debajo del 0,3% no son un problema de meta title. Son un problema de intención mal servida: el buscador cree que ese producto responde a algo que en realidad no responde.
Total, que cuando vemos ese patrón concentrado en una categoría concreta, lo que hay debajo suele ser canibalización con la página de listado o thin content en variantes. Volveremos a ambos.
La navegación por filtros es útil para el usuario y letal para el crawler si no está contenida. Cada combinación de talla, color, marca y precio genera una URL potencial. En un catálogo mediano, hablamos de decenas de miles de combinaciones inútiles indexables.
Cómo detectar el index bloat generado por filtros y ordenaciones
El indicador rápido: si el número de páginas descubiertas en el informe de cobertura supera en más de un 300% al número real de productos activos, hay bloat.
El indicador definitivo son los logs. Revisamos qué rutas está rastreando Googlebot y cuántas veces vuelve a URLs con parámetros de filtro. Cuando más del 40% del rastreo se concentra ahí, el paciente está en tratamiento intensivo.
Diagnóstico con logs: qué está rastreando Google de verdad
Search Console miente por omisión. Solo los logs del servidor te dicen qué está pasando de verdad. Cruzamos peticiones de Googlebot verificado por IP con la estructura del catálogo, y aparecen los agujeros: rutas con orden=precio-asc rastreadas mil veces al mes que jamás recibirán una visita.
Esa parte del análisis suele durar dos o tres días en tiendas medianas. Es la más aburrida y la que más decisiones sostiene después.
Tratamiento: canonical, noindex o bloqueo en robots (y cuándo elegir cada uno)
Aquí es donde muchos informes se equivocan por pereza. Las tres directivas no son intercambiables.
- Canonical: cuando la URL con parámetros muestra el mismo contenido que otra URL principal y quieres consolidar señales de enlazado hacia esta última.
- Noindex: cuando la URL debe seguir siendo rastreable (para descubrir enlaces) pero no debe aparecer en resultados.
- Bloqueo en robots.txt: cuando ni siquiera quieres que el crawler gaste tiempo entrando. Ojo: bloquear en robots impide leer directivas noindex.
El error clásico es aplicar noindex y bloquear en robots la misma ruta. Resultado: el buscador ve la URL enlazada, no puede entrar a leer el noindex, y la mantiene en el índice sin snippet. Un desastre que hemos limpiado en al menos ocho ocasiones durante 2024.
Canibalización entre categoría y ficha: la enfermedad crónica del ecommerce
Este es el problema más subestimado. Ocurre cuando la página de categoría y la ficha de producto compiten por la misma consulta, y ambas pierden por partida doble.
Cómo identificar el conflicto con Search Console y consultas duplicadas
El método es directo. En el informe de rendimiento, filtramos por consulta y observamos qué URLs aparecen para la misma búsqueda. Cuando dos o tres páginas del sitio rotan posiciones para una consulta comercial, el conflicto está confirmado.
Un dato concreto: en un análisis de febrero de 2024, encontramos 342 consultas donde categoría y ficha se pisaban. Al resolver el conflicto priorizando la categoría en 210 casos y la ficha en los 132 restantes, el tráfico orgánico creció un 28% en ocho semanas.
Cuándo la ficha debe rankear y cuándo debe ceder a la categoría
La regla útil, no la teórica: si la consulta lleva al usuario a un producto único que resuelve una necesidad concreta (marca + modelo específico), gana la ficha. Si la consulta es genérica y admite comparación (categoría, tipo, gama), gana el listado.
«Zapatilla running mujer» es categoría. «Nike Pegasus 40 mujer talla 38» es ficha. La zona gris intermedia se resuelve viendo qué está posicionando Google para consultas parecidas: casi siempre te dice qué prefiere.
Redistribución de intención con enlazado interno quirúrgico
Una vez decidido quién gana, ajustamos enlaces internos. La página perdedora enlaza a la ganadora con anchor semántico coherente. La ganadora recibe enlaces desde el header, footer o desde artículos de blog si existen.
Aquí entra el trabajo del auditor SEO técnico que revisa la arquitectura completa para que la señal fluya en la dirección correcta y no en zigzag.

Variantes, tallas y colores: el foco oculto de contenido pobre
El escenario típico: una camiseta con siete colores y seis tallas genera 42 URLs. Todas comparten el 95% del texto, cambiando solo el atributo. El buscador ve 42 páginas casi idénticas y decide, con razón, que ninguna merece protagonismo.
Detección de plantillas duplicadas al 95%
La detección es sencilla con Sitebulb o con un análisis de similaridad Levenshtein sobre los HTML renderizados. Cuando el porcentaje de coincidencia entre URLs de la misma familia supera el 90%, tienes plantillas duplicadas.
En una revisión de mayo de 2024, un cliente de moda tenía 18.400 fichas con similitud media del 96,2%. Solo 1.100 productos únicos generaban ese volumen. La decisión posterior no fue automática.
Cuándo consolidar variantes en una sola URL y cuándo mantenerlas
Depende del comportamiento de búsqueda. Si los usuarios buscan «camiseta blanca hombre» con volumen relevante, mantener la variante color como URL propia tiene sentido. Si solo buscan el producto genérico, consolidas.
La forma más limpia es una URL principal con selector de variantes que actualiza contenido sin cambiar la ruta, y URLs específicas solo para las variantes con demanda de búsqueda demostrada. El resto se canonicaliza a la principal.
¿Funciona siempre? Jamás. ¿Vale la pena el análisis previo? Solo si tu catálogo tiene más de 500 productos con variantes. Debajo de esa cifra, la consolidación total suele ser mejor decisión que la segmentación fina.
Paginación mal resuelta: por qué pierdes autoridad sin darte cuenta
Desde que Google anunció en 2019 que ya no usaba rel=»next» y rel=»prev» como señal de indexación, la paginación en tiendas online quedó huérfana de guía oficial. Y muchos desarrollos siguen implementando esa etiqueta como si fuera 2015.
Diagnóstico rápido de series /page/2, /page/3 mal enlazadas
El síntoma: la página 2 recibe enlaces desde la página 1, pero la página 3 no recibe enlaces desde ninguna parte visible del sitio. Google la descubre por sitemap, la rastrea con esfuerzo y no le transmite autoridad interna.
Un chequeo con crawl de Screaming Frog en modo lista, cargando todas las URLs paginadas, te dice cuántos enlaces internos apunta a cada una. Cuando la respuesta es «menos de tres para páginas más allá de la 4», el paciente sangra autoridad.
Alternativas al rel=next/prev que sí funcionan hoy
Tres caminos, ninguno perfecto:
- Vista extendida por scroll infinito con URLs paginadas paralelas: el usuario ve carga continua, el crawler ve URLs enlazadas correctamente.
- «Ver todo» con canonicalización desde las paginadas: solo funciona si la página completa carga en menos de 3 segundos.
- Paginación estándar con enlaces contextuales: incluir enlaces a páginas 3, 5, 10 y última desde la primera, no solo «siguiente».
Elegimos según el volumen del catálogo y el rendimiento del servidor. Sin datos previos, la decisión es adivinanza cara.

El tratamiento en orden: qué arreglar antes para que el resto tenga efecto
Aquí es donde la mayoría de informes fallan. Listan 47 problemas sin decir cuál tocar primero, y el equipo del cliente termina resolviendo lo cosmético mientras lo grave sigue sangrando.
Priorización por impacto sobre crawl budget e ingresos
Nuestro método es un cuadrante simple. Eje horizontal: impacto sobre presupuesto de rastreo. Eje vertical: impacto sobre ingresos directos. Todo lo que cae arriba-derecha se resuelve primero.
En la práctica, el orden habitual queda así:
- Contención de facetada (bloqueo en robots o noindex según cada caso).
- Resolución de canibalización en las 20 consultas comerciales top.
- Consolidación de variantes sin demanda de búsqueda.
- Reestructuración de paginación en las categorías más profundas.
- Trabajo fino sobre síntomas menores (thin content residual, breadcrumbs, schema).
Alterar ese orden es tirar horas. Si consolidas variantes antes de contener la facetada, ésta te vuelve a generar duplicados sobre el catálogo recién limpiado. Total, que la secuencia importa tanto como el tratamiento.
¿Puedes hacer este diagnóstico sin agencia externa?
Sí, si tienes acceso a los logs del servidor, licencia de Screaming Frog o Sitebulb y perfil técnico en el equipo interno. Sin logs no hay diagnóstico serio: Search Console te da síntomas, los logs te dan causa. Y sin perfil técnico, las decisiones sobre canonical vs noindex vs robots.txt se convierten en experimentos caros.
Checklist de seguimiento a 90 días para validar el diagnóstico
Un tratamiento sin seguimiento es un experimento sin resultados. A 90 días revisamos cinco indicadores concretos:
- Ratio de URLs indexadas / URLs con valor comercial (objetivo: acercarse a 1:1 en tiendas medianas).
- Porcentaje de rastreo dedicado a URLs paramétricas frente a URLs canónicas (objetivo: menos del 15%).
- Número de consultas con canibalización activa entre categoría y ficha (objetivo: reducción del 70% respecto a línea base).
- CTR medio de las fichas con impresiones históricas (objetivo: mejora superior al 20%).
- Ingresos orgánicos por sesión en el segmento afectado por la intervención (objetivo: superar la línea base sin considerar estacionalidad).
Si en 90 días tres de esos cinco no se mueven, el diagnóstico estaba mal o el tratamiento se aplicó a medias. Ambas cosas pasan, y en el equipo hemos aprendido a decirlo cuando ocurre en lugar de esconderlo bajo excusas.
Lo que descubrimos después de años haciendo esto es que un buen diagnóstico técnico no es una lista de errores. Es un mapa de decisiones ordenadas donde cada intervención habilita la siguiente. Cuando ese orden se respeta, los ingresos suben. Cuando se ignora, el trabajo se convierte en mantenimiento eterno sin resultado.

