SEO de Navegación Facetada en Shopify: Deja de Desperdiciar Presupuesto de Rastreo en URLs de Filtros
Los filtros de Shopify crean miles de URLs duplicadas que agotan el presupuesto de rastreo y suprimen rankings.
Los filtros de colecciones de Shopify son una de las herramientas UX más efectivas de la plataforma y uno de los errores SEO más dañinos que los comerciantes cometen sin darse cuenta. Cuando cada combinación de filtro genera su propia URL rastreable, Googlebot gasta su presupuesto en páginas delgadas y casi duplicadas en lugar de tus páginas de dinero real. La solución es una arquitectura de rastreo deliberada, no un simple cambio de configuración.
Puntos clave
- Una tienda con 500 productos, 3 colecciones y 3 variantes por producto puede generar más de 8,000 URLs rastreables de solo 500 productos reales, quemando presupuesto de rastreo en duplicados.
- Google ignora las etiquetas canónicas automáticas de Shopify entre un 30-40% de las veces cuando los enlaces internos apuntan a URLs de ruta de colección en lugar de la ruta canónica
/products/. - Cuatro personalizaciones de robots.txt cubren la gran mayoría del desperdicio de rastreo para tiendas con menos de 100,000 páginas.
- Los parámetros de filtro facetado deben manejarse con una de tres estrategias: bloquear en robots.txt, añadir
noindex, o usar estados basados en fragmentos del lado del cliente. - La aplicación Search and Discovery es gratuita y controla qué atributos de filtro generan URLs rastreables, convirtiéndola en tu primer punto de palanca antes de tocar cualquier código.
Por qué la navegación facetada rompe el SEO de Shopify
El filtrado de escaparates de Shopify, construido en la aplicación Search and Discovery, genera URLs con parámetros de consulta como /collections/shirts?filter.p.tag=blue. Por defecto, Shopify no siempre aplica etiquetas canónicas a cada combinación de filtro, lo que significa que Google ve una cascada de páginas casi idénticas, cada una diferente por un valor de parámetro.
Auditorías recientes de sitios de comercio electrónico (incluyendo tiendas Shopify Plus) encontraron que cuatro de cada cinco tenían más del 60% de sus solicitudes de rastreo de Googlebot aterrizando en URLs que ningún humano escribiría o compartiría, principalmente combinaciones de filtros y parámetros de ordenamiento. No es un problema marginal. Es el resultado predeterminado cuando instalas una aplicación de filtro y no haces nada más.
La escala se compone rápidamente. Para una tienda de 500 productos donde los productos promedian 3 colecciones y 3 variantes, la arquitectura de Shopify puede crear más de 8,000 URLs rastreables para solo 500 productos reales. Ese es presupuesto de rastreo que se gasta en páginas duplicadas en lugar de tu contenido real, como se detalla en un análisis técnico de mayo de 2026 de Black Belt Commerce.
El problema de la etiqueta canónica que lo agrava
Shopify sí genera etiquetas canónicas automáticamente. Los productos obtienen una canónica que apunta a /products/{handle}, que es la señal correcta. El problema es que Google ignora las etiquetas canónicas entre 30-40% de las veces, especialmente cuando los enlaces internos en todo el sitio apuntan a las versiones de ruta de colección como /collections/shirts/products/blue-tee.
Esto significa que la canónica por sí sola no es suficiente. Cada enlace interno en tu tema, incluyendo carruseles "También te puede interesar", migas de pan y mosaicos de cuadrícula de colecciones, necesita resolver a la URL /products/, no a la ruta consciente de colección. Audita las plantillas Liquid de tu tema y verifica dónde se generan las URLs de productos. En la mayoría de temas, la URL de ruta de colección se usa por defecto dentro de bucles de colección, y ese es exactamente el comportamiento incorrecto.
Para validar el impacto en el mundo real, ve a Google Search Console, abre Cobertura > Excluidos, y busca "Duplicado, URL enviada no seleccionada como canónica." Si ves cientos de entradas allí, tus enlaces internos están socavando tus etiquetas canónicas.
Tres estrategias para cada tipo de filtro
No todos los filtros merecen el mismo trato. El árbol de decisión es sencillo:
1. Bloquear en robots.txt (para filtros sin valor SEO)
Las páginas de colecciones basadas en etiquetas (por ejemplo, /collections/shirts+blue) y los parámetros de ordenamiento rara vez tienen intención de búsqueda independiente. Añade Disallow: /collections/*/tagged/ a tu archivo robots.txt.liquid para evitar que Googlebot las rastree en absoluto. Desde mediados de 2021, Shopify ha permitido a los comerciantes personalizar robots.txt a través de una plantilla robots.txt.liquid en el editor de código del tema, dándote control por patrón sin herramientas externas.
Añadir una regla Disallow para páginas filtradas por etiqueta previene el desperdicio de rastreo en contenido delgado que casi nunca se posiciona por su cuenta. Esa única línea cubre una superficie sorprendentemente grande en tiendas que usan el etiquetado de productos de Shopify fuertemente.
2. Noindex (para filtros que ayudan UX pero no tienen intención de búsqueda independiente)
Algunos filtros, como talla o color en una colección amplia, son esenciales para la usabilidad en el sitio pero nunca se posicionarán para una consulta distinta. Deja que el bot rastree estas páginas para que pueda ver la directiva noindex, pero asegúrate de que la página no esté bloqueada por robots.txt. La regla es: las páginas bloqueadas no pueden comunicar noindex a Google, así que usa una u otra, nunca ambas.
En el Liquid de tu tema, puedes condicionalizar la salida de la etiqueta noindex:
<code>liquid {% if request.page_type == 'collection' and current_tags %} <meta name="robots" content="noindex, follow"> {% endif %} </code>
Esto apunta solo a vistas de colecciones filtradas por etiqueta, dejando tus páginas de colección base completamente indexables.
3. Estados basados en fragmentos (para filtros sin valor SEO en absoluto)
Para filtros puramente impulsados por UX donde el objetivo es cero visibilidad en búsqueda, considera renderizar el estado del filtro en el fragmento de URL (por ejemplo, #color=blue) en lugar de como parámetro de consulta. La propia guía de Google confirma que generalmente no usa fragmentos de URL para rastreo e indexación, lo que mantiene esos estados fuera de la búsqueda por diseño. Esto requiere JavaScript personalizado para gestionar el estado, pero es la solución arquitectónica más limpia para filtros que nunca deberían aparecer en un índice.
Comparación de tres estrategias de manejo de filtros
| Estrategia | Googlebot rastrea la página | Mejor utilizado para | Limitación clave |
|---|---|---|---|
| Bloquear en robots.txt | No | Filtros de etiqueta, parámetros de ordenamiento, URLs sin intención de búsqueda | No puede pasar señal noindex; usar cuidadosamente para evitar bloqueos excesivos |
| Etiqueta meta noindex | Sí | Filtros de talla, color o UX que ayudan en el sitio pero nunca se posicionan independientemente | Aún consume presupuesto de rastreo porque la página se obtiene antes de que se lea noindex |
| Estado basado en fragmento | No (Google ignora fragmentos) | Filtros puramente UX donde visibilidad de búsqueda cero es el objetivo | Requiere JavaScript personalizado para gestión de estado; no apto para filtros dirigidos a SEO |
Lo que controla la aplicación Search and Discovery (y lo que no)
La aplicación Search and Discovery gratuita de Shopify es donde comienza la arquitectura de filtros. Controla qué atributos de producto se pueden filtrar y cómo se ordenan los valores de filtro. Una restricción importante de la plataforma: las colecciones con más de 5,000 productos no muestran filtros en absoluto. Si tienes un catálogo grande, esta es una razón para dividir colecciones amplias en subcolecciones más ajustadas, lo que también resulta ser mejor para SEO (páginas de colección más dirigidas, caminos de rastreo más limpios).
Lo que la aplicación no controla es cómo se comportan las URLs de filtro resultantes en la búsqueda. Esa es tu responsabilidad a través de etiquetas canónicas, robots.txt y enlaces internos. La aplicación configura la capa UX. La capa SEO es una preocupación de ingeniería separada.
Para tiendas a escala empresarial donde los límites de la aplicación nativa son demasiado restrictivos, las aplicaciones de filtro de terceros añaden más flexibilidad, pero introducen JavaScript adicional que puede aumentar tu Largest Contentful Paint (LCP) más allá del umbral de 2.5 segundos que Google usa como señal de ranking. Cada aplicación que instalas añade scripts cargándose en cada página, así que pondera la funcionalidad de filtro contra la velocidad de página base de datos por aplicación.
El playbook de robots.txt.liquid
Aquí está el conjunto condensado de reglas que cubre la mayoría de tiendas Shopify. Añade estas a tu archivo robots.txt.liquid:
Disallow: /collections/*/tagged/ Disallow: /search Disallow: /cart Disallow: /checkout Disallow: /account
La línea /collections/*/tagged/ es la más impactante para tiendas que usan etiquetas de producto como filtros. Las páginas de búsqueda internas indexadas por Google diluyen tu presupuesto de rastreo con contenido delgado duplicado, así que bloquea esas también. Las páginas de carrito, pago y cuenta nunca deben indexarse y ya están bloqueadas en el robots.txt predeterminado de Shopify, pero hacerlas explícitas futuro-prueba tu configuración contra cualquier cambio de plataforma.
Después de hacer cambios, usa la herramienta de Inspección de URLs en Google Search Console para verificar que las páginas individuales responden como se espera. Monitorea el informe de Estadísticas de Rastreo semanalmente durante dos a cuatro semanas después de cualquier cambio en robots.txt. Un pico en exclusiones "bloqueado por robots.txt" es normal y esperado. Una caída en impresiones para tus páginas de colección central no lo es, y señala una regla Disallow demasiado amplia.
Enlaces internos: la corrección que las etiquetas canónicas no pueden hacer solas
La corrección estructural que la mayoría de comerciantes omiten es actualizar la salida de enlaces internos de su tema. En Liquid, las URLs de producto dentro de bucles de colección típicamente se generan como:
liquid {{ product.url | within: collection }}
Esto genera la URL de ruta de colección. Para SEO, quieres la ruta canónica:
liquid {{ product.url }}
El filtro | within: collection es el culpable detrás de la mayoría de reportes de desajuste canónico. Removerlo de enlaces de tarjetas de producto, migas de pan y carruseles de productos relacionados significa que el rastreo de Google sigue la misma URL que estás canonicalizando. La etiqueta canónica y los enlaces internos entonces están de acuerdo, que es cuando Google honra confiablemente tu señal canónica.
Si quieres una revisión más profunda de la salida Liquid de tu tema y arquitectura de rastreo, el servicio de SEO de Shopify que ofrezco cubre una auditoría completa de rastreo como parte del compromiso.
Higiene del mapa del sitio
El sitemap.xml auto-generado de Shopify es un acelerador útil de rastreo, pero requiere revisión periódica. El mapa del sitio excluye correctamente las URLs de producto de ruta de colección por defecto, que es uno de los comportamientos SEO subestimados de la plataforma. Lo que no filtra automáticamente son las páginas de colección basadas en etiquetas y, en algunas configuraciones de tienda, URLs de colecciones paginadas más allá de la página uno.
Shopify no te permite remover manualmente entradas de mapa del sitio, pero puedes suprimir páginas de indexación usando etiquetas noindex basadas en Liquid, que señala a Google que esas URLs deben excluirse del índice incluso si el mapa del sitio las lista. No confíes en la omisión del mapa del sitio únicamente como señal noindex. Usa la etiqueta meta robots en el <head> para cualquier página que quieras definitivamente excluida.
Validación del trabajo
Después de implementar correcciones canónicas, actualizaciones de robots.txt y correcciones de enlaces internos, valida con esta secuencia:
- Google Search Console > Cobertura > Excluidos: el recuento "Duplicado, URL enviada no seleccionada como canónica" debe caer dentro de 4-8 semanas.
- Informe de Estadísticas de Rastreo: las solicitudes totales de rastreo deben disminuir o estabilizarse; la proporción que va a URLs de ruta de colección debe caer.
- Screaming Frog o Ahrefs Site Audit: re-rastrea después de 30 días y compara la proporción de URLs 3xx, noindex, y desajuste canónico con tu línea base.
- Inspección de URL: verifica 5-10 URLs de filtro para confirmar que el canónico seleccionado por Google coincide con tu URL
/products/prevista.
Para una lista de verificación técnica completa que vaya más allá de la navegación facetada hacia Core Web Vitals y datos estructurados, consulta la guía de optimización de velocidad de Shopify que publiqué anteriormente.
La dimensión del rastreador de IA
Un factor que no existía a escala hace dos años: los rastreadores de IA de ChatGPT, Perplexity y el sistema Google AI Overview ahora están añadiendo tráfico de bots golpeando tu tienda. Estos rastreadores operan bajo agentes de usuario separados, y el robots.txt predeterminado de Shopify solo aborda User-agent: *. Si quieres permitir o restringir explícitamente bots de IA, necesitas reglas de agente de usuario nombrado en tu robots.txt.liquid. Más importante, estos rastreadores dependen fuertemente de datos estructurados para entender tus páginas de producto. Un mapa del sitio que presenta tus páginas de colección y producto canónicas, combinado con esquema de producto correcto, es lo que hace que tu inventario se cite en respuestas generadas por IA.
Arregla la arquitectura de rastreo primero. Las URLs canónicas que presentas a Googlebot son las mismas que los rastreadores de IA usarán para entender y recomendar tus productos.
Preguntas frecuentes
¿Shopify arregla automáticamente problemas de SEO de navegación facetada?
Shopify añade etiquetas canónicas a páginas de producto automáticamente, pero no gestiona la indexación de URLs de filtro, reglas de robots.txt para páginas etiquetadas, o rutas de enlace interno. Los comerciantes necesitan configurar esto por separado usando la plantilla robots.txt.liquid y ediciones de tema Liquid.
¿Debo bloquear todas las URLs de filtro de colección en robots.txt?
No. Solo bloquea combinaciones de filtro que tienen intención de búsqueda independiente cero, como parámetros de ordenamiento y páginas filtradas por etiqueta. Los filtros que representan consultas de búsqueda genuinas (por ejemplo, una colección filtrada a un material específico) pueden merecer su propia página indexable con una URL canónica única.
¿Cuánto tiempo tarda en ver mejoras de ranking después de arreglar problemas de presupuesto de rastreo?
Las correcciones de presupuesto de rastreo típicamente muestran resultados en Google Search Console dentro de 4-8 semanas mientras Googlebot re-rastrea y re-evalúa tus canónicas. Las mejoras de ranking orgánico en resultados de búsqueda usualmente siguen 2-3 meses después de que las correcciones de indexación se estabilicen.