← Alle berichten Shopify Faceted Navigation SEO: Stop Wasting Crawl Budget on Filter URLs

Shopify Faceted Navigation SEO: Stop Wasting Crawl Budget on Filter URLs

Shopify filters genereren duizenden duplicate URLs die crawl budget opslokken en rankings onderdrukken.

Shopify's collectiefilters zijn een van de meest effectieve UX-tools op het platform en een van de meest schadelijke SEO-fouten die handelaren onbewust maken. Wanneer elke filtercombinatie zijn eigen crawlable URL genereert, geeft Googlebot zijn budget uit aan dunne, bijna-duplicate pagina's in plaats van uw echte money pages. De oplossing is een bewuste crawl-architectuur, niet een enkele instellingsschakelaar.

Belangrijkste punten

  • Een winkel met 500 producten, 3 collecties en 3 varianten per product kan meer dan 8.000 crawlable URLs genereren uit slechts 500 echte producten, wat crawl budget verspilt aan duplicaten.
  • Google negeert Shopify's auto-canonical tags 30-40% van de tijd wanneer interne links naar collectie-pad-URLs wijzen in plaats van naar het canonieke /products/-pad.
  • Vier robots.txt-aanpassingen dekken de meeste crawl-verspilling voor winkels onder de 100.000 pagina's.
  • Gefacetteerde filterparameters moeten worden afgehandeld met een van drie strategieën: blokkeren in robots.txt, noindex toevoegen, of client-side statusgebruiken op basis van fragment.
  • De Search and Discovery app is gratis en bepaalt welke filterattributen crawlable URLs genereren, wat het uw eerste hefboom maakt voordat u iets aan code aanraakt.

Waarom gefacetteerde navigatie Shopify SEO breekt

Shopify's winkelfiltering, gebouwd op de Search and Discovery app, genereert URLs met queryparameters zoals /collections/shirts?filter.p.tag=blue. Standaard paste Shopify niet altijd canonical tags toe op elke filtercombinatie, wat betekent dat Google een cascade van bijna identieke pagina's ziet, elk verschillend door één parameterwaarde.

Recente audits van e-commerce sites (inclusief Shopify Plus-winkels) ontdekten dat vier op de vijf meer dan 60% van hun Googlebot-crawlaanvragen op URLs hadden die geen mens ooit zou typen of delen, vooral filtercombinaties en sorteerparameters. Dit is niet het probleem van een klein groepje. Het is het standaardresultaat wanneer u een filter-app installeert en verder niets doet.

De schaal groeit snel. Voor een winkel met 500 producten waarbij producten gemiddeld in 3 collecties en 3 varianten voorkomen, kan Shopify's architectuur meer dan 8.000 crawlable URLs voor slechts 500 werkelijke producten creëren. Dat is crawl budget dat wordt besteed aan duplicate pagina's in plaats van uw echte inhoud, zoals gedetailleerd in een technische analyse uit mei 2026 door Black Belt Commerce.

Het canonical tag-probleem dat het verergert

Shopify genereert wel canonical tags automatisch. Producten krijgen een canonical die naar /products/{handle} wijst, wat het juiste signaal is. Het probleem is dat Google canonical tags 30-40% van de tijd negeert, vooral wanneer interne links in de hele site naar de collectie-pad-versies wijzen zoals /collections/shirts/products/blue-tee.

Dit betekent dat canonical alleen niet voldoende is. Elke interne link in uw thema, inclusief "Je mag ook van houden" carousels, breadcrumbs en collectiegrrid-tegels, moet naar de /products/-URL gaan, niet naar het collectie-pad. Controleer de Liquid templates van uw thema en controleer waar product-URLs worden weergegeven. In de meeste thema's wordt standaard de collectie-pad-URL gebruikt in collectielussen, en dat is precies het verkeerde gedrag.

Ga naar Google Search Console, open Coverage (Dekking) > Excluded (Uitgesloten) en zoek naar "Duplicate, submitted URL not selected as canonical (Duplicaat, ingediende URL niet geselecteerd als canonical)." Als u daar honderden entries ziet, ondermijnen uw interne links uw canonical tags.

Drie strategieën voor elk filtertype

Niet alle filters verdienen dezelfde behandeling. De beslissingsboom is eenvoudig:

1. Blokkeren in robots.txt (voor filters zonder SEO-waarde)

Collectiepagina's op basis van tags (bijv. /collections/shirts+blue) en sorteerparameters hebben zelden zelfstandige zoekintenties. Voeg Disallow: /collections/*/tagged/ toe aan uw robots.txt.liquid-bestand om te voorkomen dat Googlebot ze helemaal crawlt. Sinds medio 2021 staat Shopify handelaren toe hun robots.txt via een robots.txt.liquid-sjabloon in de thema-code-editor aan te passen, wat u per-patrooncontrole geeft zonder externe tools.

Het toevoegen van een Disallow-regel voor tag-gefilterde pagina's voorkomt crawl-verspilling op dunne inhoud die bijna nooit op eigen kracht wordt gerangschikt. Die enkele regel dekt een verrassend groot oppervlak in winkels die Shopify's product tagging zwaar gebruiken.

2. Noindex (voor filters die UX helpen maar geen zelfstandige zoekintenties hebben)

Sommige filters, zoals maat of kleur in een brede collectie, zijn essentieel voor gebruiksvriendelijkheid op de site, maar zullen nooit voor een aparte query worden gerangschikt. Laat de bot deze pagina's crawlen zodat het de noindex-richtlijn kan zien, maar zorg ervoor dat de pagina niet door robots.txt wordt geblokkeerd. De regel is: geblokkeerde pagina's kunnen Google het noindex-signaal niet overbrengen, dus gebruik een van beide, nooit beide.

In uw thema's Liquid kunt u voorwaardelijk de noindex-tag uitvoeren:

liquid {% if request.page_type == 'collection' and current_tags %} <meta name="robots" content="noindex, follow"> {% endif %}

Dit richt zich alleen op tag-gefilterde collectieweergaven, waardoor uw basiscollectiepagina's volledig indexeerbaar blijven.

3. Status op basis van fragment (voor filters zonder SEO-waarde)

Voor zuiver UX-gestuurde filters waarbij het doel nul zichtbaarheid in zoekopdrachten is, overweeg filterstate in het URL-fragment (bijv. #color=blue) weer te geven in plaats van als queryparameter. Googles eigen richtlijnen bevestigen dat het URL-fragmenten over het algemeen niet voor crawlen en indexeren gebruikt, wat deze statussen van design uit de zoekopdracht houdt. Dit vereist aangepast JavaScript voor statusbeheer, maar het is de schoonste architectuuroplossing voor filters die nooit in een index mogen verschijnen.

De drie strategieën voor filterverwerking vergelijken

Strategie Googlebot crawlt de pagina Het beste voor Belangrijkste beperking
Blokkeren in robots.txt Nee Tag-filters, sorteerparameters, URLs met nul zoekintenties Kan noindex-signaal niet doorgeven; voorzichtig gebruiken om overteksten te voorkomen
Noindex meta-tag Ja Maat-, kleur- of UX-filters die ter plaatse helpen maar nooit onafhankelijk worden gerangschikt Verbruikt nog steeds crawl budget omdat de pagina wordt opgehaald voordat noindex wordt gelezen
Status op basis van fragment Nee (fragmenten genegeerd door Google) Zuiver UX-filters waar nul zichtbaarheid in zoekopdrachten het doel is Vereist aangepast JavaScript voor statusbeheer; niet geschikt voor SEO-target-filters

Wat de Search and Discovery app bepaalt (en wat niet)

Shopify's gratis Search and Discovery app is waar de filterarchitectuur begint. Het bepaalt welke productattributen filterbaar worden en hoe filterwaarden worden geordend. Een belangrijke platformbeperking: collecties met meer dan 5.000 producten geven helemaal geen filters weer. Als u een grote catalogus hebt, is dit een reden om brede collecties in strakere subcollecties op te splitsen, wat toevallig ook beter voor SEO is (meer gerichte collectiepagina's, schonere crawlpaden).

Wat de app niet bepaalt, is hoe de resulterende filter-URLs zich in zoeken gedragen. Dat is uw verantwoordelijkheid via canonical tags, robots.txt en interne koppeling. De app stelt de UX-laag in. De SEO-laag is een aparte engineering-bezorgnis.

Voor bedrijfswinkels op grote schaal waar de beperkingen van de native app te restrictief zijn, bieden apps van derden meer flexibiliteit, maar ze introduceren extra JavaScript dat uw Largest Contentful Paint (LCP) boven de 2,5-secondendrempel die Google als rankingsignaal gebruikt, kan verhogen. Elke app die u installeert, voegt scripts toe die op elke pagina worden geladen, dus wegen filterfunctionaliteit af tegen paginasnelheid per app.

Het robots.txt.liquid speelboek

Hier is de samengevatte reeks regels die de meeste Shopify-winkels dekt. Voeg deze toe aan uw robots.txt.liquid-bestand:

Disallow: /collections/*/tagged/ Disallow: /search Disallow: /cart Disallow: /checkout Disallow: /account

De regel /collections/*/tagged/ heeft de meeste impact voor winkels die product tags als filters gebruiken. Geïndexeerde interne zoekpagina's door Google verdunnen uw crawl budget met duplicate dunne inhoud, dus blokkeer die ook. Winkelwagen-, checkout- en accountpagina's mogen nooit worden geïndexeerd en zijn al in Shopify's standaard robots.txt geblokkeerd, maar het expliciet maken toekomstbestendigt uw setup tegen eventuele platformwijzigingen.

Na het maken van wijzigingen, gebruik het URL-inspectie tool in Google Search Console om te verifiëren dat afzonderlijke pagina's naar verwachting reageren. Controleer het Crawl Stats-rapport wekelijks gedurende twee tot vier weken na elke robots.txt-wijziging. Een piek in "blocked by robots.txt (geblokkeerd door robots.txt)" uitsluitingen is normaal en verwacht. Een daling van indrukken voor uw kernverzamellingspagina's niet, en geeft een te brede Disallow-regel aan.

Interne linking: de fix die canonical tags niet alleen kunnen doen

De structurele fix die meeste handelaren overslaan, is het bijwerken van de interne linkuitvoer van hun thema. In Liquid worden product-URLs in collectielussen doorgaans als volgt weergegeven:

liquid {{ product.url | within: collection }}

Dit genereert de URL van het collectiepad. Voor SEO wilt u het canonieke pad:

liquid {{ product.url }}

Het filter | within: collection is de schuldige achter de meeste canonical mismatch-rapportages. Het verwijderen uit productkaartlinks, breadcrumbs en gerelateerde productcarousels betekent dat Googlebot's crawl dezelfde URL volgt die u canonicaliseert. De canonical tag en interne links stemmen dan overeen, wat betekent dat Google uw canonical signaal betrouwbaar eert.

Als u een diepere beoordeling van uw thema's Liquid-uitvoer en crawl-architectuur wilt, dekken de Shopify SEO-service die ik aanbied een volledige crawl-audit als onderdeel van de betrokkenheid.

Sitemap-hygiëne

Shopify's automatisch gegenereerde sitemap.xml is een nuttige crawl-versneller, maar vereist periodieke controle. De sitemap sluit standaard op correcte manier collectie-pad-product-URLs uit, wat een van de ondergewaardeerde SEO-gedragingen van het platform is. Wat het niet automatisch filtert, zijn tag-gebaseerde collectiepagina's en, in sommige winkeltaken, gepagineerde collectie-URLs na pagina een.

Shopify staat u niet toe om sitemapitems handmatig te verwijderen, maar u kunt pagina's van indexering onderdrukken met behulp van Liquid-gebaseerde noindex-tags, die aan Google signaleren dat die URLs uit de index moeten worden uitgesloten, zelfs als de sitemap deze vermeldt. Vertrouw niet alleen op sitemap-weglating als noindex-signaal. Gebruik de meta robots-tag in de <head> voor elke pagina die u definitief wilt uitsluiten.

Het werk valideren

Na het implementeren van canonical fixes, robots.txt-updates en interne linkcorrecties, valideer met deze volgordeprocessus:

  • Google Search Console > Coverage (Dekking) > Excluded (Uitgesloten): het aantal "Duplicate, submitted URL not selected as canonical (Duplicaat, ingediende URL niet geselecteerd als canonical)" moet binnen 4-8 weken dalen.
  • Crawl Stats-rapport: totale crawlaanvragen moeten afnemen of stabiliseren; het aandeel naar collectie-pad-URLs moet dalen.
  • Screaming Frog of Ahrefs Site Audit: herkrui na 30 dagen en vergelijk de verhouding van 3xx, noindex en canonical-mismatch-URLs met uw baseline.
  • URL-inspectie: steekproef 5-10 filter-URLs om te bevestigen dat Google's geselecteerde canonical uw beoogde /products/-URL overeenkomt.

Voor een volledige technische checklist die verder gaat dan gefacetteerde navigatie in Core Web Vitals en gestructureerde gegevens, zie de Shopify-snelheidsoptimalisatiegids die ik eerder heb gepubliceerd.

De AI-crawler dimensie

Een factor die twee jaar geleden niet op schaal bestond: AI-crawlers van ChatGPT, Perplexity en Googles AI Overview-systeem voegen nu toe aan de bot-verkeersaanvallen op uw winkel. Deze crawlers werken onder afzonderlijke user agents, en Shopify's standaard robots.txt behandelt alleen User-agent: *. Als u AI-bots expliciet wilt toestaan of beperken, hebt u genoemde user-agent-regels in uw robots.txt.liquid nodig. Nog belangrijker is dat deze crawlers sterk afhankelijk zijn van gestructureerde gegevens om uw productpagina's te begrijpen. Een sitemap die uw canonieke collectie- en productpagina's aan het oppervlak brengt, in combinatie met correcte Product schema, is wat uw inventaris in door AI gegenereerde antwoorden wordt aangehaald.

Repareer eerst de crawl-architectuur. De canonieke URLs die u aan Googlebot oppervlakt, zijn dezelfde die AI-crawlers zullen gebruiken om uw producten te begrijpen en aan te bevelen.

shopify seotechnical seocrawl budgetfaceted navigationshopify collectionsshopify developer

Veelgestelde vragen

Lost Shopify automatisch problemen met gefacetteerde navigatie SEO op?

Shopify voegt automatisch canonical tags toe aan productpagina's, maar beheert geen filter-URL-indexering, robots.txt-regels voor tag-pagina's of interne linkpaden. Handelaren moeten deze afzonderlijk configureren met behulp van de robots.txt.liquid-sjabloon en Liquid-thema-bewerkingen.

Moet ik alle collectiefilter-URLs in robots.txt blokkeren?

Nee. Blokkeer alleen filtercombinaties die nul zelfstandige zoekintenties hebben, zoals sorteerparameters en tag-gefilterde pagina's. Filters die echte zoekaanvragen vertegenwoordigen (bijvoorbeeld een collectie gefilterd op een specifiek materiaal) verdienen mogelijk hun eigen indexeerbare pagina met een unieke canonical URL.

Hoe lang duurt het voordat ranginingsverbeteringen zichtbaar zijn na het oplossen van crawl budget-problemen?

Crawl budget fixes tonen doorgaans resultaten in Google Search Console binnen 4-8 weken terwijl Googlebot uw canonicals opnieuw crawlt en opnieuw evalueert. Organische rankingverbeteringen in zoekresultaten volgen meestal 2-3 maanden na stabilisering van de indexeringscorrecties.