← Tous les articles Contenu dupliqué chez Shopify: Ce que c'est et comment le corriger

Contenu dupliqué chez Shopify: Ce que c'est et comment le corriger

Le contenu dupliqué chez Shopify provient des URLs de produits, des pages de tags et de la pagination. Découvrez comment le diagnostiquer et le corriger.

Shopify génère par défaut plusieurs URLs pour le même produit, ce que Google considère comme du contenu dupliqué et qui dilue votre classement. La bonne nouvelle: la plateforme applique déjà automatiquement certaines balises Canonical, mais cette automatisation ne vous donne pas carte blanche. Vous devez intervenir activement pour protéger votre budget de crawl et consolider l'autorité des liens vers une seule URL forte.

Points clés à retenir

  • Shopify crée pour chaque produit au moins deux URLs indexables: /products/ et /collections/[nom]/products/.
  • Les balises Canonical sont des suggestions, pas des directives. Google ne les suit pas toujours.
  • Les pages de collection filtrées par tags comme /collections/chaussures/course sont des usines silencieuses de contenu dupliqué.
  • ?page=1 est un doublon gratuit de chaque page de collection que Shopify ne canonise pas automatiquement.
  • L'ordre correct des corrections est: vérifier Canonical, nettoyer les liens internes, appliquer Noindex, puis adapter robots.txt.

Qu'est-ce que le contenu dupliqué chez Shopify?

Le contenu dupliqué existe quand un contenu identique ou très similaire est accessible via plusieurs URLs. Pour les moteurs de recherche, ce sont techniquement des pages différentes, même si le client n'y voit aucune différence. Google doit alors décider quelle URL indexer et laquelle ignorer. Google prend cette décision seul, généralement pas comme vous le souhaitez.

Shopify génère du contenu dupliqué par quatre sources principales:

  1. URLs de produits scoped par collection (le plus gros problème)
  2. Pages de collection filtrées par tags
  3. URLs de pagination (?page=1)
  4. Paramètres de variante (?variant=12345)

Les quatre sources en détail

1. URLs de produits scoped par collection

C'est de loin la cause la plus fréquente. Chaque produit chez Shopify est accessible via deux chemins:

  • https://votre-boutique.fr/products/t-shirt-bleu
  • https://votre-boutique.fr/collections/t-shirts/products/t-shirt-bleu

Shopify applique automatiquement une balise Canonical sur la variante collection qui pointe vers l'URL /products/. Cela semble être une solution, mais c'est seulement à moitié vrai. Les balises Canonical sont des recommandations, pas des instructions. Si vos liens internes pointent toujours vers l'URL scoped par collection, cela envoie des signaux contradictoires à Google, qui peut alors choisir la mauvaise URL comme maître.

Le déclencheur courant: le filtre Liquid | within: collection dans beaucoup de thèmes génère automatiquement des liens awareness-collection. Chaque produit lié à l'intérieur d'une collection obtient ainsi sa propre URL dupliquée.

La correction dans votre template Liquid:

Vérifiez votre product-card.liquid ou le snippet correspondant. Le lien vers le produit doit toujours pointer vers product.url, pas vers product.url | within: collection:

{# Incorrect - génère une URL scoped par collection #}
<a href="{{ product.url | within: collection }}">

{# Correct - pointe toujours vers /products/ #}
<a href="{{ product.url }}">

Avec ce seul changement dans votre code de thème, vous redirigez tous les signaux de lien interne vers l'URL canonique.

2. Pages de collection filtrées par tags

Le système de tagging de Shopify est pratique, mais un producteur silencieux de contenu dupliqué. Quand les clients filtrent une collection par tags, cela crée des URLs comme:

  • /collections/chaussures/course
  • /collections/chaussures/etanche
  • /collections/chaussures/course+etanche

Ces pages contiennent souvent exactement les mêmes produits que la collection parent, avec le même titre et la même meta-description. Avec une boutique ayant 200 tags sur 50 collections, on peut rapidement avoir plus de 10 000 pages faibles qui consomment le budget de crawl sans jamais être classées.

La correction:

Appliquez une balise meta Noindex à toutes les pages filtrées par tags. Dans theme.liquid, vérifiez si current_tags est défini:

{% if current_tags %}
  <meta name="robots" content="noindex, follow">
{% endif %}

Avec follow, vous permettez à Googlebot de continuer à suivre les liens de la page. Seule l'indexation est bloquée. Vous pouvez aussi bloquer les pages de tags dans votre robots.txt.liquid avec Disallow: /collections/*/, mais rappelez-vous: robots.txt ne protège pas l'indexation, c'est juste un indice de crawl. Pour une indexation propre et durable, combinez les deux mesures.

3. URLs de pagination

Une collection avec 200 produits et 24 par page génère 9 URLs de pagination. Shopify ajoute ?page=2, ?page=3, etc. Le vrai problème: ?page=1 est un doublon direct de l'URL de base /collections/chaussures, et Shopify ne canonise pas cette variante automatiquement.

URLStatutStandard Shopify
/collections/chaussuresCanonique, indexableCorrect
/collections/chaussures?page=1Doublon de l'URL de baseNon canonisé
/collections/chaussures?page=2Pagination indépendanteAuto-canonisé
/collections/chaussures?sort_by=priceDoublon avec tri différentNon canonisé

Pour ?page=1, une Canonical manuelle dans votre template de collection aide:

{% if current_page == 1 %}
  <link rel="canonical" href="{{ collection.url | prepend: shop.url }}">
{% else %}
  <link rel="canonical" href="{{ collection.url | prepend: shop.url }}?page={{ current_page }}">
{% endif %}

4. Paramètres de variante

Les variantes de produit génèrent des URLs comme /products/t-shirt?variant=12345678. Ici, Shopify fait vraiment bien les choses: la balise Canonical appliquée automatiquement sur les URLs de variante pointe toujours vers l'URL de produit de base, sans le paramètre de variante. Cela vous protège du contenu dupliqué dans ce domaine.

Attention avec les applications tierces pour les configurateurs de produits complexes. Certaines de ces applications créent leurs propres pages pour les variantes et contournent les Canonicals standards de Shopify. Après chaque installation d'application, vérifiez qu'aucune nouvelle URL sans balise Canonical n'apparaît.

Diagnostiquer le contenu dupliqué: Les outils

Avant d'appliquer des corrections, vous avez besoin d'un inventaire. Ces outils révèlent les problèmes:

  • Google Search Console: Allez à "Pages" et filtrez par "Doublon, Google a choisi une autre URL canonique". Si Google ignore votre Canonical, c'est un signal fort que vos liens internes sont contradictoires.
  • Screaming Frog SEO Spider: Crawlez votre boutique et exportez toutes les URLs. Cherchez les URLs qui partagent la même balise Canonical.
  • Google Search: Entrez site:votre-boutique.fr inurl:/collections/. Si les URLs de produits avec le chemin de collection apparaissent dans les résultats, Google n'a pas accepté votre Canonical.
  • View Page Source: Ouvrez une URL de produit dans une collection, appuyez sur Ctrl+U et cherchez rel="canonical". Le href doit pointer vers /products/, pas vers l'URL de collection.

L'ordre correct des corrections

Beaucoup de marchands se lancent d'abord dans robots.txt. C'est une erreur. L'ordre correct:

  1. Vérifier et corriger les balises Canonical (theme.liquid et snippets de produit)
  2. Nettoyer les liens internes (pas de filtre | within: collection dans les liens de produit)
  3. Appliquer Noindex aux pages faibles (pages de tags, résultats de recherche interne)
  4. Adapter robots.txt (seulement comme mesure complémentaire, pas comme remplacement)

Rappelez-vous: robots.txt empêche le crawl, pas l'indexation. Si Google connaît déjà des liens vers une page, elle peut toujours finir dans l'index, avec la mention "Description pour ce résultat non disponible".

Checklist: Audit de contenu dupliqué pour Shopify

  • [ ] Vérifiez si vos snippets de thème utilisent product.url | within: collection
  • [ ] Testez 5 URLs de produits de différentes collections sur leur balise Canonical
  • [ ] Vérifiez Google Search Console pour "Doublon, Google a choisi une autre URL canonique"
  • [ ] Contrôlez les pages de tags pour la balise Noindex (condition current_tags)
  • [ ] Vérifiez que ?page=1 sur les pages de collection est correctement canonisé
  • [ ] Testez après les installations d'applications les nouvelles URLs de variante sans Canonical
  • [ ] Assurez-vous que votre sitemap.xml contient seulement les URLs canoniques et indexables

Ce que Shopify fait automatiquement (et ce qu'il ne fait pas)

ProblèmeStandard ShopifyIntervention manuelle requise?
Produit en collection vs /products/Canonical appliquéOui, si les liens internes pointent mal
URLs de variante (?variant=)Canonical sur l'URL de baseSeulement pour les configurateurs d'application
Pages filtrées par tagsPas de protectionOui, Noindex requis
Doublon ?page=1Non canoniséOui, logique Canonical manuelle
Paramètres ?sort_by=Non canoniséOui, robots.txt ou Noindex
Paramètres UTM (?utm_source=)Canonical ignore les paramètresNon, Shopify gère cela
Pages de blogAuto-canoniséesNon

Contenu dupliqué et visibilité IA en 2026

Depuis 2026, les architectures de page propres jouent un rôle supplémentaire: les recherches assistées par IA comme Google AI Overviews et Perplexity favorisent les pages structurellement claires et fiables. Les boutiques avec des problèmes de contenu dupliqué non résolus envoient des signaux de crawl contradictoires, qui affectent non seulement le classement Google classique, mais réduisent aussi la probabilité d'être citées dans les réponses générées par l'IA.

Si vous voulez approfondir les fondamentaux du SEO technique, mon Guide complet Shopify Technical SEO couvre l'architecture complète de sitemap et de crawl. Et si vous voulez savoir comment la navigation à facettes et les URLs de filtre consomment votre budget de crawl, lisez mon guide sur Shopify Faceted Navigation SEO.

Conclusion

Le contenu dupliqué chez Shopify n'est pas le signe d'une plateforme cassée, mais une caractéristique architecturale qui demande une gestion active. Shopify fournit la base Canonical, mais l'ajustement fin vous appartient: des liens internes propres, Noindex sur les pages faibles, et une logique Canonical robuste dans le code Liquid. Qui ferme systématiquement ces quatre sources consolide son autorité de lien sur les pages qui doivent vraiment être classées.

shopify seoseo techniquecontenu dupliquécanonical tagsshopify liquid

Questions fréquentes

Le contenu dupliqué chez Shopify est-il un vrai problème SEO?

Oui. Le contenu dupliqué dilue votre autorité de lien sur plusieurs URLs et force Google à décider lui-même quelle page classer. Cela mène souvent à ce qu'une URL plus faible ou non désirée apparaisse dans les résultats de recherche. Shopify applique bien des balises Canonical automatiquement, mais ce ne sont que des suggestions, pas des directives obligatoires.

La balise Canonical résout-elle tous les problèmes de contenu dupliqué chez Shopify?

Pas seule. Les balises Canonical sont des recommandations, et Google les ignore si des signaux contradictoires existent, par exemple si vos liens internes pointent vers l'URL dupliquée. En complément, vous avez besoin de liens internes propres, de Noindex sur les pages faibles, et éventuellement d'adaptations robots.txt.

Dois-je appliquer moi-même les balises Canonical chez Shopify ou la plateforme le fait-elle?

Shopify applique automatiquement les balises Canonical pour les URLs de produit et les paramètres de variante. Pour les pages de collection filtrées par tags, le doublon ?page=1 et les paramètres ?sort_by=, vous devez intervenir manuellement, soit par du code Liquid dans le thème, soit par des balises Noindex.