Réponse rapide : Pour garder une page Shopify hors de Google, ajoutez une balise meta robots noindex dans son en modifiant theme.liquid pour afficher <meta name="robots" content="noindex"> de manière conditionnelle pour les pages que vous souhaitez exclure (il n'y a pas de bascule dans l'admin). Ne bloquez PAS la page dans robots.txt — un Disallow empêche Google de crawler la page, donc il ne voit jamais le noindex et l'URL peut toujours apparaître comme un lien nu. Autorisez le crawl, utilisez noindex. Cibles courantes : résultats de recherche internes, panier, compte, et URLs de collections fortement facettées.

Parfois, le gain SEO consiste à garder une page hors de la recherche, pas dedans — les pages de résultats de recherche internes, les doublons facettés et les pages utilitaires diluent le focus de crawl de votre boutique. L'erreur que font la plupart des marchands est de se tourner vers robots.txt, qui est le mauvais outil et aggrave silencieusement le problème.

noindex vs robots.txt — la distinction qui compte

Ils semblent interchangeables mais ne le sont pas :

  • noindex (une balise meta ou un en-tête) dit : crawler cette page, mais ne l'indexez pas.
  • robots.txt Disallow dit : ne pas crawler cette page du tout.

Voici le piège. Si vous Disallow une URL, Googlebot ne peut pas récupérer la page — donc il ne voit jamais une balise noindex que vous y mettez, et l'URL peut toujours apparaître dans les résultats comme un lien nu, sans description, car Google sait qu'elle existe mais a été informé de ne pas regarder. Pour retirer de manière fiable une page de l'index, vous devez laisser Google la crawler et trouver un noindex. Les deux directives sont en conflit ; choisissez noindex pour "la garder hors de la recherche."

Comment noindexer sur Shopify

Shopify n'a pas de commutateur admin pour cela, donc c'est une modification conditionnelle dans Boutique en ligne → Thèmes → Modifier le code → theme.liquid, à l'intérieur du <head> :

{% if template contains 'search' or template contains 'cart' %}
  <meta name="robots" content="noindex">
{% endif %}

Basez la condition sur ce qui identifie les pages que vous souhaitez exclure — le nom du template, un handle de page spécifique, ou un modèle d'URL. Gardez la règle étroite : une condition qui correspond à un template trop largement peut noindexer silencieusement des pages que vous souhaitez classer, ce qui est la blessure auto-infligée la plus courante ici.

Quoi noindexer (et quoi ne jamais)

Candidats raisonnables : pages de résultats de recherche internes, les pages de panier et de compte, les URLs de collections filtrées par tag ou fortement facettées qui créent des quasi-doublons (bien que Shopify canonicalise déjà beaucoup d'entre elles), et occasionnellement des pages utilitaires minces. Ne jamais noindexer vos produits, collections, articles de blog, ou pages de destination clés — et relisez toute règle large avant de la publier.

Vérifier que cela a fonctionné

Affichez le code source et confirmez que <meta name="robots" content="noindex"> est dans le <head> des pages ciblées — et absent de tout le reste. Ensuite, passez la page par l'outil d'inspection d'URL de Google Search Console, qui rapporte l'indexabilité et si elle a vu le noindex. Retirer une page déjà indexée prend un cycle de crawl : la directive s'applique lorsque Google récupère la page la prochaine fois, pas instantanément. Si vous avez besoin qu'elle disparaisse plus rapidement, demandez l'indexation (ce qui incite à un nouveau crawl) après avoir confirmé que la balise est en place.