Respuesta rápida: Para mantener una página de Shopify fuera de Google, añade una etiqueta meta robots noindex en su editando theme.liquid para que emita <meta name="robots" content="noindex"> de manera condicional para las páginas que deseas excluir (no hay un interruptor en el administrador). NO bloquees la página en robots.txt — un Disallow impide que Google rastree la página, por lo que nunca ve el noindex y la URL aún puede aparecer como un enlace simple. Permite el rastreo, usa noindex. Objetivos comunes: resultados de búsqueda internos, carrito, cuenta y URLs de colecciones con muchas facetas.

A veces, el éxito en SEO es mantener una página fuera de la búsqueda, no dentro de ella — las páginas de resultados de búsqueda internos, los duplicados con facetas y las páginas de utilidad diluyen el enfoque de rastreo de tu tienda. El error que cometen la mayoría de los comerciantes es recurrir a robots.txt, que es la herramienta incorrecta y empeora silenciosamente el problema.

noindex vs robots.txt — la distinción que importa

Parecen intercambiables y no lo son:

  • noindex (una etiqueta meta o encabezado) dice: rastrea esta página, pero mantenla fuera del índice.
  • robots.txt Disallow dice: no rastrees esta página en absoluto.

Aquí está la trampa. Si haces Disallow a una URL, Googlebot no puede obtener la página — por lo que nunca ve una etiqueta noindex que pongas allí, y la URL puede aún aparecer en los resultados como un enlace simple y sin descripción porque Google sabe que existe pero se le dijo que no mirara. Para eliminar de manera confiable una página del índice, debes permitir que Google la rastree y encuentre un noindex. Las dos directivas entran en conflicto; elige noindex para "mantenerla fuera de la búsqueda."

Cómo noindexar en Shopify

Shopify no tiene un interruptor de administrador para esto, por lo que es una edición condicional en Tienda Online → Temas → Editar código → theme.liquid, dentro del <head>:

{% if template contains 'search' or template contains 'cart' %}
  <meta name="robots" content="noindex">
{% endif %}

Clave la condición en lo que identifica las páginas que deseas excluir — el nombre del template, un handle de página específico, o un patrón de URL. Mantén la regla estrecha: una condición que coincida con un template demasiado ampliamente puede noindexar silenciosamente páginas que deseas que se clasifiquen, lo cual es la herida autoinfligida más común aquí.

Qué noindexar (y qué nunca)

Candidatos razonables: páginas de resultados de búsqueda internos, las páginas de carrito y cuenta, URLs de colecciones filtradas por etiquetas o con muchas facetas que crean casi duplicados (aunque Shopify canibaliza muchas de esas ya), y ocasionalmente páginas de utilidad delgadas. Nunca noindexes tus productos, colecciones, publicaciones de blog o páginas de destino clave — y vuelve a leer cualquier regla amplia antes de implementarla.

Verifica que funcionó

Ve al código fuente y confirma que <meta name="robots" content="noindex"> está en el <head> de las páginas que apuntaste — y ausente de todo lo demás. Luego, ejecuta la página a través de la herramienta de Inspección de URL de Google Search Console, que informa sobre la indexabilidad y si vio el noindex. Eliminar una página ya indexada lleva un ciclo de rastreo: la directiva se aplica cuando Google vuelve a obtener la página, no instantáneamente. Si necesitas que desaparezca más rápido, solicita la indexación (lo que provoca un nuevo rastreo) después de confirmar que la etiqueta está activa.