Resposta rápida: robots.txt informa aos motores de busca e rastreadores de IA quais caminhos na sua loja eles podem rastrear. O Shopify oferece um padrão sensato e permite que você o personalize com um modelo robots.txt.liquid. O erro comum e caro é desautorizar acidentalmente caminhos de produtos ou coleções, o que os desindexa. Para busca de IA, permita explicitamente os rastreadores que você deseja que citem — GPTBot, ClaudeBot, PerplexityBot e Google-Extended.

O seu robots.txt informa aos motores de busca e rastreadores de IA o que eles podem rastrear na sua loja. No Shopify, é quase tudo automático, o que é bom — mas os padrões causam dois problemas recorrentes, e o aviso do Google "Indexado, mas bloqueado por robots.txt" confunde muitos comerciantes que depois pioram a situação bloqueando ainda mais. Veja como o arquivo funciona no Shopify, como editá-lo com segurança e como corrigir os erros que ele causa.

Como funciona o robots.txt do Shopify

O Shopify gera o arquivo em yourstore.com/robots.txt automaticamente e oferece um padrão sensato. Esse padrão já desautoriza os caminhos internos que você nunca quer indexados — /cart, /checkout, /orders, /account e as URLs internas de busca e filtragem do Shopify — e direciona os rastreadores para o seu sitemap. Para muitas lojas, você nunca precisa mexer nele.

Desde 2021, você pode personalizá-lo adicionando um arquivo templates/robots.txt.liquid ao seu tema. Você o cria no editor de código do tema: no seu admin, vá para Loja Online → Temas → [seu tema] → ⋯ → Editar código, depois na pasta Templates clique em "Adicionar um novo modelo" e escolha robots.txt no menu suspenso de tipos de modelo. O Shopify estrutura as regras padrão como Liquid, e você edita a partir daí. O arquivo é Liquid, não texto simples, então você está modificando um modelo que renderiza as regras em vez de escrever diretivas brutas — o que permite adicionar ou remover regras específicas mantendo os padrões sensatos do Shopify intactos.

Duas precauções antes de editar. Primeiro, este arquivo é poderoso na direção errada — um Disallow: / acidental diria a todos os rastreadores para ignorarem toda a sua loja, então altere-o deliberadamente e verifique o resultado renderizado em yourstore.com/robots.txt depois. Segundo, robots.txt controla o rastreamento, não a indexação. Essas são coisas diferentes, e confundi-las é a raiz do erro mais comum de robots do Shopify.

Rastreamento não é indexação

Uma regra Disallow em robots.txt diz a um rastreador "não busque esta URL." Não diz ao Google "não indexe esta URL." Se o Google descobrir uma URL bloqueada através de um link em algum lugar, ele ainda pode adicionar a URL nua ao seu índice — ele só não pode ler a página para ver o que há nela. O resultado é uma listagem sem título ou descrição úteis, o que é pior do que indexar a página corretamente ou mantê-la fora completamente.

Essa única distinção explica o aviso abaixo, e é por isso que "apenas bloqueá-lo em robots.txt" é a correção errada para páginas que você quer manter fora da busca.

Corrigindo "Indexado, mas bloqueado por robots.txt"

Este aviso do Search Console significa que o Google encontrou uma URL, geralmente através de um link, mas não pôde rastreá-la porque robots.txt bloqueia o caminho — então ele indexou a URL sem conteúdo. A correção depende do que você quer que aconteça com essa URL:

Se você quer... Então... Porque...
Manter a URL indexada e corrigir a listagem Remova ou restrinja a regra Disallow; solicite indexação no Search Console O Google precisa rastrear a página para ver seu conteúdo e atualizar a listagem
Remover a URL dos resultados de busca completamente Desbloqueie a página, depois adicione uma meta tag noindex ou cabeçalho X-Robots-Tag Um rastreador não pode ler uma instrução noindex em uma página bloqueada
  • Identifique a URL exata bloqueada no relatório de Páginas do Search Console sob este status, e verifique-a contra o seu robots.txt para encontrar a regra Disallow correspondente.
  • Se ela deve ser indexada — um produto real ou coleção que foi pego por uma regra muito ampla — remova ou restrinja a regra Disallow em robots.txt.liquid para que o Google possa rastreá-la, depois solicite indexação. Uma vez que o Google leia a página, o aviso desaparece e a listagem recebe um título e descrição adequados.
  • Se ela não deve ser indexada — uma página de filtro fina, um resultado de busca interna, uma página de login — não confie apenas no bloqueio. Bloquear sozinho pode deixar a URL nua indexada para sempre. Em vez disso, deixe o Google rastrear a página e dê-lhe um sinal noindex que ele possa realmente ler: uma meta tag noindex no markup da página, ou um cabeçalho X-Robots-Tag noindex. Contraditoriamente, para remover uma página do índice, muitas vezes você tem que desbloqueá-la primeiro para que o rastreador possa ver a instrução noindex. Uma página bloqueada é uma página cuja tag noindex o Google nunca lerá.

Desautorizando páginas de busca e tags

Dois padrões de URL do Shopify geram páginas de baixo valor quase infinitas que podem inchar seu índice: resultados de busca interna (caminhos sob /search) e URLs de coleções filtradas por tags (longas strings de consulta com ?constraint= ou parâmetros de tag). Os padrões do Shopify lidam com muito disso, mas em temas personalizados e catálogos fortemente etiquetados, essas podem escapar e serem indexadas como páginas finas e duplicadas.

Se você as encontrar indexadas e quiser removê-las, aplique a lógica de rastreamento versus indexação acima. Bloquear /search em robots.txt impede o rastreamento fresco, mas não removerá URLs já indexadas; para essas, um sinal noindex nos modelos de busca e filtro é a correção duradoura. Tags canônicas ajudam aqui também — apontar variantes de coleções filtradas de volta para a URL limpa da coleção é muitas vezes mais limpo do que bloquear, e isso é abordado no guia de tags canônicas. A decisão é se você quer a página não rastreável ou não indexada; elas exigem ferramentas opostas.

Dê boas-vindas aos rastreadores de IA, deliberadamente

Para ser citado por motores de resposta de IA, seu robots.txt precisa permitir os rastreadores que esses motores usam — e muitas lojas os bloqueiam por acidente, muitas vezes através de uma CDN ou configuração de segurança em vez de escolha do proprietário da loja. Os agentes que vale a pena conhecer pelo nome:

  • GPTBot e OAI-SearchBot — rastreadores da OpenAI, o segundo especificamente para citações de busca do ChatGPT.
  • ClaudeBot — rastreador da Anthropic.
  • Google-Extended — controle do Google para treinamento e fundamentação de IA, separado do Googlebot.
  • PerplexityBot — rastreador da Perplexity.
  • CCBot — Common Crawl, que alimenta muitos modelos a jusante.

Estes são distintos do Googlebot e cada um busca em seus próprios termos. A ação de AEO mais rápida é confirmar que seu robots.txt não bloqueia os que você quer que citem você, e idealmente permitir explicitamente com um bloco User-agent e Allow no robots.txt.liquid. Bloqueá-los silenciosamente exclui sua loja da visibilidade de IA sem erro algum para avisá-lo. Isso é fundamental para otimização de motores de resposta e o mais amplo otimização de motores generativos e visibilidade de IA — e combina naturalmente com um bom arquivo llms.txt, que é a versão afirmativa da mesma ideia. Se você está ponderando quais agentes permitir, o guia de SEO do ChatGPT aprofunda-se especificamente nos rastreadores da OpenAI.

Uma maneira rápida de verificar seu robots.txt

Abra yourstore.com/robots.txt em um navegador — esse é o resultado renderizado que todo rastreador vê, e é o arquivo que importa, não o seu modelo Liquid. Procure por qualquer Disallow: / sozinho (um bloqueio de site completo), por agentes de rastreadores de IA sob um Disallow, e por uma linha Sitemap: apontando para o seu verdadeiro sitemap.xml. No Search Console, o relatório de Páginas informa o que está realmente acontecendo — quantas URLs estão sob "Indexado, mas bloqueado por robots.txt" e quais são. Entre o arquivo bruto e o relatório de Páginas, você pode ver tanto a política quanto suas consequências.

A higiene do robots.txt está ao lado do seu sitemap, redirecionamentos e marcação de esquema como a camada de rastreabilidade do SEO do Shopify; a lista de verificação de 2026 e o guia de SEO do Shopify os unem, e a visão geral das ferramentas de SEO do Shopify cobre o que as automatiza.

O RankEngine audita sua política de robots, sinaliza URLs bloqueadas mas indexadas a partir dos seus dados do Search Console, e pode publicar um robots.txt.liquid com as regras corretas para rastreadores de IA — depois verifica contra o arquivo renderizado ao vivo para que você saiba que a mudança realmente foi feita em vez de confiar que o modelo foi salvo.