Resposta rápida: robots.txt informa aos motores de busca e rastreadores de IA quais caminhos na sua loja eles podem rastrear. O Shopify oferece um padrão sensato e permite que você o personalize com um modelo robots.txt.liquid. O erro comum e caro é desautorizar acidentalmente caminhos de produtos ou coleções, o que os desindexa. Para busca de IA, permita explicitamente os rastreadores que você deseja que citem — GPTBot, ClaudeBot, PerplexityBot e Google-Extended.
O seu robots.txt informa aos motores de busca e rastreadores de IA o que eles podem rastrear na sua loja. No Shopify, é quase tudo automático, o que é bom — mas os padrões causam dois problemas recorrentes, e o aviso do Google "Indexado, mas bloqueado por robots.txt" confunde muitos comerciantes que depois pioram a situação bloqueando ainda mais. Veja como o arquivo funciona no Shopify, como editá-lo com segurança e como corrigir os erros que ele causa.
Como funciona o robots.txt do Shopify
O Shopify gera o arquivo em yourstore.com/robots.txt automaticamente e oferece um padrão sensato. Esse padrão já desautoriza os caminhos internos que você nunca quer indexados — /cart, /checkout, /orders, /account e as URLs internas de busca e filtragem do Shopify — e direciona os rastreadores para o seu sitemap. Para muitas lojas, você nunca precisa mexer nele.
Desde 2021, você pode personalizá-lo adicionando um arquivo templates/robots.txt.liquid ao seu tema. Você o cria no editor de código do tema: no seu admin, vá para Loja Online → Temas → [seu tema] → ⋯ → Editar código, depois na pasta Templates clique em "Adicionar um novo modelo" e escolha robots.txt no menu suspenso de tipos de modelo. O Shopify estrutura as regras padrão como Liquid, e você edita a partir daí. O arquivo é Liquid, não texto simples, então você está modificando um modelo que renderiza as regras em vez de escrever diretivas brutas — o que permite adicionar ou remover regras específicas mantendo os padrões sensatos do Shopify intactos.
Duas precauções antes de editar. Primeiro, este arquivo é poderoso na direção errada — um Disallow: / acidental diria a todos os rastreadores para ignorarem toda a sua loja, então altere-o deliberadamente e verifique o resultado renderizado em yourstore.com/robots.txt depois. Segundo, robots.txt controla o rastreamento, não a indexação. Essas são coisas diferentes, e confundi-las é a raiz do erro mais comum de robots do Shopify.
Rastreamento não é indexação
Uma regra Disallow em robots.txt diz a um rastreador "não busque esta URL." Não diz ao Google "não indexe esta URL." Se o Google descobrir uma URL bloqueada através de um link em algum lugar, ele ainda pode adicionar a URL nua ao seu índice — ele só não pode ler a página para ver o que há nela. O resultado é uma listagem sem título ou descrição úteis, o que é pior do que indexar a página corretamente ou mantê-la fora completamente.
Essa única distinção explica o aviso abaixo, e é por isso que "apenas bloqueá-lo em robots.txt" é a correção errada para páginas que você quer manter fora da busca.
Corrigindo "Indexado, mas bloqueado por robots.txt"
Este aviso do Search Console significa que o Google encontrou uma URL, geralmente através de um link, mas não pôde rastreá-la porque robots.txt bloqueia o caminho — então ele indexou a URL sem conteúdo. A correção depende do que você quer que aconteça com essa URL:
| Se você quer... | Então... | Porque... |
|---|---|---|
| Manter a URL indexada e corrigir a listagem | Remova ou restrinja a regra Disallow; solicite indexação no Search Console | O Google precisa rastrear a página para ver seu conteúdo e atualizar a listagem |
| Remover a URL dos resultados de busca completamente | Desbloqueie a página, depois adicione uma meta tag noindex ou cabeçalho X-Robots-Tag | Um rastreador não pode ler uma instrução noindex em uma página bloqueada |
- Identifique a URL exata bloqueada no relatório de Páginas do Search Console sob este status, e verifique-a contra o seu robots.txt para encontrar a regra Disallow correspondente.
- Se ela deve ser indexada — um produto real ou coleção que foi pego por uma regra muito ampla — remova ou restrinja a regra Disallow em robots.txt.liquid para que o Google possa rastreá-la, depois solicite indexação. Uma vez que o Google leia a página, o aviso desaparece e a listagem recebe um título e descrição adequados.
- Se ela não deve ser indexada — uma página de filtro fina, um resultado de busca interna, uma página de login — não confie apenas no bloqueio. Bloquear sozinho pode deixar a URL nua indexada para sempre. Em vez disso, deixe o Google rastrear a página e dê-lhe um sinal noindex que ele possa realmente ler: uma meta tag noindex no markup da página, ou um cabeçalho X-Robots-Tag noindex. Contraditoriamente, para remover uma página do índice, muitas vezes você tem que desbloqueá-la primeiro para que o rastreador possa ver a instrução noindex. Uma página bloqueada é uma página cuja tag noindex o Google nunca lerá.
Desautorizando páginas de busca e tags
Dois padrões de URL do Shopify geram páginas de baixo valor quase infinitas que podem inchar seu índice: resultados de busca interna (caminhos sob /search) e URLs de coleções filtradas por tags (longas strings de consulta com ?constraint= ou parâmetros de tag). Os padrões do Shopify lidam com muito disso, mas em temas personalizados e catálogos fortemente etiquetados, essas podem escapar e serem indexadas como páginas finas e duplicadas.
Se você as encontrar indexadas e quiser removê-las, aplique a lógica de rastreamento versus indexação acima. Bloquear /search em robots.txt impede o rastreamento fresco, mas não removerá URLs já indexadas; para essas, um sinal noindex nos modelos de busca e filtro é a correção duradoura. Tags canônicas ajudam aqui também — apontar variantes de coleções filtradas de volta para a URL limpa da coleção é muitas vezes mais limpo do que bloquear, e isso é abordado no guia de tags canônicas. A decisão é se você quer a página não rastreável ou não indexada; elas exigem ferramentas opostas.
Dê boas-vindas aos rastreadores de IA, deliberadamente
Para ser citado por motores de resposta de IA, seu robots.txt precisa permitir os rastreadores que esses motores usam — e muitas lojas os bloqueiam por acidente, muitas vezes através de uma CDN ou configuração de segurança em vez de escolha do proprietário da loja. Os agentes que vale a pena conhecer pelo nome:
- GPTBot e OAI-SearchBot — rastreadores da OpenAI, o segundo especificamente para citações de busca do ChatGPT.
- ClaudeBot — rastreador da Anthropic.
- Google-Extended — controle do Google para treinamento e fundamentação de IA, separado do Googlebot.
- PerplexityBot — rastreador da Perplexity.
- CCBot — Common Crawl, que alimenta muitos modelos a jusante.
Estes são distintos do Googlebot e cada um busca em seus próprios termos. A ação de AEO mais rápida é confirmar que seu robots.txt não bloqueia os que você quer que citem você, e idealmente permitir explicitamente com um bloco User-agent e Allow no robots.txt.liquid. Bloqueá-los silenciosamente exclui sua loja da visibilidade de IA sem erro algum para avisá-lo. Isso é fundamental para otimização de motores de resposta e o mais amplo otimização de motores generativos e visibilidade de IA — e combina naturalmente com um bom arquivo llms.txt, que é a versão afirmativa da mesma ideia. Se você está ponderando quais agentes permitir, o guia de SEO do ChatGPT aprofunda-se especificamente nos rastreadores da OpenAI.
Uma maneira rápida de verificar seu robots.txt
Abra yourstore.com/robots.txt em um navegador — esse é o resultado renderizado que todo rastreador vê, e é o arquivo que importa, não o seu modelo Liquid. Procure por qualquer Disallow: / sozinho (um bloqueio de site completo), por agentes de rastreadores de IA sob um Disallow, e por uma linha Sitemap: apontando para o seu verdadeiro sitemap.xml. No Search Console, o relatório de Páginas informa o que está realmente acontecendo — quantas URLs estão sob "Indexado, mas bloqueado por robots.txt" e quais são. Entre o arquivo bruto e o relatório de Páginas, você pode ver tanto a política quanto suas consequências.
A higiene do robots.txt está ao lado do seu sitemap, redirecionamentos e marcação de esquema como a camada de rastreabilidade do SEO do Shopify; a lista de verificação de 2026 e o guia de SEO do Shopify os unem, e a visão geral das ferramentas de SEO do Shopify cobre o que as automatiza.
O RankEngine audita sua política de robots, sinaliza URLs bloqueadas mas indexadas a partir dos seus dados do Search Console, e pode publicar um robots.txt.liquid com as regras corretas para rastreadores de IA — depois verifica contra o arquivo renderizado ao vivo para que você saiba que a mudança realmente foi feita em vez de confiar que o modelo foi salvo.