O Shopify gera automaticamente um robots.txt para cada loja. A documentação da plataforma diz que o arquivo padrão é adequado para a maioria das lojas, então a prática mais segura é entender primeiro o que o Shopify já gera e personalizar apenas quando existe uma necessidade concreta.
Para mudanças avançadas, o tema pode incluir robots.txt.liquid. O próprio Shopify alerta que uma personalização incorreta pode causar perda significativa de tráfego.
Onde fica o robots.txt do Shopify
Na raiz do domínio principal:
https://example.com/robots.txt
Antes de mudar qualquer coisa, salve o arquivo publicado como baseline. Não copie o robots.txt de outra loja: apps, mercados, tema e regras da plataforma podem variar.
Quando robots.txt.liquid faz sentido
Considere personalização quando houver um requisito específico, como:
- app gerando muitas URLs desnecessárias;
- necessidade de liberar um caminho concreto;
- adição de outro sitemap;
- política para um crawler documentado;
- controle de rastreadores de IA na web aberta.
Não edite apenas porque um relatório SEO diz que robots.txt existe ou porque o arquivo de um concorrente é maior.
Preserve os padrões do Shopify
O Shopify permite usar Liquid para adicionar ou remover regras mantendo a base gerenciada pela plataforma. Substituir tudo por texto estático pode congelar uma política e impedir que mudanças futuras do Shopify sejam refletidas.
Faça a menor alteração possível e documente o motivo de cada override.
Rastreamento não é indexação
O Shopify distingue explicitamente os dois processos. Uma URL bloqueada pode ser descoberta e indexada por outros sinais, o que explica mensagens como “Indexada, embora bloqueada por robots.txt”.
Se uma página pública deve ficar fora dos resultados, robots.txt não substitui noindex. Se a informação é privada, use autenticação. Não remova regras padrão só para eliminar um aviso sem entender por que a rota foi bloqueada.
Sitemap
O Shopify fornece sitemap automaticamente. Se adicionar uma linha, use URL absoluta:
Sitemap: https://example.com/sitemap.xml
Repetir o mesmo sitemap não traz ganho extra. O importante é listar URLs canônicas e indexáveis.
Crawlers de IA e Shopify Catalog
A documentação atual do Shopify separa o acesso de crawlers pela web aberta da distribuição de dados do catálogo para canais agênticos ativados na loja.
Você pode permitir ou bloquear User-agent específicos via robots.txt.liquid, mas bloquear um crawler em /robots.txt não desativa automaticamente o envio de dados via Shopify Catalog a um canal que você ativou.
Defina qual camada quer controlar:
- rastreamento direto das páginas públicas;
- descoberta em busca/IA;
- crawler específico de um provedor;
- distribuição de catálogo nos canais do Shopify.
Filtros, coleções e busca exigem cuidado
Antes de alterar regras amplas, reúna exemplos de coleções canônicas, filtros, busca interna, produtos com parâmetros, URLs por mercado/idioma e rotas de apps. Um Allow amplo demais pode expor milhares de combinações de baixo valor.
Fluxo seguro
- Salve o
/robots.txtatual. - Escreva o objetivo em uma frase.
- Liste URLs que devem ser permitidas e bloqueadas.
- Faça a menor mudança possível em Liquid.
- Valide o arquivo gerado.
- Teste URLs representativas.
- Publique e busque novamente
/robots.txt. - Monitore Search Console e logs.
- Revise a customização quando a plataforma mudar.
Para a maioria das lojas, o padrão é suficiente. Quando a mudança for necessária, preserve as regras do Shopify, limite o override e teste o resultado real em produção.