Guias de robots.txt

Parâmetros de URL no robots.txt: como testamos filtros e facetas

Nosso processo para query strings, filtros, facetas, tracking, canonical e noindex antes de bloquear URLs com parâmetros.

Por Robots.txt Tools Editorial TeamÚltima verificação em 2026-09-131 min de leitura

Método editorial: este guia documenta o processo de revisão da equipe editorial do Robots.txt Tools. A linguagem procedural em primeira pessoa descreve esse método; não representa alegação de trabalho para clientes ou casos pessoais.

Parâmetros de URL no robots.txt: como testamos filtros e facetas

Nós não começamos com Disallow: /*?. Primeiro classificamos o parâmetro: ordenação, filtro, faceta, tracking, sessão, paginação ou busca interna.

Testamos a query string exata

User-agent: *
Disallow: /*?sort=

Rodamos exemplos permitidos e bloqueados no tester porque um wildcard pode atingir muito mais URLs do que parece.

Duplicidade não significa bloqueio automático

Para tracking, canonical, redirects ou links limpos podem resolver melhor. Para uma página pública que não deve aparecer na busca, avaliamos noindex.

Facetas precisam de seleção

Alguns filtros de ecommerce têm valor de busca; combinações profundas podem gerar expansão quase infinita. Nós preservamos estados úteis e bloqueamos apenas o crawl sem valor comprovado.

Separamos crawling de indexação

Robots.txt controla acesso do crawler; noindex controla indexação quando a página pode ser lida. A comparação com meta robots ajuda a escolher a camada.

Confirmamos produção

Criamos uma matriz de URLs, validamos regras e repetimos os testes sobre o arquivo vivo com o checker.

Guias relacionados