guias
Robots.txt para rastreadores de IA: busca, treinamento e acesso
Como permitir descoberta em busca com IA sem liberar todos os crawlers de treinamento?
Ler guia →Base de conhecimento
Guias práticos sobre rastreamento, indexação, escopo por host, sitemaps, parâmetros de URL, cache e solução de problemas com robots.txt.
guias
Como permitir descoberta em busca com IA sem liberar todos os crawlers de treinamento?
Ler guia →guias
robots.txt impede indexação? Quando usar noindex no lugar de Disallow?
Ler guia →guias
Crawl-delay funciona no Googlebot e como reduzir carga excessiva de rastreamento?
Ler guia →guias
Qual regra vence quando Allow e Disallow combinam com a mesma URL?
Ler guia →guias
O que o Googlebot faz quando robots.txt retorna 404, 403, 429 ou 500?
Ler guia →guias
Onde nós adiciono Sitemap no robots.txt e como verifico várias referências?
Ler guia →guias
O robots.txt do domínio principal se aplica a subdomínios, HTTP, HTTPS ou outra porta?
Ler guia →guias
Como nós controlo URLs com parâmetros e facetas sem bloquear páginas úteis?
Ler guia →guias
O que acontece se robots.txt passar de 500 KiB ou não estiver em UTF-8?
Ler guia →guias
Devo usar robots.txt, meta robots, X-Robots-Tag, canonical ou autenticação?
Ler guia →guias
Quanto tempo robots.txt pode ficar em cache e como nós separo cache do crawler de falha de deploy?
Ler guia →guias
Como manter staging fora da busca sem tratar robots.txt como segurança?
Ler guia →