Nous choisissons la couche selon l’objectif : robots.txt pour le crawl, noindex pour l’indexation, canonical pour les doublons, redirection pour un déplacement, authentification pour le privé.
Robots.txt répond à une question de crawl
Disallow n’est pas une commande fiable de suppression d’index.
Meta robots doit être lisible
<meta name="robots" content="noindex">
Si robots.txt bloque la page, le crawler peut ne pas lire noindex.
X-Robots-Tag agit dans la réponse HTTP
X-Robots-Tag: noindex
Cette solution convient notamment aux PDF et ressources non HTML.
Canonical ne protège pas un contenu privé
canonical consolide des signaux. Nous utilisons authentification ou autorisation pour la confidentialité.
Notre séquence de décision
Privé → authentification. Public hors index → noindex/X-Robots-Tag. Doublon → canonical ou redirection. Crawl inutile → évaluer robots.txt. Enfin nous vérifions la production avec le checker.