Nous considérons Sitemap: comme un signal de découverte, pas comme une règle Allow ou Disallow.
Nous contrôlons d’abord le sitemap
Nous ouvrons le XML, vérifions le statut HTTP, HTTPS, l’hôte canonique et les URL indexables. Ensuite nous utilisons une URL absolue :
Sitemap: https://example.com/sitemap.xml
Plusieurs fichiers ou un index
Plusieurs lignes Sitemap: sont valides. Lorsqu’un sitemap index stable existe, nous préférons le référencer pour éviter de maintenir deux inventaires.
Sitemap: https://example.com/sitemap-index.xml
Nous séparons les hôtes
Le robots.txt de example.com ne gouverne pas automatiquement shop.example.com. Pour les architectures multi-hôtes, nous vérifions chaque origine et utilisons le guide des sous-domaines.
Search Console complète la vérification
La déclaration facilite la découverte, mais ne garantit pas la qualité du sitemap. Nous contrôlons aussi les redirections, noindex et URL non canoniques.
Nous vérifions la production
Après publication, nous ouvrons /robots.txt, chaque sitemap, puis utilisons le checker et le validator.