Cuando revisamos un robots.txt, tratamos Sitemap: como una referencia de descubrimiento, no como una regla Allow o Disallow.
Verificamos primero el sitemap
Abrimos el XML y comprobamos estado HTTP, host canónico, HTTPS y URLs indexables. Después usamos una URL absoluta:
Sitemap: https://example.com/sitemap.xml
No usamos Sitemap: /sitemap.xml.
Un índice suele ser más mantenible
Si el sitio tiene varios sitemaps, podemos declarar varias líneas, pero cuando existe un índice estable preferimos referenciarlo. Así robots.txt no se convierte en una segunda lista que hay que mantener.
Sitemap: https://example.com/sitemap-index.xml
Revisamos host y subdominios
https://example.com/robots.txt y https://shop.example.com/robots.txt tienen ámbitos distintos. En arquitecturas con varios hosts comprobamos cada origen y no asumimos que una declaración se hereda. Para ese caso usamos la guía de subdominios.
Search Console sigue siendo útil
La línea Sitemap facilita el descubrimiento, pero no sustituye el seguimiento en Search Console. Un sitemap puede estar bien enlazado y aun contener redirecciones, URLs noindex o versiones no canónicas.
Comprobamos producción
Nuestro flujo final es abrir /robots.txt, abrir cada sitemap, revisar una muestra de URLs y pasar el archivo por el checker y el validator. Si también cambiamos reglas de rastreo, usamos el tester.
La regla práctica es sencilla: una referencia estable, absoluta y canónica, verificada en la respuesta pública real.