En Magento/Adobe Commerce empezamos por identificar qué capa sirve el storefront público.
Revisamos Content → Design → Configuration
En la configuración correspondiente buscamos Search Engine Robots y verificamos después /robots.txt en el dominio real.
Default Robots no es el archivo robots.txt
Default Robots controla directivas de indexación de páginas; las reglas de crawling de robots.txt son otra capa. No mezclamos ambos conceptos.
Ecommerce necesita pruebas con URLs reales
Carrito, cuenta, búsqueda y navegación facetada pueden generar rutas muy distintas entre tiendas. No pegamos un blocklist genérico. Para parámetros usamos la guía de facetas.
Cloud cambia el contexto
En Adobe Commerce Cloud revisamos controles por entorno, sitemap y separación entre staging y producción.
PWA y headless pueden mover el ownership
Si un frontend PWA/headless o CDN sirve el host público, ese sistema puede ser quien realmente genere robots.txt. Un ajuste en Commerce Admin solo sirve si controla la respuesta pública.
Nuestro checklist incluye Content, Design, Configuration, Search Engine Robots, Default Robots, Cloud, sitemap, PWA/headless y verificación con el checker.