guide
Robots.txt per crawler IA: ricerca, training e accesso
Come consentire la ricerca IA senza aprire tutti i crawler usati per il training?
Leggi la guida →Base di conoscenza
Guide pratiche su scansione, indicizzazione, ambito per host, sitemap, parametri URL, cache e risoluzione dei problemi robots.txt.
guide
Come consentire la ricerca IA senza aprire tutti i crawler usati per il training?
Leggi la guida →guide
robots.txt impedisce l’indicizzazione e quando bisogna usare noindex?
Leggi la guida →guide
Crawl-delay funziona con Googlebot e come si riduce un carico di scansione eccessivo?
Leggi la guida →guide
Quale regola prevale quando più Allow e Disallow corrispondono allo stesso URL?
Leggi la guida →guide
Come tratta Googlebot un robots.txt che risponde 404, 403, 429 o 500?
Leggi la guida →guide
Dove aggiungo Sitemap in robots.txt e come verifico più riferimenti?
Leggi la guida →guide
Il robots.txt del dominio principale vale per sottodomini, HTTP, HTTPS o altre porte?
Leggi la guida →guide
Come controllo URL con parametri e faccette senza bloccare pagine importanti?
Leggi la guida →guide
Cosa succede se robots.txt supera 500 KiB o non è in UTF-8?
Leggi la guida →guide
Devo usare robots.txt, meta robots, X-Robots-Tag, canonical o autenticazione?
Leggi la guida →guide
Quanto resta robots.txt in cache e come distinguo cache del crawler da un errore di deploy?
Leggi la guida →guide
Come tengo lo staging fuori dalla ricerca senza usare robots.txt come sicurezza?
Leggi la guida →