Guide robots.txt

Robots.txt vs meta robots: come scegliamo il controllo giusto

Il nostro modello per robots.txt, noindex, X-Robots-Tag, canonical, redirect e autenticazione senza confondere scansione, indicizzazione e privacy.

Di Robots.txt Tools Editorial TeamUltima verifica 2026-09-131 min di lettura

Metodo editoriale: questa guida documenta il flusso di verifica usato dal Robots.txt Tools Editorial Team. La prima persona descrive il metodo operativo e non rivendica lavori per clienti o casi personali.

Robots.txt vs meta robots: come scegliamo il controllo giusto

Noi scegliamo il livello in base all’obiettivo: robots.txt per il crawling, noindex per l’indicizzazione, canonical per i duplicati, redirect per gli spostamenti e autenticazione per il privato.

Robots.txt risponde a un problema di crawl

Disallow non è un comando affidabile per rimuovere una URL dall’indice.

Meta robots deve essere leggibile

<meta name="robots" content="noindex">

Se robots.txt blocca la stessa pagina, il crawler può non leggere noindex.

X-Robots-Tag opera negli header HTTP

X-Robots-Tag: noindex

È utile anche per PDF e risorse non HTML.

Canonical non è sicurezza

canonical consolida segnali. Per informazioni private usiamo autenticazione o authorization reale.

La nostra sequenza di scelta

Privato → autenticazione. Pubblico fuori indice → noindex/X-Robots-Tag. Duplicato → canonical/redirect. Crawl waste → valutare robots.txt. Infine controlliamo la production con il checker.

Guide correlate