Controllo della scansione in Blogger

Generatore robots.txt per Blogger

Crea un punto di partenza robots.txt personalizzato per Blogger solo quando hai una politica di scansione precisa da applicare. Blogger serve già un comportamento robots.txt predefinito, quindi le regole personalizzate vanno considerate una sostituzione consapevole e non un'impostazione SEO obbligatoria.

La maggior parte dei siti Blogger non necessita di robots.txt personalizzato

La documentazione Blogger indica che, quando attivi robots.txt personalizzato, il tuo testo sostituisce il contenuto robots.txt predefinito. Se non hai un problema di scansione specifico da risolvere, mantenere il comportamento della piattaforma è il punto di partenza più sicuro.

Scegli la modalità di modifica

La modalità semplice è più sicura per una configurazione rapida. L'editor avanzato mostra tutti i gruppi crawler e le regole.

Politica in base allo scopo del crawler

Parti da una configurazione neutra e applica restrizioni ai crawler IA solo quando corrispondono alla tua politica.

Impostazione neutra: lascia aperti crawler di ricerca, ricerca IA e controllo IA salvo blocchi espliciti nelle regole di percorso.

Percorsi da bloccare

Parti da un percorso suggerito o aggiungi il tuo. Blocca solo i percorsi che vuoi intenzionalmente far evitare ai crawler compatibili.

Percorsi suggeriti

Aggiungi percorso personalizzato

Aggiungi qualsiasi percorso del sito. I percorsi senza slash iniziale lo ricevono automaticamente; gli URL HTTP(S) completi vengono ridotti a percorso e query.

Ricerca

Consentito per impostazione predefinita

Ricerca IA

Consentito per impostazione predefinita

Controllo / training IA

Consentito per impostazione predefinita

Prima di pubblicare

  1. 1. Genera
    Controlla il risultato in tempo reale.
  2. 2. Valida
    Controlla sintassi e compatibilità.
  3. 3. Testa URL
    Verifica percorsi e crawler importanti.
  4. 4. Pubblica
    Caricalo come /robots.txt nella radice del sito.

robots.txt generato

Risultato in tempo reale; generazione e validazione restano nel browser.

User-agent: *Disallow: /searchDisallow: /search/label/ 
0 errori0 avvisi0 note

Nessun avviso di sintassi o compatibilità rilevato.

Cosa cerca di controllare la configurazione Blogger

Blogger espone spesso URL di ricerca e risultati per etichetta diversi dagli URL normali di post e pagine. La configurazione parte con blocchi prudenti dei percorsi di ricerca da verificare, ma resta solo un punto di partenza per il tuo blog.

URL dei risultati di ricerca

La configurazione include /search affinché i crawler compatibili evitino i percorsi dei risultati di ricerca Blogger. Verifica gli URL esatti creati da tema e navigazione prima di mantenere o ampliare la regola.

URL dei risultati per etichetta

Le pagine etichetta di Blogger si trovano spesso sotto /search/label/. Testa un URL etichetta reale e un URL di post normale prima di pubblicare, così un modello ampio non intercetta contenuti che vuoi mantenere scansionabili.

Post e pagine

Post principali e pagine autonome dovrebbero normalmente restare scansionabili, salvo una politica diversa intenzionale. Testa almeno un URL rappresentativo per ogni tipo di contenuto.

Direttiva Sitemap

Usa l'URL sitemap realmente servito dal blog in produzione. Evita di copiare vecchi esempi di feed Atom o parametri mobile da altri tutorial senza verificare prima l'URL online.

Come usare robots.txt personalizzato in Blogger

  1. 1

    Decidi se serve davvero una sostituzione

    Se il comportamento predefinito di Blogger corrisponde già alla tua politica di scansione, non attivare un file personalizzato solo perché un tutorial SEO ne mostra uno.

  2. 2

    Genera e controlla le regole

    Confronta ogni percorso bloccato con URL realmente presenti nel blog. Rimuovi le regole che non puoi spiegare.

  3. 3

    Apri Crawler e indicizzazione

    Nelle impostazioni Blogger attiva robots.txt personalizzato solo quando sei pronto a sostituire il contenuto predefinito con il testo verificato.

  4. 4

    Testa prima e dopo il salvataggio

    Controlla un post, una pagina, un URL etichetta, un URL di ricerca e la sitemap. Dopo il salvataggio verifica anche la risposta online di /robots.txt.

Riferimento ufficiale della piattaforma: Guida Blogger — Gestire le impostazioni del blog. Consulta la sezione crawler e indicizzazione per robots.txt personalizzato e tag header robots personalizzati.

robots.txt personalizzato e tag header robots sono controlli distinti

Blogger offre controlli separati per robots.txt personalizzato e tag header robots personalizzati. Una regola Disallow in robots.txt controlla l'accesso di scansione ai percorsi corrispondenti; una direttiva di indicizzazione è un controllo diverso.

Non usare un blocco di scansione come sostituto di una decisione di indicizzazione. Se una pagina deve essere scansionabile perché il motore di ricerca veda una direttiva di indicizzazione, bloccare lo stesso URL in robots.txt può andare contro l'obiettivo.

Leggi robots.txt e noindex →

URL Blogger da testare prima della pubblicazione

Home page

/

Dovrebbe normalmente restare scansionabile

Post recente

/YYYY/MM/post-slug.html

Conferma che un post normale non venga intercettato da una regola ampia

Pagina autonoma

/p/page-slug.html

Conferma che le pagine statiche restino accessibili quando previsto

Risultati per etichetta

/search/label/example

Controlla che la politica ricerca/etichette venga applicata

Risultati di ricerca

/search?q=example

Verifica che la scansione dei risultati di ricerca corrisponda alla tua politica

Sitemap

/sitemap.xml

Verifica che l'URL sitemap reale si carichi e non sia bloccato

Domande frequenti su robots.txt in Blogger

Devo attivare robots.txt personalizzato in Blogger?

In genere no. Blogger fornisce già un comportamento predefinito. Attiva un file personalizzato solo quando hai una politica di scansione precisa e sei pronto a testare le regole sostitutive.

Il robots.txt personalizzato sostituisce quello predefinito di Blogger?

Sì. La documentazione Blogger descrive il testo personalizzato come sostituto del contenuto predefinito, quindi copiare un modello non verificato può causare problemi di scansione.

Devo bloccare /search in Blogger?

Può avere senso tenere ricerca interna e risultati per etichetta fuori dalle code di scansione, ma verifica gli URL del tuo blog e testa post e pagine normali prima di mantenere una regola ampia.

robots.txt può impedire l'indicizzazione di un URL Blogger?

robots.txt controlla principalmente la scansione. I controlli di indicizzazione sono separati e bloccare un URL può impedire al crawler di vedere una direttiva di indicizzazione presente sulla pagina.