In breve: Come impostare un file robots.txt per il controllo degli: File robots.txt: indica ai crawler quali URL possono richiedere, ma non impedisce in modo affidabile l’indicizzazione delle pagine.
Indice dei contenuti
File robots.txt
File robots.txt: indica ai crawler quali URL possono richiedere, ma non impedisce in modo affidabile l’indicizzazione delle pagine.
File robots.txt regola la scansione dei crawler compatibili, ma non è uno strumento di sicurezza e non garantisce la deindicizzazione.
Cosa sapere
Disallow limita la scansione, ma una pagina bloccata può comunque comparire nei risultati se scoperta da altri link. Per impedire l’indicizzazione usa noindex lasciando la pagina accessibile, oppure proteggila con autenticazione.
Procedura consigliata
- Apri o crea robots.txt.
- Definisci User-agent e direttive.
- Non bloccare risorse necessarie.
- Aggiungi la sitemap.
- Testa il file e controlla Search Console.
Approfondimenti utili
- Come impostare il modulo gzip
- Come effettuare un redirect con il file.htaccess
- Tools esterni per effettuare le scansioni del sito web
- guida Google a robots.txt

Guide Xlogic correlate
- Permessi file WordPress: valori sicuri e controlli
- Come visualizzare un sito senza modificare i DNS
- Come rilevare e correggere gli elementi non sicuri SSL