Strumento online gratuito per generare robots.txt. Imposta regole di permesso/blocco per i crawler e URL sitemap. Essenziale per SEO. Elaborato nel browser.
Premi Ctrl+D per aggiungere questa pagina ai preferiti
Il Generatore di Robots. txt è uno strumento online gratuito che crea facilmente file robots.
Come usare Generatore robots.txt?
Seleziona lo user agent (crawler).
Imposta le regole dei percorsi Allow e Disallow.
Aggiungi l'URL della tua sitemap e copia il robots.txt generato.
Domande frequenti su Generatore robots.txt
Cos'è il robots.txt?
Il robots.txt è un file di testo posizionato nella radice di un sito web che indica ai crawler dei motori di ricerca quali pagine scansionare o ignorare.
Il robots.txt può nascondere completamente le pagine dai risultati di ricerca?
No. Il robots.txt controlla solo la scansione: le pagine possono comunque comparire nei risultati di ricerca se collegate da altri siti. Usa un meta tag noindex per la rimozione completa.
Come impedisco ai crawler di IA di usare il mio sito per l'addestramento?
In robots.txt indica il crawler pubblicato da ciascuna azienda — GPTBot, ClaudeBot, PerplexityBot e così via — e assegnagli un Disallow. Un approccio più recente, Content-Signal, permette di dichiarare il permesso per finalità in una sola riga, come search=yes, ai-train=no. Ricorda che robots.txt è una richiesta rispettata solo dai crawler che scelgono di obbedire, non un blocco tecnico: ciò che davvero non deve essere prelevato va messo dietro un login.
Un errore in robots.txt può far sparire l'intero sito dalla ricerca?
Sì: una sola riga con Disallow: / esclude l'intero sito dalla scansione. Pubblicare in produzione il robots.txt di un server di prova senza cancellare quella riga è un incidente davvero frequente. Apri robots.txt nel browser subito dopo ogni rilascio e passa le pagine principali nel tester robots.txt di Google Search Console. Riprendersi da una deindicizzazione richiede giorni o settimane, ben dopo la correzione del file.
Consigli per usare Generatore robots.txt efficacemente
Il robots.txt blocca solo la scansione: per uscire dai risultati serve il meta tag noindex.
Scrivi regole per singolo User-agent se vuoi trattare GPTBot diversamente da Googlebot.
Chiudi il file con una riga Sitemap: https://... in URL assoluto.