Creare e provare un robots.txt
Un clic blocca i crawler delle IA (GPTBot, ClaudeBot, Google-Extended, CCBot e gli altri). Restano separati dai crawler dei motori di ricerca, perché bloccare quello sbagliato ti toglie da Google.
- Funziona interamente nel tuo browser
- Funziona offline
- Niente upload
- Niente registrazione
- Niente filigrana
Caricamento dello strumento…
Come funziona
- Elenca le parti del sito da bloccare (i percorsi) e le eventuali eccezioni da consentire.
- Se vuoi, blocca i crawler delle IA.
- Prova un indirizzo contro il risultato. Il tester usa la stessa logica «vince la regola più lunga» che applicano i motori di ricerca.
Perché non viene caricato nulla
Ogni operazione di questa pagina la esegue codice che gira dentro la scheda del tuo browser, con lo stesso motore che disegna le pagine web. Il file viene letto dal disco alla memoria della scheda, trasformato lì e riscritto come download. Non viene mai inviato da nessuna parte: né a noi, né a terzi.
Verificalo tu stesso
- Apri gli strumenti per sviluppatori del browser (F12) e scegli la scheda «Rete».
- Carica il tuo file e avvia lo strumento.
- Le uniche richieste che vedrai scaricano il codice dello strumento stesso — e, in pochi strumenti pesanti, il loro motore open source da una CDN pubblica — più un piccolo segnale di visita verso loreatec.jp (indirizzo e titolo della pagina, nulla di più). Nessuna di esse porta con sé il tuo file.
Domande frequenti
Bloccare Google-Extended danneggia il mio posizionamento?
No. Google-Extended controlla soltanto se le tue pagine vengono usate per addestrare i modelli di IA di Google (Gemini); non ha alcun effetto sulla Ricerca Google. Quello che conta per la ricerca è Googlebot, e bloccare quello ti toglie del tutto dai risultati.
robots.txt tiene una pagina fuori da Google?
No — è un fraintendimento comune e costoso. Una riga Disallow impedisce a Google di leggere la pagina, non di elencarla: una pagina bloccata può comparire lo stesso nei risultati, senza descrizione, se altri siti la collegano. Per tenere una pagina fuori da Google, lascia che venga scansionata e aggiungi invece un meta tag noindex.
Esce qualcosa dal mio browser?
No. Non viene inviato nulla a un server. Tutto lo strumento è un piccolo programma che gira dentro la scheda del tuo browser. Una volta caricata la pagina, continua a funzionare anche con la connessione spenta.