Construire et tester un robots.txt

Un clic bloque les robots d’IA (GPTBot, ClaudeBot, Google-Extended, CCBot et les autres). Ils sont tenus à part des robots de recherche, parce que bloquer le mauvais vous fait disparaître de Google.

Chargement de l’outil…

Comment ça marche

  1. Listez les parties du site à bloquer (les chemins), et les exceptions à autoriser.
  2. Bloquez les robots d’IA si vous le souhaitez.
  3. Testez une URL contre le résultat. Le testeur applique la même logique que les moteurs : la règle la plus longue l’emporte.

Pourquoi rien n’est envoyé

Toutes les opérations de cette page sont effectuées par du code qui tourne dans l’onglet de votre navigateur, avec le moteur qui affiche les pages web. Le fichier est lu depuis le disque vers la mémoire de l’onglet, transformé sur place, puis réécrit sous forme de téléchargement. Il n’est jamais envoyé où que ce soit — ni à nous, ni à un tiers.

Vérifiez-le vous-même

  1. Ouvrez les outils de développement de votre navigateur (F12) et choisissez l’onglet « Réseau ».
  2. Chargez votre fichier et lancez l’outil.
  3. Les seules requêtes que vous verrez téléchargent le code de l’outil lui-même — et, pour quelques outils lourds, leur moteur open source depuis un CDN public — plus un petit signal de visite vers loreatec.jp (adresse et titre de la page, rien de plus). Aucune ne transporte votre fichier.

La preuve que tout reste chez vous →

Questions fréquentes

Bloquer Google-Extended nuit-il à mon classement dans la recherche ?

Non. Google-Extended décide seulement si vos pages servent à entraîner les modèles d’IA de Google (Gemini) ; il n’a aucun effet sur Google Search. C’est Googlebot qui compte pour la recherche, et le bloquer vous retire entièrement des résultats.

Le robots.txt empêche-t-il une page d’apparaître dans Google ?

Non — c’est un malentendu courant et coûteux. Une ligne Disallow empêche Google de lire la page, pas de la référencer : une page bloquée peut toujours apparaître dans les résultats, sans description, si d’autres sites pointent vers elle. Pour tenir une page hors de Google, laissez-la être explorée et ajoutez plutôt une balise meta noindex.

Quelque chose quitte-t-il mon navigateur ?

Non. Rien n’est envoyé à un serveur. L’outil entier est un petit programme qui s’exécute dans votre onglet. Une fois la page chargée, il continue de fonctionner même sans connexion à Internet.