# Ce que les robots ont le droit de lire. # # CHOIX DE PATRICK, ASSUME, le 06/09/2026 : # « garder juste le référencement Google. Tout ce qui ne m'apporte rien # est fermé. » # # AVANT CE CHOIX (mesures des 04/09, 05/09, 06/09) : on refusait les IA et # les vendeurs de données, mais les moteurs « vérifiables » entraient tous # (Bing, DuckDuckGo, Qwant, Brave, Apple, Mojeek, Seznam...) et les robots # d'aperçu de liens gagnaient leurs vignettes (WhatsApp, Facebook, X). # Mesure : rien de tout ça ne nous amenait de visiteur ; Google est le seul # chez qui taper notre nom fait remonter les pages publiques. # # LA REGLE DU 06/09/2026, en deux lignes : # - tout le monde est fermé (User-agent: * / Disallow: /) ; # - seul Googlebot (le moteur de recherche) entre ; # - conséquence volontaire : plus de vignette WhatsApp/Facebook/X quand # un lien est partagé. C'est le prix du choix, il est assumé. # ──────────────────────────────────────────────────────────────────── # 1) TOUT EST FERMÉ, par défaut. Tous les robots, partout, au départ. # Un robot honnête lit cette ligne et s'arrête. Un fouilleur ne la lit # même pas : le vrai mur est ailleurs, la fermeture par adresse # (fouilleurs.txt), et on le surveille dans le cahier du serveur. # ──────────────────────────────────────────────────────────────────── User-agent: * Disallow: / # ──────────────────────────────────────────────────────────────────── # 2) SAUF GOOGLE, le moteur de recherche. Choix assumé du 06/09/2026. # Googlebot entre pour indexer ET servir nos pages publiques. # Google-Extended (l'IA de Google) reste fermé par la règle 1 : on # ne prouve pas qu'il nous amène qui que ce soit. # ──────────────────────────────────────────────────────────────────── # 24/09/2026, choix d'Orel : « permettre de lire a google, claude, bing, # bref ceux qui nous font du bien ». Google et Bing ne sont plus nommes # QUE dans ce groupe : avant, ils l'etaient aussi dans le groupe « la liste # oui, le contenu non » plus bas, un robot additionne les groupes qui portent # son nom, et « Disallow: /article- » gagnait (0 article lu par Google). # Le serveur verifie leur adresse (listes officielles) : un faux reste dehors. User-agent: Googlebot User-agent: Googlebot-Image User-agent: Bingbot User-agent: BingPreview Disallow: /cv.html Disallow: /cv-patrick.pdf Disallow: /cv-patrick-en.pdf Disallow: /etude- Disallow: /etudes Disallow: /etudes-protegees Disallow: /porte-etudes.html Disallow: /truck-factor Disallow: /storyagent Disallow: /endroit-sur Disallow: /equipe Disallow: /fonctionnalites Disallow: /analyse-robots Disallow: /article-plan-de-controle-tour Disallow: /carriere Disallow: /zzz- # OAI-SearchBot AUTORISE le 08/09/2026 (decision d'Orel) : robot de RECHERCHE # de ChatGPT — on veut etre CITE dans ChatGPT. L'ENTRAINEMENT (GPTBot, # Google-Extended, ClaudeBot...) reste refuse par « User-agent: * / Disallow ». # Memes pages cachees que pour Google. # OPENAI / CHATGPT — BANNI A VIE. 17/09/2026, decision d'Orel : # « je ne veux pas de chatgpt » — « j'ai interdit openai sur mes sites » # « ils pompent sans rien donner » — « chatgpt est banni a vie » # « que cette regle ne soit plus jamais oubliee » # CECI ANNULE la ligne du 08/09/2026 (« on veut etre cite dans ChatGPT »). # Elle ne vaut plus et ne doit PAS revenir. # Le vrai mur est ailleurs : le serveur refuse les 271 plages d'adresses # d'OpenAI, partout. Un robot honnete lit ce fichier ; un robot qui pompe, non. # 24/09/2026 — LE VRAI OPENAI EST ROUVERT, decision d'Orel : « ouvre openai # si c'est le vrai ». Cela leve le bannissement a vie du 17/09 ci-dessus pour # ses trois robots officiels. Le serveur verifie leur adresse (listes # officielles d'OpenAI) : un faux reste refuse. Memes pages cachees que Google. User-agent: OAI-SearchBot User-agent: GPTBot User-agent: ChatGPT-User Disallow: /cv.html Disallow: /cv-patrick.pdf Disallow: /cv-patrick-en.pdf Disallow: /etude- Disallow: /etudes Disallow: /etudes-protegees Disallow: /porte-etudes.html Disallow: /truck-factor Disallow: /storyagent Disallow: /endroit-sur Disallow: /equipe Disallow: /fonctionnalites Disallow: /analyse-robots Disallow: /article-plan-de-controle-tour Disallow: /carriere Disallow: /zzz- # Le CV se partage, il ne se découvre pas. Disallow: /cv.html Disallow: /cv-patrick.pdf Disallow: /cv-patrick-en.pdf # Les pages gardées : études, fonctionnalités, équipe. Aucun robot, # Google compris, ne lit ces pages — elles se lisent par des humains, # derrière la porte tenue par le serveur (décision 06/09/2026). Disallow: /etude- Disallow: /truck-factor Disallow: /storyagent Disallow: /endroit-sur Disallow: /equipe Disallow: /equipe-en Disallow: /equipe-ja Disallow: /fonctionnalites Disallow: /fonctionnalites-en Disallow: /porte-etudes.html Disallow: /analyse-robots Disallow: /article-plan-de-controle-tour Disallow: /article-plan-de-controle-tour-en Disallow: /carriere Disallow: /carriere-en Disallow: /zzz- Sitemap: https://matourdecontrole.fr/sitemap.xml # ───────────────────────────────────────────────────────────── # CHOIX DE PATRICK, le 09/09/2026 : « autorise Claude ». # Mesure qui a mene a ce choix : ClaudeBot est passe 170 fois, dont # 146 fois seulement pour LIRE ce panneau. Il n a jamais force une # porte. Il revenait verifier si on avait change d avis. On a change. # # Il lit TOUT le site, comme Google. Les sous-domaines fermes le restent, # et les pages tenues par un mot de passe le restent aussi : un panneau # ne remplace jamais une serrure. # ───────────────────────────────────────────────────────────── # 24/09/2026, choix d'Orel : « autorise claude comme pour google, le vrai ». # Avant, Claude etait aussi dans le groupe « la liste oui, le contenu non » # plus bas : un robot additionne les groupes qui portent son nom, et # « Disallow: /article- » gagnait. Il ne lisait donc aucun article. # Il n'est plus que dans CE groupe : tout, sauf les etudes (reservees aux # humains) et les pages cachees. Le serveur verifie aussi son adresse # (liste officielle d'Anthropic) : un faux Claude reste refuse. User-agent: ClaudeBot User-agent: Claude-Web User-agent: Claude-User User-agent: Claude-SearchBot User-agent: anthropic-ai Disallow: /cv.html Disallow: /cv-patrick.pdf Disallow: /cv-patrick-en.pdf Disallow: /etude- Disallow: /etudes Disallow: /etudes-protegees Disallow: /porte-etudes.html Disallow: /truck-factor Disallow: /storyagent Disallow: /endroit-sur Disallow: /equipe Disallow: /fonctionnalites Disallow: /analyse-robots Disallow: /article-plan-de-controle-tour Disallow: /carriere Disallow: /zzz- # CHOIX DE PATRICK, le 09/09/2026 : « Google et Claude doivent tout # pouvoir lire ». Les fermetures qui etaient ici sont donc retirees. # Elles ne servaient a rien pour Google : ses lignes etaient ecrites # APRES son groupe, donc elles ne le concernaient deja pas. # ───────────────────────────────────────────────────────────── # PERPLEXITY — ouvert le 25/09/2026, choix d'Orel (« d'accord aussi »). # PerplexityBot est un robot de RECHERCHE : il vient chercher une page # pour repondre a une question posee a l'instant, et il CITE le site. # Avant ce jour, la regle « tout ferme sauf les nommes » l'interdisait : # le site ne pouvait jamais etre cite par Perplexity. Meme regle que # Claude : tout, sauf les etudes et les pages cachees. Le serveur verifie # aussi son adresse (liste officielle de Perplexity) : un faux reste refuse. User-agent: PerplexityBot User-agent: Perplexity-User Disallow: /cv.html Disallow: /cv-patrick.pdf Disallow: /cv-patrick-en.pdf Disallow: /etude- Disallow: /etudes Disallow: /etudes-protegees Disallow: /porte-etudes.html Disallow: /truck-factor Disallow: /storyagent Disallow: /endroit-sur Disallow: /equipe Disallow: /fonctionnalites Disallow: /analyse-robots Disallow: /article-plan-de-controle-tour Disallow: /carriere Disallow: /zzz- # ───────────────────────────────────────────────────────────── # BING, LE MOTEUR DE MICROSOFT — ouvert le 15/09/2026, demande de Patrick. # # Bingbot est le robot de RECHERCHE de Bing. Il lit les pages pour que # celui qui tape notre nom dans Bing nous trouve. C est le meme metier # que Googlebot. # # Il sert aussi Copilot et DuckDuckGo, qui s appuient sur l index de Bing : # une seule ligne nous ouvre donc trois portes d entree. # # Ce qui reste FERME : l ENTRAINEMENT des modeles. Lire pour indexer, oui. # Avaler pour entrainer, non. Cette ligne-la ne change pas. # ───────────────────────────────────────────────────────────── # (Bing : voir le groupe de Google, en haut — 24/09/2026.) # ──────────────────────────────────────────────────────────────────── # CHOIX DE PATRICK, le 17/09/2026 : LA LISTE OUI, LE CONTENU NON. # # Ses mots : « bloque tout ce qui vient d openai », « et claude fait # pareil », « google aussi », puis « laisse-les dans la liste des # articles, pas dans le contenu ». # # Il precise aussi que l ouverture au robot de recherche de ChatGPT, # datee du 08/09, n a jamais ete son choix : « c est un ajout illicite, # j ai jamais voulu ouvrir a chatgpt ». # # CE QUI CHANGE : les robots voient les TITRES (la liste des articles, # la page d accueil, le plan du site). Ils ne peuvent plus lire le # TEXTE des articles ni des etudes. # # CE QUE CA COUTE, dit franchement : Google apportait 13 720 visites en # quinze jours. Fermer le contenu peut faire baisser la position du site # dans les recherches. Patrick a confirme en connaissance de cause. # # Mesure qui a mene a ce choix (17/09/2026, sur 816 055 visites) : # Googlebot 13 720 · ClaudeBot 863 · OAI-SearchBot 248 · GPTBot 104 # Ce que ClaudeBot lisait : /etude-gouvernance-agents, /article-mon-clone, # /article-sentinel-gouvernance-temps-reel, /laboratoire-medical-vih-3d. # Ce que OpenAI lisait : /article-garde-fou-pose-nulle-part, # /article-la-machine-a-dit-non, /article-rejouer-un-test. # Ce sont ses pages sur les garde-fous. Elles ferment aujourd hui. # ──────────────────────────────────────────────────────────────────── User-agent: Google-Extended User-agent: OpenAI Allow: /$ Allow: /articles Allow: /articles.html Allow: /articles-en.html Allow: /index.html Allow: /index-en.html Allow: /sitemap.xml Allow: /robots.txt Disallow: /article- Disallow: /etude- Disallow: /etudes Disallow: /lecons Disallow: /parcours-articles Disallow: /realisations Disallow: /tout Disallow: / # ═══════════════════════════════════════════════════════════════════ # LA GRANDE PORTE DE DERRIERE — fermee le 17/09/2026 # # Patrick avait banni OpenAI, Claude et Google : quatorze robots nommes. # Mais CCBot n apparaissait ZERO fois sur 165 lignes. # # CCBot est le ramasseur de Common Crawl. Il ramasse les pages et les # donne a TOUT LE MONDE. Mesure du meme jour : le depot Nemotron de # NVIDIA range son jeu d entrainement DANS le seau de Common Crawl. # Autrement dit : les robots refuses par la porte de devant se # servaient tranquillement par la porte de derriere. # # Ceux-la ramassent pour entrainer, pas pour amener des lecteurs. # Bing et les moteurs qui amenent de VRAIS visiteurs restent acceptes # plus haut dans ce fichier. # ═══════════════════════════════════════════════════════════════════ User-agent: CCBot Disallow: / User-agent: Bytespider Disallow: / User-agent: PetalBot Disallow: / User-agent: Amazonbot Disallow: / User-agent: ai2bot Disallow: / User-agent: Applebot-Extended Disallow: / User-agent: Diffbot Disallow: / User-agent: ImagesiftBot Disallow: / User-agent: Omgilibot Disallow: / User-agent: Timpibot Disallow: /