
À partir du 15 septembre 2026, Cloudflare applique de nouveaux réglages par défaut sur le trafic des robots d'intelligence artificielle : les bots de recherche restent autorisés, les bots d'entraînement et les agents IA sont bloqués par défaut sur les pages affichant de la publicité, et les bots mixtes sont bloqués. Si votre site passe par Cloudflare, votre configuration actuelle mérite une vérification avant cette date, sous peine de voir votre contenu disparaître des réponses générées par les assistants IA.
À retenir
- Au 15 septembre 2026, Cloudflare bloque par défaut les bots d'entraînement et les agents IA sur les pages affichant de la publicité, ainsi que les bots multi-usages ; les bots de recherche restent autorisés.
- Les clients Cloudflare déjà en place doivent confirmer leurs préférences dans leurs paramètres de sécurité : l'inaction n'est pas un choix neutre.
- La catégorie « agent » est celle qui détermine votre présence dans les réponses de ChatGPT, Gemini ou Perplexity, à distinguer des bots d'entraînement.
- Google a rappelé qu'il n'utilise ni llms.txt ni llms-author.txt : ce fichier ne peut pas servir de socle à une stratégie GEO.
Ce qui change au 15 septembre 2026
Cloudflare, qui sert d'intermédiaire réseau à une part considérable du web, modifie ses réglages par défaut pour le trafic des robots d'intelligence artificielle. Selon l'annonce publiée par Cloudflare, relayée par ROI Revolution, quatre catégories de robots sont désormais distinguées et traitées différemment.
Le détail des nouveaux défauts est le suivant : les bots de recherche, ceux qui explorent votre site pour l'indexer dans les moteurs, restent autorisés. Les bots d'entraînement, qui aspirent le contenu pour nourrir les modèles, sont bloqués par défaut sur les pages qui affichent de la publicité. Les bots agents, ceux qui vont chercher une information en temps réel pour répondre à la question d'un utilisateur, sont eux aussi bloqués par défaut sur les pages avec publicité. Enfin les bots multi-usages, qui combinent recherche et entraînement, sont bloqués par défaut sans condition.
| Type de bot | Rôle | Réglage par défaut au 15/09/2026 |
|---|---|---|
| Recherche | Indexation moteur | Autorisé |
| Entraînement | Alimentation des modèles | Bloqué sur les pages avec publicité |
| Agent | Réponse en temps réel à une question | Bloqué sur les pages avec publicité |
| Multi-usages (recherche + entraînement) | Les deux à la fois | Bloqué |
Pourquoi la catégorie « agent » est celle qui compte pour votre visibilité ChatGPT
La confusion la plus fréquente consiste à traiter tous les robots IA comme un même problème de droits d'auteur. Ce n'est pas le cas sur le plan de la visibilité. Un bot d'entraînement lit votre page une fois pour l'intégrer dans un corpus : le bloquer protège votre contenu, l'impact sur votre trafic est différé et diffus. Un bot agent, lui, va chercher votre page au moment précis où un utilisateur pose une question à un assistant. C'est ce trafic-là qui produit une citation, un lien cliquable et une visite.
Concrètement : si un prospect demande à ChatGPT ou à Gemini quel prestataire choisir pour tel besoin dans telle ville, et que l'agent qui va chercher la réponse se heurte à un blocage Cloudflare sur vos pages, votre entreprise n'apparaît pas dans la réponse. Vos concurrents accessibles, eux, y apparaissent. Le référencement IA se joue à ce niveau : ce n'est plus une question de position dans une liste de dix liens, mais de présence ou d'absence dans un paragraphe unique.
La nuance « sur les pages qui affichent de la publicité » limite la portée du changement pour beaucoup de sites vitrines et de sites e-commerce sans régie publicitaire. Mais elle concerne directement les éditeurs, les blogs monétisés, les sites médias et tous les sites qui embarquent des scripts publicitaires même de façon marginale. Nous recommandons de ne pas présumer de son propre cas : la détection est faite par Cloudflare, pas par vous.
Clients Cloudflare existants : une action est requise de votre côté
Le point le plus important opérationnellement, et le plus mal compris, tient en une distinction. Selon Cloudflare, les nouveaux clients arrivés à partir du 15 septembre n'auront rien à faire s'ils sont d'accord avec ces réglages. Les clients existants, en revanche, devront passer dans leurs paramètres de sécurité pour confirmer leurs préférences.
Autrement dit, l'inaction n'est pas neutre. Si votre site tourne derrière Cloudflare depuis des années et que personne ne touche à la console, vous ne savez pas dans quel état vous serez le 16 septembre. C'est exactement le type de réglage qui échappe aux organisations où l'hébergement, le CDN et le marketing sont gérés par trois interlocuteurs différents. Dans notre pratique d'exploitation de sites en production, ce sont les réglages de couche réseau, invisibles depuis le CMS, qui produisent les pertes de visibilité les plus difficiles à diagnostiquer après coup.
Autre effet de bord à anticiper : un blocage au niveau de Cloudflare ne se voit pas dans votre robots.txt. Vous pouvez avoir un robots.txt parfaitement permissif et un pare-feu qui renvoie un 403 aux agents IA. Les deux couches doivent être cohérentes, et la couche réseau l'emporte toujours sur le fichier texte.
llms.txt : Google a dit non, ne construisez pas votre stratégie GEO dessus
Le fichier llms.txt est présenté depuis quelques mois comme le nouveau standard permettant de dicter aux modèles ce qu'ils peuvent faire de votre contenu. En réaction à l'annonce de Cloudflare, un porte-parole de Google a rappelé sur Reddit que Google n'utilise ni llms.txt ni llms-author.txt, ce qui signifie, selon ROI Revolution, que Google n'a pas l'intention de suivre les signaux de contenu proposés par Cloudflare.
La conséquence pratique est simple : llms.txt reste un fichier peu coûteux à déployer, sans risque, et potentiellement lu par certains acteurs, mais il ne constitue pas un mécanisme de contrôle opposable. Ne l'inscrivez pas au budget comme un chantier structurant. Les leviers qui pèsent réellement sur votre présence dans les réponses IA sont ailleurs : la configuration du pare-feu, le robots.txt, les réglages de Search Console, et la qualité du contenu que les agents trouvent quand ils passent.
Sur ce dernier point, Google déploie par ailleurs progressivement, au-delà du Royaume-Uni, des contrôles dédiés à l'IA générative dans Search Console. Selon la documentation de Google, trois options existent : inclure votre site dans les fonctionnalités d'IA générative, l'en exclure, ou hériter du réglage de la propriété parente. Ces réglages n'affectent pas votre classement organique classique. Vérifiez si l'option est disponible sur votre compte, elle ne l'est pas encore partout.
Le check-up GEO à faire avant le 15 septembre
Voici la séquence de vérifications que nous appliquons sur les sites que nous exploitons. Comptez une à deux heures pour un site simple, davantage si plusieurs sous-domaines ou plusieurs propriétés Search Console sont en jeu.
- Identifiez si votre site passe par Cloudflare. Regardez vos enregistrements DNS et l'en-tête HTTP de réponse de votre site. Si l'hébergement est délégué, posez la question par écrit à votre prestataire technique.
- Ouvrez les paramètres de gestion des bots IA dans le tableau de bord Cloudflare et notez l'état actuel de chaque catégorie : recherche, entraînement, agent, multi-usages. Faites une capture datée, elle servira de référence en cas de régression.
- Déterminez si vos pages affichent de la publicité au sens de la détection Cloudflare, y compris les scripts d'affiliation ou de régie résiduels hérités d'anciennes campagnes. C'est ce critère qui déclenche le blocage par défaut des bots d'entraînement et des agents.
- Tranchez explicitement la catégorie « agent ». Si vous voulez être cité dans les réponses de ChatGPT, Gemini ou Perplexity, cette catégorie doit rester autorisée. Le choix est un arbitrage entre protection du contenu et visibilité, il doit être documenté, pas subi.
- Relisez votre robots.txt et vérifiez la cohérence avec les réglages Cloudflare. Un robots.txt ouvert et un pare-feu fermé produisent un blocage réel ; l'inverse aussi.
- Contrôlez les réglages d'IA générative dans Search Console, propriété par propriété, en vérifiant les relations parent/enfant si vous en avez. Un réglage hérité peut exclure un sous-domaine sans que personne l'ait décidé.
- Testez après le 15 septembre. Interrogez les principaux assistants sur des requêtes où votre site est légitime et notez s'il est cité. Refaites le test à quinze jours d'intervalle pour distinguer un blocage d'une simple variation.
- Consignez la décision par écrit et attribuez-la à une personne identifiée en interne. Ces réglages évoluent, ils doivent avoir un propriétaire.
Bloquer ou laisser passer : comment trancher
Il n'existe pas de bonne réponse universelle, mais il existe des cas nets. Un site e-commerce, un site de services, un site vitrine local ont tout intérêt à laisser passer les agents IA : leur contenu n'a pas de valeur marchande en lui-même, sa fonction est d'attirer des clients. Les bloquer revient à se retirer volontairement d'un canal d'acquisition en croissance.
Un éditeur dont le contenu est le produit se trouve dans une position différente. Là, le calcul oppose la perte de trafic direct à la protection d'un actif éditorial. Une position intermédiaire est possible : autoriser les agents, qui citent et renvoient du trafic, et bloquer les bots d'entraînement, qui absorbent sans rendre. C'est précisément la granularité que les nouveaux réglages de Cloudflare rendent accessible, et c'est probablement l'intérêt principal de cette mise à jour.
Quel que soit votre cas, le pire scénario reste le même : ne pas savoir dans quel état est votre configuration. Si vous n'avez pas de visibilité sur votre couche réseau, faites l'inventaire maintenant plutôt qu'en octobre, quand la baisse de citations sera déjà installée et attribuée à tort à autre chose. Nous menons ce type d'audit de configuration et de visibilité dans le cadre de l'exploitation courante des sites que nous hébergeons.
Questions fréquentes
Mon site est-il concerné si je n'affiche aucune publicité ?
Les blocages par défaut des bots d'entraînement et des agents IA ne s'appliquent qu'aux pages affichant de la publicité. En revanche, les bots multi-usages, qui combinent recherche et entraînement, sont bloqués par défaut sans cette condition. Vérifiez aussi l'absence de scripts d'affiliation ou de régie résiduels, la détection est faite par Cloudflare et non par vous.
Bloquer les bots IA fait-il baisser mon référencement Google classique ?
Non. Les bots de recherche restent autorisés par défaut chez Cloudflare, et les contrôles d'IA générative de Search Console n'affectent pas le classement dans les résultats organiques traditionnels selon la documentation de Google. Ce sont deux couches distinctes : votre position dans les liens bleus et votre présence dans les réponses générées.
Faut-il installer un fichier llms.txt sur mon site ?
Le coût est faible et le risque nul, mais l'efficacité n'est pas garantie. Google a explicitement indiqué qu'il n'utilise ni llms.txt ni llms-author.txt. Ne construisez pas votre stratégie de visibilité IA sur ce fichier, privilégiez la configuration Cloudflare, le robots.txt et les réglages Search Console.
Comment savoir si mon site est déjà bloqué pour les assistants IA ?
Interrogez ChatGPT, Gemini ou Perplexity sur des requêtes où votre site est légitime et observez s'il est cité comme source. Croisez avec vos logs serveur pour repérer les réponses 403 renvoyées aux user-agents des agents IA, et vérifiez directement l'état des réglages dans le tableau de bord Cloudflare. Un test isolé ne suffit pas, répétez-le à quinze jours d'intervalle.
Qui doit s'occuper de ce réglage dans mon entreprise ?
C'est un arbitrage marketing appliqué dans un outil technique, ce qui explique qu'il tombe souvent entre deux chaises. La décision d'autoriser ou non les agents IA revient au responsable de l'acquisition, la mise en œuvre à celui qui détient les accès Cloudflare. Formalisez la décision par écrit et attribuez-lui un propriétaire, car ces réglages continueront d'évoluer.
Sources
- ROI Revolution – August 2026 SEO & GEO News Recap
- Cloudflare – Content Independence Day: AI options
- Google Search Central – Contrôles d'IA générative dans Search Console
Article rédigé le 27/08/2026 par l'équipe Websource à partir des sources citées ci-dessus, puis relu avant publication. Une information vous semble inexacte ou datée ? Signalez-le nous, nous corrigeons.


