Salle de serveurs faiblement éclairée, rangées de baies réseau avec voyants lumineux, faible profondeur de champ

Actualité : Cloudflare a annoncé le 1er juillet 2026 qu'à compter du 15 septembre 2026, les nouveaux domaines rejoignant sa plateforme recevront des réglages par défaut modifiés : les robots classés « Training » et « Agent » seront bloqués sur les pages affichant de la publicité, tandis que la catégorie « Search » restera autorisée (Cloudflare, « Your site, your rules », 1er juillet 2026).

L'essentiel en 20 secondes

  • La formule qui circule, « Cloudflare va bloquer Googlebot par défaut », ne correspond pas au texte de Cloudflare : le défaut annoncé laisse la catégorie Search autorisée.
  • Le point réellement documenté est ailleurs : l'ancienne option « Block AI bots » excluait jusqu'ici les robots à double usage. Elle ne les exclura plus.
  • Conséquence concrète : un site qui a coché cette case il y a des mois change de comportement sans que personne n'y touche.
  • Pour la visibilité dans les IA, la catégorie décisive n'est pas Training mais Agent, qui couvre les récupérations de pages en temps réel.

Une annonce d'infrastructure passe rarement pour un sujet éditorial. Celle-ci en est un, parce qu'elle déplace une décision que la plupart des sites n'ont jamais prise consciemment : qui a le droit de lire vos pages, et pour quoi faire.

Depuis l'annonce du 1er juillet, une lecture s'est imposée dans les comptes rendus spécialisés : au 15 septembre, Cloudflare bloquerait Googlebot par défaut, et un cinquième du web disparaîtrait des résultats de recherche. La documentation de Cloudflare décrit quelque chose de plus étroit, et de plus sournois.

Les trois catégories que Cloudflare a créées

Le cœur du changement n'est pas un blocage, c'est une taxonomie. Cloudflare a cessé de traiter « les robots IA » comme un bloc et les classe désormais par intention.

CatégorieDéfinition CloudflareRéglage par défaut au 15 septembre
Search« Tout comportement qui collecte ou indexe votre contenu, afin de pouvoir répondre à des questions à son sujet plus tard »Autorisé
Agent« Une activité automatisée agissant, généralement en temps réel, pour le compte d'une personne »Bloqué sur les pages publicitaires
Training« Un robot qui récupère votre contenu pour entraîner ou affiner un modèle »Bloqué sur les pages publicitaires

Ce découpage a une conséquence que Cloudflare assume : un robot est « autorisé ou bloqué selon l'ensemble de ses comportements ». Or Googlebot, Applebot et BingBot font plusieurs choses à la fois. Ils indexent pour la recherche et collectent pour l'entraînement, avec le même agent utilisateur. C'est ce qu'on appelle un robot à double usage, et c'est là que tout se joue. Nous avions déjà décrit ce problème d'agent unique dans notre analyse d'Applebot et de la visibilité dans Siri.

Pourquoi « Googlebot bloqué par défaut » est une lecture fragile

Le réglage par défaut annoncé pour les nouveaux domaines bloque Training et Agent sur les pages publicitaires, et Cloudflare précise dans la même phrase que Search « restera autorisé par défaut ». Googlebot relève de Search. Sur cette base, le raccourci « Googlebot bloqué par défaut » ne tient pas.

Mais Cloudflare écrit aussi, dans sa documentation technique, que les robots à double usage « seront également bloqués par toutes les configurations visant à bloquer l'entraînement IA ». Le nouveau défaut est une configuration qui bloque l'entraînement. Les deux phrases se rencontrent, et la documentation publique ne dit pas explicitement laquelle l'emporte sur un domaine neuf.

Ce que nous n'affirmons pas : nous ne savons pas, à la lecture des sources publiques disponibles au 10 août 2026, si un nouveau domaine verra Googlebot bloqué sur ses pages publicitaires au 15 septembre. Les deux formulations de Cloudflare pointent dans des directions différentes et l'entreprise n'a pas publié d'arbitrage. Nous avons vérifié ces deux passages directement dans le billet de blog et dans la documentation technique de Cloudflare, le 10 août 2026, et non dans les reprises secondaires qui les résument. Nous préférons signaler cette zone d'ombre plutôt que de choisir la version la plus spectaculaire, comme l'a fait une partie de la couverture.

Le vrai piège : une case cochée il y a six mois

Voilà le point qui ne souffre aucune ambiguïté, et il concerne des sites qui existent déjà.

Beaucoup d'éditeurs ont activé, à un moment ou à un autre, l'option historique « Block AI bots » de Cloudflare. Un clic, un sentiment de contrôle, puis on passe à autre chose. Ce réglage, précise la documentation, excluait les robots à double usage : Googlebot continuait de passer. À partir du 15 septembre, cette exclusion disparaît, et l'ancienne case se met à couvrir les robots qu'elle épargnait.

Le changement ne demande aucune action de votre part. C'est exactement ce qui le rend dangereux : il n'y aura pas de notification dans votre outil d'analyse, pas d'alerte dans la Search Console, juste une érosion de l'exploration sur les pages monétisées, attribuée quelques semaines plus tard à une mise à jour d'algorithme imaginaire.

Vous ne savez pas ce qui est coché dans votre Cloudflare ? C'est le cas de la plupart des sites que nous auditons. On regarde votre configuration d'exploration et votre visibilité réelle dans les moteurs IA, et on vous dit ce qui bloque. .

La catégorie que personne ne regarde : Agent

La couverture s'est concentrée sur Training, parce que c'est le sujet politique du moment. Pour votre visibilité, la catégorie qui compte est Agent, et elle est bloquée par défaut sur les pages publicitaires.

Cloudflare définit Agent comme l'activité automatisée agissant en temps réel pour le compte d'une personne, et cite explicitement les robots de récupération de pages des agents conversationnels. C'est le mécanisme par lequel un assistant va chercher votre page pendant qu'un utilisateur pose sa question, pour la citer dans sa réponse. Bloquer Agent, ce n'est pas refuser d'alimenter un modèle : c'est refuser d'être cité au moment précis où quelqu'un cherche ce que vous vendez.

La distinction est structurante pour le référencement génératif. Entraînement et citation temps réel sont deux robinets séparés, et on peut fermer le second en croyant fermer le premier. Nous avons détaillé ce mécanisme de citation dans notre article sur la façon dont ChatGPT sélectionne ses sources, et le débat plus large sur le blocage des robots dans les médias face à Common Crawl.

Ce qu'il faut faire avant le 15 septembre 2026

  1. Ouvrir les réglages de sécurité de votre zone Cloudflare. Pas pour changer quelque chose, pour constater. La question à laquelle vous devez pouvoir répondre est simple : l'option de blocage des robots IA est-elle active sur ce domaine, oui ou non ?
  2. Traiter l'ancienne case « Block AI bots » comme une dette. Si elle est cochée, elle a été cochée par quelqu'un, un jour, pour une raison. Retrouvez cette raison avant le 15 septembre, ou décochez-la.
  3. Décider séparément pour Agent et pour Training. Ce sont deux arbitrages différents : l'un porte sur votre présence dans les réponses des IA, l'autre sur l'entraînement des modèles. Les traiter d'un seul geste est le réflexe que Cloudflare vient précisément de rendre coûteux.
  4. Identifier vos pages publicitaires. Le défaut ne s'applique qu'à elles. Si vous monétisez vos pages de contenu, ce sont vos pages de contenu qui sont concernées, c'est-à-dire celles qui portent votre stratégie de contenu.
  5. Annoter la date dans vos rapports. Posez un repère au 15 septembre 2026. Sans lui, une baisse d'exploration en octobre sera imputée à Google plutôt qu'à une case de votre propre configuration.

Notre analyse : le CDN devient un arbitre éditorial

Ce qui se joue dépasse un réglage. Cloudflare, qui n'écrit aucun contenu, se retrouve à décider par défaut qui peut lire celui des autres. Pour un éditeur, cela veut dire qu'une partie de sa politique de visibilité est désormais définie dans une interface d'infrastructure, par des gens qui ne se voient pas comme des acteurs du référencement.

Notre position tient en une phrase : le risque du 15 septembre n'est pas que Cloudflare bloque Googlebot, c'est que des milliers de sites découvrent en octobre qu'ils avaient une opinion sur les robots IA sans le savoir. La bonne réaction n'est pas de tout débloquer par panique, c'est d'ouvrir la page de réglages et de décider une fois, en connaissance de cause.

Ce que cet article ne couvre pas

Nous ne donnons pas de procédure pas à pas. L'interface Cloudflare évolue et une capture d'écran périmée fait plus de dégâts qu'une absence d'instruction. Référez-vous à la documentation Cloudflare au moment où vous agissez.

Nous ne mesurons pas l'ampleur réelle du parc concerné. Le défaut vise les nouveaux domaines, et plusieurs reprises secondaires y ajoutent les comptes gratuits existants. Nous n'avons pas trouvé cette extension formulée ainsi dans les sources primaires de Cloudflare, et nous ne la reprenons donc pas à notre compte.

Nous ne traitons pas la monétisation par péage. Cloudflare développe en parallèle des mécanismes de facturation de l'accès des robots. C'est un autre sujet, avec un autre calendrier.

Questions fréquentes

Cloudflare va-t-il bloquer Googlebot par défaut le 15 septembre 2026 ?
Pas selon la formulation de Cloudflare. Le réglage par défaut annoncé pour les nouveaux domaines bloque les catégories Training et Agent sur les pages affichant de la publicité, et précise que la catégorie Search reste autorisée par défaut. Googlebot appartient à la catégorie Search. Cloudflare écrit par ailleurs que les robots à double usage sont bloqués par les configurations qui bloquent Training, sans indiquer publiquement comment les deux règles s'articulent sur un nouveau domaine. Nous signalons cette zone d'ombre plutôt que de trancher à sa place.
Qu'est-ce qui change pour l'ancienne case « Block AI bots » ?
C'est le point le plus clair de l'annonce. La documentation de Cloudflare indique que les robots à double usage, qui combinent Search et Training, seront bloqués par toutes les configurations bloquant l'entraînement IA, y compris l'ancienne option « Block AI bots ». Elle précise que ce réglage historique excluait jusqu'ici ces robots à double usage. Autrement dit, un site qui a activé cette case par le passé verra son comportement changer sans aucune intervention de sa part.
Quelles sont les trois catégories de robots définies par Cloudflare ?
Cloudflare définit Search comme tout comportement qui collecte ou indexe le contenu pour répondre à des questions à son sujet plus tard, Agent comme une activité automatisée agissant en temps réel pour le compte d'une personne, par exemple les robots de récupération de pages des agents conversationnels, et Training comme un robot qui récupère le contenu pour entraîner ou affiner un modèle. Un même robot peut relever de plusieurs catégories à la fois.
Comment vérifier ou modifier ses réglages avant le 15 septembre ?
Cloudflare indique que les clients peuvent signaler leur préférence dans les réglages de sécurité de leur zone à tout moment avant le 15 septembre 2026, ce qui confirme qu'ils ne souhaitent aucun changement sur les robots d'entraînement qui explorent aussi à des fins de recherche. L'action utile consiste donc à ouvrir ces réglages, constater l'état réel de la configuration, et décider explicitement plutôt que d'hériter d'un défaut.

À lire aussi

Note éditoriale. Divulgation : Cicéro est une agence de contenu SEO et GEO. Cette analyse est éditoriale, n'est pas sponsorisée, et ne présente aucun lien commercial avec Cloudflare ni avec Google. Le site cicero.studio utilise Cloudflare Turnstile sur ses formulaires.

Sources

Alexis Dollé, fondateur de Cicéro
Alexis Dollé
CEO & Fondateur

Spécialiste du growth et de la stratégie de contenu SEO, j'ai lancé Cicéro pour aider les entreprises à capter une visibilité organique durable, sur Google comme dans les réponses des IA. Chaque contenu qu'on produit est pensé pour convertir, pas juste pour exister.

LinkedIn

Votre contenu est-il prêt pour la recherche IA ?

Cicéro audite votre visibilité sur Google, ChatGPT et Perplexity, puis produit le contenu qui vous rend citable. Réservez votre diagnostic gratuit.