Depuis le 15 septembre 2026, Cloudflare bloque par défaut les robots Training et Agent sur les pages affichant de la publicité des nouveaux domaines, tandis que Search reste autorisé. Les propriétaires de sites peuvent configurer séparément Search, Training et Agent : autoriser, bloquer seulement les pages avec publ...
Publié parModifié avec GPT-5.6 TerraImages générées avec GPT Image 2
Réponse de recherche

Create a landscape editorial hero image for this Studio Global article: What default rules did Cloudflare begin enforcing in September 2026 for AI training and agent crawlers on millions of websites, which new an. Article summary: On September 15, 2026, Cloudflare began default-blocking automated traffic classified as AI Training or Agent on ad-bearing pages, while continuing to allow Search crawlers. The change is a default for newly onboarded do. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Cloudflare a redéfini la manière dont les sites peuvent gérer les robots associés à l’IA. Depuis le 15 septembre 2026, les nouveaux domaines intégrés à son réseau bloquent par défaut les robots classés Training et Agent sur les pages qui affichent des publicités. Les robots classés Search, eux, restent autorisés. 2
15
L’enjeu pour les éditeurs est de pouvoir conserver l’indexation susceptible de générer des visites, tout en limitant les usages qui servent à entraîner un modèle ou à aller chercher du contenu en temps réel pour un assistant IA.
Cette règle concerne les nouveaux domaines lors de leur intégration à Cloudflare. Lorsqu’une page comporte de la publicité, Cloudflare bloque par défaut deux types de trafic automatisé :
La catégorie Search demeure autorisée par défaut. Cloudflare y range les robots qui explorent ou indexent des contenus pour répondre ultérieurement à des questions ; l’entreprise associe cet usage à l’attente de trafic référent ou d’une autre forme de compensation équitable pour l’éditeur. 1
3
Il ne s’agit donc pas d’un blocage global de l’IA. La règle vise uniquement les comportements Training et Agent, et seulement les pages sur lesquelles de la publicité est détectée. 2
15
La documentation de Cloudflare indique que cette configuration par défaut s’applique aux domaines nouvellement intégrés à son réseau. 2
15 Des articles sur le déploiement précisent que le périmètre comprend aussi les nouveaux sites ajoutés par des clients existants ainsi que les comptes de l’offre gratuite qui n’avaient pas modifié manuellement leurs réglages.
23
Les clients déjà en place ne doivent donc pas présumer que toutes leurs zones existantes reçoivent automatiquement la même politique. Le résultat dépend du statut d’intégration du domaine, de l’offre utilisée et de la configuration déjà appliquée. Le plus sûr est de vérifier les contrôles des robots IA dans le tableau de bord de la zone concernée. 2
3
Cloudflare ne traite plus tout le trafic lié à l’IA comme un ensemble unique : la distinction repose sur le comportement du robot. Les trois catégories sont configurables indépendamment. 1
3
| Catégorie | Ce qu’elle recouvre | Réglage par défaut pour les nouveaux domaines, sur les pages avec publicité |
|---|---|---|
| Search | Exploration ou indexation du contenu pour répondre plus tard à des questions | Autorisé |
| Training | Collecte de contenu pour entraîner ou affiner un modèle | Bloqué |
| Agent | Automatisation en temps réel pour le compte d’un utilisateur | Bloqué |
Pour chacune de ces catégories, un site peut choisir entre trois politiques :
Cette granularité permet, par exemple, de laisser l’indexation de recherche active tout en bloquant les robots d’entraînement sur l’ensemble du site, ou d’appliquer la règle plus limitée aux seules pages monétisées par la publicité.
Le nom d’un robot ne garantit pas qu’il n’exerce qu’une seule fonction. Cloudflare explique qu’un robot combinant les rôles Search et Training est évalué selon l’ensemble de ses comportements : la règle applicable la plus restrictive détermine alors son accès. 2
6
15
Conséquence potentiellement importante : bloquer Training peut aussi empêcher l’exploration destinée à la recherche pour un robot que Cloudflare considère à la fois comme Search et Training. La documentation et les analyses du déploiement citent notamment Googlebot, Applebot et BingBot parmi les robots polyvalents concernés par cette règle. 2
6
Autrement dit, autoriser Search ne garantit pas à lui seul l’accès d’un robot qui est aussi classé dans Training. Avant d’appliquer un blocage de l’entraînement à l’échelle d’un site, il faut donc mesurer le possible impact sur l’indexation et la visibilité dans les moteurs de recherche. 2
4
Cloudflare indique que les configurations qui bloquent l’entraînement IA — y compris l’ancienne option « Block AI bots » — s’appliquent également aux robots mixtes Search et Training. 2 Les sites qui avaient activé ce réglage général en pensant ne cibler que des usages IA hors recherche ont donc intérêt à revoir leur politique.
Des informations publiées lors du déploiement évoquent une approche plus récente, « Disallow AI Training », conçue pour exprimer une préférence de non-entraînement tout en laissant Googlebot, Applebot et BingBot explorer le site pour la recherche lorsqu’un robot est désigné comme « Accountable ». Les effets pratiques et le chemin de migration pouvant dépendre du réglage retenu, les administrateurs doivent vérifier le contrôle actuellement affiché dans leur tableau de bord Cloudflare plutôt que de se fier au seul nom d’un ancien bouton. 4
La politique répond à une inquiétude croissante chez les éditeurs : historiquement, un moteur de recherche explore et indexe une page, puis peut renvoyer l’internaute vers la source. Les services d’IA générative peuvent, eux, utiliser le contenu pour l’entraînement ou afficher une réponse récupérée dans leur propre interface, avec moins de valeur directe sous forme de visites pour le site d’origine.
Cloudflare présente Search comme un trafic pour lequel les éditeurs doivent pouvoir attendre des référents ou une compensation équivalente. Les catégories Training et Agent recouvrent, elles, des usages qui prélèvent le contenu ou agissent sur celui-ci d’une autre façon. 1
3
La question centrale n’est donc pas seulement de savoir si un robot est « de l’IA ». Il s’agit de déterminer si son comportement contribue à la découverte du contenu et renvoie de la valeur au site, ou s’il consomme surtout les contenus pour l’entraînement ou des tâches IA en temps réel. 1
3
Avant tout changement, il est préférable d’évaluer les conséquences pour chaque comportement :
Ces réglages donnent davantage de contrôle aux éditeurs, mais la classification des robots polyvalents en fait aussi une décision SEO : ce n’est pas seulement un paramètre de politique IA.
Studio Global AI
Cette page comprend une réponse basée sur la source que vous pouvez continuer dans Studio Global.
Depuis le 15 septembre 2026, Cloudflare bloque par défaut les robots Training et Agent sur les pages affichant de la publicité des nouveaux domaines, tandis que Search reste autorisé.
Depuis le 15 septembre 2026, Cloudflare bloque par défaut les robots Training et Agent sur les pages affichant de la publicité des nouveaux domaines, tandis que Search reste autorisé. Les propriétaires de sites peuvent configurer séparément Search, Training et Agent : autoriser, bloquer seulement les pages avec publicité ou bloquer l’ensemble du site.
Point de vigilance SEO : un robot classé à la fois Search et Training peut être bloqué par une règle visant l’entraînement, y compris Googlebot, Applebot ou BingBot selon leur classification.