Desde 15 de setembro de 2026, novos domínios na Cloudflare bloqueiam por padrão rastreadores de treinamento de IA e agentes em páginas com anúncios; a categoria Search continua permitida. Os proprietários podem configurar Search, Training e Agent separadamente: permitir, bloquear apenas páginas com anúncios ou bloqu...
Publicado porEditado com GPT-5.6 TerraImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What default rules did Cloudflare begin enforcing in September 2026 for AI training and agent crawlers on millions of websites, which new an. Article summary: On September 15, 2026, Cloudflare began default-blocking automated traffic classified as AI Training or Agent on ad-bearing pages, while continuing to allow Search crawlers. The change is a default for newly onboarded do. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
A Cloudflare passou a separar com mais rigor a indexação tradicional para busca dos usos de conteúdo ligados à IA. Desde 15 de setembro de 2026, novos domínios que entram na rede recebem, por padrão, bloqueio para rastreadores classificados como Training ou Agent em páginas que exibem anúncios. Já os rastreadores classificados como Search continuam permitidos. 2
15
A distinção interessa especialmente a veículos, blogs e outros sites que desejam manter a descoberta de conteúdo por buscadores, mas limitar sistemas automatizados que treinam modelos ou consultam páginas em tempo real para assistentes de IA.
A nova configuração padrão vale para novos domínios em processo de entrada na Cloudflare. Nas páginas em que a empresa detecta anúncios, duas categorias de tráfego automatizado são bloqueadas:
A categoria Search segue liberada por padrão. A Cloudflare a define como a coleta ou indexação de conteúdo para responder a perguntas posteriormente — um modelo no qual o site deveria receber tráfego de referência ou outra compensação considerada equivalente. 1
3
Portanto, não se trata de um bloqueio geral contra IA. A configuração padrão atinge apenas os comportamentos de Training e Agent, e somente nas páginas que exibem publicidade. 2
15
A documentação oficial aponta que o novo padrão se aplica a domínios que estão sendo adicionados à rede da Cloudflare. 2
15 Coberturas sobre a implementação também descrevem o alcance como incluindo novos sites de clientes já existentes e contas do plano gratuito que não alteraram manualmente suas configurações.
23
Quem já usa a Cloudflare não deve presumir que todos os domínios antigos receberam automaticamente a mesma política. O resultado prático depende do status de entrada do domínio, do plano e das configurações já existentes. A forma mais segura de confirmar a regra ativa é revisar os controles de rastreadores de IA na zona do domínio. 2
3
Em vez de tratar todo rastreador ligado à IA como uma coisa só, a Cloudflare divide o tráfego automatizado por comportamento. As três categorias podem ser configuradas de forma independente: 1
3
| Categoria | O que abrange | Padrão para novos domínios em páginas com anúncios |
|---|---|---|
| Search | Coleta ou indexação de conteúdo para responder a perguntas depois | Permitido |
| Training | Coleta de conteúdo para treinamento ou ajuste fino de modelos | Bloqueado |
| Agent | Automação em tempo real que atua em nome de um usuário | Bloqueado |
Para cada categoria, o administrador do site pode escolher uma de três políticas:
Esse nível de controle permite, por exemplo, manter a indexação de busca acessível e bloquear rastreadores de treinamento no site inteiro — ou adotar a regra mais limitada às páginas monetizadas com anúncios.
A classificação de um rastreador não se limita necessariamente a um único comportamento. Segundo a Cloudflare, rastreadores que combinam Search e Training são avaliados por todos os seus comportamentos, e a regra aplicável mais restritiva determina o acesso. 2
6
15
Na prática, isso pode ter uma consequência relevante: se um site bloquear Training, um rastreador que a Cloudflare considere simultaneamente Search e Training poderá perder também o acesso usual de rastreamento para busca. A documentação e a cobertura do lançamento citam Googlebot, Applebot e BingBot como exemplos de rastreadores multipropósito relevantes para essa regra. 2
6
Ou seja: manter Search permitido não garante automaticamente o acesso de um bot cuja atividade também seja classificada como Training. Antes de aplicar um bloqueio total a Training, o proprietário do site deve avaliar a possível perda de indexação e visibilidade em buscadores. 2
4
A Cloudflare informou que configurações que bloqueiam treinamento de IA — incluindo a opção antiga “Block AI bots” — também se aplicam a rastreadores que misturam Search e Training. 2 Por isso, sites que ativaram esse controle amplo esperando atingir apenas usos de IA fora da busca devem revisar sua política.
Uma cobertura posterior ao lançamento relatou uma abordagem mais recente, chamada “Disallow AI Training”, voltada a sinalizar a preferência de não permitir treinamento sem necessariamente impedir Googlebot, Applebot e BingBot de rastrear para fins de busca quando o rastreador for designado como “Accountable”. Como o comportamento e a migração podem variar conforme a opção escolhida, administradores devem verificar o controle exibido atualmente no painel da Cloudflare, em vez de se basear apenas no nome de um botão antigo. 4
A política responde a uma preocupação crescente entre publishers: historicamente, mecanismos de busca rastreiam e indexam páginas, mas também podem enviar leitores de volta ao site de origem. Serviços de IA generativa, por sua vez, podem usar o conteúdo para treinar modelos ou entregar respostas recuperadas dentro de sua própria interface, com menor retorno direto de visitas ao publisher.
A Cloudflare descreve Search como um tipo de tráfego no qual o site deveria esperar referências ou compensação equivalente. Já Training e Agent representam usos que absorvem ou utilizam o conteúdo de outras formas. 1
3 Seus controles buscam permitir que os donos dos sites preservem as automações que consideram valiosas e restrinjam as que não consideram.
A questão central, portanto, não é apenas se um bot usa IA. É se seu comportamento ajuda pessoas a descobrir o conteúdo e gera valor de volta para o site, ou se consome o material principalmente para treinamento ou tarefas de IA em tempo real. 1
3
Antes de mudar a política, vale checar os efeitos por tipo de comportamento:
Os novos padrões da Cloudflare dão mais controle aos publishers, mas a classificação de rastreadores multipropósito faz da configuração também uma decisão de SEO — e não apenas uma escolha sobre política de IA.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
Desde 15 de setembro de 2026, novos domínios na Cloudflare bloqueiam por padrão rastreadores de treinamento de IA e agentes em páginas com anúncios; a categoria Search continua permitida.
Desde 15 de setembro de 2026, novos domínios na Cloudflare bloqueiam por padrão rastreadores de treinamento de IA e agentes em páginas com anúncios; a categoria Search continua permitida. Os proprietários podem configurar Search, Training e Agent separadamente: permitir, bloquear apenas páginas com anúncios ou bloquear todo o site.
Rastreadores de uso misto podem seguir a regra mais restritiva. Por isso, bloquear Training pode também afetar a atividade de busca de bots como Googlebot, Applebot e BingBot.