A Cloudflare definiu o dia 15 de setembro de 2026 como prazo final para empresas de IA separarem seus crawlers de busca, treinamento e agentes; robôs 'mistos' serão bloqueados por padrão em sites com anúncios. A empresa introduziu um sistema de três categorias (Busca, Agente, Treinamento) que permite aos editores de...
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What changes is Cloudflare implementing by September 15, 2026, regarding how it handles AI crawle. Article summary: Here is a fact-checked, evidence-backed breakdown of Cloudflare's September 15, 2026 deadline and its three-part policy shift.. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it us
A partir de 15 de setembro de 2026, a Cloudflare bloqueará qualquer crawler de IA que agrupe indexação de busca com treinamento de IA ou tarefas de agente em um único user-agent — a menos que o editor opte explicitamente por permitir .
Esta não é uma simples mudança de configuração. A Cloudflare, que gerencia cerca de 20% do tráfego global da internet, está virando o padrão da web de 'opt-out' (crawlers permitidos a menos que bloqueados) para 'opt-in' para crawlers específicos de IA . Para os editores, isso significa proteção de nível empresarial contra bots. Para as empresas de IA, significa o fim da raspagem gratuita em larga escala de sites que usam Cloudflare.
A Cloudflare estabeleceu o 15 de setembro de 2026 como prazo para que as empresas de IA separem seus crawlers em categorias distintas e identificadas, com base em como o conteúdo será usado. Qualquer crawler que não declare claramente seu propósito — ou que agrupe indexação de busca com treinamento de IA sob um único user-agent — será bloqueado por padrão no tráfego originado da Cloudflare, particularmente em páginas que exibem anúncios .
Após essa data, novos clientes da Cloudflare e sites recém-criados terão configurações padrão que permitirão apenas crawlers de busca claramente identificados, bloqueando crawlers de treinamento e agentes de IA, a menos que o editor opte explicitamente por permiti-los . Clientes existentes do plano gratuito que não atualizarem manualmente suas preferências também serão migrados para os novos padrões
.
Anteriormente, a web operava com uma norma de opt-out: os crawlers eram permitidos a menos que um site os bloqueasse explicitamente via robots.txt. A Cloudflare inverteu isso para um paradigma de opt-in para crawlers específicos de IA .
A Cloudflare introduziu uma nova classificação que permite que os editores definam regras independentes para três comportamentos de robôs, disponível para todos os clientes, incluindo os do plano gratuito :
| Categoria | Definição | Configuração Padrão (15 de Setembro) |
|---|---|---|
| Busca (Search) | Crawlers que indexam conteúdo para que ele apareça nos resultados de busca e enviem tráfego de referência de volta ao editor. | Permitido por padrão — esses bots geram leitores e receita de anúncios. |
| Agente (Agent) | Bots que agem em nome de um usuário (ex.: assistentes de IA realizando tarefas, compras ou reservas). | Bloqueado por padrão — editores devem optar por permitir. |
| Treinamento (Training) | Bots que raspam conteúdo exclusivamente para treinar modelos de IA, sem enviar usuários ou atribuição de volta. | Bloqueado por padrão — editores devem optar por permitir. |
Os editores agora podem definir uma política como 'Permitir Busca, Bloquear Treinamento, Bloquear Agente' a partir de um único painel, mesmo no plano gratuito . Isso é mais granular do que o
robots.txt tradicional, que só permitia uma permissão/negação genérica por user-agent. A própria documentação da Cloudflare define Busca como uma atividade onde os proprietários de sites 'devem esperar tráfego de referência ou alguma compensação equitativa' .
A Cloudflare introduziu o 'Pague por Crawl' (Pay Per Crawl) em julho de 2025 como um beta privado — um mercado onde os editores podiam cobrar das empresas de IA por requisição, usando códigos de status HTTP 402 ('Pagamento Requerido') para negociar o acesso . Este sistema permitia que os editores retornassem uma resposta 402 com informações de preço quando um crawler não aprovado solicitava conteúdo
.
Em abril de 2026, durante a chamada Semana dos Agentes (13 a 17 de abril), a empresa evoluiu isso para um modelo mais amplo de 'Pague por Uso' (Pay Per Use), integrando a estrutura de pagamento por crawl em um console operacional único disponível em todos os níveis de plano . A distinção principal:
A implementação do Stack Overflow (fevereiro de 2026) demonstrou a versão de produção: seu programa de licenciamento de dados usa a categorização de bots da Cloudflare para servir respostas 402 a crawlers não autorizados, monetizando em escala sem contratos personalizados .
robots.txt que vão além do acesso por página, permitindo que os editores sinalizem se seu conteúdo pode ser usado para indexação de busca, treinamento de IA ou agentes de IA Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
A Cloudflare definiu o dia 15 de setembro de 2026 como prazo final para empresas de IA separarem seus crawlers de busca, treinamento e agentes; robôs 'mistos' serão bloqueados por padrão em sites com anúncios.
A Cloudflare definiu o dia 15 de setembro de 2026 como prazo final para empresas de IA separarem seus crawlers de busca, treinamento e agentes; robôs 'mistos' serão bloqueados por padrão em sites com anúncios. A empresa introduziu um sistema de três categorias (Busca, Agente, Treinamento) que permite aos editores definir regras independentes para cada tipo de robô, mesmo no plano gratuito.
O modelo 'Pague por Crawl' de 2025 evoluiu para 'Pague por Uso', um sistema flexível que permite desde taxas por requisição até licenças fixas, já implementado por empresas como o Stack Overflow.