Cloudflare muda o padrão de bloqueio de crawlers de IA: o que isso muda para sua estratégia de GEO

Resposta rápida: Desde 15 de setembro de 2026, a Cloudflare descontinuou o antigo controle genérico "Block AI Bots" e passou a separar crawlers de IA em três categorias: treinamento, busca e agentes. Bots de treinamento e de agentes agora são bloqueados por padrão em páginas com anúncios, enquanto crawlers de uso misto — como Googlebot, Bingbot e Applebot, que fazem tanto busca quanto tarefas relacionadas a IA — são avaliados pelo conjunto do comportamento, em vez de bloqueados por completo. Para quem depende de citações em respostas de IA, a mudança reforça a importância de configurar o robots.txt com precisão: bloquear crawlers de treinamento (como GPTBot e Google-Extended) sem impedir o acesso de crawlers de busca de IA (como OAI-SearchBot e PerplexityBot), que são os que geram elegibilidade para citação.

O robots.txt genérico — permitir tudo ou bloquear tudo — está cada vez mais inadequado para quem quer aparecer em respostas de IA sem abrir mão do controle sobre como seu conteúdo é usado. A mudança de política da Cloudflare em 15 de setembro de 2026 torna essa distinção praticamente obrigatória para uma parcela relevante da web.

Indice
  1. O que mudou: do bloqueio genérico à separação por finalidade
  2. Content-Signal: sinalizando intenção diretamente no robots.txt
  3. Por que isso importa: o volume de tráfego de busca por IA está crescendo rápido
  4. O que fazer na prática
  5. Perguntas frequentes
  6. Leia também

O que mudou: do bloqueio genérico à separação por finalidade

Dois robôs representando tipos diferentes de crawlers de IA: um de treinamento e outro de busca
A separação entre crawlers de treinamento e crawlers de busca é o núcleo da mudança de política da Cloudflare.

Até então, o controle "Block AI Bots" da Cloudflare tratava crawlers de IA como um bloco único. A partir de 15 de setembro de 2026, esse controle foi descontinuado em favor de uma abordagem mais granular: bots de treinamento (como GPTBot, Google-Extended e ClaudeBot) e bots de agentes passaram a ser bloqueados por padrão em páginas que exibem anúncios. Já os crawlers de uso misto — que combinam busca, treinamento e função de agente, caso de Googlebot, Bingbot e Applebot — não são bloqueados de forma automática, mas avaliados pelo conjunto do comportamento.

Content-Signal: sinalizando intenção diretamente no robots.txt

Arquivo de código com interruptores representando sinais de acesso configuráveis
Diretivas Content-Signal permitem declarar, dentro do próprio robots.txt, se o conteúdo pode ser usado para treinamento, busca ou como insumo de resposta de IA.

Complementando a separação por tipo de crawler, o robots.txt de produção passa a poder incluir diretivas Content-Signal — como ai-train=no, search=yes e ai-input=yes — que declaram explicitamente a intenção do site: permitir que o conteúdo seja indexado e citado em respostas de IA, mas recusar seu uso para treinar novos modelos. Essa configuração, batizada de "Disallow AI Training", evita o efeito colateral mais comum de bloqueios genéricos: desaparecer também da busca tradicional e da elegibilidade para citação em IA ao tentar apenas proteger o conteúdo do treinamento.

Por que isso importa: o volume de tráfego de busca por IA está crescendo rápido

Gráfico de barras ascendente representando o crescimento do tráfego de busca por IA
As visitas vindas de busca por IA cresceram 42,8% entre o primeiro trimestre de 2025 e o de 2026.

O volume de visitas provenientes de busca por IA saltou de 15,6 bilhões para 27,4 bilhões entre o primeiro trimestre de 2025 e o mesmo período de 2026 — um crescimento de 42,8% ano a ano. Nesse contexto, bloquear indiscriminadamente qualquer bot com "AI" no nome pode significar abrir mão de uma fatia de tráfego que já supera, em alguns nichos, o volume vindo de busca tradicional.

O que fazer na prática

Para sites que já configuram GEO como parte da estratégia de conteúdo, a recomendação é auditar o robots.txt distinguindo três grupos: crawlers de treinamento (bloquear, se a política do site for essa), crawlers de busca de IA como OAI-SearchBot e Claude-SearchBot (manter liberados, já que são os que tornam o site elegível para citação) e crawlers de uso misto (avaliar caso a caso, considerando que bloqueá-los por completo também pode afetar a indexação tradicional). Revisar essa configuração deixou de ser uma tarefa pontual e passou a ser parte da manutenção regular de qualquer estratégia de GEO.

Perguntas frequentes

O que mudou na política da Cloudflare em 15 de setembro de 2026?

O controle genérico "Block AI Bots" foi descontinuado. Bots de treinamento e de agentes de IA passaram a ser bloqueados por padrão em páginas com anúncios, enquanto crawlers de uso misto são avaliados pelo comportamento, não bloqueados automaticamente.

O que são as diretivas Content-Signal no robots.txt?

São sinalizações como ai-train=no, search=yes e ai-input=yes que declaram explicitamente se o conteúdo pode ser usado para treinamento de IA, indexado em buscas ou usado como insumo para respostas de IA.

Bloquear todos os crawlers de IA prejudica o GEO?

Sim, pode prejudicar. Bloquear indiscriminadamente inclui também crawlers de busca de IA, como OAI-SearchBot e PerplexityBot, que são os responsáveis por tornar o site elegível para citação em respostas de IA.

Fonte: Gilmar Pupo — Cloudflare separou busca, treinamento e agentes: a política do gpupo.com.

📱
Versão Web Story disponívelVisual, rápido e otimizado para Google Discover.

Ver Story ›

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *

Go up