Ferramenta gratuita · sem cadastro
Quais rastreadores de IA conseguem acessar o seu site?
Digite seu domínio e lemos o seu robots.txt do jeito que os rastreadores leem (RFC 9309). Depois mostramos se cada agente de IA relevante está liberado, parcialmente bloqueado ou bloqueado. Agentes de busca com IA e os que acessam a pedido do usuário precisam de acesso para que suas páginas sejam citadas; liberar ou não os rastreadores de treinamento é outra escolha.
Revisado em 16 de setembro de 2026
Verificador de rastreadores de IA
Como funciona
Buscamos o /robots.txt do seu domínio e analisamos os grupos de user-agent, as regras allow e disallow, os curingas e as linhas de sitemap.
Para cada agente de IA aplicamos o grupo correspondente mais específico (ou o grupo *) e a regra correspondente mais longa, na página inicial e em alguns caminhos comuns.
Você recebe um resumo em linguagem simples, uma lista de tarefas priorizada e uma tabela com o operador, a finalidade e o status de cada bot, com link para a documentação oficial do operador.
Perguntas frequentes
O que é um rastreador de IA?
É um cliente automatizado operado por uma empresa de IA. Alguns coletam conteúdo para treinar modelos (por exemplo, GPTBot ou ClaudeBot), outros montam índices de busca para respostas de IA (por exemplo, OAI-SearchBot, Claude-SearchBot ou PerplexityBot) e outros só acessam uma página quando um usuário pede (por exemplo, ChatGPT-User ou Claude-User).
Devo bloquear rastreadores de IA?
Depende dos seus objetivos. Se você quer ser citado em respostas de IA, libere os agentes de busca e os que acessam a pedido do usuário. Bloquear rastreadores de treinamento é outra decisão de negócio; operadores como OpenAI, Anthropic e Google documentam tokens separados para você escolher.
Como bloqueio apenas o treinamento de IA?
Adicione um grupo para cada token de treinamento, por exemplo “User-agent: GPTBot” seguido de “Disallow: /”. O Google informa que o token Google-Extended controla o uso para treinamento e embasamento do Gemini e não afeta o ranqueamento na Pesquisa Google.
O robots.txt garante que um bot fique de fora?
Não. O robots.txt é um padrão voluntário. Os operadores desta lista dizem respeitá-lo, mas ele não é controle de acesso; use autenticação ou regras de firewall para conteúdo que precisa continuar privado.
O verificador de rastreadores de IA da Citevana é gratuito?
Sim. É gratuito e não exige conta, com um limite diário generoso para evitar abusos.