Herramienta gratuita · sin registro
¿Qué rastreadores de IA pueden acceder a tu web?
Introduce tu dominio y leeremos tu robots.txt como lo hacen los rastreadores (RFC 9309). Después te mostramos si cada agente de IA importante está permitido, bloqueado en parte o bloqueado. Los agentes de búsqueda con IA y los que actúan a petición del usuario necesitan acceso para que tus páginas se citen; permitir o no a los rastreadores de entrenamiento es una decisión aparte.
Revisado por última vez el 16 de septiembre de 2026
Comprobador de rastreadores de IA
Cómo funciona
Descargamos /robots.txt de tu dominio y analizamos sus grupos de user-agent, las reglas allow y disallow, los comodines y las líneas de sitemap.
Para cada agente de IA aplicamos el grupo coincidente más específico (o el grupo *) y la regla coincidente más larga, en tu página de inicio y en algunas rutas habituales.
Recibes un resumen en lenguaje sencillo, una lista de tareas ordenada y una tabla con el operador, la finalidad y el estado de cada bot, enlazada a la documentación oficial del operador.
Preguntas frecuentes
¿Qué es un rastreador de IA?
Es un cliente automatizado de una empresa de IA. Algunos recopilan contenido para entrenar modelos (por ejemplo, GPTBot o ClaudeBot), otros crean índices de búsqueda para respuestas de IA (por ejemplo, OAI-SearchBot, Claude-SearchBot o PerplexityBot) y otros solo acceden a una página cuando un usuario lo pide (por ejemplo, ChatGPT-User o Claude-User).
¿Debo bloquear los rastreadores de IA?
Depende de tus objetivos. Si quieres aparecer citado en respuestas de IA, permite los agentes de búsqueda y los que actúan a petición del usuario. Bloquear los rastreadores de entrenamiento es otra decisión de negocio; operadores como OpenAI, Anthropic y Google documentan tokens distintos para que puedas elegir.
¿Cómo bloqueo solo el entrenamiento de IA?
Añade un grupo para cada token de entrenamiento, por ejemplo «User-agent: GPTBot» seguido de «Disallow: /». Google indica que su token Google-Extended controla el uso para el entrenamiento y la fundamentación de Gemini y que no afecta al posicionamiento en la Búsqueda de Google.
¿robots.txt garantiza que un bot no entre?
No. robots.txt es un estándar voluntario. Los operadores de esta lista afirman respetarlo, pero no es un control de acceso: usa autenticación o reglas de cortafuegos para el contenido que deba seguir siendo privado.
¿El comprobador de rastreadores de IA de Citevana es gratuito?
Sí. Puedes usarlo gratis y sin cuenta, con un límite diario generoso para evitar abusos.