CitevanaBot
CitevanaBot est le robot de récupération que Citevana utilise pour analyser les pages publiques soumises à nos outils.
Dernière mise à jour : 16 septembre 2026
Comment le reconnaître
CitevanaBot s’identifie avec un user-agent qui commence par « CitevanaBot » et renvoie vers cette page (https://citevana.com/bot).
Ce que CitevanaBot récupère
CitevanaBot ne récupère que les URL soumises aux outils de Citevana, ainsi que des fichiers publics associés sur le même site, comme /robots.txt et /llms.txt. Il ne parcourt pas le web de sa propre initiative. Après le lancement, il explorera aussi les sites que leurs propriétaires ont vérifiés dans Citevana, pour les audits de site.
robots.txt
Les fonctionnalités d’exploration, comme les audits de site, respectent les règles du robots.txt. Une vérification ponctuelle d’une seule URL est demandée par une personne, un peu comme l’ouverture de la page dans un navigateur. Pour bloquer les fonctionnalités d’exploration de CitevanaBot, ajoutez ceci à votre robots.txt : User-agent: CitevanaBot / Disallow: /
Limites et garde-fous
- Il ne se connecte qu’à des adresses internet publiques, en HTTP ou HTTPS sur les ports standard.
- Il suit au maximum 5 redirections, s’arrête après 8 secondes et lit au plus 2 Mo par réponse.
- Les requêtes des outils gratuits sont limitées.
- Il ne se connecte à aucun compte, ne soumet aucun formulaire et ne tente pas de contourner les CAPTCHA ou les protections anti-robots.
- Il n’extrait pas de résultats de recherche Google.
- Il traite le contenu des pages uniquement comme des données, jamais comme des instructions.
Contact
Si CitevanaBot pose un problème à votre site, écrivez à hello@citevana.com en indiquant les URL concernées et l’heure, et nous examinerons la situation.