Notre robot d'indexation
Si vous administrez le site d'un musée et avez vu EnfiladeBot dans vos journaux — c'est nous. Vous trouverez ici qui nous sommes, ce que nous prenons et comment nous bloquer.
EnfiladeBot est le robot d'un catalogue de musées. Il décline son nom complet et laisse l'adresse de cette page : un robot sans adresse de retour, vous avez le droit de le bloquer, et vous auriez raison.
Horaires, tarifs, adresse, téléphone, lien de billetterie et liste des expositions — ce qu'un visiteur lit sur vos pages. Nous ne prenons pas d'images, ne conservons pas de pages entières et n'explorons rien au-delà de ces rubriques. Ce que nous reprenons vous est attribué avec la date de lecture, et le lien mène à votre page, non à côté.
Pas plus d'une requête toutes les deux secondes par hôte ; la nuit plutôt qu'aux heures de visite ; avec des requêtes conditionnelles (ETag et If-Modified-Since), de sorte que le plus souvent on nous répond « non modifié » et nous ne prenons rien. Chaque type d'information est revu à son propre rythme : expositions chaque semaine, horaires tous les trois mois, adresse une fois l'an.
Une ligne dans robots.txt — nous la lisons et la respectons, et nous tranchons les cas douteux à notre défaveur : une interdiction l'emporte sur une autorisation de même longueur. Une règle à notre nom remplace entièrement la règle générale.
Balisez vos horaires et vos tarifs en schema.org — OpeningHoursSpecification, Offer, ExhibitionEvent. Nous reprendrons alors ce que vous déclarez vous-même plutôt que ce que nous devinons de votre code, et vos horaires cesseront de casser à chaque refonte. Sur soixante et un sites de musées, exactement un l'a fait.
Écrivez-nous par le formulaire de contact — une demande d'arrêt est honorée le jour même et sans discussion. Nous écrire.