À propos de webatlabot
webatlabot est le robot d'exploration exploité par webatla. Il visite des pages web publiques et relève les technologies utilisées par un site. Si vous êtes arrivé ici depuis une chaîne User-Agent dans vos journaux, cette page contient tout ce qu'il faut pour identifier, vérifier ou bloquer le robot.
Dernière mise à jour 2026-08-24
1Comment identifier le robot
Mozilla/5.0 (compatible; webatlabot/1.0; +https://webatla.com/bot; abuse@webatla.com)From: abuse@webatla.com46.224.210.134 → crawl.webatla.com2a01:4f8:1c19:79a5::1 → crawl.webatla.comChaque requête du robot porte exactement cette chaîne User-Agent et exactement cet en-tête From. Le trafic provient des deux adresses ci-dessus et d'aucune autre.
2Ce que le robot fait et ne fait pas
- ✓Demande des pages publiques en HTTP et HTTPS, exactement comme le ferait un navigateur.
- ✓Lit le HTML renvoyé et les en-têtes de réponse afin de déterminer les logiciels utilisés par le site.
- ✓Suit les redirections ordinaires et enregistre l'URL finale.
- ✗N'envoie aucun formulaire, ne se connecte à aucun compte et ne tente aucune authentification.
- ✗N'analyse pas les ports et ne recherche pas de vulnérabilités.
- ✗N'exécute pas de JavaScript et ne collecte aucune donnée personnelle sur les pages.
3Comment vérifier qu'une requête vient bien de nous
Nos deux adresses ont un DNS inverse pointant vers crawl.webatla.com, et ce nom d'hôte se résout à nouveau vers ces deux mêmes adresses. Vérifiez les deux sens avant d'accorder votre confiance à une requête.
# résolution inverse de l'adresse IPv4 dig -x 46.224.210.134 +short crawl.webatla.com. # la résolution directe doit renvoyer la même adresse dig +short crawl.webatla.com 46.224.210.134 # même vérification pour l'IPv6 dig -x 2a01:4f8:1c19:79a5::1 +short crawl.webatla.com.
Une chaîne User-Agent ne prouve rien à elle seule. N'importe qui peut envoyer notre User-Agent. Si une requête se présente comme webatlabot mais que l'adresse échoue au contrôle ci-dessus, ce n'est pas nous, et nous aimerions en être informés.
À noter : crawl.webatla.com est uniquement l'hôte du robot. Cette page et le reste du site sont servis depuis d'autres adresses derrière un CDN, une résolution de webatla.com ne correspondra donc pas.
4Pourquoi le robot a contacté une adresse que vous ne reconnaissez pas
Le robot s'appuie sur des listes publiques de domaines et sur le DNS. Si un domaine pointe encore vers votre adresse IP, le robot se connecte à cette adresse, même lorsque ce domaine n'a plus aucun rapport avec vous.
C'est l'explication habituelle d'une visite inattendue. Un ancien client est parti en laissant un enregistrement A ou AAAA dirigé vers votre plage, ou un domaine parqué se résout vers un hôte que vous avez repris depuis.
Envoyez-nous le nom de domaine avec l'adresse et nous confirmerons ce qui s'est passé. Corriger l'enregistrement DNS obsolète à la source arrête tous les robots, pas seulement le nôtre.
5Comment arrêter le robot
Le blocage prend effet immédiatement et ne demande rien de notre part. Filtrez sur le jeton webatlabot dans le User-Agent, ou sur les deux adresses.
# blocage par User-Agent (Apache) SetEnvIfNoCase User-Agent "webatlabot" bad_bot Deny from env=bad_bot # blocage par adresse (pare-feu Linux) iptables -A INPUT -s 46.224.210.134 -j DROP ip6tables -A INPUT -s 2a01:4f8:1c19:79a5::1 -j DROP
Vous pouvez aussi écrire à l'adresse ci-dessous pour demander l'exclusion de vos domaines ou de votre plage d'adresses. Nous traitons les demandes d'exclusion sous un jour ouvré et confirmons par e-mail une fois la modification en place.
6Contact
Une personne lit cette adresse : abuse@webatla.com
- •Le nom de domaine ou l'adresse IP concernés
- •Quelques lignes de journal, avec horodatage et fuseau horaire
- •Ce que vous attendez de nous (bloquer un domaine, exclure une plage ou expliquer une requête précise)
- •Une adresse à laquelle nous pouvons répondre