Sobre o webatlabot

O webatlabot é o rastreador web operado pela webatla. Visita páginas web públicas e regista que tecnologias cada site utiliza. Se chegou aqui a partir de uma cadeia User-Agent nos seus registos, esta página tem tudo o que precisa para identificar, verificar ou bloquear o rastreador.

Última atualização 2026-08-24

1Como identificar o rastreador

User-Agent
Mozilla/5.0 (compatible; webatlabot/1.0; +https://webatla.com/bot; abuse@webatla.com)
Cabeçalho do pedido
From: abuse@webatla.com
Endereço IPv4
46.224.210.134crawl.webatla.com
Endereço IPv6
2a01:4f8:1c19:79a5::1crawl.webatla.com
Contacto de abuso

Todos os pedidos do rastreador levam exatamente essa cadeia User-Agent e exatamente esse cabeçalho From. O tráfego vem dos dois endereços acima e de mais nenhum.

2O que o rastreador faz e o que não faz

  • Pede páginas públicas por HTTP e HTTPS, tal como faria um navegador.
  • Lê o HTML devolvido e os cabeçalhos de resposta para determinar que software o site utiliza.
  • Segue redirecionamentos normais e guarda o URL final.
  • Não submete formulários, não inicia sessão nem tenta qualquer autenticação.
  • Não faz varrimento de portas nem procura vulnerabilidades.
  • Não executa JavaScript nem recolhe dados pessoais das páginas.

3Como confirmar que um pedido veio mesmo de nós

Os nossos dois endereços têm DNS inverso a apontar para crawl.webatla.com, e esse nome de anfitrião resolve de volta para esses mesmos dois endereços. Verifique os dois sentidos antes de confiar num pedido.

# resolução inversa do endereço IPv4
dig -x 46.224.210.134 +short
crawl.webatla.com.

# a resolução direta tem de devolver o mesmo endereço
dig +short crawl.webatla.com
46.224.210.134

# a mesma verificação para IPv6
dig -x 2a01:4f8:1c19:79a5::1 +short
crawl.webatla.com.

Uma cadeia User-Agent, por si só, não prova nada. Qualquer pessoa pode enviar o nosso User-Agent. Se um pedido se apresenta como webatlabot mas o endereço não passa a verificação acima, não somos nós, e gostaríamos de saber.

Note que crawl.webatla.com é apenas o anfitrião do rastreador. Esta página e o resto do site são servidos a partir de outros endereços atrás de uma CDN, pelo que uma consulta a webatla.com não vai coincidir.

4Porque é que o rastreador contactou um endereço que não reconhece

O rastreador trabalha a partir de listagens públicas de domínios e do DNS. Se um domínio continua a apontar para o seu endereço IP, o rastreador liga-se a esse endereço, mesmo quando esse domínio já não tem qualquer relação consigo.

É essa a explicação habitual para uma visita inesperada. Um antigo cliente saiu e deixou um registo A ou AAAA apontado para a sua gama, ou um domínio estacionado resolve para um anfitrião que entretanto passou a ser seu.

Envie-nos o nome do domínio juntamente com o endereço e confirmamos o que aconteceu. Corrigir o registo DNS desatualizado na origem trava todos os rastreadores, não só o nosso.

5Como travar o rastreador

O bloqueio produz efeito de imediato e não precisa de nada da nossa parte. Filtre pelo token webatlabot no User-Agent ou pelos dois endereços.

# bloqueio por User-Agent (Apache)
SetEnvIfNoCase User-Agent "webatlabot" bad_bot
Deny from env=bad_bot

# bloqueio por endereço (firewall Linux)
iptables -A INPUT -s 46.224.210.134 -j DROP
ip6tables -A INPUT -s 2a01:4f8:1c19:79a5::1 -j DROP

Também pode escrever para o endereço abaixo e pedir que excluamos os seus domínios ou a sua gama de endereços. Tratamos os pedidos de exclusão no prazo de um dia útil e confirmamos por email assim que a alteração estiver ativa.

6Contacto

Este endereço é lido por uma pessoa: abuse@webatla.com

  • O domínio ou o endereço IP em causa
  • Algumas linhas de registo, com data e hora e o fuso horário
  • O que pretende que façamos (bloquear um domínio, excluir uma gama ou explicar um pedido concreto)
  • Um endereço para o qual possamos responder