Todos os domínios registados na internet, num único ficheiro: é isso que realmente procura, e há exatamente uma forma prática de o conseguir. Não uma amostra, não uma única extensão, não um scrape que morre ao primeiro rate limit. Quer o conjunto completo de domínios em todas as extensões de domínio: limpo, atual e pronto a consultar. Eis como o consegue, e porque construí-lo por conta própria é uma armadilha.
Que dimensão tem uma lista de todos os domínios registados?
Maior do que a maioria das pessoas espera. Neste momento, estão registados centenas de milhões de domínios em todas as extensões de domínio do mundo, e o número muda todos os dias, à medida que surgem nomes novos e outros caem. Isto não é um ficheiro que se guarda numa folha de cálculo: é um dataset a sério.
O .com por si só ultrapassa os 160 milhões de domínios, cerca de 40 % de todo o espaço de nomes. Junte o .net e o .org, as extensões mais recentes (.io, .ai, .xyz, .shop) e centenas de códigos de país, e o panorama completo chega às centenas de milhões de nomes de domínio individuais. Esta escala é exatamente a razão pela qual um conjunto completo de todos os domínios é um dos datasets mais valiosos da internet: está na base de pipelines de vendas, proteção de marca, investigação de segurança e inteligência de mercado. É também a razão pela qual ninguém o distribui gratuitamente.
A pergunta sobre o .com com que toda a gente começa
A maioria das pessoas que quer «todos os domínios» começa, na prática, pelo .com, porque o .com é o mercado: com mais de 160 milhões de nomes, ofusca todas as outras extensões, e qualquer plano a sério tem de o tratar primeiro. A boa notícia: depois de ter o conjunto completo, isolá-lo é um filtro de uma linha. Cada domínio .com está no mesmo ficheiro que cada .net, .org e nome de código de país, por isso extrai-o assim que precisar dele e guarda a cauda longa para mais tarde.
Essa é a diferença entre uma exportação apenas de .com e um dataset completo: com o conjunto inteiro em mãos, o .com é uma vista, não um projeto à parte. Nunca terá de voltar a comprar o .net no trimestre seguinte só porque o primeiro ficheiro cobria apenas uma extensão.
Porque não consegue montá-lo sozinho
Não existe um registo mestre de tudo. Cada extensão de domínio funciona na infraestrutura do seu próprio operador, sob as suas próprias regras, no seu próprio formato, e a esmagadora maioria nunca chega a publicar um feed utilizável. Juntar um panorama completo, sem duplicados e atual, em todas elas, não é um script de fim de semana: é uma operação de dados permanente que a maioria das equipas começa, subestima gravemente e abandona discretamente três meses depois. Quem persiste acaba a manter scrapers frágeis, a perseguir alterações de formato em dezenas de registos, e a explicar à sua equipa porque é que a lista de domínios está, mais uma vez, uma semana desatualizada.
Esse é o problema que a webatla já resolveu. Em vez de perder um trimestre a perseguir centenas de fontes incompatíveis e mesmo assim acabar com lacunas, obtém um único ficheiro que já contém todos os domínios que rastreamos, atualizado diariamente.
O que torna este conjunto completo e utilizável
Uma pilha de despejos de registos em bruto não é um dataset: é trabalho de casa. O valor está no trabalho que transforma centenas de fontes fragmentadas num único ficheiro que pode efetivamente consultar, e é exatamente isso que está a comprar:
- Cobertura: todas as extensões de domínio, do
.come.netaté ao mais pequeno código de país, num único conjunto. Nada fica de fora só porque um registo era difícil de alcançar. - Remoção de duplicados: uma linha limpa por domínio, sem colisões resultantes de fontes sobrepostas.
- Normalização: um esquema consistente em todas as extensões, para que
example.comeexample.co.uksejam interpretados da mesma forma. - Atualidade: reconstruído diariamente, para que o conjunto reflita os domínios que existem hoje, não os do trimestre passado.
Essa combinação é a diferença entre «tecnicamente, tenho os dados» e «consigo responder a uma pergunta com eles antes do almoço».
O conjunto inteiro, num só ficheiro
O dataset completo de domínios da webatla é a própria lista: todos os domínios em todas as extensões de domínio, sem duplicados e normalizados num único ficheiro limpo, reconstruído todos os dias. Sem candidaturas, sem aprovações, sem papelada por registo: compre uma vez e extraia todo o espaço de nomes como JSONL atualizado.
É, deliberadamente, o produto mais barato e de maior volume que vendemos, porque é a base sobre a qual tudo o resto assenta: um preço fixo único, um mês de downloads e todos os domínios no seu disco em minutos, não em meses.
O aspeto de cada linha
Cada linha é um nome de domínio, estruturado para que possa filtrar e segmentar centenas de milhões de registos sem ter de montar uma base de dados. Uma única linha é tão simples como isto:
{"domain": "example.com", "tld": "com", "suffix": "com", "domainType": "ICANN"}
| Campo | Exemplo | Utilização |
|---|---|---|
domain |
example.com |
o próprio registo |
tld |
com |
filtrar por extensão de domínio |
suffix |
co.uk |
tratar corretamente sufixos multinível |
domainType |
ICANN |
separar gTLD de espaços de nomes privados |
O conjunto base diz-lhe que domínios existem. Quando precisar do registo por trás de cada um (quem é o titular, quando foi criado e através de que registrar), acrescente o dataset RDAP & WHOIS. Adicione o dataset DNS para servidores de nomes, ou Technologies para saber o que cada site utiliza. O mesmo conjunto de domínios, enriquecido a partir do ângulo que precisar.
Trabalhar com um ficheiro desta dimensão
Todos os datasets da webatla são distribuídos em JSONL: um objeto JSON por linha, o único formato que escala para centenas de milhões de domínios. Processa-se linha a linha e entra diretamente em jq, pandas, DuckDB, BigQuery ou Spark, por isso nunca carrega o ficheiro inteiro para memória.
Classifique todas as extensões por número de domínios com uma linha de jq:
cat domains.jsonl | jq -r .tld | sort | uniq -c | sort -rn | head
Extraia apenas os domínios .com para o seu próprio ficheiro:
jq -c 'select(.tld == "com")' domains.jsonl > com.jsonl
Ou consulte o conjunto inteiro no próprio local com o DuckDB, sem base de dados, sem índice:
SELECT tld, count(*) AS domains
FROM 'domains.jsonl'
GROUP BY tld
ORDER BY domains DESC;
Esta única consulta transforma o ficheiro em bruto num mapa por extensão de todo o mercado de domínios em segundos. Utilizámos os mesmos dados para analisar a concentração de DNS e registrars e as extensões de domínio com crescimento mais rápido no 1.º trimestre de 2026.
Quem depende de um conjunto completo de domínios
As equipas que compram o conjunto completo de domínios abrangem todos os setores, mas partilham um problema: dados parciais estragam silenciosamente o seu trabalho, e as lacunas permanecem invisíveis até algo correr mal mais à frente.
- Vendas e go-to-market: uma visão do mercado total endereçável só é exata se partir de todos os domínios. Filtre por um nicho
.com, um código de país ou uma pegada tecnológica, e está a prospetar o mercado inteiro, não uma fatia dele. - Equipas de marca e propriedade intelectual: encontre todos os domínios que contêm a sua marca em todas as extensões, e um typosquat
.comadormecido surge antes de ser usado como arma. - Segurança e threat intel: varra todo o espaço de nomes em busca de padrões de phishing, clusters suspeitos de servidores de nomes e novos domínios semelhantes que um feed parcial não detetaria.
- Investidores em domínios e registrars: acompanhe a movimentação de domínios por extensão ao longo do tempo e identifique onde a procura está a mudar.
- Equipas de dados e ML: treine e avalie com um conjunto limpo e sem duplicados de nomes de domínio reais, não uma amostra obtida por scraping que distorce o modelo.
Todos estes casos partem do mesmo ponto: um conjunto de domínios completo, atual e de confiança, não uma exportação desatualizada ou um scrape a meio.
O custo real de uma lista incompleta
Uma lista parcial falha em silêncio, e é isso que a torna perigosa. Um número de mercado total endereçável parece sólido até se descobrir que foi construído a partir de uma fração dos domínios que realmente existem. Uma varredura de marca volta limpa, não porque não existam domínios semelhantes, mas porque os dados nunca os continham. Um modelo treina com uma amostra enviesada, e ninguém repara até as previsões começarem a desviar-se silenciosamente.
A completude é o propósito de uma lista de domínios, não um extra. Um conjunto ao qual faltam os códigos de país, ou os registos da semana passada, ou a cauda longa estacionada, enviesa todas as contagens e todas as correspondências construídas sobre ele. Comprar um único ficheiro fidedigno em vez de juntar fragmentos é exatamente o que elimina esse ponto cego: um ficheiro, todos os domínios, para que a resposta que obtém seja, de facto, verdadeira.
Do ficheiro à primeira resposta em minutos
Não há nenhum projeto de ETL para executar antes de obter valor. Basta abrir um ficheiro e apontar o jq ou o DuckDB para ele: fica imediatamente a consultar todo o espaço de nomes de domínios, seja a contar .com versus .net, a isolar um código de país ou a procurar padrões de uma marca em todas as extensões numa única passagem. Por ser JSONL simples, o mesmo ficheiro alimenta um notebook Python, uma tarefa Spark ou uma carga para o BigQuery sem conversão. A distância entre comprar os dados e responder a uma pergunta real mede-se em minutos, não em sprints. Este é o argumento prático para comprar o conjunto de uma só vez: assim que chega, já está a produzir resultados, e o seu tempo vai para a análise, não para as tarefas de infraestrutura.
Sempre atual, nunca desatualizado
Um ficheiro de domínios envelhece depressa. Registam-se e largam-se nomes a cada minuto, por isso um ficheiro com seis meses é, na maior parte, ruído para tudo o que seja sensível ao tempo, e os domínios recentes que sinalizam um lançamento ou uma campanha são exatamente os que um conjunto desatualizado não apanha. É por isso que o dataset é reconstruído diariamente e cada exportação é versionada por data: sabe sempre, com precisão, o que tem em mãos e quando foi gerado. Se o objetivo é apanhar registos acabados de fazer no dia em que surgem, o dataset Domain Investor foi concebido em torno de domínios recentes em todas as extensões.
Perguntas frequentes
Quantos domínios registados existem?
Centenas de milhões, somando todas as extensões, e o número muda diariamente. Só o .com ultrapassa os 160 milhões, cerca de 40 % do total. Como muda constantemente, um conjunto datado e reconstruído diariamente é a única versão que vale a pena usar.
Posso descarregar apenas os domínios .com?
Sim. Filtre o dataset completo por tld == "com" e tem todos os domínios .com no seu próprio ficheiro. O .com é, de longe, a maior extensão, por isso espere um ficheiro grande, mas é um filtro, não uma compra separada.
O ficheiro inclui mais do que o .com?
Sim. O .com é apenas a maior fatia. O conjunto abrange .net, .org, .io, .ai e todas as outras extensões até ao mais pequeno código de país, tudo no mesmo ficheiro.
Posso obter apenas os domínios registados recentemente? Sim. Filtre por data de registo, ou comece pelo dataset Domain Investor, que se foca em registos recentes em todas as extensões de domínio.
Em que formato está e quão atual é? JSONL limpo, um domínio por linha, reconstruído diariamente e versionado por data, nunca um despejo histórico desatualizado.
Posso usar a lista completa comercialmente? Sim. Vendas, segurança, proteção de marca, investigação e funcionalidades de produto são todos usos habituais. Um preço fixo único cobre um mês de acesso para o que estiver a construir sobre os dados.
Quanto custa? Um preço fixo único para um mês de acesso, sem subscrição. Consulte a página de preços para o valor atual: é a forma mais económica de ter todos os domínios no seu disco.
Descarregue a lista completa
Deixe de tentar remontar os domínios da internet registo a registo: é um projeto que nunca termina. Descarregue o dataset completo de domínios da webatla → e tenha, hoje, todos os domínios registados em todas as extensões de domínio, do .com à cauda longa, em JSONL limpo e atual. Ou explore todos os datasets para ver tudo o que pode acrescentar. Sem registos para perseguir e sem aprovações para esperar, apenas o conjunto completo de domínios, a funcionar assim que chega. É o caminho mais rápido entre «preciso de todos os domínios» e realmente tê-los.