Todos los dominios registrados en internet, en un solo archivo: eso es lo que realmente busca, y existe exactamente una forma práctica de conseguirlo. No una muestra, no una sola extensión, no un scraping que muere al primer límite de peticiones. Quiere el conjunto completo de dominios en todas las extensiones de dominio: limpio, actual y listo para consultar. Esto es cómo conseguirlo y por qué construirlo usted mismo es una trampa.
¿Qué tamaño tiene una lista de todos los dominios registrados?
Más grande de lo que la mayoría espera. En este momento hay cientos de millones de dominios registrados en las extensiones de dominio de todo el mundo, y la cifra cambia cada día a medida que aparecen nombres nuevos y otros caducan. Eso no es un archivo que se guarda en una hoja de cálculo. Es un dataset serio.
El .com por sí solo supera los 160 millones de dominios, aproximadamente el 40 % de todo el espacio de nombres. Sume .net y .org, las extensiones más nuevas (.io, .ai, .xyz, .shop) y cientos de códigos de país, y el panorama completo alcanza cientos de millones de nombres de dominio individuales. Esa escala es precisamente la razón por la que un conjunto completo de todos los dominios es uno de los datasets más valiosos de internet: sostiene pipelines de ventas, protección de marca, investigación de seguridad e inteligencia de mercado. También es la razón por la que nadie lo regala.
La pregunta sobre .com con la que todos empiezan
La mayoría de quienes quieren «todos los dominios» en realidad empiezan por .com, porque .com es el mercado: con más de 160 millones de nombres, deja atrás a cualquier otra extensión, y cualquier plan serio tiene que abordarlo primero. La buena noticia es que, una vez que tiene el conjunto completo, aislarlo es un filtro de una sola línea. Cada dominio .com está en el mismo archivo que cada .net, .org y nombre de código de país, así que lo extrae en el momento en que lo necesita y guarda la larga cola para después.
Esa es la diferencia entre una exportación solo de .com y un dataset completo: con el conjunto entero en mano, .com es una vista, no un proyecto aparte. Nunca vuelve a comprar .net el próximo trimestre porque el primer archivo solo cubría una extensión.
Por qué no puede montarlo usted mismo
No existe un registro maestro de todo. Cada extensión de dominio funciona sobre la infraestructura de su propio operador, con sus propias reglas y su propio formato, y la inmensa mayoría no publica nunca un feed utilizable. Unir un panorama completo, deduplicado y actual entre todas ellas no es un script de fin de semana. Es una operación de datos permanente que la mayoría de los equipos empieza, subestima gravemente y abandona en silencio a los tres meses. Quienes insisten acaban manteniendo scrapers frágiles, persiguiendo cambios de formato en decenas de registros y explicando a su equipo por qué la lista de dominios vuelve a llevar una semana de retraso.
Ese es el problema que webatla ya resolvió. En lugar de quemar un trimestre entero persiguiendo cientos de fuentes incompatibles y acabar igualmente con huecos, usted recibe un único archivo que ya contiene todos los dominios que rastreamos, actualizado a diario.
Qué hace que sea un conjunto completo y utilizable
Un montón de volcados de registros en bruto no es un dataset, es trabajo por hacer. El valor está en el trabajo que convierte cientos de fuentes fragmentadas en un único archivo que de verdad se puede consultar, y eso es exactamente lo que está comprando:
- Cobertura: todas las extensiones de dominio, desde
.comy.nethasta el código de país más pequeño, en un único conjunto. Nada falta porque un registro fuera difícil de alcanzar. - Deduplicación: una fila limpia por dominio, sin colisiones por fuentes solapadas.
- Normalización: un esquema coherente en todas las extensiones, de modo que
example.comyexample.co.ukse interpretan de la misma manera. - Actualidad: reconstruido a diario, de modo que el conjunto refleja los dominios que existen hoy, no los del trimestre pasado.
Esa combinación es la diferencia entre «técnicamente tengo los datos» y «puedo responder una pregunta con ellos antes de comer».
El conjunto entero, en un solo archivo
El dataset completo de dominios de webatla es la lista en sí: todos los dominios de todas las extensiones de dominio, deduplicados y normalizados en un único archivo limpio, reconstruido cada día. Sin solicitudes, sin aprobaciones, sin papeleo por registro. Cómprelo una vez y descargue todo el espacio de nombres como JSONL recién generado.
Es deliberadamente el producto más barato y de mayor volumen que vendemos, porque es la base sobre la que se construye todo lo demás: un precio fijo único, un mes de descargas y todos los dominios en su disco en minutos, no en meses.
Qué aspecto tiene cada línea
Cada línea es un nombre de dominio, estructurado para que pueda filtrar y segmentar cientos de millones de registros sin tener que levantar una base de datos. Una sola fila es tan simple como esto:
{"domain": "example.com", "tld": "com", "suffix": "com", "domainType": "ICANN"}
| Campo | Ejemplo | Uso |
|---|---|---|
domain |
example.com |
el registro en sí |
tld |
com |
filtrar por extensión de dominio |
suffix |
co.uk |
gestionar correctamente los sufijos multinivel |
domainType |
ICANN |
separar los gTLD de los espacios de nombres privados |
El conjunto base le dice qué dominios existen. Cuando necesite el registro detrás de cada uno (quién es el propietario, cuándo se creó y a través de qué registrador), añada el dataset RDAP & WHOIS. Sume el dataset DNS para los servidores de nombres, o Technologies para saber qué usa cada sitio. El mismo conjunto de dominios, enriquecido desde el ángulo que necesite.
Trabajar con un archivo de este tamaño
Todos los datasets de webatla se entregan en JSONL: un objeto JSON por línea, el único formato que escala a cientos de millones de dominios. Se transmite línea a línea y se carga directamente en jq, pandas, DuckDB, BigQuery o Spark, de modo que nunca tiene que cargar el archivo completo en memoria.
Clasifique todas las extensiones por número de dominios con una línea de jq:
cat domains.jsonl | jq -r .tld | sort | uniq -c | sort -rn | head
Extraiga solo los dominios .com a su propio archivo:
jq -c 'select(.tld == "com")' domains.jsonl > com.jsonl
O consulte el conjunto entero directamente con DuckDB: sin base de datos, sin índice.
SELECT tld, count(*) AS domains
FROM 'domains.jsonl'
GROUP BY tld
ORDER BY domains DESC;
Esa única consulta convierte el archivo en bruto en un mapa por extensión de todo el mercado de dominios en segundos. Usamos los mismos datos para desglosar la concentración de DNS y registradores y las extensiones de dominio de mayor crecimiento del primer trimestre de 2026.
Quién depende de un conjunto completo de dominios
Los equipos que compran el conjunto completo de dominios abarcan todos los sectores, pero comparten un problema: los datos parciales estropean su trabajo en silencio, y los huecos permanecen invisibles hasta que algo falla más adelante.
- Ventas y go-to-market: una visión del mercado total direccionable solo es precisa si parte de todos los dominios. Filtre por un nicho
.com, un código de país o una huella tecnológica, y estará prospectando todo el mercado, no una parte de él. - Equipos de marca y marcas registradas: encuentre todos los dominios que contienen su marca en todas las extensiones, y un typosquat
.cominactivo sale a la luz antes de que se utilice con fines maliciosos. - Seguridad e inteligencia de amenazas: rastree todo el espacio de nombres en busca de patrones de phishing, clústeres sospechosos de servidores de nombres y nuevas imitaciones que un feed parcial pasaría por alto.
- Inversores en dominios y registradores: siga el movimiento de dominios por extensión a lo largo del tiempo y detecte hacia dónde se desplaza la demanda.
- Equipos de datos y ML: entrene y evalúe con un conjunto limpio y deduplicado de nombres de dominio reales, no con una muestra scrapeada que sesga el modelo.
Todos estos casos necesitan el mismo punto de partida: un conjunto de dominios completo, actual y fiable, no una exportación obsoleta ni un scraping a medio terminar.
El coste real de una lista incompleta
Una lista parcial falla en silencio, y eso es lo que la hace peligrosa. Una cifra de mercado total direccionable parece sólida hasta que descubre que se construyó a partir de una fracción de los dominios que existen realmente. Un rastreo de marca vuelve limpio, no porque no existan imitaciones, sino porque los datos nunca las contuvieron. Un modelo se entrena con una muestra sesgada y nadie se da cuenta hasta que las predicciones se desvían poco a poco.
La integridad es el objetivo mismo de una lista de dominios, no un extra deseable. Un conjunto al que le faltan los códigos de país, los registros de la semana pasada o la larga cola de dominios aparcados sesga cada recuento y cada coincidencia construida sobre él. Comprar un único archivo autorizado en lugar de coser fragmentos entre sí es precisamente lo que elimina ese punto ciego: un archivo, todos los dominios, de modo que la respuesta que obtiene es la que realmente es cierta.
Del archivo a la primera respuesta en minutos
No hay ningún proyecto ETL que ejecutar antes de obtener valor. Abre un archivo, apunta jq o DuckDB hacia él y ya está consultando todo el espacio de nombres de dominios de inmediato: cuenta .com frente a .net, aísla un código de país o hace coincidir patrones de una marca en todas las extensiones en una sola pasada. Al ser JSONL sencillo, el mismo archivo alimenta un notebook de Python, un job de Spark o una carga en BigQuery sin necesidad de conversión. La distancia entre comprar los datos y responder una pregunta real se mide en minutos, no en sprints. Ese es el argumento práctico para comprar el conjunto directamente: en el momento en que llega ya está funcionando, y su tiempo se dedica al análisis en lugar de a la fontanería.
Siempre actual, nunca desactualizado
Un archivo de dominios envejece rápido. Los nombres se registran y se liberan cada minuto, así que un archivo de hace seis meses es sobre todo ruido para cualquier cosa sensible al tiempo, y los dominios recién registrados que anuncian un lanzamiento o una campaña son precisamente los que un conjunto desactualizado pasa por alto. Por eso el dataset se reconstruye a diario y cada exportación va versionada por fecha: siempre sabe con precisión qué tiene entre manos y cuándo se generó. Si lo que busca es detectar registros recién creados el mismo día en que aparecen, el dataset Domain Investor está construido en torno a dominios recién registrados en todas las extensiones.
Preguntas frecuentes
¿Cuántos dominios registrados hay?
Cientos de millones sumando todas las extensiones, y la cifra cambia a diario. El .com por sí solo supera los 160 millones, aproximadamente el 40 % del total. Como cambia constantemente, un conjunto fechado y reconstruido a diario es la única versión que merece la pena usar.
¿Puedo descargar solo los dominios .com?
Sí. Filtre el dataset completo por tld == "com" y tendrá todos los dominios .com en su propio archivo. El .com es, con diferencia, la extensión más grande, así que espere un archivo grande. Pero es un filtro, no una compra aparte.
¿El archivo incluye algo más que .com?
Sí. El .com es solo la porción más grande. El conjunto abarca .net, .org, .io, .ai y todas las demás extensiones hasta el código de país más pequeño, todo en el mismo archivo.
¿Puedo obtener solo los dominios registrados recientemente? Sí. Filtre por fecha de registro, o parta del dataset Domain Investor, centrado en los registros recientes en todas las extensiones de dominio.
¿En qué formato está y cómo de actualizado? JSONL limpio, un dominio por línea, reconstruido a diario y versionado por fecha. Nunca un volcado histórico desactualizado.
¿Puedo usar la lista completa con fines comerciales? Sí. Ventas, seguridad, protección de marca, investigación y funciones de producto son usos habituales. Un precio fijo único cubre un mes de acceso, sea lo que sea lo que esté construyendo sobre los datos.
¿Cuánto cuesta? Un precio fijo por un mes de acceso, sin suscripción. Consulte los precios actuales: es la forma más económica de tener todos los dominios en su disco.
Descargue la lista completa
Deje de intentar reconstruir los dominios de internet registro a registro: es un proyecto que nunca termina. Descargue el dataset completo de dominios de webatla → y tenga hoy mismo todos los dominios registrados en todas las extensiones de dominio, tanto .com como la larga cola, en un JSONL limpio y actual. O explore todos los datasets para ver todo lo que puede añadir encima. Sin registros que perseguir ni aprobaciones que esperar, solo el conjunto completo de dominios, funcionando desde el momento en que llega. Es el camino más rápido para pasar de «necesito todos los dominios» a tenerlos de verdad.