La mayoría de las preguntas sobre la web son, en realidad, preguntas sobre el cambio. Qué TLD están creciendo. Si un CMS gana o pierde terreno. Cuántos dominios se movieron detrás de un CDN concreto este trimestre. Ninguna de ellas se responde con una consulta puntual, y tampoco con un único archivo: hace falta medir dos veces la misma población. Esa práctica —tomar instantáneas periódicas de datos de dominios y compararlas— es lo que esta guía llama escucha de dominios. No tiene nada de glamurosa, es puramente mecánica y es la única forma fiable de ver moverse la web.
RESUMEN / IDEAS CLAVE
- La escucha de dominios consiste en monitorizar una población de dominios a lo largo del tiempo comparando instantáneas, en lugar de consultar nombres individuales.
- La unidad de trabajo es un archivo, no una consulta. El formato de descarga depende del paquete y se indica en la página del producto.
- La escala es el objetivo: el paquete de la zona .com contiene 163.422.083 dominios, la lista de WordPress 21.639.326 y el dataset de todos los dominios registrados 272.614.863 filas.
- Los archivos se generan en el momento de la compra, por lo que cada descarga es un extracto reciente y no una instantánea almacenada en caché. Eso es lo que hace significativa la comparación entre periodos.
- El análisis ocurre en tu lado. No hay constructor de consultas, ni consulta por dominio, ni interfaz de filtrado. Compras un archivo y lo procesas con tus propias herramientas.
- Solo datos de dominios: nombres, fechas de registro cuando se publican, name servers, MX, IP y tecnología detectada. Sin contactos personales, sin números de teléfono, sin señales de intención de compra.
- La barrera de entrada es baja: paquetes de compra única desde $3.50, Pro por $29/mes y Enterprise por $99/mes.
Índice de contenidos
- Qué es realmente la escucha de dominios
- Qué puedes medir con instantáneas
- Qué contienen los archivos
- Comprar y procesar un paquete
- Montar un flujo de trabajo de comparación
- Automatizar con la API del catálogo
- Errores habituales en la escucha de dominios y cómo evitarlos
- Preguntas frecuentes
- Recursos relacionados
Qué es realmente la escucha de dominios
La escucha de dominios es la práctica de observar una población definida de dominios en intervalos repetidos y registrar qué cambió entre ellos. Esa población puede ser un TLD entero, todos los dominios en los que se detecta un CMS determinado o todos los que resuelven a un conjunto concreto de name servers. El intervalo puede ser semanal, mensual o trimestral, según la velocidad a la que se mueva la señal que te interesa.
La mecánica es la misma sea cual sea el objeto de estudio. Tomas una instantánea, la guardas, tomas otra más adelante y calculas tres conjuntos: las filas presentes en ambas, las que aparecieron y las que desaparecieron. Todo lo interesante sale de esos tres conjuntos. El crecimiento es el conjunto de las aparecidas. La rotación es el de las desaparecidas. La migración es una fila presente en ambas con algún campo modificado.
Esta es una disciplina distinta de la consulta dominio a dominio. WHOIS y RDAP responden a «qué dice el registro sobre este nombre ahora mismo», y su límite de peticiones existe precisamente para que nadie los use para enumerar una población. Un archivo de zona o una lista de tecnología son, en sí mismos, la población, entregada como archivo. La contrapartida es la inmediatez: no puedes preguntarle nada a un archivo hasta haberlo cargado, pero una vez cargado puedes hacerle preguntas que ningún protocolo de consulta responderá jamás.
De ahí se derivan dos consecuencias prácticas. Primera, la disciplina de almacenamiento importa más que la habilidad con las consultas: si tiras el archivo del trimestre pasado, no podrás recuperar el estado del trimestre pasado. Segunda, la comparación solo es válida si ambas instantáneas se produjeron de la misma manera. Comparar un extracto reciente con la copia en caché y desactualizada de un proveedor mide la política de caché del proveedor, no la web.
Qué puedes medir con instantáneas
Todo lo que sigue se puede responder con dos o más instantáneas del mismo paquete. Nada de ello requiere datos de contacto ni una interfaz de consulta.
Crecimiento y rotación por TLD
Compara un archivo de zona con una copia anterior de sí mismo. Las filas nuevas son registros que aparecieron en la zona; las filas ausentes son nombres que salieron de ella. Agrega por mes y tendrás una tendencia de registros para ese TLD que no depende de las estadísticas publicadas por nadie.
Cuota de mercado de plataformas a lo largo del tiempo
Los paquetes de tecnología agrupan los dominios por la plataforma detectada en ellos. Contar las filas del paquete de WordPress en dos momentos distintos da una cifra de movimiento absoluto. Hacer lo mismo con varias plataformas y normalizar contra el archivo de zona de un TLD da la cuota dentro de ese TLD. Es una de las pocas maneras de dimensionar la huella de una plataforma sin depender de sus propias cifras de marketing.
Migración de infraestructura
Cuando un dataset incluye los campos de name server, MX o IP, una fila presente en ambas instantáneas con un valor distinto es un evento de migración. Agregados, estos eventos muestran qué proveedores de DNS, de correo y de hosting están ganando dominios y cuáles los están perdiendo.
Dimensionar la población antes de construir
Antes de dedicar esfuerzo de ingeniería a una integración o a un producto de nicho, el número de filas de un paquete de tecnología es un límite superior directo del conjunto de sitios abordable. Ese número es un hecho sobre el archivo, no una proyección.
Investigación y análisis de superficie de exposición
La investigación de seguridad suele empezar con «qué dominios resuelven a este bloque de red» o «qué dominios usan esta plataforma». Los archivos masivos responden a ambas como un filtro sobre una columna. Lo que no te dicen es la versión del software ni el nivel de parcheo: eso exige sondear los hosts tú mismo, y los archivos son la lista de objetivos de ese trabajo, no un sustituto de él.
Empieza a escuchar.
1.538 paquetes: 716 archivos de zona por TLD, 79 listas de tecnología, 27 datasets. El formato de descarga depende del paquete y se indica en la página del producto.
Explorar el catálogo → | Ver precios →
Qué contienen los archivos
El catálogo se divide en tres grupos:
- Archivos de zona por TLD: 716 paquetes. Solo .com contiene 163.422.083 dominios.
- Listas de tecnología y CMS: 79 paquetes de dominios agrupados por plataforma detectada. WordPress contiene 21.639.326 dominios.
- Datasets seleccionados: 27 paquetes, incluido el de todos los dominios registrados, con 272.614.863 filas.
Las columnas dependen del paquete. Un archivo de zona es estrecho; un dataset resuelto incluye los campos de DNS e IP. La tabla siguiente describe la forma de los datos, no garantiza que todas las columnas estén en todos los paquetes: cada ficha muestra su propio número de filas y su contenido antes de la compra.
| Campo | Valor de ejemplo | Dónde aparece |
|---|---|---|
| domain | example.com | Todos los paquetes |
| created / fecha de registro | 2014-03-18 | Cuando el registro la publica |
| ns | ns1.cloudflare.com | Archivos de zona, datasets |
| mx | aspmx.l.google.com | Datasets con datos de correo |
| ip | 93.184.216.34 | Datasets de dominios resueltos |
| cms / technology | WordPress | Paquetes de tecnología |
Lo que los archivos no contienen: nombres de personas, direcciones de correo electrónico, números de teléfono, datos firmográficos ni señales de intención de compra. WebTrackly publica datos de dominios. Los datos personales del titular están ocultos a nivel de registro para la mayoría de los dominios en virtud del RGPD y no forman parte del producto.
Comprar y procesar un paquete
- Elige el paquete. Explora el catálogo o ve directamente a /zones/, /domaindata/ o /datasets/. Cada ficha indica su número de filas.
- Cómpralo. Las compras únicas empiezan en $3.50. Pro cuesta $29/mes (50 paquetes, 10 datasets, 30.000 llamadas a la API); Enterprise, $99/mes (200 paquetes, 50 datasets, 300.000 llamadas a la API). Consulta los precios.
- Descárgalo. El ZIP se genera bajo demanda y está disponible inmediatamente después del pago.
- Procésalo en local. Descomprime el archivo y trabaja con el CSV en tu propio entorno.
Con este volumen de filas, las herramientas de procesamiento en streaming superan con creces a las que trabajan en memoria:
unzip wordpress-domains.zip
wc -l wordpress-domains.csv
# top name servers, straight from the CSV
duckdb -c "SELECT ns, count(*) AS n FROM 'wordpress-domains.csv'
GROUP BY ns ORDER BY n DESC LIMIT 20"
Para todo aquello que vayas a consultar repetidamente, cárgalo una vez en PostgreSQL o ClickHouse e indexa las columnas por las que filtres. Cruzar dos paquetes —una lista de tecnología contra un archivo de zona, por ejemplo— es un join por la columna de dominio.
Montar un flujo de trabajo de comparación
Un sistema de monitorización son tres cosas: una convención de nombres, un lugar donde guardar las instantáneas y un paso de comparación.
Nombra por paquete y fecha. com-zone-2026-07.csv, wordpress-2026-07.csv. La fecha es la de la descarga, no la del análisis.
Conserva los archivos originales. El CSV comprimido es barato, y una instantánea que has borrado no se puede regenerar a posteriori: el archivo refleja el estado en el momento en que se produjo.
Compara por la columna clave. Para un análisis de aparecidos/desaparecidos basta con una comparación ordenada:
cut -d, -f1 wordpress-2026-06.csv | sort -u > old.txt
cut -d, -f1 wordpress-2026-07.csv | sort -u > new.txt
comm -13 old.txt new.txt > appeared.txt # in new, not in old
comm -23 old.txt new.txt > disappeared.txt # in old, not in new
wc -l appeared.txt disappeared.txt
Para detectar cambios a nivel de campo —un dominio que sigue ahí pero ha cambiado de name servers— hazlo en SQL:
SELECT n.domain, o.ns AS old_ns, n.ns AS new_ns
FROM new_snapshot n
JOIN old_snapshot o USING (domain)
WHERE n.ns IS DISTINCT FROM o.ns;
Dos advertencias. Normaliza antes de comparar: pasa el dominio a minúsculas, elimina los puntos finales y fija una única codificación para los nombres internacionalizados, o acabarás fabricando una rotación que no existe. Y trata un único intervalo como ruido: la señal útil es la tendencia a lo largo de varios intervalos, no la diferencia entre dos archivos cualesquiera.
Automatizar con la API del catálogo
Las suscripciones incluyen acceso a la API para trabajar con el catálogo mediante programación: listar paquetes y datasets y leer sus metadatos. Pro incluye 30.000 llamadas al mes; Enterprise, 300.000. La API es una interfaz de catálogo; no realiza consultas por dominio.
curl -H "Authorization: Bearer YOUR_API_KEY" \
"https://webtrackly.com/api/v1/packages/?type=zone"
curl -H "Authorization: Bearer YOUR_API_KEY" \
"https://webtrackly.com/api/v1/packages/?type=technology&q=wordpress"
curl -H "Authorization: Bearer YOUR_API_KEY" \
"https://webtrackly.com/api/v1/datasets/"
La referencia de endpoints está en la página de documentación de la API. Un cron mensual que lea el catálogo, descargue los paquetes que sigues y los guarde en archivos fechados basta para mantener un pipeline de escucha funcionando sin supervisión.
Errores habituales en la escucha de dominios y cómo evitarlos
-
Tomar una sola instantánea y llamarlo monitorización
- Qué falla: se descarga un único archivo y se analiza una sola vez.
- Por qué: una instantánea describe un estado. Cualquier pregunta sobre crecimiento, rotación o migración requiere al menos dos.
- La solución: decide el intervalo antes de la primera descarga y conserva todos los archivos que tomes.
-
Comparar instantáneas que no se produjeron de la misma manera
- Qué falla: se compara un extracto reciente con un archivo más antiguo de otra fuente o de otro paquete.
- Por qué: la diferencia refleja entonces discrepancias metodológicas, no cambios reales.
- La solución: compara el mismo paquete consigo mismo y anota la fecha de descarga de cada archivo.
-
Saltarse la normalización antes de comparar
- Qué falla: las diferencias de mayúsculas, los puntos finales o una codificación IDN inconsistente generan enormes conjuntos fantasma de aparecidos y desaparecidos.
- Por qué: la comparación de cadenas es exacta; el mismo dominio en dos formas son dos filas.
- La solución: pasa a minúsculas, elimina los puntos finales y elige una única representación IDN al cargar los datos.
-
Cargar cientos de millones de filas en la herramienta equivocada
- Qué falla: se abre un CSV de varios gigabytes en una hoja de cálculo o se recorre fila a fila en un lenguaje de scripting.
- Por qué: aquí el número de filas llega a los cientos de millones. Cualquier cosa que mantenga el archivo en memoria no llegará a terminar.
- La solución: procésalo en streaming: filtros de línea de comandos, DuckDB directamente sobre el CSV o una carga masiva en un almacén columnar.
-
Leer una detección de tecnología como si indicara la versión
- Qué falla: se toma una lista de tecnología como una lista de hosts que ejecutan una versión vulnerable concreta.
- Por qué: los paquetes agrupan los dominios por plataforma detectada, no por nivel de parcheo.
- La solución: usa la lista como conjunto de objetivos y determina tú mismo la versión o la exposición, dentro de la autorización que tu trabajo requiera.
-
Esperar que los datos de contacto estén en algún lugar del archivo
- Qué falla: se diseña un flujo de trabajo en torno a correos electrónicos o teléfonos asociados a dominios.
- Por qué: esos datos no están en los paquetes, y los datos del titular están ocultos a nivel de registro para la mayoría de los dominios en virtud del RGPD.
- La solución: usa los datos de dominios por lo que son —un mapa de nombres, infraestructura y plataformas— y gestiona la obtención de contactos por canales con consentimiento y procedencia documentados.
Preguntas frecuentes
P: ¿Qué vende exactamente WebTrackly?
R: Datos masivos de dominios descargables. 1.538 paquetes en total: 716 archivos de zona por TLD, 79 listas de tecnología y CMS y 27 datasets seleccionados. El formato de descarga depende del paquete y se indica en la página del producto.
P: ¿Cómo de actualizada está una descarga?
R: El archivo se genera en el momento de la compra en lugar de servirse desde una instantánea preconstruida, así que refleja el estado de los datos de origen el día en que lo compras.
P: ¿Hay un buscador para consultar un dominio concreto?
R: No. No existe consulta por dominio ni interfaz de filtrado. Eliges un paquete del catálogo, lo compras, descargas el CSV y lo filtras con tus propias herramientas.
P: ¿Cómo de grandes son los archivos?
R: Depende del paquete. El paquete de la zona .com contiene 163.422.083 dominios; la lista de tecnología de WordPress, 21.639.326; y el dataset de todos los dominios registrados, 272.614.863 filas. Cada ficha muestra su número de filas antes de comprar.
P: ¿Cuánto cuesta?
R: Las compras únicas de paquetes empiezan en $3.50. Pro cuesta $29/mes e incluye 50 paquetes, 10 datasets y 30.000 llamadas a la API. Enterprise cuesta $99/mes con 200 paquetes, 50 datasets y 300.000 llamadas a la API. Consulta la página de precios para ver las condiciones vigentes.
P: ¿Los archivos incluyen datos de contacto?
R: No. Ni nombres, ni correos electrónicos, ni teléfonos, ni datos personales del titular. Con el RGPD, esos datos están ocultos en los registros públicos de la mayoría de los dominios y quedan fuera del alcance de lo que publica WebTrackly.
P: ¿Hay API?
R: Sí, para el catálogo. Lista paquetes y datasets y devuelve sus metadatos, con autenticación mediante bearer token; consulta la documentación de la API. No realiza consultas de dominios.
P: ¿Cómo detecto qué ha cambiado entre dos descargas?
R: Normaliza la columna de dominio y compara las dos instantáneas por ella. Las filas que solo están en el archivo más reciente son las que aparecieron; las que solo están en el más antiguo, las que desaparecieron; las presentes en ambos con algún campo modificado son migraciones. El comando comm se encarga de la comparación de conjuntos, y un join en SQL, de la detección de cambios a nivel de campo.
Conclusión
La escucha de dominios no es una funcionalidad de producto, es un hábito: descargar el mismo paquete de forma periódica, conservar todas las copias y compararlas. El formato de descarga depende del paquete y se indica en la página del producto. A cambio obtienes una medición de la web que no depende de las estadísticas publicadas por nadie ni de un protocolo de consulta con límite de peticiones.
Elige la población que te interesa, toma la primera instantánea y pon el reloj en marcha.
Toma la primera instantánea.
716 archivos de zona por TLD, 79 listas de tecnología, 27 datasets. El formato de descarga depende del paquete y se indica en la página del producto.
Explorar paquetes → | Ver precios →
Recursos relacionados
- Catálogo de paquetes — 1.538 bases de datos de dominios descargables
- Archivos de zona por TLD — .com, .net, .de y más de 700 más
- Datos de dominios — listas de dominios por CMS y tecnología
- Datasets seleccionados — todos los dominios registrados, servidores MX, e-commerce
- Precios — compras únicas desde $3.50