Los archivos de zona son la base de la inteligencia de dominios: una instantánea de todos los dominios activos bajo un determinado dominio de primer nivel, junto con sus registros DNS. Saber cómo obtenerlos, analizarlos y filtrarlos es lo que diferencia un conjunto de datos de dominios accionable de un archivo de texto enorme e inservible. Esta guía explica de dónde proceden los datos de zona, por qué las zonas de código de país son mucho más difíciles de conseguir que las genéricas y cómo reducir un feed en bruto a algo utilizable.
¿Listo para trabajar con datos de zona reales? WebTrackly ofrece bases de datos de dominios listas para descargar: archivos de zona por TLD, datos de zona enriquecidos con campos NS, MX, IP y CMS, listas de sitios por tecnología y conjuntos de datos curados en descargas CSV de pago único, sin suscripción.
En resumen
- Los feeds en bruto de dominios recién registrados (NRD) tienen mucho ruido: buena parte son dominios aparcados o spam de PPC, así que filtrar antes de usarlos es obligatorio.
- Conseguir archivos de zona de ccTLD es bastante más difícil que en los gTLD; registros como los de .de y .fr no publican ninguna zona pública, lo que obliga a recurrir a datos agregados.
- El valor de una lista de dominios para el cold email se degrada rápido sin validación de MX: vuelve a comprobar la entregabilidad la misma semana en que envías.
- WebTrackly cubre 716 archivos de zona por TLD y 716 conjuntos de zona enriquecidos, con 279,944,703 dominios en total, entregados en CSV dentro de un ZIP.
- En la generación de leads sensible al tiempo, una exportación reciente vale más que un volcado de marketplace mucho mayor pero desactualizado.
Entender el archivo de zona
Un archivo de zona es un archivo de texto plano que lista los nombres de dominio activos bajo un TLD concreto junto con sus registros DNS. El archivo de zona de .com, por ejemplo, lista todos los dominios .com registrados y sus registros de servidores de nombres (NS): 163,422,083 dominios en la exportación actual de esa zona en WebTrackly. El acceso a los archivos de zona de gTLD se rige por los acuerdos de ICANN y normalmente exige una solicitud, su aprobación y compromisos sobre el uso que se dará a los datos; la documentación del programa de registros de ICANN describe el marco.
El valor de un archivo de zona no está tanto en el volumen como en la estructura. Cada entrada aporta el nombre de dominio, sus servidores de nombres y, a veces, registros glue: las direcciones IP de los servidores de nombres que residen dentro del propio TLD. Con eso basta para seguir relaciones de alojamiento, identificar proveedores de DNS y agrupar dominios por infraestructura compartida, que es la base de casi cualquier técnica de filtrado que merezca la pena.
Obtener archivos de zona: gTLD frente a ccTLD
La dificultad se concentra en la adquisición, y la brecha entre los TLD genéricos y los de código de país es enorme.
Archivos de zona de gTLD
Para los TLD genéricos como .com, .org o .info el proceso está estandarizado, pero es burocrático. Los registros —Verisign en el caso de .com y .net— gestionan programas de acceso a archivos de zona con proceso de solicitud, acuerdos de uso y, en algunos casos, tarifas. Los detalles están publicados en la página de acceso a archivos de zona de Verisign. La aprobación es solo el principio: los archivos se actualizan a diario, llegan comprimidos y hay que descomprimirlos, analizarlos e indexarlos de forma periódica. Eso es un compromiso de infraestructura permanente, no una descarga puntual.
Archivos de zona de ccTLD: el problema difícil
Los archivos de zona de ccTLD son mucho más difíciles de obtener que los de gTLD. Muchos registros de código de país sencillamente nunca publican un archivo de zona público. El .de alemán y el .fr francés son los ejemplos más destacados, y ambos alegan la privacidad del titular y la política nacional. Como los registros de ccTLD no están sujetos a la política de ICANN del mismo modo que los de gTLD, no existe un programa de acceso centralizado al que acudir: cada registro fija sus propias condiciones y, en una parte nada desdeñable de los casos, la respuesta es simplemente no.
Eso deja los datos agregados como única vía práctica para cubrir esas zonas. También implica que la disponibilidad por TLD es desigual en todos los proveedores de este mercado, el nuestro incluido. Antes de montar un flujo de trabajo en torno a una zona de código de país concreta, comprueba que esa zona esté realmente en el catálogo: WebTrackly publica actualmente 716 archivos de zona por TLD, con sus conjuntos enriquecidos correspondientes en datos de dominios. Si trabajas específicamente con dominios recién registrados, consulta nuestra guía sobre cómo trabajar con dominios recién registrados.
No dejes que unos registros inaccesibles frenen tu investigación. WebTrackly ofrece bases de datos de dominios listas para descargar: archivos de zona por TLD, datos de zona enriquecidos, listas de sitios por tecnología y conjuntos de datos curados — CSV dentro de un ZIP, generados en el momento de la compra, desde $3.50.
Filtrar el ruido: del archivo de zona en bruto a una lista accionable
Un archivo de zona en bruto, o un feed diario de dominios recién registrados derivado de él, es una manguera a presión. El reto no es conseguir datos, sino conseguir datos útiles: una gran proporción de cualquier feed de NRD son páginas aparcadas y spam de PPC y, sin un filtrado agresivo, cualquier campaña de contacto construida sobre ellos fracasa por diseño.
Una metodología de filtrado
- Reconocimiento de patrones en los servidores de nombres. El filtro más rentable. Los registros NS que apuntan a proveedores de aparcamiento delatan un dominio sin sitio activo, y además se agrupan: un solo patrón elimina muchos dominios de golpe. Se ejecuta sin conexión sobre un CSV que ya contiene los campos NS, sin más coste que el procesamiento.
- Filtrado por registrador. Los registros masivos y de bajo coste se concentran en un puñado de registradores y se correlacionan mucho con los clústeres de aparcamiento anteriores, así que ambos filtros se complementan en lugar de solaparse.
- Análisis WHOIS. Los registros anónimos, las direcciones de contacto genéricas y los servicios de privacidad son señales débiles por separado, pero útiles combinadas con los filtros estructurales.
- Análisis de tecnología y contenido. Para una lista corta, comprobar sobre qué plataforma funciona cada sitio añade una dimensión de cualificación muy potente. WebTrackly publica 79 listas de sitios basadas en tecnología que cubren la detección de CMS y plataformas: WordPress con 21,639,326 dominios y Joomla con 607,765, entre otras.
El orden importa. Ejecuta primero los filtros estructurales gratuitos sobre toda la zona y gasta peticiones de red solo en lo que sobreviva. Invertir ese orden es la forma más habitual de convertir un análisis barato en uno caro.
Por qué los datos de zona son más complicados de lo que parecen
Hay dos cosas que sorprenden sistemáticamente a quien llega a esto desde un perfil de datos generalista.
La primera es que, en el trabajo con dominios recién registrados, la frescura no es un extra deseable: es toda la premisa. Los NRD resultan interesantes porque representan negocios en fase de arranque, todavía eligiendo proveedores y tomando decisiones. Una vez pasada esa ventana, la lista es solo una lista de dominios, y su tamaño no lo compensa. Por eso WebTrackly genera cada archivo en el momento de la compra en lugar de distribuir un volcado preconstruido.
La segunda es que el volumen interesante no se limita a los TLD clásicos. Los gTLD más nuevos como .xyz, .online y .site tienen una proporción de basura mayor que .com, pero su volumen absoluto de registros es lo bastante alto como para que un extracto bien filtrado siga dando una lista relevante. Limitar tu cobertura a .com y .net es decidir ignorar buena parte del panorama actual de registros, no una opción neutra por defecto.
Conclusiones prácticas
- Prioriza la frescura en las campañas con NRD. Si tu objetivo son negocios recién lanzados, la antigüedad de los datos es la variable que gobierna el resultado. Trabaja a partir de una exportación reciente.
- Valida los registros MX antes del cold email. Una lista de dominios vale lo que valga su validación de MX, y esa validación envejece. Haz la pasada sin conexión sobre el campo MX de los datos de zona enriquecidos y después ejecuta comprobaciones en vivo con un servicio como Hunter.io o ZeroBounce justo antes de enviar. WebTrackly vende únicamente datos a nivel de dominio: sin registros de contacto, direcciones de correo ni números de teléfono.
- No descartes los ccTLD, pero comprueba antes la cobertura. La oportunidad de segmentación en el espacio de código de país es real, y el problema de acceso a los datos también. Confirma que la zona que necesitas está disponible antes de diseñar nada en torno a ella.
- Filtra primero de forma estructural y luego de forma selectiva. Filtros de servidores de nombres y de registrador sobre todo el archivo; peticiones de red solo sobre los supervivientes.
- Segmenta por tecnología. Saber que un dominio funciona con WordPress, Shopify o Magento hace que el contacto sea muchísimo más específico. Las listas de sitios por tecnología existen precisamente para que no tengas que construir tú mismo la detección.
Preguntas frecuentes
¿Cuál es la diferencia entre un archivo de zona y los datos de zona enriquecidos?
Un archivo de zona lista los dominios de un TLD junto con sus registros de servidores de nombres: un mapa técnico de lo que existe. Los datos de zona enriquecidos añaden encima atributos por dominio —campos NS, MX, IP y CMS—, que son los que permiten filtrar sin montar tu propia infraestructura de rastreo y resolución. WebTrackly publica 716 paquetes de cada tipo, en zonas y datos de dominios.
¿Por qué es más difícil conseguir archivos de zona de ccTLD que de gTLD?
Por la regulación nacional y la autonomía de cada registro. Muchos registros de código de país, sobre todo en Europa, priorizan la privacidad del titular y no publican un archivo de zona completo, a menudo amparándose en la legislación de protección de datos. Los grandes registros de gTLD operan bajo acuerdos de ICANN que contemplan el acceso al archivo de zona en condiciones definidas. En el espacio de código de país no existe un mecanismo central equivalente, así que los datos agregados son la alternativa práctica cuando no hay acceso directo.
¿Cómo de actuales son los datos cuando los descargo?
Cada archivo se exporta en el momento de la compra en lugar de servirse desde un volcado preconstruido, así que refleja el estado de la zona en ese preciso instante. Recibes un CSV dentro de un ZIP, disponible inmediatamente después del pago.
¿Cuánto cuesta?
Los paquetes individuales parten de $3.50 como compra única, sin suscripción. Para un uso habitual hay dos planes: Pro, a $29 al mes, con 50 paquetes y 10 conjuntos de datos y 30K llamadas a la API; y Enterprise, a $99 al mes, con 200 paquetes y 50 conjuntos de datos y 300K llamadas a la API. Las colecciones entre zonas —incluido el conjunto de datos completo de todos los dominios, con 272,614,863 filas— figuran en conjuntos de datos. Consulta también nuestra guía complementaria sobre los registros DNS en los datos de zona.
¿Listo para trabajar con datos de dominios actualizados? WebTrackly ofrece 1,538 paquetes —716 archivos de zona por TLD, 716 conjuntos de zona enriquecidos, 79 listas de sitios por tecnología y 27 conjuntos de datos curados— en descargas CSV inmediatas.