Domain Intelligence

¿Quién es el dueño de los dominios .com? Entender los datos de registro de .com

blureshot mayo 01, 2026 15 min de lectura 710 visitas
who owns .com domain - Unlocking Billions: Who Owns .com Domains and How WebTrackly Turns That Data into Your Next 50,000 Leads
who owns .com domain - Unlocking Billions: Who Owns .com Domains and How WebTrackly Turns That Data into Your Next 50,000 Leads

"¿Quién es el dueño de .com?" es una sola pregunta con dos respuestas muy distintas. En el nivel del registro la respuesta es precisa y pública: .com lo opera Verisign en virtud de un contrato con la ICANN, y el registro publica un archivo de zona con los dominios que existen. En el nivel de cada titular la respuesta es, en su mayor parte, inaccesible: desde el RGPD, la mayoría de las fichas WHOIS de .com están ocultas. Este artículo explica qué contienen realmente los datos de registro de .com, qué se puede y qué no se puede deducir de ellos, y qué ofrece WebTrackly: conjuntos de datos de zona y de enriquecimiento descargables, incluidos 163,422,083 dominios .com.

Resumen / Ideas clave

  • Registro frente a registrador: Verisign gestiona el registro de .com; registradores como GoDaddy o Namecheap venden y administran las altas. Los datos del titular residen en el registrador, no en el archivo de zona.
  • El archivo de zona responde a "qué existe": enumera los dominios delegados y sus servidores de nombres; ni nombres, ni direcciones, ni contactos.
  • WHOIS ya no responde a "quién": los datos del titular de un .com están ocultos por defecto por motivos de privacidad, así que identificar la titularidad dominio a dominio y a gran escala no es realista.
  • El enriquecimiento responde a "qué tecnología usa y dónde está alojado": NS, MX, IP y el CMS detectado se derivan de las respuestas DNS y HTTP, y son el sustituto práctico de los datos de titularidad.
  • Qué ofrece WebTrackly: El formato de descarga depende del paquete y se indica en la página del producto. Solo la zona .com suma 163,422,083 dominios.
  • Qué no ofrece: ni contactos personales, ni datos de intención, ni consultas dominio a dominio, ni búsqueda interactiva por tecnología.

Índice de contenidos

Quién es realmente el dueño de .com: registro, registrador y titular

En todo dominio .com intervienen tres actores distintos, y confundirlos es el origen de casi todas las suposiciones erróneas sobre los datos de dominios.

  • El registro opera el propio TLD. En el caso de .com es Verisign, bajo un acuerdo de registro con la ICANN. El registro mantiene la base de datos autorizada de qué nombres .com están delegados y a qué servidores de nombres apuntan, y opera la infraestructura DNS autoritativa de la zona.
  • El registrador es la empresa acreditada que vende el alta a un cliente final: GoDaddy, Namecheap, Tucows, Cloudflare y cientos más. El registrador es quien mantiene la relación con el cliente, los datos de facturación y la ficha de contacto del titular.
  • El titular es la persona u organización que ostenta el derecho de uso del nombre durante el periodo de registro. Nadie "posee" un dominio en propiedad plena: un registro es un derecho renovable, no una propiedad.

Esta separación tiene consecuencias prácticas. El registro puede decirte, de forma exhaustiva, qué nombres existen. No puede decirte quién hay detrás, porque nunca dispone de esa información en un formato que publique. El registrador sí tiene la identidad del titular, pero solo la distribuye a través de WHOIS/RDAP y sujeta a la ocultación por privacidad.

Qué publica el archivo de zona de .com — y qué no

Un archivo de zona es la lista de delegaciones DNS de un dominio de primer nivel. En el caso de .com enumera todos los nombres de segundo nivel con servidores de nombres activos, junto con los registros NS que los delegan y los registros de pegado A/AAAA cuando esos servidores de nombres residen dentro de la propia zona. El acceso a los archivos de zona de los gTLD se facilita a las partes autorizadas a través del Centralized Zone Data Service de la ICANN.

Lo que sí te da un archivo de zona:

  • El conjunto completo de nombres delegados bajo el TLD: lo más parecido que existe a un censo de la web en la capa de nombres.
  • Los servidores de nombres a los que está delegado cada dominio, un indicador sólido del proveedor de DNS y, a menudo, de la plataforma de alojamiento que hay detrás del sitio.
  • Una base fiable para comparar versiones: nombres que aparecen o desaparecen entre dos instantáneas.

Lo que no te da un archivo de zona:

  • Nombres de titulares, organizaciones, direcciones postales ni datos de contacto de ningún tipo.
  • Fechas de alta o de vencimiento: esas proceden del servicio WHOIS/RDAP del registro, y solo algunos registros las publican de forma masiva.
  • Nombres registrados que no tienen servidores de nombres configurados. Un dominio puede estar registrado y no delegado; sencillamente no aparecerá en la zona.
  • Nada sobre el contenido, el modelo de negocio o el tamaño del sitio.

Dicho de otro modo: el archivo de zona responde a "qué existe", y lo hace con una exhaustividad poco común. No responde —ni se diseñó nunca para responder— a "quién es su dueño".

Por qué WHOIS ya no responde a la pregunta de la titularidad

La respuesta clásica a "quién es el dueño del dominio .com X" era una consulta WHOIS: una petición a la base de datos del registrador o del registro que devolvía el nombre del titular, la organización, la dirección postal y las fechas de registro. Esa respuesta ha dejado de funcionar en gran medida.

  • Ocultación por privacidad. A raíz del RGPD, registradores y registros ocultan por defecto los campos de contacto del titular en la mayoría de los dominios. Una respuesta WHOIS típica de un .com muestra hoy el registrador, los códigos de estado, los servidores de nombres y las fechas — y "REDACTED FOR PRIVACY" en lugar de la identidad.
  • Servicios de privacidad y proxy. Cuando una ficha no está oculta, el nombre suele estar registrado a través de un servicio de proxy, de modo que el titular visible es el propio proveedor del proxy.
  • Límites de frecuencia. Los endpoints WHOIS y RDAP están pensados para consultas puntuales y aisladas. Consultar millones de nombres no está permitido ni es viable.
  • Datos obsoletos. Las fichas de titular las declara el propio interesado y muchas veces no se actualizan nunca tras el alta inicial.

Las alternativas de siempre no salen mejor paradas. Las consultas manuales no escalan y están limitadas por frecuencia; el scraping a medida consume muchos recursos, es frágil y jurídicamente ambiguo; y las listas estáticas que se compran quedan obsoletas enseguida y carecen de trazabilidad verificable.

La conclusión honesta: identificar la titularidad dominio a dominio y a gran escala ya no es algo que los datos públicos permitan. Lo que sigue disponible, y resulta genuinamente útil, son los datos de infraestructura y tecnología.

De "qué existe" a "qué tecnología usa": enriquecimiento de DNS y tecnología

Si la titularidad está cerrada, la capa observable sigue abierta. Todo sitio activo responde a consultas DNS y a peticiones HTTP, y esas respuestas describen su stack:

  • Los registros NS identifican al operador de DNS, a menudo una plataforma de alojamiento, una CDN o un proveedor de WordPress gestionado.
  • Los registros MX identifican la plataforma de correo: Google Workspace, Microsoft 365, el correo por defecto de un proveedor de alojamiento o ninguna en absoluto. Un dominio sin registro MX suele estar aparcado o inactivo.
  • Los registros A/AAAA resuelven a una IP, que se asocia a un ASN y, por tanto, a un proveedor de alojamiento, una región de nube o un nodo de CDN.
  • Las respuestas HTTP dejan al descubierto huellas de CMS y de plataforma: metaetiquetas generator, rutas características, nombres de cookies, patrones de cabeceras.

Nada de esto son datos personales. Describe infraestructura, no personas, y precisamente por eso puede recopilarse y distribuirse de forma masiva, algo que con la identidad de WHOIS no es posible.

Qué ofrece realmente WebTrackly

WebTrackly no es un buscador de personas. Es un catálogo de conjuntos de datos descargables construidos a partir de datos de zona y enriquecimiento de infraestructura.

Cobertura y tipos de paquete

El catálogo contiene actualmente 1,538 paquetes:

  • 716 archivos de zona por TLD — las listas de dominios en bruto, una por dominio de primer nivel.
  • 716 conjuntos enriquecidos por zona — las mismas zonas con NS, MX, IP y el CMS detectado añadidos.
  • 79 listas de sitios por CMS o tecnología — por ejemplo, todas las instalaciones detectadas de WordPress o Joomla.
  • 27 conjuntos de datos seleccionados — compilaciones entre zonas, como la lista completa de dominios registrados.

Cifras principales de cobertura:

Conjunto de datos Dominios
Todas las zonas combinadas 285,582,781
Zona .com 163,422,083
Todos los dominios registrados (conjunto seleccionado) 272,614,863 filas
Sitios WordPress 21,639,326
Sitios Joomla 567,680

Esquema de datos y qué no contienen los archivos

Un paquete de zona enriquecida es un CSV con, por fila:

  • domain — el nombre registrado.
  • registration_date — cuando el registro la publica; vacío en los registros que no lo hacen.
  • ns — los servidores de nombres delegados.
  • mx — los servidores de correo, cuando existen.
  • ip — dirección resuelta del registro apex.
  • cms — sistema de gestión de contenidos o plataforma detectada, cuando se identifica alguna.

Dicho claramente, los archivos no contienen ningún contacto personal: ni personas identificadas, ni fichas de contacto de empresas, ni señales de comportamiento o de intención. No hay herramienta de consulta dominio a dominio ni búsqueda interactiva por tecnología. Lo que recibes es el archivo masivo, y todo lo que hagas después con él ocurre en tu propia máquina.

Trabajar con los datos: comprar, descargar y procesar en local

El flujo es deliberadamente sencillo y tiene cuatro pasos.

  1. Elige un paquete en el catálogo, o ve directamente a los archivos de zona por TLD, los datos de dominios o los conjuntos de datos seleccionados.
  2. Cómpralo. Las compras puntuales arrancan en $3.50. También hay suscripciones: Pro, a $29/mes, incluye 50 paquetes más 10 conjuntos de datos y 30,000 llamadas a la API; Enterprise, a $99/mes, incluye 200 paquetes más 50 conjuntos de datos y 300,000 llamadas a la API. Consulta los precios.
  3. Descarga. El formato de descarga depende del paquete y se indica en la página del producto.
  4. Procésalo en local. Son archivos planos de gran tamaño, y las herramientas habituales de línea de comandos y análisis los manejan sin problema.

Un archivo a escala .com es demasiado grande para una hoja de cálculo, así que empieza por la línea de comandos:

unzip com_zone_enriched.zip
wc -l com_zone_enriched.csv
head -3 com_zone_enriched.csv

# domains delegated to Cloudflare name servers
grep -i 'ns\.cloudflare\.com' com_zone_enriched.csv > cloudflare.csv

# how many use Google Workspace for mail
grep -ic 'aspmx\.l\.google\.com' com_zone_enriched.csv

Para cualquier análisis, carga el CSV en DuckDB o ClickHouse en lugar de en una base de datos transaccional de propósito general: ambas leen CSV directamente y manejan cientos de millones de filas en una sola máquina:

-- DuckDB
CREATE TABLE com AS SELECT * FROM read_csv_auto('com_zone_enriched.csv');

SELECT cms, count(*) AS sites
FROM com
WHERE cms IS NOT NULL
GROUP BY cms
ORDER BY sites DESC
LIMIT 20;

-- share of the zone that resolves at all
SELECT count(*) FILTER (WHERE ip IS NOT NULL) AS resolving,
       count(*)                                AS total
FROM com;

Como cada compra regenera la exportación, comparar una descarga antigua con otra más reciente te da una comparación directa de los nombres que aparecen y desaparecen, o de las migraciones de plataforma dentro de una zona.

La API: un catálogo de paquetes

La API expone el catálogo: qué paquetes existen, qué cubren y cómo obtenerlos. No es un endpoint de búsqueda de dominios, porque detrás no hay ningún producto de consulta dominio a dominio. Todas las peticiones se autentican con un token de tipo bearer.

curl -X GET "https://webtrackly.com/api/v1/packages/?type=zone" \
  -H "Authorization: Bearer YOUR_API_KEY"

curl -X GET "https://webtrackly.com/api/v1/packages/?type=technology&q=wordpress" \
  -H "Authorization: Bearer YOUR_API_KEY"

curl -X GET "https://webtrackly.com/api/v1/packages/{slug}/" \
  -H "Authorization: Bearer YOUR_API_KEY"

Lo mismo en Python: listar los paquetes de tecnología que coinciden con una palabra clave y después inspeccionar uno de ellos antes de comprarlo:

import requests

API = "https://webtrackly.com/api/v1"
headers = {"Authorization": "Bearer YOUR_API_KEY"}

# 1. find technology packages matching a keyword
resp = requests.get(f"{API}/packages/",
                    params={"type": "technology", "q": "wordpress"},
                    headers=headers)
packages = resp.json()

for pkg in packages["results"]:
    print(pkg["slug"], pkg["name"])

# 2. inspect a single package
slug = packages["results"][0]["slug"]
detail = requests.get(f"{API}/packages/{slug}/", headers=headers).json()
print(detail["slug"], detail.get("rows"), detail.get("price"))

La documentación de los endpoints está en /api/. El cupo de llamadas depende del plan: 30,000 al mes en Pro y 300,000 en Enterprise.

Errores habituales al trabajar con datos de dominios

  1. Error: esperar que WHOIS identifique al propietario

    • Qué sale mal: se diseña un flujo de trabajo en torno a obtener nombres de titulares para una lista de dominios. Funciona con un puñado de fichas antiguas y luego se derrumba.
    • Por qué falla: la mayoría de los campos de titular de .com están ocultos, muchos nombres van tras un proxy y las consultas masivas están limitadas por frecuencia.
    • La solución: apóyate en señales de infraestructura: servidores de nombres, plataforma de correo, IP de alojamiento y CMS detectado. Son observables, consistentes y están disponibles de forma masiva.
  2. Error: tratar un archivo de zona como una lista de sitios web activos

    • Qué sale mal: se presenta un recuento de nombres delegados como si fuera un recuento de sitios activos.
    • Por qué falla: una parte importante de los dominios delegados están aparcados, redirigidos o registrados de forma defensiva, sin contenido alguno.
    • La solución: filtra por las columnas de enriquecimiento. Exigir una IP que resuelva, un registro MX o un CMS detectado reduce una zona a algo mucho más cercano a los sitios en funcionamiento.
  3. Error: dar por hecho que una instantánea sigue siendo exacta

    • Qué sale mal: se trata como actual un archivo descargado hace meses.
    • Por qué falla: los dominios se registran y se liberan continuamente, y las migraciones de plataforma o de alojamiento ocurren sin parar.
    • La solución: vuelve a descargar cuando la actualidad importe. Las exportaciones se generan en el momento de la compra, así que una descarga nueva es una instantánea nueva — y dos instantáneas te dan una comparación.
  4. Error: cargar cientos de millones de filas en la herramienta equivocada

    • Qué sale mal: el CSV se abre en una hoja de cálculo o se importa fila a fila en una base de datos transaccional.
    • Por qué falla: las hojas de cálculo llegan a su límite mucho antes de la escala de .com, y las inserciones fila a fila tardan horas en agregaciones que un motor columnar resuelve en segundos.
    • La solución: usa procesamiento en flujo desde la línea de comandos para filtrar, y DuckDB o ClickHouse para agregar. Ambos leen CSV de forma nativa.
  5. Error: interpretar la detección de CMS como una certeza

    • Qué sale mal: una plataforma detectada se toma como un hecho verificado sobre un negocio.
    • Por qué falla: la detección se basa en huellas. Las configuraciones headless, el almacenamiento en caché agresivo, las CDN y los desarrollos a medida pueden ocultar o imitar una plataforma.
    • La solución: trata la columna de CMS como una señal sólida para segmentar y dimensionar mercados, y verifica caso por caso antes de actuar sobre una fila concreta.
  6. Error: pasar por alto las consideraciones legales y éticas

    • Qué sale mal: se adquieren y utilizan datos sin conocer la normativa de privacidad (RGPD, CCPA) ni las políticas de uso aceptable. Esto puede acarrear problemas legales, daño reputacional y suspensiones de cuenta.
    • Por qué falla: el desconocimiento no exime. La privacidad de los datos es una preocupación seria en todo el mundo, y las empresas responden por cómo recopilan y utilizan datos personales.
    • La solución: cíñete siempre a las obligaciones legales. Los conjuntos de datos descritos aquí contienen datos de infraestructura observables públicamente y ningún contacto personal, lo que mantiene los datos en sí fuera del alcance de la mayoría de las normas sobre datos personales — pero aquello con lo que los combines, y cómo actúes a partir de ellos, sigue siendo responsabilidad tuya.

Preguntas frecuentes (FAQ)

P: ¿Puedo averiguar con estos datos quién es el dueño de un dominio .com concreto?
R: No. La identidad del titular de un .com está oculta en WHOIS en la gran mayoría de los dominios, y no forma parte de los datos de zona ni de enriquecimiento. Lo que los datos te dicen es que un dominio existe, dónde está delegado, dónde resuelve, qué plataforma de correo usa y qué CMS parece ejecutar.

P: ¿Qué recibo exactamente al comprar un paquete?
R: El formato de descarga depende del paquete y se indica en la página del producto. La exportación se genera en el momento de la compra, de modo que refleja el estado actual del conjunto de datos y no un archivo prefabricado de antigüedad desconocida.

P: ¿Los archivos contienen datos de contacto personales?
R: No. No hay ningún contacto personal de ningún tipo en los datos. Las columnas son dominio, fecha de alta cuando el registro la publica, servidores de nombres, registros MX, IP y CMS detectado.

P: ¿Qué parte del espacio de nombres .com está cubierta?
R: El paquete de la zona .com cubre 163,422,083 dominios. Entre las 716 zonas, el total es de 285,582,781 dominios, y el conjunto seleccionado de todos los dominios registrados contiene 272,614,863 filas.

P: ¿Existe una interfaz para filtrar dominios por tecnología?
R: No hay una interfaz de filtrado interactivo. El catálogo está organizado en paquetes ya preparados — archivos por zona, conjuntos enriquecidos por zona, listas de sitios por tecnología y conjuntos de datos seleccionados — y el filtrado se hace por tu parte una vez descargado el CSV.

P: ¿Qué hace la API?
R: Sirve el catálogo: lista los paquetes por tipo, permite buscarlos por palabra clave y devuelve el detalle de un paquete concreto. Los endpoints son GET /api/v1/packages/?type=zone, GET /api/v1/packages/?type=technology&q=wordpress y GET /api/v1/packages/{slug}/, autenticados con una cabecera Authorization: Bearer.

P: ¿Cuánto cuestan los planes?
R: Los paquetes individuales pueden comprarse de forma puntual desde $3.50. Pro cuesta $29/mes e incluye 50 paquetes, 10 conjuntos de datos y 30,000 llamadas a la API. Enterprise cuesta $99/mes e incluye 200 paquetes, 50 conjuntos de datos y 300,000 llamadas a la API. Tienes el detalle en la página de precios.

P: ¿Por qué algunas filas no tienen fecha de alta?
R: Porque no todos los registros publican las fechas de alta en un formato que pueda compilarse de forma masiva. Cuando el registro la publica, el campo se rellena; cuando no, se deja vacío en lugar de estimarlo.

Conclusión

La pregunta "quién es el dueño de .com" tiene una respuesta institucional nítida — Verisign opera el registro, los registradores acreditados venden los nombres y los titulares ostentan derechos limitados en el tiempo — y una respuesta individual en gran medida cerrada, porque la identidad del titular está oculta por defecto. Trabajar de forma productiva con datos de .com pasa por aceptarlo y desplazar la pregunta un paso al lado: no quién hay detrás de un dominio, sino qué existe y qué tecnología usa.

El formato de descarga depende del paquete y se indica en la página del producto. Empieza por el catálogo de paquetes o por el listado de archivos de zona.

Compartir esta entrada

Entradas relacionadas

Comentarios (0)

Dejar un comentario

Aún no hay comentarios. ¡Sé el primero en comentar!

support_agent
WebTrackly Support
Usually replies within minutes
¡Hola!
Envíanos un mensaje y te responderemos lo antes posible.