"Quem é o dono do .com" é uma única pergunta com duas respostas bem diferentes. No nível do registro, a resposta é precisa e pública: o .com é operado pela Verisign sob contrato com a ICANN, e o registro publica um arquivo de zona que lista os domínios existentes. No nível de cada titular, a resposta é, em grande parte, indisponível: desde o GDPR, a maioria dos registros WHOIS de .com está ocultada. Este artigo explica o que os dados de registro de .com realmente contêm, o que você consegue e o que não consegue extrair deles, e o que a WebTrackly entrega — conjuntos de dados de zona e de enriquecimento para download, incluindo 163,422,083 domínios .com.
TL;DR / Principais conclusões
- Registro vs. registrador: a Verisign opera o registro do .com; registradores como GoDaddy ou Namecheap vendem e gerenciam os registros de domínio. Os dados do titular ficam com o registrador, não no arquivo de zona.
- O arquivo de zona responde "o que existe": ele lista os domínios delegados e seus name servers — não nomes, não endereços, não contatos.
- O WHOIS já não responde "quem": os dados do titular de .com são ocultados por padrão por questões de privacidade, o que torna inviável identificar a propriedade domínio a domínio em escala.
- O enriquecimento responde "o que roda e onde está hospedado": NS, MX, IP e o CMS detectado são derivados de respostas de DNS e HTTP, e são o substituto prático para os dados de propriedade.
- O que a WebTrackly entrega: O formato do download varia conforme o pacote e é informado na página do produto. Só a zona .com tem 163,422,083 domínios.
- O que não entrega: nenhum contato pessoal, nenhum dado de intenção, nenhuma consulta domínio a domínio, nenhuma busca interativa por tecnologia.
Índice
- Quem realmente é dono do .com: registro, registrador e titular
- O que o arquivo de zona do .com publica — e o que não publica
- Por que o WHOIS já não responde à pergunta sobre propriedade
- De "o que existe" para "o que roda": enriquecimento de DNS e tecnologia
- O que a WebTrackly realmente oferece
- Trabalhando com os dados: comprar, baixar e processar localmente
- A API: um catálogo de pacotes
- Erros comuns ao trabalhar com dados de domínios
- Perguntas frequentes (FAQ)
- Conclusão
- Recursos relacionados
Quem realmente é dono do .com: registro, registrador e titular
Três partes distintas participam de todo domínio .com, e confundi-las é a origem da maioria das suposições equivocadas sobre dados de domínios.
- O registro opera o próprio TLD. No caso do .com, é a Verisign, sob um contrato de registro com a ICANN. O registro mantém a base autoritativa de quais nomes .com estão delegados e para quais name servers eles apontam, além de operar a infraestrutura DNS autoritativa da zona.
- O registrador é a empresa credenciada que vende o registro ao cliente final — GoDaddy, Namecheap, Tucows, Cloudflare e centenas de outras. O registrador detém o relacionamento com o cliente, os dados de cobrança e o cadastro de contato do titular.
- O titular é a pessoa ou organização que detém o direito de usar o nome durante o período de registro. Ninguém "possui" um domínio de forma definitiva; um registro é um direito renovável, não uma propriedade plena.
Essa divisão faz diferença na prática. O registro consegue dizer, de forma abrangente, quais nomes existem. Mas não consegue dizer quem está por trás deles, porque nunca detém essa informação em um formato que publique. O registrador detém a identidade do titular, mas a distribui apenas por WHOIS/RDAP, sujeita à ocultação por privacidade.
O que o arquivo de zona do .com publica — e o que não publica
Um arquivo de zona é a lista de delegações DNS de um domínio de topo. No caso do .com, ele enumera todos os nomes de segundo nível que têm name servers ativos, junto com os registros NS que os delegam e os registros glue A/AAAA quando esses name servers ficam dentro da própria zona. O acesso aos arquivos de zona dos registros de gTLDs é fornecido pelo Centralized Zone Data Service da ICANN a partes aprovadas.
O que um arquivo de zona oferece:
- O conjunto completo de nomes delegados sob o TLD — o mais próximo que existe de um censo da web na camada de nomes.
- Os name servers para os quais cada domínio está delegado, um forte indicador do provedor de DNS e, muitas vezes, da plataforma de hospedagem por trás do site.
- Uma base confiável para comparação: nomes que aparecem ou desaparecem entre dois snapshots.
O que um arquivo de zona não oferece:
- Nomes de titulares, organizações, endereços postais ou quaisquer dados de contato.
- Datas de registro ou de expiração — elas vêm do serviço WHOIS/RDAP do registro, e apenas alguns registros as publicam em massa.
- Nomes registrados que não têm name servers configurados. Um domínio pode estar registrado e não delegado; nesse caso, simplesmente não aparece na zona.
- Qualquer informação sobre o conteúdo, o modelo de negócio ou o porte do site.
Em outras palavras, o arquivo de zona é uma resposta para "o que existe", e uma resposta excepcionalmente completa. Ele não é, e nunca foi projetado para ser, uma resposta para "quem é o dono".
Por que o WHOIS já não responde à pergunta sobre propriedade
A resposta tradicional para "quem é o dono do domínio .com X" era uma consulta WHOIS: uma busca na base do registrador ou do registro que devolvia o nome do titular, a organização, o endereço postal e as datas de registro. Essa resposta praticamente deixou de funcionar.
- Ocultação por privacidade. Após o GDPR, registradores e registros passaram a ocultar por padrão os campos de contato do titular na maioria dos domínios. Uma resposta WHOIS típica de .com hoje mostra o registrador, os códigos de status, os name servers e as datas — e "REDACTED FOR PRIVACY" no lugar da identidade.
- Serviços de privacidade e proxy. Quando o dado não está ocultado, o nome muitas vezes foi registrado por meio de um serviço de proxy, de modo que o titular visível é o próprio provedor do proxy.
- Limites de requisições. Os endpoints WHOIS e RDAP foram feitos para consultas individuais ocasionais. Consultar milhões de nomes não é permitido nem prático.
- Desatualização. Os dados do titular são autodeclarados e, com frequência, nunca são atualizados após o registro inicial.
As alternativas antigas não se saem melhor. Consultas manuais não escalam e esbarram em limites de requisições; scraping próprio é caro em recursos, frágil e juridicamente ambíguo; e listas estáticas compradas envelhecem rápido e não trazem procedência verificável.
A conclusão honesta: identificar a propriedade domínio a domínio em escala já não é algo que os dados públicos sustentem. O que continua disponível, e é genuinamente útil, são os dados de infraestrutura e tecnologia.
De "o que existe" para "o que roda": enriquecimento de DNS e tecnologia
Se a propriedade está fechada, a camada observável continua aberta. Todo site ativo responde a consultas DNS e requisições HTTP, e essas respostas descrevem a stack:
- Registros NS identificam o operador de DNS — muitas vezes uma plataforma de hospedagem, uma CDN ou um provedor de WordPress gerenciado.
- Registros MX identificam a plataforma de e-mail: Google Workspace, Microsoft 365, o e-mail padrão de um provedor de hospedagem, ou nenhuma. Um domínio sem registro MX costuma estar estacionado ou inoperante.
- Registros A/AAAA resolvem para um IP, que mapeia para um ASN e, portanto, para um provedor de hospedagem, uma região de nuvem ou um edge de CDN.
- Respostas HTTP expõem impressões digitais de CMS e plataforma — meta tags generator, caminhos característicos, nomes de cookies, padrões de cabeçalho.
Nada disso é dado pessoal. Descreve infraestrutura, não pessoas, e é exatamente por isso que pode ser compilado e distribuído em massa, enquanto a identidade do WHOIS não pode.
O que a WebTrackly realmente oferece
A WebTrackly não é uma interface de busca sobre pessoas. É um catálogo de conjuntos de dados para download, construídos a partir de dados de zona e de enriquecimento de infraestrutura.
Cobertura e tipos de pacote
O catálogo contém atualmente 1,538 pacotes:
- 716 arquivos de zona de TLDs — as listas brutas de domínios, uma por domínio de topo.
- 716 conjuntos enriquecidos por zona — as mesmas zonas com NS, MX, IP e CMS detectado anexados.
- 79 listas de sites por CMS ou tecnologia — por exemplo, todas as instalações detectadas de WordPress ou Joomla.
- 27 conjuntos de dados curados — compilações entre zonas, como a lista completa de domínios registrados.
Números principais de cobertura:
| Conjunto de dados | Domínios |
|---|---|
| Todas as zonas combinadas | 285,582,781 |
| Zona .com | 163,422,083 |
| Todos os domínios registrados (conjunto curado) | 272,614,863 linhas |
| Sites WordPress | 21,639,326 |
| Sites Joomla | 567,680 |
Esquema dos dados e o que os arquivos não contêm
Um pacote de zona enriquecida é um CSV com, por linha:
domain— o nome registrado.registration_date— quando o registro a publica; vazio para registros que não publicam.ns— os name servers delegados.mx— os servidores de e-mail, quando existem.ip— endereço resolvido do registro apex.cms— sistema de gerenciamento de conteúdo ou plataforma detectada, quando identificada.
Dito com clareza, os arquivos não contêm nenhum contato pessoal: nenhuma pessoa nomeada, nenhum cadastro de contato de empresa, nenhum sinal comportamental ou de intenção. Não há ferramenta de consulta domínio a domínio nem busca interativa por tecnologia. O que você recebe é o arquivo em massa, e tudo o que fizer com ele depois acontece na sua própria máquina.
Trabalhando com os dados: comprar, baixar e processar localmente
O fluxo é deliberadamente simples e tem quatro etapas.
- Escolha um pacote no catálogo, ou vá direto para arquivos de zona por TLD, dados de domínios ou conjuntos de dados curados.
- Compre. As compras avulsas começam em $3.50. Há assinaturas disponíveis: o Pro, a $29/mês, inclui 50 pacotes mais 10 conjuntos de dados e 30,000 chamadas de API; o Enterprise, a $99/mês, inclui 200 pacotes mais 50 conjuntos de dados e 300,000 chamadas de API. Veja os preços.
- Baixe. O formato do download varia conforme o pacote e é informado na página do produto.
- Processe localmente. São arquivos planos grandes, e as ferramentas padrão de linha de comando e de análise lidam bem com eles.
Um arquivo na escala do .com é grande demais para uma planilha, então comece pela linha de comando:
unzip com_zone_enriched.zip
wc -l com_zone_enriched.csv
head -3 com_zone_enriched.csv
# domains delegated to Cloudflare name servers
grep -i 'ns\.cloudflare\.com' com_zone_enriched.csv > cloudflare.csv
# how many use Google Workspace for mail
grep -ic 'aspmx\.l\.google\.com' com_zone_enriched.csv
Para qualquer análise, carregue o CSV no DuckDB ou no ClickHouse em vez de um banco transacional de uso geral — ambos leem CSV diretamente e lidam com centenas de milhões de linhas em uma única máquina:
-- DuckDB
CREATE TABLE com AS SELECT * FROM read_csv_auto('com_zone_enriched.csv');
SELECT cms, count(*) AS sites
FROM com
WHERE cms IS NOT NULL
GROUP BY cms
ORDER BY sites DESC
LIMIT 20;
-- share of the zone that resolves at all
SELECT count(*) FILTER (WHERE ip IS NOT NULL) AS resolving,
count(*) AS total
FROM com;
Como cada compra regenera a exportação, comparar um download antigo com um mais recente dá uma leitura direta dos nomes que surgiram e desapareceram, ou das migrações de plataforma dentro de uma zona.
A API: um catálogo de pacotes
A API expõe o catálogo — quais pacotes existem, o que cobrem e como obtê-los. Não é um endpoint de busca de domínios, porque não há um produto de consulta domínio a domínio por trás dela. Todas as requisições são autenticadas com um bearer token.
curl -X GET "https://webtrackly.com/api/v1/packages/?type=zone" \
-H "Authorization: Bearer YOUR_API_KEY"
curl -X GET "https://webtrackly.com/api/v1/packages/?type=technology&q=wordpress" \
-H "Authorization: Bearer YOUR_API_KEY"
curl -X GET "https://webtrackly.com/api/v1/packages/{slug}/" \
-H "Authorization: Bearer YOUR_API_KEY"
O mesmo em Python — liste os pacotes de tecnologia que correspondem a uma palavra-chave e depois inspecione um deles antes da compra:
import requests
API = "https://webtrackly.com/api/v1"
headers = {"Authorization": "Bearer YOUR_API_KEY"}
# 1. find technology packages matching a keyword
resp = requests.get(f"{API}/packages/",
params={"type": "technology", "q": "wordpress"},
headers=headers)
packages = resp.json()
for pkg in packages["results"]:
print(pkg["slug"], pkg["name"])
# 2. inspect a single package
slug = packages["results"][0]["slug"]
detail = requests.get(f"{API}/packages/{slug}/", headers=headers).json()
print(detail["slug"], detail.get("rows"), detail.get("price"))
A documentação dos endpoints fica em /api/. As cotas de chamadas seguem o plano: 30,000 por mês no Pro e 300,000 no Enterprise.
Erros comuns ao trabalhar com dados de domínios
-
Erro: esperar que o WHOIS identifique o dono
- O que dá errado: um fluxo de trabalho é desenhado em torno de extrair nomes de titulares para uma lista de domínios. Funciona com um punhado de registros antigos e depois desmorona.
- Por que falha: a maioria dos campos de titular de .com está ocultada, muitos nomes usam proxy e as consultas em massa esbarram em limites de requisições.
- A solução: construa sobre sinais de infraestrutura — name servers, plataforma de e-mail, IP de hospedagem e CMS detectado. Eles são observáveis, consistentes e disponíveis em massa.
-
Erro: tratar um arquivo de zona como uma lista de sites ativos
- O que dá errado: uma contagem de nomes delegados é apresentada como uma contagem de sites ativos.
- Por que falha: boa parte dos domínios delegados está estacionada, redirecionada ou registrada de forma defensiva, sem conteúdo algum.
- A solução: filtre pelas colunas de enriquecimento. Exigir um IP que resolva, um registro MX ou um CMS detectado reduz uma zona a algo bem mais próximo de sites em operação.
-
Erro: supor que um snapshot continua preciso
- O que dá errado: um arquivo baixado meses atrás é tratado como atual.
- Por que falha: domínios são registrados e abandonados continuamente, e migrações de plataforma ou de hospedagem acontecem o tempo todo.
- A solução: baixe de novo quando a atualidade importar. As exportações são geradas no momento da compra, então um novo download é um novo snapshot — e dois snapshots dão uma comparação.
-
Erro: carregar centenas de milhões de linhas na ferramenta errada
- O que dá errado: o CSV é aberto em uma planilha ou importado linha a linha para um banco transacional.
- Por que falha: planilhas estouram muito antes da escala do .com, e inserções linha a linha levam horas para agregações que um motor colunar responde em segundos.
- A solução: use processamento em fluxo na linha de comando para filtrar, e DuckDB ou ClickHouse para agregar. Ambos leem CSV nativamente.
-
Erro: ler a detecção de CMS como certeza
- O que dá errado: uma plataforma detectada é tratada como fato verificado sobre um negócio.
- Por que falha: a detecção é baseada em impressões digitais. Configurações headless, cache agressivo, CDNs e builds personalizados podem esconder ou imitar uma plataforma.
- A solução: trate a coluna de CMS como um forte sinal para segmentação e dimensionamento de mercado, e verifique caso a caso antes de agir sobre um registro isolado.
-
Erro: ignorar questões legais e éticas
- O que dá errado: adquirir e usar dados sem entender as regulações de privacidade (GDPR, CCPA) ou as políticas de uso aceitável. Isso pode gerar problemas jurídicos, dano à reputação e suspensão de contas.
- Por que falha: desconhecimento não é defesa. A privacidade de dados é uma preocupação séria no mundo todo, e as empresas respondem pela forma como coletam e usam dados pessoais.
- A solução: siga sempre as diretrizes legais. Os conjuntos de dados descritos aqui contêm dados de infraestrutura publicamente observáveis e nenhum contato pessoal, o que mantém os dados em si fora do alcance da maioria das regras sobre dados pessoais — mas o que você combinar com eles, e como agir a partir disso, continua sendo responsabilidade sua.
Perguntas frequentes (FAQ)
P: Consigo descobrir quem é o dono de um domínio .com específico com esses dados?
R: Não. A identidade do titular de .com está ocultada no WHOIS na grande maioria dos domínios, e não faz parte dos dados de zona nem de enriquecimento. O que os dados dizem é que um domínio existe, para onde está delegado, para onde resolve, qual plataforma de e-mail usa e qual CMS aparenta rodar.
P: O que exatamente eu recebo ao comprar um pacote?
R: O formato do download varia conforme o pacote e é informado na página do produto. A exportação é gerada no momento da compra, então reflete o estado atual do conjunto de dados, e não um arquivo pré-montado de idade desconhecida.
P: Os arquivos contêm dados de contato pessoais?
R: Não. Não há contatos pessoais de nenhum tipo nos dados. As colunas são domínio, data de registro quando o registro a publica, name servers, registros MX, IP e CMS detectado.
P: Qual parte do namespace .com está coberta?
R: O pacote da zona .com cobre 163,422,083 domínios. Somando todas as 716 zonas, o total é de 285,582,781 domínios, e o conjunto curado com todos os domínios registrados contém 272,614,863 linhas.
P: Existe uma interface para filtrar domínios por tecnologia?
R: Não há uma interface de filtragem interativa. O catálogo é organizado em pacotes prontos — arquivos por zona, conjuntos enriquecidos por zona, listas de sites por tecnologia e conjuntos de dados curados — e a filtragem acontece do seu lado, depois que o CSV é baixado.
P: O que a API faz?
R: Ela serve o catálogo: lista pacotes por tipo, permite buscá-los por palavra-chave e devolve os detalhes de um pacote individual. Os endpoints são GET /api/v1/packages/?type=zone, GET /api/v1/packages/?type=technology&q=wordpress e GET /api/v1/packages/{slug}/, autenticados com um cabeçalho Authorization: Bearer.
P: Quanto custam os planos?
R: Pacotes individuais podem ser comprados avulsos a partir de $3.50. O Pro custa $29/mês e inclui 50 pacotes, 10 conjuntos de dados e 30,000 chamadas de API. O Enterprise custa $99/mês e inclui 200 pacotes, 50 conjuntos de dados e 300,000 chamadas de API. Os detalhes estão na página de preços.
P: Por que algumas linhas não têm data de registro?
R: Porque nem todo registro publica datas de registro em um formato que possa ser compilado em massa. Quando o registro publica, o campo é preenchido; quando não publica, o campo fica vazio, em vez de estimado.
Conclusão
A pergunta "quem é o dono do .com" tem uma resposta institucional clara — a Verisign opera o registro, registradores credenciados vendem os nomes, titulares detêm direitos por tempo limitado — e uma resposta individual em grande parte fechada, porque a identidade do titular é ocultada por padrão. Trabalhar bem com dados de .com significa aceitar isso e deslocar a pergunta um passo para o lado: não quem está por trás de um domínio, mas o que existe e o que roda.
O formato do download varia conforme o pacote e é informado na página do produto. Comece pelo catálogo de pacotes ou pela lista de arquivos de zona.
Recursos relacionados
- Catálogo de pacotes — mais de 1,500 bases de domínios para download
- Arquivos de zona por TLD — .com, .net, .de e mais de 700 outros
- Conjuntos de dados curados — todos os domínios registrados, servidores MX, e-commerce
- Preços — compras avulsas a partir de $3.50