L'Inde administre l'un des plus vastes espaces de noms de domaine nationaux au monde, et le registre qui en a la charge publie un service WHOIS que chacun peut interroger. Ce que ce service révèle — et ce qu'il ne révèle plus — a considérablement évolué ces dernières années, et la plupart des guides le décrivent encore tel qu'il fonctionnait il y a dix ans. Cet article explique comment fonctionne réellement le WHOIS du registre .in aujourd'hui, quels champs survivent au masquage, pourquoi la collecte en masse via WHOIS est impraticable, et comment constituer à la place un jeu de données exploitable de domaines indiens à partir de fichiers de zone.
EN BREF / POINTS CLÉS
- NIXI exploite l'espace de noms .in : le National Internet Exchange of India administre .in et ses espaces de second niveau — .co.in, .net.in, .org.in, .firm.in, .gen.in, .ind.in — auxquels s'ajoute un ensemble de TLD internationalisés pour les écritures indiennes.
- WHOIS est un protocole domaine par domaine : une requête renvoie un enregistrement. L'accès est limité en débit, parfois protégé par CAPTCHA, et retourne du texte libre dont le format varie selon le registrar.
- Les champs du titulaire sont largement masqués : nom, e-mail, téléphone et adresse postale ne sont pas divulgués pour la majorité des domaines. Le Digital Personal Data Protection Act, 2023 indien renforce cette orientation plutôt qu'il ne l'inverse.
- Ce qui reste disponible de façon fiable : les dates de création, de mise à jour et d'expiration, le registrar, les codes de statut du domaine et les serveurs de noms.
- Les fichiers de zone répondent aux questions que WHOIS ne peut pas traiter : quels domaines existent, quels serveurs de noms et serveurs de messagerie ils utilisent, vers quelle adresse ils résolvent et quel CMS est détectable.
- WebTrackly distribue ces fichiers : 1,538 packages — 716 fichiers de zone TLD, 716 jeux de zone enrichis (NS, MX, IP, CMS), 79 listes de sites par technologie, 27 jeux de données curés — couvrant au total 285,582,781 domaines.
- Aucune donnée de contact : les packages ne contiennent que des attributs de domaine et d'infrastructure. Aucune adresse e-mail, aucun numéro de téléphone, aucune identité de titulaire.
SOMMAIRE
- Comment fonctionne le WHOIS du registre .in et ce qu'il renvoie aujourd'hui
- Cinq questions de recherche auxquelles les données de domaines .in répondent
- Ce que contient un fichier de données de zone
- Fichiers en masse ou requêtes WHOIS
- Travailler concrètement avec les données de domaines .in
- Erreurs courantes dans l'exploitation des données WHOIS .in
- FAQ : le WHOIS du registre .in
- Conclusion
- Ressources associées
Comment fonctionne le WHOIS du registre .in et ce qu'il renvoie aujourd'hui
L'espace de noms .in est administré par le National Internet Exchange of India (NIXI) à travers son activité de registre. Il couvre le second niveau ouvert (example.in) ainsi qu'un ensemble d'espaces de second niveau structurés, chacun avec une vocation propre : .co.in pour les entités commerciales, .net.in pour les opérateurs réseau, .org.in pour les organisations, et .firm.in, .gen.in, .ind.in pour des catégories plus étroites. NIXI administre également des ccTLD internationalisés pour les écritures indiennes : une vision complète de l'espace de domaines indien ne se limite donc pas à la chaîne ASCII « .in ».
Le registre publie un service WHOIS qui suit le modèle thin/thick habituel des ccTLD : l'enregistrement du registre porte les faits techniques faisant autorité, tandis que le registrar conserve les données de contact éventuellement collectées. Lorsque vous l'interrogez, vous pouvez compter sur la présence et l'exactitude d'un petit ensemble de champs : la date de création, la date de dernière mise à jour, la date d'expiration, le registrar gestionnaire, les codes de statut du domaine (clientTransferProhibited, pendingDelete, etc.) et les serveurs de noms délégués.
Ce sur quoi vous ne pouvez plus compter, c'est le bloc de contact. Depuis que le RGPD a redéfini les pratiques de divulgation des registres à l'échelle mondiale, le nom du titulaire, son organisation, son e-mail, son téléphone et son adresse postale sont masqués dans les réponses publiques pour la grande majorité des domaines, remplacés par une valeur générique ou une adresse relais gérée par le registrar. Le Digital Personal Data Protection Act, 2023 indien va dans le même sens : les données personnelles d'un titulaire restent des données personnelles, même lorsqu'elles figurent dans un enregistrement de domaine. Tout processus qui suppose que le WHOIS public livrera une personne à contacter repose sur une hypothèse qui n'est plus valable.
La seconde contrainte est mécanique. WHOIS répond pour un domaine par requête. Pour profiler 10,000 domaines, il faut 10,000 requêtes, et les registres brident précisément ce comportement : l'accès au port 43 est limité en débit par IP, et l'interface web ajoute un CAPTCHA. Le format des réponses varie selon le registrar, si bien qu'un analyseur qui fonctionne sur un enregistrement échoue sur le suivant. Rien dans ce protocole n'a été conçu pour une collecte à l'échelle d'une population, et aucun effort d'ingénierie ne changera cela.
D'où une répartition des rôles très simple. Utilisez WHOIS lorsque vous avez un domaine précis et que vous avez besoin de son statut d'enregistrement faisant autorité : c'est là qu'il excelle. Lorsque la question porte sur la population — combien de domaines existent, ce qu'ils font tourner, où ils résolvent, comment tout cela évolue —, la réponse vient des données de zone, distribuées sous forme de fichiers plutôt qu'interrogées enregistrement par enregistrement.
Besoin de la liste complète des domaines, pas d'une requête isolée ?
Parcourez le catalogue de fichiers de zone — 716 TLD avec le nombre de lignes publié avant l'achat.
Parcourir les zones → | Voir les tarifs →
Cinq questions de recherche auxquelles les données de domaines .in répondent
Les données de zone sont des données de population. Elles permettent de compter, de regrouper et de comparer dans le temps. Elles n'identifient pas les personnes, et aucun des cas d'usage ci-dessous ne repose sur une telle identification.
1. Mesurer l'adoption des CMS et des plateformes dans un espace de noms national
Les chiffres publiés sur les plateformes dominantes d'un pays donné sont généralement extrapolés à partir d'un échantillon des N sites les plus populaires, ce qui biaise fortement le résultat en faveur des grandes organisations. Un fichier de zone doté d'une colonne de détection CMS permet au contraire de compter directement sur un dénominateur connu. Sur l'ensemble du catalogue WebTrackly, WordPress est détecté sur 21,639,326 domaines et Joomla sur 567,680 ; le même calcul restreint à une seule zone donne la distribution propre à cette zone.
Indiquez systématiquement le dénominateur et le taux de détection. « X domaines couverts sur Y, dont Z % de lignes portant une valeur CMS » est une affirmation qui résiste à l'examen. Un pourcentage isolé, non.
2. Cartographier les fournisseurs DNS et d'hébergement
Les enregistrements de serveurs de noms constituent le signal fournisseur le plus fiable du jeu de données. Regrouper la colonne NS par suffixe montre quels opérateurs DNS — plateformes mondiales, hébergeurs régionaux, registrars individuels — portent la zone, et la distribution s'avère généralement bien plus concentrée qu'on ne l'imagine. Les IP résolues apportent un second angle, à interpréter toutefois avec prudence : un site derrière un CDN publie l'adresse du CDN, si bien que les parts calculées à partir des IP mesurent la périphérie plutôt que l'origine.
3. Analyser l'infrastructure de messagerie
Les enregistrements MX des jeux enrichis indiquent où un domaine achemine son courrier. Classez les noms d'hôtes MX selon les motifs propres à chaque fournisseur et vous obtenez, sur toute la zone, la répartition entre plateformes de messagerie hébergées, fournisseurs régionaux et serveurs auto-administrés. Comparer deux instantanés espacés de plusieurs mois révèle les migrations entre eux, ce qui constitue la véritable question derrière la plupart des débats sur « qui gagne dans l'e-mail ». Un enregistrement MX est une cible d'acheminement, pas une boîte aux lettres : ces fichiers ne contiennent aucune adresse.
4. Suivre la croissance et l'attrition
Le volume d'enregistrements est un indicateur indirect largement cité de l'activité numérique, et l'un des rares que vous pouvez mesurer vous-même plutôt que de le reprendre d'un communiqué de presse. Achetez le même package de zone à deux moments différents, comparez les colonnes de domaines, et vous obtenez les nouveaux enregistrements et les abandons sur la période, sans dépendre des statistiques publiées par qui que ce soit. Conservez et datez chaque fichier téléchargé : un instantané supprimé est une comparaison définitivement perdue.
5. Recherche en sécurité et sur la surface d'attaque
Une reconnaissance qui démarre par des requêtes WHOIS se heurte presque immédiatement aux limites de débit. Partir d'un fichier de zone lève ce plafond : filtrez localement le sous-ensemble qui vous intéresse — un CMS, un serveur de noms, une plage IP — et injectez cette liste dans vos propres outils de vérification. Le fichier fournit la population ; l'analyse reste la vôtre. Tout test actif doit rester dans le périmètre que vous êtes autorisé à tester, et une liste de domaines téléchargeable ne constitue pas une autorisation.
Ce que contient un fichier de données de zone
Le format de téléchargement dépend du package et figure sur la page produit. Les packages de fichiers de zone contiennent la liste des domaines. Les packages de zone enrichis y ajoutent les serveurs de noms, les enregistrements MX, les IP résolues et le CMS détecté, renseignés lorsqu'ils ont pu être déterminés et vides sinon.
| domain | ns | mx | ip | cms |
|---|---|---|---|---|
| exampleindia.co.in | ns1.hostinger.in | mx1.hostinger.in | 156.67.x.x | WordPress |
| techsolutions.in | ns-1234.awsdns-56.org | aspmx.l.google.com | 13.234.x.x | |
| mydelhi-store.in | ns1.cloudflare.com | 104.18.x.x | ||
| bengaluru-it.in | ns1.bluehost.in | mail.bengaluru-it.in | 162.241.x.x | Joomla |
| globalexports.in | ns1.vultr.com | mx.zoho.in | 139.84.x.x |
Le schéma s'arrête là. Il n'y a ni colonne titulaire, ni colonne organisation, ni colonne contact, parce que ces données sont masquées au niveau du registre et ne sont pas reconstituées ici. Les dates d'enregistrement n'apparaissent que lorsque la zone source les publie ; pour de nombreux ccTLD ce n'est pas le cas, et la colonne est alors absente plutôt qu'estimée.
Fichiers en masse ou requêtes WHOIS
| Critère | Requête WHOIS du registre .in | Packages de zone / enrichis en masse |
|---|---|---|
| Unité de travail | Un domaine par requête | Un fichier par zone |
| Répond à « quels domaines existent ? » | Non | Oui |
| Dates d'enregistrement et d'expiration | Oui, faisant autorité | Uniquement là où la zone source les publie |
| Codes de statut du domaine | Oui | Non |
| Serveurs de noms | Oui | Oui |
| MX, IP résolue, CMS détecté | Non | Oui, dans les jeux enrichis |
| Données de contact du titulaire | Masquées pour la plupart des domaines | Non incluses |
| Limitation de débit | Stricte, imposée par le registre | Aucune après téléchargement |
| Format de sortie | Texte libre, dépendant du registrar | Le format de téléchargement dépend du package et figure sur la page produit. |
| Coût | Gratuit à la requête, inutilisable en masse | À partir de $3.50 par package |
Les deux approches sont complémentaires. WHOIS reste la référence sur le statut d'un domaine que vous avez déjà identifié. Les fichiers en masse sont ce qui vous permet d'identifier la population en premier lieu.
Travailler concrètement avec les données de domaines .in
Il n'y a ni interface de recherche, ni filtrage côté serveur. Vous choisissez un package, vous l'achetez, vous téléchargez le ZIP et vous menez l'analyse sur votre propre machine.
Étape 1 — Trouver le package. /zones/ liste les 716 fichiers de zone TLD et leurs équivalents enrichis, avec le nombre de lignes affiché avant l'achat pour que vous en connaissiez la taille. /datasets/ regroupe les 27 collections curées inter-zones, la plus volumineuse étant celle de tous les domaines enregistrés, avec 272,614,863 lignes. /packages/ constitue le catalogue complet, listes de sites par technologie comprises (79 au total).
Étape 2 — Acheter et télécharger. Les packages démarrent à $3.50 et se téléchargent immédiatement ; le fichier est exporté à neuf au moment de l'achat plutôt que servi depuis une ancienne version. Pour un usage récurrent, l'offre Pro est à $29/mois (50 packages, 10 jeux de données, 30,000 appels API) et l'offre Enterprise à $99/mois (200 packages, 50 jeux de données, 300,000 appels API). Voir /pricing/.
Étape 3 — Décompresser et inspecter.
unzip in-enriched.zip
head -3 in-enriched.csv
wc -l in-enriched.csv
Étape 4 — Premiers découpages en ligne de commande.
# second-level space breakdown
grep -oE '\.(co|net|org|firm|gen|ind)\.in$' in-enriched.csv | sort | uniq -c | sort -rn
# rows where the detected CMS is WordPress
awk -F',' '$5 == "WordPress"' in-enriched.csv > in-wordpress.csv
# top name servers
cut -d',' -f2 in-enriched.csv | sort | uniq -c | sort -rn | head -20
Étape 5 — Analyse dans un moteur en colonnes. DuckDB lit le CSV directement, sans étape d'import :
-- mail provider distribution
SELECT
CASE
WHEN mx ILIKE '%google%' THEN 'Google'
WHEN mx ILIKE '%outlook%' THEN 'Microsoft'
WHEN mx ILIKE '%zoho%' THEN 'Zoho'
WHEN mx IS NULL OR mx = '' THEN 'none'
ELSE 'other'
END AS provider,
count(*) AS domains
FROM read_csv_auto('in-enriched.csv')
GROUP BY provider ORDER BY domains DESC;
-- new domains between two snapshots
SELECT n.domain
FROM read_csv_auto('in-2026-07.csv') n
LEFT JOIN read_csv_auto('in-2026-04.csv') o USING (domain)
WHERE o.domain IS NULL;
Étape 6 — Automatiser l'accès au catalogue via l'API. L'API expose le catalogue de packages, pas une recherche de domaine. L'authentification se fait par bearer token.
# list zone-file packages
curl -H "Authorization: Bearer YOUR_API_KEY" \
"https://webtrackly.com/api/v1/packages/?type=zone"
# technology packages matching a keyword
curl -H "Authorization: Bearer YOUR_API_KEY" \
"https://webtrackly.com/api/v1/packages/?type=technology&q=wordpress"
# details for a single package
curl -H "Authorization: Bearer YOUR_API_KEY" \
"https://webtrackly.com/api/v1/packages/in-zone/"
La référence des endpoints se trouve sur /api/. Une automatisation classique liste les packages que vous suivez, vérifie l'existence d'une version plus récente, la télécharge et la charge dans l'entrepôt de données à côté de l'instantané précédent.
Erreurs courantes dans l'exploitation des données WHOIS .in
-
Traiter WHOIS comme une source de masse.
- Ce qui déraille : les limites de débit et les CAPTCHA bloquent le traitement au bout de quelques milliers de requêtes, et il ne vous reste qu'une couverture partielle, incapable d'étayer un pourcentage.
- La solution : tirez la population d'un fichier de zone et réservez les requêtes au petit sous-ensemble pour lequel un statut faisant autorité, domaine par domaine, importe réellement.
-
Attendre les coordonnées du titulaire.
- Ce qui déraille : tout un pipeline est bâti autour d'une colonne de contact masquée à la source, qui n'arrivera jamais.
- La solution : concevez votre traitement autour de ce que l'enregistrement contient réellement — dates, registrar, statut, serveurs de noms — et traitez l'acquisition de contacts comme un problème distinct, avec sa propre base légale au titre du DPDP Act et du RGPD.
-
Ignorer la structure de second niveau de .in.
- Ce qui déraille : ne compter que
*.inet laisser de côté.co.in,.net.in,.org.inet les autres sous-estime l'espace de noms, parfois nettement. - La solution : énumérez explicitement les espaces de second niveau et présentez-les séparément ; ils attirent des profils de titulaires différents et évoluent différemment dans le temps.
- Ce qui déraille : ne compter que
-
Oublier les TLD internationalisés.
- Ce qui déraille : une analyse censée couvrir « l'espace de domaines indien » exclut silencieusement les ccTLD en écritures locales administrés par NIXI.
- La solution : énoncez votre périmètre avec précision. Si vous n'avez mesuré que l'arborescence .in en ASCII, dites-le au lieu de généraliser au pays entier.
-
Lire une date de création comme la date de fondation d'une entreprise.
- Ce qui déraille : un domaine enregistré en 2019 est présenté comme une entreprise fondée en 2019, alors qu'il peut s'agir d'un changement de marque, d'un enregistrement défensif ou d'un transfert ayant réinitialisé la date.
- La solution : considérez la date de création comme l'ancienneté de l'enregistrement et recoupez vos sources avant d'affirmer quoi que ce soit sur l'organisation.
-
Travailler à partir d'un seul instantané.
- Ce qui déraille : vous pouvez décrire l'état actuel mais pas la tendance, qui est pourtant la question réellement posée.
- La solution : archivez et datez chaque téléchargement. Croissance, attrition et migration de fournisseurs exigent toutes deux observations.
-
Surinterpréter la détection de CMS.
- Ce qui déraille : une part de marché d'apparence précise s'effondre dès que quelqu'un utilisant une autre méthode de détection la conteste.
- La solution : un champ CMS vide signifie « non détecté », pas « pas de CMS ». Publiez le taux de détection avec chaque part de marché et présentez vos chiffres comme des installations détectées.
FAQ : le WHOIS du registre .in
Q : Qu'est-ce que le WHOIS du registre .in ?
R : la base publique des enregistrements de l'espace de noms .in, exploitée par NIXI. Une requête renvoie l'enregistrement d'un seul domaine : dates de création, de mise à jour et d'expiration, registrar gestionnaire, codes de statut du domaine et serveurs de noms délégués. Les champs de contact sont masqués pour la plupart des domaines.
Q : Pourquoi les informations sur le titulaire sont-elles masquées ?
R : les pratiques de divulgation des registres ont changé partout après le RGPD, et les données personnelles présentes dans les enregistrements sont désormais retirées des réponses publiques par défaut. Le Digital Personal Data Protection Act, 2023 indien va dans le même sens. Leur divulgation exige en général une base légale documentée, soumise au registrar.
Q : Puis-je interroger le WHOIS .in en masse ?
R : pas en pratique. L'accès au port 43 est limité en débit par IP et l'interface web est protégée par CAPTCHA. Le protocole est conçu pour des requêtes ponctuelles, domaine par domaine.
Q : WebTrackly effectue-t-il des requêtes WHOIS à ma place ?
R : non. WebTrackly distribue des fichiers en masse déjà préparés. Le format de téléchargement dépend du package et figure sur la page produit. Il n'y a ni service de recherche, ni endpoint de requête par domaine.
Q : Que contient un package ?
R : les packages de fichiers de zone contiennent la liste des domaines d'un TLD. Les packages de zone enrichis y ajoutent les serveurs de noms, les enregistrements MX, les IP résolues et le CMS détecté lorsqu'il est déterminable. Les packages technologiques listent les sites sur lesquels un CMS ou une technologie donnée a été détectée. Les jeux de données curés sont des compilations inter-zones.
Q : Les adresses e-mail ou les numéros de téléphone sont-ils inclus ?
R : non. Les fichiers ne contiennent que des attributs de domaine et d'infrastructure, sans aucune coordonnée personnelle ou d'entreprise.
Q : Quelle est la taille du catalogue ?
R : 1,538 packages : 716 fichiers de zone, 716 jeux de zone enrichis, 79 listes de sites par technologie et 27 jeux de données curés, couvrant 285,582,781 domaines sur l'ensemble des packages de zone. Le jeu de données de tous les domaines enregistrés compte 272,614,863 lignes.
Q : À quel point les données sont-elles à jour ?
R : chaque package est exporté au moment de l'achat, vous obtenez donc la version courante. Pour suivre l'évolution, rachetez le même package plus tard et comparez les deux fichiers.
Q : À quoi sert l'API ?
R : elle expose le catalogue. GET /api/v1/packages/?type=zone liste les packages de zone, ?type=technology&q=wordpress filtre les packages technologiques, et /api/v1/packages/{slug}/ renvoie le détail d'un package. Authentification par bearer token. Elle n'accepte pas un nom de domaine pour en retourner les caractéristiques.
Q : Combien cela coûte-t-il ?
R : les packages individuels à partir de $3.50, en achat unique. L'offre Pro est à $29/mois (50 packages, 10 jeux de données, 30,000 appels API) ; l'offre Enterprise à $99/mois (200 packages, 50 jeux de données, 300,000 appels API). Voir /pricing/.
Conclusion
Le WHOIS du registre .in est une source fiable pour les faits d'enregistrement d'un domaine que vous avez déjà en main : sa date de création, son registrar gestionnaire, son statut, la délégation DNS. Ce n'est pas un outil de découverte, ni une base de contacts, et aucun script ne lui fera jouer l'un ou l'autre de ces rôles.
Les questions à l'échelle de la population sur l'espace de domaines indien — combien de domaines, sur quelles plateformes, derrière quels fournisseurs DNS et de messagerie, en croissance ou en recul — trouvent leur réponse dans des fichiers de zone que vous téléchargez et analysez localement. Le schéma est volontairement restreint : domaine, serveurs de noms, MX, IP résolue, CMS détecté, et dates d'enregistrement uniquement là où la source les publie. Connaître cette limite à l'avance, c'est ce qui évite à un projet d'échouer à la dernière étape.
Parcourir le catalogue de fichiers de zone →
Ressources associées
- Catalogue de packages — 1,538 bases de données de domaines téléchargeables
- Fichiers de zone par TLD — .com, .net, .de et plus de 700 autres
- Jeux de données curés — tous les domaines enregistrés, serveurs MX, e-commerce
- Documentation de l'API — accès au catalogue avec un bearer token
- Tarifs — achats uniques à partir de $3.50