Поиск исчерпывающего списка одноразовых email-доменов почти всегда заканчивается устаревшими данными. Сервисы временной почты регистрируют домены пачками, постоянно их ротируют и так же быстро бросают, поэтому любой скачанный список начинает устаревать в момент своего создания. Если вам нужно выявлять или отсекать такие домены в промышленных масштабах, рабочее решение — не статический список, а свежий фид доменов плюс собственные правила фильтрации.
WebTrackly публикует данные о доменах в виде разовых выгрузок CSV: зональные файлы TLD, обогащённые наборы по каждой зоне с полями nameserver, MX, IP и CMS, списки сайтов по используемым технологиям и кураторские датасеты. По всем зонам каталог сейчас охватывает 279 944 703 домена, из них только зона .com — 163 422 083. Именно на этих базовых данных и работают эвристики поиска одноразовых доменов.
Нужны свежие данные о доменах, чтобы построить собственные фильтры? WebTrackly отдаёт готовые базы доменов: зональные файлы TLD, обогащённые зональные данные с полями MX и nameserver, списки по технологиям — CSV внутри ZIP, выгрузка формируется в момент покупки, без подписки.
Как устроен одноразовый email-домен
Выявление одноразовых email-доменов — это не только про узнаваемые имена вроде mailinator.com. Значение имеют как раз те провайдеры, о которых вы никогда не слышали, и они не ограничиваются зонами .com и .net. Дешёвые новые gTLD — .xyz, .top, .online — часто становятся домом для сервисов временной почты именно потому, что регистрация там стоит копейки и удобна для массовых закупок.
Типичные признаки
Основную работу делает небольшой набор сигналов. Короткие шаблонные имена («tempmail» плюс цифры), регистрация на один год, бесплатные или дефолтные DNS-серверы и записи MX, настроенные на приём всей почты по catch-all, — всё это характерные маркеры. Кластеры важнее отдельных доменов: сервисы временной почты обычно направляют десятки и сотни имён на один и тот же небольшой набор почтовых серверов и IP-адресов, поэтому группировка зонального файла по MX-хосту или IP выявляет их куда быстрее, чем поштучная проверка имён.
Поэтому обогащённые зональные данные полезнее голого перечня имён. Обогащённые пакеты WebTrackly по каждой зоне поставляются с полями NS, MX, IP и CMS рядом с доменом — можно сортировать и группировать ровно по тем атрибутам, которые вскрывают общую инфраструктуру.
Где брать свежие данные о доменах
Когда целевая выборка обновляется так быстро, свежесть важнее объёма. Список, собранный несколько месяцев назад, будет содержать домены, у которых MX-записи с тех пор исчезли совсем, и не будет содержать ничего из зарегистрированного позже. WebTrackly формирует каждый файл в момент покупки, а не отдаёт заранее собранный слепок, поэтому данные отражают текущее состояние зоны, а не момент последней пересборки архива поставщиком.
Зональные файлы против агрегированных данных
Для ccTLD зональные файлы получить крайне сложно. Многие реестры ccTLD вообще никогда не публикуют зональный файл — в отличие от gTLD, где доступ к зоне выдаётся через программы, предписанные ICANN. Эта асимметрия и есть главная причина, почему покрытие так сильно различается между TLD: для значительной части национальных зон агрегированные данные остаются единственным реальным вариантом. Каталог WebTrackly сейчас включает 716 зональных файлов TLD, столько же — 716 — соответствующих обогащённых наборов, 79 списков сайтов по технологиям и 27 кураторских датасетов: всего 1538 пакетов.
Чем плохи устаревшие списки
Сценарий отказа купленного «премиального» списка одноразовых доменов предсказуем: к моменту использования заметная доля записей уже не резолвится, лишилась MX-записей или ведёт на мёртвые почтовые серверы. Понять, какие записи протухли, без повторной валидации невозможно, а если вы всё равно валидируете заново, то продуктом перестаёт быть список — продуктом становится ваш пайплайн проверки.
Отсев шума
Фиды свежезарегистрированных доменов шумны по своей природе. Большая доля любого сырого фида — это припаркованные страницы, PPC-заглушки и недолговечные регистрации, которые так ничем и не станут. Без жёсткой фильтрации любые рассылки и аналитика поверх такого фида неэффективны по построению.
Подсказки от регистратора и nameserver
Самый действенный одиночный фильтр — по nameserver. NS-записи, указывающие на известные парковочные сервисы вроде Sedo или Bodis, — надёжный маркер домена без работающего сайта, а массовые регистрации через отдельных дешёвых регистраторов плотно кластеризуются вокруг тех же самых nameserver. Отбрасывание этих групп снимает существенную часть шума ещё до того, как вы потратитесь на дальнейшую обработку, и заодно ловит многие сервисы одноразовой почты — они пользуются теми же дешёвыми каналами массовой регистрации.
Проверка MX: лакмусовая бумажка доставляемости
Для холодных рассылок список доменов стоит ровно столько, сколько стоит его MX-проверка, а результаты проверки быстро стареют — перепроверяйте доставляемость на той же неделе, когда отправляете. Сама проверка обходится дёшево: запросить DNS-записи MX для каждого домена и убедиться, что они существуют и ведут на живой почтовый сервер. Поскольку данные MX входят в обогащённые зональные пакеты WebTrackly, первый проход можно сделать офлайн по CSV, а живые запросы оставить для короткого списка выживших.
Учтите, что и вполне легитимный на вид домен может не пройти эту проверку. Кривые настройки записей и заброшенные почтовые серверы встречаются достаточно часто, чтобы MX-проверка была обязательным финальным барьером в любом пайплайне, а не опциональным дополнением.
Почему это сложнее, чем кажется
Люди стабильно спотыкаются на двух вещах. Первая — охват TLD: логика детекта, написанная только под .com, .net, .org и .info, пропустит большую часть ландшафта одноразовой почты, который сместился в дешёвые новые gTLD. Вторая — что более грамотные сервисы временной почты целенаправленно мимикрируют под легитимные сайты: правдоподобные записи WHOIS, настоящая посадочная страница, нормально выглядящее имя. Поверхностного осмотра здесь не хватает. Отличительные улики почти всегда лежат на уровне MX и nameserver — и в том факте, что одна и та же инфраструктура обслуживает сразу множество доменов.
Практические выводы
- Свежесть важнее размера списка. Работайте с недавно выгруженными данными, а не с архивным дампом. Одноразовые домены ротируются достаточно быстро, чтобы старый список ошибался в обе стороны: мёртвые записи вы всё ещё блокируете, а живые пропускаете.
- Сначала фильтруйте по nameserver. Сгруппируйте зональные данные по NS-записи и уберите известные парковочные кластеры. Это самый дешёвый фильтр с высокой отдачей, и он не требует сетевых запросов, если поля NS уже есть в ваших данных.
- Группируйте по MX-хосту и IP. Сервисы одноразовой почты делят общую почтовую инфраструктуру. Сортировка зональной выгрузки по MX-хосту вскрывает целые семейства доменов, которые поштучный осмотр никогда бы не связал между собой.
- Запускайте MX-проверку непосредственно перед использованием. Валидируйте прямо перед отправкой, а не в момент получения данных. Всё, что старше недели, нужно перепроверять.
- Закрывайте дешёвые gTLD. Расширяйте детект за пределы легаси-зон. Если ваше покрытие зон заканчивается на .com и .net, там же заканчивается и ваша выявляемость.
Готовы строить фильтрацию на актуальных данных? WebTrackly предлагает 1538 пакетов для скачивания: 716 зональных файлов TLD, 716 обогащённых зональных наборов с полями NS, MX, IP и CMS, 79 списков сайтов по технологиям и 27 кураторских датасетов. Выберите пакет, оплатите от $3.50 и сразу скачайте CSV внутри ZIP.
FAQ
Продаёт ли WebTrackly список одноразовых email-доменов?
Нет. WebTrackly даёт исходные данные о доменах — зональные файлы TLD, обогащённые наборы по зонам с полями MX и nameserver, списки по технологиям и кураторские датасеты, — а не готовый размеченный список «одноразовых». Определение одноразовости зависит от задачи, поэтому практичнее применять собственные критерии фильтрации к свежим базовым данным.
С какого пакета начать?
Если нужны сырые имена доменов по зоне, берите зональный файл TLD. Если нужны поля MX и nameserver, чтобы выполнить описанную выше фильтрацию, берите обогащённый набор по той же зоне в разделе данных о доменах. Кросс-зональные коллекции, включая полный датасет всех доменов на 272 614 863 строки, лежат в разделе датасетов.
Насколько актуальны данные на момент скачивания?
Каждый файл формируется в момент покупки, а не отдаётся из заранее собранного архива, поэтому он отражает состояние зоны на момент вашей оплаты. Вы получаете CSV внутри ZIP, доступный для скачивания сразу после оплаты.
Почему MX-проверка так важна?
Домен может существовать, резолвиться — и при этом не иметь рабочей маршрутизации почты. Без проверки MX холодные рассылки копят жёсткие отказы по доменам, которые изначально не способны принимать письма, а это бьёт по репутации отправителя. Записи MX меняются без предупреждения, поэтому валидируйте на той же неделе, когда отправляете.