Боты4 мин чтения·10 августа 2026 г.·обновлено 8 сентября 2026 г.

Statdom.ru/Bot честно предупреждает: robots.txt его не остановит

Оператор сам заявляет на официальной странице, что ограничить этого робота через robots.txt невозможно — прямая противоположность обычной практике. Разбираем, что это значит для настройки блокировки.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота Statdom Bot: нежелательный бот

statdom.ru/Bot — семейство роботов проекта «Домены России» (АО «Технический центр Интернета»). Собирают статистику о сайтах и веб-технологиях (CMS, сервер, скрипты, TLS) для аналитики доменных зон РФ. Не Googlebot. Проект «Домены России» — совместная инициатива Координационного центра национального домена сети Интернет (официального администратора зон .ru и .рф) и АО «Технический центр Интернет». Собранная статистика по национальным доменным зонам .ru, .su, .рф обновляется ежедневно и используется для анализа состояния и развития российского доменного пространства.

Параметры

Параметр Значение
UA Mozilla/5.0 (compatible; statdom.ru/Bot; +https://statdom.ru/bot.html)
Оператор ТЦИ / проект «Домены России»
Docs statdom.ru/bot.html
Назначение Статистика инфраструктуры сайтов для аналитики доменных зон РФ
robots.txt По прямому заявлению оператора на официальной странице бота — ограничение доступа через robots.txt и подобные файлы «не представляется возможным». Это не догадка, а формулировка самого проекта
Запросы GET: robots.txt, /, ссылки с главной; HTTP/HTTPS

Главное расхождение с типичной практикой: robots.txt здесь не работает по признанию самого оператора

Большинство крупных легитимных краулеров прямо заявляют о соблюдении robots.txt как о стандарте вежливого поведения. Проект «Домены России» поступает иначе — и честно предупреждает об этом на своей же странице: технически ограничить доступ отдельных роботов семейства statdom.ru через robots.txt или подобные механизмы не получится. Это не означает злонамеренность — скорее, специфику задачи: сервис собирает статистику по всему национальному доменному пространству, и точечные исключения плохо сочетаются с целью построить полную картину инфраструктуры зон .ru/.su/.рф. Практическое следствие: если решаете ограничить обход этого бота, сразу переходите к серверному уровню (nginx/Apache/TrafficVeil) — попытки полагаться на robots.txt здесь заведомо не дадут результата, в отличие от многих других легитимных краулеров.

Нагрузка

По сводке TrafficVeil — порядка 37 тысяч запросов. Задача бота — собрать технический профиль сайта (CMS, сервер, скрипты, TLS), а не вычитать весь контент, поэтому такой объём выглядит соразмерным точечной технической проверке, а не массовому обходу.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Контроль

grep -i "statdom" /var/log/nginx/access.log
# Формально можно прописать, но по заявлению оператора это не даёт гарантии
User-agent: statdom.ru/Bot
Crawl-delay: 10

User-agent: statdom.ru/Bot
Disallow: /

Для реального эффекта используйте блокировку на уровне сервера, а не только правку robots.txt.

Рекомендации

  • Нейтральная статистика по российскому доменному пространству — часто оставляют разрешённой, поскольку данные идут в открытую аналитику официального администратора зон .ru/.рф, а не коммерческому третьему лицу
  • Не хотите участвовать — учитывая прямое заявление оператора о неэффективности robots.txt, для гарантированного результата нужен deny на уровне сервера, а не только Disallow
  • На Google не влияет — это отдельная от поисковой индексации инфраструктура

Частые вопросы

Правда ли, что robots.txt не работает для statdom.ru/Bot?
Да, это прямое заявление самого оператора на официальной странице бота, а не предположение.
Кто стоит за проектом «Домены России»?
Совместная инициатива Координационного центра национального домена сети Интернет и АО «Технический центр Интернет».
Какие данные собирает statdom.ru/Bot?
Техническую статистику о сайтах: CMS, тип сервера, скрипты, TLS — для аналитики доменных зон .ru, .su, .рф.
Как тогда реально ограничить обход этого бота?
Только на уровне сервера — nginx, Apache или TrafficVeil, поскольку robots.txt здесь не имеет эффекта по признанию оператора.
Влияет ли этот бот на позиции сайта в Google?
Нет, это отдельная от поисковой индексации инфраструктура.
Стоит ли вообще блокировать эту статистику?
Многие сайты оставляют её разрешённой, поскольку данные идут в открытую аналитику официального администратора национальных доменных зон, а не коммерческому третьему лицу.
#statdom.ru#Домены России#ТЦИ#национальные домены#robots.txt#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil