Имя EpivozCrawler звучит достаточно узнаваемо, чтобы соблазниться быстрым выводом — например, связать его с калифорнийской компанией Epivoz Corporation из Сан-Франциско, которая существует уже около двадцати лет. Но при ближайшем рассмотрении это, скорее всего, ложный след: по открытым бизнес-данным, Epivoz Corporation — крошечная организация с примерно двумя сотрудниками в сфере персональных услуг, а не технологическая компания, работающая с веб-краулингом или данными. Совпадение звучного имени с реальной, но совершенно не связанной по профилю деятельности компанией — ловушка, в которую легко попасть при поверхностном поиске, и хороший повод лишний раз не выдавать любое похожее по звучанию совпадение за подтверждённый факт.
Что можно сказать достоверно
После вычета этого ложного следа достоверной информации об операторе, назначении или официальной документации EpivozCrawler в открытых источниках не остаётся. Это тот случай, когда единственный честный подход — прямо признать пробел, а не заполнять его правдоподобной, но недоказанной версией. Единственное, что можно утверждать с уверенностью, опираясь на структуру самого запроса: бот выполняет сервисный автоматический обход URL по расписанию или очереди задач чужой системы, о чём говорит сама повторяемость и регулярность паттерна в логах, а не что-либо специфичное для конкретного бренда.
Параметры бота
| Параметр | Значение |
| User-Agent / паттерн | epivozcrawler |
| Оператор | Не установлен — совпадение с California-компанией Epivoz Corporation, вероятнее всего, случайное и не подтверждается профилем её деятельности |
| Официальная документация | ❌ Не найдена |
| Список IP-адресов | ❌ Отсутствует |
| Категория TrafficVeil | Прочие краулеры и сервисы — нежелательный |
Урок методологии, который стоит держать в голове при разборе подобных ботов
Расследование этого бота — хороший пример того, почему поиск «кто стоит за именем» нельзя останавливать на первом же совпадающем по звучанию результате. Существование реальной компании с похожим названием — не доказательство, а лишь повод для дальнейшей проверки: если профиль её деятельности (в данном случае — персональные услуги с парой сотрудников) никак не соотносится с ролью оператора веб-краулера, разумнее отбросить эту версию, чем зафиксировать её как факт. Та же логика применима к любому боту с интригующе узнаваемым именем — совпадение написания не заменяет подтверждения через официальный сайт, документацию или профильный каталог ботов.
Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.
Как оценивать бота при отсутствии подтверждённого оператора
При полном отсутствии официальных данных разумно опираться на четыре поведенческих признака одновременно:
- Глубина обхода — точечные запросы к нескольким URL или системный проход по всей пагинации и каталогу;
- Повторяемость — вычитывает ли бот один и тот же набор адресов регулярно (похоже на мониторинг) или каждый раз новые (похоже на массовый сбор);
- Сессионные признаки — отсутствие cookie и нормальной сессии, характерное для автоматизированных клиентов;
- Принадлежность IP — датацентр общего назначения с большей вероятностью говорит о стороннем скрапере, чем о специализированной инфраструктуре именованного сервиса.
Как найти бота в логах
# Базовый поиск
grep -i "epivozcrawler" /var/log/nginx/access.log
# Топ URL, которые вычитывает бот
grep -i "epivozcrawler" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head
# Топ IP за этим UA
grep -i "epivozcrawler" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head
Для проверки принадлежности IP при отсутствии официального фида — стандартная связка whois/rDNS:
IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"
Как заблокировать
При отсутствии подтверждённой пользы для сайта — запрет по умолчанию:
User-agent: epivozcrawler
Disallow: /
if ($http_user_agent ~* "epivozcrawler") {
return 403;
}
Если требуется не полная блокировка, а контроль частоты — например, чтобы понаблюдать за поведением бота дольше, прежде чем принимать окончательное решение:
limit_req_zone $binary_remote_addr zone=epivozcrawler:10m rate=10r/m;
location / {
if ($http_user_agent ~* "epivozcrawler") {
limit_req zone=epivozcrawler burst=20 nodelay;
}
}
На позиции в поисковой выдаче Google, Bing или Яндекса присутствие или отсутствие EpivozCrawler не влияет. При отсутствии официальной документации и подтверждённой пользы для владельца сайта запрет по умолчанию остаётся оправданной низкорисковой позицией.
Частые вопросы
EpivozCrawler принадлежит компании Epivoz Corporation?
Почему нельзя доверять совпадению названий?
Как оценивать бота, если официальной документации нет?
Стоит ли доверять строке User-Agent при принятии решения?
Что делать при отсутствии подтверждённой пользы от бота?
Повлияет ли блокировка на позиции в поисковых системах?
Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.