crawler_eb (часто встречается как crawler_eb_germany_2.0) — непрозрачный краулер без публичной политики оператора. В базах ботов значится как generic crawler / unknown.
Осторожно с готовыми описаниями из каталогов
Если искать этот токен в общедоступных базах ботов, можно наткнуться на шаблонное описание вроде «краулер обычно используется для индексации и сбора данных, применяется поисковиками, аналитическими или маркетинговыми компаниями». Важно понимать: это универсальная заготовка, которую тот же каталог применяет практически без изменений к десяткам других неопознанных токенов — не специфический факт именно про crawler_eb, а общая формулировка «на всякий случай». Не принимайте такое описание за подтверждённую информацию об операторе.
Параметры
| Параметр | Значение |
|---|---|
| UA | crawler_eb_germany_2.0 / токен crawler_eb |
| Оператор / IP feed | ❌ Нет устойчивых официальных источников |
Что может подсказать сама структура токена
Присутствие слова «germany» в полной строке иногда трактуют как географическую привязку оператора или целевого региона обхода — но это лишь предположение по структуре имени, не подтверждённый факт. Версионирование («2.0») предполагает, что у токена есть история изменений, то есть это не разовый скрипт, а поддерживаемый (хотя бы формально) инструмент — тоже не более чем наблюдение, а не доказанное происхождение.
Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.
Нагрузка
По сводке TrafficVeil — порядка 4 тысяч запросов.
Контроль
grep -i "crawler_eb" /var/log/nginx/access.log
if ($http_user_agent ~* "crawler_eb") {
return 403;
}
Что ещё стоит проверить
- Посмотрите разброс IP — единичный источник говорит о конкретном скрипте, множество разных сетей — о более широкой, потенциально арендованной инфраструктуре
- Сверьте, какие разделы сайта интересуют бота — концентрация на определённом типе страниц (например, с ценами или контактами) может подсказать назначение точнее, чем любое стороннее описание
Рекомендации
- Нет пользы — deny, стандартный подход при отсутствии подтверждённого оператора
- На Google не влияет
- AhrefsBot: полное руководство
- Googlebot: полное руководство
- Googlebot-Image
- Googlebot-News
- Googlebot-Video
- Google AdsBot
- Storebot-Google
- Mediapartners-Google (AdSense)
- Feedfetcher-Google
- APIs-Google
- Google-Read-Aloud
- Google-Site-Verification и InspectionTool
- Bingbot (MSN Bot)
- YandexBot
- YandexMetrika
- Yandex Userproxy
- MJ12bot
- SemrushBot
- Amazonbot
- DotBot
- FacebookBot
- Amazon SearchBot
- Yandex Direct Fetcher
- Anthropic AI
- Cohere AI
- llmstxtscan
- HetrixTools
- ArchiveTeam ArchiveBot
- HeadlessChrome
- EECS498
- IntelX
- statdom.ru
- Website-info.net-Robot
Частые вопросы
Можно ли доверять описанию crawler_eb из каталогов ботов?
О чём может говорить слово «germany» в полной строке UA?
Что означает версия «2.0» в названии токена?
Как оценить назначение бота при отсутствии официальных данных?
Стоит ли блокировать crawler_eb при отсутствии подтверждённой пользы?
Влияет ли блокировка crawler_eb на позиции в Google?
Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.