Боты4 мин чтения·9 августа 2026 г.

Три разных «Storm»: почему нельзя банить по половине названия

StormIntelCrawler — не единственный бот со словом Storm в имени. Разбираем, как минимум три несвязанные сущности прячутся за похожими названиями, и почему регулярка-wildcard здесь опасна.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота StormIntelCrawler: нежелательный прочие краулеры и сервисы

StormIntelCrawler в логах TrafficVeil — краулер с этим идентификатором в User-Agent. Устойчивой официальной страницы политики, IP-листа и заявленной пользы для сайта обычно нет.

Не путать с Apache StormCrawler (и это не единственная путаница)

  StormIntelCrawler Apache StormCrawler
Что это Конкретный UA в трафике Open-source фреймворк для своих краулеров
Оператор Не подтверждён публично Любой, кто развернул framework
UA StormIntelCrawler … Задаётся в конфиге (http.agent.name и др.)

Совпадение слова «Storm» ≠ один продукт — и это не преувеличение ради красного словца. У Apache StormCrawler строка User-Agent полностью настраивается разработчиком: имя, версия, описание, ссылка на политику — всё указывается вручную при развёртывании, поэтому под одним и тем же фреймворком в логах разных сайтов могут встречаться совершенно разные, никак не связанные между собой строки UA. При этом в открытых каталогах ботов встречается и третий, отдельный игрок — генерик-скрапер с названием просто «StormCrawler» (без «Intel»), который трекеры связывают с иной компанией. Итого — минимум три разных сущности со словом «Storm» в имени, ни одна из которых не гарантирует связь с двумя другими.

Параметры

Параметр Значение
Токен StormIntelCrawler
Оператор / docs ❌ Нет устойчивых публичных источников
IP-лист ❌ Нет
robots.txt Не гарантировано

Почему такое имя вообще могло появиться

Название «StormIntelCrawler» намекает на разведывательную (intel) функцию — сбор данных для аналитики, мониторинга угроз или конкурентной разведки. Это не подтверждённый факт, а лишь наблюдение по структуре имени: подобные составные названия («X-Intel-Crawler», «Y-Intelligence-Bot») часто используют внутренние или узкоспециализированные инструменты компаний, которые никогда не публиковали материалы для вебмастеров, потому что не рассчитывали на массовое присутствие в чужих логах.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Нагрузка

По сводке TrafficVeil паттерн stormintelcrawler — порядка 10 тысяч запросов (март–июнь 2026, июнь по 14.06). Объём умеренный; при отсутствии подтверждённого оператора стоит зафиксировать эту цифру как отправную точку для последующих сравнений.

Контроль

grep -i "StormIntelCrawler" /var/log/nginx/access.log
User-agent: StormIntelCrawler
Disallow: /
if ($http_user_agent ~* "StormIntelCrawler") {
    return 403;
}

Как не задеть посторонних при настройке правил

  • Используйте точное совпадение строки StormIntelCrawler, а не общий паттерн со словом «Storm» — иначе рискуете заблокировать легитимные инстансы Apache StormCrawler с корректно настроенным agent.name у совершенно других операторов
  • Если в правилах antibot уже есть запись про StormCrawler (без «Intel»), проверьте, что это не смешивается с текущей записью — по факту это разные строки и разные, не связанные друг с другом источники
  • При сомнениях сверяйте логи построчно, а не полагайтесь на регулярку с wildcard посередине слова

Рекомендации

  • Нет доказанной пользы — deny в TrafficVeil
  • На позиции в Google не влияет
  • Не баньте все UA со словом «Storm» — можно случайно задеть легитимные инстансы StormCrawler с нормальным agent.name, развёрнутые совершенно другими операторами

Частые вопросы

Сколько разных сущностей скрывается за словом «Storm» в User-Agent?
Минимум три: сам токен StormIntelCrawler, open-source фреймворк Apache StormCrawler и отдельный генерик-скрапер под названием StormCrawler без «Intel».
Можно ли считать все Storm-боты одним оператором?
Нет, это разные, никак не связанные друг с другом инструменты — совпадение части названия не доказывает общее происхождение.
Почему у Apache StormCrawler такие разные строки UA на разных сайтах?
Потому что имя, версия и описание задаются вручную при развёртывании фреймворка каждым конкретным оператором, а не фиксированы производителем.
Как правильно настроить правило блокировки, чтобы не задеть чужие StormCrawler-инстансы?
Использовать точное совпадение строки StormIntelCrawler, а не общий wildcard-паттерн со словом «Storm» посередине.
О чём может говорить слово «Intel» в названии StormIntelCrawler?
Предположительно, о разведывательной или аналитической функции сбора данных, но это лишь наблюдение по структуре имени, а не подтверждённый факт.
Стоит ли блокировать StormIntelCrawler по умолчанию?
Да, поскольку доказанной пользы для сайта нет, а на позиции в Google это никак не влияет.
#StormIntelCrawler#StormCrawler#неопознанные боты#robots.txt#TrafficVeil#верификация трафика
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil