Боты5 мин чтения·7 августа 2026 г.

HubSpot Crawler: скорее всего это работает ваш же маркетолог

HubSpot Crawler появляется в логах, когда кто-то использует продукты HubSpot против вашего домена — часто это ваша же команда. Разбираем семейство ботов HubSpot и как настроить каждый по отдельности.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота HubSpot Crawler: нежелательный прочие краулеры и сервисы

HubSpot Crawler — краулер экосистемы HubSpot: обходит внешние URL для SEO-инструментов, импорта контента и связанных проверок. Это не поисковый Googlebot и не универсальный «маркетинг-скрапер мира» — трафик появляется, когда кто-то использует продукты HubSpot против вашего домена (или своих страниц). По классификации Cloudflare Radar, боты HubSpot относятся к типу с «intermediary»-доступом: ими управляет не только сама компания, а конечные пользователи — маркетологи или агентства, настроившие конкретный инструмент HubSpot. Практически это значит: если бот появился в логах, велика вероятность, что кто-то из вашей же команды (или клиент, работающий с доменом через HubSpot) сам инициировал эту активность.

Параметры

Параметр Значение
Типичный UA Mozilla/5.0 (compatible; HubSpot Crawler; web-crawlers@hubspot.com)
Варианты HubSpot Crawler, +https://www.hubspot.com, HubSpot Single Page link check (web-crawlers+links@hubspot.com), HubSpot Connect 2.0
Оператор HubSpot, Inc.
Контакт в UA web-crawlers@hubspot.com
Родственник HubSpotContentSearchBot — поиск по сайту внутри HubSpot CMS, настраивается отдельным правилом в robots.txt
robots.txt Подтверждённо соблюдается — краулер поддерживает стандарт исключения роботов
IP-лист ❌ Компактного публичного feed обычно нет; в полевых наблюдениях запросы фиксировались с адресов из блока Amazon/AWS

Семейство ботов HubSpot: не только Crawler

Помимо основного HubSpot Crawler, в логах может встречаться ещё несколько родственных UA:

  • HubSpotContentSearchBot — отдельный бот именно для функции поиска по сайту внутри HubSpot CMS; если у вас используется этот модуль, для него нужно отдельное правило Allow в robots.txt, иначе поиск на сайте перестанет работать корректно
  • HubSpot Single Page link check (контакт web-crawlers+links@hubspot.com) — проверяет отдельные ссылки, например при валидации URL в письмах или лендингах
  • HubSpot Connect 2.0 — обобщённое имя для линейки интеграционных задач: проверка домена, сканирование на malware, работа файлового менеджера контента

Каждый из этих UA решает свою задачу, и это стоит учитывать при настройке правил — блокировка одного не обязательно затронет остальные.

Нагрузка

По сводке TrafficVeil паттерн HubSpot crawler — порядка 12 тысяч запросов (март–июнь 2026, июнь по 14.06). Объём умеренный и типичный для инструмента, работающего по запросу пользователей HubSpot, а не по расписанию массового обхода.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Контроль

grep -i "HubSpot" /var/log/nginx/access.log
User-agent: HubSpot Crawler
Disallow: /
if ($http_user_agent ~* "HubSpot Crawler|HubSpot Links") {
    return 403;
}

Верификация

Строку UA легко подделать, поэтому для большей уверенности сверяйте источник запроса с опубликованными диапазонами оператора, где это возможно — принадлежность IP подделать сложнее, чем текст заголовка. Официального компактного списка HubSpot не публикует, но исторически запросы фиксировались с адресов из блока Amazon/AWS — используйте это как дополнительный, а не единственный ориентир.

IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"

Рекомендации

  • Ваши маркетологи живут в HubSpot и аудитят сайт — Allow
  • Используете модуль site search HubSpot CMS — не забудьте отдельное правило Allow для HubSpotContentSearchBot, иначе сломается поиск по сайту
  • Чужой SEO-crawl HubSpot не нужен — Disallow + deny, соблюдение robots.txt подтверждено, поэтому директива сработает надёжно
  • Не путать с блокировкой всего HubSpot tracking — это другие UA и скрипты, отвечающие за аналитику на самом сайте, а не за краулинг
  • На Google ranking блокировка не влияет

Частые вопросы

Почему трафик от HubSpot Crawler часто оказывается «своим»?
Потому что по классификации доступа этот бот управляется конечными пользователями HubSpot, а не только самой компанией — то есть кто-то из вашей команды или клиентов мог сам инициировать эту активность.
Сколько всего разных ботов у HubSpot?
Помимо основного Crawler есть минимум HubSpotContentSearchBot, HubSpot Single Page link check и семейство HubSpot Connect 2.0 — у каждого своя задача.
Что будет, если заблокировать HubSpot Crawler, а на сайте используется поиск HubSpot CMS?
Ничего страшного, если правильно настроить: для HubSpotContentSearchBot нужно отдельное правило Allow в robots.txt, иначе сломается поиск по сайту.
Соблюдает ли HubSpot Crawler правила robots.txt?
Да, подтверждённо поддерживает стандарт исключения роботов, поэтому Disallow сработает надёжно.
Публикует ли HubSpot официальный список IP для верификации?
Компактного списка нет, но исторически запросы фиксировались с адресов из блока Amazon/AWS — можно использовать как дополнительный ориентир.
Повлияет ли блокировка HubSpot Crawler на позиции в Google?
Нет, на ранжирование в поиске это никак не влияет.
#HubSpot Crawler#HubSpotContentSearchBot#HubSpot Connect#SEO-инструменты#robots.txt#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil