TrafficVeil
Боты 4 мин29 июня 2026 г.

DotBot

DotBot — веб-краулер компании Moz, одной из старейших и наиболее узнаваемых SEO-платформ в индустрии. Бот питает фирменный индекс ссылок Moz (Mozscape) и обеспечивает работу инструментов Link Explorer, Moz Pro, Moz Links API, а также самой узнаваемой метрики в SEO-индустрии — Domain Authority (DA), которая давно стала фактическим отраслевым стандартом оценки авторитетности домена, наравне с Trust Flow Majestic и Domain Rating Ahrefs.

TV
TrafficVeil Team
Эксперты по защите веб-трафика
Содержание статьи
  1. 1. Что такое DotBot
  2. 1.1 User-Agent строка
  3. 1.2 Кто стоит за DotBot
  4. 1.3 Moz управляет четырьмя ботами, а не одним
  5. 1.4 Domain Authority — что строит DotBot
  6. 2. Как работает DotBot
  7. 2.1 Эволюция бота: от простой индексации к машинному обучению
  8. 2.2 Этапы обхода
  9. 2.3 Что DotBot анализирует
  10. 2.4 Частота обхода — адаптивная и зависящая от внешних факторов
  11. 3. Польза и риски: взгляд с двух сторон
  12. 3.1 Преимущества разрешения DotBot
  13. 3.2 Потенциальные сложности
  14. 4. Нагрузка на сервер
  15. 4.1 Репутация: высокий объём, но предсказуемое поведение
  16. 4.2 Параллельные обходы — главный источник скачков нагрузки
  17. 4.3 Минимальная отдача трафика — контекст из данных Cloudflare
  18. 5. Обнаружение в логах
DDoS L7

DDoS атака что это простыми словами и как защитить сайт

Разобрали виды атак, признаки DDoS, последствия, уровни защиты, L7 DDoS и схему подключения TrafficVeil через DNS/reverse proxy.

Читать про DDoS

Энциклопедия ботов TrafficVeil

618 ботов с описаниями, паттернами User-Agent и фильтром по категориям — открытый справочник для аудита логов и настройки защиты.

Открыть справочник

DotBot — высокообъёмный, но в целом доброкачественный краулер: индустриальные классификаторы ботов прямо называют его «high-volume yet benign» (высокообъёмный, но безвредный) и рекомендуют включать его в allowlist систем управления ботами, а не блокировать по умолчанию. Понимание принципов его работы важно для каждого сайта, который заботится о своей репутации в SEO-инструментах, используемых маркетологами и конкурентами по всему миру.

1. Что такое DotBot

1.1 User-Agent строка

Mozilla/5.0 (compatible; DotBot/1.2; +https://opensiteexplorer.org/dotbot; help@moz.com)

Обратите внимание: в строке User-Agent сохранилась ссылка на opensiteexplorer.org — устаревшее название инструмента, который теперь называется Link Explorer. Это историческое наследие: первый продукт Moz для анализа ссылок назывался Open Site Explorer, и хотя сам продукт давно переименован, ссылка в User-Agent осталась неизменной.

1.2 Кто стоит за DotBot

Параметр Значение
Оператор Moz (изначально SEOmoz, Inc.)
Основной продукт Индекс ссылок Mozscape, Domain Authority, Page Authority
Связанные инструменты Link Explorer, Moz Pro, Moz Links API, Site Crawl
Контакт для вебмастеров help@moz.com
Сбор персональных данных Официально не собирает чувствительные или личные данные
Тип бота SEO Crawler

1.3 Moz управляет четырьмя ботами, а не одним

Как и у Ahrefs и Semrush, у Moz не один, а несколько отдельных краулеров, каждый со своим User-Agent токеном, что позволяет управлять их доступом независимо друг от друга. DotBot — основной и наиболее известный из них, отвечающий именно за построение индекса ссылок и расчёт Domain Authority / Page Authority. Остальные боты Moz обслуживают смежные задачи внутри экосистемы продуктов компании.

Практический вывод: блокировка только DotBot в robots.txt не гарантированно останавливает все автоматизированные обращения от Moz — если вы хотите полностью исключить взаимодействие с экосистемой Moz, стоит проверить полный список их User-Agent токенов в актуальной документации (moz.com/help/moz-procedures/crawlers/dotbot), а не ограничиваться только основным ботом.

1.4 Domain Authority — что строит DotBot

Метрика Что измеряет
Domain Authority (DA) Прогнозируемая способность всего домена ранжироваться в поисковой выдаче, по шкале от 1 до 100
Page Authority (PA) Аналогичный показатель, но для отдельной конкретной страницы, а не всего домена
Назначение Сравнительная оценка — не абсолютный сигнал ранжирования Google, а инструмент сопоставления силы доменов между собой

Обе метрики рассчитываются исключительно на основе данных индекса ссылок Mozscape, который непрерывно пополняет DotBot, обходя страницы и фиксируя структуру связей между ними. Важно понимать: Domain Authority — собственная метрика Moz, а не сигнал, который использует сама Google для ранжирования. Тем не менее она настолько широко принята в индустрии, что стала де-факто общим языком для обсуждения авторитетности сайтов между SEO-специалистами.

2. Как работает DotBot

2.1 Эволюция бота: от простой индексации к машинному обучению

DotBot прошёл значительную эволюцию с момента запуска. Ранние версии фокусировались на базовой индексации сайтов и обнаружении ссылок. По мере усложнения SEO-индустрии Moz обновила бота для более глубокого анализа качества контента, структуры сайта и ссылочных профилей. По состоянию на 2025–2026 годы DotBot использует продвинутые техники обхода и модели машинного обучения для эффективного сбора данных — алгоритм самостоятельно определяет, какие страницы посетить и как часто возвращаться, обучаясь на основе прошлых паттернов обхода и изменений на сайтах.

2.2 Этапы обхода

  1. DotBot систематически обходит страницы интернета, переходя по обнаруженным гиперссылкам.
  2. На каждой странице фиксируются исходящие и входящие ссылки, формируя структуру индекса Mozscape.
  3. Анализируется контент страницы — качество, структура, метаданные.
  4. Модель машинного обучения адаптирует частоту последующих визитов исходя из характеристик конкретного сайта и активности запросов пользователей через инструменты Moz.
  5. Обновлённые данные становятся доступны в Link Explorer, Moz Pro и через Moz Links API.

2.3 Что DotBot анализирует

Элемент Что извлекается Важность
Исходящие и входящие ссылки Построение индекса Mozscape ⭐⭐⭐⭐⭐ Главная задача
Domain Authority / Page Authority сигналы Расчёт фирменных метрик авторитетности ⭐⭐⭐⭐⭐ Критически важно
Качество и структура контента Дополняет ссылочный анализ контекстом ⭐⭐⭐⭐ Очень важно
Технические проблемы (битые ссылки, дубли) Данные для Site Crawl и SEO-рекомендаций ⭐⭐⭐⭐ Очень важно
Метаданные страниц Полнота технического аудита ⭐⭐⭐ Важно
Персональные/чувствительные данные Официально не собираются Не релевантно

2.4 Частота обхода — адаптивная и зависящая от внешних факторов

Согласно документации индустриальных каталогов ботов, частота визитов DotBot варьируется в зависимости от нескольких факторов: авторитетности сайта, популярности его ссылочного профиля, показателей в выдаче, а также от того, отслеживается ли сайт активно клиентами Moz через их инструменты. Это означает, что вы не можете напрямую контролировать, как часто бот вас посещает — частота определяется алгоритмически и внешним спросом со стороны пользователей Moz, анализирующих именно ваш домен.

3. Польза и риски: взгляд с двух сторон

3.1 Преимущества разрешения DotBot

  • Видимость в SEO-инструментах — ваш сайт остаётся актуальным в Domain Authority, Link Explorer и других продуктах Moz, которыми пользуются маркетологи, потенциальные партнёры и журналисты
  • Обнаружение проблем — обход DotBot может выявить битые ссылки, дублированный контент, отсутствующие метаданные и другие технические проблемы, видимые через инструменты Moz
  • Использование собственных данных — если вы сами клиент Moz, актуальный индекс позволяет получать точные рекомендации по своему сайту
  • Отсутствие риска для приватности — бот официально не собирает персональные или чувствительные данные

3.2 Потенциальные сложности

  • Объём трафика может быть значительным — SEO-краулеры нередко запрашивают каждую страницу сайта целиком, особенно при активном мониторинге несколькими клиентами Moz одновременно
  • Параллельные обходы — если несколько разных пользователей Moz отслеживают один и тот же домен через свои аккаунты, это может создавать множественные одновременные волны запросов
  • Индексация второстепенных страниц — бот может заходить на страницы, которые владелец сайта не считает приоритетными для внешнего анализа

4. Нагрузка на сервер

4.1 Репутация: высокий объём, но предсказуемое поведение

Индустриальные классификаторы ботов описывают DotBot как краулер, способный создавать ощутимую нагрузку именно за счёт объёма, а не агрессивности поведения — он, как правило, уважает robots.txt, отступает при превышении лимита скорости (rate limiting) и использует механизм повторных попыток с задержкой (retry/back-off) при временной недоступности страниц, что характеризует его как «вежливого» краулера в техническом смысле.

4.2 Параллельные обходы — главный источник скачков нагрузки

Один из ключевых факторов риска для производительности сервера — то, что несколько клиентов SEO-платформы могут одновременно анализировать один и тот же домен. Если ваш сайт активно отслеживается через Moz несколькими разными пользователями (например, и вашей собственной командой, и конкурентами, изучающими ваш ссылочный профиль), это может создавать параллельные волны запросов, суммарно создающие заметную нагрузку, даже если поведение каждого отдельного потока остаётся вежливым.

4.3 Минимальная отдача трафика — контекст из данных Cloudflare

Один из самых показательных параметров для оценки реальной ценности этого бота для сайта — соотношение «обходов к кликам». По данным, опирающимся на верифицированную статистику Cloudflare Radar, на каждые 1000 запросов DotBot сайт получает обратно в среднем всего около 0.087 человеческих визитов. Это значительно ниже даже скромных показателей других SEO-краулеров и заметно ниже показателей AI-краулеров для генеративного поиска — DotBot практически не приводит прямого реферального трафика, его ценность для сайта лежит исключительно в плоскости видимости в сторонних SEO-инструментах, а не в прямой посещаемости.

5. Обнаружение в логах

5.1 Как выглядит запись

# Стандартный запрос DotBot:
216.244.66.198 - - [09/May/2026:16:12:30 +0000] \
  "GET /blog/link-building-2026/ HTTP/1.1" \
  200 28432 "-" \
  "Mozilla/5.0 (compatible; DotBot/1.2; +https://opensiteexplorer.org/dotbot; help@moz.com)"

5.2 Аналитика через grep

Найти все запросы DotBot:

grep -i 'dotbot' /var/log/nginx/access.log

Подсчитать количество запросов:

grep -i 'dotbot' access.log | wc -l

Топ обходимых страниц:

grep -i 'dotbot' access.log \
  | awk '{print $7}' | sort | uniq -c | sort -nr | head -30

HTTP-коды ответов:

grep -i 'dotbot' access.log \
  | awk '{print $9}' | sort | uniq -c | sort -nr

Поиск параллельных волн обхода (несколько IP одновременно):

grep -i 'dotbot' access.log \
  | awk '{print $1}' | sort | uniq -c | sort -nr

Bandwidth, потребляемый ботом:

grep -i 'dotbot' access.log \
  | awk '{sum+=$10} END{print sum/1024/1024 " MB"}'

Live-мониторинг:

tail -f /var/log/nginx/access.log | grep --line-buffered -i 'dotbot'

5.3 Программная детекция (пример для серверных приложений)

# Python/Flask:
import re
from flask import request

def detect_dotbot():
    user_agent = request.headers.get('User-Agent', '')
    pattern = r'DotBot'
    if re.search(pattern, user_agent, re.IGNORECASE):
        return True
    return False

# PHP:
function detect_dotbot() {
    $user_agent = $_SERVER['HTTP_USER_AGENT'] ?? '';
    $pattern = '/DotBot/i';
    if (preg_match($pattern, $user_agent)) {
        error_log('DotBot detected from IP: ' . $_SERVER['REMOTE_ADDR']);
        return true;
    }
    return false;
}

5.4 Верификация подлинности

User-Agent легко подделывается, поэтому для надёжной идентификации рекомендуется дополнительная проверка через обратный DNS lookup — официальная рекомендация заключается в проверке, что хост резолвится в домен moz.com:

#!/bin/bash
IP=$1
HOST=$(host $IP | awk '{print $NF}')

if [[ $HOST == *moz.com* ]]; then
  FWD=$(host $HOST | awk '{print $NF}')
  if [[ $FWD == $IP ]]; then
    echo "✔ Настоящий DotBot: $IP → $HOST"
  else
    echo "✖ DNS mismatch: $IP"
  fi
else
  echo "✖ Нет подтверждающей PTR-записи moz.com: $IP"
fi

Важная оговорка из индустриальной практики: строка User-Agent легко поддаётся спуфингу, тогда как принадлежность IP-адреса гораздо сложнее подделать — поэтому при любых сомнениях приоритет должен быть за проверкой IP/DNS, а не только за текстовым совпадением User-Agent.

6. Управление DotBot

6.1 Полная блокировка через robots.txt

User-agent: DotBot
Disallow: /

Последствие: блокировка DotBot не повлияет на позиции сайта в Google, Bing или Яндексе — этот бот не передаёт данные в алгоритмы поисковых систем. Эффект ограничится исключительно точностью данных о вашем сайте в продуктах Moz (Domain Authority, Page Authority, Link Explorer).

6.2 Рекомендуемый сбалансированный подход

Индустриальная рекомендация в большинстве случаев — не блокировать DotBot полностью, особенно если вы сами пользуетесь SEO-инструментами: блокировка одного из краулеров такого рода подрывает общую экосистему данных, на которую вы сами опираетесь при анализе конкурентов. Вместо полной блокировки рекомендуется применять более тонкие методы контроля:

User-agent: DotBot
Disallow: /admin/
Disallow: /private/
Disallow: /checkout/
Allow: /

6.3 Кеширование специально для DotBot (снижение нагрузки без блокировки)

# Nginx — отдавать кешированную версию страницы специально для DotBot,
# снижая нагрузку на бэкенд без потери видимости в индексе Moz:
location / {
    if ($http_user_agent ~* "DotBot") {
        add_header Cache-Control "public, max-age=3600";
        add_header X-Robots-Tag "noarchive";
    }
}

6.4 Блокировка через .htaccess (Apache)

RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} DotBot [NC]
RewriteRule .* - [F,L]

6.5 Rate limiting через Nginx (предпочтительная альтернатива полной блокировке)

map $http_user_agent $is_dotbot {
    default       0;
    "~*DotBot"    1;
}

limit_req_zone $is_dotbot zone=dotbot_limit:10m rate=2r/s;
location / {
    limit_req zone=dotbot_limit burst=10 nodelay;
}

6.6 Когда блокировка действительно оправдана

Сценарий Рекомендация
Сервер испытывает чрезмерную нагрузку от параллельных обходов Rate limiting предпочтительнее полной блокировки
Вы сами активно используете SEO-инструменты (свои или сторонние) Не блокировать — подрывает общую экосистему данных
Закрытые/служебные разделы сайта Точечный Disallow, а не блокировка всего бота
Принципиальное желание скрыть ссылочный профиль от любого внешнего анализа Полная блокировка — обоснованное решение

7. Диагностика проблем

7.1 Типичные проблемы и решения

Проблема Причина Решение
DotBot создаёт заметную нагрузку Несколько клиентов Moz анализируют сайт параллельно Rate limiting вместо полной блокировки
Данные Domain Authority устарели Бот заблокирован в robots.txt Проверить и скорректировать правила, дать боту доступ
Подозрение на подделку User-Agent Скрейперы маскируются под известный SEO-бот Верифицировать IP через reverse DNS к moz.com
Бот посещает нежелательные/служебные разделы Нет точечных правил в robots.txt Добавить Disallow для конкретных путей
Непредсказуемая частота визитов Алгоритм машинного обучения адаптирует расписание самостоятельно Это нормальное поведение — частота не контролируется напрямую владельцем сайта

7.2 Пошаговая диагностика

Шаг 1 — Проверить robots.txt:

curl https://example.com/robots.txt | grep -i 'dotbot'

Шаг 2 — Проверить доступность сайта для бота:

curl -A "Mozilla/5.0 (compatible; DotBot/1.2; +https://opensiteexplorer.org/dotbot; help@moz.com)" \
  -I https://example.com/
# Ожидается: HTTP/1.1 200 OK

Шаг 3 — Оценить долю трафика от бота:

echo "Всего запросов:"
wc -l access.log
echo "Запросов от DotBot:"
grep -ci 'dotbot' access.log

Шаг 4 — При сомнениях в легитимности конкретного IP — обратиться в Moz:

Email: help@moz.com
Документация: https://moz.com/help/moz-procedures/crawlers/dotbot

8. DotBot vs другие крупные SEO-краулеры

Краулер Компания Фирменная метрика Crawl-to-click (на 1000 запросов) Допускает rate limiting
DotBot Moz Domain Authority, Page Authority ~0.087 визитов ✔ Отступает при превышении лимита
AhrefsBot Ahrefs Domain Rating, URL Rating Не публикуется официально ✔ Поддерживает Crawl-delay
SemrushBot Semrush Authority Score Не публикуется официально ✔ Поддерживает Crawl-delay (до 10 сек)
MJ12bot Majestic Trust Flow, Citation Flow Не публикуется официально ✔ Поддерживает Crawl-delay

Контекст из реальных данных pbnshield: по статистике за март–май 2026 года, DotBot (зафиксированный под историческим именем платформы как «Moz/Open Site Explorer» категория в общей выборке SEO-краулеров) занимает позицию в общем диапазоне крупных ссылочных краулеров наряду с MJ12bot (#22, 0.6%) и AhrefsBot (#31, 0.3%) — точная доля варьируется в зависимости от методологии классификации конкретной аналитической системы, поскольку некоторые инструменты группируют исторические и текущие токены DotBot по-разному.

9. Рекомендуемая стратегия

✔ Главный принцип: DotBot — высокообъёмный, но технически вежливый краулер с минимальной прямой отдачей трафика. Решение о блокировке должно основываться на реальной нагрузке на ваш сервер, а не на опасениях по поводу конкурентного анализа — для большинства сайтов разрешение DotBot оправдано тем, что поддерживает общую SEO-экосистему данных.

Задача Решение
Снизить нагрузку без блокировки Rate limiting через Nginx + кеширование для DotBot
Полностью исключить сайт из индекса Moz User-agent: DotBot / Disallow: /
Защитить служебные разделы Точечный Disallow для /admin/, /private/, /checkout/
Оценить реальное влияние на сервер grep + расчёт доли от общего трафика, поиск параллельных IP
Верифицировать подлинность подозрительного трафика Reverse DNS lookup → moz.com (приоритет над текстовым UA)
Узнавать о визитах в реальном времени Подключить систему мониторинга агентов (Agent Analytics или аналог)
Решить нестандартную проблему Обратиться на help@moz.com

 

Другие гайды по ботам

Частые вопросы

Почему в строке User-Agent DotBot упоминается opensiteexplorer.org, хотя продукт давно называется Link Explorer?

Это историческое наследие. Open Site Explorer был первым инструментом анализа ссылок Moz, который впоследствии был переименован и интегрирован в современный Link Explorer. Сама строка идентификации бота при этом не менялась — это обычная практика в индустрии, когда внутренние технические идентификаторы остаются стабильными даже после ребрендинга продукта, чтобы не нарушать совместимость с существующими системами детекции ботов.

Стоит ли мне блокировать DotBot?

В большинстве случаев — нет. Если вы сами пользуетесь SEO-инструментами (Moz или сторонними), блокировка одного из крупных краулеров подрывает общую экосистему данных, на которую вы опираетесь для анализа конкурентов. Ограничивать доступ стоит преимущественно тогда, когда бот потребляет избыточные ресурсы сервера — и в этом случае предпочтительнее использовать ограничение скорости (rate limiting), а не полную блокировку.

Сколько разных ботов использует Moz?

По данным индустриальных каталогов ботов, Moz управляет четырьмя отдельными ботами в общей сложности, каждый под собственным User-Agent токеном, что позволяет настраивать доступ для них независимо друг от друга. DotBot — основной и самый известный из них, отвечающий именно за построение индекса ссылок и расчёт Domain Authority / Page Authority.

Собирает ли DotBot персональные данные посетителей моего сайта?

Нет, согласно официальной позиции и индустриальным обзорам бота, DotBot не собирает чувствительную или личную информацию о пользователях. Его задача ограничена анализом структуры ссылок, контента и технических SEO-параметров публично доступных страниц — данные, относящиеся к индивидуальным посетителям сайта, не входят в зону его интересов.

Почему DotBot вдруг резко увеличил частоту обхода моего сайта?

Частота визитов DotBot определяется адаптивным алгоритмом, учитывающим авторитетность сайта, популярность его ссылочного профиля, показатели в выдаче и — что особенно важно — активность запросов через инструменты Moz от сторонних пользователей. Если ваш домен начали активно отслеживать клиенты Moz (например, в рамках конкурентного анализа), это может временно увеличить частоту обхода независимо от ваших собственных действий.

Как отличить настоящий DotBot от подделки?

Строка User-Agent легко поддаётся спуфингу любым скрейпером. Для надёжной верификации используйте обратный DNS lookup IP-адреса — он должен резолвиться в домен, связанный с moz.com, с подтверждающим прямым lookup, возвращающим исходный IP. Принципиальное индустриальное правило: принадлежность IP-адреса значительно сложнее подделать, чем текстовую строку User-Agent, поэтому при любых сомнениях приоритет должен быть за проверкой через DNS, а не за простым совпадением заголовка запроса.

Может ли DotBot нагрузить мой сервер сильнее, чем я ожидаю?

Да, особенно если ваш домен одновременно отслеживается несколькими разными клиентами Moz через их аккаунты — каждый запуск независимого анализа может создавать собственную параллельную волну запросов. Сумма таких одновременных, технически вежливых по отдельности потоков может создать заметную совокупную нагрузку. В этом случае оптимальным решением является ограничение скорости (rate limiting) специально для User-Agent DotBot, а не полная блокировка.

Использует ли DotBot машинное обучение для обхода сайтов?

Да, по данным актуальной на 2025–2026 годы документации. Бот применяет модели машинного обучения для определения того, какие страницы посещать и с какой периодичностью возвращаться, обучаясь на основе истории прошлых обходов и изменений, происходящих на конкретных сайтах. Это отличает современную версию DotBot от его ранних реализаций, которые использовали более простые, фиксированные алгоритмы индексации.

TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак.

Похожие статьи

GPTBot

GPTBot — краулер OpenAI, который собирает публично доступный веб-контент для обучения будущих поколений генеративных моделей семейства GPT. Это один из первых официально задокументированных ИИ-краулеров на рынке (представлен в августе 2023 года) и на сегодня — самый узнаваемый бот OpenAI среди веб-мастеров.

4 мин

OAI-AdsBot

OAI-AdsBot — самый новый краулер OpenAI, впервые появившийся в официальной документации в апреле 2026 года. Он обслуживает рекламную инфраструктуру ChatGPT: когда рекламодатель размещает объявление в ChatGPT Ads, этот бот посещает указанную посадочную страницу, чтобы проверить её на соответствие рекламным политикам OpenAI и, при необходимости, использовать содержимое страницы для оценки релевантности показа объявления.

3 мин

Keys.so Bot (keys-so-bot)

Keys-so-bot — краулер российского SEO-сервиса Keys.so (оператор — компания «Битерика Групп»), который используется для сбора данных о видимости сайтов в органической и контекстной выдаче Яндекса и Google, анализа семантического ядра конкурентов и построения истории изменений файлов robots.txt. Это не поисковый робот в классическом смысле — он не индексирует страницы для показа в результатах поиска, а сканирует сайты в интересах пользователей сервиса, которые анализируют конкурентов.

3 мин

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.