TrafficVeil
Боты 4 мин25 июня 2026 г.

Bingbot (MSN Bot)

Bingbot — официальный веб-краулер Microsoft, запущенный в 2010 году для индексации страниц в поисковой системе Bing. Несмотря на скромную долю рынка Bing по сравнению с Google в большинстве стран, Bingbot остаётся одним из самых заметных краулеров в интернете — по данным Cloudflare, он стабильно входит в число наиболее активных ботов по объёму запросов.

TV
TrafficVeil Team
Эксперты по защите веб-трафика
Содержание статьи
  1. 1. Что такое Bingbot
  2. 1.1 User-Agent строки
  3. 1.2 Кто стоит за Bingbot
  4. 1.3 Контекст из реальных данных pbnshield
  5. 2. Как работает Bingbot
  6. 2.1 Этапы обхода
  7. 2.2 Что Bingbot анализирует
  8. 2.3 Зачем Bingbot обходит сайт так часто
  9. 3. Официальная верификация Bingbot
  10. 3.1 Зачем нужна верификация
  11. 3.2 Метод 1 — официальный список IP-адресов
  12. 3.3 Метод 2 — инструмент Verify Bingbot
  13. 3.4 Метод 3 — двухэтапная DNS-верификация (официальная рекомендация)
  14. 3.5 ⚠ Известная проблема: несоответствие между методами верификации
  15. 4. Нагрузка на сервер
  16. 4.1 Факторы, влияющие на частоту обхода
  17. 4.2 Управление скоростью через Bing Webmaster Tools
  18. 4.3 Crawl-delay в robots.txt
DDoS L7

DDoS атака что это простыми словами и как защитить сайт

Разобрали виды атак, признаки DDoS, последствия, уровни защиты, L7 DDoS и схему подключения TrafficVeil через DNS/reverse proxy.

Читать про DDoS

Энциклопедия ботов TrafficVeil

618 ботов с описаниями, паттернами User-Agent и фильтром по категориям — открытый справочник для аудита логов и настройки защиты.

Открыть справочник

Значение Bingbot выходит далеко за рамки самого Bing: данные, собранные этим краулером, используются также для индексации в Yahoo (через партнёрство), DuckDuckGo (частично), голосового помощника Cortana (в прошлом), а с развитием Copilot и AI-функций Microsoft — и для AI-поиска. Понимание работы этого бота важно для каждого сайта, ориентированного на международную аудиторию.

1. Что такое Bingbot

1.1 User-Agent строки

# Десктоп:
Mozilla/5.0 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm)

# Десктоп (расширенный, с движком Chromium):
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; bingbot/2.0;
+http://www.bing.com/bingbot.htm) Chrome/W.X.Y.Z Safari/537.36 Edg/W.X.Y.Z

# Мобильный:
Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P)
AppleWebKit/537.36 (KHTML, like Gecko) Chrome/W.X.Y.Z
Mobile Safari/537.36 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm)
Edg/W.X.Y.Z

# Устаревший токен (изредка встречается в старых логах):
msnbot

В апреле 2022 года Microsoft обновила строку User-Agent, добавив идентификатор движка Edge (Edg/W.X.Y.Z) — это отражает переход Bingbot на рендеринг на основе Chromium, схожий с современным браузером Edge.

1.2 Кто стоит за Bingbot

Параметр Значение
Оператор Microsoft Corporation
Год запуска 2010 (как замена устаревшего MSNBot)
Основной продукт Поисковая система Bing
Партнёрские сети Yahoo Search, частично DuckDuckGo, AI-функции Copilot
Позиция по активности (Cloudflare) Один из top-5 самых активных краулеров по объёму запросов
Инструмент для вебмастеров Bing Webmaster Tools (bing.com/webmasters)

1.3 Контекст из реальных данных pbnshield

По статистике pbnshield за март–май 2026 года BingBot занял 8-е место среди 100 зафиксированных ботов с долей 3.6% (3 827 247 запросов) — обгоняя по объёму как GoogleBot (#11, 2.2%), так и YandexBot (#14, 1.6%). При этом BingBot демонстрировал устойчивый и быстрый рост на протяжении всего квартала:

Месяц Запросов BingBot Динамика
Март 2026 223 740
Апрель 2026 923 094 📈 рост ×4.1
Май 2026 2 680 413 📈 рост ×2.9

Совокупный рост за квартал — почти ×12, что заметно опережает темпы роста GoogleBot за тот же период. Это может отражать как органический рост доли Bing, так и активизацию индексации в связи с развитием AI-поиска и Copilot.

2. Как работает Bingbot

2.1 Этапы обхода

  1. Bingbot проверяет robots.txt сайта, чтобы определить разрешённые и запрещённые для обхода разделы.
  2. Отправляет GET-запросы не только к HTML-страницам, но и к изображениям, CSS-файлам и другим ресурсам, необходимым для полного рендеринга.
  3. Если сайт добавлен в Bing Webmaster Tools и отправлен sitemap — Bingbot использует его как ориентир для более быстрого обнаружения новых URL.
  4. Анализируется контент, метаданные, структурированные данные страницы.
  5. Обновляются позиции и сниппеты в поисковой выдаче Bing на основе собранных данных.

2.2 Что Bingbot анализирует

Элемент Назначение Важность
Текстовый контент и метаданные Индексация для поисковой выдачи Bing ⭐⭐⭐⭐⭐ Критически важно
Изображения и видео Превью и видеосниппеты в результатах поиска ⭐⭐⭐⭐ Очень важно
Структурированные данные (Schema.org) Расширенные сниппеты в выдаче ⭐⭐⭐⭐ Очень важно
Sitemap.xml Ускоренное обнаружение новых и изменённых URL ⭐⭐⭐⭐⭐ Критически важно
Качество рекламных referring-страниц Проверка качества страниц, на которые ведёт реклама Bing Ads ⭐⭐⭐ Важно для рекламодателей
Значимость и авторитетность сайта Влияет на частоту повторного обхода ⭐⭐⭐⭐ Очень важно

2.3 Зачем Bingbot обходит сайт так часто

Согласно официальной документации Microsoft, частые визиты Bingbot объясняются необходимостью поддерживать актуальность поисковой выдачи: обнаружение нового или обновлённого контента, удаление из индекса страниц, которые были удалены или перенаправлены, а также обновление отображения сайта в выдаче исходя из его значимости и авторитетности. Дополнительно бот может посещать сайт для проверки качества страниц, на которые ведут рекламные объявления, и для генерации скриншотов и видеопревью результатов поиска.

3. Официальная верификация Bingbot

3.1 Зачем нужна верификация

User-Agent легко подделывается. Злоумышленники маскируются под Bingbot, чтобы обойти ограничения скорости, заняться скрейпингом контента или даже совершить клик-фрод по рекламе. Microsoft официально предоставляет несколько инструментов для проверки подлинности.

3.2 Метод 1 — официальный список IP-адресов

# Microsoft публикует и поддерживает актуальный JSON-файл с IP-диапазонами:
https://www.bing.com/toolbox/bingbot.json

# Скачать и проверить вхождение конкретного IP:
curl -s https://www.bing.com/toolbox/bingbot.json | python3 -m json.tool

3.3 Метод 2 — инструмент Verify Bingbot

Microsoft предоставляет специальный веб-инструмент для проверки конкретного IP-адреса:

# Публичный инструмент (без необходимости аккаунта):
https://www.bing.com/toolbox/verify-bingbot

# Также доступен внутри Bing Webmaster Tools:
# Diagnostics & Tools → Verify Bingbot

3.4 Метод 3 — двухэтапная DNS-верификация (официальная рекомендация)

Согласно официальному руководству Bing, классический метод верификации через обратный и прямой DNS lookup выглядит так:

#!/bin/bash
# Шаг 1: обратный DNS lookup IP из логов
IP=$1
HOST=$(host $IP | awk '{print $NF}')

# Согласно официальной документации, хост должен заканчиваться на search.msn.com
if [[ $HOST == *search.msn.com* ]]; then
  # Шаг 2: прямой DNS lookup полученного хоста
  FWD=$(host $HOST | awk '{print $NF}')
  if [[ $FWD == $IP ]]; then
    echo "✔ Настоящий Bingbot: $IP → $HOST"
  else
    echo "✖ DNS mismatch: $IP"
  fi
else
  echo "✖ Hostname не заканчивается на search.msn.com: $IP"
fi

3.5 ⚠ Известная проблема: несоответствие между методами верификации

Важный практический нюанс, о котором сообщают администраторы серверов: иногда IP-адрес, который присутствует в официальном bingbot.json и успешно проходит проверку через инструмент Verify Bingbot, при этом не проходит классическую проверку через обратный DNS lookup — хост не резолвится в ожидаемое имя, заканчивающееся на search.msn.com, а возвращает либо пустой результат, либо сам IP-адрес без изменений.

Это создаёт неопределённость: с одной стороны, Microsoft официально подтверждает принадлежность IP-диапазона Bingbot через два инструмента (JSON-список и Verify Bingbot), с другой — классический метод верификации, рекомендованный в той же официальной документации, даёт противоречивый результат. Практическая рекомендация: если IP подтверждён одновременно через официальный JSON-список и через инструмент Verify Bingbot, считайте его легитимным, даже если reverse DNS lookup не дал ожидаемого результата — это известное несоответствие в инфраструктуре, а не признак подделки.

4. Нагрузка на сервер

4.1 Факторы, влияющие на частоту обхода

Фактор Влияние
Авторитетность и значимость сайта Более авторитетные сайты обходятся чаще
Наличие sitemap в Bing Webmaster Tools Ускоряет обнаружение новых страниц, может увеличить частоту обхода
Частота обновления контента Часто обновляемые сайты проверяются чаще
Активная реклама через Bing Ads Дополнительные проверки качества целевых страниц
Размер сайта Крупные сайты требуют пропорционально больше запросов для полного покрытия

4.2 Управление скоростью через Bing Webmaster Tools

В отличие от некоторых других крупных краулеров, Bingbot предоставляет официальный интерфейс для прямого управления скоростью обхода:

# Bing Webmaster Tools → Configure My Site → Crawl Control
# Доступны настройки:
# - Слайдер интенсивности обхода по часам суток
# - Возможность задать сниженную активность в пиковые часы трафика сайта
# - Региональная настройка (если у вашего хостинга разная нагрузка по времени)

4.3 Crawl-delay в robots.txt

User-agent: bingbot
Crawl-delay: 5

Bingbot поддерживает директиву Crawl-delay, хотя предпочтительным современным способом управления нагрузкой является именно интерфейс Crawl Control в Bing Webmaster Tools — он даёт более тонкую настройку по времени суток.

5. Известная проблема: парсинг параметров поиска как контента сайта

Реальный задокументированный случай из практики администраторов: на сайтах со встроенной функцией внутреннего поиска (например, рецепты, каталоги товаров) верифицированные IP-адреса Bingbot могут массово отправлять запросы со случайными или нерелевантными значениями параметра search, заставляя сервер сайта выполнять реальный поиск по этим запросам и возвращать результат — что создаёт избыточную нагрузку на базу данных, не связанную с обычным индексированием контента.

5.1 Почему это происходит

Вероятная причина — Bingbot обнаруживает параметризованные URL внутреннего поиска через внешние ссылки, кеш или предыдущие обходы, и пытается переобходить их как обычные страницы, не различая, что они генерируют динамический контент по произвольному запросу.

5.2 Решение: блокировка параметра поиска через robots.txt

# Запретить обход URL с параметром поиска для Bingbot
# (и любых других ботов при необходимости):
User-agent: bingbot
Disallow: /*?search=
Disallow: /*search*

User-agent: *
Disallow: /*?search=

# Более точечный вариант, если параметр называется иначе:
User-agent: bingbot
Disallow: /*?q=
Disallow: /*?query=

Важно: в отличие от полной блокировки бота, этот метод сохраняет индексацию основного контента сайта, устраняя только избыточные запросы к динамическим страницам поиска — рекомендуемый подход при столкновении с этой проблемой.

6. Обнаружение в логах

6.1 Как выглядит запись

# Десктопный Bingbot:
157.55.39.130 - - [09/May/2026:15:10:22 +0000] \
  "GET /article/seo-trends-2026/ HTTP/1.1" \
  200 28432 "-" \
  "Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; bingbot/2.0; \
  +http://www.bing.com/bingbot.htm) Chrome/116.0.5845.96 Safari/537.36 Edg/116.0.5845.96"

# Мобильный Bingbot:
157.55.39.131 - - [09/May/2026:15:11:00 +0000] \
  "GET /article/seo-trends-2026/ HTTP/1.1" \
  200 24180 "-" \
  "Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) \
  AppleWebKit/537.36 (KHTML, like Gecko) Chrome/116.0.5845.96 \
  Mobile Safari/537.36 (compatible; bingbot/2.0; \
  +http://www.bing.com/bingbot.htm) Edg/116.0.5845.96"

6.2 Аналитика через grep

Найти все запросы Bingbot:

grep -i 'bingbot' /var/log/nginx/access.log

Подсчитать количество запросов:

grep -i 'bingbot' access.log | wc -l

Топ обходимых страниц:

grep -i 'bingbot' access.log \
  | awk '{print $7}' | sort | uniq -c | sort -nr | head -30

Поиск проблемы с параметрами поиска (см. раздел 5):

grep -i 'bingbot' access.log | grep -E '\?(search|q|query)='

HTTP-коды ответов:

grep -i 'bingbot' access.log \
  | awk '{print $9}' | sort | uniq -c | sort -nr

Разделить десктоп и мобильные запросы:

grep -i 'bingbot' access.log | grep -v 'Android' # десктоп
grep -i 'bingbot' access.log | grep 'Android'     # мобильные

Live-мониторинг:

tail -f /var/log/nginx/access.log | grep --line-buffered -i 'bingbot'

7. Управление Bingbot

7.1 Полная блокировка через robots.txt

User-agent: bingbot
Disallow: /

⚠ Последствие: в отличие от менее значимых SEO-краулеров, блокировка Bingbot приводит к прямой потере видимости и позиций в поиске Bing — это полноценная поисковая система с заметной долей рынка в ряде стран и сегментов (например, корпоративные пользователи Windows/Edge, США).

7.2 Рекомендуемый подход — точечное управление

User-agent: bingbot
Disallow: /admin/
Disallow: /cart/
Disallow: /checkout/
Disallow: /*?search=
Crawl-delay: 5
Allow: /

Sitemap: https://example.com/sitemap.xml

7.3 Блокировка через .htaccess (Apache)

RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} bingbot [NC]
RewriteRule .* - [F,L]

7.4 Блокировка через Nginx

map $http_user_agent $is_bingbot {
    default       0;
    "~*bingbot"   1;
}

if ($is_bingbot) {
    return 403;
}

7.5 Blacklist для неверифицированных IP с UA Bingbot

Согласно официальной рекомендации Microsoft: если инструмент Verify Bingbot подтверждает, что подозрительный IP не принадлежит Bingbot, — рекомендуется добавить такой IP в чёрный список и заблокировать доступ к сайту.

8. Диагностика проблем

8.1 Типичные проблемы и решения

Проблема Причина Решение
Verified IP не проходит reverse DNS проверку Известное несоответствие в инфраструктуре Bing Доверять JSON-списку + Verify Bingbot tool, игнорировать аномалию DNS
Bingbot заваливает сервер запросами с параметром search Бот переобходит параметризованные URL внутреннего поиска Disallow для /*?search= в robots.txt
Сайт пропал из индекса Bing Блокировка в robots.txt или технические ошибки Проверить через Bing Webmaster Tools → URL Inspection
Слишком частые визиты создают нагрузку Высокая значимость сайта + отсутствие настроек скорости Настроить Crawl Control в Bing Webmaster Tools
Подозрение на спуфинг User-Agent Скрейперы маскируются под bingbot Verify Bingbot tool + сверка с bingbot.json

8.2 Пошаговая диагностика

Шаг 1 — Проверить robots.txt:

curl https://example.com/robots.txt | grep -i 'bingbot'

Шаг 2 — Проверить доступность через curl:

curl -A "Mozilla/5.0 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm)" \
  -I https://example.com/
# Ожидается: HTTP/1.1 200 OK

Шаг 3 — Верифицировать подозрительный IP:

# Через официальный инструмент:
https://www.bing.com/toolbox/verify-bingbot

# Или сверкой со списком:
curl -s https://www.bing.com/toolbox/bingbot.json | grep "ваш_IP"

Шаг 4 — Проверить статус индексации в Bing Webmaster Tools:

  • Зарегистрироваться/войти на bing.com/webmasters
  • Раздел URL Inspection → ввести проблемный URL
  • Раздел Crawl Control → проверить настройки скорости обхода

9. Bingbot vs другие поисковые краулеры

Краулер Поисковик Доля в данных pbnshield Crawl-delay Управление скоростью через UI
Bingbot Bing / Microsoft 3.6% (#8 место) ✔ Поддерживает ✔ Crawl Control в Webmaster Tools
GoogleBot Google 2.2% (#11 место) ✖ Игнорирует ✔ Ограниченно через Search Console
YandexBot Яндекс 1.6% (#14 место) ✔ Поддерживает ✔ Через Яндекс.Вебмастер
BaiduSpider Baidu 0.2% (#36 место) ✔ Поддерживает Частично
DuckDuckBot DuckDuckGo 0.1% (#39 место) ✔ Поддерживает Ограниченно

Контекст из независимых данных Cloudflare: по результатам двухмесячного анализа Cloudflare (январь 2026), Googlebot достигает в 3.26 раза больше уникальных URL, чем Bingbot — заметный разрыв, несмотря на то что в выборке pbnshield BingBot по объёму запросов опережает GoogleBot. Это указывает на разную методологию обхода: Bingbot может делать больше повторных запросов к уже известным URL, тогда как Googlebot эффективнее охватывает новые страницы.

10. Рекомендуемая стратегия

✔ Главный принцип: Bingbot — полноценный поисковый краулер с прямым влиянием на видимость сайта, а не вспомогательный SEO-инструмент. Управляйте им через официальные инструменты Bing Webmaster Tools, а не блокируйте по умолчанию.

Задача Решение
Ускорить индексацию новых страниц Отправить sitemap через Bing Webmaster Tools
Настроить скорость обхода точно Crawl Control в Bing Webmaster Tools по часам суток
Остановить избыточные запросы к поиску сайта Disallow для параметра ?search= в robots.txt
Верифицировать подозрительный IP Verify Bingbot tool + сверка с bingbot.json
Не паниковать при несовпадении reverse DNS Известная аномалия — доверять официальным инструментам верификации
Защитить чувствительные разделы Точечный Disallow вместо полной блокировки
Диагностировать выпадение из индекса URL Inspection в Bing Webmaster Tools
Обнаружить активность в логах grep -i bingbot + анализ параметров URL

 

Другие гайды по ботам

Частые вопросы

Что делать, если IP подтверждён как Bingbot через JSON-список, но не проходит reverse DNS проверку?

Это известная и документированная в сообществе аномалия инфраструктуры Bing: некоторые официально подтверждённые диапазоны IP не возвращают ожидаемый hostname, заканчивающийся на search.msn.com, при обратном DNS lookup. Если IP присутствует в официальном bingbot.json и подтверждён через инструмент Verify Bingbot — считайте его легитимным, несмотря на несовпадение результата reverse DNS.

Почему Bingbot отправляет запросы с случайными значениями параметра поиска на моём сайте?

Это задокументированная в сообществе вебмастеров проблема: бот переобходит параметризованные URL внутреннего поиска сайта (например, /recipes?search=...), которые он где-то обнаружил, как если бы это были обычные страницы контента. Поскольку такие URL генерируют динамический результат по любому запросу, это создаёт избыточную нагрузку на базу данных. Решение — заблокировать через robots.txt конкретный параметр (например, Disallow: /*?search=), сохранив индексацию остального сайта.

Как ускорить индексацию нового контента в Bing?

Добавьте сайт в Bing Webmaster Tools и отправьте актуальный sitemap.xml — Bingbot использует его как ориентир для быстрого обнаружения новых и изменённых URL, вместо того чтобы ждать обнаружения через обычный обход по ссылкам. Также можно использовать функцию URL Submission в том же интерфейсе для запроса немедленной индексации конкретных страниц.

Чем мобильная версия Bingbot отличается от десктопной?

Обе версии собирают данные для одного и того же поискового индекса, но с разным User-Agent, имитирующим соответствующий тип устройства — десктопный браузер на основе Chromium/Edge или мобильный Android-браузер. Это позволяет Bing оценивать, как сайт выглядит и работает на разных типах устройств, что особенно важно для оценки мобильной адаптивности.

Поддерживает ли Bingbot директиву Crawl-delay?

Да, директива поддерживается, но более современным и точным способом управления скоростью обхода является интерфейс Crawl Control в Bing Webmaster Tools, который позволяет настроить интенсивность обхода по конкретным часам суток — например, снизить активность бота в часы пиковой посещаемости вашего сайта реальными пользователями.

Почему в логах встречается устаревший токен msnbot?

MSNBot — это исторический предшественник Bingbot, использовавшийся до 2010 года, когда Microsoft запустила Bing как отдельный продукт. Хотя основным актуальным токеном уже более десяти лет является bingbot, упоминания msnbot иногда всё ещё можно встретить в инструментах верификации и устаревшей документации — современный краулер работает исключительно под именем bingbot.

Как часто обновляется официальный список IP-адресов Bingbot?

Microsoft поддерживает файл bingbot.json в постоянно актуальном состоянии, периодически добавляя новые диапазоны по мере расширения инфраструктуры. Сообщество вебмастеров неоднократно отмечало появление новых блоков IP, которые сразу проходили проверку через официальный инструмент Verify Bingbot. Рекомендуется не хардкодить статичный список IP в правилах файрвола, а либо регулярно обновлять его из первоисточника, либо использовать связку User-Agent + динамическую верификацию для критичных решений.

TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак.

Похожие статьи

GPTBot

GPTBot — краулер OpenAI, который собирает публично доступный веб-контент для обучения будущих поколений генеративных моделей семейства GPT. Это один из первых официально задокументированных ИИ-краулеров на рынке (представлен в августе 2023 года) и на сегодня — самый узнаваемый бот OpenAI среди веб-мастеров.

4 мин

OAI-AdsBot

OAI-AdsBot — самый новый краулер OpenAI, впервые появившийся в официальной документации в апреле 2026 года. Он обслуживает рекламную инфраструктуру ChatGPT: когда рекламодатель размещает объявление в ChatGPT Ads, этот бот посещает указанную посадочную страницу, чтобы проверить её на соответствие рекламным политикам OpenAI и, при необходимости, использовать содержимое страницы для оценки релевантности показа объявления.

3 мин

Keys.so Bot (keys-so-bot)

Keys-so-bot — краулер российского SEO-сервиса Keys.so (оператор — компания «Битерика Групп»), который используется для сбора данных о видимости сайтов в органической и контекстной выдаче Яндекса и Google, анализа семантического ядра конкурентов и построения истории изменений файлов robots.txt. Это не поисковый робот в классическом смысле — он не индексирует страницы для показа в результатах поиска, а сканирует сайты в интересах пользователей сервиса, которые анализируют конкурентов.

3 мин

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.