ГлавнаяЭнциклопедия ботов
Bot Detection

Энциклопедия ботов

Открытый справочник User-Agent: кто обращается к вашему серверу, легитимен ли визит и что с ним делать на уровне WAF, nginx или антибот-системы. Данные синхронизированы с базой TrafficVeil Bot Detection.

618ботов в справочнике с описанием на русском
10категорий: от поисковиков до парсеров
620подробных разбора в блоге
7,1 млнадресов в базах блокировок сервиса

Показано 121–144 из 206 ботов · по алфавиту

Уникальная иллюстрация бота Nicecrawler: нежелательный прочие краулеры и сервисы

Nicecrawler

Нежелательный
Прочие краулеры и сервисы

Программный агент Nicecrawler запрашивает URL по расписанию или из очереди задач. Классифицирован как нежелательный для владельца контента. В логах прокси отражает bot-трафик, а не посещение человека из браузера.

UA: nicecrawler
ОграничиватьПодробнее
Уникальная иллюстрация бота NIXStatsbot: нежелательный прочие краулеры и сервисы

NIXStatsbot

Нежелательный
Прочие краулеры и сервисы

Автоматизированный краулер NIXStatsbot: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «NIXStatsbot».

UA: nixstatsbot
ОграничиватьПодробнее
Уникальная иллюстрация бота NostoCrawlerBot: нежелательный прочие краулеры и сервисы

NostoCrawlerBot

Нежелательный
Прочие краулеры и сервисы

Сканер Nosto загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: nostocrawlerbot
ОграничиватьПодробнее
Уникальная иллюстрация бота OI-Crawler: нежелательный прочие краулеры и сервисы

OI-Crawler

Нежелательный
Прочие краулеры и сервисы

Сканер OI- загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: oi-crawler
ОграничиватьПодробнее
Уникальная иллюстрация бота omgili: нежелательный прочие краулеры и сервисы

omgili

Нежелательный
Прочие краулеры и сервисы

Автоматизированный краулер omgili: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «omgili».

UA: omgili
ОграничиватьПодробнее
Уникальная иллюстрация бота OnlineOrNot.com_bot: нежелательный прочие краулеры и сервисы

OnlineOrNot.com_bot

Нежелательный
Прочие краулеры и сервисы

Программный агент OnlineOrNot.com_bot запрашивает URL по расписанию или из очереди задач. Классифицирован как нежелательный для владельца контента. В логах прокси отражает bot-трафик, а не посещение человека из браузера.

UA: onlineornot.com
ОграничиватьПодробнее
Уникальная иллюстрация бота OpenCode: нежелательный прочие краулеры и сервисы

OpenCode

Нежелательный
Прочие краулеры и сервисы

Программный агент OpenCode запрашивает URL по расписанию или из очереди задач. Классифицирован как нежелательный для владельца контента. В логах прокси отражает bot-трафик, а не посещение человека из браузера.

UA: opencode
ОграничиватьПодробнее
Уникальная иллюстрация бота Owler: нежелательный прочие краулеры и сервисы

Owler

Нежелательный
Прочие краулеры и сервисы

Автоматизированный краулер Owler: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «Owler».

UA: owler
ОграничиватьПодробнее
Уникальная иллюстрация бота Pandalytics: нежелательный прочие краулеры и сервисы

Pandalytics

Нежелательный
Прочие краулеры и сервисы

Сканер Pandalytics загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: pandalytics
ОграничиватьПодробнее
Уникальная иллюстрация бота PanguBot: нежелательный прочие краулеры и сервисы

PanguBot

Нежелательный
Прочие краулеры и сервисы

Автоматизированный краулер Pangu: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «PanguBot».

UA: pangubot
ОграничиватьПодробнее
Уникальная иллюстрация бота panscient.com: нежелательный прочие краулеры и сервисы

panscient.com

Нежелательный
Прочие краулеры и сервисы

Сканер panscient.com загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: panscient.com
ОграничиватьПодробнее
Уникальная иллюстрация бота PaqleBot: нежелательный прочие краулеры и сервисы

PaqleBot

Нежелательный
Прочие краулеры и сервисы

Автоматизированный краулер Paqle: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «PaqleBot».

UA: paqlebot
ОграничиватьПодробнее
Уникальная иллюстрация бота PartnerOptimizer-bot: нежелательный прочие краулеры и сервисы

PartnerOptimizer-bot

Нежелательный
Прочие краулеры и сервисы

Сканер PartnerOptimizer-bot загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: partneroptimizer-bot
ОграничиватьПодробнее
Уникальная иллюстрация бота Phind: нежелательный прочие краулеры и сервисы

Phind

Нежелательный
Прочие краулеры и сервисы

Сканер Phind загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: phind
ОграничиватьПодробнее
Уникальная иллюстрация бота Poggio-Citations: нежелательный прочие краулеры и сервисы

Poggio-Citations

Нежелательный
Прочие краулеры и сервисы

Сканер Poggio-Citations загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: poggio-citations
ОграничиватьПодробнее
Уникальная иллюстрация бота PressEngineBot: нежелательный прочие краулеры и сервисы

PressEngineBot

Нежелательный
Прочие краулеры и сервисы

Сканер PressEngine загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: pressenginebot
ОграничиватьПодробнее
Уникальная иллюстрация бота ProductLookoutBot: нежелательный прочие краулеры и сервисы

ProductLookoutBot

Нежелательный
Прочие краулеры и сервисы

Автоматизированный краулер ProductLookout: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «ProductLookoutBot».

UA: productlookoutbot
ОграничиватьПодробнее
Уникальная иллюстрация бота proximic: нежелательный прочие краулеры и сервисы

proximic

Нежелательный
Прочие краулеры и сервисы

Сканер proximic загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: proximic
ОграничиватьПодробнее
Уникальная иллюстрация бота qcbot: нежелательный прочие краулеры и сервисы

qcbot

Нежелательный
Прочие краулеры и сервисы

Автоматизированный краулер qcbot: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «qcbot».

UA: qcbot
ОграничиватьПодробнее
Уникальная иллюстрация бота QualifiedBot: нежелательный прочие краулеры и сервисы

QualifiedBot

Нежелательный
Прочие краулеры и сервисы

Сканер Qualified загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: qualifiedbot
ОграничиватьПодробнее
Уникальная иллюстрация бота Qualys: нежелательный прочие краулеры и сервисы

Qualys

Нежелательный
Прочие краулеры и сервисы

Программный агент Qualys запрашивает URL по расписанию или из очереди задач. Классифицирован как нежелательный для владельца контента. В логах прокси отражает bot-трафик, а не посещение человека из браузера.

UA: qualys
ОграничиватьПодробнее
Уникальная иллюстрация бота Quantcastbot: нежелательный прочие краулеры и сервисы

Quantcastbot

Нежелательный
Прочие краулеры и сервисы

Автоматизированный краулер Quantcastbot: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «Quantcastbot».

UA: quantcastbot
ОграничиватьПодробнее
Уникальная иллюстрация бота QuillBot: нежелательный прочие краулеры и сервисы

QuillBot

Нежелательный
Прочие краулеры и сервисы

Программный агент Quill запрашивает URL по расписанию или из очереди задач. Классифицирован как нежелательный для владельца контента. В логах прокси отражает bot-трафик, а не посещение человека из браузера.

UA: quillbot
ОграничиватьПодробнее
Уникальная иллюстрация бота Quora-Bot: нежелательный прочие краулеры и сервисы

Quora-Bot

Нежелательный
Прочие краулеры и сервисы

Сканер Quora загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.

UA: quora-bot
ОграничиватьПодробнее

Как мы определяем ботов

User-Agent — только повод присмотреться: подделать строку может кто угодно. Решение принимается по совокупности признаков, и каждый из них проверяется отдельно.

Обратный DNS

Главная проверка для поисковиков: адрес разворачивается в имя, имя — обратно в адрес. Подделка под Googlebot и YandexBot отсекается именно здесь, а не по строке User-Agent.

PTR-записьпрямая сверкаофициальные диапазоны

Отпечаток TLS, JA3

Скрипт на Python или Go здоровается с сервером иначе, чем настоящий Chrome. Расхождение отпечатка рукопожатия с заявленным браузером — прямой признак подмены.

JA3 и JA4набор шифровпорядок расширений

Поведение на сайте

Человек читает, кликает и загружает картинки. Бот берёт только HTML, идёт по каталогу подряд и держит ровный интервал между запросами — паттерн виден за минуту.

ритм запросовглубина обходастатика и cookie

ASN и тип сети

Запрос из дата-центра под видом мобильного пользователя — уже аномалия. Смотрим владельца сети, её тип и репутацию соседних адресов того же диапазона.

хостинг или домашняя сетьVPN и Torблокировка по ASN

Заголовки запроса

Порядок и состав заголовков у браузеров стабилен. Отсутствие Accept-Language, странный Accept-Encoding и пустой Referer в связке с тяжёлым обходом дают уверенный вердикт.

порядок заголовковHTTP/2 fingerprintнесогласованность с UA

Базы и репутация

Поверх признаков — списки известных адресов: 7,1 млн записей из РКН, Tor exit, публичных VPN, ботнетов и поддельных поисковиков. Обновляются ежедневно.

РКНTor exitSpamhaus и IPsumFirehol

Что делать с AI-краулерами

107 краулеров в справочнике собирают тексты для языковых моделей. Универсального ответа нет: издателю и интернет-магазину выгодны разные решения.

Пропускать

Ставка на видимость

Контент попадает в ответы ChatGPT, Perplexity и Gemini со ссылкой на источник. Для медиа, блогов и справочных проектов это новый канал переходов.

Кому подходит: издания, блоги, документация, B2B-контент

Ограничивать

Компромисс по умолчанию

Лимит частоты и доступ только к публичным разделам. Модели видят витрину и статьи, но не выгребают каталог, цены и пользовательский контент целиком.

Кому подходит: магазины, сервисы, площадки с каталогом

Блокировать

Полный запрет

Запрет по User-Agent и по сетям владельца модели. Имеет смысл, когда контент — основной актив и он уже уходит к конкурентам через агрегаторы.

Кому подходит: платный контент, базы, уникальные исследования

Запрет обучения через robots.txt

# обучение моделей — запрещаем
User-agent: GPTBot
User-agent: ClaudeBot
User-agent: Google-Extended
User-agent: Bytespider
Disallow: /

# поиск с цитированием — оставляем
User-agent: OAI-SearchBot
User-agent: PerplexityBot
Allow: /
Disallow: /cart
Disallow: /account
robots.txt — это просьба, а не запрет. Крупные компании его соблюдают, десятки мелких скраперов представляются как AI-краулеры и не читают файл вовсе. Реальный запрет ставится на границе: правило по User-Agent, лимит частоты и блокировка сетей владельца модели.

О справочнике ботов TrafficVeil

Энциклопедия ботов TrafficVeil — открытый справочник User-Agent для более чем 600 известных краулеров, поисковых роботов, AI-агентов, мониторинговых клиентов и сервисных ботов, которые ежедневно обращаются к сайтам. Если вы администратор сайта, SEO-специалист, разработчик или специалист по информационной безопасности, каталог поможет быстро понять, кто обращается к вашему серверу, легитимен ли визит и стоит ли пропускать или блокировать трафик на уровне WAF, nginx или антибот-системы.

Каждая карточка содержит название бота, паттерн User-Agent для распознавания в access.log и правилах фильтрации, краткое описание на русском языке и метку: легитимный или нежелательный посетитель. Боты сгруппированы по десяти категориям (cluster): поисковые роботы — Googlebot, YandexBot, Bingbot; AI и LLM-краулеры — GPTBot, ClaudeBot, PerplexityBot; мониторинг доступности; RSS и фиды; превью ссылок в соцсетях; рекламные и AdTech-боты; SEO и backlink-краулеры; технические клиенты; веб-архивы; прочие сервисные агенты.

Справочник поддерживает полнотекстовый поиск по названию, описанию и паттерну UA, фильтрацию по категории cluster и разделение на легитимных и нежелательных посетителей. Данные синхронизированы с базой TrafficVeil Bot Detection и применяются в продакшене для ML-классификации трафика, rate limiting и WAF-правил.

Владельцы сайтов получают тысячи автоматических запросов в сутки. Часть полезна — индексация в поиске, проверка uptime, генерация Open Graph-превью. Часть перегружает сервер, парсит цены, скликивает рекламу или собирает контент конкурентами. Без понимания User-Agent сложно настроить robots.txt или антибот. Энциклопедия снимает неопределённость: находите бота по имени, читаете назначение и принимаете решение в панели TrafficVeil.

TrafficVeil — российская платформа защиты веб-трафика с детект ботов, L7-фильтрами, DNS, SSL и GeoIP. WAF входит со Starter. Тарифа на трафик нет: вы платите за домены и состав функций. Используйте каталог для аудита логов, настройки whitelist и blacklist, отчётов по бот-трафику и обучения команды. На бесплатном тарифе доступен стартовый контур защиты для 1 домена: проксирование, SSL, детект ботов и лимиты.

Узнайте, кто ходит по вашему сайту

Подключите домен и посмотрите живую ленту: какие боты приходят, что они забирают и сколько это стоит вашему серверу. Запросы ботов и атак в тариф не считаются.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

Справочник открыт и бесплатен · база обновляется еженедельно · 1 домен на бесплатном тарифе
TrafficVeil