Открытый справочник User-Agent: кто обращается к вашему серверу, легитимен ли визит и что с ним делать на уровне WAF, nginx или антибот-системы. Данные синхронизированы с базой TrafficVeil Bot Detection.
Показано 25–48 из 362 ботов · по алфавиту
Программный агент Anomura запрашивает URL по расписанию или из очереди задач. Классифицирован как нежелательный для владельца контента. В логах прокси отражает bot-трафик, а не посещение человека из браузера.
UA: anomuraСканер Apify загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.
UA: apifybotАвтоматизированный краулер Apify: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «ApifyWebsiteContentCrawler».
UA: apifywebsitecontentcrawlerКраулер регулятора NGB (Netherlands) для проверки доступности gambling-доменов. Проверяет reachability URL в рамках compliance-мониторинга.
UA: argus-ngbЛегитимный сервис Arquivo-web-crawler: обращается к сайту для интеграции, верификации или доставки функции клиенту. Запросы связаны с настройками аккаунта, а не с массовым scraping.
UA: arquivoСканер Assaybot загружает веб-страницы для анализа контента, ссылок или технических параметров. Классифицирован как нежелательный для владельца контента. Нагрузка на origin зависит от частоты и глубины обхода.
UA: assaybotПрограммный агент Atlassian запрашивает URL по расписанию или из очереди задач. Классифицирован как нежелательный для владельца контента. В логах прокси отражает bot-трафик, а не посещение человека из браузера.
UA: atlassian-botКомпонент Authory проверяет URL при установке виджета, webhook или tracking-кода на сайте. Подтверждает корректность интеграции от имени пользователя сервиса.
UA: authoryИнфраструктура Automaton загружает страницы или ресурсы в рамках штатной работы платформы. Обычно ожидаемый трафик при подключении сайта к сервису.
UA: automatonПрограммный агент AutomatonHeadlessChrome запрашивает URL по расписанию или из очереди задач. Классифицирован как нежелательный для владельца контента. В логах прокси отражает bot-трафик, а не посещение человека из браузера.
UA: headlesschromeПрограммный агент Awario запрашивает URL по расписанию или из очереди задач. Классифицирован как нежелательный для владельца контента. В логах прокси отражает bot-трафик, а не посещение человека из браузера.
UA: awarioАвтоматизированный краулер Awario: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «AwarioBot».
UA: awariobotАвтоматизированный краулер AwarioSmart: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «AwarioSmartBot».
UA: awariosmartbotЛегитимный сервис BackupLand: обращается к сайту для интеграции, верификации или доставки функции клиенту. Запросы связаны с настройками аккаунта, а не с массовым scraping.
UA: backuplandКомпонент BazQux проверяет URL при установке виджета, webhook или tracking-кода на сайте. Подтверждает корректность интеграции от имени пользователя сервиса.
UA: bazquxЛегитимный сервис BestChange: обращается к сайту для интеграции, верификации или доставки функции клиенту. Запросы связаны с настройками аккаунта, а не с массовым scraping.
UA: bestchangeИнфраструктура Big Sur AI загружает страницы или ресурсы в рамках штатной работы платформы. Обычно ожидаемый трафик при подключении сайта к сервису.
UA: big sur aiЛегитимный сервис bigsur.ai: обращается к сайту для интеграции, верификации или доставки функции клиенту. Запросы связаны с настройками аккаунта, а не с массовым scraping.
UA: bigsur.aiКраулер BilateralNavigator-PageFetch для двусторонней загрузки страниц в research-проектах. Обходит URL из очередей академических или архивных заданий.
UA: bilateralnavigatorЛегитимный сервис binarycanary: обращается к сайту для интеграции, верификации или доставки функции клиенту. Запросы связаны с настройками аккаунта, а не с массовым scraping.
UA: binarycanaryКомпонент Bitly проверяет URL при установке виджета, webhook или tracking-кода на сайте. Подтверждает корректность интеграции от имени пользователя сервиса.
UA: bitlybotПрограммный агент BitSight запрашивает URL по расписанию или из очереди задач. Классифицирован как нежелательный для владельца контента. В логах прокси отражает bot-трафик, а не посещение человека из браузера.
UA: bitsightbotАвтоматизированный краулер British Library: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «bl.uk_lddc_bot».
UA: bl.uk-lddc-botАвтоматизированный краулер Blackboard: обходит страницы для сбора данных, индекса или мониторинга. Классифицирован как нежелательный для владельца контента. Конкретная цель зависит от оператора, использующего идентификатор «Blackboard».
UA: blackboardUser-Agent — только повод присмотреться: подделать строку может кто угодно. Решение принимается по совокупности признаков, и каждый из них проверяется отдельно.
Главная проверка для поисковиков: адрес разворачивается в имя, имя — обратно в адрес. Подделка под Googlebot и YandexBot отсекается именно здесь, а не по строке User-Agent.
Скрипт на Python или Go здоровается с сервером иначе, чем настоящий Chrome. Расхождение отпечатка рукопожатия с заявленным браузером — прямой признак подмены.
Человек читает, кликает и загружает картинки. Бот берёт только HTML, идёт по каталогу подряд и держит ровный интервал между запросами — паттерн виден за минуту.
Запрос из дата-центра под видом мобильного пользователя — уже аномалия. Смотрим владельца сети, её тип и репутацию соседних адресов того же диапазона.
Порядок и состав заголовков у браузеров стабилен. Отсутствие Accept-Language, странный Accept-Encoding и пустой Referer в связке с тяжёлым обходом дают уверенный вердикт.
Поверх признаков — списки известных адресов: 7,1 млн записей из РКН, Tor exit, публичных VPN, ботнетов и поддельных поисковиков. Обновляются ежедневно.
107 краулеров в справочнике собирают тексты для языковых моделей. Универсального ответа нет: издателю и интернет-магазину выгодны разные решения.
Контент попадает в ответы ChatGPT, Perplexity и Gemini со ссылкой на источник. Для медиа, блогов и справочных проектов это новый канал переходов.
Кому подходит: издания, блоги, документация, B2B-контент
Лимит частоты и доступ только к публичным разделам. Модели видят витрину и статьи, но не выгребают каталог, цены и пользовательский контент целиком.
Кому подходит: магазины, сервисы, площадки с каталогом
Запрет по User-Agent и по сетям владельца модели. Имеет смысл, когда контент — основной актив и он уже уходит к конкурентам через агрегаторы.
Кому подходит: платный контент, базы, уникальные исследования
Энциклопедия ботов TrafficVeil — открытый справочник User-Agent для более чем 600 известных краулеров, поисковых роботов, AI-агентов, мониторинговых клиентов и сервисных ботов, которые ежедневно обращаются к сайтам. Если вы администратор сайта, SEO-специалист, разработчик или специалист по информационной безопасности, каталог поможет быстро понять, кто обращается к вашему серверу, легитимен ли визит и стоит ли пропускать или блокировать трафик на уровне WAF, nginx или антибот-системы.
Каждая карточка содержит название бота, паттерн User-Agent для распознавания в access.log и правилах фильтрации, краткое описание на русском языке и метку: легитимный или нежелательный посетитель. Боты сгруппированы по десяти категориям (cluster): поисковые роботы — Googlebot, YandexBot, Bingbot; AI и LLM-краулеры — GPTBot, ClaudeBot, PerplexityBot; мониторинг доступности; RSS и фиды; превью ссылок в соцсетях; рекламные и AdTech-боты; SEO и backlink-краулеры; технические клиенты; веб-архивы; прочие сервисные агенты.
Справочник поддерживает полнотекстовый поиск по названию, описанию и паттерну UA, фильтрацию по категории cluster и разделение на легитимных и нежелательных посетителей. Данные синхронизированы с базой TrafficVeil Bot Detection и применяются в продакшене для ML-классификации трафика, rate limiting и WAF-правил.
Владельцы сайтов получают тысячи автоматических запросов в сутки. Часть полезна — индексация в поиске, проверка uptime, генерация Open Graph-превью. Часть перегружает сервер, парсит цены, скликивает рекламу или собирает контент конкурентами. Без понимания User-Agent сложно настроить robots.txt или антибот. Энциклопедия снимает неопределённость: находите бота по имени, читаете назначение и принимаете решение в панели TrafficVeil.
TrafficVeil — российская платформа защиты веб-трафика с детект ботов, L7-фильтрами, DNS, SSL и GeoIP. WAF входит со Starter. Тарифа на трафик нет: вы платите за домены и состав функций. Используйте каталог для аудита логов, настройки whitelist и blacklist, отчётов по бот-трафику и обучения команды. На бесплатном тарифе доступен стартовый контур защиты для 1 домена: проксирование, SSL, детект ботов и лимиты.
Подключите домен и посмотрите живую ленту: какие боты приходят, что они забирают и сколько это стоит вашему серверу. Запросы ботов и атак в тариф не считаются.
Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.