TrafficVeil
Yandex боты 3 мин25 июня 2026 г.

Yandex Userproxy бот

YandexUserproxy — один из наименее документированных агентов в экосистеме Яндекса. В отличие от YandexBot, YandexImages или YandexNews, Яндекс не публикует официального описания этого агента в своей документации для вебмастеров. Тем не менее он регулярно появляется в логах серверов и заслуживает внимательного изучения.

TV
TrafficVeil Team
Эксперты по защите веб-трафика
Содержание статьи
  1. 1. Что такое YandexUserproxy
  2. 1.1 User-Agent строка
  3. 1.2 Место в экосистеме Яндекс-агентов
  4. 1.3 Ключевые особенности
  5. 1.4 IP-адреса
  6. 2. Для чего используется YandexUserproxy
  7. 2.1 Прокси для Яндекс-сервисов с пользовательским контекстом
  8. 2.2 Контентный рендеринг для сервисов
  9. 2.3 Что достоверно известно vs что предположительно
  10. 3. Как YandexUserproxy появляется в логах
  11. 3.1 Характерные паттерны запросов
  12. 3.2 Как выглядит запись в логе
  13. 3.3 Аналитика через grep
  14. 3.4 Верификация подлинности
  15. 4. Нагрузка на сервер
  16. 4.1 Контекст из реальных данных
  17. 4.2 Характер нагрузки
  18. 5. Управление YandexUserproxy
DDoS L7

DDoS атака что это простыми словами и как защитить сайт

Разобрали виды атак, признаки DDoS, последствия, уровни защиты, L7 DDoS и схему подключения TrafficVeil через DNS/reverse proxy.

Читать про DDoS

Энциклопедия ботов TrafficVeil

618 ботов с описаниями, паттернами User-Agent и фильтром по категориям — открытый справочник для аудита логов и настройки защиты.

Открыть справочник

 

Первые упоминания YandexUserproxy в логах датируются началом 2024 года. По своей природе это прокси-агент: он не является краулером в традиционном смысле, не индексирует контент для основной поисковой выдачи и работает иначе, чем основной YandexBot. Его задача — выступать посредником между пользователем и веб-ресурсом в рамках различных Яндекс-сервисов.

1. Что такое YandexUserproxy

1.1 User-Agent строка

Mozilla/5.0 (compatible; YandexUserproxy; robot; +http://yandex.com/bots)

Обратите внимание на слово robot в строке — это прямое указание на автоматизированную природу агента. Большинство Яндекс-краулеров не включают этот маркер явно в строку User-Agent.

1.2 Место в экосистеме Яндекс-агентов

Агент Тип Основная задача Влияет на SEO?
YandexBot Краулер Индексация страниц для поиска ✔ Да, напрямую
YandexRenderResourcesBot Специализированный краулер Загрузка ресурсов для JS-рендеринга ✔ Косвенно
YandexUserproxy Прокси-агент Посредник между пользователем и ресурсом ✖ Не напрямую
YandexMobileBot Краулер Индексация мобильных версий ✔ Да
YandexImages Специализированный краулер Индексация изображений ✔ Да (картинки)
YandexDirectFetcher Рекламный агент Проверка страниц для Яндекс.Директ Влияет на рекламу

1.3 Ключевые особенности

  • Прокси по природе — действует как посредник, а не самостоятельный краулер
  • Появился в 2024 году — относительно новый агент, слабо задокументированный
  • Слово «robot» в UA — явно декларирует автоматизированный характер
  • Низкая частота — появляется значительно реже, чем YandexBot
  • Не индексирует контент — не влияет напрямую на позиции в поиске Яндекса
  • Подчиняется групповым правилам Яндекса — реагирует на директиву User-agent: Yandex в robots.txt

1.4 IP-адреса

YandexUserproxy использует инфраструктуру Яндекса — автономные системы AS13238, AS208722 и AS212066. Яндекс намеренно не публикует фиксированный список IP-адресов своих ботов, так как они регулярно меняются. Верификация через DNS — единственный надёжный способ проверки подлинности:

# IP-адреса YandexUserproxy резолвируются в домены:
*.yandex.ru
*.yandex.com
*.yandex.net

# Проверка подлинности — двухэтапный DNS lookup:
host [IP_адрес]
# Должен вернуть хост вида *.yandex.ru или *.yandex.net

host [полученный_хост]
# Должен вернуть исходный IP

2. Для чего используется YandexUserproxy

Яндекс официально не описывает конкретные сценарии использования YandexUserproxy. На основе анализа паттернов поведения агента в логах и архитектуры Яндекс-сервисов можно выделить несколько наиболее вероятных назначений.

2.1 Прокси для Яндекс-сервисов с пользовательским контекстом

Ключевое слово в названии — Userproxy, а не просто Proxy. Это указывает на то, что агент действует в контексте конкретного пользовательского запроса или взаимодействия, а не как автономный краулер по расписанию. Вероятные сценарии:

  • Яндекс.Браузер (Turbo-режим) — когда браузер запрашивает облегчённую версию страницы через серверы Яндекса, запрос может идти через YandexUserproxy
  • Алиса (голосовой ассистент) — при ответах на вопросы, требующих получения актуального содержимого веб-страниц в реальном времени
  • Яндекс.Поиск с расширенным сниппетом — предварительная загрузка контента страницы для формирования более информативного сниппета
  • Prefetch и предзагрузка — загрузка ресурсов страниц, которые пользователь вероятно откроет следующими

2.2 Контентный рендеринг для сервисов

YandexUserproxy может участвовать в рендеринге страниц для сервисов, которым нужна «живая» версия контента, а не кешированная копия из индекса:

  • Получение актуальных данных с JavaScript-страниц для Алисы
  • Формирование превью ссылок в Яндекс-мессенджерах и сервисах
  • Проверка доступности и актуальности контента для Яндекс.Новостей или Дзена
  • Загрузка ресурсов при серверном рендеринге через облачную инфраструктуру Яндекса

2.3 Что достоверно известно vs что предположительно

Утверждение Статус Источник
User-Agent строка YandexUserproxy; robot ✔ Достоверно Логи серверов, базы данных UA
Принадлежит Яндексу (AS13238) ✔ Достоверно DNS верификация, ASN
Появился в начале 2024 года ✔ Достоверно Хронология упоминаний в логах
Не индексирует для основного поиска ✔ Достоверно Паттерны запросов, отсутствие в индексе
Связан с пользовательскими запросами ⚠ Предположительно Анализ названия и паттернов
Используется Алисой / Turbo-страницами ⚠ Предположительно Косвенные признаки, нет официального подтверждения
Уважает robots.txt директивы Yandex ✔ Достоверно Официальная документация Яндекса по UA

3. Как YandexUserproxy появляется в логах

3.1 Характерные паттерны запросов

YandexUserproxy в логах отличается от YandexBot несколькими характерными признаками:

  • Низкая частота — появляется редко, единичными запросами, а не сериями как краулер
  • Точечные запросы — обычно запрашивает конкретные страницы, а не обходит сайт целиком
  • Нет паттерна обхода ссылок — не следует по внутренним ссылкам страниц
  • Может включать Referer — иногда содержит заголовок Referer, указывающий источник запроса
  • Запросы к разным ресурсам — HTML, изображения, CSS в зависимости от задачи

3.2 Как выглядит запись в логе

# Nginx access.log — запрос к HTML-странице:
77.88.21.144 - - [08/May/2026:23:10:44 +0000] \
  "GET /article/yandex-seo-2026/ HTTP/1.1" \
  200 28432 "-" \
  "Mozilla/5.0 (compatible; YandexUserproxy; robot; \
  +http://yandex.com/bots)"

# Запрос с Referer (признак пользовательского контекста):
77.88.21.145 - - [08/May/2026:23:10:46 +0000] \
  "GET /about/ HTTP/1.1" \
  200 12180 "https://yandex.ru/search/?text=о+нас" \
  "Mozilla/5.0 (compatible; YandexUserproxy; robot; \
  +http://yandex.com/bots)"

# Запрос к изображению или ресурсу:
77.88.21.146 - - [08/May/2026:23:11:00 +0000] \
  "GET /images/cover.jpg HTTP/1.1" \
  200 87432 "https://example.com/article/" \
  "Mozilla/5.0 (compatible; YandexUserproxy; robot; \
  +http://yandex.com/bots)"

3.3 Аналитика через grep

Найти все запросы YandexUserproxy:

grep -i 'YandexUserproxy' /var/log/nginx/access.log

Подсчитать количество запросов:

grep -i 'YandexUserproxy' access.log | wc -l

Топ запрашиваемых страниц:

grep -i 'YandexUserproxy' access.log \
  | awk '{print $7}' | sort | uniq -c | sort -nr | head -20

HTTP-коды ответов:

grep -i 'YandexUserproxy' access.log \
  | awk '{print $9}' | sort | uniq -c | sort -nr

Запросы с Referer (пользовательский контекст):

grep -i 'YandexUserproxy' access.log \
  | awk '$8 != "\"-\"" {print $8, $7}' | sort | uniq -c | sort -nr | head -10

Активность по часам суток:

grep -i 'YandexUserproxy' access.log \
  | awk '{print $4}' | cut -d: -f2 | sort | uniq -c | sort -n

Сравнить объём YandexUserproxy vs YandexBot:

echo "=== YandexBot ==="
grep -i 'YandexBot' access.log | grep -v 'UserProxy\|Userproxy' | wc -l

echo "=== YandexUserproxy ==="
grep -i 'YandexUserproxy' access.log | wc -l

Live-мониторинг:

tail -f /var/log/nginx/access.log \
  | grep --line-buffered -i 'YandexUserproxy'

3.4 Верификация подлинности

#!/bin/bash
# Проверка: настоящий ли YandexUserproxy?
IP=$1
HOST=$(host $IP | awk '{print $NF}')

if [[ $HOST == *yandex.ru* ]] || [[ $HOST == *yandex.com* ]] \
   || [[ $HOST == *yandex.net* ]]; then
  FWD=$(host $HOST | awk '{print $NF}')
  if [[ $FWD == $IP ]]; then
    echo "✔ Настоящий YandexUserproxy: $IP → $HOST"
  else
    echo "✖ Fake YandexUserproxy (DNS mismatch): $IP"
  fi
else
  echo "✖ Fake YandexUserproxy (нет PTR записи yandex.ru/com/net): $IP"
fi

4. Нагрузка на сервер

По данным реальных продакшен-логов (96 миллионов запросов за 91 день на сотнях доменов) YandexUserproxy генерирует минимальный объём трафика — значительно меньше основного YandexBot.

4.1 Контекст из реальных данных

В наблюдаемом периоде (март–июнь 2026, 696 доменов) распределение Яндекс-агентов выглядело так:

Яндекс-агент Запросов за 91 день Доля от общего трафика
YandexBot 2 126 141 2.21%
YandexImages 287 080 0.30%
YandexMobileBot 101 070 0.10%
YandexMetrika 20 273 0.02%
YandexRenderResourcesBot 16 727 0.02%
YandexDirectFetcher 15 806 0.02%
YandexFavicons 14 981 0.02%
YandexAccessibilityBot 6 078 0.01%

YandexUserproxy в этом наборе данных зафиксирован с объёмом, сопоставимым с YandexRenderResourcesBot и YandexDirectFetcher — то есть в диапазоне нескольких десятков тысяч запросов за квартал на большой выборке доменов. Для отдельного сайта это будет единицы или десятки запросов в день.

4.2 Характер нагрузки

Параметр YandexBot YandexUserproxy
Объём трафика Высокий Минимальный
Паттерн запросов Систематический обход всего сайта Точечные запросы к конкретным страницам
Частота Ежедневно, многократно Редко, эпизодически
Следует по ссылкам ✔ Да ✖ Нет
Скачивает зависимые ресурсы Частично Может (изображения, CSS)

5. Управление YandexUserproxy

5.1 robots.txt — как работает

Согласно официальной документации Яндекса, все агенты с токеном «Yandex» в User-Agent подчиняются директиве User-agent: Yandex в robots.txt. Это означает, что YandexUserproxy управляется через групповые правила для всех Яндекс-ботов — либо через явное указание его User-Agent токена.

# Групповое правило для всех Яндекс-агентов:
User-agent: Yandex
Disallow: /private/
Crawl-delay: 2

# Явное правило только для YandexUserproxy:
User-agent: YandexUserproxy
Disallow: /

# Разрешить всё для YandexUserproxy явно:
User-agent: YandexUserproxy
Allow: /

# Полная блокировка (крайний случай):
User-agent: YandexUserproxy
Disallow: /
# Последствие: Яндекс-сервисы не смогут получить контент через этот агент

Важно: согласно документации Яндекса, если для агента найдена явная запись User-agent: YandexUserproxy — директива User-agent: Yandex для него игнорируется. Если явной записи нет — применяется групповое правило User-agent: Yandex. Если нет и группового правила — агент считается неограниченным.

5.2 Блокировка через .htaccess (Apache)

RewriteEngine On

# Блокировка YandexUserproxy:
RewriteCond %{HTTP_USER_AGENT} YandexUserproxy [NC]
RewriteRule .* - [F,L]

# Блокировка конкретного раздела:
RewriteCond %{HTTP_USER_AGENT} YandexUserproxy [NC]
RewriteCond %{REQUEST_URI} ^/private/ [NC]
RewriteRule .* - [F,L]

5.3 Блокировка через Nginx

map $http_user_agent $is_yandex_userproxy {
    default             0;
    "~*YandexUserproxy" 1;
}

# Блокировка всего сайта:
if ($is_yandex_userproxy) {
    return 403;
}

# Блокировка конкретного раздела:
location /private/ {
    if ($is_yandex_userproxy) {
        return 403;
    }
}

# Блокировка вместе с другими Яндекс-агентами:
map $http_user_agent $is_yandex_all {
    default              0;
    "~*YandexUserproxy"  1;
    "~*YandexBot"        1;
    "~*YandexImages"     1;
}
if ($is_yandex_all) { return 403; }

5.4 Когда блокировка оправдана

Сценарий Рекомендация
Закрытый раздел (личный кабинет, API) Блокировать через robots.txt или сервер
Страницы только для авторизованных Закрыть авторизацией — агент не пройдёт
Ресурсоёмкие страницы (тяжёлый рендеринг) Ограничить через Crawl-delay в robots.txt
Сайт без русскоязычной аудитории Можно заблокировать — вреда от этого немного
Сайт с русскоязычной аудиторией Не блокировать — может ухудшить работу Яндекс-сервисов
Публичный контент для Алисы/поиска Оставить открытым — это полезный трафик

6. YandexUserproxy vs похожие агенты Яндекса

Агент UA токен Основная задача Тип
YandexBot YandexBot/3.0 Индексация всего сайта для поиска Краулер
YandexMobileBot YandexMobileBot/3.0 Индексация мобильных версий Краулер
YandexRenderResourcesBot YandexRenderResourcesBot/1.0 Загрузка CSS/JS/изображений для рендеринга Технический краулер
YandexUserproxy YandexUserproxy; robot Прокси для пользовательских запросов в сервисах Прокси-агент
YandexDirectFetcher YandexDirectFetcher Проверка страниц для Директ (реклама) Рекламный агент
YandexMetrika YandexMetrika Сбор данных для счётчиков Метрики Аналитический агент
YandexAccessibilityBot YandexAccessibilityBot Проверка доступности сайтов Технический агент

Принципиальное отличие от YandexRenderResourcesBot

Вопрос, который часто возникает при изучении логов: чем YandexUserproxy отличается от YandexRenderResourcesBot? Оба агента могут запрашивать ресурсы страниц (CSS, JS, изображения), но их природа разная:

  • YandexRenderResourcesBot — работает в паре с YandexBot при плановом краулинге. Когда YandexBot обходит страницу и видит JavaScript, RenderResourcesBot скачивает зависимые ресурсы для рендеринга. Это часть процесса индексации.
  • YandexUserproxy — действует в контексте пользовательского запроса или взаимодействия с Яндекс-сервисом. Это не плановый краулинг, а реакция на конкретное действие пользователя или сервиса.

7. Диагностика проблем

7.1 Признаки проблем с YandexUserproxy

  • В логах появляются 403 или 404 ответы на запросы YandexUserproxy к публичным страницам
  • Яндекс-сервисы (Алиса, Браузер) некорректно отображают контент вашего сайта
  • Превью ссылок в Яндекс-продуктах отображаются с ошибкой или пустыми
  • Нестандартно высокое число запросов от YandexUserproxy — возможна поддельная активность

7.2 Диагностика через curl

# Симулировать запрос YandexUserproxy к странице:
curl -A "Mozilla/5.0 (compatible; YandexUserproxy; robot; +http://yandex.com/bots)" \
  -I https://example.com/article/

# Ожидаемый результат: HTTP/1.1 200 OK
# Проблема: 403 Forbidden — агент заблокирован

# Проверить robots.txt:
curl https://example.com/robots.txt | grep -i 'yandexuserproxy\|yandex'

# Убедиться что страница доступна без ограничений:
curl -A "Mozilla/5.0 (compatible; YandexUserproxy; robot; +http://yandex.com/bots)" \
  -L https://example.com/article/ | head -50

7.3 Типичные проблемы

Проблема Причина Решение
Агент получает 403 Заблокирован в robots.txt или на уровне сервера Убрать блокировку или добавить явное Allow
Превью в Яндекс-сервисах пустые Агент не может получить контент страницы Убедиться в публичной доступности страницы
Много запросов от неверифицированных IP Боты маскируются под YandexUserproxy DNS-верификация + блокировка по IP на уровне WAF
Агент запрашивает только одну страницу много раз Возможна ошибка на стороне Яндекс-сервиса Проверить через Яндекс.Вебмастер, контакт с поддержкой

Полезные ссылки: Яндекс — документация по User-Agent в robots.txt | Проверка принадлежности бота Яндексу | Яндекс.Вебмастер | IP-адреса Яндекса

Другие гайды по ботам

Частые вопросы

Почему Яндекс не документирует YandexUserproxy официально?

Это распространённая практика у крупных IT-компаний: внутренние технические агенты, не имеющие прямого отношения к SEO и индексации, часто не упоминаются в публичной документации для вебмастеров. Яндекс документирует агентов, управление которыми важно для оптимизации сайта под поиск. YandexUserproxy работает на инфраструктурном уровне и не требует активного взаимодействия со стороны владельца сайта.

Нужно ли беспокоиться об YandexUserproxy в логах?

В большинстве случаев нет. Если вы видите единичные запросы от верифицированных IP Яндекса — это нормальная работа Яндекс-инфраструктуры. Поводом для внимания могут быть: аномально высокое число запросов от одного IP, запросы от IP, не принадлежащих Яндексу (потенциальная подделка), или запросы, возвращающие 403/404 на публичные страницы.

Влияет ли YandexUserproxy на SEO и позиции в Яндексе?

Напрямую — нет. YandexUserproxy не передаёт данные в поисковый индекс и не участвует в ранжировании. Косвенная связь возможна: если агент используется для формирования превью или ответов Алисы, качество вашего контента и его доступность влияют на то, как Яндекс-сервисы его представляют пользователям. Но это влияние на видимость в экосистеме Яндекса, а не на позиции в поиске.

Что делать если вижу много запросов от «YandexUserproxy» с разных IP?

Сначала верифицируйте IP через DNS: настоящий YandexUserproxy резолвируется в домены *.yandex.ru, *.yandex.com или *.yandex.net. Если часть IP не проходит верификацию — это поддельные боты, использующие User-Agent Яндекса. Их можно блокировать по ASN или через WAF-правила, не трогая реальные IP Яндекса (AS13238, AS208722, AS212066).

YandexUserproxy запрашивает страницы, которых нет на сайте. Почему?

Возможные причины: агент получил ссылку на страницу из внешнего источника (Яндекс-сервис, пользователь); страница ранее существовала и была удалена, но ссылка на неё сохранилась; поддельный агент случайно или намеренно сканирует несуществующие пути. Верифицируйте IP и верните корректный HTTP 410 Gone для удалённых страниц, а HTTP 404 для никогда не существовавших.

Может ли блокировка YandexUserproxy навредить сайту?

Для сайтов с активной русскоязычной аудиторией — потенциально да. Блокировка может ухудшить отображение контента в Яндекс.Браузере, ответы Алисы по теме вашего сайта или превью ссылок в Яндекс-продуктах. Для сайтов без аудитории из России и СНГ — практически нет, блокировка безопасна. В любом случае блокировка YandexUserproxy не влияет на индексацию и позиции в Яндекс-поиске — это управляется через YandexBot.

Связан ли YandexUserproxy с Алисой (голосовым ассистентом)?

Возможно, но официального подтверждения нет. Название «Userproxy» и паттерн точечных запросов (не системный обход) совпадают с тем, как работает голосовой ассистент, получающий актуальный контент страниц по запросу пользователя. Алиса с 2024 года работает на YandexGPT 3 и активно использует веб-контент для формирования ответов. Однако без официального комментария Яндекса это остаётся предположением.

Как убедиться что robots.txt правильно управляет YandexUserproxy?

Проверьте через инструмент «Анализ robots.txt» в Яндекс.Вебмастер, введя строку YandexUserproxy в поле User-Agent. Дополнительно проверьте через curl: curl -A "Mozilla/5.0 (compatible; YandexUserproxy; robot; +http://yandex.com/bots)" -I https://example.com/ваша-страница/ — ответ покажет, как сервер обрабатывает запросы от этого агента.

Нужно ли специально что-то настраивать для YandexUserproxy?

Нет. Для большинства сайтов достаточно стандартного robots.txt с правилами для Яндекса. Если вы уже правильно настроили доступ для YandexBot — YandexUserproxy будет работать в рамках тех же групповых ограничений через директиву User-agent: Yandex. Отдельная настройка требуется только если вы хотите управлять этим агентом иначе, чем остальными Яндекс-ботами.

TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.