Боты4 мин чтения·12 августа 2026 г.

YouBot: краулер You.com с криптографической верификацией через Web Bot Auth

YouBot строит индекс для AI-поиска You.com — платформы с акцентом на разговорные ответы и приватность. Разбираем, как устроена подпись HTTP-запросов через протокол Web Bot Auth (более строгий метод верификации, чем просто UA или rDNS), и почему блокировка одного AI-поискового краулера не убирает сайт из всей экосистемы AI-поиска сразу.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота YouBot: нежелательный прочие краулеры и сервисы

YouBot принадлежит You.com — поисковой системе, построенной вокруг AI-ответов и делающей акцент на приватности пользователя. По независимым обзорам краулер официально соблюдает robots.txt, а по данным Cloudflare Radar даже поддерживает современный криптографический протокол верификации запросов Web Bot Auth — публикует директорию ключей для проверки подписи HTTP-сообщений, аналогично тому, как это устроено у DuckAssistBot из этой серии.

Чем занимается You.com и зачем ей краулер

You.com — поисковая система, которая вместо привычного списка синих ссылок делает акцент на AI-синтезированных ответах и разговорном формате: пользователь получает не просто список результатов, а сформированный ответ с прямыми ссылками на источники внутри текста. Помимо основного поиска, платформа предлагает AI-чат, поиск по коду и интеграцию социального поиска. Именно YouBot строит индекс, который лежит в основе этих функций: он собирает публичный веб-контент, чтобы AI-ассистент You.com мог отвечать на вопросы пользователей и подкреплять ответы ссылками на реальные источники, оформленными как inline-цитирования прямо внутри текста ответа.

Параметры бота

Параметр Значение
User-Agent Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; YouBot/1.0; +https://docs.you.com/youbot; env:prod) Chrome/X.X.X.X Safari/537.36
Оператор You.com
Официальная документация docs.you.com/youbot
Назначение Индексация веб-контента для AI-поиска и разговорных ответов с цитированием источников
Соблюдение robots.txt Да, по независимым обзорам официально подтверждено; поддерживает директиву Crawl-delay, как и большинство современных AI-поисковых краулеров
Верификация подлинности Поддерживает протокол Web Bot Auth — публикует директорию криптографических ключей по адресу you.com/.well-known/http-message-signatures-directory для проверки подписи HTTP-запросов, что даёт более строгий уровень верификации, чем просто совпадение UA или rDNS
Способ обнаружения сайтов Стандартные методы: переход по ссылкам с уже проиндексированных ресурсов, обработка sitemap, упоминания домена в других частях веба
Список IP-адресов ❌ Компактного официального фида, аналогичного, например, спискам Google или Bing, обычно нет

Как YouBot соотносится с обучением моделей и позициями в других поисковиках

По независимым источникам, блокировка YouBot затрагивает только использование контента для AI-функций и обучающих аспектов, связанных именно с You.com, — она никак не влияет на позиции сайта в классической выдаче Google, Bing или Яндекса, поскольку это отдельная, не связанная между собой экосистема индексации. При этом стоит держать в уме общее правило для всей категории AI-поисковых краулеров: блокировка одного конкретного бота не убирает сайт из всех AI-продуктов сразу — если важна полная невидимость для AI-поиска в целом, нужно отдельно управлять каждым краулером соответствующей платформы.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Сколько трафика он создаёт

По сводке TrafficVeil, паттерн запросов youbot на подключённых доменах составил порядка 4 тысяч. Это умеренный объём, характерный для AI-поисковых краулеров этого масштаба, не создающий заметной фоновой нагрузки для большинства сайтов.

Как найти бота в логах

grep -i "YouBot" /var/log/nginx/access.log

Для более строгой верификации, помимо совпадения строки UA, можно сверить подпись запроса через опубликованную директорию ключей Web Bot Auth — это надёжнее, чем полагаться на одну лишь строку заголовка, которую в принципе может подделать любой скрипт.

Стоит ли блокировать

  • если для сайта важна видимость в AI-поиске You.com с цитированием и потенциальным реферальным трафиком от пользователей платформы — бота стоит разрешить;
  • если приоритет — полностью исключить использование контента в AI-продуктах You.com — блокировка не затрагивает позиции сайта в классических поисковых системах;
  • полное исключение из всей AI-поисковой экосистемы требует отдельного управления каждым краулером соответствующей платформы, а не одним общим правилом.

Как настроить robots.txt

Явное разрешение:

User-agent: YouBot
Allow: /

Полный запрет:

User-agent: YouBot
Disallow: /

Ограничение скорости вместо полного запрета при заметной нагрузке:

User-agent: YouBot
Crawl-delay: 10

Для гарантированного результата на уровне сервера:

if ($http_user_agent ~* "YouBot") {
    return 403;
}

Частые вопросы

YouBot соблюдает правила robots.txt?
Да, по независимым обзорам это официально подтверждено, включая поддержку директивы Crawl-delay.
Как устроена AI-поисковая функция You.com, для которой работает бот?
Вместо списка ссылок платформа выдаёт разговорный AI-синтезированный ответ с прямыми inline-цитированиями источников внутри текста.
Как строже всего проверить подлинность запроса от YouBot?
Через сверку криптографической подписи запроса по протоколу Web Bot Auth — оператор публикует директорию ключей для этой проверки, что надёжнее простого совпадения User-Agent.
Повлияет ли блокировка YouBot на позиции в Google или Bing?
Нет, это отдельная экосистема индексации, не связанная с классическими поисковыми системами.
Достаточно ли заблокировать YouBot, чтобы исключить сайт из всего AI-поиска?
Нет, каждая платформа AI-поиска использует своего краулера — для полного исключения нужно управлять каждым отдельно.
Что делать при заметной нагрузке от бота?
Использовать директиву Crawl-delay вместо полной блокировки — YouBot её поддерживает.
#youbot#You.com#AI-поиск#Web Bot Auth#бот-энциклопедия#robots.txt#verification#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil