YouBot принадлежит You.com — поисковой системе, построенной вокруг AI-ответов и делающей акцент на приватности пользователя. По независимым обзорам краулер официально соблюдает robots.txt, а по данным Cloudflare Radar даже поддерживает современный криптографический протокол верификации запросов Web Bot Auth — публикует директорию ключей для проверки подписи HTTP-сообщений, аналогично тому, как это устроено у DuckAssistBot из этой серии.
Чем занимается You.com и зачем ей краулер
You.com — поисковая система, которая вместо привычного списка синих ссылок делает акцент на AI-синтезированных ответах и разговорном формате: пользователь получает не просто список результатов, а сформированный ответ с прямыми ссылками на источники внутри текста. Помимо основного поиска, платформа предлагает AI-чат, поиск по коду и интеграцию социального поиска. Именно YouBot строит индекс, который лежит в основе этих функций: он собирает публичный веб-контент, чтобы AI-ассистент You.com мог отвечать на вопросы пользователей и подкреплять ответы ссылками на реальные источники, оформленными как inline-цитирования прямо внутри текста ответа.
Параметры бота
| Параметр | Значение |
| User-Agent | Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; YouBot/1.0; +https://docs.you.com/youbot; env:prod) Chrome/X.X.X.X Safari/537.36 |
| Оператор | You.com |
| Официальная документация | docs.you.com/youbot |
| Назначение | Индексация веб-контента для AI-поиска и разговорных ответов с цитированием источников |
| Соблюдение robots.txt | Да, по независимым обзорам официально подтверждено; поддерживает директиву Crawl-delay, как и большинство современных AI-поисковых краулеров |
| Верификация подлинности | Поддерживает протокол Web Bot Auth — публикует директорию криптографических ключей по адресу you.com/.well-known/http-message-signatures-directory для проверки подписи HTTP-запросов, что даёт более строгий уровень верификации, чем просто совпадение UA или rDNS |
| Способ обнаружения сайтов | Стандартные методы: переход по ссылкам с уже проиндексированных ресурсов, обработка sitemap, упоминания домена в других частях веба |
| Список IP-адресов | ❌ Компактного официального фида, аналогичного, например, спискам Google или Bing, обычно нет |
Как YouBot соотносится с обучением моделей и позициями в других поисковиках
По независимым источникам, блокировка YouBot затрагивает только использование контента для AI-функций и обучающих аспектов, связанных именно с You.com, — она никак не влияет на позиции сайта в классической выдаче Google, Bing или Яндекса, поскольку это отдельная, не связанная между собой экосистема индексации. При этом стоит держать в уме общее правило для всей категории AI-поисковых краулеров: блокировка одного конкретного бота не убирает сайт из всех AI-продуктов сразу — если важна полная невидимость для AI-поиска в целом, нужно отдельно управлять каждым краулером соответствующей платформы.
Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.
Сколько трафика он создаёт
По сводке TrafficVeil, паттерн запросов youbot на подключённых доменах составил порядка 4 тысяч. Это умеренный объём, характерный для AI-поисковых краулеров этого масштаба, не создающий заметной фоновой нагрузки для большинства сайтов.
Как найти бота в логах
grep -i "YouBot" /var/log/nginx/access.log
Для более строгой верификации, помимо совпадения строки UA, можно сверить подпись запроса через опубликованную директорию ключей Web Bot Auth — это надёжнее, чем полагаться на одну лишь строку заголовка, которую в принципе может подделать любой скрипт.
Стоит ли блокировать
- если для сайта важна видимость в AI-поиске You.com с цитированием и потенциальным реферальным трафиком от пользователей платформы — бота стоит разрешить;
- если приоритет — полностью исключить использование контента в AI-продуктах You.com — блокировка не затрагивает позиции сайта в классических поисковых системах;
- полное исключение из всей AI-поисковой экосистемы требует отдельного управления каждым краулером соответствующей платформы, а не одним общим правилом.
Как настроить robots.txt
Явное разрешение:
User-agent: YouBot
Allow: /
Полный запрет:
User-agent: YouBot
Disallow: /
Ограничение скорости вместо полного запрета при заметной нагрузке:
User-agent: YouBot
Crawl-delay: 10
Для гарантированного результата на уровне сервера:
if ($http_user_agent ~* "YouBot") {
return 403;
}Частые вопросы
YouBot соблюдает правила robots.txt?
Как устроена AI-поисковая функция You.com, для которой работает бот?
Как строже всего проверить подлинность запроса от YouBot?
Повлияет ли блокировка YouBot на позиции в Google или Bing?
Достаточно ли заблокировать YouBot, чтобы исключить сайт из всего AI-поиска?
Что делать при заметной нагрузке от бота?
Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.