Manus-User — ещё один серьёзный случай неверной категоризации: черновик описывает его как «автоматизированный краулер... классифицирован как нежелательный», но по факту это не краулер вообще, а AI-агент с браузером, который действует по прямому поручению конкретного живого человека. Это принципиально другой тип автоматизации, чем всё остальное в категории «Прочие краулеры и сервисы», и логика «нежелательный по умолчанию» здесь работает против реальных пользователей сайта, а не против фонового шума.
1. Что такое Manus-User на самом деле
Manus — автономный AI-агент компании Butterfly Effect (Китай), которую в западных медиа иногда называют «второй DeepSeek» за происхождение и резонанс. В отличие от обычного чат-бота, Manus не просто отвечает на вопросы, а самостоятельно выполняет многошаговые задачи: планирование поездки, анализ отчётов, написание кода, работа с таблицами — в том числе те, что требуют реального взаимодействия с сайтами.
Manus-User — это идентификатор именно такого взаимодействия: когда пользователь ставит агенту задачу, которая требует зайти на сайт, Manus-User навигирует по страницам, заполняет формы и собирает информацию автономно — так же, как это делал бы человек, но через программный браузер. Официальная документация доступна по адресу manus.im/help/Manus-user.
| Параметр | Значение |
| Название | Manus-User |
| Оператор | Butterfly Effect — компания-разработчик Manus AI, Китай |
| Правильная категория | AI Agent (агентный браузер) — принципиально отличается от краулера/скрейпера (см. раздел 8) |
| Роль | Автономная многошаговая навигация по сайту (заполнение форм, сбор информации, взаимодействие с интерфейсом) по прямому поручению конкретного пользователя |
| User-Agent / паттерн | Manus-User |
| Поведенческий паттерн | Непредсказуем и определяется целью задачи, а не фиксированным путём обхода; выполняет JavaScript, обрабатывает cookies и сессии, может проводить на странице разное время — принципиально отличается от классического краулера |
| Официальная документация | manus.im/help/Manus-user |
| Статистика (по независимым данным на середину 2026) | Около 2% топовых сайтов блокируют Manus-User в robots.txt; трафик AI-агентов в целом — доли процента от всего веб-трафика |
| Пометка TrafficVeil | Нежелательный / Прочие краулеры и сервисы — категория и статус, по всей видимости, ошибочны (см. раздел 8) |
2. Зачем Manus-User приходит на сайт
- пользователь поручил Manus задачу, для выполнения которой агенту нужно посетить конкретный сайт — например, найти информацию, сравнить варианты, заполнить форму;
- в отличие от краулера, у Manus-User нет собственной цели «обойти сайт впрок» — визит целиком определяется задачей конкретного человека в конкретный момент;
- агент может задерживаться на странице дольше обычного бота, если задача требует анализа содержимого, а не просто извлечения метаданных.
Типичный кейс: единичный, нерегулярный визит с непредсказуемым путём по сайту — заходы на разные, не обязательно связанные страницы, заполнение форм, паузы — то, что в черновике описано как «нет нормальной сессии, другие интервалы, повторяемый path-паттерн», на практике для Manus-User чаще выглядит наоборот: сессия есть, паттерн непредсказуем именно потому, что за агентом стоит живая задача реального человека.
3. Нагрузка и риски
Здесь стоит прямо возразить формулировке черновика про «фоновый шум в аналитике» как стандартный риск: по независимым данным, блокировка Manus-User обычно не рекомендуется именно потому, что агент действует от имени реального человека, выполняющего задачу, — блокировка мешает не боту, а пользователю получить то, за чем он пришёл, что может создавать разочарование и негативное восприятие сайта у совершенно реальной аудитории.
Отдельная оговорка: некоторые сторонние каталоги ботов помечают Manus-User общим предупреждением о возможном использовании контента для обучения AI-моделей — но это шаблонная формулировка, применяемая ко многим AI-связанным UA без специфичного подтверждения именно для Manus, и более детальные источники описывают его исключительно как агента, выполняющего задачи в реальном времени, а не как краулер, собирающий данные для тренировки моделей впрок. Однозначных доказательств массового сбора контента для обучения не найдено.
4. Как найти Manus-User в логах
# Базовый поиск
grep -i "manus-user" /var/log/nginx/access.log
# Топ URL — ожидаемо разнообразные, без чёткого системного паттерна
grep -i "manus-user" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head
# Топ IP за этим UA
grep -i "manus-user" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head
# Суточная активность — ожидаемо нерегулярная, а не системный фон
grep -i "manus-user" /var/log/nginx/access.log | awk '{print $4}' | cut -d: -f1 | sort | uniq -c
# Признак реального взаимодействия — заходы на страницы с формами, а не только листинги
grep -i "manus-user" /var/log/nginx/access.log | grep -icE "/contact|/form|/checkout|/search"
Верификация. Строку UA подделать может любой скрипт. Официального списка IP-диапазонов не найдено — для решения allow/deny смотрите связку UA + IP/ASN + характерный непредсказуемый, не системный паттерн обхода, отличающий агента от классического краулера:
IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"
5. robots.txt для Manus-User
# Жёсткий запрет — как правило, не рекомендуется, см. раздел 3
User-agent: Manus-User
Disallow: /
# Разрешить всё — рекомендуемый вариант по умолчанию
User-agent: Manus-User
Allow: /
# Компромисс: закрыть личный кабинет и служебные разделы, оставить публичное взаимодействие доступным
User-agent: Manus-User
Disallow: /admin/
Disallow: /account/
Allow: /
6. Блокировка вручную и через TrafficVeil
Nginx:
if ($http_user_agent ~* "manus-user") {
return 403;
}
Apache (.htaccess):
RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} manus-user [NC]
RewriteRule ^ - [F,L]
TrafficVeil:
- найдите manus-user в разделе ботов домена или в /system/bots;
- для подавляющего большинства сайтов — allow обоснован по умолчанию: агент представляет реального пользователя, и блокировка портит именно его опыт, а не защищает сайт от вредоносной автоматизации;
- причины для deny здесь скорее редкое исключение — например, разделы, куда в принципе не должны заходить автоматизированные клиенты (личный кабинет, платёжные формы);
- после изменения сверьте логи и учитывайте, что низкая доля блокировки этого UA у топовых сайтов (около 2%) отражает сложившуюся практику отрасли, а не недосмотр.
7. Что делать: короткий алгоритм
- Стандартная рекомендация — allow: агент действует от имени реального человека, а не собирает контент впрок;
- Хотите ограничить доступ к чувствительным разделам (личный кабинет, оплата) — точечный Disallow для этих путей, а не блокировка всего агента;
- Наблюдаете нагрузку, непропорциональную задачам пользователей — рассмотрите rate-limit, но учитывайте, что доля такого трафика в целом пока минимальна;
- Не применяйте к Manus-User логику «просто ещё один нежелательный краулер» — категория и мотивация здесь принципиально другие;
- Не блокируйте по маске
User-agent: *, чтобы не задеть Googlebot/YandexBot заодно.
8. Открытый вопрос по категоризации
Это явный случай ошибочной категоризации: Manus-User отнесён к «Прочие краулеры и сервисы (нежелательный)», хотя по факту относится к отдельной, растущей категории AI-агентов — программ, которые используют настоящий браузер для выполнения задач конкретного человека, а не для системного сбора данных. Независимые каталоги ботов прямо рекомендуют не блокировать такие агенты по умолчанию именно по этой причине. Рекомендую перенести запись в отдельную категорию «AI-агенты» (или создать её, если такой ещё нет) и пересмотреть статус с «нежелательный» на «легитимный» — вероятно, эта же проблема касается и других записей вида GoogleAgent-Mariner, ChatGPT Agent, которые по той же логике должны требовать пересмотра, если они размечены аналогично.
| Бот / сосед | Категория | Комментарий |
| ChatGPT Agent | AI Agent | Официально задокументированный агент OpenAI с той же логикой — действует от имени пользователя, не собирает данные впрок |
| GoogleAgent-Mariner | AI Agent | Аналогичный тип агента от Google — стоит проверить категоризацию в базе TrafficVeil по той же логике |
| GPTBot | AI и LLM-краулеры (training) | Настоящий training-краулер — принципиально другая природа: системный фоновый сбор, а не разовое действие по задаче человека |
| 360Spider | Прочие краулеры и сервисы | нежелательный, но действительно системный краулер без привязки к задаче конкретного пользователя — не путать с Manus-User |
9. Стратегия allow/deny для Manus-User
| Ситуация | Действие |
| Стандартный сайт, публичный контент | Allow — блокировка вредит реальным пользователям, а не защищает от угрозы |
| Чувствительные разделы (кабинет, оплата) | Точечный Disallow для этих путей, не для агента целиком |
| Ошибочно применена логика «нежелательный краулер» | Пересмотреть — правильная категория и мотивация другие |
| Нагрузка от таких визитов заметна | Rate-limit как мягкая мера, полный deny избыточен |
| Подозрение на spoofing UA | Не доверять строке UA; смотреть IP/ASN и характерный непредсказуемый, не системный паттерн |