TrafficVeil
Боты 7 мин21 августа 2026 г.

Manus-User: AI-агент человека, а не нежелательный краулер

Manus-User — это не безымянный сборщик данных, а идентификатор автономного AI-агента компании Butterfly Effect, который заходит на сайты по прямому поручению конкретного человека, а не для системного обхода. Разбираемся, почему блокировка такого трафика по умолчанию вредит реальным пользователям, а не защищает сайт, и почему запись, вероятно, попала не в ту категорию базы.

TV
TrafficVeil Team
Эксперты по защите веб-трафика
Содержание статьи
  1. 1. Что такое Manus-User на самом деле
  2. 2. Зачем Manus-User приходит на сайт
  3. 3. Нагрузка и риски
  4. 4. Как найти Manus-User в логах
  5. 5. robots.txt для Manus-User
  6. 6. Блокировка вручную и через TrafficVeil
  7. 7. Что делать: короткий алгоритм
  8. 8. Открытый вопрос по категоризации
  9. 9. Стратегия allow/deny для Manus-User
DDoS L7

DDoS атака что это простыми словами и как защитить сайт

Разобрали виды атак, признаки DDoS, последствия, уровни защиты, L7 DDoS и схему подключения TrafficVeil через DNS/reverse proxy.

Читать про DDoS

Энциклопедия ботов TrafficVeil

618 ботов с описаниями, паттернами User-Agent и фильтром по категориям — открытый справочник для аудита логов и настройки защиты.

Открыть справочник

Manus-User — ещё один серьёзный случай неверной категоризации: черновик описывает его как «автоматизированный краулер... классифицирован как нежелательный», но по факту это не краулер вообще, а AI-агент с браузером, который действует по прямому поручению конкретного живого человека. Это принципиально другой тип автоматизации, чем всё остальное в категории «Прочие краулеры и сервисы», и логика «нежелательный по умолчанию» здесь работает против реальных пользователей сайта, а не против фонового шума.

1. Что такое Manus-User на самом деле

Manus — автономный AI-агент компании Butterfly Effect (Китай), которую в западных медиа иногда называют «второй DeepSeek» за происхождение и резонанс. В отличие от обычного чат-бота, Manus не просто отвечает на вопросы, а самостоятельно выполняет многошаговые задачи: планирование поездки, анализ отчётов, написание кода, работа с таблицами — в том числе те, что требуют реального взаимодействия с сайтами.

Manus-User — это идентификатор именно такого взаимодействия: когда пользователь ставит агенту задачу, которая требует зайти на сайт, Manus-User навигирует по страницам, заполняет формы и собирает информацию автономно — так же, как это делал бы человек, но через программный браузер. Официальная документация доступна по адресу manus.im/help/Manus-user.

Параметр Значение
Название Manus-User
Оператор Butterfly Effect — компания-разработчик Manus AI, Китай
Правильная категория AI Agent (агентный браузер) — принципиально отличается от краулера/скрейпера (см. раздел 8)
Роль Автономная многошаговая навигация по сайту (заполнение форм, сбор информации, взаимодействие с интерфейсом) по прямому поручению конкретного пользователя
User-Agent / паттерн Manus-User
Поведенческий паттерн Непредсказуем и определяется целью задачи, а не фиксированным путём обхода; выполняет JavaScript, обрабатывает cookies и сессии, может проводить на странице разное время — принципиально отличается от классического краулера
Официальная документация manus.im/help/Manus-user
Статистика (по независимым данным на середину 2026) Около 2% топовых сайтов блокируют Manus-User в robots.txt; трафик AI-агентов в целом — доли процента от всего веб-трафика
Пометка TrafficVeil Нежелательный / Прочие краулеры и сервисы — категория и статус, по всей видимости, ошибочны (см. раздел 8)

2. Зачем Manus-User приходит на сайт

  • пользователь поручил Manus задачу, для выполнения которой агенту нужно посетить конкретный сайт — например, найти информацию, сравнить варианты, заполнить форму;
  • в отличие от краулера, у Manus-User нет собственной цели «обойти сайт впрок» — визит целиком определяется задачей конкретного человека в конкретный момент;
  • агент может задерживаться на странице дольше обычного бота, если задача требует анализа содержимого, а не просто извлечения метаданных.

Типичный кейс: единичный, нерегулярный визит с непредсказуемым путём по сайту — заходы на разные, не обязательно связанные страницы, заполнение форм, паузы — то, что в черновике описано как «нет нормальной сессии, другие интервалы, повторяемый path-паттерн», на практике для Manus-User чаще выглядит наоборот: сессия есть, паттерн непредсказуем именно потому, что за агентом стоит живая задача реального человека.

3. Нагрузка и риски

Здесь стоит прямо возразить формулировке черновика про «фоновый шум в аналитике» как стандартный риск: по независимым данным, блокировка Manus-User обычно не рекомендуется именно потому, что агент действует от имени реального человека, выполняющего задачу, — блокировка мешает не боту, а пользователю получить то, за чем он пришёл, что может создавать разочарование и негативное восприятие сайта у совершенно реальной аудитории.

Отдельная оговорка: некоторые сторонние каталоги ботов помечают Manus-User общим предупреждением о возможном использовании контента для обучения AI-моделей — но это шаблонная формулировка, применяемая ко многим AI-связанным UA без специфичного подтверждения именно для Manus, и более детальные источники описывают его исключительно как агента, выполняющего задачи в реальном времени, а не как краулер, собирающий данные для тренировки моделей впрок. Однозначных доказательств массового сбора контента для обучения не найдено.

4. Как найти Manus-User в логах

# Базовый поиск
grep -i "manus-user" /var/log/nginx/access.log

# Топ URL — ожидаемо разнообразные, без чёткого системного паттерна
grep -i "manus-user" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head

# Топ IP за этим UA
grep -i "manus-user" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head

# Суточная активность — ожидаемо нерегулярная, а не системный фон
grep -i "manus-user" /var/log/nginx/access.log | awk '{print $4}' | cut -d: -f1 | sort | uniq -c

# Признак реального взаимодействия — заходы на страницы с формами, а не только листинги
grep -i "manus-user" /var/log/nginx/access.log | grep -icE "/contact|/form|/checkout|/search"

Верификация. Строку UA подделать может любой скрипт. Официального списка IP-диапазонов не найдено — для решения allow/deny смотрите связку UA + IP/ASN + характерный непредсказуемый, не системный паттерн обхода, отличающий агента от классического краулера:

IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"

5. robots.txt для Manus-User

# Жёсткий запрет — как правило, не рекомендуется, см. раздел 3
User-agent: Manus-User
Disallow: /

# Разрешить всё — рекомендуемый вариант по умолчанию
User-agent: Manus-User
Allow: /

# Компромисс: закрыть личный кабинет и служебные разделы, оставить публичное взаимодействие доступным
User-agent: Manus-User
Disallow: /admin/
Disallow: /account/
Allow: /

6. Блокировка вручную и через TrafficVeil

Nginx:

if ($http_user_agent ~* "manus-user") {
    return 403;
}

Apache (.htaccess):

RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} manus-user [NC]
RewriteRule ^ - [F,L]

TrafficVeil:

  • найдите manus-user в разделе ботов домена или в /system/bots;
  • для подавляющего большинства сайтов — allow обоснован по умолчанию: агент представляет реального пользователя, и блокировка портит именно его опыт, а не защищает сайт от вредоносной автоматизации;
  • причины для deny здесь скорее редкое исключение — например, разделы, куда в принципе не должны заходить автоматизированные клиенты (личный кабинет, платёжные формы);
  • после изменения сверьте логи и учитывайте, что низкая доля блокировки этого UA у топовых сайтов (около 2%) отражает сложившуюся практику отрасли, а не недосмотр.

7. Что делать: короткий алгоритм

  • Стандартная рекомендация — allow: агент действует от имени реального человека, а не собирает контент впрок;
  • Хотите ограничить доступ к чувствительным разделам (личный кабинет, оплата) — точечный Disallow для этих путей, а не блокировка всего агента;
  • Наблюдаете нагрузку, непропорциональную задачам пользователей — рассмотрите rate-limit, но учитывайте, что доля такого трафика в целом пока минимальна;
  • Не применяйте к Manus-User логику «просто ещё один нежелательный краулер» — категория и мотивация здесь принципиально другие;
  • Не блокируйте по маске User-agent: *, чтобы не задеть Googlebot/YandexBot заодно.

8. Открытый вопрос по категоризации

Это явный случай ошибочной категоризации: Manus-User отнесён к «Прочие краулеры и сервисы (нежелательный)», хотя по факту относится к отдельной, растущей категории AI-агентов — программ, которые используют настоящий браузер для выполнения задач конкретного человека, а не для системного сбора данных. Независимые каталоги ботов прямо рекомендуют не блокировать такие агенты по умолчанию именно по этой причине. Рекомендую перенести запись в отдельную категорию «AI-агенты» (или создать её, если такой ещё нет) и пересмотреть статус с «нежелательный» на «легитимный» — вероятно, эта же проблема касается и других записей вида GoogleAgent-Mariner, ChatGPT Agent, которые по той же логике должны требовать пересмотра, если они размечены аналогично.

Бот / сосед Категория Комментарий
ChatGPT Agent AI Agent Официально задокументированный агент OpenAI с той же логикой — действует от имени пользователя, не собирает данные впрок
GoogleAgent-Mariner AI Agent Аналогичный тип агента от Google — стоит проверить категоризацию в базе TrafficVeil по той же логике
GPTBot AI и LLM-краулеры (training) Настоящий training-краулер — принципиально другая природа: системный фоновый сбор, а не разовое действие по задаче человека
360Spider Прочие краулеры и сервисы нежелательный, но действительно системный краулер без привязки к задаче конкретного пользователя — не путать с Manus-User

9. Стратегия allow/deny для Manus-User

Ситуация Действие
Стандартный сайт, публичный контент Allow — блокировка вредит реальным пользователям, а не защищает от угрозы
Чувствительные разделы (кабинет, оплата) Точечный Disallow для этих путей, не для агента целиком
Ошибочно применена логика «нежелательный краулер» Пересмотреть — правильная категория и мотивация другие
Нагрузка от таких визитов заметна Rate-limit как мягкая мера, полный deny избыточен
Подозрение на spoofing UA Не доверять строке UA; смотреть IP/ASN и характерный непредсказуемый, не системный паттерн

Частые вопросы

Manus-User — это краулер, который собирает контент впрок?

Нет, это идентификатор AI-агента с браузером, который выполняет конкретную задачу конкретного человека в реальном времени, а не системно обходит сайт.

Кто на самом деле управляет Manus-User?

Butterfly Effect — китайская компания-разработчик AI-агента Manus, которую в медиа иногда называют «второй DeepSeek».

Почему блокировка Manus-User обычно не рекомендуется?

Потому что за агентом стоит реальный пользователь, выполняющий задачу — блокировка мешает именно ему, а не защищает сайт от вредоносной автоматизации.

Собирает ли Manus-User контент сайта для обучения AI-моделей?

Однозначных подтверждений этому не найдено — более детальные источники описывают его исключительно как агента, действующего в реальном времени по задаче пользователя.

Чем поведение Manus-User отличается от обычного краулера?

Оно непредсказуемо и определяется целью задачи: агент выполняет JavaScript, обрабатывает cookies и сессии, а не идёт по фиксированному маршруту обхода.

Стоит ли пересмотреть категорию Manus-User в базе TrafficVeil?

Да, похоже, запись ошибочно попала в «Прочие краулеры и сервисы» вместо отдельной категории AI-агентов,

#Manus-User#Manus AI#AI-агенты#User-Agent#Butterfly Effect#robots.txt#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак.

Похожие статьи

Skype (общий токен): не один бот, а минимум три разных

Общий поиск по слову «skype» в логах цепляет сразу несколько разных, исторически связанных механизмов Microsoft — от закрытого в мае 2025 года превью-бота до активной внутренней инфраструктуры Teams, унаследовавшей кодовое имя SkypeSpaces. Разбираемся, почему общее правило блокировки по этому слову рискованно, и как разделить разные варианты в своих логах.

7 мин

Fedicabot: превью-fetcher Fedica, а не краулер Fediverse

Fedicabot принадлежит Fedica — крупной платформе публикации и аналитики соцсетей, а не имеет отношения к Fediverse, несмотря на созвучное название. Официальная страница оператора прямо заявляет: бот не обходит сайты целиком, а читает только страницу, которую указал конкретный пользователь при планировании публикации, — это меняет всю логику оценки риска.

6 мин

Amazon Kendra: возможно, ваш корпоративный поиск

Amazon Kendra — реальный сервис корпоративного поиска AWS, и его коннектор Web Crawler обходит только те конкретные URL, которые явно указал клиент AWS при настройке источника данных — то есть это не свободный обход, а целевая индексация по чьему-то заданию. Разбираемся, почему первый шаг здесь — проверить, не настроен ли на вашем сайте (или у партнёра) такой поисковый индекс, прежде чем блокировать бота как постороннего.

6 мин

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.