В логах сайт может выглядеть «живым», хотя рост дают не посетители, а строка вида googleagent-mariner — с той оговоркой, что именно такую строку в реальных запросах вы, скорее всего, не увидите вовсе. «GoogleAgent-Mariner» — распространённое, но неофициальное имя. Несколько каталогов ботов начали использовать его для описания ИИ-агента Project Mariner ещё до того, как Google формально задокументировал этот трафик. Когда 20 марта 2026 года Google действительно добавил соответствующую запись в официальную документацию краулеров, закреплённый токен оказался другим — просто Google-Agent, без упоминания Mariner в самой строке User-Agent.
Почему это важно практически
Если в правилах robots.txt, nginx или TrafficVeil прописан фильтр буквально под googleagent-mariner, велика вероятность, что он не сработает — не потому что бот игнорирует правило, а потому что реальные запросы приходят под другим именем. Это классическая ловушка при работе со свежими, ещё не устоявшимися токенами: сторонние источники успевают присвоить продукту своё название раньше официального анонса, и это имя продолжает жить в старых статьях и списках уже после того, как оператор выбрал другое.
Параметры
| Параметр | Значение |
|---|---|
| Распространённое неофициальное название | GoogleAgent-Mariner |
| Официальный токен по документации Google (с 20 марта 2026) | Google-Agent |
| Оператор | |
| Продукт | Project Mariner — ИИ-агент Google DeepMind, доступный подписчикам Google AI Ultra, автономно взаимодействует со страницами по запросу пользователя |
| Категория по документации Google | User-triggered fetcher — та же категория, что у Feedfetcher, Google Read Aloud, NotebookLM |
| Список IP | Публикуется Google в user-triggered-agents.json — вопреки распространённому мнению об отсутствии таких списков |
| robots.txt | Формально может игнорироваться: запрос инициирован конкретным пользователем, а не автономным краулером |
Зачем этот трафик приходит на сайт
Логика та же, что у прямого «Google-Agent»: реальный пользователь просит ИИ-агента (например, Project Mariner) выполнить задачу — сравнить товары, заполнить форму, найти информацию — и агент заходит на конкретные страницы вашего сайта, чтобы это сделать.
- Какие зоны чаще трогает: любые страницы, с которыми пользователь попросил ИИ взаимодействовать
- Что ищет: конкретную информацию или действие, запрошенное живым человеком именно сейчас
- Чем отличается от автономного краулера: нет расписания и нет систематического обхода — только точечные визиты по факту пользовательского запроса
Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.
Как правильно настроить фильтры с учётом путаницы в имени
Самый надёжный подход — ловить оба варианта имени сразу, а не полагаться на то, какое из них «правильное» именно сейчас:
# Ищите оба варианта — старое неофициальное имя и текущий официальный токен
grep -iE "googleagent-mariner|Google-Agent" /var/log/nginx/access.log
# В robots.txt ориентируйтесь на официальный токен
User-agent: Google-Agent
Disallow: /admin/
Disallow: /account/
Disallow: /checkout/
Allow: /
# На сервере тоже матчите официальный вариант, а не устаревшее имя из старых источников
if ($http_user_agent ~* "Google-Agent") {
return 403;
}
Если ваши текущие правила блокировки писались давно и содержат именно строку «googleagent-mariner» — стоит проверить их и обновить на актуальный токен, иначе создастся ложное ощущение контроля при фактическом отсутствии блокировки.
Взвешенный подход, а не блокировка по умолчанию
Как и с прямым Google-Agent, здесь нет смысла банить трафик автоматически как «нежелательный скрапер»:
- За каждым запросом стоит реальный человек, пытающийся выполнить задачу на сайте через ИИ — блокировка мешает именно ему, а не абстрактному боту
- Если сайт ориентирован на потребителя (продажи, сравнение, бронирование), заметный объём такого трафика — сигнал, что стоит рассмотреть удобные для агентов интерфейсы, а не закрывать доступ
- Точечная блокировка чувствительных разделов (админка, личный кабинет) через серверный контроль доступа — более разумная стратегия, чем полный запрет
Верификация
Поскольку речь о реальном трафике Google, для проверки подлинности используйте официальный список IP-диапазонов user-triggered-agents.json, а не полагайтесь только на совпадение имени в UA — тем более что само имя, как видно, ещё недавно было предметом путаницы даже в открытых источниках.
IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"
С чем не путать
| Название | Статус | Комментарий |
|---|---|---|
| Google-Agent | Официальный токен | Именно эту строку стоит использовать в правилах — закреплена Google с марта 2026 |
| GoogleAgent-Mariner | Неофициальное имя из сторонних каталогов | Описывает тот же продукт (Project Mariner), но не является реальным токеном в трафике |
| Googlebot | Отдельный, не связанный краулер | Автономная индексация для поиска — принципиально другая категория и логика соблюдения robots.txt |
Частые вопросы
Реальные запросы в логах будут содержать строку «googleagent-mariner»?
Откуда вообще взялось название GoogleAgent-Mariner, если Google его не использует?
Если правило блокировки написано под старое название, оно просто не сработает молча?
Стоит ли вообще закрывать доступ этому агенту?
Есть ли официальный способ проверить подлинность такого трафика?
Чем это принципиально отличается от обычного Googlebot?
Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.