Боты6 мин чтения·7 августа 2026 г.

Google-Agent: почему блокировка этого «бота» может стоить вам клиентов

Разбор Google-Agent — официального идентификатора ИИ-агентов Google (Project Mariner), которые заходят на сайт по прямому запросу реального пользователя. Почему robots.txt здесь не работает и как не отсечь настоящих клиентов.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота Google-Agent: нежелательный прочие краулеры и сервисы

Google-Agent стоит отдельного правила в антиботе — но не потому, что это нежелательный автоматический краулер, а потому что это принципиально новый тип посетителя: агент, который заходит на сайт по прямому запросу живого человека, а не по расписанию или из очереди задач. Google официально добавил Google-Agent в документацию по краулингу 20 марта 2026 года. Это идентификатор ИИ-агентов на инфраструктуре Google — в первую очередь Project Mariner от Google DeepMind, — которые по запросу конкретного пользователя заходят на сайты и выполняют задачи: заполняют формы, сравнивают товары, извлекают информацию, кликают по элементам страницы. Оператор: Google. Классификация: user-triggered fetcher — та же категория, что у Feedfetcher-Google. За каждым запросом Google-Agent стоит реальный пользователь, пытающийся выполнить задачу на вашем сайте через ИИ; это не автономный обход, и по умолчанию его не стоит банить так же, как случайный скрапер.

Что такое Google-Agent

Параметр Значение
Название Google-Agent
User-Agent / паттерн google-agent (идентификатор закреплён Google официально с марта 2026)
Оператор Google
Роль User-triggered fetcher: ИИ-агенты (Project Mariner и подобные продукты) выполняют действия на сайте по прямому запросу конкретного пользователя — не автоматический обход по расписанию
Документация / ориентир developers.google.com — официальный раздел про user-triggered fetchers
Список IP Публикуется Google в user-triggered-agents.json — вопреки распространённому мнению, официальный список для этой категории агентов существует
robots.txt Как user-triggered fetcher, в общем случае игнорирует robots.txt — запрос инициирован человеком, а не автономным краулером; управлять доступом нужно иначе (см. ниже)
Пометка TrafficVeil Не «нежелательный» по умолчанию — оценивайте по бизнес-контексту: блокировка бьёт по реальным пользователям, пытающимся взаимодействовать с сайтом через ИИ

Зачем Google-Agent приходит на сайт

Представьте: пользователь просит Project Mariner «найти рейсы в Берлин дешевле 400 долларов и сравнить три варианта». ИИ-агент открывает сайты, кликает по страницам, заполняет формы и извлекает данные — каждый такой запрос приходит на сайт с User-Agent Google-Agent.

  • Какие зоны чаще трогает: любые страницы, с которыми пользователь попросил ИИ взаимодействовать — от каталога до форм оформления заказа
  • Что ищет: конкретную информацию или действие, запрошенное пользователем именно на этом сайте
  • Чем отличается от Googlebot: Googlebot непрерывно обходит веб для построения поискового индекса; Google-Agent появляется только тогда, когда живой человек попросил ИИ что-то сделать — принципиально разные категории с разными правилами

Объём трафика Google-Agent сейчас может быть близок к нулю для многих сайтов: Project Mariner пока доступен только в США и только подписчикам плана Google AI Ultra ($249.99/мес). Но документация закреплена как часть глобальной инфраструктуры краулеров Google, а не как региональный эксперимент — это сигнал, что трафик будет расти по мере расширения доступа.

Почему robots.txt здесь не сработает

Google явно относит Google-Agent к категории user-triggered fetchers — той же, что Feedfetcher, Google Read Aloud и NotebookLM. Официальная позиция Google: такие агенты в общем случае игнорируют robots.txt, поскольку запрос исходит не от автономного краулера, а от конкретного человека через стороннее приложение или сервис. Практическое следствие: если нужно ограничить доступ Google-Agent, обычные директивы Disallow могут не сработать. Управлять доступом нужно через серверную аутентификацию или контроль доступа — теми же средствами, которыми вы бы ограничивали обычного человека-посетителя, а не через robots.txt.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Кому выгодны визиты Google-Agent

Это ключевое отличие от большинства ботов в этой категории: пользы от блокировки Google-Agent «по умолчанию» может не быть вовсе — и наоборот, есть прямой риск.

  • Если сайт продаёт товары или услуги, а пользователи всё чаще делегируют покупки и сравнения ИИ-агентам — блокировка Google-Agent означает потерю реальных потенциальных клиентов, которые физически не смогут завершить задачу на сайте через свой ИИ-инструмент
  • Заметный объём взаимодействий Google-Agent — сигнал, что стоит рассмотреть внедрение структурированных интерфейсов для агентов (WebMCP и подобные машинно-читаемые протоколы), чтобы такие взаимодействия проходили эффективнее
  • Блокировать имеет смысл точечно — например, закрыть агентам доступ к административным или платёжным разделам, а не к сайту целиком

Верификация

Google-Agent экспериментирует с протоколом Web Bot Auth — экспериментальным IETF-стандартом, по которому агент криптографически подписывает каждый HTTP-запрос под identity https://agent.bot.goog. Это более надёжный способ подтвердить подлинность, чем UA или IP по отдельности, хотя пока стандарт в статусе draft. Дополнительно можно сверяться с официальным списком user-triggered-agents.json от Google, публикуемым именно для этой категории.

grep -i "Google-Agent" /var/log/nginx/access.log

robots.txt и практический контроль доступа

# Формально можно прописать, но помните: как user-triggered fetcher,
# Google-Agent может это правило проигнорировать
User-agent: Google-Agent
Disallow: /admin/
Disallow: /account/
Disallow: /checkout/
Allow: /

Если действительно нужно ограничить доступ к конкретным разделам, а robots.txt не даёт гарантии — используйте серверную аутентификацию (логин, токен доступа) для чувствительных разделов, как для обычного пользователя. Это надёжнее, чем полагаться на добровольное соблюдение директив.

Рекомендации: что делать с Google-Agent

  • Сайт ориентирован на потребителя (e-commerce, услуги, сравнение цен) — не блокируйте Google-Agent вслепую; оцените, не отсекаете ли вы реальных клиентов, использующих ИИ-агентов для покупок
  • Нужно закрыть только чувствительные разделы (админка, личный кабинет, оформление заказа) — используйте серверный контроль доступа, а не только robots.txt
  • Мониторьте объём в логах: рост взаимодействий Google-Agent — повод присмотреться к WebMCP и другим машинно-читаемым интерфейсам для агентов, а не сразу к блокировке
  • Не путайте с Googlebot — это разные категории с разными правилами и разной пользой для сайта

С кем не путать Google-Agent

Бот Оператор Отличие от Google-Agent
Googlebot Google Автономно и непрерывно обходит веб для построения поискового индекса; соблюдает robots.txt в отличие от Google-Agent
Google-Extended Google Управляет использованием контента для обучения моделей Gemini; никак не связан с живым браузингом по запросу пользователя
«GoogleAgent-Mariner» (встречается в некоторых сторонних источниках) Google Некоторые трекеры ботов использовали это имя до официального релиза; закреплённый Google токен — именно Google-Agent, не путайте варианты названия

Частые вопросы

Что такое Google-Agent и кто его оператор?
Это официальный идентификатор Google для ИИ-агентов вроде Project Mariner, которые выполняют действия на сайте по прямому запросу конкретного пользователя.
Чем Google-Agent отличается от Googlebot?
Googlebot автономно и непрерывно обходит веб для поискового индекса, а Google-Agent появляется только тогда, когда живой человек попросил ИИ что-то сделать на конкретном сайте.
Работает ли robots.txt для блокировки Google-Agent?
Не гарантированно: Google относит его к user-triggered fetchers, которые в общем случае игнорируют robots.txt, поскольку действуют по запросу человека.
Стоит ли блокировать Google-Agent по умолчанию?
Не рекомендуется вслепую: за каждым запросом стоит реальный пользователь, и блокировка может лишить сайт настоящих клиентов, использующих ИИ-агентов для покупок.
Публикует ли Google список IP для верификации Google-Agent?
Да, в файле user-triggered-agents.json, а также разрабатывается криптографическая верификация через протокол Web Bot Auth.
Как ограничить доступ Google-Agent к чувствительным разделам сайта?
Через серверную аутентификацию (логин, токен доступа) для админки и личного кабинета, а не только через robots.txt, который может не сработать.
#Google-Agent#Project Mariner#ИИ-агенты#user-triggered fetcher#robots.txt#TrafficVeil#WebMCP
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil