Боты5 мин чтения·11 августа 2026 г.

KlaviyoAIBot: почему этот AI-краулер не заходит на сайт без явного согласия владельца аккаунта

По официальной документации Klaviyo, KlaviyoAIBot обходит только домены, которые владелец аккаунта сам явно подключил для работы AI-функции Kai Customer Agent — не сканирует сайты по своей инициативе и не обходит paywall или авторизацию. Разбираем, почему это отличает бота от типичных обучающих AI-краулеров, и почему шаблонная классификация «нежелательный» здесь не подходит без выяснения контекста.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота KlaviyoAIBot: нежелательный ai и llm-краулеры

По документации самой Klaviyo, KlaviyoAIBot — не рядовой AI-скрапер, тайком собирающий сырьё для обучения чужой модели, а бот с чётко очерченным и осознанным согласием на обход: он заходит только на те домены и URL, которые владелец аккаунта Klaviyo сам явно подключил в настройках платформы. Это принципиально иная модель доступа, чем у большинства AI-краулеров из этой серии, — и она заслуживает отдельного разбора, прежде чем присваивать боту ярлык «нежелательный» по умолчанию.

Что стоит за именем и зачем Klaviyo вообще нужен собственный краулер

Klaviyo — крупная платформа email- и SMS-маркетинга для e-commerce, и KlaviyoAIBot обслуживает её функцию Kai Customer Agent — AI-инструмент, который использует проиндексированный контент для генерации текста, ответов ИИ и товарных рекомендаций внутри самой платформы и на сайте клиента. Источники для индексации не ограничены главным магазином: помимо основного storefront, клиент может явно подключить дополнительные источники — например, справочный центр на Zendesk, блог или новостные материалы бренда, — и именно эти подключённые адреса бот и будет обходить.

Официальная документация Klaviyo отдельно подчёркивает: бот не обходит авторизацию, платный доступ (paywall) или иные механизмы контроля доступа — то есть технически ограничен ровно тем контентом, который и так публично доступен, плюс явным согласием владельца аккаунта на использование именно этого домена как источника.

Параметры бота

Параметр Значение
User-Agent / паттерн KlaviyoAIBot
Оператор Klaviyo
Назначение Индексация контента для AI-функции Kai Customer Agent: генерация текста, AI-ответы, товарные рекомендации
Модель доступа Обходит только домены и URL, явно подключённые владельцем конкретного аккаунта Klaviyo — не сканирует произвольные сторонние сайты по своей инициативе
Логика обновления Индексация строится на «сигналах изменения» (change signals) и настройках пользователя, а не на фиксированном расписании полного переобхода
Соблюдение robots.txt Да, официально следует Robots Exclusion Protocol — индексирует только то, что владелец подключённого домена разрешил через правила для этого токена
Реакция на замедление Официально поддерживает стандартные ответы rate-limiting (429 или 503 с заголовком Retry-After) как способ временно снизить частоту запросов без изменения правил robots.txt
Список IP-адресов ❌ Отдельного официального фида не найдено — верификация по User-Agent

Почему готовый шаблон «AI-краулер = нежелательный» здесь не подходит

Ключевое отличие KlaviyoAIBot от массовых обучающих краулеров вроде GPTBot или CCBot — отсутствие произвольности в выборе целей. Бот в принципе не может «внезапно» появиться на сайте, который никак не связан с Klaviyo: чтобы это произошло, кто-то должен был осознанно указать конкретный домен как источник в настройках собственного аккаунта платформы. Это значит, что появление этого бота в логах сайта — почти всегда сигнал одного из двух сценариев: либо сайт сам подключён к Klaviyo как продавец на e-commerce, либо (реже) это URL стороннего справочного ресурса или блога, который клиент Klaviyo явно указал как дополнительный источник для своего AI-агента.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Стоит ли блокировать

Решение зависит от того, чей это источник и зачем контент индексируется:

  • если сайт — собственный магазин или ресурс, подключённый к Klaviyo для работы Kai Customer Agent, — блокировка бота напрямую ломает функцию AI-ответов и рекомендаций, ради которой интеграция и настраивалась;
  • если сайт оказался подключён как сторонний источник (справочный центр, блог) в чужом аккаунте Klaviyo без ведома его владельца — стоит сначала выяснить, кто и зачем это сделал, прежде чем реагировать блокировкой: возможно, это законная интеграция партнёра, о которой просто не знали в команде;
  • на позиции в органической выдаче Google, Bing или Яндекса присутствие или отсутствие KlaviyoAIBot не влияет — это отдельная от классической поисковой индексации AI-система.

Как найти бота в логах

grep -i "klaviyoaibot" /var/log/nginx/access.log

Как настроить доступ

Полный запрет через robots.txt — с явной оговоркой, что это отменит функциональность Kai Customer Agent для владельца соответствующего аккаунта Klaviyo:

User-agent: KlaviyoAIBot
Disallow: /

Частичный запрет отдельных разделов — если нужно исключить только чувствительные страницы, оставив остальной контент доступным для AI-функций:

User-agent: KlaviyoAIBot
Disallow: /account/
Disallow: /checkout/
Allow: /

Если задача не полностью заблокировать бота, а лишь снизить частоту обращений в моменте — по документации оператора для этого не обязательно менять robots.txt, достаточно возвращать боту стандартные коды замедления, которые он честно соблюдает:

return 429;
# или, с указанием интервала:
# Retry-After: 60

Это заметно более щадящий инструмент управления нагрузкой, чем жёсткая блокировка через if ($http_user_agent ~* "klaviyoaibot") { return 403; } — последнюю имеет смысл применять только в случае, если бот попал на сайт по ошибке или без ведома владельца и никакой пользы от индексации при этом нет.

Частые вопросы

Может ли KlaviyoAIBot зайти на сайт, никак не связанный с Klaviyo?
Практически нет — бот обходит только домены и URL, которые владелец конкретного аккаунта Klaviyo явно подключил в настройках платформы.
Обходит ли бот платный доступ или авторизацию на странице?
Нет, по официальной документации Klaviyo бот не обходит paywall, авторизацию и другие механизмы контроля доступа.
Как снизить нагрузку от бота, не блокируя его совсем?
Возвращать стандартные коды замедления 429 или 503 с заголовком Retry-After — бот честно их соблюдает без необходимости менять robots.txt.
Соблюдает ли KlaviyoAIBot правила robots.txt?
Да, он официально следует Robots Exclusion Protocol и индексирует только то, что разрешено правилами для его токена.
Что делать, если бот появился в логах, а сайт вроде бы не подключён к Klaviyo?
Стоит выяснить, не подключил ли кто-то этот сайт как сторонний источник (справочный центр, блог) в чужом аккаунте Klaviyo, прежде чем сразу блокировать.
Стоит ли блокировать бота, если сайт использует Kai Customer Agent?
Нет, блокировка сломает саму функцию AI-ответов и рекомендаций, ради которой контент и был подключён.
#klaviyoaibot#Klaviyo#Kai Customer Agent#AI-краулер#бот-энциклопедия#robots.txt#rate-limiting#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil