По документации самой Klaviyo, KlaviyoAIBot — не рядовой AI-скрапер, тайком собирающий сырьё для обучения чужой модели, а бот с чётко очерченным и осознанным согласием на обход: он заходит только на те домены и URL, которые владелец аккаунта Klaviyo сам явно подключил в настройках платформы. Это принципиально иная модель доступа, чем у большинства AI-краулеров из этой серии, — и она заслуживает отдельного разбора, прежде чем присваивать боту ярлык «нежелательный» по умолчанию.
Что стоит за именем и зачем Klaviyo вообще нужен собственный краулер
Klaviyo — крупная платформа email- и SMS-маркетинга для e-commerce, и KlaviyoAIBot обслуживает её функцию Kai Customer Agent — AI-инструмент, который использует проиндексированный контент для генерации текста, ответов ИИ и товарных рекомендаций внутри самой платформы и на сайте клиента. Источники для индексации не ограничены главным магазином: помимо основного storefront, клиент может явно подключить дополнительные источники — например, справочный центр на Zendesk, блог или новостные материалы бренда, — и именно эти подключённые адреса бот и будет обходить.
Официальная документация Klaviyo отдельно подчёркивает: бот не обходит авторизацию, платный доступ (paywall) или иные механизмы контроля доступа — то есть технически ограничен ровно тем контентом, который и так публично доступен, плюс явным согласием владельца аккаунта на использование именно этого домена как источника.
Параметры бота
| Параметр | Значение |
| User-Agent / паттерн | KlaviyoAIBot |
| Оператор | Klaviyo |
| Назначение | Индексация контента для AI-функции Kai Customer Agent: генерация текста, AI-ответы, товарные рекомендации |
| Модель доступа | Обходит только домены и URL, явно подключённые владельцем конкретного аккаунта Klaviyo — не сканирует произвольные сторонние сайты по своей инициативе |
| Логика обновления | Индексация строится на «сигналах изменения» (change signals) и настройках пользователя, а не на фиксированном расписании полного переобхода |
| Соблюдение robots.txt | Да, официально следует Robots Exclusion Protocol — индексирует только то, что владелец подключённого домена разрешил через правила для этого токена |
| Реакция на замедление | Официально поддерживает стандартные ответы rate-limiting (429 или 503 с заголовком Retry-After) как способ временно снизить частоту запросов без изменения правил robots.txt |
| Список IP-адресов | ❌ Отдельного официального фида не найдено — верификация по User-Agent |
Почему готовый шаблон «AI-краулер = нежелательный» здесь не подходит
Ключевое отличие KlaviyoAIBot от массовых обучающих краулеров вроде GPTBot или CCBot — отсутствие произвольности в выборе целей. Бот в принципе не может «внезапно» появиться на сайте, который никак не связан с Klaviyo: чтобы это произошло, кто-то должен был осознанно указать конкретный домен как источник в настройках собственного аккаунта платформы. Это значит, что появление этого бота в логах сайта — почти всегда сигнал одного из двух сценариев: либо сайт сам подключён к Klaviyo как продавец на e-commerce, либо (реже) это URL стороннего справочного ресурса или блога, который клиент Klaviyo явно указал как дополнительный источник для своего AI-агента.
Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.
Стоит ли блокировать
Решение зависит от того, чей это источник и зачем контент индексируется:
- если сайт — собственный магазин или ресурс, подключённый к Klaviyo для работы Kai Customer Agent, — блокировка бота напрямую ломает функцию AI-ответов и рекомендаций, ради которой интеграция и настраивалась;
- если сайт оказался подключён как сторонний источник (справочный центр, блог) в чужом аккаунте Klaviyo без ведома его владельца — стоит сначала выяснить, кто и зачем это сделал, прежде чем реагировать блокировкой: возможно, это законная интеграция партнёра, о которой просто не знали в команде;
- на позиции в органической выдаче Google, Bing или Яндекса присутствие или отсутствие KlaviyoAIBot не влияет — это отдельная от классической поисковой индексации AI-система.
Как найти бота в логах
grep -i "klaviyoaibot" /var/log/nginx/access.log
Как настроить доступ
Полный запрет через robots.txt — с явной оговоркой, что это отменит функциональность Kai Customer Agent для владельца соответствующего аккаунта Klaviyo:
User-agent: KlaviyoAIBot
Disallow: /
Частичный запрет отдельных разделов — если нужно исключить только чувствительные страницы, оставив остальной контент доступным для AI-функций:
User-agent: KlaviyoAIBot
Disallow: /account/
Disallow: /checkout/
Allow: /
Если задача не полностью заблокировать бота, а лишь снизить частоту обращений в моменте — по документации оператора для этого не обязательно менять robots.txt, достаточно возвращать боту стандартные коды замедления, которые он честно соблюдает:
return 429;
# или, с указанием интервала:
# Retry-After: 60
Это заметно более щадящий инструмент управления нагрузкой, чем жёсткая блокировка через if ($http_user_agent ~* "klaviyoaibot") { return 403; } — последнюю имеет смысл применять только в случае, если бот попал на сайт по ошибке или без ведома владельца и никакой пользы от индексации при этом нет.
Частые вопросы
Может ли KlaviyoAIBot зайти на сайт, никак не связанный с Klaviyo?
Обходит ли бот платный доступ или авторизацию на странице?
Как снизить нагрузку от бота, не блокируя его совсем?
Соблюдает ли KlaviyoAIBot правила robots.txt?
Что делать, если бот появился в логах, а сайт вроде бы не подключён к Klaviyo?
Стоит ли блокировать бота, если сайт использует Kai Customer Agent?
Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.