Боты5 мин чтения·9 августа 2026 г.·обновлено 8 сентября 2026 г.

Два бота одной Kagi: не путайте kagi-fetcher с Kagibot

У поисковой системы Kagi есть два разных бота — основной краулер Kagibot и менее документированный kagi-fetcher, срабатывающий по живым запросам через Kagi AI. Разбираем разницу и как настроить каждого отдельно.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота kagi-fetcher: нежелательный прочие краулеры и сервисы

kagi-fetcher стоит отдельного правила в антиботе — но прежде чем настраивать это правило, стоит разобраться, что перед вами: у поисковой системы Kagi на самом деле два разных бота, и в логах их легко перепутать.

Не путайте kagi-fetcher с Kagibot

Бот Задача Документация
Kagibot Классический поисковый краулер — строит индекс Kagi Search Официальная страница kagi.com/bot, статические IP, понятная логика robots.txt
kagi-fetcher Подгружает содержимое конкретной страницы, чтобы ответить на живой запрос пользователя через ИИ-инструменты Kagi (Kagi Assistant и связанные функции) Отдельной официальной страницы, аналогичной kagi.com/bot, не найдено

Это разные боты одной компании с разной логикой поведения — как если бы у сайта был отдельный краулер для поиска и отдельный fetcher для ИИ-ассистента. Далее речь именно про kagi-fetcher.

Что такое kagi-fetcher

Параметр Значение
Название kagi-fetcher
User-Agent / паттерн kagi-fetcher
Оператор Kagi — независимая платная поисковая система
Роль Загружает содержимое страницы для ответа на конкретный запрос пользователя в Kagi AI (Assistant и смежные функции) — не автономный обход по расписанию
Документация / ориентир Официальной страницы конкретно по kagi-fetcher не найдено (в отличие от Kagibot); включён в открытый community-проект ai.robots.txt как AI-related агент
Список IP ❌ Отдельного официального списка для kagi-fetcher нет; для Kagibot IP публикуются отдельно и не должны применяться к этому боту
robots.txt Официального заявления о поведении конкретно kagi-fetcher нет. Общая практика для агентов этой категории (fetch по запросу пользователя, а не автономный обход) — соблюдение не гарантировано так же строго, как у классических краулеров
Пометка TrafficVeil Прочие краулеры и сервисы

Зачем kagi-fetcher приходит на сайт

Логика похожа на другие «user-triggered» fetch-агенты: кто-то из подписчиков Kagi задал вопрос через Kagi Assistant, и для формирования ответа сервису понадобилось подгрузить содержимое конкретной страницы вашего сайта.

  • Какие зоны чаще трогает: конкретные URL, которые оказались релевантны запросу пользователя — не сайт целиком
  • Что ищет: содержимое страницы для формирования ответа ИИ-инструмента Kagi
  • Чем отличается от Kagibot: нет систематического обхода по расписанию — визиты привязаны к моменту, когда чей-то запрос затронул именно ваш контент

Типичный кейс: CDN-трафик слегка дорожает, origin CPU нагружен вычиткой отдельных HTML-страниц. Фильтр по kagi-fetcher в логах покажет точечные, не систематические обращения — это отличает его от типичного «фонового шума» обычных нежелательных краулеров.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Нагрузка и риски

Отдельной строки в публичной сводке top-bot TrafficVeil у kagi-fetcher может не быть, но в категории «Прочие краулеры и сервисы» такие агенты дают характерный фон: на отдельных доменах серии запросов выглядят как мини-волны автоматизации без конверсий. Учитывая природу user-triggered fetch, объём для большинства сайтов, скорее всего, невелик — Kagi заметно менее массовая аудитория, чем Google или OpenAI. Смотрите не только абсолютный RPS, но и качество хитов: глубина обхода, повторы одних и тех же URL, отсутствие cookie/сессий и концентрация на служебных или листовых страницах.

Как найти kagi-fetcher в логах

# Базовый поиск
grep -i "kagi-fetcher" /var/log/nginx/access.log

# Топ URL, которые вычитывает бот
grep -i "kagi-fetcher" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head

# Топ IP за этим UA
grep -i "kagi-fetcher" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head

# Суточная активность
grep -i "kagi-fetcher" /var/log/nginx/access.log | awk '{print $4}' | cut -d: -f1 | sort | uniq -c

# Отделить kagi-fetcher от Kagibot — это разные боты
grep -iE "kagi-fetcher|kagibot" /var/log/nginx/access.log | \
  sed -n 's/.*"\([^"]*\)".*/\1/p' | sort | uniq -c | sort -rn

Верификация

Подделать User-Agent может любой скрипт. Официального списка IP для kagi-fetcher нет — не путайте с IP-адресами Kagibot (216.18.205.234, 35.212.27.76, 104.254.65.50, 209.151.156.194), они относятся к другому боту той же компании и не годятся для верификации kagi-fetcher.

IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"

robots.txt для kagi-fetcher

# Жёсткий запрет
User-agent: kagi-fetcher
Disallow: /

# Разрешить всё
User-agent: kagi-fetcher
Allow: /

# Компромисс: закрыть служебные разделы, оставить публичку
User-agent: kagi-fetcher
Disallow: /admin/
Disallow: /cart/
Disallow: /checkout/
Disallow: /account/
Disallow: /api/
Allow: /

Важно: не переносите на kagi-fetcher правила, написанные под Kagibot, и наоборот — у Kagi нет общего правила «одно на всю компанию», это разные User-agent токены с разным поведением.

Блокировка вручную и через TrafficVeil

Nginx

if ($http_user_agent ~* "kagi-fetcher") {
    return 403;
}

limit_req_zone $binary_remote_addr zone=kagifetcher:10m rate=10r/m;
location / {
    if ($http_user_agent ~* "kagi-fetcher") {
        limit_req zone=kagifetcher burst=20 nodelay;
    }
}

Apache (.htaccess)

RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} kagi-fetcher [NC]
RewriteRule ^ - [F,L]

TrafficVeil

  • Найдите kagi-fetcher отдельно от Kagibot в ботах домена или в /system/bots — это разные записи
  • Для нежелательного сценария — категория «запретить»; для мягкого — rate-limit
  • Allow стоит рассматривать, если для сайта важна видимость в ответах Kagi AI
  • После изменения сверьте логи: хиты kagi-fetcher должны уйти в блок/лимит, а Kagibot и другие поисковики остаться без изменений

Рекомендации: что делать с kagi-fetcher

  • Видимость в ответах Kagi AI не приоритет — Disallow/403, критичных потерь для основного SEO не будет (это не Kagibot, не основной поисковый индекс)
  • Важна видимость в ИИ-ответах Kagi — Allow, но отдельным правилом, не смешивая с настройками Kagibot
  • Если нагрузка мешает — сначала rate-limit, затем полный запрет
  • Не режьте слишком широко User-agent: *, чтобы случайно не закрыть Googlebot/YandexBot вместе с kagi-fetcher

Частые вопросы

Kagi-fetcher и Kagibot — это один и тот же бот?
Нет, это два разных бота одной компании: Kagibot строит поисковый индекс, а kagi-fetcher подгружает страницы по живым запросам через Kagi AI.
Есть ли у kagi-fetcher такая же официальная документация, как у Kagibot?
Нет, отдельной страницы с подробностями конкретно про kagi-fetcher, аналогичной kagi.com/bot, не найдено.
Можно ли использовать IP-адреса Kagibot для верификации kagi-fetcher?
Нет, это адреса другого бота той же компании — для kagi-fetcher они не подходят.
Повлияет ли блокировка kagi-fetcher на позиции сайта в поиске Kagi?
Нет, за поисковый индекс отвечает Kagibot — блокировка kagi-fetcher касается только видимости в ответах ИИ-инструментов Kagi.
Стоит ли ожидать большого объёма трафика от kagi-fetcher?
Как правило, нет — аудитория Kagi заметно меньше, чем у Google или OpenAI, и трафик привязан к конкретным пользовательским запросам, а не к регулярному обходу.
Как отличить kagi-fetcher от Kagibot прямо в логах?
По самой строке User-Agent — токены разные (kagi-fetcher и kagibot), и полезно смотреть их отдельно, а не одним общим фильтром.
#kagi-fetcher#Kagibot#Kagi#Kagi Assistant#robots.txt#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil