В логах сайт может выглядеть «живым», хотя рост даёт не аудитория, а AI SEO Crawler с User-Agent ai seo crawler. Важное уточнение по итогам проверки: ни классические SEO-краулеры, ни реальные AI-краулеры не используют именно эту обобщённую фразу как свой UA — у каждой категории есть собственные, чётко задокументированные имена, и «AI SEO Crawler» не совпадает ни с одной из них.
1. Что такое AI SEO Crawler
SEO-платформы, которые реально обходят сайты для технического аудита, отслеживания позиций и анализа ссылок, называют себя конкретно: AhrefsBot у Ahrefs, SemrushBot у Semrush, ClarityBot у seoClarity, боты Screaming Frog и Majestic — у каждого своё уникальное имя и, как правило, документация о соблюдении robots.txt. Реальные AI-краулеры точно так же называются конкретно: GPTBot, ClaudeBot, PerplexityBot, Claude-SearchBot и подобные. Токен «AI SEO Crawler» будто пытается объединить обе категории в одном обобщённом имени — но ни один известный оператор ни из SEO-индустрии, ни из мира AI так себя не называет.
| Название | AI SEO Crawler |
| User-Agent / паттерн | ai seo crawler |
| Оператор | Не установлен — ни известные SEO-платформы (Ahrefs, Semrush, seoClarity, Screaming Frog, Majestic), ни известные AI-краулеры не используют этот UA |
| Роль | По шаблону категории — наполнение AI-индекса или обучающей/retrieval-выборки; но без подтверждённого оператора нельзя сказать, что реально стоит за токеном |
| Документация / ориентир | Публичной документации для этого конкретного токена не найдено ни в SEO-, ни в AI-каталогах ботов |
| Список IP | ❌ Официального списка нет |
| robots.txt | Поведение непредсказуемо — нет подтверждённого единого оператора, который мог бы задать политику |
| Пометка TrafficVeil | Легитимный / AI и LLM-краулеры — присвоено по шаблону категории, конкретных оснований для доверия меньше, чем для документированных SEO- или AI-краулеров |
2. Зачем AI SEO Crawler приходит на сайт
Шаблонное объяснение категории — визиты чаще связаны с наполнением AI-индекса или обучающей/retrieval-выборки, а не с классической поисковой выдачей. Но раз токен не совпадает ни с одной документированной SEO- или AI-платформой, стоит относиться к заявленной цели со скепсисом: возможно, это небольшой no-name инструмент, который скомбинировал слова «AI» и «SEO Crawler» в описательное, но никак не защищённое конкретным брендом имя.
- Какие зоны чаще трогает: /blog/, /product/, /category/, /news/, /api/ (если открыто), пагинация каталога;
- Что ищет: контент, метаданные, availability или ссылочный граф — конкретная цель не подтверждена официальной документацией;
- Чем отличается от браузерного пользователя: нет нормальной сессии, другие интервалы, повторяемый path-паттерн.
Типичный кейс: ночью RPS растёт, конверсий нет. В access.log доминирует ai seo crawler на пагинации и карточках. Прежде чем решить, что это «в целом безобидный SEO- или AI-инструмент», сравните его с настоящими SEO-ботами (AhrefsBot, SemrushBot) — если вы сами используете один из этих сервисов, их трафик будет называться иначе, и «AI SEO Crawler» не заменяет и не дублирует их.
3. Нагрузка и риски именно для AI SEO Crawler
Отдельной строки в публичной сводке top-bot TrafficVeil у ai seo crawler может не быть, но в категории «AI и LLM-краулеры» такие агенты дают характерный фон: нагрузка может быть «тихой» — не DDoS в классическом смысле, но постоянный съём HTML и рост bandwidth. Для этого токена риск неопределённости выше среднего: нет ни репутации SEO-индустрии (где у крупных игроков есть публичные соглашения и документация), ни репутации известного AI-оператора — только обобщённое, ничем не подкреплённое имя.
Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.
4. Как найти AI SEO Crawler в логах
Не ищите «просто ботов» — ищите конкретный токен ai seo crawler и сравнивайте с настоящими SEO- и AI-краулерами.
# Базовый поиск
grep -i "ai seo crawler" /var/log/nginx/access.log
# Топ URL, которые вычитывает бот
grep -i "ai seo crawler" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head
# Топ IP за этим UA
grep -i "ai seo crawler" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head
# Суточная активность
grep -i "ai seo crawler" /var/log/nginx/access.log | awk '{print $4}' | cut -d: -f1 | sort | uniq -c
# Проверить полную строку UA — есть ли ссылка на реального оператора
grep -io "ai seo crawler[^\"]*" /var/log/nginx/access.log | sort -u | head
# Сравнить с настоящими SEO- и AI-краулерами
grep -iE "ahrefsbot|semrushbot|gptbot|perplexitybot|claudebot" /var/log/nginx/access.log | wc -l
Верификация. Подделать User-Agent может любой скрипт. Официального списка IP нет, поэтому смотрите полную строку UA целиком: у реальных SEO- и AI-краулеров всегда есть ссылка на документацию оператора. Если такой ссылки нет — доверять названию не стоит.
IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"
5. robots.txt для AI SEO Crawler
# Жёсткий запрет
User-agent: ai seo crawler
Disallow: /
# Разрешить всё
User-agent: ai seo crawler
Allow: /
# Компромисс: закрыть деньги/кабинет, оставить публичку
User-agent: ai seo crawler
Disallow: /admin/
Disallow: /cart/
Disallow: /checkout/
Disallow: /account/
Disallow: /api/
Allow: /
Важно: ставьте Disallow или 403 для ai seo crawler, если пользы нет — с учётом отсутствия подтверждённого оператора это разумный default. Если вы сами используете реальный SEO-инструмент (Ahrefs, Semrush и подобные), настраивайте правила под их настоящие токены, а не под этот обобщённый.
6. Блокировка вручную и через TrafficVeil
Nginx
if ($http_user_agent ~* "ai seo crawler") {
return 403;
}
limit_req_zone $binary_remote_addr zone=aiseocrawler:10m rate=10r/m;
location / {
if ($http_user_agent ~* "ai seo crawler") {
limit_req zone=aiseocrawler burst=20 nodelay;
}
}
Apache (.htaccess)
RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} ai seo crawler [NC]
RewriteRule ^ - [F,L]
TrafficVeil
- Найдите ai seo crawler в ботах домена или в /system/bots;
- Для нежелательного сценария — категорию «запретить»; для мягкого — rate-limit;
- Allow только при явной, подтверждённой пользе — и не путайте этот токен с реальными используемыми вами SEO-инструментами;
- После изменения сверьте логи: хиты ai seo crawler должны уйти в блок или лимит, а настоящие SEO- и поисковые боты — остаться без изменений.
7. Рекомендации: что делать с AI SEO Crawler
- Если пользы нет — Disallow/403 для ai seo crawler, если пользы нет;
- Если вы используете реальный SEO-инструмент — проверьте, что его настоящий токен (AhrefsBot, SemrushBot и подобные) разрешён отдельно, независимо от политики по этому обобщённому имени;
- Если нагрузка мешает — сначала rate-limit, затем полный запрет;
- Не режьте слишком широко User-agent: *, чтобы случайно не закрыть Googlebot/YandexBot;
- Что будет при блокировке: блокировка почти не бьёт по классическому SEO Google/Yandex и, вероятнее всего, не затрагивает работу реальных SEO-инструментов, которые называются иначе.
8. С кем не путать AI SEO Crawler
| Бот / сосед | Кластер | UA | Комментарий |
| AhrefsBot | SEO-краулеры | ahrefsbot | реальный, документированный краулер Ahrefs |
| SemrushBot | SEO-краулеры | semrushbot | реальный, документированный краулер Semrush |
| ClarityBot | SEO-краулеры | claritybot | реальный краулер seoClarity, соблюдает robots.txt и crawl-delay |
| AI Article Writer | AI и LLM-краулеры | ai article writer | такой же обобщённый токен без единого подтверждённого оператора |
| AI Search Engine | AI и LLM-краулеры | ai search engine | такой же обобщённый токен без единого подтверждённого оператора |
9. Стратегия allow/deny для AI SEO Crawler
| Ситуация | Действие |
| Используете реальный SEO-инструмент | Настроить правило под его настоящий токен (AhrefsBot, SemrushBot и подобные), не под ai seo crawler |
| Только мешает и жрёт ресурсы | Disallow + запрет в TrafficVeil |
| Нужен доступ, но пики по ночам | Rate-limit на nginx/TrafficVeil |
| Нежелательный по базе TrafficVeil | Deny по умолчанию, исключения — точечно |
| Подозрение на spoofing UA | Высокое по умолчанию — обобщённое имя без подтверждённой связи с оператором скорее повод для проверки, чем для доверия |
Частые вопросы
AI SEO Crawler — это Ahrefs, Semrush или похожий инструмент?
Может быть, это всё-таки реальный AI-краулер под другим названием категории?
Если я использую Ahrefs или Semrush, повлияет ли на них блокировка этого токена?
Стоит ли по умолчанию блокировать этот токен?
Как проверить полную строку UA на признаки настоящего оператора?
Что делать, если хочется разрешить и SEO-инструменты, и AI-краулеры одновременно?
Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.