Если фильтровать access.log по claude-code, часто всплывает целый пласт машинных хитов — это и есть Claude Code. Важное уточнение по итогам проверки: это не фоновый краулер, который систематически собирает контент как сырьё для AI-индекса, а официально задокументированный четвёртый бот в семействе Anthropic — клиент CLI-инструмента Claude Code, который обращается к конкретному URL по инициативе конкретного разработчика во время работы над задачей.
1. Что такое Claude Code
Claude Code — агентный инструмент для написания и отладки кода, встроенный инструмент которого (WebFetch) позволяет разработчику попросить агента посмотреть документацию API, страницу README библиотеки или другой веб-ресурс прямо в процессе работы над кодом. Именно эти обращения и оставляют токен claude-code в access.log. По независимым каталогам ботов, инструмент официально задокументирован Anthropic наравне с тремя другими их ботами — ClaudeBot (тренировка моделей), Claude-User (запросы пользователей claude.ai) и Claude-SearchBot (поисковый индекс) — и, как и они, соблюдает robots.txt.
| Название | Claude Code |
| User-Agent / паттерн | claude-code |
| Оператор | Anthropic — официально задокументированный четвёртый бот в их семействе, отдельно от ClaudeBot/Claude-User/Claude-SearchBot |
| Роль | Клиент CLI-инструмента Claude Code выполняет запрос к URL по инициативе конкретного разработчика в процессе написания или отладки кода (например, чтобы прочитать документацию API) — это не систематический сбор контента, а разовый точечный fetch под конкретную задачу |
| Документация / ориентир | Официальный справочный центр Anthropic по ботам и их поведению в robots.txt; независимые каталоги ботов подтверждают эту документацию |
| Список IP | Важный нюанс: запросы Claude Code часто выполняются буквально с машины разработчика (локально, через инструмент WebFetch), а не из облачной инфраструктуры Anthropic — то есть IP может принадлежать обычному пользователю (домашнему или корпоративному провайдеру), а не публикуемым диапазонам Anthropic |
| robots.txt | Официально соблюдается, как и у трёх других ботов Anthropic (ClaudeBot, Claude-User, Claude-SearchBot) |
| Пометка TrafficVeil | Нежелательный / AI и LLM-краулеры |
2. Зачем Claude Code приходит на сайт
В отличие от шаблонного предположения категории («ваш контент интересен как сырьё для AI-продукта»), присутствие claude-code в логах чаще означает нечто более узкое и человекоориентированное: конкретный разработчик, работающий с Claude Code над своим проектом, попросил агента (или агент сам решил, выполняя задачу) заглянуть на конкретную страницу — документацию, спецификацию API, пример кода. Это не индексация «про запас» и не тренировочный сбор данных, а разовый запрос под конкретную сессию разработки.
- Какие зоны чаще трогает: документация API, README-файлы, технические спецификации, страницы с примерами кода — а не /blog/, /product/, /category/ в общем смысле, если только именно эти разделы не стали предметом задачи разработчика;
- Что ищет: конкретную техническую информацию, релевантную задаче, над которой в данный момент работает разработчик через Claude Code;
- Чем отличается от браузерного пользователя: нет продолжительной пользовательской сессии в привычном смысле, но запрос инициирован конкретным человеком и его текущей задачей, а не автономным расписанием обхода.
Типичный кейс: CDN-трафик дорожает, origin CPU пилит HTML. Фильтр по claude-code показывает единичные или редкие обращения к конкретным техническим страницам — если сайт публикует документацию, API-референс или подобный технический контент, это, вероятнее всего, разработчики используют его как справочный материал через свой инструмент, а не признак систематического сбора данных.
3. Нагрузка и риски именно для Claude Code
Отдельной строки в публичной сводке top-bot TrafficVeil у claude-code может не быть, но в категории «AI и LLM-краулеры» такие агенты дают характерный фон. Для этого конкретного бота риск отличается от типичного «тихого съёма HTML в промышленных масштабах»: поскольку запросы инициированы отдельными разработчиками под конкретные задачи, а не систематическим обходом, серьёзной агрегированной нагрузки claude-code обычно не создаёт — независимый каталог ботов присваивает ему статус «Safe» (проверенный и в целом уважаемый SEO-сообществом).
4. Как найти Claude Code в логах
Не ищите «просто ботов» — ищите конкретный токен claude-code и рядом смотрите соседей по семейству ботов Anthropic.
# Базовый поиск
grep -i "claude-code" /var/log/nginx/access.log
# Топ URL, которые вычитывает бот — ожидаемо документация, API, README
grep -i "claude-code" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head
# Топ IP за этим UA — ожидайте разнообразие (могут быть IP конкретных разработчиков, не облако Anthropic)
grep -i "claude-code" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head
# Суточная активность
grep -i "claude-code" /var/log/nginx/access.log | awk '{print $4}' | cut -d: -f1 | sort | uniq -c
# Сравнить с остальными ботами семейства Anthropic
grep -iE "claude-code|claudebot|claude-user|claude-searchbot" /var/log/nginx/access.log | wc -l
Верификация. Подделать User-Agent может любой скрипт. Здесь верификация по IP особенно ненадёжна: поскольку инструмент часто работает буквально с машины разработчика, а не из облака Anthropic, IP может принадлежать обычному провайдеру, и сверка с официальными диапазонами Anthropic для этого конкретного бота может не сработать так же, как для ClaudeBot.
IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"
5. robots.txt для Claude Code
# Жёсткий запрет
User-agent: claude-code
Disallow: /
# Разрешить всё
User-agent: claude-code
Allow: /
# Компромисс: закрыть деньги/кабинет, оставить публичку
User-agent: claude-code
Disallow: /admin/
Disallow: /cart/
Disallow: /checkout/
Disallow: /account/
Disallow: /api/
Allow: /
Важно: ставьте Disallow, если контент не должен использоваться в AI-обучении, — по независимым данным, блокировка claude-code влияет именно на этот аспект и не затрагивает поисковую видимость или обычный трафик сайта. Если сайт публикует документацию или технические материалы, которые разработчики закономерно используют как справочник через свои инструменты, стоит взвесить: блокировка также помешает и этому легитимному, человеко-инициированному использованию.
6. Блокировка вручную и через TrafficVeil
Nginx
if ($http_user_agent ~* "claude-code") {
return 403;
}
limit_req_zone $binary_remote_addr zone=claudecode:10m rate=10r/m;
location / {
if ($http_user_agent ~* "claude-code") {
limit_req zone=claudecode burst=20 nodelay;
}
}
Apache (.htaccess)
RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} claude-code [NC]
RewriteRule ^ - [F,L]
TrafficVeil
- Найдите claude-code в ботах домена или в /system/bots;
- Для нежелательного сценария — категорию «запретить»; для мягкого — rate-limit;
- Allow оставляйте, если сайт публикует техническую документацию и заинтересован в том, чтобы разработчики могли легко ссылаться на неё через свои AI-инструменты;
- После изменения сверьте логи: хиты claude-code должны уйти в блок или лимит, а нужные поисковики остаться.
7. Рекомендации: что делать с Claude Code
- Блокировка почти не бьёт по классическому SEO Google/Yandex и не затрагивает обычный пользовательский трафик — она относится именно к вопросу участия контента в AI-обучении;
- Если сайт публикует API-документацию, технические гайды или подобный справочный контент — учитывайте, что claude-code часто используется добросовестными разработчиками как рабочий инструмент, а не только как сборщик данных;
- Если пользы нет — Disallow/403 для claude-code;
- Не режьте слишком широко User-agent: *, чтобы случайно не закрыть Googlebot/YandexBot;
- Не путайте с другими ботами семейства Anthropic — блокировка claude-code не влияет на поведение ClaudeBot, Claude-User или Claude-SearchBot, у каждого свои правила.
8. С кем не путать Claude Code
| Бот / сосед | Кластер | UA | Комментарий |
| ClaudeBot | AI и LLM-краулеры | claudebot | тот же оператор — систематический тренировочный краулер, а не разовый fetch по задаче разработчика |
| Claude-User | AI и LLM-краулеры | claude-user | тот же оператор — запросы пользователей claude.ai, а не разработчиков в CLI-инструменте |
| Claude-SearchBot | AI и LLM-краулеры | claude-searchbot | тот же оператор — построение поискового индекса для цитирований |
| anthropic-ai | AI и LLM-краулеры | anthropic-ai | устаревший, депрекированный токен того же оператора — не соответствует действующей инфраструктуре |
| AI2Bot | AI и LLM-краулеры | ai2bot | другой оператор (Allen Institute for AI), не связан с Anthropic |
9. Стратегия allow/deny для Claude Code
| Ситуация | Действие |
| Сайт публикует техническую документацию, полезную разработчикам | Allow — claude-code часто используется добросовестно как справочный инструмент |
| Принципиально против участия в AI-обучении | Disallow — влияет именно на этот аспект, не на SEO |
| Нужен доступ, но пики мешают | Rate-limit на nginx/TrafficVeil |
| Нежелательный по базе TrafficVeil | Deny по умолчанию, исключения — точечно |
| Подозрение на spoofing UA | IP-верификация здесь менее надёжна, чем для ClaudeBot — запросы могут идти с машины конкретного разработчика, а не из облака Anthropic |