Боты5 мин чтения·11 августа 2026 г.·обновлено 8 сентября 2026 г.

Anthropic-ai: устаревший токен Claude — почему сегодня нужны три отдельных правила вместо одного

anthropic-ai и Claude-Web — деприкейтнутые идентификаторы, официально заменённые тремя раздельными краулерами: ClaudeBot (обучение), Claude-User (запрос по инициативе пользователя в диалоге) и Claude-SearchBot (поиск внутри Claude). Разбираем, зачем Anthropic разделила бота на три, что означает появление старого UA в логах в 2026 году, и как настроить robots.txt под актуальную схему.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота AnthropicAI: легитимный ai и llm-краулеры

Строка anthropic-ai (иногда встречается слитно как anthropicai) в логах указывает на компанию Anthropic, разработчика Claude, — но важно понимать: это устаревший идентификатор. Наравне с другим легаси-именем, Claude-Web, он давно не используется в актуальной инфраструктуре компании и заменён тремя отдельными, более специализированными краулерами. Если в 2026 году в логах всё ещё встречается именно старое имя, стоит в первую очередь свериться с актуальным списком, а не строить политику вокруг устаревшего токена.

Как Anthropic реорганизовала своих краулеров

Anthropic обновила официальную документацию по краулерам, разделив единого универсального бота на три самостоятельных агента с разными задачами и разными строками User-Agent в robots.txt:

  • ClaudeBot — основной краулер, который собирает публично доступный контент для обучения и улучшения будущих моделей Claude;
  • Claude-User — срабатывает, когда живой пользователь Claude в диалоге просит модель открыть конкретную страницу — это не массовый обход, а точечный запрос по инициативе конкретного человека;
  • Claude-SearchBot — индексирует контент специально для функций поиска внутри экосистемы Claude, отдельно от тренировочного пайплайна.

Ключевое следствие этого разделения — блокировка одного бота не блокирует остальных автоматически. Например, запрет ClaudeBot останавливает попадание новых материалов сайта в обучающие датасеты будущих моделей, но никак не мешает Claude-SearchBot индексировать сайт для поисковых функций или Claude-User — открывать конкретную страницу по прямому запросу пользователя в диалоге. Каждый из трёх ботов настраивается в robots.txt независимо.

Параметры

Параметр Значение
Устаревшие токены anthropic-ai, Claude-Web — оба официально признаны устаревшими (deprecated)
Актуальные токены ClaudeBot, Claude-User, Claude-SearchBot — каждый со своей строкой в robots.txt
Оператор Anthropic
Соблюдение robots.txt По заявлению компании, все три актуальных бота, включая пользовательский Claude-User, следуют правилам robots.txt — это отличает политику Anthropic от части других AI-компаний, где часть пользовательских фетчеров может robots.txt игнорировать
Поддержка Crawl-delay Поддерживается официально — можно задать не только allow/disallow, но и задержку между запросами
Список IP-адресов Официального списка диапазонов Anthropic не публикует; верификация — по строке User-Agent в логах

Что означает появление устаревшего UA в 2026 году

Есть два реалистичных объяснения. Первое — устаревшая или заранее заскриптованная реализация клиента где-то в цепочке (редко, но встречается, если какой-то внутренний инструмент десятилетней настройки ещё использует старую строку). Второе, значительно более вероятное — спуфинг: сторонний скрапер намеренно представляется именем известной AI-компании, рассчитывая, что администратор сайта либо пропустит его как «легитимного», либо, наоборот, не станет разбираться и просто скопирует чужое правило блокировки без проверки актуальности.

В обоих случаях практический вывод один: строить текущую политику допуска стоит вокруг актуальной тройки — ClaudeBot, Claude-User, Claude-SearchBot, а не вокруг легаси-имени, которое официально не используется.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Как найти в логах

# Устаревший токен
grep -iE "anthropic-ai|anthropicai|claude-web" /var/log/nginx/access.log

# Актуальные боты
grep -iE "claudebot|claude-user|claude-searchbot" /var/log/nginx/access.log

Как настроить robots.txt под актуальную схему

Отдельное правило для каждого из трёх современных ботов — с возможностью разрешить один и запретить другой независимо:

User-agent: ClaudeBot
Disallow: /

User-agent: Claude-User
Allow: /

User-agent: Claude-SearchBot
Allow: /

Такая конфигурация, например, полностью выводит сайт из тренировочных датасетов будущих моделей Claude, но сохраняет видимость в поисковых функциях внутри Claude и позволяет модели открывать конкретные страницы по прямому запросу пользователя в диалоге — то есть блокирует использование контента для обучения, но не блокирует видимость сайта для конечных пользователей Claude.

Для устаревших токенов, если они всё же встречаются в логах, — блокировка на уровне сервера как для потенциального спуфинга:

if ($http_user_agent ~* "anthropic-ai|claude-web") {
    return 403;
}

Стоит ли блокировать

Решение по каждому из трёх актуальных ботов имеет смысл принимать отдельно, а не оптом:

  • если важно не отдавать контент в обучающие датасеты — логично заблокировать именно ClaudeBot, оставив два других открытыми;
  • если сайт заинтересован в видимости для пользователей Claude (например, чтобы модель могла точно и актуально пересказывать информацию о бренде или продукте по прямому запросу) — Claude-User и Claude-SearchBot стоит оставить разрешёнными;
  • на позиции в органической выдаче Google, Bing или Яндекса ни один из этих ботов не влияет — это отдельная, не связанная с классическим поиском экосистема.

Частые вопросы

Используется ли ещё токен anthropic-ai?
Нет, он официально признан устаревшим вместе с Claude-Web — актуальная инфраструктура работает через три отдельных бота.
Чем отличаются три современных бота Anthropic?
ClaudeBot собирает данные для обучения моделей, Claude-User точечно открывает страницу по прямому запросу пользователя в диалоге, а Claude-SearchBot индексирует контент для поисковых функций внутри Claude.
Если заблокировать ClaudeBot, заблокируются ли остальные два бота автоматически?
Нет, каждый бот настраивается в robots.txt независимо — блокировка одного не влияет на работу двух других.
Что чаще всего означает появление устаревшего anthropic-ai в логах сегодня?
Скорее всего, это спуфинг — сторонний скрапер выдаёт себя за известное имя, либо реже — давно не обновлявшаяся реализация клиента где-то в цепочке.
Соблюдают ли боты Anthropic правила robots.txt?
Да, по заявлению компании все три актуальных бота, включая пользовательский Claude-User, следуют robots.txt — это отличает подход Anthropic от части других AI-компаний.
Как заблокировать использование контента для обучения, но сохранить видимость для пользователей Claude?
Запретить в robots.txt только ClaudeBot, оставив Claude-User и Claude-SearchBot разрешёнными.
#anthropic-ai#ClaudeBot#Claude-User#Claude-SearchBot#AI-краулер#бот-энциклопедия#robots.txt#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil