TrafficVeil
Боты 4 мин24 августа 2026 г.

Slackbot: превью ссылок, но robots.txt его не остановит

Slackbot в логах — легитимный фетчер превью ссылок Slack, но с важным нюансом: компания официально не соблюдает robots.txt для этого бота. Разбираемся, как на самом деле ограничить его доступ.

TV
TrafficVeil Team
Эксперты по защите веб-трафика
Содержание статьи
  1. Что такое Slackbot на самом деле
  2. Зачем Slackbot приходит на сайт
  3. Важный нюанс: почему robots.txt здесь не работает
  4. Как найти Slackbot в логах
  5. Блокировка вручную и через TrafficVeil
  6. Что в итоге делать со Slackbot
DDoS L7

DDoS атака что это простыми словами и как защитить сайт

Разобрали виды атак, признаки DDoS, последствия, уровни защиты, L7 DDoS и схему подключения TrafficVeil через DNS/reverse proxy.

Читать про DDoS

Энциклопедия ботов TrafficVeil

618 ботов с описаниями, паттернами User-Agent и фильтром по категориям — открытый справочник для аудита логов и настройки защиты.

Открыть справочник

Строка slackbot в черновиках часто описывают как «оператор не указан публично» — хотя здесь редкий случай, когда сам оператор официально и подробно документирует поведение своего бота на отдельной странице: api.slack.com/robots. Это Slack (продукт Salesforce), и его агент для превью ссылок работает не совсем так, как большинство ботов из этой энциклопедии, — с одним важным исключением из общего правила про robots.txt.

Что такое Slackbot на самом деле

Полное имя агента — Slackbot-LinkExpanding, с отдельным компаньоном Slack-ImgProxy для загрузки изображений. Когда пользователь Slack вставляет ссылку в канал или личное сообщение, Slackbot-LinkExpanding обращается к странице, используя HTTP Range-заголовки, чтобы забрать минимально необходимую часть страницы и извлечь oEmbed, Open Graph и Twitter Card теги для превью-карточки. Ответы кешируются на стороне Slack примерно на 30 минут, поэтому повторных запросов к одному и тому же URL чаще этого интервала быть не должно.

Параметр Значение
Название Slackbot (полное имя — Slackbot-LinkExpanding; компаньон — Slack-ImgProxy)
User-Agent / паттерн Slackbot-LinkExpanding 1.0 (+https://api.slack.com/robots)
Оператор Slack (Salesforce) — официально задокументировано на api.slack.com/robots
Категория TrafficVeil Фетчер превью-ссылок мессенджера (не проверка интеграции и не общий краулер)
Что делает на сайте Забирает минимальную часть страницы для генерации превью ссылки, вставленной пользователем в Slack
Список IP ❌ Отдельного публичного списка IP не найдено; проверяйте ASN и поведение
robots.txt Официально НЕ соблюдается — Slack прямо заявляет, что не учитывает robots.txt для этого бота, так как действует от имени человека, а не как самостоятельный краулер
Пометка TrafficVeil Легитимный — визит означает, что вашу страницу упомянули в Slack

Зачем Slackbot приходит на сайт

Триггер — не расписание, а конкретное действие пользователя Slack: он вставил вашу ссылку в сообщение, и сервис обращается к странице, чтобы вытащить мета-теги для превью-карточки. Это тот же принцип, что у facebookexternalhit, Twitterbot или Snap URL Preview Service — точечный, событийный визит к одной конкретной странице, а не системный обход сайта.

Важный нюанс: почему robots.txt здесь не работает

В отличие от большинства ботов в этой энциклопедии, Slack официально и прямо заявляет: «Мы не соблюдаем файлы robots.txt. После внедрения и экспериментов с этим мы получили слишком много жалоб от пользователей, потому что значительная часть интернета недоступна для краулеров. Поскольку мы не краулер — мы не переходим по ссылкам и действуем от имени человека, — было логично перестать обрабатывать robots.txt, как если бы мы были краулером». Практический вывод: директива в robots.txt для Slackbot ничего не изменит — если нужно ограничить доступ, единственный рабочий способ — блокировка на уровне сервера по UA или IP.

Как найти Slackbot в логах

# Базовый поиск
grep -i "slackbot" /var/log/nginx/access.log

# Какие именно страницы упоминали в Slack
grep -i "slackbot" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head

# Топ IP
grep -i "slackbot" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head

Для верификации сверяйте IP через ASN — единичные точечные визиты к конкретной странице характерны для настоящего фетчера, а не для спуфинга:

IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"

Блокировка вручную и через TrafficVeil

# robots.txt Slack официально не читает, но директиву всё равно можно оставить
# как сигнал для других инструментов, которые её уважают
User-agent: Slackbot-LinkExpanding
Allow: /

TrafficVeil: для этого бота разумный вариант по умолчанию — «легитимный» без ограничений: нагрузка минимальна и кешируется самим Slack, а польза (корректные превью при упоминании ссылки в рабочих чатах) обычно перевешивает риски. Если всё же требуется заблокировать бота — не полагайтесь на robots.txt, настраивайте правило на уровне nginx/Apache или в TrafficVeil по UA/IP.

Что в итоге делать со Slackbot

Ситуация Действие
Стандартный случай Allow без ограничений — визитов мало, а превью в Slack полезны для B2B-контента
Аудитория Slack не релевантна бизнесу Блокировка на уровне сервера/TrafficVeil — robots.txt для этого не сработает
Подозрение на спуфинг (высокая частота, обход многих URL) Сверять по ASN — настоящий Slackbot так себя не ведёт

Частые вопросы

Правда ли, что оператор Slackbot неизвестен?

Нет, это официально задокументированный бот Slack (продукт Salesforce) — компания подробно описывает его поведение на отдельной странице api.slack.com/robots.

Остановит ли директива в robots.txt бота Slackbot?

Нет, Slack официально заявляет, что не учитывает robots.txt для этого агента, поскольку считает его не краулером, а сервисом, действующим от имени человека.

Как тогда реально ограничить доступ Slackbot, если это нужно?

Только правилами на уровне веб-сервера или в TrafficVeil по UA или IP — полагаться на robots.txt в этом случае бессмысленно.

Зачем этот бот вообще заходит на сайт?

Кто-то вставил вашу ссылку в сообщение или канал Slack, и сервис забирает минимальную часть страницы, чтобы показать превью-карточку.

Как часто Slack повторно запрашивает одну и ту же ссылку?

Ответы кешируются на стороне Slack примерно на 30 минут, поэтому более частых повторных запросов к одному URL быть не должно.

Есть ли у Slack отдельный бот для загрузки изображений в превью?

Да, это Slack-ImgProxy — компаньон Slackbot-LinkExpanding, который отдельно забирает и кеширует изображения для карточек превью.

#Slackbot#боты#краулеры#антибот#Slack#превью ссылок#robots.txt#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.