atlassian-bot — не безымянный «сервисный агент», а официально задокументированный краулер компании Atlassian, и появление его в логах почти всегда означает одно: администратор чьей-то организации в Atlassian Administration осознанно подключил ваш сайт как источник для индексации через коннектор Custom Website — часть системы Teamwork Graph, которая питает поиск и AI-функции продукта Rovo (AI-ассистент, встроенный в Jira, Confluence и другие инструменты Atlassian).
Что именно индексирует бот и зачем
По официальной документации Atlassian, коннектор Custom Website выполняет поисковый обход и индексацию сайта, чтобы его содержимое затем появлялось в результатах поиска и было доступно в Rovo Chat и AI-агентах внутри организации, которая настроила подключение. Индексируются веб-страницы (text/html) и текстовые файлы (text/plain), а для каждого объекта сохраняются название, URL, дата создания, дата последнего обновления, описание и содержимое страницы. Важная деталь из документации: коннектор поддерживает только защищённые (https) сайты, которыми управляет сама организация, — то есть штатный сценарий использования подразумевает, что клиент Atlassian подключает свой собственный сайт или внутренний ресурс, а не чужой сторонний домен.
Тем не менее коннектор технически способен обходить и сайты со сложной аутентификацией (базовой или через форму входа) — если такое подключение настроено, все пользователи Teamwork Graph в организации получают доступ ко всему содержимому, доступному указанным логином и паролем, без индивидуального разграничения прав. Это специфика именно данного коннектора, которую стоит учитывать при оценке потенциальной чувствительности данных, если вдруг закрытый раздел сайта оказался неожиданно доступен через чужую корпоративную индексацию.
Параметры бота
| Параметр | Значение |
| Токен robots.txt | atlassian-bot |
| Оператор | Atlassian — официально подтверждено в документации компании |
| Продукт | Teamwork Graph / Rovo (AI-поиск, чат и агенты внутри продуктов Atlassian) |
| Что индексирует | HTML-страницы и текстовые файлы: название, URL, даты создания/обновления, описание, содержимое страницы |
| Соблюдение robots.txt | Да — Atlassian прямо документирует, как добавить отдельные Allow/Disallow правила именно для токена atlassian-bot, и коннектор их соблюдает |
| Официальный список IP | ✅ Публикуется по адресу ip-ranges.atlassian.com — конкретно у записей с параметром product: rovo-crawler, а также дублируется в общей документации по IP-адресам облачных продуктов Atlassian |
| Частота обхода | Настраивается администратором, подключившим коннектор, индивидуально для каждого сайта |
Как выглядит сценарий с точки зрения владельца сайта
Если ваш сайт получает трафик от atlassian-bot, велика вероятность одного из двух сценариев: либо это ваша собственная организация подключила собственный же сайт (например, публичную документацию или базу знаний поддержки) как источник для внутреннего Rovo-поиска сотрудников, либо кто-то из клиентов, партнёров или контрагентов, использующих продукты Atlassian, настроил у себя интеграцию с вашим доменом — например, чтобы их сотрудники могли быстро находить информацию с вашего сайта через корпоративный AI-поиск. В обоих случаях это не массовый, ничем не мотивированный обход, а результат сознательного административного действия конкретной организации.
Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.
Как найти бота в логах
grep -i "atlassian-bot" /var/log/nginx/access.log
Поскольку официальный список IP публикуется и обновляется динамически, для проверки подлинности запроса стоит сверяться именно с ним, а не только со строкой User-Agent, которую в принципе может подделать любой скрипт.
Стоит ли блокировать
Решение стоит принимать исходя из того, полезна ли для сайта индексация в чужих или собственных корпоративных Rovo-инструментах:
- если сайт — это ваша собственная документация или база знаний, и вы сами настраиваете для неё внутренний корпоративный поиск через Rovo, — бот нужен для работы этой функции, блокировать его не стоит;
- если сайт публичный и присутствие в чужих корпоративных AI-поисках потенциально полезно (например, справочный или продуктовый контент, который могут искать клиенты через свои внутренние инструменты Atlassian), — блокировка отсечёт эту возможность без выигрыша взамен;
- если сайт не заинтересован в подобной индексации ни в каком виде — можно ограничить бота полностью или частично через стандартный механизм robots.txt, который коннектор соблюдает;
- на позиции в органической выдаче Google, Bing или Яндекса присутствие или отсутствие этого бота не влияет — это отдельная от классического поиска система.
Как настроить robots.txt
Полный запрет:
User-agent: atlassian-bot
Disallow: /
Частичное ограничение — закрыть конкретный неинформативный раздел, оставив остальной сайт доступным для индексации:
User-agent: atlassian-bot
Disallow: /not-useful/
Явное разрешение, если индексация желательна:
User-agent: atlassian-bot
Allow: /
Как альтернативу или дополнение к robots.txt, Atlassian также поддерживает точечное исключение отдельных страниц через стандартный HTML-тег, что удобно, если нужно закрыть от индексации конкретную страницу, не трогая правила для всего раздела:
<meta name="robots" content="noindex">
Если сайт защищён файрволом и блокирует соединения с неизвестных IP, а подключение по каким-то причинам всё же нужно разрешить, стоит внести официальные IP-адреса Atlassian (записи с product rovo-crawler по ссылке ip-ranges.atlassian.com) в allowlist на уровне сетевой защиты, а не только полагаться на правило в robots.txt.
Частые вопросы
atlassian-bot — это анонимный краулер?
Зачем этот бот заходит на сайт?
Может ли этот коннектор индексировать закрытые разделы сайта?
Где найти официальный список IP-адресов бота?
Соблюдает ли бот правила robots.txt?
Что делать, если сайт защищён файрволом и блокирует неизвестные IP?
Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.