Боты6 мин чтения·13 августа 2026 г.

FeedlyFeedly в логах: агент читателя, а не краулер — и это меняет всё

Разбираем Feedly — RSS-агрегатор, который по собственному официальному заявлению не соблюдает robots.txt, потому что действует как агент конкретного подписчика. Показываем, как читать число подписчиков прямо из UA, и единственный рабочий способ блокировки, который рекомендует сама компания.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота Feedly: легитимный rss и фиды

Feedly стоит отдельного правила в антиботе: это не «ещё один hit», а повторяемый паттерн автоматизации от известного RSS-агрегатора Feedly, которым пользуются миллионы читателей блогов и новостей. У сервиса есть официальная страница специально для вебмастеров — feedly.com/fetcher.html, где компания прямо и подробно объясняет, как работает её фетчер и, что особенно важно, честно говорит, что robots.txt он не соблюдает принципиально, по дизайну.

1. Что такое Feedly

По собственному объяснению Feedly, их фетчер запрашивает контент ленты только после того, как реальный человек явно добавил её в свой аккаунт Feedly (или в другое приложение, построенное поверх облака Feedly). Именно поэтому компания описывает фетчер не как робота, а как «прямого агента человека-пользователя» — и на этом основании официально не следует правилам robots.txt. Отдельная полезная деталь: в самой строке UA часто указано количество подписчиков конкретно на вашу ленту — это можно увидеть прямо в логах, без обращения к сторонним сервисам.

Название Feedly
User-Agent / паттерн feedly — типовая строка Feedly/1.0 (+http://www.feedly.com/fetcher.html; N subscribers; like FeedFetcher-Google), где N — число подписчиков на конкретную ленту
Оператор Feedly — публичный и известный RSS/новостной агрегатор
Роль Забирает контент ленты по явному запросу подписавшихся пользователей; для экономии ресурсов запрашивает одну и ту же публичную ленту один раз для всех подписчиков сразу, а не отдельно на каждого
Документация / ориентир feedly.com/fetcher.html — официальная страница для вебмастеров с прямыми ответами на частые вопросы, включая блокировку
Список IP ❌ Официального списка нет и не предвидится: по прямому заявлению Feedly, IP-адреса фетчера регулярно меняются, а сам фетчер распределён по нескольким машинам для масштабирования — надёжная идентификация только по строке UA
robots.txt Официально и осознанно не соблюдается — компания прямо пишет, что фетчер действует как агент пользователя, а не краулер, и поэтому игнорирует правила robots.txt
Пометка TrafficVeil Легитимный / RSS и фиды

2. Зачем Feedly приходит на сайт

Feedly читает ленты и синдицирует обновления контента — но, в отличие от многих ботов этой категории, делает это исключительно по факту явной подписки конкретных людей. Официально заявленная частота — не чаще раза в час в среднем на большинство сайтов (для часто обновляемых лент — возможны более частые проверки), хотя сетевые задержки иногда создают видимость более частых визитов. При этом реальные наблюдения некоторых вебмастеров расходятся с этим ориентиром: встречаются жалобы на запросы каждые 20 минут и на несовпадающие UA-строки даже с одного и того же IP — то есть на практике поведение может быть менее предсказуемым, чем в официальном описании.

  • Какие зоны чаще трогает: /feed/, /rss/, /atom.xml, /blog/feed;
  • Что ищет: новые записи в ленте для читателей, которые на неё подписаны;
  • Чем отличается от браузерного пользователя: нет нормальной сессии, но, по заявлению оператора, это агент конкретных людей, а не автономный робот — отсюда и официальный отказ следовать robots.txt.

Типичный кейс: маркетинг видит всплеск hits в Метрике/GA, но сессии пустые. Причина — Feedly. Прежде чем реагировать, посмотрите число подписчиков прямо в строке UA — это разница между «у ленты реальная аудитория» и «нечастый технический шум».

3. Нагрузка и риски именно для Feedly

Отдельной строки в публичной сводке top-bot TrafficVeil у feedly может не быть, но в категории «RSS и фиды» такие агенты дают характерный фон: лишние опросы feed URL, редко критичные по нагрузке. Поскольку Feedly фетчит одну публичную ленту один раз для всех своих подписчиков сразу (не по запросу на каждого пользователя отдельно), нагрузка от сервиса обычно предсказуема и не растёт линейно с числом читателей — но если наблюдаются визиты чаще заявленного раза в час, это стоит зафиксировать отдельно, поскольку расходится с официальным описанием поведения.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

4. Как найти Feedly в логах

Не ищите «просто ботов» — ищите конкретный токен feedly и обязательно смотрите на число подписчиков внутри строки UA.

# Базовый поиск
grep -i "feedly" /var/log/nginx/access.log

# Извлечь количество подписчиков прямо из UA
grep -io "feedly/1.0[^\"]*subscribers" /var/log/nginx/access.log | sort -u

# Топ URL, которые вычитывает бот
grep -i "feedly" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head

# Топ IP за этим UA — ожидайте разнообразие, фетчер распределён по нескольким машинам
grep -i "feedly" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head

# Суточная активность и интервалы — заявлено не чаще раза в час
grep -i "feedly" /var/log/nginx/access.log | awk '{print $4}'

Верификация. Подделать User-Agent может любой скрипт. Официального списка IP Feedly не публикует и не планирует — по их собственному ответу на этот вопрос, IP-адреса меняются со временем, а надёжная идентификация возможна только по строке UA.

IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"

5. robots.txt для Feedly

# Формально можно прописать, но по официальному заявлению оператора это не сработает
User-agent: Feedly
Disallow: /

Важно: сама Feedly прямо предупреждает, что правила robots.txt их фетчер не соблюдает принципиально, поскольку считает себя агентом конкретного пользователя, а не краулером. Если лента сайта публично доступна, ограничить к ней доступ фетчера через robots.txt не получится. Официальная рекомендация самой компании для тех, кто действительно хочет заблокировать доступ: настроить сервер так, чтобы отдавать код ошибки (404, 410 или другой) именно в ответ на запросы с UA Feedly/1.0 — это единственный задокументированный самим оператором рабочий способ.

6. Блокировка вручную и через TrafficVeil

Nginx (рекомендованный самой Feedly подход — отдавать ошибку конкретно этому UA)

if ($http_user_agent ~* "feedly") {
    return 410;
}

limit_req_zone $binary_remote_addr zone=feedly:10m rate=10r/m;
location / {
    if ($http_user_agent ~* "feedly") {
        limit_req zone=feedly burst=20 nodelay;
    }
}

Apache (.htaccess)

RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} feedly [NC]
RewriteRule ^ - [F,L]

TrafficVeil

  • Найдите feedly в ботах домена или в /system/bots;
  • Учитывая, что robots.txt здесь не работает по дизайну, для нежелательного сценария сразу используйте серверный запрет, а не полагайтесь на файл;
  • Allow оставляйте по умолчанию — присутствие Feedly означает наличие реальных подписчиков, число которых видно прямо в UA;
  • После изменения сверьте логи: хиты Feedly должны уйти в блок или лимит, а нужные поисковики — остаться без изменений.

7. Рекомендации: что делать с Feedly

  • Если пользы нет — блокируйте на уровне сервера (не через robots.txt) и, следуя рекомендации самой Feedly, отдавайте этому UA код ошибки вроде 404/410;
  • Если польза есть — Allow по умолчанию; проверяйте число подписчиков в UA, чтобы понимать реальный масштаб аудитории;
  • Если нагрузка выглядит чаще заявленного раза в час — зафиксируйте это отдельно, поскольку расходится с официальным описанием поведения фетчера;
  • Не режьте слишком широко правилом User-agent: *, чтобы случайно не закрыть Googlebot/YandexBot;
  • Что будет при блокировке: потеряете часть распространения через агрегаторы и читалки — причём с точным числом затронутых подписчиков, которое видно в логах.

8. С кем не путать Feedly

Бот / сосед Кластер UA Комментарий
Automattic Feed Fetcher RSS и фиды automattic feed fetcher легитимный
FeedBurner RSS и фиды feedburner легитимный
FeedFlow RSS и фиды feedflow легитимный
Feedbin RSS и фиды feedbin легитимный
Feeder RSS и фиды feeder легитимный

9. Стратегия allow/deny для Feedly

Ситуация Действие
Стандартная ситуация — есть подписчики Allow по умолчанию, отслеживать число подписчиков в UA
Только мешает и жрёт ресурсы Серверный запрет (не robots.txt) — по рекомендации Feedly, код ошибки для этого UA
Частота заметно выше заявленного раза в час Rate-limit на nginx/TrafficVeil, зафиксировать отклонение от официального поведения
Нежелательный по базе TrafficVeil Deny по умолчанию, исключения — точечно
Подозрение на spoofing UA Не доверять только строке UA; официального списка IP нет, поэтому дополнительно смотреть на паттерн запросов

Частые вопросы

Правда ли, что Feedly не соблюдает robots.txt?
Да, и это не догадка, а официальная позиция компании: фетчер считает себя агентом конкретного подписавшегося пользователя, а не автоматическим краулером, и поэтому сознательно игнорирует правила robots.txt.
Как узнать, сколько у ленты реальных подписчиков через Feedly?
Число подписчиков указано прямо в строке User-Agent в логах — не нужно обращаться к сторонним сервисам, чтобы это увидеть.
Как отличить Feedly от других ботов?
По токену User-Agent `feedly` и паттерну URL. Соседей по семейству: смотрите таблицу сравнения в статье.
Какой официальный способ заблокировать Feedly, если robots.txt не работает?
Сама компания рекомендует настроить сервер так, чтобы отдавать код ошибки, например 404 или 410, именно в ответ на запросы с UA Feedly/1.0.
Публикует ли Feedly список IP-адресов своего фетчера?
Нет и не планирует — по их собственному ответу, IP-адреса регулярно меняются, а фетчер распределён по нескольким машинам, поэтому надёжная идентификация возможна только по строке UA.
Как часто Feedly должен обращаться к ленте сайта?
Официально — не чаще раза в час в среднем, хотя некоторые вебмастера сообщают о более частых визитах, вплоть до каждых 20 минут, что расходится с заявленным поведением.
#Feedly#RSS-агрегатор#анализ логов#robots.txt#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil