Боты6 мин чтения·13 августа 2026 г.

Automattic Feed Fetcher в логах: подписки WordPress.com Reader

Разбираем Automattic Feed Fetcher — бота WordPress.com Reader, который синхронизирует ленту сайта с подписной базой и растущим кругом сторонних читалок. Показываем, почему нельзя полагаться только на robots.txt, как найти бота в access.log и настроить allow/deny.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота Automattic Feed Fetcher: легитимный rss и фиды

Если отфильтровать access.log по automattic feed fetcher, часто всплывает целый пласт машинных хитов на технических адресах ленты — это фид-фетчер Automattic, компании, которая стоит за WordPress.com, Tumblr и плагином Jetpack. Бот синхронизирует публикации блога или новостного сайта с подписной базой WordPress.com Reader — встроенного агрегатора подписок, на который читатели могут подписаться на любой публичный блог или RSS-ленту.

1. Что такое Automattic Feed Fetcher

WordPress.com Reader — давний (больше десяти лет) сервис Automattic, который агрегирует блоги, подкасты и RSS-ленты для подписчиков; именно фид-фетчер обновляет кеш Reader при появлении новых записей. Продукт продолжает расширяться: в 2026 году Automattic добавил в Reader поддержку Fediverse (Mastodon, Bluesky через ActivityPub) и Google Reader-совместимый API синхронизации, которым теперь пользуются сторонние читалки вроде Reeder, NetNewsWire, ReadKit, Unread и другие — то есть обход одной и той же ленты может запускаться не только напрямую пользователями WordPress.com, но и через синхронизацию из этих сторонних приложений.

Название Automattic Feed Fetcher (также встречается как WordPress.com Reader и родственный feedbot)
User-Agent / паттерн automattic feed fetcher — в независимых наблюдениях также встречается UA «WordPress.com Reader»
Оператор Automattic Inc. — компания-разработчик WordPress.com, Tumblr и плагина Jetpack
Роль Синхронизирует публикации блога с подписной базой WordPress.com Reader, обновляет кеш при новых записях в RSS; входит в ту же инфраструктуру, что и сторонние читалки, синхронизирующиеся через Reader API
Документация / ориентир Отдельной публичной страницы конкретно про этот фетчер нет; общая точка отсчёта — jetpack.com/support (та же компания, там же официальный список IP для их сервисов)
Список IP По независимым наблюдениям вебмастеров, трафик WordPress.com Reader шёл с диапазона 192.0.64.0/18 (с обратным DNS на automattic.com) — это тот же диапазон, что Automattic публикует официально для Jetpack; отдельного публичного списка именно под «Automattic Feed Fetcher» нет
robots.txt Смешанные данные: по крайней мере один зафиксированный случай показывает, что WordPress.com Reader не учитывал robots.txt при обходе — не полагайтесь на файл как единственную меру, если результат важен
Пометка TrafficVeil Легитимный / RSS и фиды

2. Зачем Automattic Feed Fetcher приходит на сайт

Фетчер читает ленты и синдицирует обновления контента для подписчиков WordPress.com Reader. Поскольку Reader в 2026 году стал шире, чем просто RSS-агрегатор (Fediverse-вкладки, синхронизация со сторонними читалками через Google Reader-совместимый API), источником визита может быть не только прямая подписка внутри WordPress.com, но и синхронизация через одно из совместимых приложений.

  • Какие зоны чаще трогает: /feed/, /rss/, /atom.xml, /blog/feed;
  • Что ищет: новые записи и обновления в RSS/Atom-ленте для рассылки подписчикам Reader;
  • Чем отличается от браузерного пользователя: нет нормальной сессии, интервалы регулярные, обращение почти всегда к техническому URL ленты.

Типичный кейс: CDN-трафик дорожает, origin CPU нагружен рендерингом HTML. Фильтр по automattic feed fetcher показывает, что бот вычитывает /feed/, /rss/, /atom.xml, /blog/feed — типичный, в целом безобидный фид-трафик, но при активной подписной базе объём может быть заметным.

3. Нагрузка и риски именно для Automattic Feed Fetcher

Отдельной строки в публичной сводке top-bot TrafficVeil у automattic feed fetcher может не быть, но в категории «RSS и фиды» такие агенты дают характерный фон: лишние опросы feed URL, редко критичные по нагрузке сами по себе. Отдельный практический нюанс именно для этого бота: как минимум один независимый отчёт вебмастеров зафиксировал случай, когда WordPress.com Reader пытался обращаться и к файлам изображений за пределами обычного паттерна фид-ридера — если в логах видно, что бот выходит за пределы /feed/ и похожих технических URL, стоит присмотреться внимательнее к конкретным запросам.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

4. Как найти Automattic Feed Fetcher в логах

Не ищите «просто ботов» — ищите конкретный токен automattic feed fetcher и рядом смотрите соседей по семейству, включая другое имя того же оператора — feedbot.

# Базовый поиск по обоим вариантам имени
grep -iE "automattic feed fetcher|wordpress\.com reader|feedbot" /var/log/nginx/access.log

# Топ URL, которые вычитывает бот
grep -i "automattic feed fetcher" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head

# Топ IP за этим UA — сверьте с диапазоном 192.0.64.0/18
grep -i "automattic feed fetcher" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head

# Суточная активность
grep -i "automattic feed fetcher" /var/log/nginx/access.log | awk '{print $4}' | cut -d: -f1 | sort | uniq -c

# Проверить, не выходит ли бот за пределы типичных фид-URL (изображения и прочее)
grep -i "automattic feed fetcher" /var/log/nginx/access.log | grep -vE "/feed|/rss|atom\.xml" | head

Верификация. Подделать User-Agent может любой скрипт. Для решения allow/deny смотрите связку: UA + IP + частоту + набор URL. Отдельного официального списка под это имя нет, но независимые наблюдения указывают на диапазон 192.0.64.0/18 с обратным DNS на automattic.com — тот же диапазон, что компания использует для Jetpack.

IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"

5. robots.txt для Automattic Feed Fetcher

# Жёсткий запрет
User-agent: automattic feed fetcher
Disallow: /

# Разрешить всё
User-agent: automattic feed fetcher
Allow: /

# Компромисс: закрыть деньги/кабинет, оставить публичку
User-agent: automattic feed fetcher
Disallow: /admin/
Disallow: /cart/
Disallow: /checkout/
Disallow: /account/
Disallow: /api/
Allow: /

Важно: ставьте Disallow или 403 для automattic feed fetcher, если пользы нет. Учитывая как минимум один зафиксированный случай, когда этот же фетчер под именем WordPress.com Reader не учитывал robots.txt, для гарантированного результата не полагайтесь только на файл — переходите к правилам на уровне nginx/Apache или к запрету в TrafficVeil.

6. Блокировка вручную и через TrafficVeil

Nginx

if ($http_user_agent ~* "automattic feed fetcher") {
    return 403;
}

limit_req_zone $binary_remote_addr zone=automatticfeedfetc:10m rate=10r/m;
location / {
    if ($http_user_agent ~* "automattic feed fetcher") {
        limit_req zone=automatticfeedfetc burst=20 nodelay;
    }
}

Apache (.htaccess)

RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} automattic feed fetcher [NC]
RewriteRule ^ - [F,L]

TrafficVeil

  • Найдите automattic feed fetcher в ботах домена или в разделе /system/bots;
  • Для нежелательного сценария выберите категорию «запретить»; для мягкого варианта — rate-limit;
  • Allow оставляйте только при явной пользе от распространения через WordPress.com Reader и совместимые с ним читалки;
  • После изменения сверьте логи: хиты Automattic Feed Fetcher должны уйти в блок или лимит, а нужные поисковики — остаться без изменений.

7. Рекомендации: что делать с Automattic Feed Fetcher

  • Если пользы нет — Disallow/403 для automattic feed fetcher;
  • Если польза есть (у ленты сайта заметная аудитория в WordPress.com Reader или в совместимых с ним читалках) — Allow только при явной пользе;
  • Если нагрузка мешает — сначала rate-limit, затем полный запрет, особенно учитывая, что robots.txt этим фетчером соблюдается не всегда надёжно;
  • Не режьте слишком широко правилом User-agent: *, чтобы случайно не закрыть Googlebot или YandexBot;
  • Что вы теряете при блокировке: часть распространения через WordPress.com Reader и растущий круг сторонних читалок, синхронизирующихся через его API.

8. С кем не путать Automattic Feed Fetcher

Бот / сосед Кластер UA Комментарий
feedbot RSS и фиды feedbot тот же оператор (Automattic/WordPress.com), доставляет обновления фида подписчикам
FeedBurner RSS и фиды feedburner легитимный, другой оператор
FeedFlow RSS и фиды feedflow легитимный
Feedbin RSS и фиды feedbin легитимный
Feedly RSS и фиды feedly легитимный

9. Стратегия allow/deny для Automattic Feed Fetcher

Ситуация Действие
Нужна дистрибуция через WordPress.com Reader и совместимые читалки Allow + закрыть /admin /cart /api
Только мешает и жрёт ресурсы Disallow + запрет в TrafficVeil на уровне сервера
Нужен доступ, но пики по ночам Rate-limit на nginx/TrafficVeil
Нежелательный по базе TrafficVeil Deny по умолчанию, исключения — точечно
Подозрение на spoofing UA Сверять с диапазоном 192.0.64.0/18 (automattic.com), не доверять только строке UA

Частые вопросы

Automattic Feed Fetcher связан только с самим WordPress.com?
Уже не только: с 2026 года Reader синхронизируется со сторонними читалками вроде Reeder и NetNewsWire через Google Reader-совместимый API, поэтому источником визита может быть и одно из этих приложений.
Можно ли доверять robots.txt для контроля этого бота?
Не полностью — есть как минимум один зафиксированный случай, когда тот же фетчер под именем WordPress.com Reader не учитывал правила robots.txt при обходе.
Публикует ли Automattic официальный список IP именно для этого фетчера?
Отдельного списка нет, но независимые наблюдения указывают на диапазон 192.0.64.0/18 с обратным DNS на automattic.com — тот же, что компания использует для Jetpack.
Чем feedbot отличается от Automattic Feed Fetcher?
Это боты одного и того же оператора: feedbot доставляет обновления фида подписчикам, а Automattic Feed Fetcher синхронизирует саму ленту с подписной базой Reader.
Что теряет сайт при полной блокировке этого бота?
Часть распространения через WordPress.com Reader и совместимые с ним сторонние читалки — на позиции в поиске это не влияет.
Как поступить, если бот обращается не только к техническому URL ленты, но и к другим файлам?
Стоит присмотреться внимательнее — как минимум один независимый отчёт фиксировал попытки этого фетчера обращаться к файлам изображений за пределами обычного фид-паттерна.
#Automattic Feed Fetcher#WordPress.com Reader#Automattic#анализ логов#robots.txt#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil