TrafficVeil
Боты 5 мин13 августа 2026 г.

Bloglines в логах в 2026 году: сервис закрыт с 2010-го

Разбираем, почему токен Bloglines в access.log сегодня не может принадлежать реальному действующему сервису — компания закрылась в 2010 году. Объясняем правдоподобные причины появления такого UA и почему deny по умолчанию оправдан без взвешивания бизнес-пользы.

TV
TrafficVeil Team
Эксперты по защите веб-трафика
Содержание статьи
  1. 1. Что такое Bloglines
  2. 2. Зачем Bloglines приходит на сайт
  3. 3. Нагрузка и риски именно для Bloglines
  4. 4. Как найти Bloglines в логах
  5. 5. robots.txt для Bloglines
  6. 6. Блокировка вручную и через TrafficVeil
  7. 7. Рекомендации: что делать с Bloglines
  8. 8. С кем не путать Bloglines
  9. 9. Стратегия allow/deny для Bloglines
DDoS L7

DDoS атака что это простыми словами и как защитить сайт

Разобрали виды атак, признаки DDoS, последствия, уровни защиты, L7 DDoS и схему подключения TrafficVeil через DNS/reverse proxy.

Читать про DDoS

Энциклопедия ботов TrafficVeil

618 ботов с описаниями, паттернами User-Agent и фильтром по категориям — открытый справочник для аудита логов и настройки защиты.

Открыть справочник

Bloglines стоит отдельного правила в антиботе, но по совершенно другой причине, чем можно подумать: это не активный легитимный сервис, который сегодня «обращается к сайту для интеграции» — Bloglines как компания официально прекратил работу ещё 1 октября 2010 года. Если в 2026 году в access.log встречается UA с токеном bloglines, встаёт закономерный вопрос: кто на самом деле стоит за этим запросом, если реального сервиса с таким названием уже полтора десятилетия не существует.

1. Что такое Bloglines

Bloglines был одним из первых и самых популярных веб-based RSS/Atom-агрегаторов: основан в 2003 году Марком Флетчером, в 2005 году куплен Ask.com (подразделением IAC), в 2010 году из-за падения интереса к RSS на фоне роста Twitter и Facebook объявлен закрытым, кратко перепродан компании MerchantCircle в ноябре 2010 года, но полноценно так и не возродился. Сегодня, в отличие от активных сервисов вроде Feedly или Feedbin, у Bloglines нет действующей инфраструктуры, которая могла бы легитимно генерировать запросы к вашему сайту.

Название Bloglines
User-Agent / паттерн bloglines
Оператор Исторически — Bloglines Inc. / Ask.com (IAC), затем MerchantCircle; сервис закрыт с 2010 года, действующего оператора не существует
Роль Историческая — чтение RSS/Atom-лент для веб-агрегатора Bloglines; в 2026 году легитимной действующей роли у этого UA быть не может
Документация / ориентир Нет — первоисточник прекратил существование, актуальной документации для вебмастеров не существует
Список IP ❌ Официального списка не было и не может быть у закрытого сервиса
robots.txt Не имеет значения — соблюдать правила попросту некому, поскольку компании-оператора не существует
Пометка TrafficVeil Легитимный / Прочие краулеры и сервисы — категория отражает историческую репутацию токена, но не текущую реальность: сервиса, который мог бы законно объяснить трафик, не существует

2. Зачем Bloglines приходит на сайт

Раз настоящего Bloglines не существует уже полтора десятилетия, реальных, законных причин для визита именно от него быть не может. Правдоподобные объяснения того, почему такой UA всё ещё встречается в логах в 2026 году: (а) устаревший, давно не обновлявшийся скрипт или библиотека, где имя Bloglines захардкожено ещё с 2000-х как «типичный пример RSS-агента» и с тех пор никто не поменял строку; (б) сознательный спуфинг — кто-то намеренно выдаёт себя за давно закрытый и потому «безобидно звучащий» сервис, рассчитывая, что владельцы сайтов не будут проверять его подлинность; (в) устаревшая запись в чьей-то внутренней базе User-Agent, которая случайно проникла в трафик через старый инструмент мониторинга или тестирования.

  • Какие зоны чаще трогает: по типовому историческому поведению RSS-агрегаторов — технический URL ленты, но для несуществующего сервиса это уже не имеет прежнего смысла;
  • Что ищет: неизвестно — легитимной задачи у токена в 2026 году нет;
  • Чем отличается от браузерного пользователя: нет нормальной сессии — как и у любого автоматизированного клиента, но здесь дополнительный красный флаг: сам факт использования имени полтора десятилетия закрытой компании.

Типичный кейс: маркетинг видит всплеск hits в Метрике/GA, но сессии пустые. Причина — bloglines. В отличие от многих ботов этой категории, здесь не нужно долго взвешивать бизнес-пользу: у токена нет действующего оператора, который мог бы её предоставить.

3. Нагрузка и риски именно для Bloglines

Отдельной строки в публичной сводке top-bot TrafficVeil у bloglines может не быть, но в категории «Прочие краулеры и сервисы» такие агенты дают характерный фон: фоновый шум в аналитике, расход CPU/bandwidth и искажение статистики «живого» трафика. Дополнительный риск именно для этого токена — повышенная вероятность спуфинга: имя закрытого 15 лет назад сервиса выглядит «архивно-безобидным» и может специально использоваться для маскировки под легитимный исторический трафик.

4. Как найти Bloglines в логах

Не ищите «просто ботов» — ищите конкретный токен bloglines и обязательно смотрите полную строку UA целиком: устаревшие библиотеки часто оставляют другие следы своей древности рядом с именем бота.

# Базовый поиск
grep -i "bloglines" /var/log/nginx/access.log

# Полная строка UA — ищите признаки устаревшего инструмента или явного спуфинга
grep -i "bloglines" /var/log/nginx/access.log | awk -F'"' '{print $6}' | sort -u

# Топ URL, которые вычитывает бот
grep -i "bloglines" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head

# Топ IP за этим UA
grep -i "bloglines" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head

# Суточная активность
grep -i "bloglines" /var/log/nginx/access.log | awk '{print $4}' | cut -d: -f1 | sort | uniq -c

Верификация. Подделать User-Agent может любой скрипт — а для несуществующего сервиса вопрос «подделка или нет» решается ещё проще, чем обычно: раз оператора не существует, любой запрос с этим UA по определению не может быть «настоящим Bloglines». Смотрите на IP и поведение как на характеристики того, что реально стоит за трафиком — устаревший инструмент или намеренная маскировка.

IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"

5. robots.txt для Bloglines

# Жёсткий запрет
User-agent: bloglines
Disallow: /

# Разрешить всё
User-agent: bloglines
Allow: /

Важно: поскольку действующего оператора не существует, деликатность «а вдруг сломаем нужную интеграцию» здесь неуместна — ставьте Disallow/403 по умолчанию. Полагаться на robots.txt как на единственную меру не стоит: раз соблюдать правила физически некому, для гарантированного результата сразу используйте блокировку на уровне сервера или TrafficVeil.

6. Блокировка вручную и через TrafficVeil

Nginx

if ($http_user_agent ~* "bloglines") {
    return 403;
}

limit_req_zone $binary_remote_addr zone=bloglines:10m rate=10r/m;
location / {
    if ($http_user_agent ~* "bloglines") {
        limit_req zone=bloglines burst=20 nodelay;
    }
}

Apache (.htaccess)

RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} bloglines [NC]
RewriteRule ^ - [F,L]

TrafficVeil

  • Найдите bloglines в ботах домена или в /system/bots;
  • Поскольку действующего оператора не существует — по умолчанию категория «запретить», без необходимости взвешивать бизнес-пользу;
  • После изменения сверьте логи: хиты bloglines должны уйти в блок или лимит, а нужные поисковики и реально активные RSS-сервисы — остаться без изменений.

7. Рекомендации: что делать с Bloglines

  • Блокируйте по умолчанию — в отличие от большинства ботов этой категории, здесь не нужно искать «бизнес-пользу», поскольку оператора, который мог бы её предоставить, не существует уже 15 лет;
  • Не полагайтесь на robots.txt как на единственную меру — сразу используйте nginx/Apache/TrafficVeil;
  • Полезно зафиксировать такой трафик отдельно для анализа: устаревший UA часто соседствует с другими признаками старого или подозрительного скрипта;
  • Не режьте слишком широко User-agent: *, чтобы случайно не закрыть Googlebot/YandexBot;
  • Что будет при блокировке: ничего не теряете — легитимной аудитории или функциональности за этим токеном в 2026 году стоять не может.

8. С кем не путать Bloglines

Бот / сосед Кластер UA Комментарий
Feedly RSS и фиды feedly активный, реально существующий RSS-агрегатор — не путать с закрытым Bloglines
Feedbin RSS и фиды feedbin легитимный, активный сервис
2ip Bot Прочие краулеры и сервисы 2ip bot легитимный
AccessStatus Прочие краулеры и сервисы accessstatus легитимный
AddThis.com Прочие краулеры и сервисы addthis.com легитимный

9. Стратегия allow/deny для Bloglines

Ситуация Действие
Стандартная ситуация — токен закрытого сервиса Disallow + запрет в TrafficVeil по умолчанию
Нужно зафиксировать источник для дальнейшего анализа Логировать отдельно перед блокировкой — полная строка UA и IP
Спутали с реально активным RSS-сервисом Проверить точное имя токена — Feedly, Feedbin и подобные живы и требуют другой логики
Нежелательный по базе TrafficVeil Deny по умолчанию — здесь совпадает с реальностью на 100%
Подозрение на spoofing UA Не гипотетическое — раз оператора не существует, любой трафик с этим именем по определению не тот, за кого себя выдаёт

Частые вопросы

Bloglines всё ещё существует как сервис?

Нет, компания официально закрылась 1 октября 2010 года и с тех пор не возобновляла работу как действующий RSS-агрегатор.

Значит ли это, что любой трафик с UA bloglines подозрителен?

По сути да — раз оператора не существует, ни один запрос с этим именем не может быть тем, за кого себя выдаёт, в отличие от активных сервисов вроде Feedly.

Откуда тогда берётся такой трафик в логах в 2026 году?

Вероятнее всего это старый захардкоженный UA в неактуальной библиотеке или скрипте, либо намеренный спуфинг под нейтрально звучащее историческое имя.

Нужно ли взвешивать бизнес-пользу перед блокировкой, как для других ботов?

Нет, это тот редкий случай, когда deny по умолчанию оправдан сразу — оценивать пользу попросту не от кого получить.

Стоит ли полагаться на robots.txt для блокировки?

Нет, соблюдать правила некому, поэтому для гарантированного результата сразу используйте блокировку на уровне сервера или TrafficVeil.

Как не перепутать Bloglines с реально активными RSS-сервисами?

Проверять точное имя токена — такие сервисы, как Feedly или Feedbin, живы и активны, и логика allow/deny для них принципиально другая.

#Bloglines#закрытые сервисы#устаревшие UA#анализ логов#robots.txt#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак.

Похожие статьи

Skype (общий токен): не один бот, а минимум три разных

Общий поиск по слову «skype» в логах цепляет сразу несколько разных, исторически связанных механизмов Microsoft — от закрытого в мае 2025 года превью-бота до активной внутренней инфраструктуры Teams, унаследовавшей кодовое имя SkypeSpaces. Разбираемся, почему общее правило блокировки по этому слову рискованно, и как разделить разные варианты в своих логах.

7 мин

Fedicabot: превью-fetcher Fedica, а не краулер Fediverse

Fedicabot принадлежит Fedica — крупной платформе публикации и аналитики соцсетей, а не имеет отношения к Fediverse, несмотря на созвучное название. Официальная страница оператора прямо заявляет: бот не обходит сайты целиком, а читает только страницу, которую указал конкретный пользователь при планировании публикации, — это меняет всю логику оценки риска.

6 мин

Amazon Kendra: возможно, ваш корпоративный поиск

Amazon Kendra — реальный сервис корпоративного поиска AWS, и его коннектор Web Crawler обходит только те конкретные URL, которые явно указал клиент AWS при настройке источника данных — то есть это не свободный обход, а целевая индексация по чьему-то заданию. Разбираемся, почему первый шаг здесь — проверить, не настроен ли на вашем сайте (или у партнёра) такой поисковый индекс, прежде чем блокировать бота как постороннего.

6 мин

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.