Боты4 мин чтения·9 августа 2026 г.

Два разных noindex: не перепутайте настройку для Twingly Recon

Twingly Recon поддерживает noindex прямо в RSS/Atom-фиде — это не то же самое, что мета-тег для Google или Яндекса. Разбираем разницу и когда есть смысл разрешать этот шведский media-краулер.

TVTrafficVeil TeamЭксперты по защите веб-трафика

Twingly Recon — краулер компании Twingly AB (Швеция): собирает обновления с новостей, блогов, форумов и смежных источников для их media/social data API. Это не поисковик Google или Yandex, а инфраструктура media intelligence — данные идут в аналитические продукты для мониторинга упоминаний, а не в поисковую выдачу.

Параметры

Параметр Значение
UA Mozilla/5.0 (compatible; Twingly Recon; twingly.com) или Twingly Recon-<subsystem>/1.0 (+https://app.twingly.com/public-docs/crawler)
Токен robots Twingly Recon
Docs Twingly Recon Crawler (developer.twingly.com/resources/recon)
robots.txt Да (по их публичной документации)
noindex Поддерживают noindex именно в RSS/Atom-фидах (спецификация Yahoo / LiveJournal) — визит на сайт возможен, но запись не попадает в их индекс
IP-лист ❌ Компактного публичного feed обычно нет

Не путайте два разных «noindex»

В черновике упоминается noindex, и здесь легко перепутать понятия. Twingly поддерживает noindex именно на уровне RSS/Atom-фида по старой спецификации Yahoo/LiveJournal — это отдельная директива внутри самого фида, которая говорит: «можно зайти и прочитать, но не включай запись в свою базу». Это не то же самое, что классический мета-тег noindex или HTTP-заголовок X-Robots-Tag, которые управляют попаданием страницы в выдачу Google или Яндекса. Если сайт уже использует общий noindex для поисковиков, это никак не отменяет и не заменяет отдельную настройку внутри фида специально для Twingly.

Нагрузка

По сводке TrafficVeil — порядка 2,8 тысячи запросов. Небольшой объём согласуется с профилем сервиса: краулер работает с конкретными источниками обновлений (фиды, страницы блогов/форумов), а не ведёт массовый обход всего сайта.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Контроль

grep -i "Twingly" /var/log/nginx/access.log
User-agent: Twingly Recon
Disallow: /
if ($http_user_agent ~* "Twingly") {
    return 403;
}

Рекомендации

  • Хотите попадание в мониторинг Twingly / связанных партнёрских продуктов — Allow; при необходимости точечно настройте noindex именно в самом фиде, а не полагайтесь на общие поисковые директивы
  • Не отдаёте контент в media-intelligence базы — Disallow + deny
  • На Google не влияет — это отдельная от поисковой выдачи инфраструктура
  • Строку UA легко подделать: если нужна повышенная уверенность в подлинности, сверяйте с поведением (концентрация на фидах/блог-разделах, а не широкий обход) — компактного официального IP-списка для дополнительной проверки нет

Частые вопросы

Для чего Twingly Recon собирает данные с блогов и форумов?
Для media/social data API компании Twingly AB — аналитической инфраструктуры мониторинга упоминаний, а не поисковой выдачи.
Чем noindex для Twingly отличается от обычного noindex для Google?
Это отдельная директива внутри самого RSS/Atom-фида по спецификации Yahoo/LiveJournal, а не мета-тег или заголовок, управляющий поисковой индексацией страницы.
Если сайт уже использует общий noindex для поисковиков, закрывает ли это данные и от Twingly?
Нет, это разные механизмы — noindex для Twingly нужно настраивать отдельно именно в самом фиде.
Влияет ли блокировка Twingly Recon на позиции сайта в Google?
Нет, это отдельная от поисковой выдачи инфраструктура, прямой связи с ранжированием нет.
Публикует ли Twingly официальный список IP для верификации краулера?
Нет, компактного публичного списка не найдено — для дополнительной уверенности стоит смотреть на поведение трафика.
Какой типичный паттерн поведения у настоящего Twingly Recon?
Концентрация на фидах и блог/форум-разделах, а не широкий обход всего сайта — это отличает его от массовых SEO-краулеров.
#Twingly Recon#Twingly#media intelligence#RSS#Atom#robots.txt#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil