Строка seo content machine в логах промаркирована как «AI и LLM-краулеры (легитимный)» с намёком на пополнение чужого AI-индекса. Это неточная и слишком мягкая формулировка. SEO Content Machine (SCM) — настольная программа, прямое назначение которой конкуренты и обзорщики описывают без обиняков: массовый скрапинг чужого контента для генерации «спин»-статей и автопостинга в сети блогов — классическая black-hat SEO-практика, за которую Google штрафует сайты.
Что такое SEO Content Machine на самом деле
SCM — это программа для контент-автоматизации, которая извлекает данные из результатов поиска Google/Bing, сайтов конкурентов, RSS-фидов, Google Maps, Wayback Machine и субтитров YouTube, чтобы на этой основе генерировать динамические AI-промпты и тысячи «уникальных» статей — с последующей автопубликацией сразу на множестве WordPress-блогов или через email в Blogger. По сути, это инструмент для построения PBN (частных блог-сетей) и статейного спама, а не легитимный AI-продукт, работающий на благо владельца контента.
| Параметр | Значение |
| Название | SEO Content Machine |
| User-Agent / паттерн | seo content machine |
| Оператор | Настольное ПО — не единый централизованный сервис, а инструмент, которым пользуются множество независимых операторов |
| Категория TrafficVeil | Инструмент скрапинга для статейного спама и PBN (не легитимный AI-краулер) |
| Что делает на сайте | Забирает контент со страниц конкурентов для последующего «спиннинга» — генерации переписанных копий статей |
| Список IP | ❌ Список невозможен в принципе — это настольная программа, запускаемая тысячами разных пользователей с разных IP |
| robots.txt | Официальной политики соблюдения нет — инструмент создан именно для скрапинга, а не для добросовестного индексирования |
| Пометка TrafficVeil | Требует осторожности — назначение инструмента прямо противоречит интересам владельца контента |
Почему пометка «легитимный AI-краулер» здесь вводит в заблуждение
В отличие от нишевых SEO-инструментов вроде Frase AI или CrawlQ AI, которые анализируют топ выдачи для построения контент-брифа своему клиенту, SCM прямо позиционируется как «мульти-языковой контент-скрапер и генератор», способный за раз забрать контент конкурента и превратить его в переписанную копию для публикации в чужой блог-сети. Это не тот случай, когда визит бота «может быть полезен бизнесу» — практическая цель инструмента прямо противоречит интересам владельца оригинального контента.
Как найти SEO Content Machine в логах
# Базовый поиск
grep -i "seo content machine" /var/log/nginx/access.log
# Какие страницы вычитывает
grep -i "seo content machine" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head
# Топ IP — источников много, это не единый оператор
grep -i "seo content machine" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head
Поскольку это десктопная программа с множеством независимых пользователей, единого списка IP не существует в принципе — оценивайте каждый случай по поведению:
IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.
robots.txt и блокировка через TrafficVeil
# Рекомендуемый вариант — запрет
User-agent: seo content machine
Disallow: /
TrafficVeil: в отличие от большинства ботов в этой энциклопедии, здесь default-рекомендация — «запретить», а не «разрешить, если есть польза»: инструмент создан специально для скрапинга контента в целях, прямо противоречащих интересам владельца сайта (спам-статьи, PBN, black-hat SEO). Учитывая, что это множество независимых десктопных инсталляций без единого оператора, полагаться на robots.txt как на единственную защиту не стоит — рассмотрите более активные меры защиты от скрапинга на уровне TrafficVeil.
Что в итоге делать с SEO Content Machine
| Ситуация | Действие |
| Стандартный случай | Disallow / запрет в TrafficVeil — назначение инструмента не в интересах владельца контента |
| Визиты регулярные, контент явно копируется целиком | Активная защита от скрапинга на уровне TrafficVeil, а не только robots.txt |
| Строка встречается редко и без явного ущерба | Зафиксировать и наблюдать, но не считать источник добросовестным по умолчанию |
| Подозрение на спуфинг UA | Сверять по поведению — паттерн массового вычитывания текста конкурентов сам по себе тревожный сигнал |
Частые вопросы
Правда ли, что SEO Content Machine стоит помечать как легитимный AI-краулер?
Зачем эта программа вообще забирает контент с чужих сайтов?
Почему для этого бота рекомендация отличается от большинства других в этой энциклопедии?
Есть ли единый список IP или оператор для этого UA?
Достаточно ли robots.txt, чтобы защититься от такого скрапинга?
Что делать, если контент сайта уже был скопирован через такой инструмент?
Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.