Строка copymatic в логах легко принять за очередного «сборщика сырья для нейросети» — благо категория AI-краулеров сейчас у всех на слуху. Но у Copymatic другая природа: это не компания, обучающая большую языковую модель на чужом контенте, а SaaS-инструмент для написания текстов — рекламных объявлений, лендингов, блог-постов. Разбираемся, зачем в таком случае его бот вообще заходит на посторонние сайты.
Что такое Copymatic на самом деле
Copymatic.ai — AI-копирайтер: сервис, который помогает пользователям генерировать рекламные тексты, контент для сайта и блог-статьи через готовую нейросеть под капотом. Это инструмент для конечного пользователя, а не оператор собственной большой языковой модели и не поисковая система — в этом принципиальное отличие от GPTBot, CCBot или Bytespider, которые системно собирают массив текста для обучения.
| Параметр | Значение |
| Название | Copymatic |
| User-Agent / паттерн | copymatic |
| Оператор | Copymatic.ai — сервис AI-копирайтинга для конечных пользователей |
| Категория TrafficVeil | Пользовательский AI-фетчер по конкретной ссылке (не массовый обучающий краулер) |
| Наиболее вероятная причина визита | Пользователь Copymatic указал URL вашей страницы для генерации текста «по мотивам» — рерайта, конкурентного анализа или контент-подсказки на основе конкретной ссылки |
| Список IP | ❌ Публичного списка нет; проверяйте ASN и поведение |
| robots.txt | Отдельной технической документации по краулеру компания не публикует — полагаться стоит на поведение, а не на заявленную политику |
| Пометка TrafficVeil | Легитимный, но с оговоркой: официального подтверждения механики визита от Copymatic нет |
Честная оговорка: у Copymatic, в отличие от крупных поисковиков или Meta, нет публичной страницы про собственного краулера. Поэтому «наиболее вероятная причина» выше — обоснованный вывод из природы продукта (инструмент для генерации текста по ссылке), а не подтверждённый факт из документации оператора.
Почему это не то же самое, что GPTBot или CCBot
Компании, стоящие за GPTBot, CCBot или Bytespider, системно обходят миллионы страниц, чтобы пополнить корпус для обучения модели — с этим и связана тревога «мой контент станет сырьём для чужого ИИ». Copymatic таких целей не заявляет: это конечный продукт для написания текстов, и его обращение к конкретному URL логичнее объяснять точечным пользовательским действием — похожим на то, как ChatGPT-User или Claude-User забирают одну страницу в момент, когда живой человек попросил ассистента сослаться на конкретный источник, а не на бесконечный фоновый обход интернета.
Как найти Copymatic в логах
# Базовый поиск
grep -i "copymatic" /var/log/nginx/access.log
# Какие страницы запрашивались
grep -i "copymatic" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head
# Топ IP
grep -i "copymatic" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head
Официального списка IP нет, поэтому верификация особенно важна:
IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
Если в логах видно точечные, разрозненные по времени запросы к отдельным страницам без системного обхода каталога — это соответствует гипотезе о пользовательском триггере. Плотный, регулярный обход множества URL подряд — повод отнестись к строке с подозрением и сверить IP.
robots.txt и настройка через TrafficVeil
# Разрешить точечные обращения
User-agent: copymatic
Allow: /
# Закрыть чувствительные разделы
User-agent: copymatic
Disallow: /admin/
Disallow: /cart/
Disallow: /checkout/
Disallow: /account/
Allow: /
TrafficVeil: поскольку заявленная механика — единичные обращения по запросу конкретного пользователя, а не сплошной обход, allow без rate-limit обычно не создаёт заметной нагрузки. Переключать на «запретить» стоит, если частота или паттерн запросов на практике не соответствуют этой гипотезе — то есть бот ведёт себя как полноценный краулер, а не как точечный фетчер.
С кем можно перепутать Copymatic
| Бот | Тип | Отличие |
| ChatGPT-User, Claude-User, Perplexity-User | Пользовательские AI-фетчеры | Тот же принцип — обращение к одной странице по запросу живого человека, а не бесконечный обход |
| GPTBot, CCBot, Bytespider | Обучающие краулеры | Системно и массово собирают контент для тренировочного корпуса — принципиально другая механика, к которой Copymatic не относится |
Что в итоге делать с Copymatic
| Ситуация | Действие |
| Визиты редкие, точечные, к отдельным страницам | Allow без rate-limit — похоже на пользовательский триггер |
| Поведение похоже на массовый обход, а не единичные запросы | Rate-limit, затем Disallow / запрет в TrafficVeil |
| Принципиально не хочется, чтобы контент попадал в чужой AI-инструмент даже точечно | Disallow сразу, без промежуточных шагов |
| Подозрение на спуфинг UA | Сверять по ASN и по характеру запросов, а не по одной строке |