Боты11 мин чтения·10 августа 2026 г.

ImageMetaBot: что это за бот и зачем он скачивает изображения с сайта

ImageMetaBot — специализированный краулер Image-Meta, который обнаруживает публичные изображения и индексирует встроенные EXIF, IPTC и XMP-метаданные. Разбираемся, какую информацию он собирает, как найти его в access.log, какую нагрузку он создаёт и стоит ли его блокировать.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота ImageMetaBot: нежелательный прочие краулеры и сервисы

Что такое ImageMetaBot

ImageMetaBot — специализированный веб-краулер, связанный с сервисом Image-Meta на домене image-meta.com. Его задача отличается от Googlebot, YandexBot и других поисковых роботов общего назначения: сервис собирает публично доступные изображения в интернете и индексирует встроенные в них метаданные.

Image-Meta ориентирован на поиск по данным EXIF, IPTC и XMP. Такие поля могут содержать модель камеры, серийный номер устройства, дату создания файла, сведения об авторе и правообладателе, используемом программном обеспечении и другие технические атрибуты изображения.

Параметр Значение
Название ImageMetaBot
Связанный сервис Image-Meta / image-meta.com
Категория Специализированные краулеры / индексаторы изображений и метаданных
Наблюдаемый UA ImageMetaBot/1.0 (+https://www.image-meta.com; info@image-meta.com) Image-Classification
Назначение Поиск публичных изображений и индексирование их метаданных
Поисковый робот Google/Yandex Нет
SEO-ценность Прямой ценности для Google или Яндекса нет
TrafficVeil Monitor / Block по политике владельца сайта

Что делает сервис Image-Meta

По публичному описанию проекта Image-Meta создаёт поисковый индекс метаданных изображений, доступных в открытом интернете. В 2026 году разработчик проекта сообщал о сотнях миллионов проиндексированных изображений и извлечении EXIF, IPTC и XMP при помощи ExifTool.

Индекс может использоваться для поиска по таким признакам, как:

  • автор изображения;
  • copyright и rights-поля;
  • производитель и модель камеры;
  • серийный номер устройства, если он сохранён в файле;
  • дата создания и изменения;
  • использованное программное обеспечение;
  • описания и другие IPTC/XMP-поля;
  • географические данные, если они присутствуют в метаданных и доступны соответствующей функции сервиса.

Это делает ImageMetaBot ближе к специализированному вертикальному индексатору данных об изображениях, чем к классическому SEO-краулеру.

Зачем ImageMetaBot приходит на сайт

Чтобы извлечь метаданные изображения, системе сначала необходимо обнаружить его URL и получить сам файл либо достаточную информацию для дальнейшей обработки. Поэтому в access.log может появляться обращение не только к HTML, но и непосредственно к JPEG, PNG и другим ресурсам.

Для анализа такого бота особенно полезно разделять:

  • запросы HTML-страниц;
  • запросы файлов изображений;
  • повторные обращения к одним и тем же файлам;
  • объём переданных изображений;
  • cache HIT/MISS;
  • нагрузку на origin и image processing.

Для сайта с большим фотокаталогом даже сравнительно небольшое число запросов может передать существенно больше данных, чем такое же количество запросов к лёгким HTML-страницам.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Какие метаданные могут находиться внутри изображения

Веб-мастеру полезно понимать, зачем специализированному сервису вообще скачивать оригинальные изображения. JPEG и другие файлы могут содержать технические и редакционные метаданные.

Тип Примеры данных
EXIF Камера, объектив, дата съёмки, параметры экспозиции, иногда GPS и серийные номера
IPTC Автор, описание, copyright, редакционные сведения и ключевые слова
XMP Расширенные сведения об авторстве, обработке, правах и workflow

Наличие конкретного поля зависит от камеры, программы обработки, CMS и того, удаляет ли платформа метаданные при загрузке или оптимизации изображения.

ImageMetaBot и приватность изображений

Сам факт доступности изображения по публичному URL не означает, что владелец сайта осознанно хотел публиковать все встроенные в файл метаданные. Поэтому обнаружение ImageMetaBot — хороший повод проверить собственный медиапайплайн.

Для публичных изображений стоит определить, действительно ли необходимо сохранять:

  • GPS-координаты;
  • серийные номера оборудования;
  • имена авторов в технических полях;
  • внутренние комментарии;
  • названия программ и workflow-поля;
  • другую лишнюю служебную информацию.

Если такие данные не нужны посетителю и не должны публиковаться, правильнее удалять их до размещения файла, а не рассчитывать только на блокировку конкретного crawler.

Как найти ImageMetaBot в access.log

Базовый поиск:

grep -i "ImageMetaBot" /var/log/nginx/access.log

Если в наблюдаемом UA присутствует домен сервиса:

grep -iE "ImageMetaBot|image-meta\.com" /var/log/nginx/access.log

Топ URL:

grep -iE "ImageMetaBot|image-meta\.com" /var/log/nginx/access.log \
| awk '{print $7}' | sort | uniq -c | sort -rn | head -30

Топ IP:

grep -iE "ImageMetaBot|image-meta\.com" /var/log/nginx/access.log \
| awk '{print $1}' | sort | uniq -c | sort -rn | head -30

Количество обращений к типичным форматам изображений:

grep -iE "ImageMetaBot|image-meta\.com" /var/log/nginx/access.log \
| grep -iE '\.(jpg|jpeg|png|webp|gif|tif|tiff)(\?| |$)' \
| wc -l

Как оценивать нагрузку ImageMetaBot

Для image crawler недостаточно смотреть только RPS. Более полезны показатели, связанные с объёмом файлов.

TrafficVeil стоит показывать:

  • число запросов;
  • уникальные URL изображений;
  • суммарный объём response bytes;
  • средний размер ответа;
  • cache HIT/MISS;
  • нагрузку на origin;
  • частоту повторного скачивания одинаковых файлов;
  • долю запросов HTML и изображений.

Если изображения отдаются через CDN и хорошо кэшируются, влияние на origin может быть небольшим. Если каждый запрос запускает динамический resize или другой image processing, даже умеренный бот-трафик способен стоить заметно дороже.

Как проверить происхождение ImageMetaBot

Наблюдаемый User-Agent содержит название ImageMetaBot, адрес сайта и контактный email. Это полезные идентификаторы, но они не являются доказательством личности клиента: любой скрипт может скопировать эту строку.

Для TrafficVeil разумно анализировать:

  1. полную строку User-Agent;
  2. IP и ASN;
  3. тип сети — hosting, residential, mobile, proxy или VPN;
  4. reverse DNS;
  5. историю IP;
  6. TLS/HTTP fingerprint;
  7. характер запрашиваемых ресурсов;
  8. соответствие поведения image crawler.

На момент подготовки материала мы не нашли публичного официального списка исходящих IP ImageMetaBot. Поэтому автоматически добавлять адрес в allowlist только по одному наблюдению не стоит.

Как выглядит нормальный и подозрительный ImageMetaBot

Признак Ожидаемое поведение Повод для проверки
Ресурсы HTML и публичные изображения Конфиги, backup-файлы, административные панели
Цель Обнаружение и получение изображений Перебор exploit paths
UA Стабильный ImageMetaBot-профиль Частая смена UA
Сеть Повторяемая серверная инфраструктура Множество несвязанных residential/proxy IP
Поведение Последовательный crawl Brute force или vulnerability scanning

Если клиент представляется ImageMetaBot, но вместо изображений массово запрашивает /.env, панели входа, резервные копии и другие технические пути, доверять названию нельзя.

robots.txt для ImageMetaBot

Если владелец сайта не хочет разрешать обход, можно объявить отдельное правило:

User-agent: ImageMetaBot
Disallow: /

Если требуется закрыть только каталоги с изображениями:

User-agent: ImageMetaBot
Disallow: /uploads/
Disallow: /images/
Disallow: /media/

Но robots.txt — декларативный механизм. Пока нет достаточно надёжной публичной документации Image-Meta о поведении crawler относительно robots.txt, TrafficVeil не должен обещать, что это правило технически остановит запросы.

Для гарантированного ограничения используйте reverse proxy, WAF или веб-сервер.

Блокировка ImageMetaBot через Nginx

if ($http_user_agent ~* "ImageMetaBot|image-meta\.com") {
    return 403;
}

Если нужна более аккуратная политика, лучше матчить точный известный токен ImageMetaBot, а домен использовать как дополнительный сигнал, чтобы уменьшить риск ложных совпадений.

Блокировка через Apache

RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} "ImageMetaBot|image-meta\.com" [NC]
RewriteRule ^ - [F,L]

Повлияет ли блокировка ImageMetaBot на Google Images

Нет прямой связи. ImageMetaBot не является Googlebot-Image и не относится к поисковой инфраструктуре Google. Отдельное правило, блокирующее только ImageMetaBot, не запрещает Googlebot-Image или YandexImages.

Но использовать слишком широкие правила для всех ботов или всех image crawler не стоит: тогда можно случайно ограничить поисковые системы, от которых сайт получает органический трафик.

Стоит ли блокировать ImageMetaBot

Решение зависит от политики сайта. В отличие от Googlebot, прямой SEO-пользы от ImageMetaBot для обычного сайта нет. Его ценность связана с присутствием изображений и их метаданных в специализированном индексе Image-Meta.

Ситуация Рекомендация
Хотите, чтобы изображения находились через Image-Meta Allow / Monitor
Специализированная индексация не нужна Можно Block
Бот создаёт заметный bandwidth Rate Limit или Block
Оригиналы содержат нежелательные метаданные Удалить лишние metadata из публичных файлов независимо от блокировки
UA выглядит поддельным Проверять IP/ASN, fingerprint и поведение
Под видом ImageMetaBot идёт security scanning Block по фактическому поведению

Как классифицировать ImageMetaBot в TrafficVeil

Для энциклопедии TrafficVeil его лучше выделить не в обычные поисковые системы, а в категорию «Специализированные краулеры и индексаторы данных» с подтипом «Изображения и метаданные».

Карточка может содержать:

  • название ImageMetaBot;
  • связанный домен image-meta.com;
  • наблюдаемый User-Agent;
  • IP и ASN;
  • тип сети;
  • число запросов;
  • число скачанных изображений;
  • объём переданных данных;
  • cache HIT/MISS;
  • топ расширений файлов;
  • топ URL;
  • рекомендацию Allow, Rate Limit или Block.

Базовая рекомендация может быть нейтральной: Monitor. Если владельцу сайта не нужна индексация метаданных изображений сторонним сервисом, TrafficVeil может предложить Block. Это более точная политика, чем автоматически считать ImageMetaBot вредоносным.

Итог

ImageMetaBot — специализированный crawler, связанный с Image-Meta и индексированием метаданных публично доступных изображений. Его задача — не продвижение сайта в Google или Яндексе, а построение отдельного поискового индекса по EXIF, IPTC, XMP и другим данным изображений.

Для большинства сайтов блокировка ImageMetaBot не должна напрямую влиять на обычное SEO. Поэтому решение можно принимать исходя из политики доступа к контенту, стоимости bandwidth и желания участвовать в специализированном индексе.

При этом сам бот поднимает более важный вопрос: какие метаданные сайт публикует внутри изображений. Если в файлах остаются ненужные GPS-координаты, серийные номера устройств или внутренние поля, лучше очищать их на этапе загрузки и публикации. Блокировка одного crawler не предотвращает получение публичного файла другими клиентами.

Частые вопросы

Что такое ImageMetaBot?
ImageMetaBot — специализированный веб-краулер, связываемый с сервисом Image-Meta. Сервис строит поисковый индекс метаданных публично доступных изображений. В отличие от Googlebot, его основная задача — не создание универсального веб-индекса, а работа с информацией, содержащейся непосредственно в изображениях.
Какие данные собирает Image-Meta?
Разработчик проекта указывает EXIF, IPTC и XMP. В зависимости от конкретного файла там могут находиться сведения об авторе и copyright, модели камеры, серийном номере устройства, времени создания, программном обеспечении и других характеристиках. Проект также описывает поиск по географическим метаданным.
Насколько крупная база Image-Meta?
В июне 2026 года разработчик публично сообщал примерно о 720 млн проиндексированных изображений. В другом обсуждении он утверждал, что изображения были обнаружены более чем на 10 млн уникальных доменов. Эти показатели являются заявлениями самого разработчика, поэтому в статье они именно так и обозначены, а не представлены как независимо проверенная статистика.
Повлияет ли блокировка ImageMetaBot на Google Images или Яндекс Картинки?
Прямого влияния быть не должно. ImageMetaBot — отдельный специализированный crawler и не является Googlebot-Image или роботом Яндекса. Главное — блокировать именно его UA, а не использовать широкое правило для всех поисковых и image-ботов.
Стоит ли блокировать ImageMetaBot?
Зависит от политики сайта. Если владельцу полезно присутствие изображений в специализированном индексе Image-Meta, бота можно разрешить и контролировать. Если стороннее индексирование метаданных не нужно или скачивание изображений расходует заметный bandwidth, его можно ограничить или заблокировать.
Почему блокировки ImageMetaBot недостаточно для защиты метаданных фотографий?
Если изображение доступно по публичному URL, его способен скачать не только ImageMetaBot. Поэтому нежелательные GPS-координаты, серийные номера оборудования, внутренние комментарии и другие служебные поля лучше удалять до публикации изображения. Блокировка одного конкретного crawler не делает публичный файл закрытым.
#ImageMetaBot#Image-Meta#image-meta.com#краулер изображений#EXIF#IPTC#XMP#метаданные изображений#image crawler#User-Agent#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil