TrafficVeil
Боты 8 мин25 июня 2026 г.

Googlebot-Image - все что нужно знать

Googlebot-Image — специализированный краулер Google, предназначенный исключительно для обхода, анализа и индексации изображений. Он является частью экосистемы краулеров Google и отвечает за наполнение сервиса Google Images.

TV
TrafficVeil Team
Эксперты по защите веб-трафика
Содержание статьи
  1. 1.1 User-Agent строка
  2. 1.2 Место в экосистеме Google-ботов
  3. 1.3 IP-адреса
  4. 2. Как работает Googlebot-Image
  5. 2.1 Этапы обхода
  6. 2.2 Что Googlebot-Image анализирует
  7. 2.3 Поддерживаемые форматы
  8. 2.4 Как Googlebot-Image находит изображения
  9. 3. Нагрузка на сервер
  10. Типичная нагрузка по типам сайтов
  11. Факторы, увеличивающие нагрузку
  12. 4. Обнаружение в логах
  13. Как выглядит запись
  14. Аналитика через grep
  15. Верификация подлинности
  16. 5. SEO-оптимизация для Google Images
  17. 5.1 Alt-текст — главный сигнал
  18. 5.2 Имена файлов
DDoS L7

DDoS атака что это простыми словами и как защитить сайт

Разобрали виды атак, признаки DDoS, последствия, уровни защиты, L7 DDoS и схему подключения TrafficVeil через DNS/reverse proxy.

Читать про DDoS

Энциклопедия ботов TrafficVeil

618 ботов с описаниями, паттернами User-Agent и фильтром по категориям — открытый справочник для аудита логов и настройки защиты.

Открыть справочник

В отличие от основного Googlebot, который анализирует весь контент страниц, Googlebot-Image сфокусирован на графических файлах: анализирует метаданные, окружающий текст, alt-атрибуты и структурированные данные, связанные с изображениями.1. Что такое Googlebot-Image

1.1 User-Agent строка

Googlebot-Image/1.0

# Иногда встречается в паре с основным агентом:
Mozilla/5.0 (compatible; Googlebot-Image/1.0; +http://www.google.com/bot.html)

1.2 Место в экосистеме Google-ботов

Краулер Зона ответственности Влияние на Google Images
Googlebot (Desktop/Mobile) HTML, CSS, JS, общая индексация Косвенное: находит изображения на страницах
Googlebot-Image Непосредственный обход изображений Прямое: добавляет в Google Images
Google-InspectionTool Ручная инспекция URL в Search Console Тестовое: не индексирует
AdsBot-Google Рекламные landing pages Нет

1.3 IP-адреса

Googlebot-Image использует те же IP-диапазоны Google (AS15169), что и основной Googlebot. Актуальный список:

https://developers.google.com/search/apis/ipranges/googlebot.json

Верификация — через двухэтапный обратный DNS (reverse + forward lookup на crawl-*.googlebot.com).


2. Как работает Googlebot-Image

2.1 Этапы обхода

  1. Основной Googlebot обходит HTML-страницу и обнаруживает изображения в разметке.
  2. URL изображений добавляются в очередь Googlebot-Image.
  3. Googlebot-Image скачивает файлы изображений по HTTP/HTTPS.
  4. Анализируются метаданные: формат, размер, EXIF.
  5. Анализируется контекст: alt-текст, title, caption, окружающий текст, заголовок страницы.
  6. Изображение индексируется в Google Images с привязкой к исходной странице.

2.2 Что Googlebot-Image анализирует

Источник данных Что извлекается Важность для SEO
alt="..." Описание изображения ⭐⭐⭐⭐⭐ Критически важно
title="..." Всплывающая подсказка ⭐⭐⭐ Важно
Имя файла Ключевые слова в URL ⭐⭐⭐⭐ Очень важно
Заголовок страницы (H1/title) Тематический контекст ⭐⭐⭐⭐ Очень важно
Окружающий текст Релевантность изображения ⭐⭐⭐ Важно
<figcaption> Описание в подписи ⭐⭐⭐ Важно
Schema.org ImageObject Структурированные метаданные ⭐⭐⭐⭐ Очень важно
Open Graph og:image Социальный превью ⭐⭐ Умеренно
EXIF (GPS, камера) Геолокация, техданные ⭐⭐ Умеренно

2.3 Поддерживаемые форматы

Формат Поддержка Рекомендация
JPEG / JPG ✔ Полная Основной формат для фото
PNG ✔ Полная Для графики с прозрачностью
WebP ✔ Полная Рекомендуется: меньше размер
AVIF ✔ Полная Современный, лучшее сжатие
GIF ✔ Полная Анимации индексируются
SVG ✔ Полная Векторная графика
BMP ✔ Частичная Не рекомендуется: большой размер
HEIC/HEIF ✖ Не поддерживается Конвертируйте в JPEG/WebP
TIFF ✖ Не поддерживается Конвертируйте перед публикацией

2.4 Как Googlebot-Image находит изображения

Через HTML-разметку (основной путь):

<!-- Стандартный img -->
<img src="/images/product.jpg" alt="Красные кроссовки Nike Air Max 2026">

<!-- Responsive с srcset -->
<img src="photo.jpg"
     srcset="photo-400.webp 400w, photo-800.webp 800w"
     sizes="(max-width:600px) 400px, 800px"
     alt="Описание изображения">

<!-- Picture element -->
<picture>
  <source srcset="photo.avif" type="image/avif">
  <source srcset="photo.webp" type="image/webp">
  <img src="photo.jpg" alt="Описание изображения">
</picture>

Через Image Sitemap:

<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9"
        xmlns:image="http://www.google.com/schemas/sitemap-image/1.1">
  <url>
    <loc>https://example.com/page/</loc>
    <image:image>
      <image:loc>https://example.com/images/photo.jpg</image:loc>
      <image:title>Красные кроссовки Nike Air Max 2026</image:title>
      <image:caption>Вид сбоку, белая подошва</image:caption>
      <image:geo_location>Москва, Россия</image:geo_location>
      <image:license>https://creativecommons.org/licenses/by/4.0/</image:license>
    </image:image>
  </url>
</urlset>

Через Schema.org (структурированные данные):

<script type="application/ld+json">
{
  "@context": "https://schema.org",
  "@type": "Product",
  "name": "Nike Air Max 2026",
  "image": {
    "@type": "ImageObject",
    "url": "https://example.com/images/product.jpg",
    "width": 1200,
    "height": 800,
    "caption": "Красные кроссовки Nike Air Max 2026"
  }
}
</script>

3. Нагрузка на сервер

Googlebot-Image создаёт нагрузку, принципиально отличающуюся от нагрузки основного Googlebot: основной трафик — это скачивание бинарных файлов изображений, которые могут быть значительно крупнее HTML-страниц.

Типичная нагрузка по типам сайтов

Тип сайта Количество изображений Нагрузка
Блог / новостной сайт 1–3 изображения на страницу Низкая, незаметная
Интернет-магазин (средний) 5–20 фото на товар, 10k товаров Ощутимая: сотни Mbps в пике
Фото-сток / галерея Миллионы изображений Высокая: постоянный трафик
Социальная сеть / UGC Непредсказуемо, бесконечно Очень высокая, нужен crawl control
Новостной портал 10–30 фото в день Умеренная, зависит от публикаций

Факторы, увеличивающие нагрузку

  • Отсутствие кеширования — бот скачивает одно изображение многократно
  • Большой размер файлов (несжатые JPEG 5–20 MB вместо 200–500 KB)
  • Дублирующиеся изображения по разным URL (с параметрами: /img.jpg?w=800&q=90)
  • Нет CDN — весь трафик идёт на origin-сервер
  • Динамическая генерация изображений (watermarks, resize на лету) — нагрузка на CPU
  • Ошибки 404 на изображения — бот повторяет попытки

4. Обнаружение в логах

Как выглядит запись

66.249.66.194 - - [08/May/2026:14:22:11 +0000] \
  "GET /images/product-red-shoes.jpg HTTP/1.1" \
  200 187432 "https://example.com/catalog/shoes/" \
  "Googlebot-Image/1.0"

# Обратите внимание: Referer указывает страницу, где найдено изображение

Аналитика через grep

Найти все запросы Googlebot-Image:

grep -i 'Googlebot-Image' /var/log/nginx/access.log

Топ запрашиваемых изображений:

grep -i 'Googlebot-Image' access.log \
  | awk '{print $7}' | sort | uniq -c | sort -nr | head -30

Статистика по HTTP-кодам:

grep -i 'Googlebot-Image' access.log \
  | awk '{print $9}' | sort | uniq -c | sort -nr

Только 404 ошибки (несуществующие изображения):

grep -i 'Googlebot-Image' access.log | grep ' 404 ' \
  | awk '{print $7}' | sort | uniq -c | sort -nr | head -20

Суммарный трафик (bandwidth):

grep -i 'Googlebot-Image' access.log \
  | awk '{sum+=$10} END{print sum/1024/1024 " MB"}'

Live-мониторинг:

tail -f /var/log/nginx/access.log | grep --line-buffered 'Googlebot-Image'

Верификация подлинности

#!/bin/bash
IP=$1
HOST=$(host $IP | awk '{print $NF}')
if [[ $HOST == *googlebot.com* ]]; then
  FWD=$(host $HOST | awk '{print $NF}')
  [[ $FWD == $IP ]] && echo "✔ Настоящий Googlebot-Image" || echo "✖ DNS mismatch"
else
  echo "✖ Fake (нет PTR записи googlebot.com)"
fi

5. SEO-оптимизация для Google Images

Правильная оптимизация изображений может стать значимым источником органического трафика — особенно для e-commerce, рецептов, путешествий, дизайна и медицины.

5.1 Alt-текст — главный сигнал

⚠ Alt-текст — важнейший фактор ранжирования в Google Images. Его отсутствие — главная причина, почему изображения не индексируются или плохо ранжируются.

<!-- ✖ Плохо: нет alt -->
<img src="photo.jpg">

<!-- ✖ Плохо: бессмысленный alt -->
<img src="photo.jpg" alt="image1">
<img src="photo.jpg" alt="фото">

<!-- ✖ Плохо: keyword stuffing -->
<img src="photo.jpg" alt="кроссовки купить кроссовки дешево кроссовки Nike">

<!-- ✔ Хорошо: конкретное описание -->
<img src="nike-air-max-2026-red.jpg"
     alt="Кроссовки Nike Air Max 2026 красные, вид сбоку">

5.2 Имена файлов

Имя файла — второй по важности сигнал. Google читает его как часть метаданных.

# ✖ Плохо
IMG_20240318_144523.jpg
photo_final_v3_2.jpg
image001.jpg

# ✔ Хорошо
nike-air-max-2026-red-side-view.jpg
chocolate-cake-recipe-ganache.jpg
moscow-red-square-winter-night.jpg

5.3 Технические требования Google Images

Параметр Минимум Рекомендация
Ширина Не указан Минимум 1200px для Featured Snippets
Соотношение сторон Любое 16:9 или 4:3 для лучшего отображения
Размер файла Нет лимита До 500 KB для быстрой загрузки
Формат JPEG, PNG, WebP, AVIF, GIF, SVG WebP или AVIF как основной
Доступность URL Публичный, без авторизации Стабильный URL без TTL-параметров
Статус HTTP 200 OK 200 OK (не 301, не 302)

5.4 Lazy loading и индексация

Google умеет обрабатывать lazy loading через атрибут loading="lazy". Однако изображения, загружаемые через кастомный JavaScript без стандартного атрибута src, могут не индексироваться — добавляйте их в Image Sitemap.

<!-- ✔ Стандартный lazy loading — Google поддерживает -->
<img src="photo.jpg" loading="lazy" alt="Описание">

<!-- ⚠ Кастомный JS lazy loading — может не индексироваться -->
<img data-src="photo.jpg" class="lazy" alt="Описание">
<!-- Для таких изображений обязательно добавляйте Image Sitemap -->

5.5 Лицензирование и авторство

Google Images поддерживает метаданные лицензии через Schema.org — это повышает доверие к изображению:

<script type="application/ld+json">
{
  "@context": "https://schema.org",
  "@type": "ImageObject",
  "contentUrl": "https://example.com/photo.jpg",
  "license": "https://creativecommons.org/licenses/by/4.0/",
  "acquireLicensePage": "https://example.com/license",
  "creditText": "Иван Иванов / example.com",
  "creator": {
    "@type": "Person",
    "name": "Иван Иванов"
  }
}
</script>

6. Управление Googlebot-Image

6.1 robots.txt

robots.txt — это соглашение, а не техническая блокировка. Настоящий Googlebot-Image его уважает. Боты-скраперы его игнорируют.

Полная блокировка Googlebot-Image:

User-agent: Googlebot-Image
Disallow: /

Блокировка конкретных директорий:

User-agent: Googlebot-Image
Disallow: /uploads/private/
Disallow: /cache/
Disallow: /tmp/
Disallow: /avatars/

Блокировка конкретных форматов:

User-agent: Googlebot-Image
Disallow: /*.bmp$
Disallow: /*.tiff$

Разрешить основной Googlebot, заблокировать только Googlebot-Image:

User-agent: Googlebot
Disallow:

User-agent: Googlebot-Image
Disallow: /

User-agent: *
Disallow: /admin/

6.2 X-Robots-Tag для изображений

Nginx — запрет индексации изображений в конкретной папке:

location /uploads/private/ {
    add_header X-Robots-Tag "noindex" always;
}

Apache .htaccess:

<FilesMatch "\.(jpg|jpeg|png|gif|webp)$">
    Header always set X-Robots-Tag "noindex"
</FilesMatch>

6.3 Блокировка через .htaccess (Apache)

RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} Googlebot-Image [NC]
RewriteRule \.(jpg|jpeg|png|gif|webp|avif|svg)$ - [F,L]

6.4 Блокировка через Nginx

map $http_user_agent $is_gbot_image {
    default            0;
    "~*Googlebot-Image" 1;
}

location ~* \.(jpg|jpeg|png|gif|webp|avif|svg)$ {
    if ($is_gbot_image) {
        return 403;
    }
}

7. Как уменьшить нагрузку

CDN — первоочередная мера

Для сайтов с большим количеством изображений CDN — самое эффективное решение. Googlebot-Image будет получать файлы с edge-узла, не нагружая origin-сервер:

  • Cloudflare — бесплатный план включает CDN для изображений
  • AWS CloudFront + S3 — стандарт для e-commerce
  • Cloudinary — CDN + автоматическая оптимизация и конвертация форматов
  • Imgix — CDN с трансформацией изображений на лету

Оптимизация размера файлов

# Конвертация JPEG в WebP (cwebp)
cwebp -q 80 input.jpg -o output.webp

# Пакетная конвертация (bash)
for f in *.jpg; do cwebp -q 80 "$f" -o "${f%.jpg}.webp"; done

# Сжатие JPEG без потери качества (jpegoptim)
jpegoptim --max=85 --strip-all images/*.jpg

# Сжатие PNG (pngquant)
pngquant --quality=65-80 images/*.png

Кеширование изображений (Nginx)

location ~* \.(jpg|jpeg|png|gif|webp|avif|svg|ico)$ {
    expires 1y;
    add_header Cache-Control "public, immutable";
    add_header Vary "Accept";
}

8. Googlebot-Image vs другие image crawlers

Краулер Платформа User-Agent Цель
Googlebot-Image Google Images Googlebot-Image/1.0 Поисковый индекс
Bingbot Bing Images bingbot/2.0 Microsoft поиск
Twitterbot Twitter/X Twitterbot/1.0 Open Graph превью
facebookexternalhit Facebook facebookexternalhit/1.1 OG-карточки
Pinterestbot Pinterest Pinterestbot Каталог Pinterest
Bytespider Bytedance/TikTok Bytespider AI training (агрессивный)

9. Рекомендуемая стратегия

✔ Главный принцип: оптимизируйте изображения для пользователей — Google Images будет следствием. Быстрые, правильно подписанные, структурированные изображения = хороший трафик из Google Images.

Задача Решение
Улучшить индексацию Image Sitemap + Schema.org ImageObject
Повысить ранжирование Уникальный alt-текст + осмысленные имена файлов
Снизить нагрузку от бота CDN + кеш + оптимизация размера файлов
Заблокировать индексацию папки robots.txt: User-agent: Googlebot-Image / Disallow: /folder/
Запретить конкретный файл X-Robots-Tag: noindex на HTTP-ответе файла
Проверить активность бота grep 'Googlebot-Image' + анализ bandwidth
Верифицировать бота Двухэтапный DNS lookup (reverse + forward)
Поддержать современные форматы <picture> с srcset для WebP/AVIF + fallback JPEG

 

Полезные ссылки: Google Images — руководство |  IP-диапазоны Googlebot

Другие гайды по ботам

Частые вопросы

Что такое Googlebot-Image и чем он отличается от основного Googlebot?

Googlebot-Image — специализированный краулер Google, предназначенный исключительно для обхода и индексации изображений. В отличие от основного Googlebot, он не анализирует текстовый контент страниц и не используется для ранжирования в основном поиске. Его задача — находить изображения, анализировать их метаданные (alt, title, имя файла, окружающий текст) и добавлять их в Google Images.

Как Googlebot-Image находит изображения?

Несколькими способами: через HTML-разметку страниц (<img>, <picture>, srcset), через структурированные данные (Schema.org ImageObject), через Image Sitemap, через Open Graph (og:image) и Twitter Cards. Основной путь — обход HTML-страниц основным Googlebot, который передаёт найденные изображения в очередь Googlebot-Image.

Индексирует ли Googlebot-Image изображения из CSS background-image?

В общем случае нет. Google не индексирует CSS background-image в Google Images, если только изображение не встречается также в HTML-разметке. Для индексации в Google Images используйте теги <img> с корректным alt-текстом.

Какую нагрузку Googlebot-Image создаёт на сервер?

Меньшую, чем основной Googlebot, но ощутимую для сайтов с большим количеством изображений. Основная нагрузка — HTTP-запросы к файлам изображений, которые могут быть значительно крупнее HTML-страниц. Сайты с тысячами товарных фотографий, галереи и стоки могут испытывать десятки Mbps дополнительного трафика во время активного обхода.

Как заблокировать Googlebot-Image, но оставить основной Googlebot?

Через robots.txt: добавьте User-agent: Googlebot-Image и Disallow: /. Это запретит боту индексировать ваши изображения в Google Images, но не повлияет на индексацию страниц основным Googlebot.

Влияет ли alt-текст на ранжирование в Google Images?

Да, и очень сильно. Alt-текст — главный сигнал для Google Images. Он должен кратко и точно описывать содержимое изображения, содержать релевантные ключевые слова (без спама), быть уникальным для каждого изображения. Отсутствие alt — одна из главных причин, почему изображения не индексируются или плохо ранжируются.

Что такое Image Sitemap и нужен ли он?

Image Sitemap — расширение стандартного sitemap.xml, которое явно указывает Google на изображения страницы с дополнительными метаданными (заголовок, описание, лицензия). Он особенно полезен для изображений, загружаемых через JavaScript, и для сайтов-галерей, где скорость индексации критична.

Как проверить, индексируются ли мои изображения в Google?

Выполните поиск site:yoursite.com в Google Images — вы увидите проиндексированные изображения. В Google Search Console раздел «Покрытие» показывает статус индексации. В разделе «Статистика сканирования» видна активность Googlebot-Image отдельно от основного бота.

Индексирует ли Googlebot-Image изображения в WebP и AVIF?

Да. Google поддерживает современные форматы: JPEG, PNG, GIF, WebP, SVG, BMP, AVIF. WebP и AVIF рекомендуются — они меньше весят при том же качестве, что улучшает скорость загрузки страницы. Используйте тег <picture> с srcset для подачи современных форматов с fallback на JPEG.

Что произойдёт, если закрыть папку с изображениями в robots.txt?

Googlebot-Image не сможет скачать изображения и не добавит их в Google Images. Кроме того, основной Googlebot не сможет обработать эти изображения для оценки страницы. Если изображения важны для бизнеса (товарные фото, портфолио), закрытие папки приведёт к потере трафика из Google Images. Закрывайте только технические директории (/uploads/tmp/, /cache/) и изображения без SEO-ценности.

TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак.

Похожие статьи

GPTBot

GPTBot — краулер OpenAI, который собирает публично доступный веб-контент для обучения будущих поколений генеративных моделей семейства GPT. Это один из первых официально задокументированных ИИ-краулеров на рынке (представлен в августе 2023 года) и на сегодня — самый узнаваемый бот OpenAI среди веб-мастеров.

4 мин

OAI-AdsBot

OAI-AdsBot — самый новый краулер OpenAI, впервые появившийся в официальной документации в апреле 2026 года. Он обслуживает рекламную инфраструктуру ChatGPT: когда рекламодатель размещает объявление в ChatGPT Ads, этот бот посещает указанную посадочную страницу, чтобы проверить её на соответствие рекламным политикам OpenAI и, при необходимости, использовать содержимое страницы для оценки релевантности показа объявления.

3 мин

Keys.so Bot (keys-so-bot)

Keys-so-bot — краулер российского SEO-сервиса Keys.so (оператор — компания «Битерика Групп»), который используется для сбора данных о видимости сайтов в органической и контекстной выдаче Яндекса и Google, анализа семантического ядра конкурентов и построения истории изменений файлов robots.txt. Это не поисковый робот в классическом смысле — он не индексирует страницы для показа в результатах поиска, а сканирует сайты в интересах пользователей сервиса, которые анализируют конкурентов.

3 мин

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.