Боты5 мин чтения·12 августа 2026 г.

SleepBot: бот, чья загадка заинтересовала даже Hacker News — сайт в UA не обновлялся с 2008 года

Ссылка в User-Agent SleepBot ведёт на сайт, не обновлявшийся с января 2008 года — заброшенную страницу частного лица с работающим интернет-радио, что заставило сообщество Hacker News всерьёз обсуждать, не ARG ли это. Разбираем это необычное расследование, противоречивые сообщения о поведении бота (от полного бездействия до агрессивного сканирования вопреки заявленному соблюдению правил), и почему загадочность не равна безобидности.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота SleepBot: нежелательный прочие краулеры и сервисы

SleepBot — один из самых любопытных «нерасшифрованных» ботов в этой серии, и не только из-за отсутствия официального оператора. Сайт, на который ссылается сама строка User-Agent — http://sleepbot.com/, причём именно по протоколу http, без защищённого соединения, — по наблюдениям сообщества вебмастеров не обновлялся ещё с января 2008 года. Ссылка в UA технически рабочая, но ведёт в далёкое прошлое веба, а не на актуальную страницу действующего сервиса.

Дело, которое заинтересовало не только вебмастеров, но и Hacker News

Показательно, что этим ботом заинтересовались не только администраторы сайтов, разбирающие access.log, но и участники технического форума Hacker News, попытавшиеся выяснить происхождение бота отдельным расследованием. По их наблюдениям, сайт, на который ведёт ссылка из UA, оказался домашней страницей человека, интересующегося технологиями и эмбиент-музыкой, который сам не появлялся в сети примерно пять лет, но всё ещё держит работающий Shoutcast-стрим интернет-радио; архив Wayback Machine показывает минимум изменений за более чем десятилетие. Ссылка на резюме с этой страницы вела на аккаунт GitHub с другим именем пользователя, где значился всего один зарегистрированный issue за текущий год — то есть какая-то минимальная активность, но крайне скудная. Само обсуждение на Hacker News было озаглавлено вопросом «не рекламируют ли мне ARG через логи User-Agent» — то есть часть сообщества всерьёз рассматривала версию, что это не коммерческий или исследовательский краулер в привычном смысле, а часть какой-то альтернативной реальностной игры или личного проекта, а не стандартного бизнес-инструмента для сбора данных.

Параметры бота

Параметр Значение
User-Agent Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; SleepBot/1.0; +http://sleepbot.com/) Chrome/131.0.0.0 Safari/537.36
Оператор ❌ Официально не подтверждён; ссылка в UA ведёт на давно заброшенный сайт частного лица
Дата последнего обновления сайта в UA Январь 2008 года, по независимым наблюдениям
Наблюдаемая инфраструктура По сообщениям сообщества вебмастеров, запросы шли преимущественно с IP-диапазонов Google Cloud Platform (34.x, 35.x), что типично для хостинга произвольных сторонних скриптов, а не для выделенной инфраструктуры конкретного продукта
Поведение по наблюдениям Противоречивое: часть администраторов фиксировала, что бот запрашивал только robots.txt и ничего больше; другие сообщали о заметном, агрессивном сканировании контента (в том числе массовой загрузке изображений) вопреки заявленному соблюдению правил
Список IP-адресов ❌ Отсутствует

Почему это не повод расслабляться

Загадочное или даже по-своему любопытное происхождение бота не делает его безопаснее с практической точки зрения. Один из зафиксированных на форуме phpBB случаев прямо описывает эпизод, где трафик, представлявшийся как SleepBot, вёл себя как атака: агрессивно и массово сканировал форум, игнорируя как добавление в список запрещённых ботов, так и явный запрет в robots.txt — притом что, по ожиданиям администратора, легитимный SleepBot должен был бы эти правила уважать. Это ровно тот случай, когда стоит подозревать смешение двух разных явлений под одной строкой: возможно, некий изначальный, менее агрессивный SleepBot действительно существует (или существовал), но имя достаточно малоизвестно и слабо задокументировано, чтобы им беспрепятственно пользовались и сторонние, куда менее добросовестные скрипты.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Сколько трафика он создаёт

По сводке TrafficVeil, паттерн запросов sleepbot на подключённых доменах составил порядка 10 тысяч за март–июнь 2026 года (июнь — по 14 число). Учитывая полное отсутствие официальной документации и противоречивые сообщения о поведении, этот объём стоит рассматривать с осторожностью независимо от абсолютной величины.

Как найти бота в логах

grep -i "SleepBot" /var/log/nginx/access.log

Учитывая задокументированные случаи явно агрессивного и не соблюдающего правила поведения под этим именем, для проверки происхождения конкретных запросов стоит обязательно свериться с ASN через whois, а не полагаться на одну лишь строку заголовка:

IP="1.2.3.4"
whois -h whois.cymru.com " -v $IP"
dig +short -x "$IP"

Как заблокировать

При отсутствии подтверждённого оператора, официальной документации и учитывая задокументированные случаи агрессивного поведения — запрет по умолчанию является наиболее взвешенной позицией:

User-agent: SleepBot
Disallow: /
if ($http_user_agent ~* "SleepBot") {
    return 403;
}

Robots.txt здесь — не гарантия: как показывает зафиксированный случай на форуме phpBB, часть трафика под этим именем правила прямо игнорировала, поэтому запрет обязательно стоит дублировать на уровне сервера. На позиции в поисковой выдаче Google, Bing или Яндекса блокировка не влияет — это не поисковый краулер ни одной из систем.

Частые вопросы

Кто владеет краулером SleepBot?
Официально не подтверждено — ссылка в User-Agent ведёт на давно заброшенный личный сайт, а не на страницу действующей компании или продукта.
Что необычного в сайте, на который ссылается бот?
По независимым наблюдениям, он не обновлялся с января 2008 года — это домашняя страница частного лица с работающим интернет-радио, чей владелец сам не появлялся в сети около пяти лет.
Почему этим ботом заинтересовался Hacker News?
Участники форума всерьёз обсуждали версию, что это не обычный коммерческий краулер, а часть альтернативной реальностной игры (ARG) или личного проекта.
Соблюдает ли SleepBot правила robots.txt?
Сообщения противоречивы — часть администраторов фиксировала полное бездействие бота, другие сообщали об агрессивном сканировании вопреки заявленному соблюдению правил.
Значит ли необычное происхождение, что бот безопасен?
Нет, зафиксирован реальный случай, когда трафик под этим именем вёл себя как атака, игнорируя и блокировку, и robots.txt.
Повлияет ли блокировка на позиции в поисковых системах?
Нет, SleepBot не связан ни с одной поисковой системой.
#sleepbot#необъяснённый краулер#Hacker News#бот-энциклопедия#robots.txt#verification#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil