Боты6 мин чтения·11 августа 2026 г.

ChatGPT Operator: почему это не краулер, а виртуальный пользователь — и почему robots.txt здесь работает слабее

ChatGPT Operator принципиально отличается от GPTBot, OAI-SearchBot и ChatGPT-User: это браузерный AI-агент, выполняющий задачи живого пользователя в реальном времени (заполнение форм, заказы), а не фоновый обходящий краулер. Разбираем, почему стандартная логика "разрешить ради AI-видимости или заблокировать ради экономии трафика" здесь не годится, и почему для чувствительных путей нужен контроль на уровне приложения, а не только robots.txt.

TVTrafficVeil TeamЭксперты по защите веб-трафика
Уникальная иллюстрация бота ChatGPT Operator: легитимный ai и llm-краулеры

ChatGPT Operator в корне отличается от привычных AI-краулеров вроде GPTBot по одной ключевой причине: это не автоматизированный сборщик данных, а браузерный агент, управляемый в реальном времени задачей конкретного пользователя. По классификации независимых аналитиков бот-трафика, Operator ведёт себя «скорее как виртуальный пользователь, чем как традиционный краулер»: он выполняет задачи, инициированные человеком — заполняет формы, оформляет заказы, записывается на приём, — а не системно обходит сайты в фоновом режиме ради накопления обучающего датасета.

Что такое Operator и как он соотносится с остальными ботами OpenAI

Operator запустили 23 января 2025 года как отдельный AI-агент, способный автономно выполнять задачи через взаимодействие с браузером — от заполнения форм до размещения заказов и других повторяющихся действий, которые обычно делает вживую человек. Важно не путать его с тремя основными краулерами OpenAI, у каждого из которых отдельная, независимо настраиваемая роль: GPTBot собирает контент для обучения будущих моделей, OAI-SearchBot строит поисковый индекс для функции поиска в ChatGPT, а ChatGPT-User выполняет разовые запросы по прямой команде пользователя в диалоге. У OpenAI все три настраиваются в robots.txt раздельно — например, можно разрешить OAI-SearchBot ради присутствия в поиске ChatGPT, полностью запретив при этом GPTBot, чтобы контент не использовался для тренировки моделей.

Параметры

Параметр Значение
Тип Браузерный AI-агент, управляемый задачей конкретного пользователя, а не автономный обходящий краулер
Запуск 23 января 2025 года; впоследствии функциональность развилась в направлении ChatGPT agent
User-Agent Варьируется — использует браузерную автоматизацию на основе Chromium как часть выполнения задачи, единой фиксированной строки, задокументированной как у GPTBot или OAI-SearchBot, независимые источники не приводят
Соблюдение robots.txt По независимым наблюдениям — нет; это отличает его от трёх основных, официально задокументированных краулеров OpenAI, которые прямо заявляют о соблюдении правил
Инфраструктура По независимым техническим наблюдениям, трафик агента проходит через облачную инфраструктуру (предположительно Microsoft Azure, судя по списку субподрядчиков OpenAI) и может идти через прокси
Список IP-адресов ❌ Официального фида, аналогичного опубликованным диапазонам для GPTBot и OAI-SearchBot, для Operator не найдено

Почему шаблон «AI-краулер = используйте robots.txt» здесь работает хуже

Ключевая практическая проблема — Operator по своей природе не является тем типом бота, для которого правило в robots.txt было спроектировано как надёжный инструмент управления. Классический краулер обходит сайты самостоятельно и заранее, вне контекста конкретного запроса человека, — и именно поэтому владелец сайта может заранее договориться с ним через файл политики. Operator же по описанию исполняет действия в реальном времени от имени конкретного пользователя, инициировавшего задачу, — то есть ближе по своей природе к автоматизированному браузеру человека, чем к фоновому индексатору, и, по наблюдениям, не гарантированно ограничивает себя правилами robots.txt так же, как это делают три основных краулера OpenAI.

Не уверены, кто ходит по вашему сайту?

Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.

Посмотреть свой трафик

Как найти в логах

grep -i "chatgpt-operator" /var/log/nginx/access.log

Поскольку единой задокументированной строки UA и официального списка IP-адресов для Operator, в отличие от GPTBot и OAI-SearchBot, нет, для проверки подлинности при аномальной активности стоит опираться на связку поведения и происхождения IP через ASN, а не полагаться на текст заголовка.

Стоит ли блокировать

Оценка здесь отличается от типового AI-краулера тем, что трафик Operator — прямое следствие действия живого пользователя, пытающегося что-то сделать на сайте (например, оформить заказ или заполнить форму) через ChatGPT, а не безличный фоновый обход:

  • если сайт заинтересован в том, чтобы пользователи ChatGPT могли совершать на нём реальные действия (покупки, бронирования, заполнение форм) через агентские сценарии, — блокировка Operator напрямую ломает этот пользовательский сценарий, а не просто «экономит трафик»;
  • если автоматизированное взаимодействие с формами и функциями сайта нежелательно (риски для форм оплаты, создания учётных записей, других чувствительных действий) — ограничение обосновано именно как защита конкретных функциональных путей, а не общий запрет на AI-видимость;
  • на позиции в органической выдаче Google, Bing или Яндекса присутствие или отсутствие Operator не влияет — это не поисковый краулер ни одной системы.

Как настроить доступ

Полный запрет через robots.txt — с оговоркой, что гарантии соблюдения ниже, чем у GPTBot или OAI-SearchBot:

User-agent: chatgpt-operator
Disallow: /

Поскольку соблюдение robots.txt этим агентом не гарантировано, для реально чувствительных путей (оформление заказа, платёжные формы, создание аккаунта) надёжнее полагаться не на файл политики, а на прямой контроль на уровне приложения или сервера:

if ($http_user_agent ~* "chatgpt-operator") {
    return 403;
}

Если задача — не заблокировать полностью, а просто снизить частоту автоматизированных обращений к определённым разделам, разумная альтернатива — ограничение скорости запросов вместо жёсткого запрета, особенно если часть таких сценариев (например, помощь пользователю с покупкой) в принципе желательна для бизнеса:

limit_req_zone $binary_remote_addr zone=chatgptoperator:10m rate=10r/m;
location / {
    if ($http_user_agent ~* "chatgpt-operator") {
        limit_req zone=chatgptoperator burst=20 nodelay;
    }
}

Частые вопросы

ChatGPT Operator — это то же самое, что GPTBot?
Нет, это принципиально другой тип бота — браузерный агент, выполняющий задачи конкретного пользователя в реальном времени, а не автономный краулер для сбора обучающих данных.
Когда запустили Operator?
23 января 2025 года, как отдельный AI-агент для автоматизации браузерных задач вроде заполнения форм и оформления заказов.
Соблюдает ли Operator правила robots.txt?
По независимым наблюдениям — нет, в отличие от трёх основных краулеров OpenAI (GPTBot, OAI-SearchBot, ChatGPT-User), которые официально заявляют о соблюдении.
Есть ли у Operator официальный список IP-адресов, как у GPTBot?
Нет, официального фида, аналогичного опубликованным диапазонам для GPTBot и OAI-SearchBot, для Operator не найдено.
Стоит ли блокировать Operator, если сайт продаёт товары или принимает заказы онлайн?
Стоит подумать дважды — блокировка может сломать сценарий, где пользователи ChatGPT пытаются оформить покупку или бронирование на сайте через агента.
Как защитить чувствительные пути вроде оплаты, если robots.txt ненадёжен?
Полагаться на контроль на уровне приложения или сервера — прямую блокировку или rate-limit, а не только на файл политики.
#chatgpt-operator#OpenAI#GPTBot#browser agent#бот-энциклопедия#robots.txt#AI-агент#TrafficVeil
TV
TrafficVeil Team

Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.

Похожие статьи

Ещё материалы из раздела «Боты» — те же вопросы, другие агенты.

Проверьте защиту своего сайта

Подключение занимает несколько минут. Начните с анализа трафика и включайте блокировки после проверки логов.

Тарифа на трафик нет. Платите за людей, а не за тех, кого отбили: боты, атаки и всё, что срезали фильтры, в счёт не идут. Тариф — число доменов и глубина настроек.

TrafficVeil