Trae — не безымянный «сканер с неясной целью», а официально задокументированный AI-агент для разработки, созданный компанией ByteDance (владельцем TikTok). Токен trae в access.log означает не системный обход сайта, а точечный fetch-запрос, который агент выполняет по инициативе конкретного разработчика в процессе работы с кодом. В каталоге TrafficVeil бот помечен как нежелательный в категории «Прочие краулеры и сервисы».
Что такое Trae на самом деле
Trae — AI-powered агент для разработки от ByteDance: он умеет понимать структуру кодовой базы, получать содержимое веб-страниц и генерировать код на основе контекста. По классу это прямой аналог таких инструментов, как Claude Code, Cursor или уже разобранного в этой энциклопедии OpenCode — программ, которые помогают разработчикам писать и поддерживать код, в том числе обращаясь к внешним веб-страницам за справочной информацией. Токен зафиксирован в открытом community-реестре AI-краулеров (ai.robots.txt) с признанным правилом блокировки.
Ключевое отличие от систематических краулеров: Trae обращается к конкретному URL потому, что разработчик, использующий агента, попросил его свериться с этой страницей — например, прочитать документацию API, проверить синтаксис или актуальность технической информации в процессе написания кода.
| Параметр | Значение |
| Название | Trae |
| User-Agent / паттерн | trae |
| Оператор | ByteDance (владелец TikTok) |
| Роль | AI-агент для разработки: понимание кодовой базы, получение веб-контента, генерация кода по запросу разработчика |
| Документация / ориентир | Токен зафиксирован в открытом community-реестре ai.robots.txt; отдельной публичной страницы для веб-мастеров не найдено |
| Список IP | ❌ Публичного списка IP нет — трафик может идти с машин отдельных разработчиков, а не из единой инфраструктуры оператора |
| robots.txt | Признанное правило существует в открытом реестре; фактическое соблюдение стоит проверять по факту логов |
| Пометка TrafficVeil | Нежелательный / Прочие краулеры и сервисы |
Зачем Trae приходит на сайт
В отличие от систематических краулеров, которые методично проходят по каталогу, Trae обращается к странице потому, что конкретный разработчик в моменте попросил своего AI-агента прочитать её — например, чтобы свериться с документацией или технической заметкой. Это делает трафик скорее единичным и непредсказуемым по времени, чем регулярным фоновым обходом.
Практическое следствие: если контент страницы важен для разработчиков как справочный материал (документация, технические гайды, примеры кода), такие визиты — это разовое использование сайта как источника информации в конкретной рабочей задаче, а не попытка собрать данные впрок.
Нагрузка и риски именно для Trae
Отдельной строки в публичной сводке топ-ботов TrafficVeil у trae может не быть, но стоит учитывать саму природу трафика: раз запросы могут идти с машин отдельных разработчиков, а не из единой инфраструктуры, классические метрики вроде «повторяемый path-паттерн» здесь работают слабее, чем для системных краулеров. Смотрите не столько на объём, сколько на контекст:
- единичность запроса — один-два URL за раз, а не систематический проход по разделам;
- отсутствие cookie и признаков полноценной сессии;
- концентрацию на технически содержательных страницах, если сайт публикует такой материал.
Подключите домен и посмотрите живую ленту: кто пришёл, с какой сети, что запрашивал и по какому правилу был пропущен или заблокирован.
Как найти Trae в логах
Ищите конкретный токен trae, а не общее слово «bot».
# Базовый поиск
grep -i "trae" /var/log/nginx/access.log
# Топ URL, которые вычитывает бот
grep -i "trae" /var/log/nginx/access.log | awk '{print $7}' | sort | uniq -c | sort -rn | head
# Топ IP за этим UA
grep -i "trae" /var/log/nginx/access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head
# Суточная активность
grep -i "trae" /var/log/nginx/access.log | awk '{print $4}' | cut -d: -f1 | sort | uniq -c
Верификация здесь особенно важна: подделать User-Agent может любой скрипт, а официального перечня IP от оператора нет. Смотрите связку UA + ASN/IP + частота + набор URL — единичные, разрозненные по времени запросы к техническим страницам типичны именно для этого класса AI-агентов, а не для систематического сбора.
IP="1.2.3.4" whois -h whois.cymru.com " -v $IP" dig +short -x "$IP"
robots.txt для Trae
# Жёсткий запрет User-agent: trae Disallow: / # Разрешить всё User-agent: trae Allow: / # Компромисс: закрыть деньги/кабинет, оставить публичную часть User-agent: trae Disallow: /admin/ Disallow: /cart/ Disallow: /checkout/ Disallow: /account/ Disallow: /api/ Allow: /
Важно понимать ограничение: даже жёсткий Disallow остановит только ту часть трафика, где агент честно указал себя в UA. Если после настройки хиты продолжаются — переходите к nginx/Apache или к запрету через TrafficVeil.
Блокировка вручную и через TrafficVeil
Nginx
if ($http_user_agent ~* "trae") {
return 403;
}
limit_req_zone $binary_remote_addr zone=trae:10m rate=10r/m;
location / {
if ($http_user_agent ~* "trae") {
limit_req zone=trae burst=20 nodelay;
}
}
Apache (.htaccess)
RewriteEngine On
RewriteCond %{HTTP_USER_AGENT} trae [NC]
RewriteRule ^ - [F,L]
TrafficVeil
- найдите trae / Trae в ботах домена или в
/system/bots; - для нежелательного сценария — категория «запретить»; для мягкого — rate-limit;
- allow оставляйте, только если для вас важно, чтобы разработчики через AI-агентов могли свободно обращаться к вашей публичной документации или техническому контенту;
- после изменения сверьте логи: хиты Trae должны уйти в блок/лимит, а нужные поисковики остаться нетронутыми.
С кем не путать Trae
| Бот / сосед | Кластер | UA | Комментарий |
| 360Spider | Прочие краулеры и сервисы | 360spider | нежелательный |
| A360-Search | Прочие краулеры и сервисы | a360-search | нежелательный |
| AASA-Bot | Прочие краулеры и сервисы | aasa-bot | нежелательный |
| ABEvalBot | Прочие краулеры и сервисы | abevalbot | нежелательный |
| ActiveComply | Прочие краулеры и сервисы | activecomply | нежелательный |
Отдельно стоит помнить про OpenCode, уже разобранный в этой энциклопедии, — концептуально Trae и OpenCode относятся к одному классу AI-агентов для разработки, хотя принадлежат разным компаниям и созданы независимо друг от друга.
Стратегия allow/deny для Trae
| Ситуация | Действие |
| Важно, чтобы разработчики через AI-агентов могли обращаться к документации сайта | Allow + закрыть /admin /cart /api |
| Единичные fetch-запросы нежелательны в принципе | Disallow + запрет в TrafficVeil |
| Нагрузка от честно идентифицированных запросов раздражает | Rate-limit на nginx/TrafficVeil |
| Нежелательный по базе TrafficVeil | Deny по умолчанию, исключения — точечно |
| Подозрение, что похожий трафик маскируется под другой UA | Полагаться на поведенческие признаки (единичность запроса, отсутствие сессии), а не только на UA |
Главное, что стоит помнить про Trae: это не масштабный автоматический краулер, а инструмент отдельных разработчиков для точечных задач — решение allow/deny здесь стоит принимать с той же логикой, что и для OpenCode, а не как для системного контентного сборщика.
Частые вопросы
Какая компания стоит за AI-агентом Trae?
Действительно ли Trae системно обходит сайт по расписанию?
На какой другой бот из этой энциклопедии похож Trae по своей природе?
Можно ли полагаться на IP или ASN для верификации запросов Trae?
Стоит ли ожидать от Trae системной нагрузки на сервер, как от классических краулеров?
Существует ли признанное правило robots.txt для Trae?
Команда TrafficVeil разрабатывает инструменты защиты сайтов от ботов, DDoS и веб-атак. Разборы ботов пишем по логам подключённых доменов и открытым данным операторов.