Тестер robots.txt
Загрузите robots.txt сайта или вставьте свой, укажите URL и выберите краулера. Вы получите понятный вердикт, точную строку, которая его определила, и тот же тест сразу для двенадцати крупных краулеров.
Подходит любой токен краулера, поэтому просто впишите нужный, если его нет в списке.
Вставленные правила сопоставляются целиком в вашем браузере. Загрузка robots.txt с домена идёт через наш сервер и скачивает только этот один публичный файл, при этом ничего не сохраняется.
Как на самом деле работает сопоставление в robots.txt
Файл robots.txt состоит из групп. Каждая группа начинается с одной или нескольких строк User-agent и содержит правила Allow и Disallow для этих краулеров. Краулер читает только ту группу, которая совпадает с его собственным токеном, плюс общую группу, если подходящей именной группы нет. Поэтому правила, написанные для Googlebot, никак не действуют на GPTBot.
Когда на один URL подходит сразу несколько правил из группы, побеждает самое конкретное: то, чей шаблон совпадает с наибольшим числом символов. Если Allow и Disallow одинаковой длины, побеждает Allow. Такой порядок закреплён в RFC 9309, стандартизированном Robots Exclusion Protocol, и именно поэтому связка Disallow: /admin/ и Allow: /admin/public/ оставляет публичную папку открытой для обхода.
В шаблонах поддерживаются два подстановочных знака. Звёздочка означает любую последовательность символов, а знак доллара привязывает шаблон к концу URL. В путях регистр важен, в именах краулеров нет, а один файл robots.txt управляет только своей схемой, своим хостом и своим портом, поэтому файл на поддомене www не распространяется на домен без www.
Что показывает тестер
- Вердикт для выбранного краулера с точным правилом и номером строки за ним
- Тот же URL, проверенный сразу по двенадцати краулерам: поисковые и ИИ-боты рядом
- Какая группа сработала, включая то, была она именной или общей
- Все строки Sitemap, объявленные в файле
- Предупреждения парсера: правила до первой строки User-agent, неподдерживаемые директивы, абсолютные URL в Disallow, отсутствующая строка Sitemap
Проверка готовности к ИИ
Могут ли ChatGPT, Claude и Perplexity читать и цитировать ваш сайт? Проверяем llms.txt, правила robots.txt для ИИ-краулеров, структурированные данные и метаданные.
Проверить готовность к ИИ →Из блога
Ошибки hreflang, которые ломают международное SEO
Почти все сломанные настройки hreflang объясняются десятью ошибками, и большинство из них не подаёт признаков. Разбираем, как заметить и исправить каждую.
robots.txtrobots.txt для ИИ-краулеров: рецепты разрешить и запретить
Три рецепта и таблица по каждому боту, чтобы управлять GPTBot, ClaudeBot, PerplexityBot и остальными из одного небольшого текстового файла.
sitemapОшибки в sitemap.xml: как найти и исправить каждую
Почти все проблемы с картой сайта сводятся к десятку типовых ошибок. Разбираем каждую: симптом, причину и конкретное исправление.