AI-готовность: как попасть в ответы ChatGPT и Perplexity
AI-ассистенты рекомендуют только те сайты, которые могут обойти, разобрать и процитировать. Это три отдельные задачи, и большинство сайтов проваливает хотя бы одну, не подозревая об этом.
Сайт готов к AI-поиску, когда ответные движки — ChatGPT, Perplexity, AI-результаты Google — могут его обойти, понять и процитировать. Это три отдельных уровня: доступ, которым управляет robots.txt; понимание, которое обеспечивают структурированные данные и метаданные; и навигация, за которую отвечает llms.txt. Каждый уровень ломается независимо от других, и у большинства сайтов есть пробел хотя бы в одном.
Почему это стало отдельной дисциплиной
Всё большая доля вопросов, которые раньше были запросами в Google или Яндексе, теперь получает ответ внутри AI-ассистента — с несколькими процитированными источниками. Оказаться среди этих цитат — новое «первое место» выдачи. Классическое SEO никуда не делось: ответные движки опираются на поисковые индексы при отборе кандидатов. Но пересечение неполное: сайт может отлично стоять в «синих ссылках» и при этом быть невидимым для AI-ответов, потому что два года назад заблокировал краулер в разгар споров об обучающих данных.
Отсюда и отдельная дисциплина: у AI-видимости свои точки отказа, которых классический аудит не проверяет. Хорошая новость в том, что почти все они технические, диагностируются за секунды и чинятся правками файлов, а не месяцами контент-работы.
Уровень 1: доступ. Кто может читать ваш сайт
Каждая крупная AI-система обходит сайты под собственным именем агента, и robots.txt решает судьбу каждого бота отдельно. Ключевое различие — для чего нужен конкретный бот: одни собирают материал для обучения будущих моделей, другие обслуживают поиск и цитирование прямо сейчас. Блокировка обучающего бота влияет только на будущие веса моделей и никак не сказывается на видимости; блокировка поискового бота убирает вас из ответов этого движка уже сегодня, полностью и независимо от качества сайта.
| Краулер | Оператор | Что означает блокировка |
|---|---|---|
GPTBot, OAI-SearchBot | OpenAI | ChatGPT не может читать и цитировать вас |
ClaudeBot | Anthropic | Claude не может читать и цитировать вас |
PerplexityBot | Perplexity | Вас нет в ответах Perplexity |
Google-Extended | Только обучение Gemini; AI Overviews не затрагивается | |
CCBot | Common Crawl | Выпадение из многих обучающих датасетов; на поиск не влияет |
Управление здесь пофамильное. robots.txt позволяет задать правило для каждого агента отдельно, и разумная политика чаще всего выглядит как «поисковым — можно, обучающим — по решению владельца»:
User-agent: OAI-SearchBot
Allow: /
User-agent: PerplexityBot
Allow: /
User-agent: CCBot
Disallow: /
Самая частая рана, нанесённая себе самому: правило «блокируем всех AI-ботов», добавленное в robots.txt в 2023 году как жест против использования контента в обучении — и оставшееся в файле теперь, когда те же самые агенты обслуживают поисковые продукты. Решайте по каждому боту отдельно, исходя из того, что он делает сегодня, а не из того, чем он был два года назад. Актуальный список агентов каждая компания публикует в своей документации для вебмастеров — например, Google ведёт такой список для всех своих краулеров.
Уровень 2: понимание. Разбирают ли машины ваш смысл
Открытая дверь — необходимое условие, но не достаточное: краулер, попавший на страницу, должен ещё понять, что на ней написано и чему можно верить. Ответные движки не читают страницы так, как люди: у конвейера извлечения нет терпения разгадывать намёки. Сигналы, которые он разбирает надёжнее всего:
- Структурированные данные JSON-LD. Разметка schema.org (Organization, FAQPage, Article, Product) — однозначный машиночитаемый факт, и именно она извлекается в ответы чище всего. Разметка FAQPage особенно эффективна: она буквально имеет форму «вопрос — ответ».
- Честные метаданные. Конкретный title, настоящий meta description, канонический URL и один внятный H1 на страницу. Когда их нет, AI-сниппеты собираются из произвольного текста страницы.
- Контент в форме ответа. Страницы, где ответ стоит в первом абзаце, цитируют; страницы, где он похоронен под 800 словами вступления, пропускают. Сравнительные таблицы и разделы FAQ удобны для извлечения уже по построению.
Заметьте, что всё перечисленное — давно известные практики со словаря schema.org и учебников технического SEO. Новых форматов уровень понимания не требует; он требует, чтобы старые были сделаны честно. Разметка, противоречащая видимому содержимому страницы, не помогает, а вредит — и извлечению, и доверию.
Уровень 3: навигация. Оставили ли вы карту
Файл llms.txt даёт моделям курируемый указатель сайта в markdown: кто вы, о чём сайт и какие 10–30 страниц читать в первую очередь. Это самый молодой и наименее стандартизованный уровень — потому он и третий, а не первый: занимайтесь им после того, как доступ и понимание приведены в порядок, а не вместо них. Файл, на который никакая модель не может попасть из-за блокировки в robots.txt, бесполезен ровно так же, как идеальная разметка на закрытой странице. С генератором создание занимает минуты и замыкает контур.
Чек-лист: чинить в этом порядке
- Запустите проверку AI-готовности для своего домена — она оценивает все три уровня примерно за десять секунд.
- Разблокируйте те AI-краулеры поиска, чьи цитаты вам нужны. Это самое результативное одиночное изменение — и это одна правка robots.txt.
- Добавьте JSON-LD на ключевые типы страниц: начните с Organization на главной и FAQPage везде, где вы действительно отвечаете на вопросы.
- Закройте пробелы в метаданных, которые отметит проверка: title, description, canonical.
- Убедитесь, что карта сайта валидна и объявлена в robots.txt: ответные движки находят вас через поисковые индексы Google, Bing и Яндекса, так что сломанный sitemap.xml бьёт и по AI-видимости.
- Добавьте llms.txt последним и прогоните проверку ещё раз, чтобы всё горело зелёным.
Порядок в списке не случаен: он выстроен по соотношению эффекта и трудозатрат. Первые два пункта — минуты работы и максимум последствий; разметка и метаданные — часы; llms.txt — приятное завершение, а не фундамент.
Чем AI-готовность не является
Это не трюк, и секретного мета-тега не существует. Системы, построенные для ответов на вопросы, вознаграждают то же, что всегда вознаграждало хорошее техническое SEO: доступные страницы, однозначную структуру, контент, который действительно что-то отвечает. Разница — в строгости. Живой посетитель простит отсутствующий meta description; конвейер извлечения просто перейдёт к следующему источнику. AI-готовность — это та же техническая гигиена, только с закрученными допусками: всё, что вы сделаете для ответных движков, пойдёт на пользу и обычному поиску.