Что такое llms.txt и нужен ли он вашему сайту
Небольшой markdown-файл в корне сайта объясняет AI-системам, что это за сайт и какие страницы на нём главные. Разбираем, как он устроен и когда его стоит завести.
llms.txt — это обычный markdown-файл в корне сайта, который рассказывает AI-системам, что представляет собой сайт и какие страницы на нём главные, в формате, придуманном специально для языковых моделей. Это общественная инициатива с сайта llmstxt.org, а не официальный стандарт, но стоит она один небольшой текстовый файл — и целый ряд AI-инструментов уже читает её.
Какую проблему решает файл
Когда языковой модели нужно разобраться в вашем сайте, у неё есть два плохих варианта. Первый — разбирать сырой HTML, продираясь сквозь навигацию, баннеры про cookie и скрипты в поисках сути. Второй — опираться на то, что когда-то попало в обучающие данные и с тех пор устарело. Контекстное окно модели ограничено, и каждый токен, потраченный на служебную обвязку, — это токен, не потраченный на ваш настоящий контент.
llms.txt — короткий путь: отобранная вручную, удобная для модели карта, которая говорит «вот кто мы, и вот страницы, которые стоит прочитать», — в чистом markdown, который модели разбирают нативно. Аналогия с robots.txt здесь не случайна: как robots.txt стал общепринятым местом, где сайт разговаривает с краулерами, так llms.txt претендует на роль места, где сайт разговаривает с языковыми моделями. Разница в содержании: robots.txt запрещает и разрешает, llms.txt объясняет и рекомендует.
Важно понимать, что происходит без файла. Модель не откажется отвечать про ваш сайт — она ответит на основании того, что сумела выцарапать из HTML или запомнила при обучении. Иногда это выглядит терпимо, иногда — как описание сайта трёхлетней давности с мёртвыми разделами. llms.txt не даёт гарантий, но по крайней мере кладёт на стол вашу версию: актуальное описание и актуальный список страниц.
Весь формат в одном примере
Спецификация умещается в четыре правила. Один заголовок # с названием сайта (обязателен). Необязательная строка-цитата > с кратким описанием. Необязательный поясняющий текст. Затем разделы ## со ссылками в markdown, у каждой — необязательное описание:
# CellChart
> Справочник кнопочных и «таблеточных» батареек:
все названия, размеры и аналоги для 92 элементов.
## Семейства батареек
- [Аналоги LR44](https://example.com/lr44/): все названия
LR44 и чем её заменить
- [CR2032 и CR2025](https://example.com/cr2032-vs-cr2025/):
две «таблетки», которые путают чаще всего
Особый смысл имеет раздел с именем ## Optional: модель вправе пропустить его, когда контекст на исходе. Обязательные к прочтению страницы кладите в первые разделы, всё второстепенное — сюда. Название раздела не переводится — это служебное слово формата, как User-agent в robots.txt.
Больше в формате нет ничего: ни XML, ни схем, ни обязательных полей с датами. Файл сознательно сделан таким, чтобы его мог написать человек в текстовом редакторе за один вечер — и чтобы модель могла прочитать его без специального парсера, просто как текст.
llms.txt, robots.txt и sitemap.xml: в чём разница
| Файл | Аудитория | Сообщает | Формат |
|---|---|---|---|
robots.txt | Все краулеры | «Эти разделы обходить можно, эти — нельзя» | Директивы |
sitemap.xml | Краулеры поисковых систем | «Вот все страницы, без исключения» | XML |
llms.txt | Языковые модели | «Вот что действительно важно, отобрано вручную» | Markdown |
Три файла дополняют друг друга и не заменяют один другой: robots.txt управляет доступом, карта сайта стремится к полноте, llms.txt — к отбору. Убирать sitemap.xml, потому что «теперь есть llms.txt», — ошибка: поисковые краулеры Google и Яндекса как читали карту сайта, так и читают. Есть и файл-компаньон, llms-full.txt: он при желании включает полный текст ключевых страниц в одном документе — для моделей и инструментов, которым выгодно получить всё за один запрос, что чаще всего оправдано на сайтах документации. Начинать стоит без него: сперва заведите обычный llms.txt и посмотрите, нужен ли вообще полный вариант.
Честный статус внедрения
Относитесь скептически к любому, кто продаёт llms.txt как приём для роста позиций. Google прямо заявил, что не использует этот файл, Яндекс поддержку тоже не объявлял, и ни одна крупная поисковая система публично на него не подписалась. При этом внедрение реально, хоть и неравномерно: платформы документации вроде Mintlify генерируют файл для тысяч сайтов, его публикуют Anthropic и Cloudflare, а всё больше AI-инструментов для разработчиков запрашивают его, когда он есть.
Правильная рамка — дешёвая страховка. Файл создаётся за минуты, ничему не вредит, и если AI-ассистенты продолжат расти как источник трафика, сайты с аккуратной машиночитаемой картой окажутся в выигрышной позиции первыми. Эта асимметрия — крошечная цена против правдоподобной выгоды — и есть весь аргумент, и его достаточно. Обратное тоже верно: если кто-то обещает вам «рост трафика на N процентов от внедрения llms.txt», перед вами продавец, а не инженер.
Типичные ошибки
- Свалка из всех URL подряд. Для этого существует карта сайта. llms.txt с пятью тысячами ссылок полезен модели ровно настолько же, насколько его отсутствие. Отберите 10–30 страниц.
- Не то расположение. Файл живёт в корне:
https://yourdomain.com/llms.txt. Подкаталоги в предложение не входят, и инструменты проверяют только корень. - Отдаётся HTML. Некоторые хостинги отвечают на незнакомые пути страницей ошибки с кодом 200. AI-инструмент тогда разбирает вашу страницу 404 как описание сайта. Проверьте, что URL возвращает на самом деле.
- Расплывчатые описания. «Полезные материалы» не говорят модели ничего. «Сроки годности автокресел 14 производителей, сверенные со страницами производителей» — вот формулировка, за которую вас цитируют точно.
- Написали и забыли. Мёртвые ссылки в файле отправляют модели на страницы 404, а устаревшее описание работает против вас. Перегенерируйте файл, когда меняются ключевые страницы, — проще всего привязать это к тому же процессу, который пересобирает карту сайта.
Как создать файл за пять минут
Наш бесплатный генератор llms.txt читает карту сайта и метаданные страниц и собирает файл за вас: просмотрите результат, поправьте неудачные формулировки и загрузите его в корень, рядом с robots.txt. Затем запустите проверку AI-готовности — она подтвердит, что файл действительно доступен по нужному адресу и корректно устроен, и заодно покажет остальную AI-поверхность сайта: правила robots.txt для AI-краулеров и структурированные данные. Так вы закроете вопрос целиком, а не одним файлом. О том, как устроены все три уровня, — в руководстве по AI-готовности.