llms.txt – текстовый файл в корне сайта, в котором для языковых моделей описано, что это за сайт, чем занимается компания и где лежат главные страницы. Формат предложил Джереми Ховард из Answer.AI в сентябре 2024 года. robots.txt отвечает на вопрос "куда боту можно заходить", llms.txt –"что на сайте важно и где это найти". Файл занимает 20–60 строк и составляется за 1–2 часа. Ниже пример файла, 5 частых ошибок и 3 бота, которых нужно пустить в robots.txt, потому что без доступа краулера llms.txt никто не прочитает.
Чем llms.txt отличается от robots.txt и sitemap.xml
Три файла в корне сайта решают три разные задачи. robots.txt ограничивает доступ, sitemap.xml перечисляет адреса для индексации, llms.txt объясняет модели структуру и смысл сайта обычным языком.
| Файл | Для кого | Формат | Что делает | Обязателен |
|---|
| robots.txt | все краулеры, включая YandexAdditional и GPTBot | директивы User-agent, Disallow, Allow | разрешает или запрещает обход разделов | да, без него боты обходят всё |
| sitemap.xml | поисковые роботы | XML со списком адресов | сообщает, какие страницы индексировать и когда они обновлялись | нужен сайтам от 50 страниц |
| llms.txt | языковые модели и ИИ-агенты | Markdown: заголовок, описание, списки ссылок | описывает сайт и указывает на ключевые страницы | нет, добровольный стандарт |
llms.txt не управляет доступом. Если GPTBot закрыт в robots.txt, он не дойдёт до llms.txt. Если он открыт, llms.txt помогает ему понять, какие 10–30 страниц из 500 отвечают на вопросы о компании.
Какие модели читают llms.txt
На сентябрь 2026 года ни Яндекс, ни OpenAI, ни Google публично не подтверждали, что их краулеры читают llms.txt при обходе. Файл читают
ИИ-агенты и инструменты, которые запрашивают его напрямую: платформы документации для разработчиков, агенты на базе
ChatGPT и Claude в режиме браузинга, когда пользователь просит изучить сайт, парсеры, которые выгружают данные для ответов.
Из этого следует оценка. llms.txt не поднимет сайт в источники
Алисы сам по себе: Алиса и Яндекс Нейро берут кандидатов из поискового индекса, поэтому сайт, оптимизированный под классическую поисковую выдачу, имеет больше шансов на оперативный вывод в нейроответы; исследования показывают, что Google берёт источники и из ТОП-40. Файл занимает час работы, ничего не ломает и даёт агентам готовую карту сайта, поэтому его ставят в дополнение к открытому robots.txt и разметке Schema.org.
Структура файла: заголовок, описание, разделы со ссылками
Формат llms.txt – Markdown с четырьмя частями. Заголовок H1 с названием сайта или компании. Цитата в одну-две строки с описанием: кто, где, с какого года, что делает. Разделы H2 со списками ссылок в формате"
Название страницы: одно предложение о том, что на странице ". Необязательный раздел" Optional" со второстепенными страницами, которые агент может пропустить.
В описании нужны факты, которые модель сможет привести в ответе: город, год основания, направления работы, ниши, контакты. Формулировки про подход и ценности из описания убираются: агент их не использует.
В списки ссылок попадают страницы, которые отвечают на вопросы клиентов: направления работы, страницы с условиями и сроками, кейсы, ответы на вопросы, контакты, страница автора или врача. Каталог на 2 000 карточек в llms.txt не переносится: для него есть sitemap.xml.
Пример llms.txt для клиники в Екатеринбурге
``` # Клиника "Пример", Екатеринбург
> Многопрофильная клиника в Екатеринбурге, работает с 2012 года. > 4 филиала, 60 врачей, 28 направлений: стоматология, гинекология, > УЗИ, лабораторные анализы. Приём по ОМС и ДМС. Телефон +7 343 000-00-00.
## Направления
- Имплантация зубов: стоимость от 45 000 ₽ с коронкой, срок 3–4 месяца, импланты Osstem и Straumann
- УЗИ: 32 вида исследований, результат в день приёма
- Анализы: 400 видов, срок готовности от 1 дня
## Врачи
## Вопросы и ответы
## Контакты
## Optional
```
Файл занимает 25 строк. Каждая строка со ссылкой содержит факт: стоимость, срок, количество. Агент, который получил этот файл, отвечает на вопрос "сколько стоит имплантация в клинике Пример" без обхода 300 страниц сайта.
Шесть шагов: от robots.txt до проверки адреса
Откройте вашсайт.ru/robots.txt и проверьте директивы для YandexAdditional, GPTBot и Google-Extended. Если для бота стоит Disallow: /, снимите запрет. Проверьте результат в Яндекс Вебмастере: Инструменты → Анализ robots.txt
Выпишите 10–30 страниц, которые отвечают на вопросы клиентов: направления, условия, кейсы, ответы на вопросы, контакты, авторы. Источник списка – отчёт "Страницы в поиске" в Вебмастере и отчёт "Страницы входа" в Метрике за 3 месяца
Напишите описание в 2–3 строки: город, год, направления, масштаб в цифрах, контакты
К каждой ссылке добавьте одно предложение с фактом: стоимость, срок, количество, технология
Сохраните файл в кодировке UTF-8 под именем llms.txt в корне сайта, чтобы он открывался по адресу вашсайт.ru/llms.txt и отдавался как text/plain или text/markdown. На сайтах с конструктором файл загружается через настройки сайта или раздел загрузки файлов, у каждой платформы свой
Откройте адрес в браузере и проверьте, что сервер отдаёт чистый текст файла
Страница 404 или HTML-страница сайта с меню вместо текста означают, что файл лежит не там. Поставьте дату обновления в конце файла и повторяйте проверку при каждом изменении структуры.
Три бота, которых надо пустить в robots.txt
| Бот | Владелец | Зачем нужен доступ | Строки в robots.txt |
|---|
| YandexAdditional | Яндекс | выгружает контент для ответов Алисы и Яндекс Нейро | User-agent: YandexAdditional, Allow: / |
| GPTBot | OpenAI | обходит сайты для ChatGPT и его режима поиска | User-agent: GPTBot, Allow: / |
| Google-Extended | Google | управляет использованием контента в ИИ-функциях Google | User-agent: Google-Extended, Allow: / |
Правило для каждого бота пишется отдельным блоком. Если в файле есть блок User-agent: * с Disallow для служебных разделов, эти же Disallow повторяются и в блоках трёх ботов: личный кабинет, корзина, результаты поиска по сайту остаются закрытыми для всех.
Пять частых ошибок в llms.txt
Файл есть, боты закрыты
В robots.txt стоит Disallow: / для User-agent: * без исключений для YandexAdditional и GPTBot. Краулер не доходит до llms.txt. Проверка: Анализ robots.txt в Вебмастере по адресу /llms.txt для YandexAdditional.
В файл скопирован sitemap.xml
800 ссылок без описаний. Агент не понимает, с чего начать, и файл теряет смысл. Норма – 10–30 ссылок с одним предложением по каждой.
Описание вместо фактов
"Мы заботимся о каждом пациенте и используем современные технологии" не даёт агенту ничего. Нужны город, год, количество филиалов, направления, стоимость и сроки.
Ссылки на страницы, которых агент не увидит: закрытые noindex, доступные только после авторизации, отдающие 404 после переезда, разработанные на JavaScript без серверного рендера. Проверка: каждый адрес из файла открыть с отключённым JavaScript
Файл не в корне или не в текстовом формате
Загружен как /files/llms.txt, сохранён в .docx или отдаётся сервером как HTML-страница с меню и подвалом. Агент ищет строго /llms.txt и ждёт текст.
Короткие ответы
Обязателен ли llms.txt
Нет. Это предложение сообщества, а не требование поисковых систем. Ни Яндекс, ни Google не заявляли, что учитывают его при формировании ответов.
Делать его стоит по остаточному принципу: час работы, вреда нет, эффект не гарантирован.
Заменяет ли llms.txt sitemap.xml или robots.txt
Нет, это три разных файла с разными задачами. robots.txt управляет доступом роботов, sitemap.xml перечисляет адреса для индексации, llms.txt пытается объяснить смысл сайта языковым моделям.
Первые два обязательны и влияют на индексацию. Третий необязателен.
Что делать, если мы не хотим, чтобы нас использовали нейросети
Доступ краулеров ИИ-сервисов закрывается директивами в robots.txt по именам их user-agent. Это обратная задача, и она решаема.
Стоит понимать последствия: закрывшись, вы исчезаете из ответов, которые сейчас приводят на сайт людей с готовым вопросом.
Если нужна техническая база целиком
Lucky Agents – агентство SEO и продвижения в нейросетях. Составляем llms.txt, открываем доступ трём ботам, ставим разметку Schema.org и проверяем, что краулеры видят контент без JavaScript, в срок 2–3 недели:
техническая база под нейросети. Юлия Кожевникова, сооснователь, маркетолог LA