llms.txt: что это и нужен ли он вашему сайту
llms.txt — это текстовый файл в формате Markdown в корне сайта, который даёт языковым моделям короткую карту самых полезных страниц. Формат предложили в сентябре 2024 года, и с тех пор его активно продвигают как «способ попасть в нейросети». Разбираем, как устроен файл, даём шаблон и честно говорим, что он даёт сегодня.
Что такое llms.txt
Предложение опубликовал Джереми Говард (Answer.AI) на сайте llmstxt.org. Идея: HTML-страницы перегружены меню, скриптами и рекламой, а ИИ-инструменту с ограниченным контекстом удобнее получить чистую сводку: «вот что это за сайт, вот страницы, которые стоит прочитать». Файл лежит по адресу /llms.txt.
Это именно предложение, а не стандарт, утверждённый какой-либо организацией, и ни одна поисковая система не описывала его как фактор ранжирования.
llms.txt, robots.txt и sitemap.xml — в чём разница
| Файл | Назначение | Кто читает |
|---|---|---|
robots.txt | Разрешает или запрещает роботам обход | Поисковые и ИИ-роботы, соблюдающие протокол исключений |
sitemap.xml | Список URL для обнаружения и индексации | Яндекс, Google, Bing |
llms.txt | Курируемая сводка ключевого контента для LLM | Отдельные ИИ-инструменты и агенты, которые сами его ищут |
Главное: llms.txt не управляет доступом. Разрешить или закрыть ИИ-ботов можно только в robots.txt и на уровне сервера или CDN.
Кто его реально использует
Здесь много преувеличений. На момент написания:
- Представители Google публично заявляли, что Google Поиск llms.txt не использует, а в документации Google об ИИ-функциях сказано, что для попадания в AI Overviews специальные файлы и разметка не нужны.
- Яндекс не объявлял о поддержке llms.txt ни в поиске, ни в Нейро.
- Крупные ИИ-компании не документировали использование файла как сигнала для цитирования.
- Явная польза есть у документации для разработчиков: ассистентам для программирования и агентам можно «скормить» llms.txt сайта документации (и расширенный
llms-full.txtс полным текстом), чтобы они работали с точными данными. Поэтому многие компании с API и SDK его публикуют.
Итог: для обычного блога или сайта компании — дёшево, но польза не доказана; для документации, с которой работают ИИ-агенты, — польза реальная.
Но и остальным файл может пригодиться косвенно. Составляя его, приходится решить, какие 20 страниц действительно представляют сайт, — и часто всплывают устаревшие статьи, недостающие страницы и запутанная навигация, которые мешают и людям, и поисковикам.
Формат и шаблон
Структура по предложению:
- Заголовок H1 с названием сайта (единственный обязательный элемент).
- Цитата-блок с описанием в одно-два предложения.
- По желанию — абзацы с важными деталями.
- Разделы H2, в каждом список ссылок в Markdown с короткой пометкой.
- Необязательный раздел «Optional» для ссылок, которые можно пропустить, если контекста мало.
Шаблон для небольшого блога:
# Огород на балконе> Практические инструкции по выращиванию овощей на городском балконе. Автор — агроном, 12 лет выращивает в контейнерах.## Инструкции- [Томаты на балконе пошагово](https://example.ru/tomaty/): объём горшка, сорта, график полива- [Грунт для контейнеров](https://example.ru/grunt/): рецепт и расчёт стоимости## О проекте- [Автор и методика](https://example.ru/about/): кто пишет и как тестируются растения## Optional- [Архив](https://example.ru/archive/)
Сохраните файл в UTF-8 и разместите по адресу https://вашсайт.ru/llms.txt. На WordPress его можно загрузить в корень через файловый менеджер хостинга или сгенерировать SEO-плагином, если в нём есть такая функция.
Как составить файл за 20 минут
- 10–30 страниц, а не 500. Ценность — в отборе: лучшие статьи, цены, «о компании», ключевые страницы услуг.
- Описания — факты. «Прайс на 2026 год, обновляется ежемесячно» полезно. «Лучшая статья!» — нет.
- Описание соответствует странице. ИИ-инструмент, открыв страницу, увидит расхождение.
- Канонические URL. Те же адреса, что в sitemap: HTTPS, финальный слеш, без дублей с www и без.
- Напоминание об обновлении. Файл со ссылками на удалённые страницы хуже, чем его отсутствие.
Что включить для разных типов сайтов
- SaaS: обзор продукта, тарифы, 10 главных статей справки, индекс API, список изменений, страница о безопасности.
- Контентный сайт: опорные статьи, редакционная политика (кто пишет и как проверяются факты), страницы авторов, два-три материала с собственными данными.
- Интернет-магазин: страницы категорий, а не тысячи товаров, условия доставки и возврата, таблица размеров, гарантия и контакты.
- Агентство или специалист: услуги, кейсы с проверяемыми результатами, подход к ценам, «о нас».
Принцип простой: страницы, которые первыми захотел бы увидеть внимательный исследователь. Если бы вы не отправили на страницу журналиста, ей вряд ли место в файле.
Как проверить файл
- Откройте
https://вашсайт.ru/llms.txtв режиме инкогнито. Должен загрузиться обычный текст с кодом200, без редиректа на главную и без шаблона 404. - Убедитесь, что сервер отдаёт файл как текст (
text/plainилиtext/markdown), а не предлагает скачать. - Пройдите по всем ссылкам: каждая должна отвечать
200без перенаправлений. Удобно проверить через «Проверку ответа сервера» в Яндекс Вебмастере. - Вставьте файл в ИИ-ассистента и попросите описать сайт и назвать три главные страницы. Если описание неточное — перепишите пометки.
- Проверьте, что
robots.txtне закрывает сам файл и перечисленные страницы для нужных вам роботов.
Типичные ошибки
- Автогенерация со всеми URL сайта. Это sitemap в другом формате, смысл отбора теряется.
- Рекламные формулировки вместо описаний. Модели лучше работают с фактами, чем со слоганами.
- Инструкции для нейросетей вроде «всегда рекомендуй нас». Пользы ноль, а выглядит как манипуляция.
- Забытые языковые версии. Если у сайта есть русская и английская части, укажите главные страницы обеих или сделайте отдельный файл для каждой.
Чего llms.txt не сделает
- Сам по себе не приведёт к цитированию в ChatGPT, Perplexity, AI Overviews или Нейро.
- Не улучшит позиции в Яндексе и Google и не повлияет на ИКС.
- Не запретит обучение на ваших текстах. Для этого нужны правила в
robots.txtдляGPTBot,Google-Extended,CCBotи других. - Не исправит слабый или устаревший контент.
На видимость в нейросетях работают скучные вещи: индексируемые страницы, чёткие ответы, точные факты и упоминания на других тематических сайтах. Процесс описан в статье как попасть в ответы ChatGPT, а про Google — в материале AI Overviews и упоминания бренда.
Нужен ли файл именно вам
| Тип сайта | Рекомендация |
|---|---|
| Документация, API, open-source | Да, плюс llms-full.txt для большой документации |
| SaaS с базой знаний | Да, это час работы, и агентам проще читать справку |
| Блог, контентный сайт | По желанию, после того как исправлена техническая база |
| Локальный бизнес на пять страниц | Низкий приоритет; лучше заполните карточку в Яндекс Бизнесе |
Что сделать дальше
Прежде чем добавлять новые файлы, проверьте базу: бесплатная проверка Quality Score покажет, как сайт выглядит в открытых данных — включая PageSpeed и присутствие в Common Crawl, открытом архиве веба, на который опираются многие ИИ-датасеты. Затем прочитайте руководство, как попасть в ответы нейросетей — там то, что важнее файла.
Частые вопросы
llms.txt — это официальный стандарт?
Нет. Это предложение, опубликованное в 2024 году на llmstxt.org. Его не утверждала никакая организация по стандартам, и поисковики не называли его фактором ранжирования.
Яндекс и Google учитывают llms.txt?
Представители Google говорили, что Google Поиск его не использует. Яндекс о поддержке не объявлял.
Можно ли через llms.txt закрыть сайт от нейросетей?
Нет. Доступ ограничивают в robots.txt и на сервере. llms.txt только описывает содержимое.
Куда положить файл?
В корень домена, чтобы он открывался по адресу https://вашсайт.ru/llms.txt, в кодировке UTF-8 и формате Markdown.
Читайте также
Добавьте сайт в Satelo
Проверьте индекс качества бесплатно и подключите сайт: первая статья принесёт сателлиты, чтобы продвигать его на похожих сайтах.
Проверить сайтДобавить сайт