llms.txt: что это за файл, нужен ли он и как его составить
Сергей Карасев из Латакии, Сооснователь / CTO
Почти каждый второй владелец сайта, которому мы проводим GEO-аудит, спрашивает одно и то же: «Нам уже сказали сделать llms.txt. Это что за файл и правда ли без него нейросети нас не видят?» Вопрос понятный. Про llms.txt пишут как про волшебную кнопку для попадания в ChatGPT, генераторы обещают сделать всё за минуту, а конкретики мало.
Коротко: llms.txt — это текстовая «визитка» сайта для языковых моделей. Она полезна, но не волшебна. Ниже разберём, что это за файл, откуда он взялся, что в него писать, чем от него отличается llms-full.txt, стоит ли доверять генераторам, как разместить файл на Tilda и 1С-Битрикс и как проверить, что всё работает.
Главное
llms.txt — краткая «визитка» сайта для языковых моделей. Крупные нейросети официально не подтверждали, что им пользуются, но файл делается за час и наводит порядок в фактах о компании.
Сначала о главном: как нейросеть читает ваш сайт
Когда человек спрашивает у ChatGPT, Алисы AI, Perplexity или Gemini «какую CRM выбрать для небольшого отдела продаж», он получает ответ нейросети. Это готовый связный текст с рекомендациями, а часто и со ссылками на сайты, из которых взята информация. В Яндексе и Google такой ответ показывается прямо над обычными результатами поиска, в чат-ботах — в окне диалога со сносками. Многие дальше этого ответа не идут.
Чтобы составить ответ, нейросеть ищет подходящие страницы, открывает их и вытаскивает смысл. Обычная веб-страница для машины неудобна: меню, баннеры, всплывающие окна, скрипты, повторяющиеся блоки. Нужный факт тонет в обвязке, а у модели ограничено время и объём текста, который она может обработать. Отсюда и появилась идея дать ей чистую выжимку.
llms.txt — что это такое
Если коротко ответить на вопрос «llms txt что это», то файл llms.txt — это обычный текстовый документ в формате Markdown. Он лежит в корне сайта и открывается по адресу вида example.com/llms.txt. Внутри кратко описано, что это за компания или проект, и перечислены ссылки на самые важные страницы, к каждой добавлена строка пояснения. Смысл простой: языковой модели не нужно разбираться в устройстве сайта, всё главное собрано в одном месте.
Формат предложили в 2024 году как открытую инициативу. Здесь важно быть честными: это не официальный стандарт, и крупные нейросети официально не подтверждали, что используют llms.txt, когда формируют ответы. Файл не гарантирует попадания в ответы ChatGPT или Алисы AI, и подрядчик, который это обещает, вводит вас в заблуждение.
Почему мы всё равно его делаем:
- Это дёшево. На нормальный файл для сайта услуг уходит один-два часа.
- Это безопасно. Файл ничему не мешает и не влияет на обычную индексацию.
- Это наводит порядок. Чтобы написать llms.txt, нужно ответить на вопросы «кто мы, что продаём, какие страницы главные». У многих компаний этих ответов в готовом виде нет.
- Им пользуются. Файл читают ИИ-инструменты для разработчиков и агенты, которые ходят по сайтам. Если крупные сервисы начнут его учитывать, у вас он уже будет.
Чем llms.txt отличается от robots.txt и sitemap.xml
Эти три файла часто путают, хотя задачи у них разные.
| Файл | Для кого | Что делает | Статус |
|---|---|---|---|
| robots.txt | Все роботы | Говорит, куда можно заходить, а куда нельзя | Общепринятый стандарт |
| sitemap.xml | Поисковые роботы | Перечисляет все страницы для индексации | Общепринятый стандарт |
| llms.txt | Языковые модели и ИИ-агенты | Объясняет смысл: кто вы и какие страницы главные | Предложенный формат, официально не подтверждён крупными нейросетями |
| llms-full.txt | Языковые модели и ИИ-агенты | Даёт полный текст ключевых материалов в одном файле | Расширение того же формата |
Главное следствие: llms.txt ничего не разрешает и не запрещает. Если robots.txt или защита сервера не пускает ИИ-роботов, аккуратный llms.txt бесполезен, потому что до него просто не дойдут. Сначала откройте доступ, об этом наша статья про GPTBot, YandexBot и других AI-краулеров.
Что написать в файле llms.txt
Формат рассчитан на то, чтобы его одинаково легко читали человек и машина. Базовая структура такая:
- Заголовок первого уровня — название компании или проекта. Это единственный обязательный элемент.
- Цитата-описание в одну-три строки: чем занимаетесь, для кого, где работаете.
- Короткий абзац с фактами: год основания, регион, ключевые условия.
- Разделы второго уровня: «Услуги», «Цены», «О компании», «Частые вопросы», «Контакты».
- Ссылки в разделах: название страницы, адрес и одна строка о том, что на ней.
- Раздел «Дополнительно» для второстепенных страниц, которые можно пропустить, если объём ограничен.
Пример файла llms.txt
Ниже условный пример для вымышленной компании, которая монтирует вентиляцию. Названия, адреса и цифры придуманы. Подставьте свои данные из реестра фактов о компании.
# ВентМонтаж
> Проектирование и монтаж вентиляции и кондиционирования для кафе, ресторанов и офисов. Работаем по Ярославлю и области с 2010 года.
Выезд инженера и замеры бесплатно. Монтаж под ключ, гарантия на работы 3 года. Цены на сайте указаны без учёта оборудования.
## Услуги
- [Вентиляция для кафе и ресторанов](https://example.com/uslugi/ventilyaciya-kafe): проект, монтаж, согласование, сроки и цены
- [Кондиционирование офисов](https://example.com/uslugi/kondicionirovanie-ofisa): подбор оборудования, монтаж, обслуживание
- [Сервисное обслуживание](https://example.com/uslugi/servis): регламент, стоимость договора, выезд при аварии
## Цены
- [Прайс-лист](https://example.com/ceny): стоимость проектирования и монтажа по площади помещения
## О компании
- [О компании](https://example.com/o-kompanii): реквизиты, лицензии, команда, год основания
- [Кейсы](https://example.com/kejsy): выполненные объекты с фото и описанием задач
## Частые вопросы
- [FAQ](https://example.com/faq): нужен ли проект, сколько длится монтаж, что входит в гарантию
## Контакты
- [Контакты](https://example.com/kontakty): адрес офиса, телефон, часы работы
## Дополнительно
- [Блог](https://example.com/blog): статьи о выборе оборудования и нормах для общепита
Обратите внимание, чего в примере нет. Нет лозунгов вроде «лидер рынка» и «лучшее качество». Нет всех страниц подряд: для этого есть sitemap.xml. Нет служебных разделов, корзины и личного кабинета. Только то, что нужно, чтобы понять компанию и ответить на вопросы клиента.
Правила, которые чаще всего нарушают
- ссылки ведут на канонические адреса с https, без UTM-меток и редиректов;
- факты совпадают с сайтом, картами и справочниками: те же цены, те же адреса, то же название;
- описание к ссылке объясняет содержание страницы, а не повторяет её заголовок;
- файл сохранён в кодировке UTF-8, иначе кириллица превратится в набор знаков;
- файл обновляется вместе с сайтом: поменялся прайс или появилась услуга — поправьте llms.txt.
llms-full.txt: когда нужен полный вариант
У формата есть расширение — llms-full.txt. Если llms.txt похож на оглавление со ссылками, то llms full txt представляет собой сам текст: содержимое ключевых страниц, собранное в один документ Markdown. Модели не нужно переходить по ссылкам, всё уже внутри.
Изначально такой вариант придумали для документации программных продуктов, где разработчику или ИИ-ассистенту нужно за раз «загрузить» описание всего API. Для сайта услуг он нужен реже. Вот когда он имеет смысл:
- у вас сложный продукт с документацией, инструкциями, тарифами и ограничениями;
- важные тексты разбиты на много коротких страниц, и по отдельности они теряют смысл;
- у сайта есть техническая база знаний, которой пользуются клиенты.
Главный риск llms-full.txt в том, что он устаревает. Это вторая копия контента, и если её не собирать автоматически при каждом обновлении сайта, через пару месяцев в ней окажутся старые цены. Для обычного сайта компании хватит аккуратного llms.txt.
Генератор llms txt: экономит время, но не думает за вас
Есть онлайн-сервисы, плагины для CMS и скрипты, которые обходят сайт и собирают llms.txt автоматически. Генератор помогает быстро получить черновик, особенно на большом сайте. Но у автоматического результата типичные проблемы:
- В файле всё подряд. Теги, фильтры, страницы пагинации, архивы новостей — генератор не знает, что для вас главное.
- Описания взяты из метатегов. Если description на сайте написан под поисковик пятнадцать лет назад, в llms.txt окажется он.
- Нет фактов о компании. Регион, условия, год основания генератор сам не придумает, а если придумает, будет хуже.
- Файл не обновляется. Разовая генерация через полгода расходится с сайтом.
Наш подход: генератор используем для черновика на крупных сайтах, дальше оставляем 15–40 действительно важных ссылок, пишем описание и факты вручную и сверяем их с реестром фактов о компании.
Как разместить llms.txt на сайте
Файл должен открываться строго по адресу example.com/llms.txt, не в подпапке и не на поддомене. Способ зависит от платформы.
Свой сайт на хостинге или сервере
Загрузите файл в корневую папку сайта, туда же, где лежат robots.txt и index.php, через FTP, SSH или файловый менеджер хостинга. Если сайт на фреймворке с отдельной публичной папкой, кладите файл в неё.
1С-Битрикс
Положите файл в корень сайта через FTP или раздел управления структурой сайта в административной панели. Если в одной установке Битрикса несколько сайтов на разных доменах, у каждого своя корневая папка, и файл нужен в каждой, со своим содержимым. Проверьте, что правила обработки адресов и модули кеширования не перехватывают запрос к llms.txt и не отдают вместо него страницу 404 шаблона.
Tilda
На Tilda нет прямого доступа к файлам в корне сайта, и возможности зависят от тарифа и текущих настроек платформы, которые периодически меняются. Сначала проверьте в настройках проекта, можно ли добавить свой файл в корень. Если нельзя, есть обходные пути: отдавать файл через собственный сервер или прокси на вашем домене либо экспортировать проект и разместить его на своём хостинге. Решение зависит от того, как устроен ваш проект, поэтому здесь лучше посоветоваться с тем, кто ведёт сайт.
WordPress и другие CMS
Для популярных CMS есть плагины, которые создают llms.txt, но результат нужно проверять руками по тем же правилам, что и у генераторов. Надёжнее всего загрузить готовый файл в корень вручную.
llms txt в robots txt: нужно ли что-то прописывать
Нет. Специальной директивы для llms.txt в robots.txt не существует. Файл находят по стандартному адресу, так же как сам robots.txt находят по адресу example.com/robots.txt. Но robots.txt всё равно стоит открыть и проверить две вещи. Во-первых, он не запрещает ИИ-роботам доступ к сайту, которым вы хотите его показать. Во-вторых, в нём нет общего запрета на файлы с расширением txt, такое иногда встречается в старых шаблонах.
Как проверить, что llms.txt работает
После размещения пройдите этот короткий список:
- адрес example.com/llms.txt открывается в браузере в режиме инкогнито, без авторизации и редиректов;
- сервер отвечает кодом 200 (посмотреть можно во вкладке «Сеть» инструментов разработчика);
- файл показывается как текст, кириллица читается нормально, браузер не предлагает его скачать;
- все ссылки внутри открываются и отвечают кодом 200;
- защита сервера или CDN не блокирует запросы роботов к файлу — это видно по журналам сервера;
- после публикации в журналах сервера видно, какие роботы запрашивали файл.
Последний пункт — единственный честный способ понять, читает ли кто-то ваш llms.txt. Спросить у нейросети «ты читала мой llms.txt?» бесполезно: такой ответ ничего не доказывает.
Что llms.txt даёт, а что нет
Давайте без иллюзий. Файл сам по себе не выведет компанию в ответы нейросетей. Если на сайте нет страниц, которые прямо отвечают на вопросы клиентов, если текст подгружается скриптами, если о компании никто не пишет на внешних площадках, llms.txt ничего не изменит. Нейросети опираются прежде всего на поиск, содержание страниц и авторитет источника. GEO — это надстройка над старым добрым SEO, а не набор служебных файлов.
Зато в связке с остальной работой llms.txt становится полезной деталью: аккуратной выжимкой фактов, которая совпадает с сайтом, разметкой и внешними источниками. Где он стоит в общей картине, видно в нашем чек-листе оптимизации сайта под нейросети: это пятый пункт из тридцати.
Как мы делаем llms.txt и всё, что вокруг
«Продвижение в нейросетях» продвигает сайты с 2002 года. У нас 100+ клиентов в России и по всему миру, сертификаты Яндекса и Google и полный комплекс работ по сайту и продвижению из одних рук. Мы работаем со всеми нейросетями, не только с Яндексом, для компаний в Латакии, по всей России и на международных рынках.
llms.txt мы составляем и размещаем в рамках технических изменений на сайте, но это лишь одна из задач. Услуга включает:
- GEO-аудит сайта и ответов нейросетей;
- сбор ИИ-ядра — вопросов, которые клиенты задают нейросетям;
- технические изменения: доступ ИИ-роботов, llms.txt, разметка, скорость, исправление ошибок;
- создание нового контента под нейроответы;
- наращивание упоминаний компании на внешних площадках;
- создание и публикацию статей во внешних источниках для рейтинга компании и её экспертов;
- регулярный мониторинг ответов ИИ.
Нейросеть оценивает сайт целиком, поэтому мы сразу берём его на комплексное обслуживание, от технических правок до GEO-продвижения. Гарантируем исполнение задач по GEO-оптимизации, исправление ошибок и быструю адаптацию сайта под меняющиеся требования нейросетей. Место в ответе ИИ не обещаем: такое честно не обещает никто.
Абонентская плата — 8 900 ₽ в месяц, в неё входят первые 10 часов работы специалиста. Каждый следующий час стоит 1 800 ₽. Работы по GEO оплачиваются по факту (time & material): сколько сделали и сдали за месяц, столько и выставляем. Скидок и бесплатных периодов нет.
Запишитесь на звонок. Проверим, видят ли нейросети ваш сайт, составим llms.txt по фактам и покажем, что ещё мешает попасть в ответы.