За последний год спрос на llms.txt в Яндексе вырос в два с половиной раза: в июле 2025 - 327 показов в месяц, в июне 2026 - 1027. Вместе с ним появился хвост запросов, по которому видно, что люди уже делают файл руками: генератор, валидатор, как составить, проверить. И в самом конце этого хвоста - вопрос, который стоило бы задавать первым: работает ли.
Ответ на него неудобный, поэтому начнём с механики.
Что это за файл
Спецификация появилась осенью 2024 года на llmstxt.org. Идея простая: положить в корень сайта файл на разметке Markdown, в котором человеческим языком написано, чем занимается сайт, и перечислены главные страницы. Не полный список всех адресов, а именно выжимка - оглавление для машины, которая читает быстро и невнимательно.
Есть парная сущность - llms-full.txt, куда складывают уже не оглавление, а весь основной текст сайта одним файлом.
Формат нестрогий: заголовок первого уровня с названием, короткое описание, дальше разделы со списками ссылок. Вот наш собственный, сокращённый:
# SEENGO
> Платформа мониторинга видимости бренда в ответах нейросетей.
> Каждую неделю сервис задаёт девяти моделям реальные вопросы
> клиентов и показывает, рекомендуют ли они компанию.
## Основные страницы
- [Тарифы](https://seengo.ru/pricing): цены и состав тарифов
- [Агентствам](https://seengo.ru/agencies): white-label и партнёрская модель
- [Журнал](https://seengo.ru/blog): разборы про видимость и методику замеров
Чем он не является
Не заменой robots.txt. Тот управляет доступом, и его соблюдают. Этот ничего не разрешает и не запрещает.
Не картой сайта. Sitemap нужен для обхода всех страниц, llms.txt - наоборот, для отсечения лишнего.
Не разметкой. Schema.org отдаёт факты в формате, который разбирается программой однозначно; здесь просто текст, который модель может прочитать, а может не прочитать.
Что известно про поддержку
Публичных обязательств от поставщиков моделей нет. Google высказался прямо: файл не поддерживается и планов нет - это позиция, озвученная представителями компании ещё летом 2025 года. Остальные крупные поставщики не заявляли, что учитывают llms.txt при генерации ответов в чате.
При этом файл живёт и используется - в другом сценарии. Когда разработчик просит модель разобраться в документации библиотеки, модель идёт на сайт документации и там llms.txt действительно служит оглавлением: по нему понятно, какие страницы читать. Поэтому у крупных технических площадок такой файл есть, и он там осмыслен.
Разница между двумя сценариями и объясняет всю путаницу. Агентское чтение документации - это когда модель приходит на конкретный сайт по конкретной задаче. Ответ на вопрос покупателя устроен иначе: модель либо отвечает по памяти, либо ищет по вебу и читает страницы, которые нашла, - и заходит она сразу на страницу, а не в корень сайта за оглавлением.
Из этого не следует, что файл вреден. Из этого следует порядок приоритетов. Если ради llms.txt откладывается открытие robots.txt для GPTBot или починка страницы, где текст рисуется скриптами, вы меняете работающий механизм на гипотезу. Наш аудит сайта проверяет llms.txt в числе шестнадцати сигналов готовности к ИИ-поиску - но он там не первый и не второй, и это осознанно.
Как собрать за двадцать минут
Ручная сборка занимает столько же времени, сколько поиск подходящего генератора, а результат лучше.
Что писать
Первая строка - название компании заголовком. Дальше абзац-описание: чем занимаетесь, для кого, в каком городе или стране работаете, чем отличаетесь. Пишите фактами, а не рекламой: модель ищет данные, а не эпитеты.
Дальше два-три раздела со ссылками: основные страницы, документы, полезные материалы. У каждой ссылки - короткое пояснение через двоеточие, зачем эта страница. Двадцати ссылок хватает с запасом; сотня превращает выжимку обратно в свалку.
Чего не делать
Не собирать файл автоматически из карты сайта. Генераторы именно так и работают, и на выходе получается список из четырёхсот адресов без пояснений - ровно то, от чего файл должен был избавить.
Не дублировать в него весь текст сайта, если не собираетесь поддерживать актуальность. Устаревшая выжимка хуже отсутствующей: в ней остаются старые цены и снятые с продажи услуги.
Не забывать про обновление. Мы сами на этом попались: в файле висела цена тарифа, которого больше нет, и это ровно тот случай, когда машиночитаемая подсказка вводит машину в заблуждение.
Как проверить у себя
Проверить можно сегодня и без чужой помощи.
Доступность. Откройте адрес вашсайт.ру/llms.txt в браузере. Файл должен отдаваться как текст, без редиректа на главную и без вёрстки вокруг. Частая ошибка на конструкторах сайтов: платформа не даёт положить файл в корень и отвечает на этот адрес страницей-заглушкой. Если так - значит, у вас его нет, как бы ни выглядела ссылка.
Содержание. Прочитайте файл глазами и спросите себя, ответит ли по нему незнакомый человек на вопрос, чем занимается компания и куда идти за ценами. Если нет - модель тоже не ответит.
Обращения. Самая полезная проверка и единственная, которая даёт факты. Поищите в логах сервера запросы к /llms.txt и посмотрите, кто их делал: браузеры, ваш собственный мониторинг или роботы с именами вроде GPTBot и ClaudeBot. Если за месяц к файлу не пришёл никто, вопрос о его влиянии на ваши ответы закрывается сам.
Что делать с этим знанием
Позиция, которую мы считаем честной: положите файл, потратьте на него двадцать минут, обновляйте раз в квартал. Это дёшево, и в сценарии, где модель приходит на сайт с задачей разобраться, файл ей поможет.
Но не считайте его рычагом видимости и не платите за него отдельно. Рычаги другие и они скучнее: открытые роботы, текст без скриптов, разметка организации, свежие даты, присутствие на площадках, откуда модели берут материал. Их порядок мы выстроили в отдельном разборе, и llms.txt стоит там восьмым пунктом из восьми.
А проверить, читается ли ваш сайт роботами вообще, можно бесплатной проверкой по 39 маркерам - llms.txt среди них есть, но интереснее посмотреть на первые семь.
Если после проверки захочется увидеть не техническое состояние, а результат - называют ли вас модели, когда клиент спрашивает их про вашу услугу, - первый замер бесплатный: пять вопросов, девять сетей, без оплаты. Регулярный мониторинг и объёмы побольше - на странице тарифов.
Источники
- llmstxt.org - спецификация формата.
вопросы
Частые вопросы
01Что такое llms.txt простыми словами?
Текстовый файл в корне сайта, написанный на разметке Markdown: короткое описание, чем занимается компания, и список главных страниц со ссылками. Задумывался как оглавление сайта для языковых моделей - чтобы они брали суть, а не выуживали её из вёрстки.
02Нейросети действительно читают llms.txt?
Публичных подтверждений от поставщиков моделей нет, а Google прямо заявил, что файл не поддерживает. Известный работающий сценарий другой: модель обращается к нему, когда её просят разобраться в документации сайта. Для маркетингового сайта это гипотеза, а не механизм.
03Чем llms.txt отличается от robots.txt?
robots.txt управляет доступом: он разрешает или запрещает роботам обход, и его соблюдают. llms.txt ничем не управляет, он только подсказывает содержание и ни к чему не обязывает. Перепутать их дорого: закрытый robots.txt отменяет ваше присутствие в ответах, отсутствующий llms.txt - нет.
04Нужен ли генератор llms.txt?
Обычно нет. Генераторы собирают файл из карты сайта и выдают список из сотен ссылок, а смысл файла ровно противоположный - выжимка. Двадцать минут ручной работы дают лучший результат, чем автосборка.
05Как проверить, что файл работает?
Откройте его по адресу вашсайт.ру/llms.txt: он должен отдаваться напрямую, без редиректа и без обёртки в HTML. Дальше посмотрите логи сервера - запрашивал ли его хоть один робот. Это единственная честная проверка, всё остальное про этот файл пока предположения.
