За последний год спрос на llms.txt в Яндексе вырос в два с половиной раза: в июле 2025 - 327 показов в месяц, в июне 2026 - 1027. Вместе с ним появился хвост запросов, по которому видно, что люди уже делают файл руками: генератор, валидатор, как составить, проверить. И в самом конце этого хвоста - вопрос, который стоило бы задавать первым: работает ли.
Ответ на него неудобный, поэтому начнём с механики, а потом покажем логи.
Что это за файл
Спецификация появилась осенью 2024 года на llmstxt.org, предложил её Джереми Ховард, сооснователь fast.ai. Идея простая: положить в корень сайта файл на разметке Markdown, в котором человеческим языком написано, чем занимается сайт, и перечислены главные страницы. Не полный список всех адресов, а именно выжимка - оглавление для машины, которая читает быстро и невнимательно.
Есть парная сущность - llms-full.txt, куда складывают уже не оглавление, а весь основной текст сайта одним файлом.
Формат нестрогий: заголовок первого уровня с названием, короткое описание, дальше разделы со списками ссылок. Вот наш собственный, сокращённый:
# SEENGO
> Платформа мониторинга видимости бренда в ответах нейросетей.
> Каждую неделю сервис задаёт девяти моделям реальные вопросы
> клиентов и показывает, рекомендуют ли они компанию.
## Основные страницы
- [Тарифы](https://seengo.ru/pricing): цены и состав тарифов
- [Агентствам](https://seengo.ru/agencies): white-label и партнёрская модель
- [Журнал](https://seengo.ru/blog): разборы про видимость и методику замеров
Чем он не является
Не заменой robots.txt. Тот управляет доступом, и его соблюдают. Этот ничего не разрешает и не запрещает.
Не картой сайта. Sitemap нужен для обхода всех страниц, llms.txt - наоборот, для отсечения лишнего.
Не разметкой. Schema.org отдаёт факты в формате, который разбирается программой однозначно; здесь просто текст, который модель может прочитать, а может не прочитать. Какая разметка нужна на самом деле, разобрано отдельно.
Что известно про поддержку
Публичных обязательств от поставщиков моделей нет. Google высказался прямо: Джон Мюллер, который отвечает в компании за связь с вебмастерами, в 2025 году написал, что ни одна известная ему система ИИ файл не использует, и сравнил его с мета-тегом keywords - декларацией, которую никто не читает. Остальные крупные поставщики не заявляли, что учитывают llms.txt при генерации ответов в чате.
При этом файл живёт и используется - в другом сценарии. Когда разработчик просит модель разобраться в документации библиотеки, модель идёт на сайт документации и там llms.txt действительно служит оглавлением: по нему понятно, какие страницы читать. Поэтому у крупных технических площадок такой файл есть, включая документацию самой Anthropic, и он там осмыслен.
Разница между двумя сценариями и объясняет всю путаницу. Агентское чтение документации - это когда модель приходит на конкретный сайт по конкретной задаче. Ответ на вопрос покупателя устроен иначе: модель либо отвечает по памяти, либо ищет по вебу и читает страницы, которые нашла, - и заходит она сразу на страницу, а не в корень сайта за оглавлением.
Что показали логи: 12 дней, 900 визитов, ноль запросов
Это можно не обсуждать, а посмотреть. У нас есть сайт с открытым robots.txt, файлом llms.txt в корне и логами сервера, где виден каждый запрос. Мы взяли 12 дней, с 18 по 30 августа 2026, и посчитали, кто из роботов нейросетей на сайт приходил и запрашивал ли файл.
| Робот | Запросов к сайту | Запросов к /llms.txt |
|---|---|---|
| ClaudeBot (обучение Claude) | 372 | 0 |
| GPTBot (обучение моделей OpenAI) | 273 | 0 |
| PerplexityBot (индекс Perplexity) | 78 | 0 |
| OAI-SearchBot (поиск в ChatGPT) | 59 | 0 |
| Claude-User (по запросу пользователя) | 48 | 0 |
| ChatGPT-User (по запросу пользователя) | 30 | 0 |
| Perplexity-User (по запросу пользователя) | 16 | 0 |
| Claude-SearchBot (поиск в Claude) | 11 | 0 |
| YandexBot | 1250 | 0 |
| Googlebot | 561 | 0 |
| PipericBot (сканер, назначение неизвестно) | 2 | 2 |
Роботы OpenAI, Anthropic и Perplexity всех трёх видов - сборщики для обучения, индексаторы поиска и те, что приходят за страницей во время разговора с пользователем, - сделали 887 запросов. Они читали главную, статьи, тарифы, служебные страницы. Файл llms.txt не запросил ни один. Яндекс и Google за те же дни сделали 1811 запросов и тоже к файлу не обращались. Единственный робот, который его взял, - сканер с незнакомым именем, дважды.
Мы не утверждаем, что так будет всегда и у всех. Двенадцать дней и один сайт - маленькая выборка, а поставщики могут включить поддержку в любой момент. Но на сегодня это прямое наблюдение против косвенных надежд, и оно совпадает с тем, что говорит Google. Если у вас есть логи, повторите проверку у себя: это займёт минуту и даст вам факт вместо мнения.
Из этого не следует, что файл вреден. Из этого следует порядок приоритетов. Если ради llms.txt откладывается открытие robots.txt для GPTBot или починка страницы, где текст рисуется скриптами, вы меняете работающий механизм на гипотезу. Наш аудит сайта проверяет llms.txt в числе шестнадцати сигналов готовности к ИИ-поиску - но он там не первый и не второй, и это осознанно. По 22 аудитам за август файла нет у 77% сайтов, и это самый безобидный из их провалов: у тех же сайтов автор не подписан в 86% случаев, а разметки организации нет у половины.
Как собрать за двадцать минут
Ручная сборка занимает столько же времени, сколько поиск подходящего генератора, а результат лучше.
Что писать
Первая строка - название компании заголовком. Дальше абзац-описание: чем занимаетесь, для кого, в каком городе или стране работаете, чем отличаетесь. Пишите фактами, а не рекламой: модель ищет данные, а не эпитеты.
Дальше два-три раздела со ссылками: основные страницы, документы, полезные материалы. У каждой ссылки - короткое пояснение через двоеточие, зачем эта страница. Двадцати ссылок хватает с запасом; сотня превращает выжимку обратно в свалку.
Чего не делать
Не собирать файл автоматически из карты сайта. Генераторы именно так и работают, и на выходе получается список из четырёхсот адресов без пояснений - ровно то, от чего файл должен был избавить.
Не дублировать в него весь текст сайта, если не собираетесь поддерживать актуальность. Устаревшая выжимка хуже отсутствующей: в ней остаются старые цены и снятые с продажи услуги.
Не забывать про обновление. Мы сами на этом попались: в файле висела цена тарифа, которого больше нет, и это ровно тот случай, когда машиночитаемая подсказка вводит машину в заблуждение.
Как проверить у себя
Проверить можно сегодня и без чужой помощи.
Доступность. Откройте адрес вашсайт.ру/llms.txt в браузере. Файл должен отдаваться как текст, без редиректа на главную и без вёрстки вокруг. Частая ошибка на конструкторах сайтов: платформа не даёт положить файл в корень и отвечает на этот адрес страницей-заглушкой. Если так - значит, у вас его нет, как бы ни выглядела ссылка.
Содержание. Прочитайте файл глазами и спросите себя, ответит ли по нему незнакомый человек на вопрос, чем занимается компания и куда идти за ценами. Если нет - модель тоже не ответит.
Обращения. Самая полезная проверка и единственная, которая даёт факты. Поищите в логах сервера запросы к /llms.txt и посмотрите, кто их делал: браузеры, ваш собственный мониторинг или роботы с именами вроде GPTBot и ClaudeBot. Отдельно посчитайте, сколько раз те же роботы заходили на сайт вообще, - без этого ноль запросов к файлу ничего не значит, может, роботы просто не приходили. У нас пришли 887 раз. Если за месяц к файлу не пришёл никто из них, вопрос о его влиянии на ваши ответы закрывается сам.
Что делать с этим знанием
Позиция, которую мы считаем честной: положите файл, потратьте на него двадцать минут, обновляйте раз в квартал. Это дёшево, и в сценарии, где модель приходит на сайт с задачей разобраться, файл ей поможет. Если поставщики включат поддержку, файл уже будет на месте.
Но не считайте его рычагом видимости и не платите за него отдельно. Рычаги другие и они скучнее: открытые роботы, текст без скриптов, разметка организации, свежие даты, подписанный автор, присутствие на площадках, откуда модели берут материал. Их порядок мы выстроили в отдельном разборе вместе со статистикой, где сайты проваливаются чаще всего, и llms.txt стоит там восьмым пунктом из восьми.
А проверить, читается ли ваш сайт роботами вообще, можно бесплатной проверкой по 17 маркерам - llms.txt среди них есть, но интереснее посмотреть на первые семь.
Если после проверки захочется увидеть не техническое состояние, а результат - называют ли вас модели, когда клиент спрашивает их про вашу услугу, - первый замер бесплатный: пять вопросов, девять сетей, без оплаты. Регулярный мониторинг и объёмы побольше - на странице тарифов.
Источники
- llmstxt.org - спецификация формата, Джереми Ховард, сентябрь 2024.
- Позиция Google: Джон Мюллер, публичные ответы вебмастерам, 2025; сравнение llms.txt с мета-тегом keywords.
- Перечень роботов OpenAI: platform.openai.com/docs/bots. Роботы Perplexity: docs.perplexity.ai/guides/bots.
- Логи nginx seengo.ru, 18-30.08.2026: запросы по имени робота и запросы к /llms.txt. 22 бесплатных аудита SEENGO, 20-29.08.2026.
- Частота запроса llms.txt: Яндекс Вордстат, июль 2025 и июнь 2026.
вопросы
Частые вопросы
01Что такое llms.txt простыми словами?
Текстовый файл в корне сайта, написанный на разметке Markdown: короткое описание, чем занимается компания, и список главных страниц со ссылками. Задумывался как оглавление сайта для языковых моделей - чтобы они брали суть, а не выуживали её из вёрстки.
02Нейросети действительно читают llms.txt?
Публичных подтверждений от поставщиков моделей нет, а представитель Google прямо сказал, что ни одна известная ему система его не использует. Наши логи говорят то же: за 12 дней роботы OpenAI, Anthropic и Perplexity сделали около 900 запросов к сайту и ни одного - к llms.txt. Файл запросили только два незнакомых сканера.
03Чем llms.txt отличается от robots.txt?
robots.txt управляет доступом: он разрешает или запрещает роботам обход, и его соблюдают. llms.txt ничем не управляет, он только подсказывает содержание и ни к чему не обязывает. Перепутать их дорого: закрытый robots.txt отменяет ваше присутствие в ответах, отсутствующий llms.txt - нет.
04Нужен ли генератор llms.txt?
Обычно нет. Генераторы собирают файл из карты сайта и выдают список из сотен ссылок, а смысл файла ровно противоположный - выжимка. Двадцать минут ручной работы дают лучший результат, чем автосборка.
05Как проверить, что файл работает?
Откройте его по адресу вашсайт.ру/llms.txt: он должен отдаваться напрямую, без редиректа и без обёртки в HTML. Дальше посмотрите логи сервера - запрашивал ли его хоть один робот нейросетей. Это единственная честная проверка, всё остальное про этот файл пока предположения.
