Запрос про оптимизацию сайта под нейросети собрал за август 249 показов, и почти треть из них - с намерением заказать. Спрос понятный, а вот что именно нужно менять, обычно объясняют туманно: добавьте структурированные данные, пишите для людей, делайте полезный контент.
Ниже - конкретный список. Он взят из нашей проверки сайта: 23 сигнала отвечают за обычную поисковую видимость, ещё 16 - за то, как сайт читают роботы нейросетей. Про эти 16 и речь.
Группа первая: вас вообще пускают
Роботы GPTBot, ClaudeBot, PerplexityBot и Google-Extended собирают материал для моделей. Если в robots.txt стоит запрет, сайт физически не попадает ни в обучение, ни в веб-поиск чата. Запрет часто оказывается там случайно: приехал с плагином, остался с прошлого редизайна, добавлен разработчиком из общих соображений безопасности.
Здесь же живёт скучная пара сигналов, которые ломают всё тихо: случайный noindex на важных страницах и недоступный robots.txt, отдающий пятисотую ошибку.
Решение принимается один раз и осознанно: либо вы хотите, чтобы модели вас цитировали, и открываете доступ, либо закрываетесь и тогда не удивляетесь отсутствию в ответах.
Группа вторая: есть что читать
Большинство сборщиков забирает исходный HTML и не выполняет JavaScript. Сайт, где текст подставляется на клиенте, для них пуст - цитировать нечего. Проверка занимает минуту: откройте исходный код страницы и поищите в нём свой первый абзац.
Рядом - три сигнала помельче, но того же свойства. Семантическая вёрстка: теги main, article, section, nav показывают, где основной текст, а где обвязка; без них страница выглядит однородным супом из div. Структура ответа: подзаголовки, списки и таблицы дают модели готовый фрагмент, а сплошное полотно приходится разбирать. Внутренние ссылки: по ним роботы находят остальные страницы, и тонкий одноэкранник почти без ссылок остаётся наполовину неизвестным.
Группа третья: факты в машиночитаемом виде
Дальше начинается то, что отличает подготовленный сайт от обычного. Модель не обязана вычитывать факты о компании из прозы - их можно отдать напрямую, разметкой Schema.org.
Минимальный набор такой. Карточка организации с типом Organization или LocalBusiness - иначе данные есть, а понимания, что перед ним компания, у робота нет. Заполненность карточки: название, адрес сайта, логотип, контакты. Ссылки sameAs на профили в соцсетях, картах и каталогах - по ним модель понимает, что компания из карточки, компания с карты и компания из отзыва - одна и та же. Тип страницы WebPage или Article. Хлебные крошки. И разметка FAQPage - готовые пары вопрос-ответ, самое удобное для вставки в ответ.
Именно sameAs чаще всего забывают, а он решает задачу, из-за которой мы отдельно писали про путаницу с однофамильцами: без связки профилей модель не уверена, что говорит о вас.
Группа четвёртая: свежесть и авторство
Здесь речь уже не про понимание, а про доверие.
Дата обновления в машиночитаемом виде - dateModified в разметке и lastmod в карте сайта. Модели охотнее берут свежее; страница без даты по умолчанию считается старой.
Автор с именем и следом в сети. Безымянный корпоративный текст модели считают менее надёжным, чем подписанный человеком, у которого есть биография и публикации.
Порядок работ
- Откройте robots.txt и проверьте четырёх роботов поимённо. Заодно уберите случайные noindex.
- Убедитесь, что текст есть в исходном коде. Если нет - это задача разработчику, и она важнее всех остальных пунктов вместе взятых.
- Соберите карточку организации со всеми контактами и добавьте sameAs на все профили компании, которые сможете вспомнить.
- Разметьте вопросы и ответы на страницах услуг: это самый дешёвый способ отдать модели свои формулировки.
- Проставьте даты обновления в разметке и lastmod в карте сайта.
- Подпишите материалы автором - с именем, должностью и ссылкой на профиль.
- Приведите вёрстку к семантической и добавьте внутренние ссылки там, где страницы висят в изоляции.
- Положите llms.txt. Это последний пункт по важности - почему именно последний, разбираем отдельно.
Быстрее всего отдача от первых трёх пунктов, и они же самые дешёвые. Открытый robots.txt правится за пять минут, карточка организации собирается за час. Текст без скриптов может стоить недели работы разработчика - но без него остальные семь пунктов не имеют смысла, поэтому очередь именно такая.
Чего сайт не решает
Оптимистичная часть статей на эту тему обычно заканчивается обещанием: сделайте всё перечисленное, и нейросети начнут вас рекомендовать. Так не работает.
Модель отвечает не по вашему сайту, а по тому, что о вас написано в интернете: подборки, каталоги, отзывы, отраслевые площадки, обсуждения. Ваш сайт в этом наборе - один источник из многих, и он же самый предвзятый с точки зрения модели.
Правильная формулировка скромнее: порядок на сайте убирает препятствия. Пока текст не читается, а роботы закрыты, вы не участвуете в отборе вообще. Когда препятствий нет, начинается настоящая работа - попадание в те источники, откуда модели берут материал по вашей теме. Какие это источники, видно из замера: рядом с ответами моделей обычно перечислены ссылки, и по ним собирается карта площадок, где вас должно быть.
Проверить свой сайт по всем 39 сигналам можно бесплатно и без регистрации - отчёт покажет, на каком из пунктов очереди вы сейчас стоите.
Дальше устроено так: этот же аудит входит в каждый тариф и пересчитывается вместе с еженедельным замером. То есть видно не только состояние сайта, но и то, сдвинулись ли ответы моделей после ваших правок - без этой связки правки делаются вслепую. На верхнем тарифе к цифрам добавляется план работ: карточки задач со статусами и порядком. Объёмы и цены открыты, первый замер бесплатный.
вопросы
Частые вопросы
01С чего начинать оптимизацию сайта под нейросети?
С двух проверок: пускает ли robots.txt роботов GPTBot, ClaudeBot, PerplexityBot и Google-Extended и виден ли текст страницы без выполнения скриптов. Пока хоть одна из них не пройдена, остальные правки роли не играют - читать нечего или некому.
02Правда ли, что роботы нейросетей не выполняют JavaScript?
Большинство сборщиков забирает исходный HTML и скрипты не исполняет. Если текст подставляется на клиенте, для такого робота страница выглядит пустой. Проверяется просмотром исходного кода страницы: если в нём нет ваших абзацев, их нет и для модели.
03Какая разметка нужна в первую очередь?
Карточка организации: тип Organization или LocalBusiness с названием, сайтом, логотипом, контактами и ссылками sameAs на профили в каталогах и соцсетях. Из неё модель берёт факты о компании напрямую, а не догадывается по обрывкам текста.
04Помогает ли разметка FAQ попасть в ответ?
Она отдаёт модели готовые пары вопрос-ответ, которые проще всего вставить в ответ дословно. Это не гарантия цитирования, но без неё ваши формулировки не отделены от остального текста и теряются в полотне.
05Достаточно ли привести сайт в порядок, чтобы нейросети начали вас называть?
Нет. Сайт - необходимое условие, а не достаточное: модели отвечают по тому, что о вас написано в интернете, включая каталоги, подборки и отзывы. Порядок на сайте убирает препятствия, дальше работа идёт с внешними источниками.
