журнал Видимость в нейросетях

Оптимизация сайта под нейросети: что менять и в каком порядке

Шестнадцать сигналов, по которым роботы моделей понимают ваш сайт, разобраны по группам и выстроены в очередь работ - от доступа роботов до разметки автора. С честной оговоркой про то, чего сайт не решает.

22 августа 20266 мин чтения

Плакат: лестница из блоков, поднимающаяся слева направо

Запрос про оптимизацию сайта под нейросети собрал за август 249 показов, и почти треть из них - с намерением заказать. Спрос понятный, а вот что именно нужно менять, обычно объясняют туманно: добавьте структурированные данные, пишите для людей, делайте полезный контент.

Ниже - конкретный список. Он взят из нашей проверки сайта: 23 сигнала отвечают за обычную поисковую видимость, ещё 16 - за то, как сайт читают роботы нейросетей. Про эти 16 и речь.

Группа первая: вас вообще пускают

Роботы GPTBot, ClaudeBot, PerplexityBot и Google-Extended собирают материал для моделей. Если в robots.txt стоит запрет, сайт физически не попадает ни в обучение, ни в веб-поиск чата. Запрет часто оказывается там случайно: приехал с плагином, остался с прошлого редизайна, добавлен разработчиком из общих соображений безопасности.

Здесь же живёт скучная пара сигналов, которые ломают всё тихо: случайный noindex на важных страницах и недоступный robots.txt, отдающий пятисотую ошибку.

Решение принимается один раз и осознанно: либо вы хотите, чтобы модели вас цитировали, и открываете доступ, либо закрываетесь и тогда не удивляетесь отсутствию в ответах.

Группа вторая: есть что читать

Большинство сборщиков забирает исходный HTML и не выполняет JavaScript. Сайт, где текст подставляется на клиенте, для них пуст - цитировать нечего. Проверка занимает минуту: откройте исходный код страницы и поищите в нём свой первый абзац.

Рядом - три сигнала помельче, но того же свойства. Семантическая вёрстка: теги main, article, section, nav показывают, где основной текст, а где обвязка; без них страница выглядит однородным супом из div. Структура ответа: подзаголовки, списки и таблицы дают модели готовый фрагмент, а сплошное полотно приходится разбирать. Внутренние ссылки: по ним роботы находят остальные страницы, и тонкий одноэкранник почти без ссылок остаётся наполовину неизвестным.

Группа третья: факты в машиночитаемом виде

Дальше начинается то, что отличает подготовленный сайт от обычного. Модель не обязана вычитывать факты о компании из прозы - их можно отдать напрямую, разметкой Schema.org.

Минимальный набор такой. Карточка организации с типом Organization или LocalBusiness - иначе данные есть, а понимания, что перед ним компания, у робота нет. Заполненность карточки: название, адрес сайта, логотип, контакты. Ссылки sameAs на профили в соцсетях, картах и каталогах - по ним модель понимает, что компания из карточки, компания с карты и компания из отзыва - одна и та же. Тип страницы WebPage или Article. Хлебные крошки. И разметка FAQPage - готовые пары вопрос-ответ, самое удобное для вставки в ответ.

Именно sameAs чаще всего забывают, а он решает задачу, из-за которой мы отдельно писали про путаницу с однофамильцами: без связки профилей модель не уверена, что говорит о вас.

Группа четвёртая: свежесть и авторство

Здесь речь уже не про понимание, а про доверие.

Дата обновления в машиночитаемом виде - dateModified в разметке и lastmod в карте сайта. Модели охотнее берут свежее; страница без даты по умолчанию считается старой.

Автор с именем и следом в сети. Безымянный корпоративный текст модели считают менее надёжным, чем подписанный человеком, у которого есть биография и публикации.

Порядок работ

  1. Откройте robots.txt и проверьте четырёх роботов поимённо. Заодно уберите случайные noindex.
  2. Убедитесь, что текст есть в исходном коде. Если нет - это задача разработчику, и она важнее всех остальных пунктов вместе взятых.
  3. Соберите карточку организации со всеми контактами и добавьте sameAs на все профили компании, которые сможете вспомнить.
  4. Разметьте вопросы и ответы на страницах услуг: это самый дешёвый способ отдать модели свои формулировки.
  5. Проставьте даты обновления в разметке и lastmod в карте сайта.
  6. Подпишите материалы автором - с именем, должностью и ссылкой на профиль.
  7. Приведите вёрстку к семантической и добавьте внутренние ссылки там, где страницы висят в изоляции.
  8. Положите llms.txt. Это последний пункт по важности - почему именно последний, разбираем отдельно.

Быстрее всего отдача от первых трёх пунктов, и они же самые дешёвые. Открытый robots.txt правится за пять минут, карточка организации собирается за час. Текст без скриптов может стоить недели работы разработчика - но без него остальные семь пунктов не имеют смысла, поэтому очередь именно такая.

Чего сайт не решает

Оптимистичная часть статей на эту тему обычно заканчивается обещанием: сделайте всё перечисленное, и нейросети начнут вас рекомендовать. Так не работает.

Модель отвечает не по вашему сайту, а по тому, что о вас написано в интернете: подборки, каталоги, отзывы, отраслевые площадки, обсуждения. Ваш сайт в этом наборе - один источник из многих, и он же самый предвзятый с точки зрения модели.

Правильная формулировка скромнее: порядок на сайте убирает препятствия. Пока текст не читается, а роботы закрыты, вы не участвуете в отборе вообще. Когда препятствий нет, начинается настоящая работа - попадание в те источники, откуда модели берут материал по вашей теме. Какие это источники, видно из замера: рядом с ответами моделей обычно перечислены ссылки, и по ним собирается карта площадок, где вас должно быть.

Проверить свой сайт по всем 39 сигналам можно бесплатно и без регистрации - отчёт покажет, на каком из пунктов очереди вы сейчас стоите.

Дальше устроено так: этот же аудит входит в каждый тариф и пересчитывается вместе с еженедельным замером. То есть видно не только состояние сайта, но и то, сдвинулись ли ответы моделей после ваших правок - без этой связки правки делаются вслепую. На верхнем тарифе к цифрам добавляется план работ: карточки задач со статусами и порядком. Объёмы и цены открыты, первый замер бесплатный.

вопросы

Частые вопросы

  • 01С чего начинать оптимизацию сайта под нейросети?

    С двух проверок: пускает ли robots.txt роботов GPTBot, ClaudeBot, PerplexityBot и Google-Extended и виден ли текст страницы без выполнения скриптов. Пока хоть одна из них не пройдена, остальные правки роли не играют - читать нечего или некому.

  • 02Правда ли, что роботы нейросетей не выполняют JavaScript?

    Большинство сборщиков забирает исходный HTML и скрипты не исполняет. Если текст подставляется на клиенте, для такого робота страница выглядит пустой. Проверяется просмотром исходного кода страницы: если в нём нет ваших абзацев, их нет и для модели.

  • 03Какая разметка нужна в первую очередь?

    Карточка организации: тип Organization или LocalBusiness с названием, сайтом, логотипом, контактами и ссылками sameAs на профили в каталогах и соцсетях. Из неё модель берёт факты о компании напрямую, а не догадывается по обрывкам текста.

  • 04Помогает ли разметка FAQ попасть в ответ?

    Она отдаёт модели готовые пары вопрос-ответ, которые проще всего вставить в ответ дословно. Это не гарантия цитирования, но без неё ваши формулировки не отделены от остального текста и теряются в полотне.

  • 05Достаточно ли привести сайт в порядок, чтобы нейросети начали вас называть?

    Нет. Сайт - необходимое условие, а не достаточное: модели отвечают по тому, что о вас написано в интернете, включая каталоги, подборки и отзывы. Порядок на сайте убирает препятствия, дальше работа идёт с внешними источниками.

проверить свой бренд

Узнайте, что нейросети отвечают о вас

Первая оценка по вашему сайту занимает десять секунд: SEENGO соберёт вопросы клиентов и покажет, где бренд виден, а где отвечают конкурентами.

читать дальше