К содержимому

журнал — Видимость в нейросетях

Оптимизация сайта под нейросети: что менять и в каком порядке

Оптимизация сайта под ИИ: шестнадцать сигналов, по которым роботы моделей читают ваш сайт, по группам и в очередь работ. Статистика 22 реальных аудитов и честная оговорка о том, чего сайт не решает.

22 августа 2026 — 8 мин чтения — обновлено 30 августа 2026

Плакат: лестница из блоков, поднимающаяся слева направо

Запрос про оптимизацию сайта под нейросети собрал за август 249 показов, и почти треть из них - с намерением заказать. Спрос понятный, а вот что именно нужно менять, обычно объясняют туманно: добавьте структурированные данные, пишите для людей, делайте полезный контент.

Ниже - конкретный список. Он взят из нашей проверки сайта: 23 сигнала отвечают за обычную поисковую видимость, ещё 16 - за то, как сайт читают роботы нейросетей. Про эти 16 и речь. А ближе к концу - то, чего в первой версии этой статьи не было: статистика по 22 сайтам, которые прошли через нашу бесплатную проверку за десять дней. Она поменяла наше представление о том, где у сайтов болит.

Группа первая: вас вообще пускают

Роботы GPTBot, ClaudeBot, PerplexityBot и OAI-SearchBot собирают материал для моделей и их поиска. Если в robots.txt стоит запрет, сайт физически не попадает ни в обучение, ни в веб-поиск чата. Запрет часто оказывается там случайно: приехал с плагином, остался с прошлого редизайна, добавлен разработчиком из общих соображений безопасности. Роботов при этом три вида, и разрешать их надо поимённо: сборщики для обучения, индексаторы поиска внутри чата и роботы, которые приходят за страницей по запросу пользователя. Какие это имена и как часто они ходят по сайту, мы посчитали по своим логам в статье про GEO, AEO и SEO.

Здесь же живёт скучная пара сигналов, которые ломают всё тихо: случайный noindex на важных страницах и недоступный robots.txt, отдающий пятисотую ошибку.

Решение принимается один раз и осознанно: либо вы хотите, чтобы модели вас цитировали, и открываете доступ, либо закрываетесь и тогда не удивляетесь отсутствию в ответах.

Группа вторая: есть что читать

Большинство сборщиков забирает исходный HTML и не выполняет JavaScript. Сайт, где текст подставляется на клиенте, для них пуст - цитировать нечего. Проверка занимает минуту: откройте исходный код страницы и поищите в нём свой первый абзац.

Рядом - три сигнала помельче, но того же свойства. Семантическая вёрстка: теги main, article, section, nav показывают, где основной текст, а где обвязка; без них страница выглядит однородным супом из div. Структура ответа: подзаголовки, списки и таблицы дают модели готовый фрагмент, а сплошное полотно приходится разбирать. Внутренние ссылки: по ним роботы находят остальные страницы, и тонкий одноэкранник почти без ссылок остаётся наполовину неизвестным.

Группа третья: факты в машиночитаемом виде

Дальше начинается то, что отличает подготовленный сайт от обычного. Модель не обязана вычитывать факты о компании из прозы - их можно отдать напрямую, разметкой Schema.org.

Минимальный набор такой. Карточка организации с типом Organization или LocalBusiness - иначе данные есть, а понимания, что перед ним компания, у робота нет. Заполненность карточки: название, адрес сайта, логотип, контакты. Ссылки sameAs на профили в соцсетях, картах и каталогах - по ним модель понимает, что компания из карточки, компания с карты и компания из отзыва - одна и та же. Тип страницы WebPage или Article. Хлебные крошки. И разметка FAQPage - готовые пары вопрос-ответ, самое удобное для вставки в ответ. Какой набор разметки действительно нужен, а какой можно не делать, разобрано отдельно.

Именно sameAs чаще всего забывают, а он решает задачу, из-за которой мы отдельно писали про путаницу с однофамильцами: без связки профилей модель не уверена, что говорит о вас. В нашем собственном замере это стоило студии с трёхбуквенным названием сорока ответов из 41: модели описывали чужие компании с теми же буквами.

Группа четвёртая: свежесть и авторство

Здесь речь уже не про понимание, а про доверие.

Дата обновления в машиночитаемом виде - dateModified в разметке и lastmod в карте сайта. Модели охотнее берут свежее; страница без даты по умолчанию считается старой.

Автор с именем и следом в сети. Безымянный корпоративный текст модели считают менее надёжным, чем подписанный человеком, у которого есть биография и публикации. Почему модели вообще доверяют одним сайтам больше других и какие семь мифов про это ходят, разобрано в отдельной статье.

Где болит на самом деле: 22 аудита

Первую версию этой статьи мы писали из общих соображений: главная беда - закрытые роботы и текст на скриптах. Потом через бесплатную проверку прошли 22 сайта, с 20 по 29 августа 2026, и картина оказалась другой. Средний балл 67 из 100. Вот доля сайтов, у которых каждый из 16 сигналов не прошёл.

СигналНе прошлиГруппа
Автор с именем и профилем86%свежесть и авторство
Разметка хлебных крошек86%факты
Тип страницы WebPage или Article82%факты
Файл llms.txt77%факты
Разметка FAQPage73%факты
Ссылки sameAs на профили68%факты
Тип организации в разметке50%факты
Заполненность карточки организации50%факты
Дата обновления в машиночитаемом виде50%свежесть и авторство
Разметка JSON-LD вообще45%факты
Семантическая вёрстка45%есть что читать
Внутренние ссылки23%есть что читать
lastmod в карте сайта23%свежесть и авторство
Структура ответа: заголовки, списки18%есть что читать
Текст без скриптов14%есть что читать
Доступ роботам нейросетей0%вас пускают
22 бесплатных аудита SEENGO, 20-29 августа 2026, доля сайтов с непройденным сигналом

Три вывода, которые из таблицы следуют, и один - который не следует.

Роботы открыты у всех. Ни один из 22 сайтов не запрещал GPTBot, ClaudeBot или PerplexityBot; robots.txt был сломан у одного, случайный noindex - у двух. Первая группа, которую мы ставили во главу очереди, на практике проходится за минуту, потому что чаще всего уже пройдена. Мы оставляем её первой, потому что она бинарная: если она не пройдена, остальное бесполезно. Но ожидать от неё эффекта не стоит - у большинства там нечего чинить.

Текст на скриптах - редкость, но тяжёлая. Три сайта из 22, и у одного из них в исходном коде ноль символов текста, у другого 281. Для остальных девятнадцати текста в коде от трёх до тридцати тысяч символов, роботу есть что читать.

Настоящая работа в третьей и четвёртой группе. Половина сайтов не говорит роботу, что перед ним компания. Две трети не связывают карточку с профилями в каталогах и картах. Три четверти не отдают готовые вопросы и ответы. И 86% не подписывают тексты человеком. Это и есть очередь, а не роботы.

А вывод, который из таблицы не следует: что достаточно закрыть все шестнадцать пунктов. Выборка маленькая, 22 сайта, и самоотобранная: проверку проходили те, кто уже задумался о видимости в нейросетях. У них и с роботами, и с текстом дела заведомо лучше среднего по рунету. Про то, что сайт не решает вовсе, - ниже.

Для сравнения, поисковый блок тех же аудитов: HSTS и заголовки безопасности не настроены у 77% сайтов, подписи к картинкам отсутствуют у 73%, заголовок страницы вне нормы у половины, описание - у 45%. Это не про нейросети, но модели с веб-поиском ищут теми же поисковиками, так что поисковая база тоже считается.

Порядок работ по оптимизации под ИИ

  1. Откройте robots.txt и проверьте роботов поимённо. Заодно уберите случайные noindex. Скорее всего, здесь всё в порядке, и пункт займёт пять минут.
  2. Убедитесь, что текст есть в исходном коде. Если нет - это задача разработчику, и она важнее всех остальных пунктов вместе взятых.
  3. Соберите карточку организации со всеми контактами и добавьте sameAs на все профили компании, которые сможете вспомнить. По статистике выше именно здесь у вас, вероятно, пусто.
  4. Разметьте вопросы и ответы на страницах услуг: это самый дешёвый способ отдать модели свои формулировки.
  5. Проставьте даты обновления в разметке и lastmod в карте сайта.
  6. Подпишите материалы автором - с именем, должностью и ссылкой на профиль. Самый массовый провал из шестнадцати.
  7. Приведите вёрстку к семантической и добавьте внутренние ссылки там, где страницы висят в изоляции.
  8. Положите llms.txt. Это последний пункт по важности - почему именно последний, разбираем отдельно, с логами, по которым видно, кто этот файл запрашивает.

Быстрее всего отдача от пунктов три и четыре, и они же самые массовые по провалам. Карточка организации с sameAs собирается за час, разметка FAQ на страницу услуги - за полчаса. Текст без скриптов может стоить недели работы разработчика - но без него остальные пункты не имеют смысла, поэтому очередь именно такая. План на два дня для того, кто делает всё сам, расписан по часам.

Чего сайт не решает

Оптимистичная часть статей на эту тему обычно заканчивается обещанием: сделайте всё перечисленное, и нейросети начнут вас рекомендовать. Так не работает.

Модель отвечает не по вашему сайту, а по тому, что о вас написано в интернете: подборки, каталоги, отзывы, отраслевые площадки, обсуждения. Ваш сайт в этом наборе - один источник из многих, и он же самый предвзятый с точки зрения модели. В нашем замере по агентству Perplexity привёл 471 ссылку под 48 ответами, и на сайт самого агентства вели 22 из них. Остальные 449 - площадки.

Правильная формулировка скромнее: порядок на сайте убирает препятствия. Пока текст не читается, а роботы закрыты, вы не участвуете в отборе вообще. Когда препятствий нет, начинается настоящая работа - попадание в те источники, откуда модели берут материал по вашей теме. Какие это источники, видно из замера: рядом с ответами моделей обычно перечислены ссылки, и по ним собирается карта площадок, где вас должно быть. Как на эти площадки попадать, разобрано отдельно.

Проверить свой сайт по всем 17 сигналам можно бесплатно и без регистрации - отчёт покажет, на каком из пунктов очереди вы сейчас стоите.

Дальше устроено так: этот же аудит входит в каждый тариф и пересчитывается вместе с еженедельным замером. То есть видно не только состояние сайта, но и то, сдвинулись ли ответы моделей после ваших правок - без этой связки правки делаются вслепую. На верхнем тарифе к цифрам добавляется план работ: карточки задач со статусами и порядком. Объёмы и цены открыты, первый замер бесплатный.

Источники

  • 22 бесплатных аудита сайтов по 39 сигналам, платформа SEENGO, 20-29.08.2026. Доли провалов по сигналам посчитаны по последнему аудиту каждого домена.
  • Типы Organization, LocalBusiness, FAQPage, BreadcrumbList и свойство sameAs: schema.org.
  • Роботы OpenAI и их имена для robots.txt: platform.openai.com/docs/bots. Роботы Perplexity: docs.perplexity.ai/guides/bots.
  • Частота запроса про оптимизацию сайта под нейросети: Яндекс Вордстат, август 2026.

вопросы

Частые вопросы

  • 01С чего начинать оптимизацию сайта под нейросети?

    С двух проверок: пускает ли robots.txt роботов GPTBot, ClaudeBot, PerplexityBot и OAI-SearchBot и виден ли текст страницы без выполнения скриптов. Пока хоть одна из них не пройдена, остальные правки роли не играют. По 22 нашим аудитам обе проверки проходят почти все, и настоящая работа начинается дальше.

  • 02Правда ли, что роботы нейросетей не выполняют JavaScript?

    Большинство сборщиков забирает исходный HTML и скрипты не исполняет. Если текст подставляется на клиенте, для такого робота страница выглядит пустой. Проверяется просмотром исходного кода страницы: если в нём нет ваших абзацев, их нет и для модели. В нашей выборке таких сайтов 3 из 22, у одного в исходном коде ноль символов текста.

  • 03Какая разметка нужна в первую очередь?

    Карточка организации: тип Organization или LocalBusiness с названием, сайтом, логотипом, контактами и ссылками sameAs на профили в каталогах и соцсетях. Из неё модель берёт факты о компании напрямую. Типа организации нет у половины проверенных сайтов, ссылок sameAs - у 68%.

  • 04Помогает ли разметка FAQ попасть в ответ?

    Она отдаёт модели готовые пары вопрос-ответ, которые проще всего вставить в ответ дословно. Это не гарантия цитирования, но без неё ваши формулировки не отделены от остального текста и теряются в полотне. Разметки FAQ нет у 73% проверенных сайтов.

  • 05Достаточно ли привести сайт в порядок, чтобы нейросети начали вас называть?

    Нет. Сайт - необходимое условие, а не достаточное: модели отвечают по тому, что о вас написано в интернете, включая каталоги, подборки и отзывы. Порядок на сайте убирает препятствия, дальше работа идёт с внешними источниками.

проверить свой бренд

Узнайте, что нейросети отвечают о вас

Первая оценка по вашему сайту занимает десять секунд: SEENGO соберёт вопросы клиентов и покажет, где бренд виден, а где отвечают конкурентами.

читать дальше

Узнайте, что нейросети говорят о вашей компании

Попробуйте бесплатно или оставьте заявку — покажем платформу на ваших данных. Разовая оценка — 5 900 ₽, подписка от 19 900 ₽, все цены открыты.

Есть вопрос — напишите нам в Телеграм @seengoooo. Отвечаем быстро и по делу.