журнал Практика

Какие тексты нейросети берут в ответ, а какие пролистывают

Разбираем анатомию абзаца, который модель может процитировать: где стоит факт, как выглядит цифра, почему вводные предложения убивают шансы страницы попасть в ответ.

23 августа 20267 мин чтения

Плакат: столбец текстовых полос, три из них подсвечены кирпичным и вынесены вправо

Разберём, что происходит с текстом внутри модели, и почему две статьи на одну тему получают разную судьбу.

Когда модель отвечает на вопрос с поиском, она не пересказывает страницу. Она достаёт из неё кусок - обычно абзац или два - и встраивает его в свой ответ. Значит, единица борьбы за видимость не статья и не сайт, а фрагмент. Дальше всё сводится к одному вопросу: есть ли на вашей странице такие куски, которые можно вынуть и подать как ответ, ничего не дописывая.

Тест на самодостаточность

Возьмите любой абзац из середины своей статьи, вырежьте его и покажите человеку, который не читал остального. Понятно ли из него, о чём речь? Есть ли в нём подлежащее, а не местоимение это? Названа ли компания или продукт, или подразумевается из предыдущего раздела?

Абзац, который проходит этот тест, годится в цитату. Абзац, который начинается со слов кроме того, стоит отметить или как мы уже говорили выше, - не годится. Он привязан к соседям, и модель его либо пропустит, либо возьмёт и получит бессмыслицу, за которую вы же будете отвечать перед клиентом.

Вот два варианта одного и того же по смыслу текста.

Плохо: "Кроме того, важно помнить о сроках. Они могут варьироваться в зависимости от целого ряда факторов, поэтому лучше уточнять индивидуально."

Хорошо: "Кухню по индивидуальным размерам мы собираем за 30-45 рабочих дней: две недели на проект и замер, три-четыре на производство фасадов, три дня на монтаж. Срочный заказ за 20 дней возможен с наценкой 15 процентов."

Второй вариант содержит цифру, диапазон, разбивку и условие. Его можно вставить в ответ дословно, и он останется верным. Первый не содержит ничего, что стоило бы цитировать.

Первое предложение раздела

Привычка, поставленная годами SEO, - начинать раздел с разгона: сначала общие слова про важность темы, потом суть. Для ответов нейросетей это ровно наоборот.

Под каждым подзаголовком первое предложение должно быть ответом. Не введением в ответ, не обещанием ответить ниже. Дальше можно объяснять, оговаривать, приводить исключения - это читают люди, и это же добавляет модели контекста. Но крючок для извлечения стоит на первой строке.

Проверка простая: прочитайте подряд только подзаголовки и первые предложения под ними. Если получился связный конспект статьи, страница устроена правильно. Если получился набор фраз про то, что тема сложная и требует внимания, - переписывайте.

Что конкретно считается фактом

Модель различает утверждения, которые можно проверить, и слова, которые нельзя. Извлекается первое.

Цена и вилка цен. Срок в днях. Гарантия в годах. Площадь, вес, состав, мощность. Город и адрес. Условия доставки. Год основания. Количество проектов. Ограничение, при котором услуга не оказывается. Дата, когда данные актуальны.

Не извлекается: индивидуальный подход, высокое качество, широкий ассортимент, гибкая ценовая политика, команда профессионалов, многолетний опыт. Эти слова стоят на каждом втором сайте, они не различают вас ни с кем и модель не может построить на них ответ на вопрос клиента.

Есть неприятное следствие. Если вы принципиально не публикуете цены, вы выпадаете из огромного класса вопросов - а именно вопросы про стоимость клиенты задают чаще всего. Полностью проблему решает вилка с условиями: от какой суммы, за что, что входит, от чего зависит верх диапазона. Это не раскрытие коммерческой тайны, это то, что модель сможет процитировать вместо конкурента.

Отдельная беда - противоречия внутри сайта. На главной написано, что работаете с 2011 года, в разделе о компании - с 2013-го, в подвале указан один телефон, в карточке филиала другой. Модель, встретив расхождение, чаще всего просто не берёт спорный факт в ответ: у неё нет способа выбрать между двумя вашими же версиями. Сверка фактов по всем страницам - работа на день, а результат заметнее, чем от новой статьи.

Формат, который собирает вопросы

У любого товара или услуги есть десяток вопросов, которые клиент задаёт вслух: сколько стоит, сколько ждать, что входит, а если не подойдёт, а вы делаете вот такое, чем отличается от соседнего варианта. Каждый такой вопрос - потенциальный запрос к нейросети.

Отсюда простой рабочий формат раздела: подзаголовок повторяет вопрос человеческими словами, первый абзац отвечает, второй разбирает исключение. Пять-семь таких блоков закрывают тему полнее, чем длинное эссе, и дают модели пять-семь независимых точек входа.

Блок вопросов и ответов в конце страницы работает по той же логике и дополнительно попадает в разметку FAQ - про неё подробно в материале о разметке. Но одним блоком в подвале ограничиваться не стоит: он собирает короткие вопросы, а развёрнутые остаются за разделами.

Чего текст не решит

Хороший фрагмент не поможет, если страницу не читают роботы или если модель отвечает по памяти и вашего сайта в её данных нет вовсе. Порядок работ от доступа к смыслу разобран в статье про оптимизацию сайта под нейросети, а деление сетей на поисковые и отвечающие по памяти - в разборе каналов замера.

Ещё одна честная граница: даже безупречный текст на вашем сайте проигрывает обзору на площадке, которой модель доверяет больше. Свой текст - обязательное условие, не достаточное.

Что унести с собой

  • Единица цитирования - фрагмент, а не статья. Пишите абзацы, которые работают в отрыве от соседей.
  • Ответ стоит в первом предложении раздела, объяснение - после.
  • Цифры, сроки и условия извлекаются, эпитеты - нет.
  • Противоречия между страницами вычёркивают факт из ответа целиком.
  • Проверять эффект надо не по трафику, а по тому, изменилась ли доля ответов, где вас называют.

Как понять, что переписывание сработало

Позиций у ответа модели нет, кликов тоже может не быть - человек прочитал ответ и не пошёл никуда. Поэтому эффект от правок в текстах видно только одним способом: замерить, в какой доле ответов на вопросы ваших клиентов модели называют вас, и повторить замер после работы.

Первый замер бесплатный и без карты: вводите сайт, получаете список вопросов и картину по девяти сетям. Дальше имеет смысл переписать три-четыре ключевые страницы по разобранным выше правилам и через месяц сравнить. Еженедельное наблюдение стоит от 5 900 рублей, а посмотреть, как выглядит динамика на дистанции, можно в демо-кабинете.

вопросы

Частые вопросы

  • 01Какой длины должен быть абзац, чтобы его процитировали?

    Работает не длина, а самодостаточность. Абзац должен читаться как законченный ответ без предыдущих трёх - обычно это выходит на 40-70 словах. Длинный абзац не запрещён, но модель вырежет из него кусок, и вырежет не тот, который вы считали главным.

  • 02Нужно ли писать в формате вопрос - ответ?

    Не обязательно везде, но подзаголовок в форме вопроса клиента с прямым ответом в первом предложении под ним - самая надёжная конструкция. Она совпадает с тем, как модель ищет фрагмент под запрос.

  • 03Правда ли, что нейросети любят списки?

    Списки удобно извлекать, но текст, где буллетов больше половины, теряет связность и перестаёт отвечать на вопрос почему. Держите баланс: перечисление там, где перечисляются вещи, проза там, где объясняется причина.

  • 04Помогает ли объём текста?

    Сам по себе нет. Десять тысяч знаков воды проигрывают трём тысячам, где на каждый вопрос есть конкретный ответ с цифрой и датой. Объём помогает только тем, что даёт больше поводов совпасть с разными формулировками вопроса.

  • 05Что делать со старыми статьями, которые никто не цитирует?

    Переписывать первые абзацы разделов так, чтобы каждый начинался с ответа, и добавлять конкретику - цены, сроки, условия, дату обновления. Это дешевле, чем писать новые тексты, и эффект виден быстрее.

проверить свой бренд

Узнайте, что нейросети отвечают о вас

Первая оценка по вашему сайту занимает десять секунд: SEENGO соберёт вопросы клиентов и покажет, где бренд виден, а где отвечают конкурентами.

читать дальше