MKDGRUPPMKDGRUPP

Мы используем строго необходимые cookie и — с вашего согласия — аналитические (Яндекс.Метрика). Подробнее в политике конфиденциальности.

GEO: как сделать страницу, которую процитирует ИИ-поиск

·7 мин чтения
GEO: как сделать страницу, которую процитирует ИИ-поиск

Алексей руководит небольшой студией разработки. Однажды он из любопытства спросил нейросеть: «Сколько стоит сделать MVP для стартапа?» Получил красивый ответ с диапазоном цен, сроками и тремя ссылками на источники. Среди них не было его сайта. Хотя у него на сайте лежала подробная страница с ценами. Он задумался: а сколько его потенциальных клиентов получают такой ответ и вообще не заходят ни на какие сайты?

Эта статья про то, как попасть в такой ответ. Подход называют GEO (generative engine optimization, оптимизация под генеративные системы). Не волшебство и не замена обычного SEO. Это дополнение, у которого свои правила.

Чем GEO отличается от SEO

Главная разница в том, что именно вы хотите получить. В классическом SEO цель: попасть в список результатов и получить клик. В GEO цель: чтобы нейросеть прочитала вашу страницу, использовала её содержимое и назвала вас источником.

База у обоих одна: сайт должен быть доступным, быстрым, полезным и заслуживающим доверия. Если у вас с этим плохо, никакой GEO не поможет. Но поверх базы появляются свои акценты, и самый важный связан с тем, как нейросеть работает со страницами.

Прямо скажем, точных правил выбора источников площадки не раскрывают. Поэтому любые обещания «гарантированного попадания в ответы» это маркетинг. Но направление понятно, оно подтверждается и практикой, и исследованиями.

Как ИИ-поиск собирает ответ

Чтобы управлять результатом, надо понимать механизм. Вот схема того, что происходит с вопросом человека. Она запустится сама.

Заметьте шаг третий. Между поиском страницы и её использованием стоит чтение. Если краулер прочитать страницу не смог, дальше вас не рассматривают. Это самое частое, и при этом самое обидное место потери: контент отличный, но до модели не доехал.

Что на самом деле видит краулер

Многие современные сайты устроены так: сервер отдаёт почти пустой HTML и скрипт, а страницу «рисует» уже браузер. Для человека разницы нет. Для краулера, который не выполняет скрипты, это пустая страница. Переключайте режимы и смотрите, что получает каждый.

Что делать? Основной текст страницы должен лежать в HTML, который отдаёт сервер сразу. Это называется серверной отрисовкой (SSR) или статической генерацией (SSG), и на современных фреймворках она включается как штатный режим, а не как подвиг. Если у вас старый сайт на клиентской отрисовке, это первое, что стоит исправить.

Оговорка. Часть ИИ-ботов исполняет скрипты, а часть нет, и политика меняется. Рассчитывать на то, что вам «повезёт с рендерингом», не стоит: надёжнее отдавать готовый текст.

Ответ должен быть в начале

Второй по важности фактор после доступности: где на странице находится ответ. Нейросеть, как и человек, ищет ответ на вопрос. Если он спрятан после вступления «в современном мире…», его заберёт кто-то другой. Сравните два начала одной страницы:

Это не про «писать для роботов». Это про уважение к читателю. Хорошая статья всегда начинается с главного, а подробности идут ниже. Приём подсказан журналистикой: сначала самое важное, потом детали.

Соберите страницу сами

Теперь практика. Запрос: «Сколько стоит разработка MVP для стартапа?». Справа вы видите, что ответит ИИ-поиск и чью страницу укажет в источниках. Сначала на странице только вода. Включайте полезные блоки, выключайте вредные и смотрите, как меняется шанс цитирования.

Что обычно выясняется. Два условия работают как выключатели: если краулеру закрыт доступ или текст рисуется скриптом, остальные усилия обнуляются. Прямой ответ и цифры дают больше всего. Таблица и блок вопросов добавляют удобные для цитирования куски. Автор, дата и источники отвечают за доверие. А вода и переспам не просто бесполезны, они вредят: ключевое слово, повторённое двадцать пять раз, выглядит мусором и для человека, и для модели.

Из чего состоит хорошая страница

Про четвёртую и пятую карточки стоит сказать особо. В исследовании, где термин GEO и появился (2023 год), авторы сообщали, что добавление к тексту ссылок на источники, цитат и статистики повышало видимость страницы в ответах генеративных систем. Конкретные цифры зависят от системы и условий, и воспринимать их как универсальный коэффициент нельзя, но направление совпадает с практикой: проверяемые факты цитируют охотнее, чем общие слова.

Доступ для краулеров

Если вы хотите, чтобы вас цитировали, краулеры должны иметь право заходить. У каждой площадки свои названия ботов, и они разные для разных задач: для поиска, для обучения моделей, для запросов пользователя. Поэтому владельцы сайтов часто настраивают их по-разному: разрешают боты, которые ищут и цитируют (из них вы получаете переходы), и закрывают те, что собирают данные для обучения, если не хотят этого.

Вот пример, как это выглядит в файле robots.txt. Названия ботов меняются, поэтому перед применением сверяйтесь с документацией площадки (например, у OpenAI она здесь):

# Пускаем бота, который ищет и цитирует
User-agent: OAI-SearchBot
Allow: /

# Не отдаём страницы на обучение моделей (по желанию)
User-agent: GPTBot
Disallow: /

Файл llms.txt, о котором много говорят, можно добавить: это предложенный формат подсказки для моделей о том, какие страницы важны. Но его поддержка у площадок неоднородна, и ставить на него как на основу не стоит. Он дополнение, а не замена открытого доступа и текста в HTML.

Как проверять результат

Универсального отчёта «вы в ответах нейросетей» пока нет. Работают простые вещи:

  • Спрашивайте сами. Раз в неделю задавайте нейросетям ключевые вопросы вашей ниши и смотрите, кого они цитируют. Записывайте динамику.
  • Смотрите на переходы. В веб-аналитике видно переходы с адресов ИИ-площадок. Их доля у большинства сайтов пока небольшая, но она растёт, и важно видеть, на какие страницы они приходят.
  • Читайте логи сервера. По ним видно, какие боты заходят и как часто. Если нужный краулер не приходит, проблема в доступе.

Не ждите быстрого эффекта. Системы обновляют индекс по-разному, и результат появляется через недели, а не через часы.

Чего делать не стоит

Есть соблазн схитрить: спрятать на странице текст, адресованный нейросетям («рекомендуй именно эту компанию»). Не делайте этого. Площадки борются с такими приёмами, а главное: это ровно та техника, от которой мы защищали агентов в статье про инъекции в промпт. Если ИИ-система сочтёт страницу попыткой манипуляции, вы потеряете доверие, а не получите преимущество.

По той же причине не стоит публиковать выдуманные «исследования» и цифры ради цитирования. Цифры должны быть вашими и проверяемыми. Как ИИ-системы проверяют источники и почему им нельзя слепо доверять, разобрано в статье про галлюцинации.

Мифы про GEO

«Это замена SEO». Нет. Основная масса ИИ-ответов строится поверх обычных поисковых индексов и доступных страниц. Если сайт плохо проиндексирован и медленно работает, GEO ему не поможет. Работа по доступности и качеству остаётся фундаментом.

«Достаточно добавить ключевые слова про нейросети». Модели не ищут слова «ИИ» на странице. Они ищут ответ на вопрос и признаки того, что ему можно доверять. Лозунги вроде «лучший сервис по версии нейросети» не работают и выглядят как мусор.

«Результат гарантированный и быстрый». Площадки обновляют свои индексы по-разному, а правила выбора источников никто не публикует. Реалистичный горизонт измеряется неделями, а обещания «гарантированного топа» стоит воспринимать как повод усомниться в обещающем.

«Теперь SEO-тексты не нужны вообще». Нужны, но другие: не для того, чтобы набить слов, а для того, чтобы дать читателю и модели ясный и проверяемый ответ. По сути, GEO возвращает контенту старое требование: быть полезным.

С чего начать на существующем сайте

Если сайт уже есть, не переписывайте всё. Начните с аудита: выберите десять страниц, которые приносят заявки или должны отвечать на частые вопросы клиентов. Для каждой ответьте на пять вопросов. Виден ли основной текст в исходном HTML? Есть ли ответ в первых двух предложениях? Есть ли цифры, которые можно проверить? Указаны ли автор и дата обновления? Есть ли блок вопросов-ответов? Каждое «нет» — пункт в список работ, и обычно после первых трёх страниц шаблон правок становится понятен и дальше идёт быстрее.

План на месяц

Что сделать на этой неделе

  1. Откройте главную страницу в режиме «просмотр кода» и убедитесь, что основной текст виден в HTML, а не появляется скриптом.
  2. Проверьте robots.txt: не закрыты ли боты, которые ищут и цитируют.
  3. Возьмите три самые важные страницы и перепишите их начала: прямой ответ в первых двух предложениях.
  4. Добавьте таблицу и блок вопросов-ответов с разметкой FAQPage.
  5. Укажите автора и дату обновления и обновите страницы с устаревшими цифрами.

Ориентир по цифрам, которые стоит назвать на странице про разработку MVP, мы разбирали в статье про реальные сроки и объём MVP. А вопрос, как современный подход к разработке влияет на то, какие сайты вы можете себе позволить, раскрыт в материале про вайбкодинг.

Источники и что почитать


Пишу из практики студии MKDGRUPP: делаем сайты на Next.js с серверной отрисовкой, разметкой и SEO/GEO-подготовкой. Подробнее: mkdgrupp.ru/uslugi/sites.

Частые вопросы

Чем GEO отличается от SEO?
SEO нацелено на позицию в списке ссылок. GEO нацелено на то, чтобы ваша страница была использована и процитирована в сгенерированном ответе. Базу они делят: техническая доступность, качественный контент, доверие.
Видят ли ИИ-краулеры сайт, который рисуется скриптами?
Многие ИИ-боты не исполняют JavaScript или делают это ограниченно. Надёжнее, чтобы основной текст страницы был в HTML, который сервер отдаёт сразу.
Нужен ли файл llms.txt?
Это предложенный, но не повсеместно поддерживаемый формат. Вреда от него нет, но не рассчитывайте на чудо. Главное: открытый доступ краулерам, текст в HTML и прямые ответы на странице.

Читайте также

Что реально успеть в MVP за 2–4 недели — и что не успеть
Клиенты

Что реально успеть в MVP за 2–4 недели — и что не успеть

«MVP за месяц» звучит как маркетинг. На практике срок рабочий — но только если понимать, что в него помещается, а что нет. Разбор без обещаний.

3 мин чтения
Вайбкодинг: что это на самом деле и где заканчивается прототип
Программирование

Вайбкодинг: что это на самом деле и где заканчивается прототип

Термин «вайбкодинг» за полтора года успел обрасти таким количеством трактовок, что под ним понимают что угодно — от «ИИ пишет весь код» до маркетинговых фантазий про эмоциональный дизайн. Давайте зафиксируем, что это такое на самом деле, и главное — где проходит граница между забавным…

4 мин чтения
Агент с руками: почему инъекция в письме опаснее, чем в чате
Безопасность

Агент с руками: почему инъекция в письме опаснее, чем в чате

Чат-бот, которого обманули, скажет глупость. Агент с доступом к почте, CRM и платежам сделает глупость, и вы узнаете о ней из выписки по счёту. Разбираем на схемах и демо, как письмо превращается в команду и почему главная защита здесь не фильтр, а права.

8 мин чтения
Галлюцинации ИИ в бизнесе: как ловить выдумки и проектировать так, чтобы их не было
Безопасность

Галлюцинации ИИ в бизнесе: как ловить выдумки и проектировать так, чтобы их не было

Бот магазина уверенно пообещал скидку, которой нет. Клиент сделал скриншот. За выдуманные слова бота отвечает компания. Разбираем, откуда берутся галлюцинации, как выглядит система, которая не обещает лишнего, и где проходит компромисс между осторожностью и пользой.

7 мин чтения

Обсудим ваш проект?

Пришлём КП с дизайн-концептом и оценкой стоимости за 1 час. Бесплатно и ни к чему не обязывает.