GEO: как сделать страницу, которую процитирует ИИ-поиск

Алексей руководит небольшой студией разработки. Однажды он из любопытства спросил нейросеть: «Сколько стоит сделать MVP для стартапа?» Получил красивый ответ с диапазоном цен, сроками и тремя ссылками на источники. Среди них не было его сайта. Хотя у него на сайте лежала подробная страница с ценами. Он задумался: а сколько его потенциальных клиентов получают такой ответ и вообще не заходят ни на какие сайты?
Эта статья про то, как попасть в такой ответ. Подход называют GEO (generative engine optimization, оптимизация под генеративные системы). Не волшебство и не замена обычного SEO. Это дополнение, у которого свои правила.
Чем GEO отличается от SEO
Главная разница в том, что именно вы хотите получить. В классическом SEO цель: попасть в список результатов и получить клик. В GEO цель: чтобы нейросеть прочитала вашу страницу, использовала её содержимое и назвала вас источником.
База у обоих одна: сайт должен быть доступным, быстрым, полезным и заслуживающим доверия. Если у вас с этим плохо, никакой GEO не поможет. Но поверх базы появляются свои акценты, и самый важный связан с тем, как нейросеть работает со страницами.
Прямо скажем, точных правил выбора источников площадки не раскрывают. Поэтому любые обещания «гарантированного попадания в ответы» это маркетинг. Но направление понятно, оно подтверждается и практикой, и исследованиями.
Как ИИ-поиск собирает ответ
Чтобы управлять результатом, надо понимать механизм. Вот схема того, что происходит с вопросом человека. Она запустится сама.
Заметьте шаг третий. Между поиском страницы и её использованием стоит чтение. Если краулер прочитать страницу не смог, дальше вас не рассматривают. Это самое частое, и при этом самое обидное место потери: контент отличный, но до модели не доехал.
Что на самом деле видит краулер
Многие современные сайты устроены так: сервер отдаёт почти пустой HTML и скрипт, а страницу «рисует» уже браузер. Для человека разницы нет. Для краулера, который не выполняет скрипты, это пустая страница. Переключайте режимы и смотрите, что получает каждый.
Что делать? Основной текст страницы должен лежать в HTML, который отдаёт сервер сразу. Это называется серверной отрисовкой (SSR) или статической генерацией (SSG), и на современных фреймворках она включается как штатный режим, а не как подвиг. Если у вас старый сайт на клиентской отрисовке, это первое, что стоит исправить.
Оговорка. Часть ИИ-ботов исполняет скрипты, а часть нет, и политика меняется. Рассчитывать на то, что вам «повезёт с рендерингом», не стоит: надёжнее отдавать готовый текст.
Ответ должен быть в начале
Второй по важности фактор после доступности: где на странице находится ответ. Нейросеть, как и человек, ищет ответ на вопрос. Если он спрятан после вступления «в современном мире…», его заберёт кто-то другой. Сравните два начала одной страницы:
Это не про «писать для роботов». Это про уважение к читателю. Хорошая статья всегда начинается с главного, а подробности идут ниже. Приём подсказан журналистикой: сначала самое важное, потом детали.
Соберите страницу сами
Теперь практика. Запрос: «Сколько стоит разработка MVP для стартапа?». Справа вы видите, что ответит ИИ-поиск и чью страницу укажет в источниках. Сначала на странице только вода. Включайте полезные блоки, выключайте вредные и смотрите, как меняется шанс цитирования.
Что обычно выясняется. Два условия работают как выключатели: если краулеру закрыт доступ или текст рисуется скриптом, остальные усилия обнуляются. Прямой ответ и цифры дают больше всего. Таблица и блок вопросов добавляют удобные для цитирования куски. Автор, дата и источники отвечают за доверие. А вода и переспам не просто бесполезны, они вредят: ключевое слово, повторённое двадцать пять раз, выглядит мусором и для человека, и для модели.
Из чего состоит хорошая страница
Про четвёртую и пятую карточки стоит сказать особо. В исследовании, где термин GEO и появился (2023 год), авторы сообщали, что добавление к тексту ссылок на источники, цитат и статистики повышало видимость страницы в ответах генеративных систем. Конкретные цифры зависят от системы и условий, и воспринимать их как универсальный коэффициент нельзя, но направление совпадает с практикой: проверяемые факты цитируют охотнее, чем общие слова.
Доступ для краулеров
Если вы хотите, чтобы вас цитировали, краулеры должны иметь право заходить. У каждой площадки свои названия ботов, и они разные для разных задач: для поиска, для обучения моделей, для запросов пользователя. Поэтому владельцы сайтов часто настраивают их по-разному: разрешают боты, которые ищут и цитируют (из них вы получаете переходы), и закрывают те, что собирают данные для обучения, если не хотят этого.
Вот пример, как это выглядит в файле robots.txt. Названия ботов меняются, поэтому перед применением сверяйтесь с документацией площадки (например, у OpenAI она здесь):
# Пускаем бота, который ищет и цитирует
User-agent: OAI-SearchBot
Allow: /
# Не отдаём страницы на обучение моделей (по желанию)
User-agent: GPTBot
Disallow: /
Файл llms.txt, о котором много говорят, можно добавить: это предложенный формат подсказки для моделей о том, какие страницы важны. Но его поддержка у площадок неоднородна, и ставить на него как на основу не стоит. Он дополнение, а не замена открытого доступа и текста в HTML.
Как проверять результат
Универсального отчёта «вы в ответах нейросетей» пока нет. Работают простые вещи:
- Спрашивайте сами. Раз в неделю задавайте нейросетям ключевые вопросы вашей ниши и смотрите, кого они цитируют. Записывайте динамику.
- Смотрите на переходы. В веб-аналитике видно переходы с адресов ИИ-площадок. Их доля у большинства сайтов пока небольшая, но она растёт, и важно видеть, на какие страницы они приходят.
- Читайте логи сервера. По ним видно, какие боты заходят и как часто. Если нужный краулер не приходит, проблема в доступе.
Не ждите быстрого эффекта. Системы обновляют индекс по-разному, и результат появляется через недели, а не через часы.
Чего делать не стоит
Есть соблазн схитрить: спрятать на странице текст, адресованный нейросетям («рекомендуй именно эту компанию»). Не делайте этого. Площадки борются с такими приёмами, а главное: это ровно та техника, от которой мы защищали агентов в статье про инъекции в промпт. Если ИИ-система сочтёт страницу попыткой манипуляции, вы потеряете доверие, а не получите преимущество.
По той же причине не стоит публиковать выдуманные «исследования» и цифры ради цитирования. Цифры должны быть вашими и проверяемыми. Как ИИ-системы проверяют источники и почему им нельзя слепо доверять, разобрано в статье про галлюцинации.
Мифы про GEO
«Это замена SEO». Нет. Основная масса ИИ-ответов строится поверх обычных поисковых индексов и доступных страниц. Если сайт плохо проиндексирован и медленно работает, GEO ему не поможет. Работа по доступности и качеству остаётся фундаментом.
«Достаточно добавить ключевые слова про нейросети». Модели не ищут слова «ИИ» на странице. Они ищут ответ на вопрос и признаки того, что ему можно доверять. Лозунги вроде «лучший сервис по версии нейросети» не работают и выглядят как мусор.
«Результат гарантированный и быстрый». Площадки обновляют свои индексы по-разному, а правила выбора источников никто не публикует. Реалистичный горизонт измеряется неделями, а обещания «гарантированного топа» стоит воспринимать как повод усомниться в обещающем.
«Теперь SEO-тексты не нужны вообще». Нужны, но другие: не для того, чтобы набить слов, а для того, чтобы дать читателю и модели ясный и проверяемый ответ. По сути, GEO возвращает контенту старое требование: быть полезным.
С чего начать на существующем сайте
Если сайт уже есть, не переписывайте всё. Начните с аудита: выберите десять страниц, которые приносят заявки или должны отвечать на частые вопросы клиентов. Для каждой ответьте на пять вопросов. Виден ли основной текст в исходном HTML? Есть ли ответ в первых двух предложениях? Есть ли цифры, которые можно проверить? Указаны ли автор и дата обновления? Есть ли блок вопросов-ответов? Каждое «нет» — пункт в список работ, и обычно после первых трёх страниц шаблон правок становится понятен и дальше идёт быстрее.
План на месяц
Что сделать на этой неделе
- Откройте главную страницу в режиме «просмотр кода» и убедитесь, что основной текст виден в HTML, а не появляется скриптом.
- Проверьте
robots.txt: не закрыты ли боты, которые ищут и цитируют. - Возьмите три самые важные страницы и перепишите их начала: прямой ответ в первых двух предложениях.
- Добавьте таблицу и блок вопросов-ответов с разметкой FAQPage.
- Укажите автора и дату обновления и обновите страницы с устаревшими цифрами.
Ориентир по цифрам, которые стоит назвать на странице про разработку MVP, мы разбирали в статье про реальные сроки и объём MVP. А вопрос, как современный подход к разработке влияет на то, какие сайты вы можете себе позволить, раскрыт в материале про вайбкодинг.
Источники и что почитать
- GEO: Generative Engine Optimization (arXiv, 2023) — исследование, где термин появился, с экспериментами по методам оптимизации.
- OpenAI: Overview of OpenAI crawlers — названия ботов и как ими управлять.
- schema.org: FAQPage — разметка блока вопросов и ответов.
- Google: введение в robots.txt — как устроен файл и что он значит.
Пишу из практики студии MKDGRUPP: делаем сайты на Next.js с серверной отрисовкой, разметкой и SEO/GEO-подготовкой. Подробнее: mkdgrupp.ru/uslugi/sites.
Частые вопросы
- Чем GEO отличается от SEO?
- SEO нацелено на позицию в списке ссылок. GEO нацелено на то, чтобы ваша страница была использована и процитирована в сгенерированном ответе. Базу они делят: техническая доступность, качественный контент, доверие.
- Видят ли ИИ-краулеры сайт, который рисуется скриптами?
- Многие ИИ-боты не исполняют JavaScript или делают это ограниченно. Надёжнее, чтобы основной текст страницы был в HTML, который сервер отдаёт сразу.
- Нужен ли файл llms.txt?
- Это предложенный, но не повсеместно поддерживаемый формат. Вреда от него нет, но не рассчитывайте на чудо. Главное: открытый доступ краулерам, текст в HTML и прямые ответы на странице.



