Чем эта система отличается от остальных
За ответами ChatGPT стоит чужая индексация: страницы попадают в поле зрения через Bing, и путь в ответ идет через посредника. Perplexity ходит по сайтам сама, краулером PerplexityBot, и запрашивает страницы в тот момент, когда собирает ответ.
Отсюда два следствия. Требования к сайту предъявляет сама система, посредника здесь нет. И ответ она собирает из того, что доступно сейчас, поэтому свежая страница попадает в него быстрее, чем в поисковый индекс.
Обход идет по расписанию, с повторными заходами. Копию сайта система у себя не держит. Это видно в логах: один и тот же адрес бот запрашивает заново при каждом обращении к теме, и у популярных материалов визитов набирается больше, чем ожидают админы. Поэтому медленный отклик сервера тут стоит дороже, чем в поиске.
Второе отличие видно глазами. Источники в ответе открыты и пронумерованы: рядом с утверждением стоит номер ссылки. Гадать, откуда взялась формулировка про ваш продукт, не нужно: ссылка открывается, и на странице виден тот самый текст. У систем, которые показывают только итог, такой сверки нет.

Для маркетолога это меняет характер разговора. Обсуждать, что модель про вас «знает», больше не требуется: перед вами конкретный список адресов, и по нему видно, кто рассказывает историю вашей категории. Часто там оказываются не сайты компаний, а обзоры и профильные издания. Тогда работа идет с размещением, и переписывание главной страницы тут не поможет.
Поэтому с Perplexity удобно начинать замер видимости: ответ по вашему запросу приходит за минуту, и сразу понятно, кто в нише занял место источника.
<!--tg-cta-->
Проверка за пятнадцать минут
Нужны браузер и доступ к логам сервера. По опыту весь порядок занимает около пятнадцати минут.
- Возьмите запрос, по которому сайт стоит в верхней части органики, и задайте его системе так, как спросил бы клиент. Брендовые вопросы вроде «чем хороша компания N» на этом шаге бесполезны: клиент их не задает.
- Разверните список источников под ответом. Откройте каждый и найдите процитированный фрагмент.
- Тот же вопрос задайте еще в двух-трех формулировках. Один запрос не показывает ничего: набор источников меняется от вопроса к вопросу.
- Спрашивайте в чистой сессии, без истории предыдущих вопросов. Иначе система тянет контекст из прошлого диалога, и вы измеряете свои же подсказки.
- В журнале сервера посмотрите, заходил ли PerplexityBot и на какие адреса. Фильтр по имени бота, глубина - месяц.
- Убедитесь, что доступ этому боту открыт. Общего разрешения для поисковых роботов мало, каждое имя проверяется само по себе.
Результаты сразу записывайте в таблицу: дата, формулировка вопроса, процитированные домены, есть вы в списке или нет. Без нее повторный замер через месяц не с чем будет сравнить, а память тут подводит: ответ на тот же вопрос каждый раз другой.
Дальше три исхода, и работа под каждый разная.
Цитируют конкурентов, вас нет. Сайт системе доступен, но страница проигрывает по содержанию: ответ на вопрос в ней не выделен или тема раскрыта слабее, чем у соседей по списку. Работа идет с текстом и структурой. Полезно открыть процитированную страницу конкурента и посмотреть, какой ее кусок ушел в ответ. Чаще это два-три предложения под конкретным подзаголовком.
Не цитируют никого из ниши, в источниках агрегаторы и общие статьи. Тему в открытом вебе никто не закрыл. Ситуация выгодная: страница, которая отвечает на вопрос прямо, занимает место быстро.
Краулер не заходил вовсе. Тогда до содержания дело и не дошло, разбираться нужно с доступом.
Разовая проверка дает точку. Чтобы видеть движение, ее повторяют по одному и тому же списку запросов, и тут пригодится методика замера видимости в нейросетях.
Доступ: почему бот не доходит до страниц
Причин три.
Самая простая - запрет в правилах обхода. Правила писались годы назад, когда этих ботов не существовало, и AI-краулеры попали под общий запрет вместе со скраперами. Проверяется за минуту. Какие директивы писать и кого пускать на сайт, показывает статья AI-краулеры: пускать, ограничивать или закрывать.
Дальше защита сервера. Стандартные настройки CDN и антибот-фильтров считают частый обход подозрительным трафиком и отдают боту заглушку или ошибку. В логах остается визит, но код ответа показывает, что содержимое боту не ушло. У Cloudflare и похожих сервисов для AI-ботов есть отдельные настройки, и разрешение там включают руками. Названия пунктов там меняются, поэтому смотреть нужно в своей панели защиты: файл с правилами обхода тут ничего не решает.
Случай встречается чаще, чем кажется. И обиднее прочих: формально все открыто, разработчик показывает файл правил и разводит руками, а бот месяцами получает страницу проверки браузера вместо содержимого. На разбор уходит примерно полчаса: выгрузить визиты по имени агента и посмотреть коды ответов. Дальше видно, какое правило срабатывает.
Отдельная деталь для логов: имя агента подделает кто угодно, поэтому часть визитов PerplexityBot в журнале к системе отношения не имеет. Подлинные обращения приходят с адресов, которые сервис публикует, и сверка по обратному DNS отсекает самозванцев. Для решения о доступе это важно: закрывать бота из-за нагрузки, которую создал чужой скрапер, смысла нет.
Третья причина - скорость. Времени на страницу у краулера немного: тяжелую он запрашивает реже, а забирает только то, что успел получить. На сервере это чинят так: сокращают время до первого байта и отдают основное содержимое без ожидания сторонних скриптов. Заодно чистят цепочки редиректов. Ускорение помогает всем системам сразу, эта реагирует заметнее.
Есть еще совет, который ходит по обсуждениям: отдавать боту одно содержимое, посетителю другое. Аргумент такой, что правил у этих систем опубликовано мало, значит и спроса не будет. Для заказчика это риск, а не прием. Схема неуправляемая: правил вы не знаете, а поменяться они могут в любой момент, и тогда переделывать придется весь сайт. Плюс содержимое, которое уходит боту, открыто любому - исходный код страницы смотрит и клиент, и конкурент.
JavaScript: главная причина невидимости
Краулер этой системы не выполняет скрипты: он берет то, что сервер отдал в ответ на запрос, и на этом останавливается. На своем сайте это проверяется за минуту, тест ниже. Google и Яндекс страницу с клиентской сборкой отрисуют: у них для этого есть отдельный этап обработки. Здесь такого этапа нет.
Сайт нормально стоит в поиске, трафик идет, Search Console показывает страницы в индексе. В ответах Perplexity компании нет вообще, ни по одному запросу. Владелец ищет причину в содержании и переписывает тексты, хотя система этих текстов не видела: ей ведь пришел пустой каркас с подключенными скриптами.
Что при этом достается боту, зависит от сборки. Иногда доезжают заголовок, описание и меню, иногда только служебный блок с просьбой включить JavaScript. Карточка товара с ценой, характеристиками и отзывами не доезжает почти никогда, потому что подтягивается запросом к API уже после загрузки. Для интернет-магазина это означает, что в ответах он существует как название без ассортимента.
Болеют этим одностраничные приложения на React, Vue и подобных фреймворках с клиентской сборкой, часть визуальных конструкторов и любые разделы, где содержимое подгружается по прокрутке. Фраза «у меня в браузере все открывается» тут ничего не доказывает: браузер скрипты выполняет, краулер нет.
Проверка занимает минуту. Откройте исходный код страницы и поищите в нем любой абзац из середины текста. Нашли - содержимое отдается сервером. Не нашли - страница собирается в браузере, и для краулера она пустая. То же самое покажет запрос через curl, если удобнее из консоли. Проверять стоит не главную, а те разделы, ради которых вас должны цитировать: карточки, услуги, статьи.
Решений три: отдавать готовый HTML с сервера, включать предварительный рендеринг для ботов или выносить критичное содержимое прямо в код страницы, а остальную логику держать на скриптах. Что выбрать, зависит от стека и от того, кто ведет разработку. Варианты со сроками и ценой ошибки разобраны в статье сайт на JavaScript и нейросети.
Что цитируется чаще
Закономерности ниже - наблюдения по нашим замерам, а не правила сервиса. Одного запроса для выводов мало: нужна серия по одному списку вопросов, с источниками в таблице. По вашей нише картина может отличаться, и набирается она тем же способом.
Прямой ответ в начале раздела. Страница, где после подзаголовка сразу идет ответ в два-три предложения, попадает в цитату чаще, чем та, где он размазан по разделу. Система забирает фрагмент, а не страницу целиком, и про его устройство есть разбор извлекаемого ответа.
В замерах свежесть тут весит больше, чем в поиске. Если перестать публиковать, видимость проседает быстрее: старые страницы уступают место тем, что обновлялись недавно. Дата обновления при этом должна быть честной, переклейка числа без правок ничего не дает.
Помогают упоминания за пределами сайта. Когда про вас пишут отраслевые издания и подборки, шанс попасть в источники растет: чужая страница цитируется наравне с вашей.
Безымянная инструкция проигрывает странице, где есть имя автора, должность и профиль. Разметка сама по себе тут мало что дает. Работает связка: имя встречается на сайте и за его пределами, поэтому системе есть чем подтвердить компетенцию.
Конкретика уходит в цитату чаще общих формулировок: цифры, сроки, названия инструментов, условия, при которых совет работает. Абзац без единого проверяемого факта пересказывать нечем.
В наших замерах YouTube у этой системы в источниках попадается чаще, чем у остальных. Ставка на видео оправдывается не в каждой нише, но проверить ее стоит, и выбор площадок описан в материале где размещать контент для нейросетей.
Система еще и разворачивает исходный вопрос в набор связанных запросов, а потом ищет по всем сразу. Поэтому в источники попадают страницы, которые под сам вопрос никто не писал: они ответили на боковую формулировку. Механику разбирает статья что такое query fan-out.
Связь с органикой при этом сохраняется. Страницы из верхней части поиска цитируются заметно чаще остальных, так что работа над позициями окупается и здесь.
Чем набор источников отличается от ChatGPT
Один и тот же вопрос, заданный двум системам, дает два разных списка источников. Пересечение бывает, но опираться на него нельзя.


Причина в устройстве. ChatGPT достает источники через индекс Bing: если страницы в этом индексе нет, до ответа она не доберется, как бы хорошо ни была написана. Perplexity обходит сайты сама и запрашивает их в момент ответа, поэтому от индексации в Bing она не зависит.
Разница видна и в составе списка. По замерам у ChatGPT чаще всплывают энциклопедии и крупные агрегаторы, у Perplexity - редакционные материалы, обзоры и ролики. Картина не универсальная: ниша и формулировка сдвигают ее, поэтому вывод по одному запросу на всю тему не переносится.
Отсюда разный набор действий. Для ChatGPT первый шаг - подтвердить сайт в инструментах Bing и убедиться, что страницы там есть, а на этот случай написана инструкция по индексации в Bing. Для Perplexity первый шаг - логи и доступ бота. Общее у двух наборов только содержание страниц.
Компания может стабильно попадать в ответы одной системы и полностью отсутствовать в другой, а по одной проверке этого не увидеть. Замер идет по каждой системе отдельно, план действий тоже, а порядок работы под ChatGPT собран в статье как попасть в ответы ChatGPT.
Когда ресурс ограничен и заниматься всем сразу не получается, начинают с общей технической части, она для всех одинаковая. Дальше - система, в которой сидят ваши клиенты. Ее показывает отчет об источниках трафика: переходы из ответов приходят как визиты с домена сервиса. У Perplexity в этом отчете есть особенность: она ставит ссылку явно, поэтому переходы от нее видны в статистике раньше и полнее, чем от систем, которые ссылками делятся неохотно.
Стоит ли этим заниматься на нашем рынке
Ответ зависит от того, кто ваш клиент.
Публичной разбивки аудитории по Казахстану, Узбекистану и России нет, поэтому долю считают у себя: отчет по источникам трафика за квартал показывает, сколько переходов дала эта система против остальных. Если весь спрос локальный и бытовой (доставка, услуги у дома, розница в своем городе), приоритет у тех систем, которыми пользуются каждый день, а эта идет после них. Спорить с этим цифрами роста западного рынка бессмысленно: там другая аудитория.
Аргументы за нее к трафику не сводятся.
Проверяемость. Другие системы не показывают источники так открыто. Гипотезы про содержание страниц дешевле обкатать здесь, а подтвердившиеся переносить дальше.
Фундамент у систем общий. Доступ бота, скорость, отдача HTML с сервера, прямой ответ в тексте работают на все сразу. Настроите сайт под Perplexity - для остальных это уже сделано.
Наконец, состав аудитории. Систему выбирают те, кто ищет глубоко и сравнивает варианты перед решением: закупки, подбор подрядчика, техническая проверка поставщика. Для B2B это дороже, чем строка в общей статистике посещений.
Цена вопроса тоже небольшая. Отдельного бюджета под эту систему нет: работа сводится к тому, чтобы проверить логи, настроить доступ и привести страницы в вид, который читается без скриптов. Все три пункта и без того стоят в очереди технических задач.
Все упирается в один вопрос: ваши клиенты перед покупкой сравнивают варианты и читают обзоры или берут первое, что попалось? В первом случае система входит в список приоритетов, во втором ее ставят в конец очереди и возвращаются к ней, когда закрыты остальные.
Коротко
У Perplexity собственный краулер и открытые пронумерованные источники, поэтому первая проверка обходится без платных сервисов и занимает минуты. Начинать нужно с логов и доступа бота: если PerplexityBot не заходил или получил заглушку от защиты, содержание страниц роли не играет. Самая частая причина отсутствия - сборка страницы скриптами в браузере, краулер их не выполняет. Дальше работают прямой ответ в тексте, свежесть, упоминания за пределами сайта, подпись автора, конкретика и видео. Набор источников здесь свой, и замер в этой системе ничего не говорит про остальные. Массового трафика в регионе она не дает, зато техническая часть работы засчитывается всем системам сразу.
Частые вопросы
Как понять, что краулер заходил на сайт
Нужен журнал сервера или отчет по ботам в панели хостинга: фильтр по имени PerplexityBot, глубина - месяц. Важен и сам визит, и код ответа. Код 200 означает, что содержимое ушло боту, а 403 или 503 - что он получил заглушку от защиты. Веб-аналитика вроде Метрики или GA4 ботов не покажет, туда попадают визиты людей.
Почему сайт есть в поиске, но нет в ответах
Первая причина по частоте - сборка содержимого скриптами. Google и Яндекс страницу отрисуют, PerplexityBot этого не делает, и ему приходит пустой каркас. Вторая причина - блокировка бота защитой сервера при формально открытом доступе в правилах обхода. Обе проверяются раньше, чем начинается работа с текстом.
Через сколько новые страницы попадают в ответы
Если домен уже обходится регулярно и доступ открыт, новая страница появляется в источниках быстро: система запрашивает страницы в момент ответа и не ждет переиндексации. Когда краулер заходит редко, сроки растягиваются: сокращает их частота обхода, а не сам факт публикации. Помогают внутренние ссылки на новую страницу, карта сайта и регулярность выпуска материалов.
Нужно ли настраивать сайт под каждую систему отдельно
Техническая часть общая: доступ ботов, скорость, отдача содержимого с сервера, понятная структура текста. Начинать приходится с разного: для ChatGPT это индексация в Bing, для Perplexity - доступ собственного краулера и скорость отклика. Сначала общая база, потом донастройка под ту систему, где вы теряете больше всего.