Голосовой поиск и разметка Speakable

Голосовой ассистент зачитывает один источник, поэтому второе место в таком ответе отсутствует.
Голосовой поиск не заменил обычный. Доля пользователей держится около двадцати процентов с 2022 года и не растет. В голосовом ответе одно место, второго нет вообще. По локальным запросам конкуренция за него низкая. Разбираем формат ответа под озвучку, разметку Speakable и ее нынешний статус у Google, а еще случаи, когда браться за голос не стоит.

Что от голосового поиска осталось к 2026 году

В 2016-2018 годах голосовой поиск подавали как смену интерфейса. По презентациям кочевал прогноз со ссылкой на ComScore: к 2020 году половина запросов станет голосовой. Половины не вышло. Голос встал в один ряд с волнами, которые обещали больше, чем дали: мобильная выдача 2015 года, AMP, потом чат-боты.

Замеры показывают другое. По данным DataReportal, доля интернет-пользователей, которые обращаются к голосовому поиску, была максимальной во втором квартале 2022 года: 22,5 процента. К середине 2024 года она составила 20,5 процента. Между этими двумя точками показатель не поднимался выше двадцати двух процентов и не опускался ниже девятнадцати. Данных свежее середины 2024 года в этих замерах публично нет.

Устройств при этом стало больше. По оценке Statista на 2024 год, в работе около 8,4 миллиарда голосовых ассистентов против 4,2 миллиарда в 2020-м. Часть прироста дают квартиры, где ассистент стоит не в одном месте: по данным Яндекса, опубликованным в июле 2026 года, число владельцев двух и более Станций за год выросло в полтора раза.

Отсюда и расхождение в оценках, из-за которого одни пишут про треть всех запросов, а другие про пятую часть аудитории. Считают разные вещи:

  • доля людей, которые хотя бы иногда пользуются голосом, около двадцати процентов по DataReportal
  • число устройств с ассистентом, больше восьми миллиардов по Statista
  • доля запросов, продиктованных голосом: сюда попадает и диктовка в поисковую строку

Последний пункт и раздувает цифру. Диктовка и голосовой ответ дают разный результат. В первом случае человек проговаривает запрос, смотрит на экран и дальше работает с обычной выдачей: десять ссылок, блоки, карты. Во втором случае экрана либо нет, либо на него не смотрят, и ассистент зачитывает вслух один вариант.

Чаще ассистент оказывается под рукой там, где рядом есть экран. По данным Edison Research за 2022 год, 56 процентов пользователей обращаются к ассистенту со смартфона и 35 процентов с умной колонки. Со смартфона ответ тоже звучит вслух, но человек опускает глаза на выдачу и выбирает сам. У колонки такой развязки нет: что прозвучало, то и ответ.

Есть и вторая причина, по которой голос не съел поиск. Колонку покупают не ради поиска компаний. По замерам того же Edison Research, ассистента чаще просят включить музыку, реже спрашивают погоду, следом идут будильники и таймеры. Яндекс в июльской статистике 2026 года описывает картину похоже: на кухне через колонку диктуют списки покупок и ставят таймеры, а в гостиной управляют телевизором. Поиск организации встроен в этот набор, но стоит в нем не первым.

Отдельный проект под голос не окупится: аудитория стоит на месте, переходы нечем отследить. А если вы и так работаете над прямыми ответами, голосовой ответ достается почти без дополнительных затрат: требования к тексту совпадают. Это одна из поверхностей, за которые борется AEO, наравне с блоком быстрого ответа и сводками нейросетей.

Один источник и ни одного второго места

В обычной выдаче человек видит десять органических результатов, рекламу, карты, блок быстрого ответа. Он сравнивает и выбирает сам. Вы можете стоять на третьей позиции и получать свою долю кликов.

Голосовой ответ устроен иначе. Ассистент проговаривает одну формулировку и называет один сайт. Второго места здесь нет, поэтому и разницу в кликах считать не от чего.

Арифметика тут неприятная. В обычной выдаче падение с первой позиции на третью стоит вам части трафика. В голосовом сценарии такое же падение отнимает все: ассистент назовет конкурента и на этом закончит. Зато и обратное верно. Когда вы забрали это место, делить показы уже не с кем.

Самый подробный публичный разбор того, откуда ассистент берет текст, сделал Backlinko в 2018 году на выборке из 10 000 запросов к Google Home. Тогда 40,7 процента звучавшего текста ассистент брал из блока быстрого ответа. Около трех четвертей источников стояли в первой тройке обычной выдачи. Замер старый, все цифры Backlinko в этой статье оттуда же, и часть их с тех пор поплыла. Связь между блоком быстрого ответа и озвучкой при этом никуда не делась. Механику захвата этого блока мы разобрали в статье про нулевую позицию.

Оттуда же цифра про источник: около 70 процентов ответов Google Home упоминали сайт, откуда взят текст. Перехода вы не получите, а название компании прозвучит в комнате, и ни одна система аналитики этого не покажет. По нашей оценке, для узнаваемости такое упоминание стоит дороже баннерного показа, но измерить его нечем, поэтому и в отчет оно не попадет.

Голосовой ассистент отвечает на запрос и называет один источник
В голосовом ответе нет второго места: ассистент зачитывает один источник и на этом останавливается.

Источники у ассистентов разные, и от этого зависит, куда смотреть:

  • Google Assistant опирается на индекс Google. Самого ассистента в 2026 году переводят на Gemini, то есть голосовой помощник на Android постепенно сливается с тем, что отвечает вам в чате
  • Алиса работает на индексе Яндекса и на собственных источниках, включая карточки организаций
  • Alexa исторически строилась вокруг Bing, поэтому англоязычным проектам приходится отдельно пробиваться в индекс Microsoft
  • Siri комбинирует несколько поставщиков данных и подключенные модели

В обсуждениях почти всегда путают голосовой ответ колонки и нейроответ в поиске Яндекса, а это разные поверхности. В колонке звучит один источник. В поиске Алиса собирает сводку из нескольких страниц и показывает ссылки. Работа частично общая, требования к тексту разные. Про то, как попасть в нейроответ, есть отдельный материал.

Разметка Speakable: что помечает и что дает сейчас

Speakable, свойство словаря Schema.org, помечает фрагменты страницы, пригодные для чтения вслух через синтез речи. Ставится на объект Article или WebPage. Придумывали его в 2018 году под узкую задачу: подсказать ассистенту, какой фрагмент зачитать, когда пользователь просит новости по теме.

Внутри объекта SpeakableSpecification задают селекторы: либо cssSelector, либо xPath, но не оба сразу. Селекторы указывают на заголовок и выжимку. Google советует держать в каждом помеченном фрагменте 20-30 секунд звучания, то есть две-три фразы.

Фрагмент разметки Speakable в исходном коде страницы
Разметка Speakable указывает, какие именно фрагменты страницы пригодны для чтения вслух.

Статус разметки пересказывают неточно. В документации Google свойство Speakable до сих пор помечено как бета. Написано, что оно работает для пользователей в США, у которых устройство Google Home настроено на английский язык, и для англоязычных издателей. Документация обновлялась 10 декабря 2025 года, оговорка про страну и язык там прежняя. Выход в другие страны Google связывает с тем, сколько издателей внедрит разметку.

Требования Google к тому, что размечать нельзя, разумны и без всякого голоса:

  • дата и место события, подписи под фотографиями, указание источника: вслух это звучит как обрывок
  • статья целиком: озвучка оборвется на середине и слушатель потеряет главное
  • текст, из которого нельзя вытащить законченную мысль двумя предложениями

Дальше идет наблюдение, а не правило. Разметка показывает, какой фрагмент страницы сам автор считает ответом, и такой текст, судя по всему, проще забирают генеративные системы, а не только колонка. Google этого не подтверждал ни строчкой, публичного замера с выборкой, который бы это показал, тоже нет. Мы держим Speakable в списке гипотез: ставим там, где короткий ответ на странице уже есть, и прироста цитирований от одной разметки не ждем.

Косвенный аргумент в пользу того, что разметка работает дольше своих витрин: расширенные результаты FAQ Google сворачивал в два приема. В 2023 году оставил их только госсайтам и медицине, а 7 мая 2026 года убрал совсем, отдельным уведомлением в документации. Сама разметка при этом осталась допустимой, и машины ее по-прежнему читают. Видимый результат и машинная польза от структурированных данных существуют по отдельности.

Ставить Speakable имеет смысл на заголовок с выжимкой статьи и на первый абзац раздела с прямым ответом. Годится и короткий ответ в блоке вопросов. А на странице контактов или в разделе, где ответ размазан на три абзаца, помечать нечего.

У сайтов на конструкторах тут своя проблема. Свойство cssSelector цепляется за класс элемента, а конструкторы генерируют классы автоматически и меняют их при пересборке страницы. Разметка после этого указывает в пустоту, и ошибку никто не покажет: расширенных результатов у нее нет, значит и в отчетах Search Console пропажа не всплывет. Надежнее держать разметку на стабильном контейнере и перепроверять селекторы после каждой правки шаблона.

Какие еще типы разметки ставить и в каком порядке - в материале про Schema.org для нейросетей. Speakable в этом наборе стоит последним по приоритету: без Organization и Article эта разметка мало что добавит.

Как писать текст, который читается вслух

Правила тут жестче обычных. Слушатель ведь не может вернуться взглядом на строку выше.

Ответ идет первым. Одно-два предложения сразу под заголовком, дальше подробности. По замеру Backlinko 2018 года средняя длина голосового ответа составляла 29 слов. Это примерно три строки текста.

Предложение с двумя придаточными и уточнением в скобках на слух рассыпается: к концу фразы слушатель уже не помнит начало. Разбивайте на два.

Ответ должен быть самодостаточным. Его зачитывают без соседних абзацев, поэтому местоимения без опоры убивают смысл. «Он занимает до трех дней» вслух не значит ничего. Повторите подлежащее: «Перевод занимает до трех дней».

Запись «10:00-22:00» ассистент прочитает как получится, адрес «мкр. Самал-2, 111/3» превратится в набор цифр. Продублируйте текстом: с десяти утра до десяти вечера. То же с валютой и сокращениями. Сумму «от 15 000 ₸» лучше расшифровать словами: «от пятнадцати тысяч тенге», потому что символ валюты синтез речи то проглатывает, то читает как название. А «ИП» и «ТОО» ассистент читает по буквам, и это сбивает ритм фразы.

Синтез речи читает названия вроде Google Business Profile то по-английски, то по буквам, и предсказать это заранее нельзя. В абзаце, который метит в озвучку, латиницу лучше не ставить вовсе или давать рядом русское написание.

Формулировки «в таблице выше» и «смотрите ниже» слушателю ничего не дают. В абзаце под озвучку их быть не должно. Это же касается списков: семь позиций подряд на слух не удержать, а вот три коротких пункта укладываются нормально.

Заголовок пишите вопросом, теми же словами, которыми спрашивают вслух: «Сколько стоит доставка по Астане» вместо «Тарифы и условия». Вслух люди говорят длиннее и естественнее, чем набирают руками, поэтому формулировки приходится собирать отдельно. Как это делать, разбираем в материале про промпты вместо ключей.

В разделе сначала идет заголовок-вопрос, под ним ответ в две-три строки, дальше подробности на четыре-пять абзацев. Ответ забирает ассистент, подробности удерживают человека, который читает страницу глазами. Одна и та же структура работает на обе аудитории, поэтому переписывать сайт ради голоса не нужно: достаточно переставить абзацы внутри уже написанных разделов.

Проверить, отделяется ли ответ от текста, недолго. Скопируйте два первых предложения раздела в пустой документ и перечитайте: понятно ли, о какой компании и услуге речь, есть ли в них цифра или срок. Если для понимания нужен заголовок или соседний абзац, ответ пока не готов.

Последнее, самое дешевое. Прочитайте вслух первый абзац каждого раздела. Место, где вы сбились с ритма или полезли глазами назад, ассистент не зачитает.

Локальные запросы: где конкуренция за голос низкая

Голосом спрашивают про то, что рядом и прямо сейчас. По опросу BrightLocal 2018 года среди тысячи американских потребителей 58 процентов искали информацию о местном бизнесе голосом, и колонка оказалась там самым редким устройством: ее назвали 18 процентов. Замер старый и сделан не на нашем рынке, поэтому берем из него не проценты, а набор сценариев. Вопросы складываются в короткий список, который повторяется из ниши в нишу:

  • где ближайшая аптека, шиномонтаж, нотариус
  • работает ли сейчас и до скольки открыто в воскресенье
  • сколько стоит стрижка, замена масла, доставка по городу
  • как доехать и есть ли парковка

Это вопросы с одним правильным ответом. Ассистенту нечего сопоставлять: он называет одно место и одну цифру.

По нашим наблюдениям на проектах в Казахстане и Узбекистане за место в голосовом ответе по локальным вопросам спорят один-два сайта. Это оценка по практике, а не замер с выборкой и периодом. В нишах же, где за первую страницу выдачи бьются два десятка компаний, вслух раз за разом звучит одно и то же название.

Локальный голосовой запрос и ответ ассистента с названием компании
По локальным запросам ассистент называет одну компанию, и конкуренция за это место пока низкая.

Такой ответ чаще питает карточка организации, а не текст сайта: Яндекс Карты, Google Business Profile, 2ГИС. Часы работы, перечень услуг, адрес, отзывы. Отсюда самое частое расхождение: на сайте одно расписание, в карточке другое, и вслух звучит неверное. Проверка занимает десять минут, а ошибка стоит места в ответе.

Второй сбой менее очевиден: это название компании. Ассистент проговаривает его так, как оно записано в карточке. Если там висит юридическое наименование с формой собственности и кавычками, вслух это превращается в невнятную конструкцию, которую человек не запомнит и не повторит. Название в карточке должно совпадать с тем, как клиенты называют компанию вслух. Что еще ассистенты берут из карточек и отзывов, подробно расписано в статье про локальные ответы нейросетей.

Отдельная ниша, о которой пока мало кто думает, это запросы на казахском и узбекском. В конце 2025 года Google объявил о запуске Gemini на казахском языке, а голосовой помощник как раз переходит на эту же модель. Данных по объему таких запросов нет ни у кого, поэтому цифр здесь не приводим. Шаг, который окупается независимо от объема: продублировать названия услуг и часы работы на языке региона в карточке и на сайте.

Как проверить, звучит ли ваш сайт

Замер тут ручной, инструмента с кнопкой не существует.

Соберите список из 10-15 вопросов, записанных теми же словами, которыми их задают вслух. Прогоните через ассистента на телефоне и через колонку, если она есть. По каждому вопросу фиксируйте четыре поля:

  • дата и устройство: телефон или колонка, какой ассистент
  • чей ответ прозвучал: вы, конкурент, справочник или никто
  • назван ли источник вслух
  • дословная формулировка ответа

Последнее поле важнее остальных. Формулировка показывает, с какой страницы взят текст и какой именно абзац сработал. Через месяц пройдите по тому же списку и сравните: изменилась ли формулировка и сменился ли источник.

Дальше проверьте свои страницы в валидаторе Schema.org: распознаны ли селекторы Speakable. Тест расширенных результатов Google для этого не подойдет: у Speakable их нет, и он ничего не покажет.

Частить с замерами не нужно: формулировки ассистентов меняются медленно, а лишние прогоны съедают время без новой информации. Список вопросов при этом не переписывайте от раза к разу, иначе сравнивать будет нечего.

Прямых переходов эта работа не дает: из колонки человек не уходит на сайт вообще, и в аналитике ее не видно. Ориентиры остаются косвенные: блоки быстрого ответа по вашим вопросам, брендовые запросы, звонки и маршруты из карточки организации. Отдельно спрашивайте у новых клиентов, откуда они про вас узнали, и держите вариант с ассистентом в списке ответов. Как собрать из этого связную метрику, разбираем в материале про измерение видимости в нейросетях.

Кому эта работа не нужна

Голос заслуживает места в очереди, но не первого. Есть случаи, когда его стоит вычеркнуть.

Длинная сделка и сложный выбор: промышленное оборудование, недвижимость, корпоративный софт. Вслух уточняют время работы и адрес, а поставщика на год вперед так не выбирают.

В юридических вопросах и медицине ответ не умещается в пару фраз. Короткий ответ вслух там либо неполон, либо опасен, и системы это учитывают: зачитывать скорее откажутся.

Если страницы плохо индексируются, структура заголовков произвольная, а половина текста подгружается скриптом, работа над озвучкой бессмысленна. Сначала техническая база.

Speakable помечает фрагмент, но не создает его. Если короткого ответа на странице нет, ставить разметку не на что.

Есть и обратный признак. Браться за голос стоит, когда клиенты часто задают вопросы с одним коротким ответом: время работы, стоимость типовой услуги, наличие товара, адрес филиала. Такие вопросы приходят в мессенджеры и на телефон каждый день, выписать их можно за неделю. Если набирается десяток повторяющихся вопросов, работа окупится. А когда клиенты начинают со слов «а что вы посоветуете», голосовой ответ не поможет.

Порядок работ, который мы считаем разумным: сначала индексация и структура, потом прямые ответы в тексте и нулевая позиция в выдаче, потом карточка организации, и только затем разметка под озвучку. Перепрыгивать через ступени бесполезно, поскольку голосовой ответ собирается из того же материала, что и остальные ответы.

Коротко

  • По DataReportal доля пользователей голосового поиска держится около двадцати процентов: 22,5 в пике второго квартала 2022 года, 20,5 к середине 2024-го. Замены обычной выдаче не случилось
  • Оценки расходятся, потому что считают разное: людей, устройства или запросы вместе с диктовкой в строку
  • В голосовом ответе один источник и одно место, второго нет; по разбору Backlinko 2018 года 40,7 процента озвучек Google Home приходило из блока быстрого ответа
  • Speakable у Google до сих пор в бете и работает для новостей на английском языке в США, справку обновляли 10 декабря 2025 года
  • По нашим наблюдениям в Казахстане и Узбекистане голосовой ответ по локальным вопросам забирают один-два сайта, а питает его карточка организации
  • Голос идет в очереди работ последним, после индексации, прямых ответов и карточки

Об авторе

Марат Аксанов, сооснователь GEO-агентства HITZ. Занимается видимостью брендов в поисковых системах и ответах нейросетей, ведет собственные замеры цитируемости по рынкам Казахстана и Узбекистана.

Об агентстве

HITZ работает с видимостью бизнеса в нейросетях и поисковых системах на рынках Казахстана и Узбекистана. Направления: GEO, AEO, Local SEO и классическое SEO. Связаться с командой можно в Telegram.

Частые вопросы

Голосовой поиск еще актуален или тему раздули?

Раздули прогноз, а не саму тему. Обещание про половину запросов голосом к 2020 году не сбылось, а замеры DataReportal с 2022 по середину 2024 года показывают одну и ту же пятую часть аудитории. При этом сценарий работает там, где человеку неудобно смотреть в экран: за рулем, на кухне, с ребенком на руках. Затевать под это отдельный проект не стоит, а вместе с работой над прямыми ответами голос достается почти бесплатно.

Что дает разметка Speakable, если голосом нас не ищут?

Она помечает фрагмент, который вы сами считаете ответом на вопрос. Google держит ее в бете и ограничивает новостями на английском в США. Есть наблюдение, что помеченная выжимка проще извлекается и генеративными системами, но подтверждений от Google нет, и мы относимся к этому как к гипотезе. Смысл ставить появляется тогда, когда на странице уже есть готовый ответ в две-три фразы.

Чем голосовой ответ отличается от нейроответа Алисы?

Это разные поверхности. В голосовом ответе колонка зачитывает один источник и называет один сайт. Нейроответ в поиске Яндекса сводит несколько страниц в один текст и дает ссылки на них, а пользователь читает глазами. Источник может совпадать, а текст нужен разный: озвучке подходит только законченный ответ в две-три фразы, сводке хватит четкого фрагмента внутри страницы.

Нужна ли отдельная страница под голосовые запросы?

Нет. По разбору Backlinko 2018 года точное совпадение запроса с заголовком страницы встречалось редко, а ответы приходили из длинных материалов средним объемом около 2300 слов. Отдельные страницы под каждую формулировку дают дубли и каннибализацию. Работающий вариант другой: раздел с заголовком-вопросом внутри большой статьи и прямой ответ в первых двух предложениях под ним.

Как понять, что ассистент читает наш сайт?

Только ручным замером. Соберите 10-15 вопросов в той формулировке, в какой их произносят вслух, задайте ассистентам и запишите, чей ответ прозвучал и назван ли источник. Повторяйте раз в месяц по тому же списку. Прямых переходов из колонки в аналитике не будет, поэтому дополнительно смотрите на блоки быстрого ответа, брендовые запросы и звонки из карточки организации.

С чего начать локальному бизнесу в Алматы или Ташкенте?

С карточки организации, а не с сайта. Ассистент по локальным вопросам чаще берет часы работы, адрес и услуги из Яндекс Карт, Google Business Profile и 2ГИС. Сверьте расписание в карточке с сайтом, заполните перечень услуг и добавьте описание на языке региона. После этого имеет смысл переписать вступления на страницах услуг так, чтобы ответ звучал в первых двух предложениях.

Обсудить проект
+7 706 624 20 40