Семантическое ядро: сбор, Вордстат и кластеризация
Семантическое ядро: сбор, Вордстат и кластеризация
Семантическое ядро — это структурированный набор поисковых запросов, связанных с продуктами, услугами, задачами и информационными потребностями аудитории сайта.
Хорошее ядро — не длинный файл с ключевыми словами. В нём каждый запрос связан с:
- интентом пользователя;
- тематической группой;
- регионом и типом устройства;
- частотностью и сезонностью;
- существующей или будущей страницей;
- приоритетом для бизнеса;
- статусом работы.
Пример минимальной структуры:
| Запрос | Интент | Кластер | Регион | Страница | Приоритет | Статус |
|---|---|---|---|---|---|---|
| купить септик для дома | коммерческий | септики для дома | Пермский край | /septiki/dlya-doma/ | высокий | создать |
| как выбрать септик | информационный | выбор септика | Россия | /blog/kak-vybrat-septik/ | средний | обновить |
| цена монтажа септика | коммерческий | монтаж | Чайковский | /montazh/ | высокий | есть |
Зачем собирать семантику
Семантическое ядро помогает:
- оценить реальный поисковый спрос;
- построить структуру сайта;
- определить нужные категории, фильтры и посадочные страницы;
- отделить коммерческий спрос от информационного;
- подготовить Title, Description, H1 и содержание страницы;
- найти темы для статей;
- избежать конкуренции нескольких собственных страниц по одному интенту;
- отслеживать позиции и трафик по осмысленным группам;
- приоритизировать SEO-работы по бизнес-ценности.
Поисковая система не знает ваше «эталонное» ядро. Она формирует представление о сайте по доступным страницам, текстам, ссылкам, структуре и пользовательским сигналам. Поэтому задача SEO — не вставить все ключи в текст, а создать понятную архитектуру и полезные страницы под реальные задачи аудитории.
Источники запросов
Не стоит ограничиваться одним сервисом. Обычно используются:
- Яндекс Вордстат;
- Яндекс Вебмастер;
- Google Search Console;
- внутренняя аналитика и поиск по сайту;
- обращения клиентов и переписка с поддержкой;
- названия товаров, услуг и характеристик;
- поисковые подсказки;
- страницы конкурентов;
- каталоги, маркетплейсы и отраслевые форумы;
- профессиональный жаргон, синонимы и ошибки написания;
- базы запросов и SEO-сервисы;
- данные рекламных кампаний.
Вордстат показывает спрос в Яндексе, но не заменяет фактические запросы, по которым уже показывается ваш сайт. Вебмастер и Search Console полезны для поиска страниц с показами, но низким CTR или позициями за пределами топа.
Яндекс Вордстат после редизайна августа 2026 года
24 августа 2026 года Яндекс представил обновлённый интерфейс Вордстата. Данные и основная функциональность сервиса не были изменены, но навигация и часть рабочих сценариев стали другими.
Скриншот из официального анонса Яндекса. Изображение загружается с CDN Яндекса.
Что изменилось
Основные разделы перенесены в левое меню:
- Топ запросов;
- Динамика;
- Регионы;
- API;
- Сайты по запросу;
- Умный помощник;
- Полезные сервисы.
Также появились:
- отдельное поле для минус-слов;
- умный помощник по функциям и интерфейсу сервиса;
- поддержка операторов в подневной статистике раздела «Динамика».
Умный помощник — это навигатор по Вордстату. Его не следует считать отдельным источником частотности или автоматическим специалистом по сбору семантики. Яндекс предупреждает, что помощник может не ответить на узкоспециализированный вопрос.
Топ запросов
Раздел показывает за последний месяц:
- популярные запросы, содержащие введённую фразу;
- похожие запросы;
- фильтрацию по региону;
- фильтрацию по типу устройства;
- экспорт CSV.
Используйте его для расширения маркерного списка, но не добавляйте все найденные фразы автоматически. Похожий запрос может относиться к другому продукту, региону или интенту.
Динамика
По умолчанию Вордстат показывает помесячные данные за последние два года. Детализацию можно переключить:
- по дням;
- по неделям;
- по месяцам.
Ограничения периода:
- подневные данные — до 60 дней от текущей даты;
- недельные и месячные данные — от минимального периода до пяти лет;
- самая ранняя доступная дата — январь 2018 года.
Данные можно фильтровать по региону и устройствам, а затем скачать в CSV.
Скриншот из официального анонса Яндекса: операторы работают в подневной статистике «Динамики».
Динамика помогает отличить:
- устойчивый спрос;
- сезонность;
- краткий новостной всплеск;
- падение интереса к устаревающему продукту;
- влияние праздников и погоды;
- различия между мобильным и десктопным спросом.
Не создавайте постоянную посадочную страницу только из-за одного краткого пика. Сначала сравните несколько лет, связанные запросы и фактические показы сайта.
Регионы
В разделе «Регионы» доступны данные за последние 30 дней:
- число запросов;
- доля запросов в регионе;
- индекс интереса;
- детализация по регионам и городам;
- фильтр по устройствам;
- экспорт CSV.
Индекс интереса выше 100% означает, что доля выбранного запроса в регионе выше его средней доли по стране. Это не количество клиентов и не прогноз конверсий.
Для локального бизнеса всегда сравнивайте:
- Россию целиком;
- нужный регион;
- город;
- соседние города;
- десктопы и смартфоны.
Операторы Вордстата
Операторы помогают уточнять запрос и работают в разделах «Регионы» и «Топ запросов». После обновления все операторы также поддерживаются в подневной статистике «Динамики».
| Оператор | Назначение | Пример |
|---|---|---|
- | исключает слово | доставка -цветы |
! | фиксирует форму слова | купить !собаку |
+ | фиксирует стоп-слово | работа +на дому |
"" | фиксирует количество слов во фразе | "купить автомобиль" |
[] | фиксирует порядок слов | билеты [из москвы в париж] |
() и | | группируют варианты | заказать (роллы|пицца) |
Операторы можно комбинировать. Проверяйте сложную конструкцию на нескольких знакомых запросах, прежде чем собирать по ней большую таблицу.
Как читать частотность
Число рядом с фразой нельзя автоматически трактовать как:
- количество уникальных людей;
- будущий трафик страницы;
- число точных коммерческих запросов;
- прогноз заказов;
- гарантированную позицию сайта.
На значение влияют:
- словоформы;
- вложенные более длинные запросы;
- регион;
- период;
- устройства;
- сезонность;
- операторы;
- повторные запросы пользователей.
Поэтому частотность нужна прежде всего для сравнения спроса внутри одной методики, а не как готовый прогноз посещаемости.
Практический процесс сбора семантического ядра
1. Зафиксировать границы проекта
До сбора запросов запишите:
- какие товары и услуги реально предлагаются;
- в каких регионах работает бизнес;
- что нельзя продавать или обещать;
- какие сегменты клиентов важнее;
- какие страницы уже существуют;
- что считается целевым действием;
- какие темы не относятся к проекту.
Без этого таблица быстро заполняется высокочастотными, но бесполезными фразами.
2. Собрать маркерные запросы
Маркер — короткая исходная фраза, описывающая товар, услугу или задачу.
Источники маркеров:
- каталог;
- прайс;
- меню сайта;
- разговоры с клиентами;
- тикеты поддержки;
- названия у конкурентов;
- синонимы;
- профессиональные и разговорные варианты;
- транслитерация и частые ошибки.
Пример:
септик
станция биологической очистки
канализация для частного дома
автономная канализация
монтаж септика
обслуживание септика
Не смешивайте в одном маркере разные продукты только потому, что пользователь может сравнивать их.
3. Расширить список в Вордстате
Для каждого маркера:
- открыть «Топ запросов»;
- выбрать регион;
- проверить популярные и похожие фразы;
- добавить минус-слова;
- использовать операторы;
- выгрузить CSV;
- повторить для близких формулировок;
- проверить «Динамику»;
- сравнить устройства.
Отдельное поле минус-слов удобно для первичной очистки, но финальная фильтрация всё равно выполняется после объединения источников.
4. Добавить фактические запросы сайта
Из Яндекс Вебмастера и Google Search Console соберите:
- запрос;
- страницу;
- показы;
- клики;
- CTR;
- среднюю позицию;
- страну/регион, если доступно;
- устройство;
- период.
Особенно полезны запросы с:
- большим числом показов и низким CTR;
- позицией 8–30;
- показами у неправильной страницы;
- несколькими конкурирующими URL;
- растущим спросом;
- отсутствующей целевой страницей.
5. Очистить нерелевантные фразы
Удаляйте или помечайте отдельно:
- чужие товары и услуги;
- неподдерживаемые регионы;
- вакансии, если это не раздел карьеры;
- бесплатные материалы, если их нет;
- инструкции, не соответствующие бизнесу;
- запросы с другой трактовкой слова;
- запрещённые или рискованные обещания;
- навигационные запросы другого бренда;
- автоматически сгенерированный мусор.
Не удаляйте информационный запрос только потому, что он не содержит слова «купить». Он может быть началом пути пользователя и темой полезной статьи.
6. Определить интент
Базовые типы:
| Интент | Пример | Тип страницы |
|---|---|---|
| коммерческий | купить септик | категория, услуга, карточка |
| транзакционный | заказать монтаж септика | посадочная с формой/ценой |
| информационный | как выбрать септик | статья, гайд, FAQ |
| сравнительный | тверь или топас | сравнение |
| локальный | монтаж септика чайковский | региональная страница |
| навигационный | официальный сайт бренд | брендовая/служебная страница |
Проверяйте интент по реальной выдаче Яндекса и Google. Формально похожие запросы могут требовать разных страниц, если результаты поиска отличаются по типу.
7. Кластеризовать
Кластер — группа запросов, которые можно полноценно закрыть одной страницей.
Объединять стоит запросы, если у них совпадают:
- задача пользователя;
- тип страницы в выдаче;
- продукт или услуга;
- коммерческий сценарий;
- существенная часть конкурирующих URL.
Не объединяйте только по общему слову.
купить септик
цена септика
септик под ключ
могут относиться к одной коммерческой категории, а:
как работает септик
почему пахнет септик
обслуживание септика
требуют отдельных информационных или сервисных страниц.
Автоматический кластеризатор ускоряет работу, но итог нужно проверять вручную.
8. Сопоставить кластеры со страницами
Для каждого кластера выберите одно действие:
- оставить существующую страницу;
- обновить страницу;
- объединить дубли;
- создать новую страницу;
- поставить redirect;
- добавить canonical;
- отложить;
- отказаться как от нерелевантного.
Один главный интент — одна основная индексируемая страница. Это не абсолютное правило, но хороший способ снизить каннибализацию.
9. Приоритизировать
Приоритет нельзя считать только по частотности.
Пример оценки:
приоритет = спрос
× соответствие продукту
× вероятность конверсии
× маржинальность
× достижимость
÷ стоимость реализации
В таблице достаточно шкалы 1–5 по каждому фактору. Не создавайте псевдоточную формулу с десятыми долями, если исходные оценки субъективны.
10. Подготовить задание на страницу
Для каждой страницы зафиксируйте:
- основной интент;
- основной кластер;
- дополнительные вопросы;
- целевое действие;
- тип страницы;
- обязательные факты и характеристики;
- регион;
- направление Title/H1;
- ссылки на связанные страницы;
- требования к schema.org;
- источники и экспертов;
- критерий готовности.
Не превращайте семантику в инструкцию повторить каждую фразу определённое число раз. Современный текст должен полноценно решать задачу, а не имитировать статистику слов.
Автоматизация и API
Для небольшого сайта ручной сбор Вордстата и данных вебмастеров может быть достаточен. Для большого проекта используются:
- CSV-выгрузки;
- API;
- Key Collector и аналоги;
- базы запросов;
- сервисы анализа конкурентов;
- кластеризаторы;
- собственные скрипты очистки и объединения.
Актуальная справка Яндекса указывает, что возможности API Вордстата доступны через Wordstat API в составе Yandex Search API. Перед автоматизацией проверьте текущие квоты, авторизацию, стоимость и формат ответа.
При объединении выгрузок храните источник каждой строки:
wordstat_top
wordstat_similar
webmaster
search_console
internal_search
competitor
support
manual
Это позволяет оценить качество источника и повторить сбор позднее.
Что проверять после внедрения
Семантическое ядро — рабочий набор данных, а не одноразовый документ.
Через 4–12 недель после публикации проверьте:
- какие запросы появились в показах;
- какая страница ранжируется;
- нет ли каннибализации;
- изменился ли CTR;
- появились ли новые формулировки;
- соответствует ли трафик региону;
- есть ли конверсии;
- не устарела ли частотность;
- не изменился ли интент выдачи;
- какие кластеры нужно разделить или объединить.
Обновляйте ядро после:
- запуска нового продукта;
- выхода в новый регион;
- изменения терминологии;
- крупного обновления сайта;
- изменения спроса;
- появления новых конкурентов;
- заметного поискового апдейта.
Типичные ошибки
- Собирать только высокочастотные запросы.
- Считать частотность прогнозом трафика или продаж.
- Не выбирать регион и устройства.
- Игнорировать сезонность.
- Создавать отдельную страницу для каждой словоформы.
- Объединять разные интенты из-за одного общего слова.
- Копировать все похожие запросы без проверки релевантности.
- Строить структуру только по конкуренту.
- Хранить ключи без связи со страницами.
- Не учитывать существующие показы сайта.
- Автоматически доверять AI-помощнику или кластеризатору.
- Не проверять выдачу вручную.
- Не пересматривать ядро после публикации.
Минимальный checklist
- [ ] Определены продукты, регионы и ограничения бизнеса.
- [ ] Собраны маркеры, синонимы и пользовательские формулировки.
- [ ] Вордстат настроен на нужный регион и устройства.
- [ ] Использованы минус-слова и операторы.
- [ ] Проверена «Динамика» и сезонность.
- [ ] Добавлены запросы из Вебмастера и Search Console.
- [ ] Удалены нерелевантные фразы.
- [ ] Для каждого запроса определён интент.
- [ ] Запросы объединены в проверенные кластеры.
- [ ] Каждый кластер связан со страницей или задачей.
- [ ] Проверена каннибализация.
- [ ] Приоритет учитывает бизнес-ценность, а не только частотность.
- [ ] После внедрения запланирована повторная проверка.
