Список запросов, под которые оптимизируют сайт, собирают один раз в начале работы — и потом полгода живут с последствиями. Ошибка здесь не исправляется текстами и не компенсируется ссылками: если страница заведена под формулировку, которой никто не ищет, она не будет показываться, сколько её ни улучшай. Ниже — порядок, по которому мы собирали семантическое ядро для собственного сайта в августе 2026 года: 1195 фраз на входе, 589 после чистки, и что из этого выяснилось по дороге.
Что входит в семантическое ядро и чего в нём быть не должно
Семантическое ядро — это перечень формулировок, которыми люди ищут то, что вы продаёте, с указанием спроса по каждой и с привязкой к странице, которая на неё отвечает. Три части здесь равнозначны. Список без цифр спроса не даёт понять, что важнее. Цифры без привязки к страницам не превращаются в план работ. Привязка без списка — это просто структура сайта, придуманная из головы.
Чего в семантическом ядре быть не должно: запросов, по которым вы не можете дать ответ; запросов чужого региона; информационных формулировок вперемешку с коммерческими. Последнее — самая частая порча. «Как выбрать подрядчика» и «заказать продвижение» — разный интент и разные типы страниц. Собранные в одну кучу, они дают страницу, проигрывающую по обоим направлениям.

Синонимы собираются до парсинга, а не после
Порядок, который нарушают чаще всего. Прежде чем идти в Вордстат, нужно выписать все способы назвать вашу услугу или товар. Автосервис — это ещё СТО, автомастерская, техцентр. Продвижение — это раскрутка, оптимизация, вывод в топ. Стоматология — это клиника, зубной, стоматологический центр.
Пропущенный синоним не просто уменьшает список запросов. Он может оказаться самым частотным вариантом — и тогда весь дальнейший сбор построен вокруг второстепенного слова. Проверяется просто: каждый синоним пробивается по частотности отдельно, до основного сбора. Если один из них даёт спрос в разы выше того, с которого вы начали, — начинать надо было с него.

Частотность только точная
Вордстат по умолчанию показывает базовую частоту: она включает все словоформы и все вложенные фразы. Запрос «продвижение сайта» с базовой частотой в десятки тысяч на деле складывается из сотен разных формулировок, и по самой фразе ищут в разы меньше.
Точная частота задаётся оператором: фраза берётся в кавычки, перед каждым словом ставится восклицательный знак. Разница между базовой и точной в коммерческих нишах доходит до порядка. Планировать страницы по базовой — значит заводить их под спрос, которого нет.
Частотность для своего семантического ядра мы снимали через Вордстат по программному интерфейсу Yandex Cloud. Отдельно отметим, потому что сами две недели заблуждались: для этого не нужна одобренная заявка в Яндекс.Директе. Достаточно ключа Cloud Search API — сервисный аккаунт, ключ, и запросы идут сразу. Ограничение там другое: примерно после полусотни обращений подряд сервис начинает отвечать отказом, так что большое ядро снимается частями.

Чистка: минус-слова и нули
Сырой список всегда содержит мусор трёх видов. Первый — чужой интент: «своими руками», «бесплатно», «скачать», «вакансии», «отзывы сотрудников», «б/у». Второй — чужой регион. Третий — нулевая частотность: фразы, которые технически существуют, но их не ищут.
Чистка делается минус-словами по списку и затем удалением всего, что после уточнения частоты оказалось нулевым. У нас из 1195 фраз после этого осталось 589 — то есть половина сырого списка была мусором. Это нормальная пропорция, и пугаться её не стоит; пугаться стоит, если после чистки осталось почти всё — значит, чистили невнимательно.

Кластеризация семантического ядра: по выдаче, а не по совпадению слов
Здесь проходит граница между работой и её имитацией. Разбить запросы на группы можно двумя способами.
Первый — по общим словам: всё, где есть «замена масла», в одну кучу. Способ быстрый, и для черновой прикидки объёма работ он годится. Но он ошибается ровно там, где ошибка дороже всего: два запроса могут состоять из одних слов и при этом означать разное, а два запроса без единого общего слова — означать одно и то же.
Второй способ — по пересечению выдачи. Берутся первые десять результатов по каждому запросу и сравниваются между собой. Если по двум формулировкам поисковая система показывает во многом одни и те же страницы — она считает их одной темой. Значит, это один кластер и одна посадочная страница. Если выдача расходится — сколько бы общих слов ни было, это разные страницы.
Порог пересечения задаётся числом общих адресов: три-четыре совпадения из десяти — мягкая группировка, шесть и более — жёсткая. Жёсткая даёт больше групп и меньше ошибок, мягкая — компактнее, но требует ручной проверки. Для сайта услуг обычно берут жёсткую по коммерческим запросам и мягкую по информационным.
Кластеризация семантического ядра по выдаче требует парсинга результатов поиска — вручную это делается только на очень маленьких списках. Для нашего объёма мы использовали черновую группировку по словоформам, а спорные группы проверяли по выдаче руками.

Один кластер — одна страница
Правило без исключений. Два кластера на одной странице означают, что она будет проигрывать по обоим: поисковая система не понимает, о чём страница, и предпочтёт документ, посвящённый чему-то одному.
Обратная ошибка тоже встречается: один кластер размазан по трём страницам, и они конкурируют между собой. Внешне это выглядит как «сайт большой, а позиций нет».
После группировки каждый кластер получает маркер — самый частотный запрос группы. От него потом пишется заголовок страницы, от него же считается, попала страница в тему или нет.

Проверка результата: гиганты и одиночки
Готовое семантическое ядро проверяют двумя взглядами.
Гиганты. Группа из двухсот запросов почти наверняка склеилась из нескольких тем — её нужно разбирать. Обычно виновато фоновое слово: название региона или самой услуги, которое есть почти в каждом запросе и потому склеивает всё подряд.
Одиночки. Кластеры из одного-двух запросов с низкой частотой не заслуживают отдельной страницы. Их либо присоединяют к близкой группе, либо закрывают разделом внутри большой страницы.
Здоровая картина для сайта услуг — большинство групп по пять–двадцать запросов, несколько крупных под основные направления и хвост одиночек, который уходит в блог.

Что делать с семантическим ядром дальше
Готовый список сам по себе позиций не даёт. Дальше он превращается в три вещи.
Структура. Семантическое ядро превращается в карту сайта: каждый кластер — либо существующая страница, либо страница, которой нет. Второй список и есть план работ на ближайшие месяцы, отсортированный по спросу.
Техзадания. Маркерный запрос идёт в заголовок, остальные фразы группы — в текст, объём берётся по медиане тех, кто уже в топе по этому запросу. Это тема отдельного разговора — тексты под низкочастотные запросы, но начинается всё здесь.
Отслеживание. Список запросов загружается в систему проверки позиций, и дальше вы смотрите не на «сайт вырос», а на конкретные строки. Мы держим свои 589 фраз в Топвизоре и сверяемся с данными Search Console: расхождение между тем, где сайт стоит, и тем, по чему он реально получает показы, обычно и есть самое полезное наблюдение.

Чего сбор семантического ядра не решает
Честная граница метода. Семантическое ядро показывает, какой спрос существует, и не создаёт спроса, которого нет. Мы столкнулись с этим на собственном проекте: по всей коммерческой тематике в Екатеринбурге набралось около 180 обращений в месяц. Никакая работа с текстами этот потолок не поднимает — она позволяет взять большую долю от него.
Второе ограничение: семантическое ядро не заменяет позиции. Между «страница заведена под кластер» и «страница показывается по нему» лежат месяцы, а для молодого домена — больше. По нашим замерам страница попадает в индекс Яндекса примерно за двое суток, а путь от индексации до первой десятки считается уже не сутками.
Третье: часть информационных запросов семантического ядра сегодня закрывается ответом прямо в выдаче, и переход на сайт по ним не происходит вовсе. Для информационной части ядра прогноз трафика стоит уменьшать, а не считать по старым таблицам кликабельности.

Порядок в семи шагах
- Выписать синонимы услуги и проверить частотность каждого — до основного сбора.
- Снять запросы по каждому синониму и по конкурентам.
- Уточнить частоту в точном виде, оператором с кавычками и восклицательными знаками.
- Вычистить минус-словами и удалить нулевые.
- Сгруппировать по пересечению выдачи, а не по общим словам.
- Проверить на гигантов и одиночек, назначить маркер каждой группе.
- Разложить группы по страницам: одна группа — одна страница, без исключений.
Дальше начинается работа с самими страницами. Если хотите увидеть, в каком состоянии сайт подходит к этому этапу, — бесплатная проверка сайта занимает полминуты и показывает техническую часть. Сбор и кластеризация семантического ядра входят в SEO-продвижение первым этапом — там же порядок остальных работ. Какие запросы сайт уже отрабатывает, показывает расширенный аудит.
