Семантика с нуля: как собрать ядро и не утонуть в мусоре
6 мин чтения30 карточек товаров + 10 пунктов чек-листа — готовая основа первого поискового замера.
Кому полезноВладельцу сайта и SEO-специалисту
Что станет понятноМаски собирайте словами клиента, а не из прайса — 20–40 базовых фраз из карточек, чатов и скриптов продаж
С чем уйдёте30 карточек товаров + 10 пунктов чек-листа — готовая основа первого поискового замера.
Полный порядок сбора, чистки и кластеризации запросов — от первых масок в Вордстате до готовой структуры сайта и списка посадочных страниц.
- Маски собирайте словами клиента, а не из прайса — 20–40 базовых фраз из карточек, чатов и скриптов продаж
- Частотность проверяйте в кавычках с восклицательным знаком, иначе спрос завышен в разы
- Чистка важнее сбора: после удаления мусора ядро обычно худеет вдвое — и это нормально
- Кластеризуйте по общности топ-10 выдачи: один кластер — одна посадочная страница
- Готовое ядро — не таблица фраз, а список задач по страницам с приоритетами и оценкой трафика
- Шаг 1: маски — фундамент ядра
- Шаг 2: расширение — от масок к сырому списку
- Шаг 3: чистка — самый недооценённый этап
- Шаг 4: кластеризация по выдаче
- Шаг 5: от кластеров к структуре сайта
- Разбор на примере: собираем ядро для магазина дверей
- Как выглядит рабочая таблица ядра
- Шесть ошибок сбора, которые приходится переделывать
- Типичные ошибки при сборе ядра
- Структура сайта под цепочку вопросов, а не под список фраз
- Путь клиента
- Стратегия по шагам
- Чек-лист
- Что в итоге
- Вопросы и ответы
- Источники
Шаг 1: маски — фундамент ядра
Маски — это 20–40 базовых фраз, из которых потом вырастет всё ядро. Главная ошибка на этом шаге — брать формулировки из собственного прайса. Клиент ищет не так, как вы называете товар: вы продаёте «стеллаж металлический сборно-разборный», а человек вводит «полка в гараж». Если маска собрана языком каталога, вы соберёте ядро про себя, а не про спрос.
Рабочие источники масок: названия и характеристики из карточек товаров, скрипты отдела продаж, вопросы клиентов в чате и по телефону, тексты объявлений конкурентов. Полезно 30 минут посидеть с менеджером по продажам — он назовёт формулировки, которых нет ни в одном сервисе.
На выходе шага — таблица масок с разбивкой по направлениям бизнеса. Не гонитесь за количеством: 25 точных масок дадут более полное ядро, чем 100 придуманных.

Шаг 2: расширение — от масок к сырому списку
Каждую маску прогоняем через три источника: Вордстат (левая и правая колонки), поисковые подсказки Яндекса и Google, и база запросов конкурентов из сервисов видимости — последняя часто даёт фразы, до которых вы сами не додумались. На выходе получается сырой список: для локальной услуги — 3–5 тысяч фраз, для интернет-магазина — легко 30–50 тысяч. 1
Обязательный пункт, который пропускают чаще всего: снимайте частотность в кавычках с восклицательным знаком («!фраза»). Базовая частотность включает все вложенные запросы и завышает спрос в разы — на её основе вы будете строить страницы под фразы, которые никто не вводит.
Ориентир по трудозатратам: расширение и съём частотности — это 1–3 дня работы с парсером, а не месяц ручного копирования из Вордстата.

Шаг 3: чистка — самый недооценённый этап
Чистка важнее сбора: лучше маленькое чистое ядро, чем огромное грязное. Из сырого списка убираем нецелевые регионы («купить стеллаж минск» для компании из Москвы), бренды конкурентов, фразы с «бесплатно», «своими руками», «б/у» — если вы это не продаёте. Для коммерческого сайта отдельно отсекаем информационные хвосты: «как выбрать», «что лучше» — это темы для блога, а не для категорий.
Нормальный результат чистки — ядро худеет примерно вдвое. Если после чистки осталось 90% фраз, вы чистили невнимательно. И практичный лайфхак: все удаляемые фразы сразу складывайте в отдельный файл — это готовый список минус-слов для рекламных кампаний в Директе, который иначе будете собирать заново и за деньги.
На этом же этапе видно, по каким запросам сайт вообще сможет конкурировать: если по фразе в топе одни агрегаторы, для неё нужна страница другого типа — с ассортиментом и коммерческими факторами ранжирования, а не текст.

<form action="/api/lead" method="post">
<label>Телефон или почта
<input name="contact" autocomplete="email" required>
</label>
<input type="hidden" name="page" value="/service/">
<button type="submit">Отправить</button>
</form>
Шаг 4: кластеризация по выдаче
Кластеризация отвечает на главный вопрос: какие фразы можно вести на одну страницу, а какие требуют разных. Самый надёжный метод — группировка по общности топ-10 2: если по двум фразам Яндекс показывает одни и те же URL, их можно объединить; если выдача разная — поисковик считает это разными интентами, и страницы нужны разные.
Режим soft объединяет смелее и даёт крупные кластеры — подходит для инфозапросов. Hard требует строгого пересечения выдачи и даёт дробную структуру — правильный выбор для коммерческих запросов. Итог кластеризации — фактически карта будущих страниц сайта.
Железное правило: один кластер — одна посадочная. Два кластера, посаженные на одну страницу, размывают релевантность; один кластер, разнесённый на две страницы, порождает каннибализацию — страницы конкурируют между собой, и позиции скачут у обеих.

Шаг 5: от кластеров к структуре сайта
Каждому кластеру назначаем тип страницы: категория, подкатегория, страница фильтра, карточка товара или статья в блог. Тип подсказывает сама выдача — смотрите, что ранжируется в топе по главной фразе кластера. Если там категории магазинов, статья в топ не встанет, сколько её ни оптимизируй. 3
Дальше расставляем приоритеты: по суммарной частотности кластера и по текущим позициям сайта. Кластеры, где вы уже на 11–20 местах, дают самый быстрый прирост — их в работу первыми. Учитывайте и техническую готовность страниц: медленные шаблоны сначала придётся ускорить, потому что скорость сайта влияет и на ранжирование, и на конверсию.
Готовое ядро — это не таблица на 20 тысяч строк, а список задач: какую страницу создать или доработать, под какие запросы, с каким приоритетом и какой оценкой трафика. В таком виде семантика превращается в план работ на месяцы вперёд — как это выглядит в деле, видно по нашему кейсу роста трафика интернет-магазина в 4 раза.

Разбор на примере: собираем ядро для магазина дверей
Покажем весь путь на конкретной нише — межкомнатные двери. Цифры условные, порядок действий рабочий.
1. Маски. Открываем прайс и выписываем, как товар называется у нас: «полотно дверное», «блок дверной», «комплект коробки». Затем открываем чат поддержки и три последних разговора с менеджером. Там звучит другое: «двери в спальню», «двери со стеклом», «двери под покраску», «сколько стоит с установкой». Вторая группа и есть маски — их около 25.
2. Расширение. Каждую маску прогоняем через Вордстат и подсказки. Из «двери со стеклом» вырастает «двери со стеклом матовым», «межкомнатные двери со стеклом в гостиную», «двери со стеклом узкие». Сырой список — примерно 8 тысяч фраз.
3. Съём частотности. Ставим фразу в кавычки с восклицательным знаком: "!двери!со!стеклом". Разница показательна: базовая частотность может показать 12 000, а точная — 400. Планировать страницу по базовой — значит делать её под спрос, которого нет.
4. Чистка. Удаляем: города, где не работаем; «своими руками», «чертёж», «б/у»; бренды конкурентов; «двери гаражные» и прочее не из нашего ассортимента. Из 8 тысяч остаётся около 3 200. Всё удалённое складываем в отдельный файл — это готовые минус-слова для рекламы.
5. Кластеризация. Группируем по совпадению выдачи. Получаем, например: «двери со стеклом» (310 фраз), «двери под покраску» (140), «двери с установкой» (95). Каждая группа — отдельная страница.
6. Итог. Ядро превращается в таблицу задач: адрес будущей страницы, тип (категория, фильтр, статья), суммарная частотность, текущая позиция, приоритет. Это документ, по которому работают разработчик и копирайтер, а не «список ключей».

Как выглядит рабочая таблица ядра
Финальный документ должен читаться человеком, который не занимается продвижением. Минимальный набор колонок:
| Кластер | Частотность | Тип страницы | Адрес | Есть сейчас | Приоритет |
|---|---|---|---|---|---|
| двери со стеклом | 2 400 | категория | /mezhkomnatnye/so-steklom/ | нет | 1 |
| двери под покраску | 880 | категория | /mezhkomnatnye/pod-pokrasku/ | нет | 2 |
| двери с установкой | 640 | услуга | /ustanovka/ | частично | 1 |
| как выбрать межкомнатную дверь | 1 900 | статья | /blog/kak-vybrat/ | нет | 3 |
Приоритет ставится не по частотности, а по связке «спрос × близость к покупке × сложность внедрения». Категория под коммерческий кластер почти всегда важнее статьи, даже если у статьи спрос выше.

Шесть ошибок сбора, которые приходится переделывать
1. Съём по базовой частотности. Самая дорогая ошибка: страницы проектируются под спрос, которого нет. Базовая частотность включает все словоформы и вложенные запросы, точная — реальные показы конкретной фразы. Разница бывает тридцатикратной.
2. Кластеризация по смыслу, а не по выдаче. «Купить дверь» и «заказать дверь» кажутся одним и тем же, но если выдача по ним разная, склеивать их нельзя. Проверка идёт по фактическому совпадению результатов поиска, а не по ощущению редактора.
3. Ядро без привязки к страницам. Список фраз без указания, какая страница закрывает какой кластер, — это не ядро, а справочный материал. Работать по нему невозможно.
4. Один кластер на две страницы. Две похожие страницы под один спрос начинают конкурировать между собой, и поиск выбирает то одну, то другую. Результат — нестабильные позиции у обеих.
5. Выброшенные минус-слова. Всё, что вычистили из ядра, — готовый список минус-слов для рекламы. Его удаляют вместе с мусором и потом собирают заново.
6. Ядро, собранное один раз навсегда. Формулировки меняются, появляются новые модели и услуги. Без квартального дополнения через год ядро отражает прошлогодний спрос.

Типичные ошибки при сборе ядра
Три ошибки, которые встречаются в каждом втором проекте на аудите:
- Ядро собрано, но не внедрено. Таблица лежит в облаке, структура сайта живёт своей жизнью. Ядро без страниц не приносит ни одного визита.
- Базовая частотность вместо точной. Страницы создаются под «жирные» фразы, у которых реальный спрос — десятки показов в месяц.
- Слепое доверие автокластеризации. Сервис — это инструмент, спорные кластеры нужно проверять руками по выдаче, особенно коммерческие.
И помните, что ядро — не разовая задача: спрос меняется, раз в 6–12 месяцев его нужно актуализировать. Ошибки в структуре стоят дорого — иногда до полного обвала видимости, как в нашем разборе падения трафика из-за robots.txt. Больше материалов по поисковому продвижению — в рубрике SEO.

Структура сайта под цепочку вопросов, а не под список фраз
Кластеризация отвечает на вопрос «какие запросы можно закрыть одной страницей», но сама по себе ещё не даёт хорошую структуру сайта. Пользователь редко движется по одному запросу: сначала уточняет задачу, затем сравнивает варианты, проверяет ограничения и только после этого ищет цену или подрядчика. Если разложить эту цепочку по связанным страницам, сайт покрывает больше семантики и ведёт человека к следующему решению.
Для каждого большого направления полезно завести три уровня:
- Хаб отвечает на широкий вопрос и объясняет карту темы. Он не пытается подробно ранжироваться по каждому частному запросу, а ведёт на материалы второго уровня.
- Поддерживающие страницы закрывают отдельное намерение: выбрать способ, рассчитать стоимость, исправить ошибку, сравнить варианты, внедрить по шагам.
- Коммерческая страница принимает уже сформированный спрос: показывает состав услуги, процесс, цену или принцип расчёта и следующий шаг.
Один URL должен иметь одно главное намерение. Запросы «как собрать семантическое ядро» и «заказать сбор семантического ядра» относятся к одной теме, но задачи у человека разные. Попытка сделать одну страницу одновременно подробной инструкцией и коммерческим предложением обычно размывает оба ответа. Правильнее связать инструкцию с услугой понятным переходом, а не смешивать их заголовки.
| Вопрос пользователя | Тип страницы | Куда вести дальше |
|---|---|---|
| Что это и зачем нужно? | Хаб или базовое руководство | К выбору метода и частым ошибкам |
| Как сделать? | Пошаговая инструкция | К инструментам, шаблону и проверке |
| Почему не работает? | Диагностический материал | К исправлению конкретной причины |
| Сколько стоит и кому поручить? | Коммерческая страница | К заявке, расчёту или консультации |
В рабочей таблице ядра добавьте к кластеру ещё четыре колонки: намерение, роль страницы, родительский хаб и следующий логичный материал. Тогда перелинковка перестаёт быть случайным блоком «похожие статьи»: каждая страница получает ссылку вверх на хаб и две ссылки вбок по цепочке вопросов. После публикации проверяйте не только наличие URL в карте сайта, но и входящие ссылки из уже проиндексированных материалов.
Простой тест на каннибализацию: если для двух будущих страниц нельзя в одном предложении объяснить разницу в задаче пользователя, вероятно, их нужно объединить. Если разница ясна — оставляйте обе и разводите H1, первый экран, примеры и внутренние анкоры. Так семантика превращается в архитектуру, а не в склад запросов.

Источники
- Яндекс Вордстат — подбор слов ↗ оператор «!» фиксирует форму слова, кавычки ограничивают фразу ↩
- Справка Яндекса: как устроен поиск по запросу ↗ о соответствии запроса и страницы ↩
- Google Search Central: рекомендации по контенту ↗ ↩
Путь клиента: где эта тема срабатывает
Тема решает в момент, когда бизнес запускает сайт или раздел и не понимает, сколько страниц делать и про что писать каждую.
Что у клиентаСайт есть, но трафика мало или он идёт не на те страницы. Владелец подозревает, что структура собрана на глаз.
Что делаемПроверяем, есть ли у клиента ядро вообще, и смотрим, покрывает ли текущая структура сайта реальный спрос.
Сигнал, что работаетКлиент видит разрыв: часть запросов из его бизнеса вообще не отражена ни на одной странице.
Что у клиентаКлиент даёт доступ к прайсу, карточкам товаров, переписке с менеджерами — то есть к языку, которым реально говорят покупатели.
Что делаемСобираем базовые маски из этих источников, расширяем их через Вордстат и парсеры до сырого списка запросов.
Сигнал, что работаетСписок из тысяч фраз, которые ещё не разложены по смыслу и не проверены на реальную частотность.
Что у клиентаКлиент часто удивляется, что итоговое ядро в разы меньше исходного списка, и спрашивает, куда всё пропало.
Что делаемУбираем мусор, дубли и нецелевые запросы, затем группируем оставшееся по общности топ-10 выдачи.
Сигнал, что работаетКаждая группа фраз явно ложится на одну страницу, а не размазывается по трём.
Что у клиентаКлиент получает не таблицу с фразами, а список конкретных страниц с приоритетами — какие сделать, какие доработать.
Что делаемПревращаем кластеры в план страниц: новые разделы, доработка существующих, оценка потенциального трафика по каждому.
Сигнал, что работаетУ клиента есть понятный список задач для разработчика и контент-менеджера, а не просто отчёт по ключевым словам.
Стратегия: что делать по шагам
Цель: Собрать семантическое ядро, которое превращается не в таблицу фраз, а в понятную структуру сайта с приоритетами по страницам.
Шкала собрана из сроков плана ниже. Это ориентир для последовательности работ.
- Неделя 1 Собираем базовые маски из карточек товаров, прайса, скриптов продаж и переписки с клиентами — обычно 20–40 фраз. Список масок, отражающий реальный язык покупателей, а не только термины из прайса.
- Неделя 1-2 Расширяем маски через Вордстат и парсеры, проверяем частотность в кавычках с восклицательным знаком. Сырой список запросов на несколько тысяч строк с реальными, а не завышенными цифрами спроса.
- Неделя 2 Чистим список: убираем дубли, нецелевые и информационные запросы не по теме, коммерческий мусор. Ядро, которое обычно теряет половину объёма — и это ожидаемый результат, а не провал сбора.
- Неделя 3 Кластеризуем оставшиеся фразы по совпадению топ-10 выдачи, проверяем каждую группу вручную. Набор кластеров, где на каждый явно ложится одна посадочная страница.
- Неделя 3-4 Раскладываем кластеры по структуре сайта: новые страницы, доработка старых, приоритеты и оценка трафика. Список задач по страницам, готовый для разработчика и контент-плана.
Сроки — ориентир для планирования, а не обязательство: скорость зависит от ниши, конкуренции и состояния сайта.
Чек-лист: сбор ядра без мусора
Проверьте, не пропущен ли какой-то из этапов до того, как передавать ядро в работу.
- Соберите базовые маски из карточек товаров, чатов и скриптов продаж, а не только из прайса
- Проверяйте частотность каждой ключевой фразы в кавычках с восклицательным знаком
- Расширяйте маски через Вордстат и парсеры до сырого списка запросов
- Удаляйте дубли и близкие по смыслу фразы до кластеризации, а не после
- Отсекайте информационные и нецелевые запросы, если сайт коммерческий
- Считайте нормальным, если после чистки ядро похудеет вдвое
- Кластеризуйте фразы по общности топ-10 выдачи, а не по субъективному смыслу
- Проверяйте вручную кластеры на границе — где пересечение выдачи неполное
- Присваивайте каждому кластеру одну посадочную страницу, не размазывайте по нескольким
- Оформляйте итог как список страниц с приоритетами, а не как таблицу фраз
Самая частая ошибка — считать, что чем больше ядро, тем оно лучше. На практике раздутое ядро почти всегда означает, что чистку пропустили или сделали формально. Нормальное рабочее ядро для среднего проекта — это не десятки тысяч строк, а несколько сотен фраз, разложенных по конкретным страницам.
Что в итоге
Семантическое ядро решает задачу только тогда, когда доходит до структуры сайта — списка страниц с понятными приоритетами. Таблица с тысячами фраз без кластеризации и чистки — это сырьё, а не готовый инструмент, и работать по ней невозможно.
Чаще всего переделывать приходится из-за одной ошибки: сбор ведут по прайсу и логике каталога, а не по языку покупателей и реальной выдаче. В итоге получают ядро, которое красиво выглядит в таблице, но не покрывает половину реального спроса и плохо ложится на структуру сайта.
С чего начать: Возьмите 20–30 карточек товаров или услуг и выпишите из них маски так, как их называют клиенты в переписке, а не так, как они названы в прайсе.
Вопросы и ответы
Сколько времени занимает сбор семантического ядра?
Для сайта услуг — обычно 1–2 недели, для интернет-магазина с десятками категорий — 3–5 недель. Больше всего времени уходит не на сбор, а на чистку и ручную проверку кластеров.
Можно ли собрать ядро только по Вордстату?
Можно, но ядро выйдет неполным: Вордстат не покажет запросы, по которым уже ранжируются конкуренты. Подсказки и базы сервисов видимости обычно добавляют 20–40% фраз, которых нет в Вордстате.
Что делать с информационными запросами на коммерческом сайте?
Не удалять, а выносить в отдельный кластер под блог. Статьи под инфозапросы приводят аудиторию на ранней стадии выбора и передают вес коммерческим страницам через перелинковку.
Сколько времени занимает сбор ядра?
Для сайта услуг с одним направлением — 3–5 рабочих дней. Для интернет-магазина на несколько тысяч позиций — от двух недель, основное время уходит на чистку и кластеризацию, а не на сбор.
Какие инструменты нужны и сколько это стоит?
Минимум: Вордстат (бесплатно) и любой сервис съёма частотности. Для магазина понадобится парсер и кластеризатор — это несколько тысяч рублей за проект. Собрать ядро вручную можно, но на объёме от тысячи фраз это неоправданно долго.
Что делать, если у кластера всего 20–30 запросов?
Смотрите на суммарную частотность и близость к покупке. Кластер из 20 фраз с общим спросом 800 показов и явным намерением купить ценнее, чем 200 информационных фраз с тем же спросом.
Нужно ли пересобирать ядро и как часто?
Полностью — раз в год-полтора. Дополнять новыми запросами стоит ежеквартально: появляются новые модели, формулировки и сезонные всплески. Полная пересборка нужна при смене ассортимента или выходе в новый регион.
Можно ли использовать ядро конкурента?
Список запросов конкурента полезен как источник идей для масок — он показывает, что вы упустили. Но копировать структуру целиком не стоит: у конкурента другой ассортимент, другая география и, возможно, другие ошибки.
Что делать, если два кластера очень похожи?
Проверьте выдачу: если по обоим показываются одни и те же страницы конкурентов — объединяйте. Если разные — делайте отдельные страницы, иначе они начнут конкурировать между собой и обе просядут.
Чем отличается ядро для магазина от ядра для сайта услуг?
Объёмом и структурой. В магазине основная работа — покрытие категорий и фильтров, там тысячи фраз и десятки типовых шаблонов страниц. В услугах фраз меньше, но каждая требует отдельной проработки страницы.
Нужно ли включать в ядро запросы с названиями конкурентов?
В продвижении — нет: такие страницы почти не ранжируются, а попытка их создать выглядит сомнительно. В рекламе такие запросы иногда используют, но это отдельное решение со своими рисками.
Что делать с запросами, по которым в выдаче только агрегаторы?
Оценить реалистичность: если все десять мест заняты крупными площадками, вложения в такой кластер окупятся нескоро. Разумнее работать по запросам, где в выдаче есть сайты вашего типа, а на агрегаторы выходить через размещение.
Как связать статьи внутри одного семантического кластера?
Поддерживающая статья должна ссылаться на главный материал кластера и на один-два соседних ответа по пути пользователя. Главный материал ведёт на дочерние страницы. Анкоры должны называть конкретный следующий вопрос, а не повторять «читать далее».
- Работа со структурой и семантикой — рост виден на горизонте 2–4 месяцев
- Технические правки: ускоряют переиндексацию, эффект заметен за 2–4 недели
- Проработка коммерческих факторов — влияет и на позиции, и на конверсию
- Наращивание объёма текстов без работы со структурой
- Ожидание результата за 2–3 недели: поиск так быстро не пересчитывает
- Гонка за баллами скорости вместо реального времени отрисовки
Что делать дальше
₽Посчитать экономикуСходится ли реклама при вашем чеке
?Задать вопросОтветим по вашей ситуации
Опишите задачу в двух словах — специалист ответит в Telegram, обычно в течение рабочего дня. Без презентаций и обязательств.
Написать в Telegram ↗✓Заявка на продвижениеРазобрать мой сайт
Бесплатно посмотрим структуру и техническую часть — пришлём задачи по приоритету, без общих слов.
Поставьте оценку — она поможет редакции улучшать следующие разборы.
Обсуждение 19
Спросите, что осталось непонятным — автор материала отвечает в комментариях.


