Семантика с нуля: как собрать ядро и не утонуть в мусоре
6 мин чтенияПолный порядок сбора, чистки и кластеризации запросов — от первых масок в Вордстате до готовой структуры сайта и списка посадочных страниц.
- Маски собирайте словами клиента, а не из прайса — 20–40 базовых фраз из карточек, чатов и скриптов продаж
- Частотность проверяйте в кавычках с восклицательным знаком, иначе спрос завышен в разы
- Чистка важнее сбора: после удаления мусора ядро обычно худеет вдвое — и это нормально
- Кластеризуйте по общности топ-10 выдачи: один кластер — одна посадочная страница
- Готовое ядро — не таблица фраз, а список задач по страницам с приоритетами и оценкой трафика
- Шаг 1: маски — фундамент ядра
- Шаг 2: расширение — от масок к сырому списку
- Шаг 3: чистка — самый недооценённый этап
- Шаг 4: кластеризация по выдаче
- Шаг 5: от кластеров к структуре сайта
- Разбор на примере: собираем ядро для магазина дверей
- Как выглядит рабочая таблица ядра
- Шесть ошибок сбора, которые приходится переделывать
- Типичные ошибки при сборе ядра
- Вопросы и ответы
- Источники
Шаг 1: маски — фундамент ядра
Маски — это 20–40 базовых фраз, из которых потом вырастет всё ядро. Главная ошибка на этом шаге — брать формулировки из собственного прайса. Клиент ищет не так, как вы называете товар: вы продаёте «стеллаж металлический сборно-разборный», а человек вводит «полка в гараж». Если маска собрана языком каталога, вы соберёте ядро про себя, а не про спрос.
Рабочие источники масок: названия и характеристики из карточек товаров, скрипты отдела продаж, вопросы клиентов в чате и по телефону, тексты объявлений конкурентов. Полезно 30 минут посидеть с менеджером по продажам — он назовёт формулировки, которых нет ни в одном сервисе.
На выходе шага — таблица масок с разбивкой по направлениям бизнеса. Не гонитесь за количеством: 25 точных масок дадут более полное ядро, чем 100 придуманных.

Шаг 2: расширение — от масок к сырому списку
Каждую маску прогоняем через три источника: Вордстат (левая и правая колонки), поисковые подсказки Яндекса и Google, и база запросов конкурентов из сервисов видимости — последняя часто даёт фразы, до которых вы сами не додумались. На выходе получается сырой список: для локальной услуги — 3–5 тысяч фраз, для интернет-магазина — легко 30–50 тысяч. 1
Обязательный пункт, который пропускают чаще всего: снимайте частотность в кавычках с восклицательным знаком («!фраза»). Базовая частотность включает все вложенные запросы и завышает спрос в разы — на её основе вы будете строить страницы под фразы, которые никто не вводит.
Ориентир по трудозатратам: расширение и съём частотности — это 1–3 дня работы с парсером, а не месяц ручного копирования из Вордстата.
Шаг 3: чистка — самый недооценённый этап
Чистка важнее сбора: лучше маленькое чистое ядро, чем огромное грязное. Из сырого списка убираем нецелевые регионы («купить стеллаж минск» для компании из Москвы), бренды конкурентов, фразы с «бесплатно», «своими руками», «б/у» — если вы это не продаёте. Для коммерческого сайта отдельно отсекаем информационные хвосты: «как выбрать», «что лучше» — это темы для блога, а не для категорий.
Нормальный результат чистки — ядро худеет примерно вдвое. Если после чистки осталось 90% фраз, вы чистили невнимательно. И практичный лайфхак: все удаляемые фразы сразу складывайте в отдельный файл — это готовый список минус-слов для рекламных кампаний в Директе, который иначе будете собирать заново и за деньги.
На этом же этапе видно, по каким запросам сайт вообще сможет конкурировать: если по фразе в топе одни агрегаторы, для неё нужна страница другого типа — с ассортиментом и коммерческими факторами ранжирования, а не текст.
Шаг 4: кластеризация по выдаче
Кластеризация отвечает на главный вопрос: какие фразы можно вести на одну страницу, а какие требуют разных. Самый надёжный метод — группировка по общности топ-10 2: если по двум фразам Яндекс показывает одни и те же URL, их можно объединить; если выдача разная — поисковик считает это разными интентами, и страницы нужны разные.
Режим soft объединяет смелее и даёт крупные кластеры — подходит для инфозапросов. Hard требует строгого пересечения выдачи и даёт дробную структуру — правильный выбор для коммерческих запросов. Итог кластеризации — фактически карта будущих страниц сайта.
Железное правило: один кластер — одна посадочная. Два кластера, посаженные на одну страницу, размывают релевантность; один кластер, разнесённый на две страницы, порождает каннибализацию — страницы конкурируют между собой, и позиции скачут у обеих.
Шаг 5: от кластеров к структуре сайта
Каждому кластеру назначаем тип страницы: категория, подкатегория, страница фильтра, карточка товара или статья в блог. Тип подсказывает сама выдача — смотрите, что ранжируется в топе по главной фразе кластера. Если там категории магазинов, статья в топ не встанет, сколько её ни оптимизируй. 3
Дальше расставляем приоритеты: по суммарной частотности кластера и по текущим позициям сайта. Кластеры, где вы уже на 11–20 местах, дают самый быстрый прирост — их в работу первыми. Учитывайте и техническую готовность страниц: медленные шаблоны сначала придётся ускорить, потому что скорость сайта влияет и на ранжирование, и на конверсию.
Готовое ядро — это не таблица на 20 тысяч строк, а список задач: какую страницу создать или доработать, под какие запросы, с каким приоритетом и какой оценкой трафика. В таком виде семантика превращается в план работ на месяцы вперёд — как это выглядит в деле, видно по нашему кейсу роста трафика интернет-магазина в 4 раза.

Разбор на примере: собираем ядро для магазина дверей
Покажем весь путь на конкретной нише — межкомнатные двери. Цифры условные, порядок действий рабочий.
1. Маски. Открываем прайс и выписываем, как товар называется у нас: «полотно дверное», «блок дверной», «комплект коробки». Затем открываем чат поддержки и три последних разговора с менеджером. Там звучит другое: «двери в спальню», «двери со стеклом», «двери под покраску», «сколько стоит с установкой». Вторая группа и есть маски — их около 25.
2. Расширение. Каждую маску прогоняем через Вордстат и подсказки. Из «двери со стеклом» вырастает «двери со стеклом матовым», «межкомнатные двери со стеклом в гостиную», «двери со стеклом узкие». Сырой список — примерно 8 тысяч фраз.
3. Съём частотности. Ставим фразу в кавычки с восклицательным знаком: "!двери !со !стеклом". Разница показательна: базовая частотность может показать 12 000, а точная — 400. Планировать страницу по базовой — значит делать её под спрос, которого нет.
4. Чистка. Удаляем: города, где не работаем; «своими руками», «чертёж», «б/у»; бренды конкурентов; «двери гаражные» и прочее не из нашего ассортимента. Из 8 тысяч остаётся около 3 200. Всё удалённое складываем в отдельный файл — это готовые минус-слова для рекламы.
5. Кластеризация. Группируем по совпадению выдачи. Получаем, например: «двери со стеклом» (310 фраз), «двери под покраску» (140), «двери с установкой» (95). Каждая группа — отдельная страница.
6. Итог. Ядро превращается в таблицу задач: адрес будущей страницы, тип (категория, фильтр, статья), суммарная частотность, текущая позиция, приоритет. Это документ, по которому работают разработчик и копирайтер, а не «список ключей».
Как выглядит рабочая таблица ядра
Финальный документ должен читаться человеком, который не занимается продвижением. Минимальный набор колонок:
| Кластер | Частотность | Тип страницы | Адрес | Есть сейчас | Приоритет |
|---|---|---|---|---|---|
| двери со стеклом | 2 400 | категория | /mezhkomnatnye/so-steklom/ | нет | 1 |
| двери под покраску | 880 | категория | /mezhkomnatnye/pod-pokrasku/ | нет | 2 |
| двери с установкой | 640 | услуга | /ustanovka/ | частично | 1 |
| как выбрать межкомнатную дверь | 1 900 | статья | /blog/kak-vybrat/ | нет | 3 |
Приоритет ставится не по частотности, а по связке «спрос × близость к покупке × сложность внедрения». Категория под коммерческий кластер почти всегда важнее статьи, даже если у статьи спрос выше.
Шесть ошибок сбора, которые приходится переделывать
1. Съём по базовой частотности. Самая дорогая ошибка: страницы проектируются под спрос, которого нет. Базовая частотность включает все словоформы и вложенные запросы, точная — реальные показы конкретной фразы. Разница бывает тридцатикратной.
2. Кластеризация по смыслу, а не по выдаче. «Купить дверь» и «заказать дверь» кажутся одним и тем же, но если выдача по ним разная, склеивать их нельзя. Проверка идёт по фактическому совпадению результатов поиска, а не по ощущению редактора.
3. Ядро без привязки к страницам. Список фраз без указания, какая страница закрывает какой кластер, — это не ядро, а справочный материал. Работать по нему невозможно.
4. Один кластер на две страницы. Две похожие страницы под один спрос начинают конкурировать между собой, и поиск выбирает то одну, то другую. Результат — нестабильные позиции у обеих.
5. Выброшенные минус-слова. Всё, что вычистили из ядра, — готовый список минус-слов для рекламы. Его удаляют вместе с мусором и потом собирают заново.
6. Ядро, собранное один раз навсегда. Формулировки меняются, появляются новые модели и услуги. Без квартального дополнения через год ядро отражает прошлогодний спрос.
Типичные ошибки при сборе ядра
Три ошибки, которые встречаются в каждом втором проекте на аудите:
- Ядро собрано, но не внедрено. Таблица лежит в облаке, структура сайта живёт своей жизнью. Ядро без страниц не приносит ни одного визита.
- Базовая частотность вместо точной. Страницы создаются под «жирные» фразы, у которых реальный спрос — десятки показов в месяц.
- Слепое доверие автокластеризации. Сервис — это инструмент, спорные кластеры нужно проверять руками по выдаче, особенно коммерческие.
И помните, что ядро — не разовая задача: спрос меняется, раз в 6–12 месяцев его нужно актуализировать. Ошибки в структуре стоят дорого — иногда до полного обвала видимости, как в нашем разборе падения трафика из-за robots.txt. Больше материалов по поисковому продвижению — в рубрике SEO.
Источники
- Яндекс Вордстат — подбор слов ↗ оператор «!» фиксирует форму слова, кавычки ограничивают фразу ↩
- Справка Яндекса: как устроен поиск по запросу ↗ о соответствии запроса и страницы ↩
- Google Search Central: рекомендации по контенту ↗ ↩
Вопросы и ответы
Сколько времени занимает сбор семантического ядра?
Для сайта услуг — обычно 1–2 недели, для интернет-магазина с десятками категорий — 3–5 недель. Больше всего времени уходит не на сбор, а на чистку и ручную проверку кластеров.
Можно ли собрать ядро только по Вордстату?
Можно, но ядро выйдет неполным: Вордстат не покажет запросы, по которым уже ранжируются конкуренты. Подсказки и базы сервисов видимости обычно добавляют 20–40% фраз, которых нет в Вордстате.
Что делать с информационными запросами на коммерческом сайте?
Не удалять, а выносить в отдельный кластер под блог. Статьи под инфозапросы приводят аудиторию на ранней стадии выбора и передают вес коммерческим страницам через перелинковку.
Сколько времени занимает сбор ядра?
Для сайта услуг с одним направлением — 3–5 рабочих дней. Для интернет-магазина на несколько тысяч позиций — от двух недель, основное время уходит на чистку и кластеризацию, а не на сбор.
Какие инструменты нужны и сколько это стоит?
Минимум: Вордстат (бесплатно) и любой сервис съёма частотности. Для магазина понадобится парсер и кластеризатор — это несколько тысяч рублей за проект. Собрать ядро вручную можно, но на объёме от тысячи фраз это неоправданно долго.
Что делать, если у кластера всего 20–30 запросов?
Смотрите на суммарную частотность и близость к покупке. Кластер из 20 фраз с общим спросом 800 показов и явным намерением купить ценнее, чем 200 информационных фраз с тем же спросом.
Нужно ли пересобирать ядро и как часто?
Полностью — раз в год-полтора. Дополнять новыми запросами стоит ежеквартально: появляются новые модели, формулировки и сезонные всплески. Полная пересборка нужна при смене ассортимента или выходе в новый регион.
Можно ли использовать ядро конкурента?
Список запросов конкурента полезен как источник идей для масок — он показывает, что вы упустили. Но копировать структуру целиком не стоит: у конкурента другой ассортимент, другая география и, возможно, другие ошибки.
Что делать, если два кластера очень похожи?
Проверьте выдачу: если по обоим показываются одни и те же страницы конкурентов — объединяйте. Если разные — делайте отдельные страницы, иначе они начнут конкурировать между собой и обе просядут.
Чем отличается ядро для магазина от ядра для сайта услуг?
Объёмом и структурой. В магазине основная работа — покрытие категорий и фильтров, там тысячи фраз и десятки типовых шаблонов страниц. В услугах фраз меньше, но каждая требует отдельной проработки страницы.
Нужно ли включать в ядро запросы с названиями конкурентов?
В продвижении — нет: такие страницы почти не ранжируются, а попытка их создать выглядит сомнительно. В рекламе такие запросы иногда используют, но это отдельное решение со своими рисками.
Что делать с запросами, по которым в выдаче только агрегаторы?
Оценить реалистичность: если все десять мест заняты крупными площадками, вложения в такой кластер окупятся нескоро. Разумнее работать по запросам, где в выдаче есть сайты вашего типа, а на агрегаторы выходить через размещение.
- Работа со структурой и семантикой — рост виден на горизонте 2–4 месяцев
- Технические правки: ускоряют переиндексацию, эффект заметен за 2–4 недели
- Проработка коммерческих факторов — влияет и на позиции, и на конверсию
- Наращивание объёма текстов без работы со структурой
- Ожидание результата за 2–3 недели: поиск так быстро не пересчитывает
- Гонка за баллами скорости вместо реального времени отрисовки
Обсуждение
Спросите, что осталось непонятным — автор материала отвечает в комментариях.