SEO

Семантика с нуля: как собрать ядро и не утонуть в мусоре

6 мин чтения
МО
Руководитель SEO-отдела Media Monster
обновлено 9 940 просмотров

Полный порядок сбора, чистки и кластеризации запросов — от первых масок в Вордстате до готовой структуры сайта и списка посадочных страниц.

Коротко — главное из статьи
  • Маски собирайте словами клиента, а не из прайса — 20–40 базовых фраз из карточек, чатов и скриптов продаж
  • Частотность проверяйте в кавычках с восклицательным знаком, иначе спрос завышен в разы
  • Чистка важнее сбора: после удаления мусора ядро обычно худеет вдвое — и это нормально
  • Кластеризуйте по общности топ-10 выдачи: один кластер — одна посадочная страница
  • Готовое ядро — не таблица фраз, а список задач по страницам с приоритетами и оценкой трафика

Шаг 1: маски — фундамент ядра

Маски — это 20–40 базовых фраз, из которых потом вырастет всё ядро. Главная ошибка на этом шаге — брать формулировки из собственного прайса. Клиент ищет не так, как вы называете товар: вы продаёте «стеллаж металлический сборно-разборный», а человек вводит «полка в гараж». Если маска собрана языком каталога, вы соберёте ядро про себя, а не про спрос.

Рабочие источники масок: названия и характеристики из карточек товаров, скрипты отдела продаж, вопросы клиентов в чате и по телефону, тексты объявлений конкурентов. Полезно 30 минут посидеть с менеджером по продажам — он назовёт формулировки, которых нет ни в одном сервисе.

На выходе шага — таблица масок с разбивкой по направлениям бизнеса. Не гонитесь за количеством: 25 точных масок дадут более полное ядро, чем 100 придуманных.

Семантика с нуля: как собрать ядро и не утонуть в мусоре — иллюстрация к разделу «Шаг 1: маски — фундамент ядра»

Шаг 2: расширение — от масок к сырому списку

Каждую маску прогоняем через три источника: Вордстат (левая и правая колонки), поисковые подсказки Яндекса и Google, и база запросов конкурентов из сервисов видимости — последняя часто даёт фразы, до которых вы сами не додумались. На выходе получается сырой список: для локальной услуги — 3–5 тысяч фраз, для интернет-магазина — легко 30–50 тысяч. 1

Обязательный пункт, который пропускают чаще всего: снимайте частотность в кавычках с восклицательным знаком («!фраза»). Базовая частотность включает все вложенные запросы и завышает спрос в разы — на её основе вы будете строить страницы под фразы, которые никто не вводит.

Ориентир по трудозатратам: расширение и съём частотности — это 1–3 дня работы с парсером, а не месяц ручного копирования из Вордстата.

Шаг 3: чистка — самый недооценённый этап

Чистка важнее сбора: лучше маленькое чистое ядро, чем огромное грязное. Из сырого списка убираем нецелевые регионы («купить стеллаж минск» для компании из Москвы), бренды конкурентов, фразы с «бесплатно», «своими руками», «б/у» — если вы это не продаёте. Для коммерческого сайта отдельно отсекаем информационные хвосты: «как выбрать», «что лучше» — это темы для блога, а не для категорий.

Нормальный результат чистки — ядро худеет примерно вдвое. Если после чистки осталось 90% фраз, вы чистили невнимательно. И практичный лайфхак: все удаляемые фразы сразу складывайте в отдельный файл — это готовый список минус-слов для рекламных кампаний в Директе, который иначе будете собирать заново и за деньги.

На этом же этапе видно, по каким запросам сайт вообще сможет конкурировать: если по фразе в топе одни агрегаторы, для неё нужна страница другого типа — с ассортиментом и коммерческими факторами ранжирования, а не текст.

Бесплатный SEO-аудит сайта

Разберём ваш сайт, как в статьях этого блога: что мешает расти в Яндексе и Google и где теряются заявки.

Отправка формы не является заключением договора и не порождает обязательств сторон.

Шаг 4: кластеризация по выдаче

Кластеризация отвечает на главный вопрос: какие фразы можно вести на одну страницу, а какие требуют разных. Самый надёжный метод — группировка по общности топ-10 2: если по двум фразам Яндекс показывает одни и те же URL, их можно объединить; если выдача разная — поисковик считает это разными интентами, и страницы нужны разные.

Режим soft объединяет смелее и даёт крупные кластеры — подходит для инфозапросов. Hard требует строгого пересечения выдачи и даёт дробную структуру — правильный выбор для коммерческих запросов. Итог кластеризации — фактически карта будущих страниц сайта.

Железное правило: один кластер — одна посадочная. Два кластера, посаженные на одну страницу, размывают релевантность; один кластер, разнесённый на две страницы, порождает каннибализацию — страницы конкурируют между собой, и позиции скачут у обеих.

Шаг 5: от кластеров к структуре сайта

Каждому кластеру назначаем тип страницы: категория, подкатегория, страница фильтра, карточка товара или статья в блог. Тип подсказывает сама выдача — смотрите, что ранжируется в топе по главной фразе кластера. Если там категории магазинов, статья в топ не встанет, сколько её ни оптимизируй. 3

Дальше расставляем приоритеты: по суммарной частотности кластера и по текущим позициям сайта. Кластеры, где вы уже на 11–20 местах, дают самый быстрый прирост — их в работу первыми. Учитывайте и техническую готовность страниц: медленные шаблоны сначала придётся ускорить, потому что скорость сайта влияет и на ранжирование, и на конверсию.

Готовое ядро — это не таблица на 20 тысяч строк, а список задач: какую страницу создать или доработать, под какие запросы, с каким приоритетом и какой оценкой трафика. В таком виде семантика превращается в план работ на месяцы вперёд — как это выглядит в деле, видно по нашему кейсу роста трафика интернет-магазина в 4 раза.

Семантика с нуля: как собрать ядро и не утонуть в мусоре — иллюстрация к разделу «Шаг 5: от кластеров к структуре сайта»

Разбор на примере: собираем ядро для магазина дверей

Покажем весь путь на конкретной нише — межкомнатные двери. Цифры условные, порядок действий рабочий.

1. Маски. Открываем прайс и выписываем, как товар называется у нас: «полотно дверное», «блок дверной», «комплект коробки». Затем открываем чат поддержки и три последних разговора с менеджером. Там звучит другое: «двери в спальню», «двери со стеклом», «двери под покраску», «сколько стоит с установкой». Вторая группа и есть маски — их около 25.

2. Расширение. Каждую маску прогоняем через Вордстат и подсказки. Из «двери со стеклом» вырастает «двери со стеклом матовым», «межкомнатные двери со стеклом в гостиную», «двери со стеклом узкие». Сырой список — примерно 8 тысяч фраз.

3. Съём частотности. Ставим фразу в кавычки с восклицательным знаком: "!двери !со !стеклом". Разница показательна: базовая частотность может показать 12 000, а точная — 400. Планировать страницу по базовой — значит делать её под спрос, которого нет.

4. Чистка. Удаляем: города, где не работаем; «своими руками», «чертёж», «б/у»; бренды конкурентов; «двери гаражные» и прочее не из нашего ассортимента. Из 8 тысяч остаётся около 3 200. Всё удалённое складываем в отдельный файл — это готовые минус-слова для рекламы.

5. Кластеризация. Группируем по совпадению выдачи. Получаем, например: «двери со стеклом» (310 фраз), «двери под покраску» (140), «двери с установкой» (95). Каждая группа — отдельная страница.

6. Итог. Ядро превращается в таблицу задач: адрес будущей страницы, тип (категория, фильтр, статья), суммарная частотность, текущая позиция, приоритет. Это документ, по которому работают разработчик и копирайтер, а не «список ключей».

Как выглядит рабочая таблица ядра

Финальный документ должен читаться человеком, который не занимается продвижением. Минимальный набор колонок:

КластерЧастотностьТип страницыАдресЕсть сейчасПриоритет
двери со стеклом2 400категория/mezhkomnatnye/so-steklom/нет1
двери под покраску880категория/mezhkomnatnye/pod-pokrasku/нет2
двери с установкой640услуга/ustanovka/частично1
как выбрать межкомнатную дверь1 900статья/blog/kak-vybrat/нет3

Приоритет ставится не по частотности, а по связке «спрос × близость к покупке × сложность внедрения». Категория под коммерческий кластер почти всегда важнее статьи, даже если у статьи спрос выше.

Шесть ошибок сбора, которые приходится переделывать

1. Съём по базовой частотности. Самая дорогая ошибка: страницы проектируются под спрос, которого нет. Базовая частотность включает все словоформы и вложенные запросы, точная — реальные показы конкретной фразы. Разница бывает тридцатикратной.

2. Кластеризация по смыслу, а не по выдаче. «Купить дверь» и «заказать дверь» кажутся одним и тем же, но если выдача по ним разная, склеивать их нельзя. Проверка идёт по фактическому совпадению результатов поиска, а не по ощущению редактора.

3. Ядро без привязки к страницам. Список фраз без указания, какая страница закрывает какой кластер, — это не ядро, а справочный материал. Работать по нему невозможно.

4. Один кластер на две страницы. Две похожие страницы под один спрос начинают конкурировать между собой, и поиск выбирает то одну, то другую. Результат — нестабильные позиции у обеих.

5. Выброшенные минус-слова. Всё, что вычистили из ядра, — готовый список минус-слов для рекламы. Его удаляют вместе с мусором и потом собирают заново.

6. Ядро, собранное один раз навсегда. Формулировки меняются, появляются новые модели и услуги. Без квартального дополнения через год ядро отражает прошлогодний спрос.

Типичные ошибки при сборе ядра

Три ошибки, которые встречаются в каждом втором проекте на аудите:

  • Ядро собрано, но не внедрено. Таблица лежит в облаке, структура сайта живёт своей жизнью. Ядро без страниц не приносит ни одного визита.
  • Базовая частотность вместо точной. Страницы создаются под «жирные» фразы, у которых реальный спрос — десятки показов в месяц.
  • Слепое доверие автокластеризации. Сервис — это инструмент, спорные кластеры нужно проверять руками по выдаче, особенно коммерческие.

И помните, что ядро — не разовая задача: спрос меняется, раз в 6–12 месяцев его нужно актуализировать. Ошибки в структуре стоят дорого — иногда до полного обвала видимости, как в нашем разборе падения трафика из-за robots.txt. Больше материалов по поисковому продвижению — в рубрике SEO.

Источники

  1. Яндекс Вордстат — подбор слов ↗ оператор «!» фиксирует форму слова, кавычки ограничивают фразу
  2. Справка Яндекса: как устроен поиск по запросу ↗ о соответствии запроса и страницы
  3. Google Search Central: рекомендации по контенту ↗

Вопросы и ответы

Сколько времени занимает сбор семантического ядра?

Для сайта услуг — обычно 1–2 недели, для интернет-магазина с десятками категорий — 3–5 недель. Больше всего времени уходит не на сбор, а на чистку и ручную проверку кластеров.

Можно ли собрать ядро только по Вордстату?

Можно, но ядро выйдет неполным: Вордстат не покажет запросы, по которым уже ранжируются конкуренты. Подсказки и базы сервисов видимости обычно добавляют 20–40% фраз, которых нет в Вордстате.

Что делать с информационными запросами на коммерческом сайте?

Не удалять, а выносить в отдельный кластер под блог. Статьи под инфозапросы приводят аудиторию на ранней стадии выбора и передают вес коммерческим страницам через перелинковку.

Сколько времени занимает сбор ядра?

Для сайта услуг с одним направлением — 3–5 рабочих дней. Для интернет-магазина на несколько тысяч позиций — от двух недель, основное время уходит на чистку и кластеризацию, а не на сбор.

Какие инструменты нужны и сколько это стоит?

Минимум: Вордстат (бесплатно) и любой сервис съёма частотности. Для магазина понадобится парсер и кластеризатор — это несколько тысяч рублей за проект. Собрать ядро вручную можно, но на объёме от тысячи фраз это неоправданно долго.

Что делать, если у кластера всего 20–30 запросов?

Смотрите на суммарную частотность и близость к покупке. Кластер из 20 фраз с общим спросом 800 показов и явным намерением купить ценнее, чем 200 информационных фраз с тем же спросом.

Нужно ли пересобирать ядро и как часто?

Полностью — раз в год-полтора. Дополнять новыми запросами стоит ежеквартально: появляются новые модели, формулировки и сезонные всплески. Полная пересборка нужна при смене ассортимента или выходе в новый регион.

Можно ли использовать ядро конкурента?

Список запросов конкурента полезен как источник идей для масок — он показывает, что вы упустили. Но копировать структуру целиком не стоит: у конкурента другой ассортимент, другая география и, возможно, другие ошибки.

Что делать, если два кластера очень похожи?

Проверьте выдачу: если по обоим показываются одни и те же страницы конкурентов — объединяйте. Если разные — делайте отдельные страницы, иначе они начнут конкурировать между собой и обе просядут.

Чем отличается ядро для магазина от ядра для сайта услуг?

Объёмом и структурой. В магазине основная работа — покрытие категорий и фильтров, там тысячи фраз и десятки типовых шаблонов страниц. В услугах фраз меньше, но каждая требует отдельной проработки страницы.

Нужно ли включать в ядро запросы с названиями конкурентов?

В продвижении — нет: такие страницы почти не ранжируются, а попытка их создать выглядит сомнительно. В рекламе такие запросы иногда используют, но это отдельное решение со своими рисками.

Что делать с запросами, по которым в выдаче только агрегаторы?

Оценить реалистичность: если все десять мест заняты крупными площадками, вложения в такой кластер окупятся нескоро. Разумнее работать по запросам, где в выдаче есть сайты вашего типа, а на агрегаторы выходить через размещение.

Официальные справки по теме
МО
Руководитель SEO-отдела Media Monster

Максим занимается поисковым продвижением 11 лет: начинал с собственных контентных проектов, затем вырос от специалиста до руководителя SEO-отдела в агентстве. Специализируется на технических аудитах, работе с большими сайтами и контент-стратегии под Яндекс и Google. В Media Monster отвечает за методологию продвижения, контролирует ключевые проекты и обучает команду.

С какими задачами к нему приходят

Чаще всего — «сайт есть несколько лет, а трафика нет». За этой формулировкой обычно скрывается одно из трёх: структура собрана по внутренней логике компании, а не по тому, как товар ищут; техническая часть мешает поисковику дойти до половины страниц; или страницы есть, но они не отвечают на вопрос, с которым человек пришёл. Вторая по частоте задача — разбор инцидента: трафик резко упал, и нужно быстро понять почему.

Отдельная категория — проверка работы предыдущего подрядчика. Здесь Максим смотрит не на отчёты, а на то, что реально изменилось на сайте: какие страницы появились, что стало с индексом, какие правки внесены в код.

Как работает

Принцип, который он повторяет команде: сначала диагностика, потом работы. До начала любых действий собирается картина — что в индексе, где спрос, чем закрыт, куда уходят люди. Это занимает от нескольких дней до двух недель и часто меняет исходный план: задача, с которой пришёл клиент, оказывается следствием, а не причиной.

Каждая рекомендация в его отчётах сопровождается ответом на вопрос «как мы поймём, что это сработало». Если измеримого критерия нет, пункт из плана убирается.

Чего не делает

Не обещает позиций и сроков выхода в топ — ни один подрядчик не управляет алгоритмами поиска. Не берётся за проекты, где нельзя вносить изменения в сайт: без доступа к структуре и коду продвижение сводится к написанию текстов, а это редко решает задачу. Не использует схемы, за которые сайт может получить санкции, — накрутку поведенческих факторов, скрытый текст, покупку ссылок пачками.

В блоге

Пишет в рубрики «SEO» и «Кейсы»: технические разборы, чек-листы и истории проектов, включая те, где часть гипотез не сработала. Все клиентские материалы публикуются обезличенно — ниша, регион и название компании не раскрываются.

Материал подготовлен по редакционной политике блога: практика проектов, официальные источники, проверка перед публикацией.

Что это даёт на практике
Главное из этого материала. Маски собирайте словами клиента, а не из прайса — 20–40 базовых фраз из карточек, чатов и скриптов продаж
✓ Что работает
  • Работа со структурой и семантикой — рост виден на горизонте 2–4 месяцев
  • Технические правки: ускоряют переиндексацию, эффект заметен за 2–4 недели
  • Проработка коммерческих факторов — влияет и на позиции, и на конверсию
✕ Что результата не даёт
  • Наращивание объёма текстов без работы со структурой
  • Ожидание результата за 2–3 недели: поиск так быстро не пересчитывает
  • Гонка за баллами скорости вместо реального времени отрисовки
Выводы обобщены по проектам направления «SEO» и обезличены: названия компаний, домены и иные идентифицирующие данные не раскрываются. Результат в каждом проекте зависит от ниши, конкуренции и исходного состояния — см. условия использования.
Хотите понять, где именно у вас теряется трафик?
Бесплатно посмотрим структуру и техническую часть — пришлём задачи по приоритету, без общих слов.
Разобрать мой сайт

Обсуждение

Спросите, что осталось непонятным — автор материала отвечает в комментариях.

Загружаем комментарии…
Комментарии — от подтверждённых читателей

Один раз подтвердите себя в Telegram: так в обсуждении нет спама, а имя подставляется само. Мы видим только имя и никогда не пишем первыми без вашего запроса.

Читайте по теме

← Все статьи рубрики «SEO»

SEO-продвижение сайтов

Яндекс Вебмастер: подключение и пять разделов, которые нужны на практике GEO: продвижение в ответах нейропоиска — что это и как под него работать Технический аудит сайта: 30 проверок, которые делаются до любых работ Локальное продвижение: как получать клиентов из карт и запросов с городом Внутренняя перелинковка: какие ссылки работают, а какие ставятся зря Все статьи рубрики (9) →

Реклама в Яндекс Директе

Реклама для дверей: какие каналы дают заявки и сколько стоят Минус-слова и чистка площадок: где проходит граница между экономией и потерей заявок «Обучение стратегии остановлено» в Яндекс Директе: причины и что делать Автостратегии в Яндекс Директе: полный разбор и типичные ошибки Геотаргетинг в Директе: регионы, радиусы и гиперлокал Открыть рубрику →

SMM и таргетированная реклама

Таргет во ВКонтакте: связки, которые дают заявки в 2026 SMM-стратегия из 6 блоков: цели, аудитория, тон, рубрики, частота, метрики Ретаргетинг: 5 сегментов, которые окупаются всегда Контент-план на месяц: как собрать за два часа Креативы: почему одинаковые баннеры перестают работать Открыть рубрику →

Разработка сайтов

Кейс: переезд магазина на новую платформу — что делали, чтобы не потерять трафик Кейс: после редизайна трафик упал на 41% — что чинили шесть недель Приёмка сайта у подрядчика: чек-лист, который защитит от типовых проблем Интеграция сайта с учётной системой: где обмен ломается и как это ловить Сколько стоит разработка сайта и из чего складывается цена Все статьи рубрики (8) →

Веб-аналитика и сквозная аналитика

Яндекс Метрика: как настроить с нуля и какие отчёты смотреть Цели в Яндекс Метрике: что настроить в первую очередь и почему они перестают работать UTM-метки: как построить систему разметки, в которой можно разобраться через год Какие отчёты в аналитике стоит смотреть владельцу и что в них искать Сквозная аналитика без бюджета: минимальная рабочая схема Все статьи рубрики (6) →

Кейсы с цифрами

Кейс: как готовили сезонный бизнес к пику спроса и почему часть работ не окупилась Кейс: продвижение в B2B, где сделка закрывается через полгода Кейс: снизили стоимость заявки вдвое — и почему это оказалось плохой новостью Кейс: как выводили новое направление с нуля и что показал первый спрос Кейс: рост органики в 4 раза за 7 месяцев — и почему первые три были почти без результата Все статьи рубрики (8) →

Подтемы

Семантическое ядро Яндекс Метрика Автостратегии Директа Регионы и гео Интернет-магазины Все подтемы (9) →

Словарь терминов

ДРР — что это CPL — что это CAC — что это Когортный анализ — что это UTM-метки — что это Все термины (36) →

Ниши и категории

Мебельный маркетинг 7 Дверной бизнес 2 B2B-сектор 2 Недвижимость 2 E-commerce 2 Все направления (6) →

SEO в 2026

GEO — ответы нейросетей Локальный спрос и карты Технический аудит Внутренняя перелинковка Коммерческие факторы

Сейчас читают

Кейс: рост органики в 4 раза за 7 месяцев — и почему первые три были почти без результата Кейс: в 2,2 раза больше заявок на том же бюджете — за счёт перераспределения Кейс: трафик упал на 38% — разбор инцидента по часам Коммерческие факторы ранжирования: полный чек-лист из 18 пунктов «Обучение стратегии остановлено» в Яндекс Директе: причины и что делать Карта блога — все статьи RSS-лента блога

Блог Media Monster

Бесплатный аудит сайта и рекламы Как мы готовим материалы Условия использования Политика конфиденциальности Согласие на обработку данных