Фильтры каталога и индексация: как не создать тысячи дублей
8 мин чтенияКаталог из трёхсот товаров умеет отдавать поиску десятки тысяч адресов — и делает это без вашего участия. Разбираемся, какие из них должны быть страницами сайта, а какие обязаны остаться кнопкой в интерфейсе.
- Страницы фильтров плодятся комбинаторикой: пять фильтров по шесть значений дают десятки тысяч адресов без единой строчки контента.
- Открывать имеет смысл только те комбинации, под которые есть сформулированный спрос и достаточный ассортимент.
- Сортировка, вид отображения и количество товаров на странице не должны создавать индексируемых адресов вообще.
- Канонический адрес — рекомендация для поиска, а не замок: одним canonical проблему бесконтрольных комбинаций не закрыть.
- Правило должно быть на уровне логики сайта: новое значение фильтра открывается вручную, а не автоматически.
- Откуда в каталоге взялись тысячи страниц, которых я не делал
- Чем страница фильтра отличается от посадочной
- Какие комбинации открывать, а какие закрывать
- Канонический адрес и сортировки: где ломается чаще всего
- Как навести порядок, не переписывая сайт заново
- Путь клиента
- Стратегия по шагам
- Чек-лист
- Что в итоге
- Вопросы и ответы
Откуда в каталоге взялись тысячи страниц, которых я не делал
Каталог редко разрастается руками. Вы завели пять фильтров — цвет, материал, размер, цена, наличие — и в каждом по шесть-восемь значений. Дальше арифметика делает всё сама: любая пара значений даёт новый адрес, тройка — ещё один, а сортировки и пагинация умножают результат ещё в несколько раз. Роботу поисковика всё равно, что вы задумывали двадцать разделов: он видит ссылки в вёрстке и идёт по ним. В итоге каталог на триста карточек честно отдаёт поиску десятки тысяч адресов, и почти все они — практически одинаковые списки одних и тех же товаров.
Дальше начинается то, что владелец замечает уже в деньгах, а не в отчётах. Робот приходит на сайт с ограниченным запасом обращений: сколько адресов он готов обойти за сутки, столько и обойдёт. Если основная часть этого запаса уходит на комбинации фильтров, новые карточки и обновлённые цены он замечает с задержкой в недели. Сезонную позицию, которую вы завели в понедельник, вполне может ждать индексация до конца месяца — просто потому, что впереди в очереди стоят тысячи бессмысленных списков.
В панели вебмастера это выглядит буднично: растёт число исключённых страниц со статусами вроде «дубль» и «малоценная или маловостребованная страница». Многие на это машут рукой — исключил и исключил, значит поиск сам разобрался. Но поиск делает из этого вывод о сайте целиком: большая часть того, что вы отдаёте, ему не нужна. В наших проектах чаще всего именно здесь и лежит причина, почему нормальный каталог с живым ассортиментом годами не может выбраться из второй-третьей десятки по среднечастотным запросам.
Отдельная неприятность — внутренние ссылки. Каждая страница фильтра забирает на себя часть веса, который вы могли бы передать разделам и карточкам. Сайт как будто аккуратно перелинкован, но вес размазан по адресам, которые никто не искал и искать не будет. Поэтому задача звучит не как «закрыть фильтры», а как «решить, какие из этих адресов заслуживают быть страницами сайта, а какие должны остаться служебным инструментом внутри интерфейса».
Чем страница фильтра отличается от посадочной
Технически — ничем. И та и другая отдаётся сервером, показывает список товаров и открывается по адресу. Разница целиком в двух вещах: есть ли под эту страницу сформулированный спрос и есть ли на ней что-то, чего нет на родительском разделе. Если люди действительно набирают в строке поиска сочетание категории и признака, а вы можете показать по нему хотя бы полтора-два десятка товаров — перед вами посадочная страница, которая просто технически собирается фильтром. Если нет — перед вами кнопка, которой зачем-то выдали адрес.
Посадочная страница отличается тем, что её не стыдно показать как отдельный результат поиска. У неё свой заголовок и title, в котором признак фильтра стоит в человеческой формулировке, а не как «Каталог — цвет: белый». У неё осмысленное описание сверху или снизу списка: чем этот подтип отличается, кому подходит, на что смотреть при выборе. У неё собственные хлебные крошки и ссылки с соседних страниц. И у неё есть человек, который отвечает за то, чтобы товары в ней не кончились.
Простой рабочий тест, который я предлагаю владельцу: произнесите вслух то, что даёт фильтр. «Диваны угловые с ящиком для белья» — так говорят и так ищут, это страница. «Диваны угловые с ящиком для белья, бежевые, от 40 до 60 тысяч, в наличии, сортировка по цене» — так не говорит никто, это состояние интерфейса. Между этими двумя формулировками и проходит граница, которую нужно закрепить в настройках сайта.
Есть и обратная ошибка, которую видно реже. Иногда под спрос уже есть отличная страница фильтра — с товарами, с трафиком, — но она закрыта от индексации «на всякий случай», потому что подрядчик когда-то закрыл вообще все адреса с параметрами. Тогда сайт теряет не на дублях, а на упущенном: запросы с уточнениями обычно короче по пути до заявки, потому что человек уже определился с признаком.
Какие комбинации открывать, а какие закрывать
Рабочее правило простое: по умолчанию закрыто всё, вручную открыто немногое. Не наоборот. Список открытых страниц — это белый список, который вы ведёте осознанно, а не результат того, что программист не успел дописать условие. В большинстве каталогов такой список получается на двадцать-пятьдесят адресов, и это нормально: столько реально существующих запросов с уточнениями в средней товарной нише и набирается.
- Есть спрос: сочетание встречается в статистике запросов, а не придумано вами.
- Есть ассортимент: хотя бы полтора-два десятка товаров, и он не исчезнет через месяц.
- Есть что написать: минимум абзац текста, который отличается от родительского раздела.
- Признак один, максимум два: «категория + материал», «категория + размер».
- Адрес человекочитаемый и постоянный, а не гирлянда параметров после вопросительного знака.
Закрывать по умолчанию стоит всё остальное, и особенно четыре группы. Первая — диапазоны цен: спрос на них почти всегда размытый, а комбинаций бесконечно много. Вторая — наличие, новинки, акции и прочие временные состояния: сегодня товар есть, завтра нет, страница пустеет и превращается в мусор. Третья — множественный выбор внутри одного фильтра: три цвета сразу дают адрес, который не соответствует ни одному запросу. Четвёртая — любые сочетания из трёх и более признаков, за редчайшими исключениями вроде устойчивых профессиональных формулировок.
Проверять спрос лучше не на глаз. Выгрузите частотность по формуле «категория + значение фильтра» для всех значений разом, отсортируйте и отрежьте хвост. Дальше сверьтесь с двумя вещами: сколько товаров реально попадает под каждое значение и не дублирует ли оно уже существующий раздел каталога. Половина кандидатов отсеивается на этом шаге, и это хороший знак — значит, вы не будете плодить страницы, которые нечем наполнить.
Канонический адрес и сортировки: где ломается чаще всего
С каноническим адресом связано главное недоразумение в этой теме. Тег canonical — это подсказка поиску, какой из похожих адресов считать основным, а не запрет на обход. Робот всё равно придёт на страницу, всё равно потратит на неё обращение и может при желании подсказку проигнорировать, если содержимое покажется ему заметно другим. Поэтому строить всю защиту от бесконтрольных комбинаций на одном canonical — не работает: он снижает риск склейки не тех страниц, но не решает проблему раздутого объёма.
Сортировки и параметры отображения — отдельная история и самый частый источник мусора. Порядок «по цене», «по популярности», количество товаров на странице, переключатель «плитка/список» не должны порождать индексируемых адресов вообще. Правильно, когда это состояние живёт в интерфейсе и не меняет адрес, а если меняет — адрес обязан указывать каноническим на базовый вариант и не иметь ни одной обычной ссылки в вёрстке. Проверяется это за пять минут: откройте раздел, перещёлкайте все сортировки и посмотрите, что происходит в адресной строке.
Пагинация требует более аккуратного обращения, чем ей обычно достаётся. Схлопывать все страницы списка на первую каноническим адресом — плохая идея: товары со второй и дальше просто выпадают из зоны видимости робота. Здоровый вариант — каждая страница пагинации канонична сама себе, у неё в заголовке есть указание на номер, чтобы не выглядеть дублем, а текстовое описание раздела показывается только на первой. Так список остаётся проходимым, но не создаёт ощущения серии одинаковых страниц.
И последнее по порядку, но не по важности — стабильность адреса. Если выбор двух признаков в разной последовательности даёт два разных адреса, вы удвоили всё, что до этого построили. Порядок параметров должен фиксироваться логикой сайта, лишние и пустые параметры — отбрасываться, а сессионные метки и разметка рекламных переходов — не влиять на то, что видит робот. Это работа разработчика на несколько дней, но без неё остальные правила держатся на честном слове.
Как навести порядок, не переписывая сайт заново
Начинать стоит не с правок, а с инвентаризации. Нужно понять, сколько адресов сайт вообще отдаёт: выгрузите список известных поиску страниц из панели вебмастера, прогоните сайт краулером и, если есть доступ, посмотрите логи сервера — они честнее всего показывают, куда робот тратит обращения. Обычно картина неприятная и очень отрезвляющая: доля адресов с параметрами фильтров переваливает за девять десятых от всего, что обходится.
Дальше собирается белый список — те самые двадцать-пятьдесят комбинаций, которые вы готовы вести как отдельные страницы. Это решение не техническое, а коммерческое, и принимать его должен человек, который знает ассортимент и маржинальность. Всё, что в список не попало, закрывается от индексации на уровне логики сайта, а не единичными правилами в файле для роботов: правило должно применяться к любой новой комбинации автоматически, иначе через полгода вы вернётесь к исходной точке.
Выкатывать лучше поэтапно и с замером. Сначала сортировки и параметры отображения — это самая быстрая и самая безопасная часть. Потом закрытие лишних комбинаций. И только затем — наполнение открытых страниц текстами и перелинковкой, потому что это самая дорогая часть работы и её обидно делать на страницах, которые потом решат закрыть. Эффект по обходу обычно виден в течение месяца-полутора, изменения в видимости — заметно позже, ближе к третьему-четвёртому месяцу.
И самое главное — регламент на будущее. Когда контент-менеджер заводит новое значение фильтра, оно по умолчанию закрыто, а открывается только после того, как кто-то проверил спрос и наполнение. В наших проектах чаще всего именно отсутствие такого простого правила и возвращает каталог к тысячам дублей через год после аккуратной чистки: технически всё было сделано верно, но новую ветку ассортимента подключили по старой схеме.
Путь клиента: где эта тема срабатывает
Путь покупателя, который ищет товар с уточнением, и точки, где страница фильтра либо срабатывает, либо теряет его.
Что у клиентаУже определился с признаком и формулирует его прямо: категория плюс материал, размер или назначение.
Что делаемИметь под этот спрос отдельную страницу, а не отправлять человека в общий раздел разбираться самому.
Сигнал, что работаетДоля запросов с уточнениями в отчётах поиска и то, на какие страницы по ним идут показы.
Что у клиентаСравнивает заголовки и описания и выбирает тот, где его уточнение повторено словами, а не спрятано в параметрах адреса.
Что делаемСобственный заголовок и описание для каждой открытой страницы фильтра, без шаблонной подстановки.
Сигнал, что работаетКликабельность страницы в выдаче по сравнению с родительским разделом.
Что у клиентаПроверяет за пару секунд, что попал куда надо: те ли товары, тот ли признак, есть ли выбор.
Что делаемПоказать на странице только релевантные товары и подписать признак в заголовке страницы.
Сигнал, что работаетДоля отказов и глубина просмотра на страницах фильтров против среднего по каталогу.
Что у клиентаДобавляет ещё пару условий, меняет сортировку, листает список.
Что делаемДать это делать в интерфейсе, не порождая новых адресов и не сбивая человека с толку.
Сигнал, что работаетЧисло уникальных адресов на одну сессию в каталоге — резкий рост означает, что интерфейс плодит страницы.
Что у клиентаКладёт в корзину или пишет запрос по конкретной позиции, найденной через фильтр.
Что делаемСвязать конверсию с типом страницы, чтобы понимать, какие комбинации окупают ведение.
Сигнал, что работаетКонверсия открытых страниц фильтров в сравнении с разделами каталога.
Стратегия: что делать по шагам
Цель: Сократить объём мусорных адресов в каталоге и превратить два-три десятка комбинаций фильтров в полноценные посадочные страницы.
- Неделя 1 Инвентаризация: выгрузка известных поиску адресов, прогон краулером, разбор логов сервера. Считаем долю адресов с параметрами. Понятен масштаб: сколько всего адресов сайт отдаёт и какая часть обращений робота уходит впустую.
- Недели 2–3 Сбор спроса по формуле «категория + значение фильтра», сверка с ассортиментом, формирование белого списка открытых комбинаций. Согласованный список из двадцати-пятидесяти адресов, которые будут вестись как отдельные страницы.
- Недели 3–4 Технические правки: фиксированный порядок параметров, закрытие сортировок и параметров отображения, правило «по умолчанию закрыто» на уровне логики сайта. Новые комбинации перестают попадать в индексацию сами по себе.
- Недели 5–8 Шаблон посадочной страницы фильтра: редактируемые заголовок, описание и метатеги, хлебные крошки, ссылки с родительского раздела. Открытые страницы отличаются от раздела содержанием, а не только набором товаров.
- Месяцы 3–4 Контроль: динамика обхода и исключённых страниц, показы и позиции по запросам с уточнениями, пересмотр белого списка. Понятно, какие комбинации окупились, какие закрыть, и работает ли регламент на новых значениях фильтров.
Сроки — ориентир для планирования, а не обязательство: скорость зависит от ниши, конкуренции и состояния сайта.
Проверка каталога на дубли фильтров
Десять пунктов, которые можно пройти самому за вечер и понять, есть ли у вас эта проблема.
- Выгрузите из панели вебмастера исключённые страницы и посчитайте долю адресов с параметрами фильтров.
- Перещёлкайте все сортировки в разделе и проверьте, меняется ли при этом адрес страницы.
- Выберите два фильтра в разном порядке и сравните полученные адреса — они должны совпадать.
- Проверьте, что переключатель вида отображения и количество товаров на странице не создают отдельных адресов.
- Составьте список комбинаций, под которые есть реальный спрос, и сверьте его с тем, что открыто сейчас.
- Убедитесь, что на каждой открытой странице фильтра не меньше полутора-двух десятков товаров.
- Откройте три случайные страницы фильтров и сравните их заголовки и описания с родительским разделом.
- Проверьте, что страницы пагинации не схлопнуты каноническим адресом на первую страницу списка.
- Найдите фильтры по цене, наличию и акциям и убедитесь, что они закрыты от индексации.
- Спросите разработчика, что произойдёт при добавлении нового значения фильтра: откроется оно само или потребует решения.
Почти в каждом каталоге, который мы разбираем, открытых для поиска страниц фильтров оказывается в разы больше, чем запросов, под которые их вообще можно посадить. Я обычно начинаю не с закрытия лишнего, а с вопроса к владельцу: какие двадцать-тридцать комбинаций вы готовы вести как отдельные страницы — с текстом, ценами и ответственным человеком. Список почти всегда получается коротким, и это нормальный результат, а не повод расширять его искусственно.
Что в итоге
Фильтры каталога — это не техническая мелочь, которую можно отдать разработчику одной строкой в задаче. Это решение о том, из каких страниц состоит ваш сайт. Комбинаторика работает без вашего участия и всегда против вас: она превращает аккуратный каталог в облако почти одинаковых адресов, по которым робот ходит вместо того, чтобы замечать новые товары и цены. Один канонический адрес эту проблему не закрывает, а закрытие всего подряд отрезает вас от запросов с уточнениями, которые обычно ближе к покупке.
Работающая схема простая и скучная: по умолчанию закрыто всё, вручную открыт короткий список комбинаций с реальным спросом и живым ассортиментом, сортировки и параметры отображения не создают адресов вовсе, а новое значение фильтра не открывается само. В наших проектах чаще всего именно последний пункт и определяет, сохранится ли порядок через год после чистки. Технических работ тут на несколько дней, содержательных — на несколько недель, и основная их часть касается не кода, а решения, какие страницы вы действительно готовы вести.
С чего начать: Завтра выгрузите из панели вебмастера список исключённых страниц и посчитайте, сколько среди них адресов с параметрами фильтров — это и есть масштаб задачи в цифрах, которые не нужно ни у кого выпрашивать.
Вопросы и ответы
У нас всего триста товаров. Нам эта история вообще нужна?
Как раз таким каталогам она нужна больше всего. Проблема не в количестве товаров, а в количестве комбинаций: триста карточек и пять фильтров дают в разы больше адресов, чем три тысячи карточек без фильтров. И чем меньше каталог, тем обиднее, когда обращения робота уходят не на карточки, а на списки.
Проще ведь закрыть все страницы с параметрами и не думать?
Проще, и в первый месяц станет лучше. Но вместе с мусором вы закроете и те два-три десятка страниц, под которые есть реальный спрос с уточнениями, — а они обычно ближе к покупке, чем общий раздел. Разумнее потратить несколько дней на белый список, чем годами не участвовать в этих запросах.
Не будут ли открытые страницы фильтров конкурировать с основным разделом?
Будут, если они дублируют его смысл и текст. Не будут, если каждая отвечает на свой запрос и это видно в заголовке, описании и наборе товаров. Признак проблемы — когда поиск сам перекидывает показы между двумя вашими страницами по одному и тому же запросу; тогда одну из них нужно закрывать или переписывать.
Разработчик говорит, что это большая переделка. Так ли это?
Зависит от платформы. Сортировки, порядок параметров и правило «по умолчанию закрыто» — это обычно несколько дней работы на любой распространённой системе. Дорого становится тогда, когда нужны отдельные шаблоны с редактируемыми текстами и метатегами для открытых страниц: это уже задача на пару недель, но её можно отложить на второй этап.
Как быстро это отразится на трафике?
Честный ответ — не сразу и не линейно. Сначала меняется поведение робота: он начинает быстрее доходить до новых карточек, это видно в течение месяца-полутора. Видимость по запросам с уточнениями подтягивается позже, обычно к третьему-четвёртому месяцу, и только если открытые страницы наполнили содержанием, а не просто оставили открытыми.
Может пострадать реклама или удобство покупателей, если мы всё закроем?
Нет, если закрытие сделано правильно. Речь идёт только о том, что видит поисковый робот: сами фильтры продолжают работать, посадочные страницы рекламных кампаний остаются доступными, покупатель не замечает ничего. Проверить это стоит отдельным пунктом приёмки — иногда неаккуратное правило закрывает и адреса, на которые ведут объявления.
- Работа со структурой и семантикой — рост виден на горизонте 2–4 месяцев
- Технические правки: ускоряют переиндексацию, эффект заметен за 2–4 недели
- Проработка коммерческих факторов — влияет и на позиции, и на конверсию
- Наращивание объёма текстов без работы со структурой
- Ожидание результата за 2–3 недели: поиск так быстро не пересчитывает
- Гонка за баллами скорости вместо реального времени отрисовки
Что делать дальше
₽Посчитать экономикуСходится ли реклама при вашем чеке
?Задать вопросОтветим по вашей ситуации
Опишите задачу в двух словах — специалист ответит в Telegram, обычно в течение рабочего дня. Без презентаций и обязательств.
Написать в Telegram ↗✓Заявка на продвижениеРазобрать мой сайт
Бесплатно посмотрим структуру и техническую часть — пришлём задачи по приоритету, без общих слов.
Обсуждение
Спросите, что осталось непонятным — автор материала отвечает в комментариях.
