SEO

Дубли страниц: откуда берутся, чем вредят и как убрать без потерь

14 мин чтения
Максим Орлов — портрет-иллюстрация
Руководитель SEO-отдела Media Monster
6 147 просмотров

Дубли — это когда одна и та же страница открывается по нескольким адресам. Владелец их обычно не замечает: сайт работает, заказы идут. Замечает поиск — и начинает сам решать, какой из адресов показывать людям. Отсюда прыгающие позиции, медленная индексация новых товаров и отчёты, в которых один раздел разбит на десять строк. Ниже — где дубли берутся на обычном коммерческом сайте, как найти их за один вечер через Вебмастер, Метрику и краулер, чем именно склеивать каждый тип и в каком порядке всё это делать, чтобы не уронить трафик по дороге.

Коротко — главное из статьи
  • Проверка на пять минут без программ: откройте главную с www и без, по http и https, со слэшем и без, плюс /index.php. Если открылось больше одного варианта — копии главной уже есть.
  • Главный список дублей поиск отдаёт сам: Вебмастер → Индексирование → Страницы в поиске → вкладка «Исключённые» → фильтр по статусу «Дубль», внизу кнопка выгрузки таблицы.
  • Порядок важнее инструмента: сначала зеркала и хвосты адресов, потом параметры и метки, потом фильтры и пагинация, и только в конце частичные дубли по текстам.
  • Запрет в robots.txt не удаляет страницу из индекса и вдобавок закрывает роботу доступ к canonical и редиректу — это самая дорогая ошибка в теме.
  • После чистки число страниц в поиске падает в разы, и это нормально. Считать нужно трафик, заявки и скорость индексации новых страниц, а не количество адресов.

Что считается дублем и откуда он берётся на обычном сайте

Дубль — это когда одно и то же содержимое открывается по двум и более адресам. Для вас это одна страница, для поиска — две разные с одинаковым текстом. Системе приходится решать, какую из них показывать людям, и решает она не всегда в пользу той, которую вы продвигаете.

Дубли бывают полные и частичные. Полный — текст совпадает символ в символ, отличается только адрес. Частичный — совпадают заголовок, вводный абзац, блок преимуществ и подвал, а различаются две-три строки. Частичные вреднее: глазами их не отличить от нормальных страниц, владелец уверен, что у него сорок разных посадочных, а поиск видит одну, размноженную сорок раз.

Проверка на пять минут, для которой не нужны ни программы, ни подрядчик. Откройте главную по очереди в шести вариантах: с www и без www, по http и по https, со слэшем в конце адреса и без него, а потом допишите к адресу /index.php. Если открылся больше чем один вариант и вас никуда не перебросило — копии главной страницы уже существуют. В наших проектах на сайтах, которые два-три года не трогали технически, обычно открываются три-четыре варианта из шести.

Дальше — источники, из которых берётся основная масса дублей на обычном коммерческом сайте:

  • Зеркала и хвосты адреса — www и без www, http и https, слэш в конце, /index.php, заглавные буквы в адресе. Самая частая группа и самая простая в лечении.
  • Метки в ссылках — utm_source, from, yclid, gclid, идентификаторы коллтрекинга. Формально каждая метка создаёт новый адрес; когда такие ссылки попадают в индекс, одна страница множится десятками копий.
  • Фильтры и сортировки в каталоге — параметры сортировки по цене, выбора цвета, размера, количества товаров на странице. Один раздел легко порождает сотни адресов с почти одинаковым набором карточек. Какие из них стоит открывать, а какие закрывать, разобрано в материале про индексацию страниц фильтров.
  • Пагинация — вторая, третья и десятая страницы списка с тем же заголовком, тем же описанием раздела сверху и тем же текстом внизу.
  • Товар в нескольких категориях — если адрес карточки собирается из пути раздела, один товар живёт по двум-трём адресам сразу. На больших каталогах это главный источник копий, пример разбора — в статье про индексацию каталога запчастей.
  • Поиск по сайту — адреса с поисковым запросом внутри. Робот заходит по ним из ссылок и складывает в индекс пустые или почти пустые выдачи.
  • Теги и метки в блоге — одна статья попадает в пять тегов, каждый тег становится страницей со списком тех же анонсов.
  • Служебные версии — версия для печати, выгрузка в PDF, старая мобильная версия на отдельном поддомене, оставшиеся ускоренные версии страниц.
  • Тестовая копия сайта — поддомен разработчика, забытый открытым. Периодически он попадает в поиск целиком, вместе с ценами двухлетней давности.
  • Шаблонные страницы под города и районы — размноженный текст, в котором меняется только название населённого пункта и телефон.
  • Модификации товара — цвет, размер и комплектация отдельными карточками с одинаковым описанием.
  • Одинаковые заголовки title и описания description, сгенерированные по одному шаблону. Страницы разные, но для поиска они близнецы.

Важно понимать: большинство дублей появляется не по вине владельца, а из коробки. Движок по умолчанию отдаёт карточку по нескольким адресам, шаблон подставляет один и тот же заголовок, модуль фильтров плодит параметры. В наших проектах на каталоге из трёх-пяти тысяч товаров краулер обычно находит от двадцати до шестидесяти тысяч адресов, и полезных среди них меньше трети.

Чем дубли вредят на самом деле: шесть последствий

Владельцу дубли обычно не мешают жить: сайт открывается, телефон звонит. Вред виден в отчётах и складывается из шести вещей.

Поиск сам выбирает адрес и меняет решение. Из двух одинаковых страниц в выдачу попадает одна, и выбирает её алгоритм. Сегодня это ваш вылизанный раздел с ценами и формой, завтра — его копия с параметром сортировки, где нет ни описания, ни блока с телефоном. Со стороны это выглядит как «позиции скачут»: страница то на пятом месте, то на двадцать пятом, хотя вы ничего не меняли.

Свои страницы конкурируют между собой. Это называется каннибализацией — когда под один и тот же запрос у вас претендуют две-три собственные страницы, и ни одна не набирает достаточно сигналов, чтобы закрепиться. Классика: раздел каталога и страница фильтра с почти тем же набором товаров, обе про одно и то же.

Робот тратит обход на мусор. У поискового робота есть лимит на количество скачиваемых страниц за визит — краулинговый бюджет. Если из тысячи адресов девятьсот — копии, новые товары робот увидит нескоро. В наших проектах на захламлённых каталогах доля мусорных адресов в отчёте «Статистика обхода» обычно 40–70%, а свежая карточка попадает в поиск через три-шесть недель вместо нескольких дней.

Сигналы размазываются. Часть ссылок с других сайтов ведёт на один вариант адреса, часть — на другой, поведение людей тоже делится между копиями. Вместо одной сильной страницы получается несколько слабых.

Аналитика врёт. В Метрике отчёт «Страницы входа» разбивает один раздел на пять-десять строк: с меткой, без метки, со слэшем, без слэша. Владелец смотрит на верхнюю строку, видит тридцать визитов вместо трёхсот и делает вывод, что направление не работает. Мы регулярно встречаем ситуацию, когда «мёртвый» раздел на деле входил в тройку по трафику — просто он был размазан по десятку адресов.

Реклама дорожает. Объявления из разных групп ведут на разные копии одной посадочной, статистика делится, автостратегии учатся медленнее, потому что каждая копия набирает конверсии отдельно. Плюс перегруз: два объявления фактически конкурируют за одного и того же человека.

Отдельная ситуация — когда трафик уже просел и непонятно, дубли ли виноваты. Тогда сначала имеет смысл пройти общий сценарий из разбора что делать, если трафик упал, и только потом лезть в склейку: падение из-за дублей обычно выглядит как плавное сползание за два-три месяца, а не как обрыв за одну неделю.

И сразу оговорка про масштаб. Пять копий главной на сайте-визитке из десяти страниц — это неприятно, но не смертельно. Пятнадцать тысяч копий на каталоге — это уже причина, по которой половина товаров годами не появляется в поиске. Прежде чем вкладываться в чистку, посмотрите на порядок цифр: он определяет, стоит ли это двух дней работы или двух месяцев.

Как найти все дубли за один вечер: куда нажимать

Порядок такой: сначала списки, которые поисковые системы отдают сами, потом собственный обход сайта, потом Метрика и Директ для оценки ущерба. Всё вместе занимает вечер, из которого больше половины уходит на ожидание краулера.

Шаг 1. Яндекс Вебмастер, раздел «Индексирование» → «Страницы в поиске». Переключитесь на вкладку «Исключённые страницы» и в фильтре статуса выберите «Дубль». Внизу списка есть кнопка выгрузки таблицы — скачайте её целиком, в файле будут адрес и статус. Это самый честный список: не ваши предположения, а то, что поиск уже посчитал копиями. В наших проектах на среднем каталоге тут обычно от нескольких сотен до нескольких десятков тысяч строк.

Шаг 2. Там же, «Диагностика» → «Диагностика сайта». Ищите уведомление о найденных страницах-дублях с GET-параметрами: система прямо называет параметры, которые стоит склеить. Дальше «Индексирование» → «Статистика обхода»: здесь видно, что робот скачивал последние дни. Отфильтруйте по коду ответа 200 и посмотрите, какая доля обходов уходит на адреса со знаком вопроса. Что ещё полезно смотреть в панели каждую неделю — в материале про отчёты Вебмастера для владельца.

Шаг 3. Search Console. Раздел «Индексирование» → «Страницы», блок непроиндексированных. Нужны две причины: страница признана копией без выбранной канонической и «Google выбрал канонической другую страницу». Вторая особенно полезна — система прямо показывает, какой адрес она считает главным. Если это не тот адрес, который вы продвигаете, вы нашли проблему.

Шаг 4. Обход сайта краулером. Подойдёт любая настольная программа-обходчик. Сравните три числа: сколько адресов нашёл краулер, сколько у вас реально товаров и услуг, сколько страниц в поиске по данным Вебмастера. Расхождение в разы и есть объём работы. Отдельно отсортируйте выгрузку по столбцу с заголовком title — одинаковые заголовки встанут подряд, и частичные дубли будут видны без всякого анализа текстов. Как встроить эту проверку в регулярную процедуру, описано в порядке технического аудита сайта.

Шаг 5. Метрика. «Отчёты» → «Содержание» → «Страницы входа», период три месяца. В фильтре задайте условие, что адрес страницы содержит знак вопроса, — увидите, сколько живых визитов приходит на адреса с параметрами. Потом снимите фильтр и поищите глазами повторяющиеся названия разделов: одинаковые страницы почти всегда стоят рядом.

Шаг 6. Директ. В Мастере отчётов сгруппируйте данные по посадочной странице. Если одна и та же посадочная встречается в нескольких вариантах написания, вы платите за трафик, который потом разъезжается по копиям.

Где смотретьЧто открытьЧто ищемВремя
Яндекс ВебмастерИндексирование → Страницы в поиске → Исключённые, фильтр «Дубль»Готовый список адресов-копий15 минут
Яндекс ВебмастерИндексирование → Статистика обходаДоля мусора в обходе робота10 минут
Search ConsoleИндексирование → СтраницыКопии и чужой выбор канонической15 минут
КраулерПолный обход доменаРазрыв между числом адресов и числом товаров, одинаковые title1–3 часа
МетрикаСодержание → Страницы входаВизиты на адреса с параметрами и на копии20 минут
ДиректМастер отчётов, группировка по страницеРазные написания одной посадочной10 минут
Бесплатный SEO-аудит сайта

Разберём ваш сайт, как в статьях этого блога: что мешает расти в Яндексе и Google и где теряются заявки.

Отправка формы не является заключением договора и не порождает обязательств сторон.

Чем склеивать: пять инструментов и когда какой применять

Инструментов немного, и путать их дорого. Разберём по одному, а потом сведём в таблицу.

301-й редиректпостоянная переадресация. Робот и человек, зайдя на старый адрес, попадают на новый; старый со временем выпадает из поиска, а его накопленные сигналы переходят на новый. Это самый надёжный вариант, когда старый адрес больше никому не нужен: зеркала, слэши, index.php, переехавшие разделы. Минус один: страницу физически нельзя открыть, поэтому для фильтров и сортировок редирект не годится — человек должен видеть отфильтрованный список.

Атрибут canonical — строка в коде страницы вида . Она говорит поиску: показывать нужно вот этот адрес. Страница при этом остаётся доступной. Идеально для фильтров, сортировок, меток и карточек, которые открываются из разных разделов. Важно: это рекомендация, а не приказ. Если содержимое страниц заметно различается, поиск вправе её проигнорировать. В наших проектах canonical срабатывает как задумано примерно в 8 случаях из 10, остальные требуют других мер.

Директива Clean-param в robots.txt — способ сказать Яндексу, что определённые параметры в адресе не меняют содержимое и их можно не учитывать. Работает точнее canonical для меток и сортировок, но понимает её только Яндекс, поэтому canonical всё равно нужен.

Метатег noindex — строка в коде. Страница доступна людям, но не попадает в поиск. Подходит для страниц поиска по сайту, корзины, личного кабинета, служебных версий.

Запрет в robots.txt — не инструмент склейки, а инструмент экономии обхода. Он запрещает роботу скачивать адрес, но не удаляет уже проиндексированное. Более того, закрытую страницу робот не скачает и не увидит ни canonical, ни noindex, ни редирект. Поэтому запрет ставят только на то, чего в индексе нет и не должно быть.

СпособКогда применятьЧто происходит с адресомКогда сработаетЧем рискуете
301-редиректЗеркала, слэши, index.php, удалённые и переехавшие страницыОткрыть нельзя, сигналы переходят на новый адресОбычно 2–6 недельЦепочки редиректов и переброс всего на главную
canonicalФильтры, сортировки, метки, карточка в нескольких разделах, пагинацияОткрывается, в поиск идёт указанный адресОбычно 3–8 недельЭто рекомендация: при разном содержимом может не сработать
Clean-paramПараметры и метки, не меняющие содержимоеОткрывается, параметр игнорируетсяОбычно 2–4 неделиПонимает только Яндекс, нужен ещё canonical
noindexПоиск по сайту, корзина, версии для печати, служебные страницыОткрывается, из поиска исчезаетОбычно 2–6 недельЗабыли снять после теста — страница выпала совсем
Запрет в robots.txtРазделы, которых в индексе нет и не должно бытьРобот не скачивает, из индекса не удаляетНе удаляет вовсеБлокирует доступ к canonical и редиректу

Отдельный случай — когда дублируется весь сайт целиком: старый домен, поддомен с мобильной версией, тестовая копия. Тут работает не точечная склейка, а полноценный переезд с постраничными редиректами и настройкой в Вебмастере; порядок действий разобран в кейсе про переезд сайта без потери трафика.

Порядок работ: что делать первым, вторым и десятым

Дубли чистят сверху вниз: от того, что множит весь сайт целиком, к тому, что портит отдельные страницы. Если начать с конца, вы будете переделывать одно и то же по три раза.

  1. Определите главный адрес. Один вариант: с www или без, по https, со слэшем или без. Запишите решение и дальше не отступайте от него нигде — ни в меню, ни в карте сайта, ни в рекламе.
  2. Настройте зеркала. Постоянный редирект со всех остальных вариантов на главный: с http на https, с www на без www (или наоборот), с /index.php на корень. Проверьте потом руками все шесть вариантов из первого раздела — каждый должен приводить на один адрес.
  3. Приведите слэши к одному виду. На большинстве движков это одна настройка. Ошибка здесь безобидна на вид, но удваивает вообще все страницы сайта.
  4. Закройте метки. Добавьте Clean-param для рекламных и служебных параметров и убедитесь, что на каждой странице стоит canonical на чистый адрес без хвостов. Заодно наведите порядок в самих ссылках — как это устроено, показано в разборе системы UTM-меток.
  5. Разберитесь с фильтрами. Решите, какие комбинации нужны людям в поиске: обычно это фильтры по одному признаку, который люди действительно ищут, — цвет, размер, бренд-нейтральные характеристики. Такие страницы получают собственные заголовки, описание и canonical сами на себя. Остальные — canonical на раздел.
  6. Настройте пагинацию. Каждая страница списка ссылается canonical сама на себя, но у второй и последующих должен различаться заголовок, а описательный текст раздела показывается только на первой.
  7. Сделайте один адрес карточке товара. Товар живёт по одному адресу, независимо от того, из какого раздела в него зашли. Со старых путей — постоянный редирект.
  8. Уберите служебное. Поиск по сайту, корзина, сравнение, версии для печати — метатег noindex. Тестовые копии сайта закрыть паролем на уровне сервера, а не запретом в robots.txt.
  9. Почистите частичные дубли. Возьмите выгрузку с одинаковыми заголовками и переписывайте по приоритету: сначала страницы, на которые идёт реклама, потом самые посещаемые. Правило простое — на каждой странице должно быть минимум по одному факту, которого нет на соседней: свои цены, свои сроки, свой список работ.
  10. Обновите карту сайта и внутренние ссылки. В карте sitemap остаются только канонические адреса. Меню, хлебные крошки и ссылки в текстах ведут на тот же вариант написания. Мы регулярно видим, как редиректы настроены правильно, а половина внутренних ссылок продолжает вести на старые адреса.

Два рабочих правила. Первое: одно изменение за раз, с записью даты в общий файл. Если после массовой правки трафик просядет, вы должны знать, какое именно действие это вызвало. Второе: после каждого крупного шага отправляйте несколько адресов на переобход в Вебмастере — раздел «Индексирование» → «Переобход страниц». В наших проектах массовые склейки обычно проявляются в отчётах через две-шесть недель, точечные — быстрее.

Сколько это занимает: на визитке до полусотни страниц — обычно один-два дня, на каталоге из нескольких тысяч товаров — от двух недель до полутора месяцев, причём основное время уходит не на настройку, а на согласование того, какие страницы фильтров вам действительно нужны.

Пять ошибок, которые владелец обычно делает сам

Дубли — редкая тема, где владелец лезет чинить сам: советов в интернете много, выглядят они просто. Вот что мы разбираем чаще всего.

Ошибка первая: закрыть всё в robots.txt. Самый популярный и самый дорогой ход. Логика понятная: «страниц-мусора много, запрещу роботу их смотреть». Проблема в том, что запрет не удаляет уже проиндексированное, а вдобавок закрывает роботу доступ к самой странице — он больше не увидит ни canonical, ни редирект, ни noindex, которые вы там поставили. В итоге копии висят в поиске годами. Отдельный сюжет — когда в файл случайно попадает лишняя строка и под запрет уходит рабочий раздел; чем это заканчивается, показано в кейсе про обвал трафика из-за robots.txt.

Ошибка вторая: canonical со всех страниц на главную. Совет «поставьте канониклы» понимают буквально и прописывают один адрес на весь сайт. Формально дубли исчезают, фактически из поиска пропадает весь каталог: вы сами сообщили, что настоящая страница только одна. Признак беды — в Вебмастере растёт число исключённых страниц со статусом про неканонический адрес, а трафик падает по всем разделам сразу.

Ошибка третья: удалить копии и отдать 404. Владелец находит список дублей и просит программиста «убрать эти страницы». Часть адресов при этом была не мусором, а рабочими страницами с трафиком и ссылками. Правило: если у адреса были визиты или внешние ссылки — постоянный редирект на живой аналог, и только полностью пустые технические адреса можно отдавать как несуществующие.

Ошибка четвёртая: размножить страницы под города копипастой. Берётся один текст, в нём меняется название населённого пункта, получается тридцать «посадочных». Поиск склеивает их между собой, в выдаче остаётся одна-две, а остальные висят мёртвым грузом. Такая страница живёт, только если на ней есть что-то своё: адрес пункта выдачи или зона выезда, местные сроки, стоимость доставки именно туда, работы, выполненные в этом городе.

Ошибка пятая: цепочки редиректов и правки «на всякий случай». Адрес ведёт на второй, тот на третий, третий на четвёртый. Каждое звено — потеря скорости и части сигналов, а иногда цепочка закольцовывается, и страница не открывается вовсе. Проверяется это в отчёте краулера по столбцу с количеством переадресаций: длина цепочки должна быть равна единице.

Общий знаменатель всех пяти — массовое действие без проверки на маленькой группе. Разумный порядок: сделать на десяти адресах, подождать две недели, посмотреть в Вебмастере, что с ними стало, и только потом раскатывать на весь сайт. Это дольше на две недели и дешевле на несколько месяцев восстановления.

2026 год: новые источники дублей и как держать оборону

Сама механика склейки за годы не изменилась, а вот источники дублей заметно обновились.

Тексты, сгенерированные пачками. Сейчас ничего не стоит выпустить сто страниц под сто запросов за вечер. Проблема в том, что при одинаковом задании модель выдаёт одинаковую структуру и одинаковые формулировки — получаются частичные дубли в промышленных объёмах. Рабочее правило: на каждую такую страницу — минимум один факт, которого нет нигде больше на сайте: своя цена, свой срок, свой набор работ, свой пример. Как писать под ответы нейропоиска, чтобы страница вообще имела шанс попасть в цитирование, разобрано в материале про тексты под нейропоиск.

Нейропоисковые ответы усилили цену ошибки. Когда система собирает короткий ответ и ссылается на источник, она берёт один адрес. Если победил обрезанный вариант вашей страницы — без цен, без условий доставки, без формы, — вы получаете упоминание, которое не приводит клиента. Проверить просто: задайте свой типовой вопрос в поиске и посмотрите, какой именно адрес вашего сайта приведён в ответе.

Мобильный трафик преобладает. Старые отдельные мобильные поддомены — это дубль всего сайта разом, и в 2026 году держать такую схему смысла нет. Если у вас остался такой поддомен, его содержимое либо переносится в адаптивный шаблон, либо склеивается редиректами. Заодно стоит пройти чек-лист мобильной версии: часто выясняется, что склеивать особо нечего — мобильная копия давно отстала по ассортименту.

Автостратегии в рекламе. Когда объявления ведут на разные копии одной посадочной, конверсии распределяются между адресами, и обучение идёт медленнее. Перед запуском кампании имеет смысл прогнать все посадочные ссылки через проверку: открывается ли адрес напрямую, без переадресации, и совпадает ли он с каноническим.

Дальше — контроль. После чистки план проверок такой:

  • Через 2 недели. Вебмастер, «Статистика обхода»: доля адресов с параметрами должна пойти вниз. В Метрике смотрим, не просели ли входы на ключевые разделы.
  • Через 6 недель. «Страницы в поиске»: общее число страниц обычно падает — иногда в разы, и это нормальный результат чистки. Смотреть нужно не на количество, а на трафик и заявки.
  • Через 3 месяца. Проверяем скорость индексации: добавьте новый товар и засеките, через сколько дней он появится в поиске. В наших проектах после нормальной чистки этот срок обычно сокращается с трёх-шести недель до нескольких дней.

И регулярная гигиена: раз в квартал прогонять сайт краулером и сверять число адресов с числом страниц в поиске. Дубли — не разовая болезнь, а следствие того, что сайт живёт: добавляется модуль, меняется шаблон, маркетолог выкладывает ссылку с новой меткой. Проверка занимает час в квартал и, как правило, обходится дешевле, чем разбор последствий через год.

Путь клиента: где эта тема срабатывает

У дублей есть собственный жизненный цикл — от момента, когда движок впервые отдал страницу по второму адресу, до момента, когда владелец видит последствия в отчётах. Рвётся эта цепочка почти всегда в середине: копии уже есть и уже мешают, но снаружи ничего не видно, и никто ничего не делает.

Копии появляются

Что у клиентаПодключили модуль фильтров, поменяли шаблон, начали ставить метки в ссылках — и один раздел стал открываться по десяткам адресов.

Что делаемПроверять сайт краулером после каждой доработки и сверять число найденных адресов с числом реальных страниц.

Сигнал, что работаетЧисло адресов в обходе не выросло скачком после релиза.

Поиск их индексирует

Что у клиентаРобот скачивает копии, кладёт часть в индекс, остальные помечает как дубли и тратит на них обход.

Что делаемРаз в месяц открывать в Вебмастере «Страницы в поиске» → «Исключённые» и смотреть объём статуса «Дубль».

Сигнал, что работаетДоля адресов с параметрами в статистике обхода не растёт от месяца к месяцу.

Владелец видит симптом

Что у клиентаПозиции скачут, новые товары долго не появляются в поиске, отчёты по разделам выглядят слабее, чем ожидалось.

Что делаемНе гадать про алгоритмы, а сверить три числа: адреса в краулере, страницы в поиске, реальные товары.

Сигнал, что работаетРасхождение объяснимо и не превышает разы.

Чистка

Что у клиентаНастраиваются редиректы, канонические адреса, Clean-param, снимаются лишние страницы с индексации.

Что делаемДелать по одному типу дублей за раз, обкатывать на десяти адресах и записывать даты изменений.

Сигнал, что работаетВ журнале есть дата, автор и список адресов по каждому шагу.

Проверка результата

Что у клиентаЧерез несколько недель число страниц в поиске падает, и это пугает — кажется, что сайт «выпал».

Что делаемСмотреть на трафик, заявки и скорость индексации новых страниц, а не на количество адресов в индексе.

Сигнал, что работаетНовый товар попадает в поиск за дни, а не за недели, трафик ключевых разделов держится.

Стратегия: что делать по шагам

Цель: За квартал привести сайт к состоянию «одна страница — один адрес»: убрать копии из индекса, освободить обход робота под реальные товары и услуги и поставить регулярную проверку, чтобы дубли не отрастали заново после каждой доработки.

  1. Неделя 1 Собрать факты: выгрузить из Вебмастера исключённые страницы со статусом «Дубль», посмотреть статистику обхода и уведомления диагностики, открыть в Search Console отчёт по непроиндексированным страницам. На руках список копий от самих поисковых систем и понимание масштаба — сотни адресов или десятки тысяч.
  2. Неделя 2 Прогнать сайт краулером, сверить число адресов с числом реальных товаров и услуг, отсортировать выгрузку по заголовкам title и выделить частичные дубли. Дубли разложены по типам, у каждого типа определён способ склейки: редирект, canonical, Clean-param или noindex.
  3. Неделя 3 Закрыть верхний уровень: выбрать главный вариант адреса, настроить редиректы с зеркал, слэшей и index.php, привести к нему все внутренние ссылки, меню и карту сайта. Все варианты главной ведут на один адрес, сайт перестал дублироваться целиком.
  4. Недели 4–6 Разобраться с параметрами: добавить Clean-param, поставить canonical на чистые адреса, решить, какие страницы фильтров оставить открытыми под спрос, остальные склеить на раздел. Доля адресов с параметрами в статистике обхода начинает снижаться, робот чаще заходит на реальные карточки.
  5. Месяц 2 Свести карточку товара к одному адресу, настроить пагинацию, снять с индексации служебные страницы, закрыть тестовую копию сайта паролем на уровне сервера. Каталог перестал плодить копии, число страниц в поиске идёт вниз при сохранении трафика.
  6. Месяц 3 Переписать частичные дубли по приоритету — сначала рекламные посадочные, потом самые посещаемые страницы, — и поставить в календарь ежеквартальный обход краулером со сверкой цифр. У каждой страницы есть собственные факты и заголовок, а повторное зарастание дублями отслеживается регулярно.

Сроки — ориентир для планирования, а не обязательство: скорость зависит от ниши, конкуренции и состояния сайта.

Чек-лист: проверка сайта на дубли за один вечер

Пройдите по списку с открытым Вебмастером, Метрикой и выгрузкой краулера. Каждый пункт проверяется за несколько минут, а любой невыполненный — это либо потерянный обход робота, либо страница, которую поиск показывает вместо вашей продвигаемой.

  • Главная открывается только по одному адресу: варианты с www, по http, со слэшем и с /index.php перебрасывают на него
  • В Вебмастере, в разделе «Страницы в поиске» → «Исключённые», выгружен список со статусом «Дубль» и посчитан его объём
  • В диагностике сайта нет активного уведомления про страницы-дубли с GET-параметрами
  • В статистике обхода доля адресов со знаком вопроса не превышает единиц процентов
  • В Search Console проверены причины «страница является копией» и «канонической выбрана другая страница»
  • Число адресов в краулере сопоставимо с числом реальных товаров и услуг, а не больше его в разы
  • Выгрузка отсортирована по title, повторяющиеся заголовки выписаны отдельным списком
  • Длина каждой цепочки переадресаций равна единице, закольцованных редиректов нет
  • Карточка товара открывается по одному адресу независимо от того, из какого раздела в неё зашли
  • В карте сайта sitemap только канонические адреса, внутренние ссылки ведут на них же
  • Страницы поиска по сайту, корзины и версий для печати закрыты метатегом noindex, а не запретом в robots.txt
  • Тестовая копия сайта закрыта паролем на уровне сервера и не отдаёт содержимое поисковым роботам
Скачать чек-лист ↓
Когда владелец говорит «сайт не растёт, хотя всё сделано», я первым делом открываю статистику обхода. Если робот половину визитов тратит на сортировки и метки, никакого продвижения там просто не происходит — новые страницы он видит через месяц. Чистка дублей выглядит скучно, зато это та работа, после которой всё остальное наконец начинает работать.
Максим ОрловРуководитель SEO-отдела Media Monster

Что в итоге

Дубли — не катастрофа и не мелочь, а обычная техническая запущенность, которая копится сама. Лечится она в понятном порядке: сначала зеркала и хвосты адресов, потом метки и параметры, потом фильтры и пагинация, в конце — одинаковые тексты и заголовки. Инструментов всего пять, и путать их дорого: редирект убирает адрес совсем, canonical оставляет страницу людям, Clean-param гасит параметры для Яндекса, noindex прячет служебное, а запрет в robots.txt не удаляет из поиска ничего.

Главное, что стоит запомнить владельцу: после чистки количество страниц в поиске падает, и это нормальный результат, а не потеря. Считать нужно другое — трафик ключевых разделов, заявки и срок, за который новый товар попадает в поиск. В наших проектах именно этот срок обычно и меняется сильнее всего: с нескольких недель до нескольких дней.

С чего начать: Начните с пятиминутной проверки главной в шести вариантах написания адреса и с выгрузки исключённых страниц со статусом «Дубль» в Вебмастере — эти два действия за полчаса покажут, идёт ли речь о косметике или о полноценной перестройке каталога.

Вопросы и ответы

Через сколько дубли уйдут из поиска после настройки?

Зависит от того, как часто робот заходит на сайт. В наших проектах первые изменения видны в Вебмастере через 2–3 недели, основная масса адресов уходит за 4–8 недель, крупные каталоги перестраиваются до трёх месяцев. Ускорить можно частично: раздел «Индексирование» → «Переобход страниц» в Вебмастере позволяет отправить приоритетные адреса вручную, но лимит там ограничен, поэтому тратьте его на важные разделы, а не на мусор.

Можно ли просто закрыть все дубли в robots.txt?

Нет, и это самая частая ошибка в теме. Запрет в robots.txt говорит роботу «не скачивай», но не говорит «удали из поиска». Уже проиндексированные копии останутся, а робот вдобавок перестанет видеть на этих страницах и canonical, и редирект, которые могли бы их склеить. Правильный порядок обратный: сначала склеить редиректом или каноническим адресом, дождаться, когда копии выпадут, и только потом при желании закрывать раздел от обхода.

Упадёт ли трафик, если убрать дубли?

Число страниц в поиске почти наверняка упадёт, иногда в несколько раз, — это ожидаемый результат, а не авария. Трафик в наших проектах чаще всего держится или растёт, но короткая просадка на 1–3 недели во время переиндексации встречается. Чтобы отличить нормальную просадку от ошибки, смотрите не общий график, а трафик на ключевые разделы: если проседают именно они, значит склеили не туда.

Чем canonical отличается от 301-редиректа?

Редирект физически перебрасывает человека и робота на другой адрес — старую страницу открыть нельзя. Canonical оставляет страницу доступной, но сообщает поиску, какой адрес показывать в выдаче. Отсюда правило выбора: если страница нужна людям (фильтр, сортировка, ссылка с меткой) — canonical; если старый адрес никому не нужен (зеркало, лишний слэш, переехавший раздел) — редирект. И помните, что canonical — рекомендация, поиск может её не учесть, если содержимое страниц заметно различается.

Нужно ли закрывать все страницы фильтров?

Нет. Часть фильтров отвечает на реальный спрос, и такие страницы приносят трафик по конкретным запросам. Проверяется это по Вордстату: если по сочетанию «товар + признак» есть заметная частотность, страницу стоит оставить открытой, дать ей собственный заголовок и описание и поставить canonical саму на себя. Всё, что спросом не подтверждено, — сортировки, комбинации из трёх и более признаков, постраничные срезы — склеивается на родительский раздел.

У нас поддомены под города с одинаковым текстом. Это дубли?

Формально это разные сайты, но поиск неплохо распознаёт размноженный контент и оставляет в выдаче один-два поддомена. Работать это начинает, когда на каждом поддомене есть своё: контакты и зона выезда, местные цены и сроки, выполненные в этом регионе работы, отзывы местных клиентов. Отзывы и фотографии объектов публикуйте только с письменного согласия клиента на использование материалов и обработку данных, а если на фото видны люди — ещё и с согласием на использование изображения.

Официальные справки по теме
Максим Орлов — портрет-иллюстрация
Руководитель SEO-отдела Media Monster

Максим занимается поисковым продвижением 11 лет: начинал с собственных контентных проектов, затем вырос от специалиста до руководителя SEO-отдела в агентстве. Специализируется на технических аудитах, работе с большими сайтами и контент-стратегии под Яндекс и Google. В Media Monster отвечает за методологию продвижения, контролирует ключевые проекты и обучает команду.

С какими задачами к нему приходят

Чаще всего — «сайт есть несколько лет, а трафика нет». За этой формулировкой обычно скрывается одно из трёх: структура собрана по внутренней логике компании, а не по тому, как товар ищут; техническая часть мешает поисковику дойти до половины страниц; или страницы есть, но они не отвечают на вопрос, с которым человек пришёл. Вторая по частоте задача — разбор инцидента: трафик резко упал, и нужно быстро понять почему.

Отдельная категория — проверка работы предыдущего подрядчика. Здесь Максим смотрит не на отчёты, а на то, что реально изменилось на сайте: какие страницы появились, что стало с индексом, какие правки внесены в код.

Как работает

Принцип, который он повторяет команде: сначала диагностика, потом работы. До начала любых действий собирается картина — что в индексе, где спрос, чем закрыт, куда уходят люди. Это занимает от нескольких дней до двух недель и часто меняет исходный план: задача, с которой пришёл клиент, оказывается следствием, а не причиной.

Каждая рекомендация в его отчётах сопровождается ответом на вопрос «как мы поймём, что это сработало». Если измеримого критерия нет, пункт из плана убирается.

Чего не делает

Не обещает позиций и сроков выхода в топ — ни один подрядчик не управляет алгоритмами поиска. Не берётся за проекты, где нельзя вносить изменения в сайт: без доступа к структуре и коду продвижение сводится к написанию текстов, а это редко решает задачу. Не использует схемы, за которые сайт может получить санкции, — накрутку поведенческих факторов, скрытый текст, покупку ссылок пачками.

В блоге

Пишет в рубрики «SEO» и «Кейсы»: технические разборы, чек-листы и истории проектов, включая те, где часть гипотез не сработала. Все клиентские материалы публикуются обезличенно — ниша, регион и название компании не раскрываются.

Портрет автора — иллюстрация, а не фотография.

Материал подготовлен по редакционной политике блога: практика проектов, официальные источники, проверка перед публикацией.

Что это даёт на практике
Главное из этого материала. Проверка на пять минут без программ: откройте главную с www и без, по http и https, со слэшем и без, плюс /index.php. Если открылось больше одного варианта — копии главной уже есть.
✓ Что работает
  • Работа со структурой и семантикой — рост виден на горизонте 2–4 месяцев
  • Технические правки: ускоряют переиндексацию, эффект заметен за 2–4 недели
  • Проработка коммерческих факторов — влияет и на позиции, и на конверсию
✕ Что результата не даёт
  • Наращивание объёма текстов без работы со структурой
  • Ожидание результата за 2–3 недели: поиск так быстро не пересчитывает
  • Гонка за баллами скорости вместо реального времени отрисовки
Выводы обобщены по проектам направления «SEO» и обезличены: названия компаний, домены и иные идентифицирующие данные не раскрываются. Результат в каждом проекте зависит от ниши, конкуренции и исходного состояния — см. условия использования.
Хотите понять, где именно у вас теряется трафик?
Бесплатно посмотрим структуру и техническую часть — пришлём задачи по приоритету, без общих слов.
Разобрать мой сайт

Обсуждение

Спросите, что осталось непонятным — автор материала отвечает в комментариях.

Загружаем комментарии…
Комментарии — от подтверждённых читателей

Один раз подтвердите себя в Telegram: так в обсуждении нет спама, а имя подставляется само. Мы видим только имя и никогда не пишем первыми без вашего запроса.

Читайте по теме

← Все статьи рубрики «SEO»

SEO-продвижение сайтов

SEO автосервиса по услугам: страницы под работы, а не под общие запросы Что писать на странице «О компании», чтобы она продавала, а не занимала место Товарные страницы стройматериалов: остатки, цены и вечная проблема наличия Продвижение на несколько городов: поддомены, папки или один сайт Дубли страниц: откуда берутся, чем вредят и как убрать без потерь Все статьи рубрики (38) →

Реклама в Яндекс Директе

Подрядчик на площадках объявлений: когда Авито и агрегаторы дают заявки дешевле сайта Маркировка интернет-рекламы в 2026: обязанности рекламодателя и типовые ошибки Директ для оконной компании: замер, а не заявка Единая перфоманс-кампания в Яндекс Директе: кому подходит и как её не сломать Реклама для дверей: какие каналы дают заявки и сколько стоят Все статьи рубрики (17) →

SMM и таргетированная реклама

Фотографии объектов и товаров: как снимать, чтобы это работало на продажи и на поиск Репутация в поиске: что делать с негативом и отзывами о компании Таргет во ВКонтакте: связки, которые дают заявки в 2026 Отделочные и общестроительные работы: продвижение через объекты и фотоотчёты Возврат клиентов через мессенджеры и рассылки: как напоминать о себе и не стать спамом Все статьи рубрики (9) →

Разработка сайтов

Прайс на сайте: показывать цены или нет и что делать, если цена индивидуальная Сайт производителя окон против сайта монтажной бригады: разные задачи, разная структура Изображения на сайте: вес, форматы и alt, от которых зависит скорость и трафик Телефон, форма или мессенджер: как выбрать способ обращения под свою нишу A/B-тесты на сайте небольшой компании: как проверять идеи, когда трафика мало Все статьи рубрики (18) →

Веб-аналитика и сквозная аналитика

Аналитика оконного бизнеса: как проследить путь от клика до подписанного договора Аналитика автосалона: звонки, тест-драйвы и что считать конверсией Как читать отчёт подрядчика по рекламе: восемь мест, где обычно прячут проблемы Окупаемость SEO: как посчитать вложения и когда ждать первых денег от органики Повторные продажи в услугах: как посчитать LTV и на чём его растить Все статьи рубрики (17) →

Кейсы с цифрами

Кейс: подрядчик загородного строительства перестал считать заявки и начал считать выезды Кейс: как оконная компания готовилась к сезону с января — сайт, реклама и учёт замеров Кейс: автосервис вышел в локальную выдачу без бюджета на ссылки Кейс: как готовили сезонный бизнес к пику спроса и почему часть работ не окупилась Кейс: продвижение в B2B, где сделка закрывается через полгода Все статьи рубрики (13) →

Подтемы

Семантическое ядро Яндекс Метрика Автостратегии Директа Регионы и гео Интернет-магазины Все подтемы (9) →

Словарь терминов

ДРР — что это CPL — что это CAC — что это Когортный анализ — что это UTM-метки — что это Все термины (36) →

Ниши и категории

Мебельный маркетинг 7 Дверной бизнес 2 B2B-сектор 2 Недвижимость 2 E-commerce 2 Все направления (10) →

SEO в 2026

GEO — ответы нейросетей Локальный спрос и карты Технический аудит Внутренняя перелинковка Коммерческие факторы

Сейчас читают

Кейс: рост органики в 4 раза за 7 месяцев — и почему первые три были почти без результата Кейс: в 2,2 раза больше заявок на том же бюджете — за счёт перераспределения Кейс: трафик упал на 38% — разбор инцидента по часам Коммерческие факторы ранжирования: полный чек-лист из 18 пунктов «Обучение стратегии остановлено» в Яндекс Директе: причины и что делать Карта блога — все статьи RSS-лента блога

Блог Media Monster

Бесплатный аудит сайта и рекламы Как мы готовим материалы Условия использования Политика конфиденциальности Согласие на обработку данных