Дубли страниц: откуда берутся и как их убрать, не потеряв трафик

Дубли страниц: откуда берутся и как их убрать, не потеряв трафик

Откуда на сайтах появляются дубли: слеш, www, http, параметры фильтров и utm, пагинация, товар в нескольких категориях. Чем canonical отличается от 301 и noindex.
Техническое SEO18 августа 2026 г.10 мин
Кратко

Разбираем источники дублей на коробочных CMS и объясняем, когда применять 301-редирект, когда canonical, а когда noindex.

Вопрос

Откуда берутся дубли страниц и как их убрать, ничего не сломав?

Дубли почти никогда не создаёт человек — их порождает сама CMS: один и тот же материал открывается со слешем и без, с www и без, по http и по https, с параметрами фильтров и utm-метками, а карточка товара доступна из трёх разных категорий. Убирают дубли тремя разными инструментами, и подменять один другим нельзя: 301-редирект — когда адрес больше не нужен и весь трафик надо перевести на другой, rel="canonical" — когда обе страницы должны оставаться доступными людям, но в поиске нужна одна, noindex — когда страница нужна пользователю, но в выдаче ей делать нечего. Перед склейкой обязательно посмотрите, какой из адресов уже получает переходы, и оставляйте главным именно его.

Дубли страниц: откуда берутся и как их убрать, не потеряв трафик — статья блога ВебСпринт

Что разберем

  • Что на самом деле теряет сайт с дублями
  • Дубли, которые создаёт сама CMS: слеш, регистр, index.php
  • Параметры: фильтры, сортировки, utm-метки и идентификаторы сессий

Кому особенно полезно

Техническое SEOРазработка интернет-магазинаSEO продвижениеЗаявки для мебели на заказ

Для владельцев каталогов и интернет-магазинов на коробочных CMS, где число адресов давно перевалило за число реальных товаров, и для тех, кто боится «склеивать» страницы, чтобы не обвалить уже идущий трафик.

В каталоге 400 товаров, а в Яндекс.Вебмастере робот обошёл 11 тысяч адресов. Знакомая картина для любого интернет-магазина на коробочной CMS. Разница между этими числами — дубли: адреса с параметрами сортировки, версии для печати, один товар в нескольких разделах, страницы с utm-метками из рекламы. Сами по себе они сайту не «вредят» в смысле наказания, но они размывают сигналы между копиями и заставляют робота тратить визиты на мусор вместо новых страниц. Разбираем, откуда дубли берутся и как их убирать, не обрушив то, что уже приносит трафик.

«Самая дорогая ошибка при работе с дублями — не сами дубли, а поспешная склейка. Человек видит два похожих адреса, ставит редирект на тот, который «правильнее выглядит», и через месяц обнаруживает, что убил страницу, на которую как раз шли все переходы из поиска. Перед любым редиректом я всегда сначала открываю отчёт по посадочным страницам в Метрике — а уже потом решаю, кто из двух адресов главный.»

Григорий
Григорий
Руководитель Web Sprint
от 35 000 ₽
Разбор дублей и склейка адресов
Входит в техническое SEO: карта дублей, схема склейки, контроль переиндексации
от 120 000 ₽
SEO интернет-магазина
Если каталог собирается заново и структуру адресов закладываем сразу без дублей

Что на самом деле теряет сайт с дублями

Формулировка «за дубли поисковик наказывает» — упрощение, которое мешает понять проблему. Никакой отдельной санкции за дубли нет. Есть три конкретных последствия, и каждое стоит денег.

Первое: поиск выбирает из копий одну и показывает только её. Выбор делает алгоритм, и он не обязан совпадать с вашим — в выдачу может уйти адрес с параметром сортировки вместо нормальной страницы категории. Второе: сигналы делятся. Ссылки, поведенческие данные и накопленный «вес» распределяются между копиями вместо того, чтобы усиливать одну страницу. Третье и самое ощутимое для каталогов: робот тратит ограниченное число визитов на обход одинаковых адресов, и новые товары попадают в индекс медленнее — иногда на недели.

Отдельная неприятность — статус «Дубль» в списке исключённых страниц Яндекс.Вебмастера. Владелец видит, что половина каталога исключена, и делает вывод, что сайт под фильтром. Обычно это не фильтр, а именно склейка копий, и решается она не переписыванием текстов, а наведением порядка в адресах.

Дубли, которые создаёт сама CMS: слеш, регистр, index.php

Начинать разбор стоит с самого скучного слоя — вариантов написания одного и того же адреса. На коробочных движках без явной настройки одна страница обычно открывается сразу в нескольких формах: со слешем на конце и без него, с /index.php в пути и без него, в разном регистре букв. Для человека это один адрес, для поиска — разные документы с одинаковым содержимым.

Сюда же относится классическая четвёрка: сайт доступен с www и без www, по http и по https. Это тема главного зеркала, мы разбирали её в статье про robots.txt и карту сайта — там же про то, почему адрес в директиве Sitemap и подтверждённый сайт в Вебмастере должны быть на одном хосте.

Лечится этот слой одинаково: выбирается один канонический формат адреса, все остальные варианты отдают 301-редирект на него, и все внутренние ссылки на сайте переписываются на выбранный формат. Последнее забывают чаще всего — на сайте продолжают жить ссылки на редиректные адреса, и робот при каждом обходе идёт лишний шаг.

  • Со слешем и без: /uslugi/remont и /uslugi/remont/ — выбираем один вариант, второй редиректим.
  • С index.php и без: /index.php?page=catalog и /catalog/ — оставляем человекопонятный.
  • Разный регистр: /Catalog/ и /catalog/ — приводим к нижнему регистру.
  • www / без www и http / https — три варианта из четырёх редиректим на основной.
  • Внутренние ссылки, меню, хлебные крошки и карта сайта — везде только канонический формат.

Параметры: фильтры, сортировки, utm-метки и идентификаторы сессий

Это главный источник дублей на любом каталоге. Каждый фильтр добавляет к адресу параметр, каждая сортировка — ещё один, каждая рекламная кампания приносит свой набор utm-меток. Комбинаторика делает своё дело: из тридцати категорий получаются тысячи адресов, за которыми стоит один и тот же список товаров, просто в другом порядке.

Важно разделить два случая. Есть параметры, которые не меняют содержимое: utm-метки, идентификаторы сессий, сортировка списка. Есть параметры, которые содержимое реально меняют: фильтр по конкретному бренду или типу товара, за которым стоит отдельный спрос в поиске. Первые надо схлопывать, вторые — иногда наоборот, превращать в полноценные посадочные страницы с собственным адресом, заголовком и текстом.

Для параметров, которые ничего не меняют, у Яндекса есть аккуратный инструмент — директива Clean-param в robots.txt: робот понимает, что адреса отличаются только служебным хвостом, и сводит их к одному. Google эту директиву не понимает, поэтому в связке с ней на страницу ставят rel="canonical" на версию без параметров. Комбинация «Clean-param для Яндекса плюс canonical для всех» покрывает подавляющее большинство случаев с фильтрами и метками.

Поиск и устранение дублей на сайте с каталогом

Техническое SEO

Внедряем технические исправления: индексация, дубли, редиректы, скорость, разметка. Работаем по своему или вашему отчёту. От 35 000 ₽, срок 7-14 дней.

Разобрать дубли на вашем каталоге

Пагинация, товар в нескольких категориях и страницы печати

Пагинация — вторая, третья, десятая страницы списка — формально дублем не является: товары на них разные. Ошибка здесь другая и очень распространённая: на все страницы пагинации ставят canonical на первую. Робот получает указание считать десятую страницу копией первой и может перестать обходить всё, что на ней лежит, — то есть половину каталога. Правильнее оставить страницы пагинации самими собой, закрыв от индексации только явно бесполезные варианты, и обязательно давать роботу прямой путь к карточкам товаров, не спрятанный за десятью кликами.

Один товар в нескольких категориях — типовая ситуация для магазина: кресло лежит и в «Мебели для офиса», и в «Кабинетах руководителя». Если CMS формирует адрес с учётом категории, получаются два и более полностью одинаковых документа. Решение — один товар, один постоянный адрес, независимый от того, из какого раздела на него пришли. Хлебные крошки при этом могут меняться, адрес — нет.

Версии для печати, мобильные поддомены вида m.site.ru, служебные копии страниц с параметром вроде ?print=1 — отдельная категория. Такие страницы нужны людям, но в выдаче им делать нечего: на них нет ни меню, ни форм, ни возможности что-то заказать. Их закрывают мета-тегом noindex, а не редиректом — редирект сломал бы сам сценарий печати.

  • Пагинация — не дубль, canonical на первую страницу здесь вредит, а не помогает.
  • Карточка товара — один постоянный адрес вне зависимости от категории входа.
  • Страницы печати и служебные версии — noindex, они нужны человеку и не нужны поиску.
  • Страницы результатов внутреннего поиска по сайту — закрываем, они генерируются бесконечно.

canonical, 301 и noindex: три инструмента, которые не заменяют друг друга

Здесь чаще всего и ломают сайты — берут один инструмент и применяют его ко всем случаям подряд. На самом деле выбор определяется одним вопросом: нужен ли дублирующий адрес живым людям.

301-редирект нужен, когда адрес больше не нужен никому. Старая страница после смены структуры, вариант с www, версия по http — их не должно быть, поэтому и человека, и робота перебрасываем на основной адрес. Это самый сильный инструмент: он не рекомендация, а команда, и он передаёт накопленные сигналы на целевую страницу.

rel="canonical" нужен, когда обе страницы должны оставаться доступными, но в поиске нужна одна. Классика — категория с примененным фильтром сортировки: человек этой страницей пользуется, а в выдаче должна быть базовая версия категории. Важно понимать: canonical — это подсказка, а не приказ. Если содержимое страниц заметно различается, поиск вправе её проигнорировать и оставить в индексе обе.

noindex нужен, когда страница полезна пользователю, но в выдаче бесполезна: версия для печати, страница благодарности после отправки формы, служебные разделы. Она остаётся открытой и работает, но из поиска уходит. Ключевое условие — робот должен иметь возможность её загрузить и прочитать запрет, поэтому такую страницу нельзя одновременно закрывать в robots.txt.

  • 301-редирект — адрес не нужен вообще: переносим людей и сигналы на основной.
  • rel="canonical" — обе страницы нужны людям, в поиске должна быть одна; работает как рекомендация.
  • noindex — страница нужна человеку, но не нужна в выдаче; в robots.txt её при этом не закрываем.
  • Clean-param — специфичный для Яндекса способ схлопнуть адреса, отличающиеся только служебными параметрами.
  • Disallow в robots.txt — не инструмент борьбы с дублями: он лишь не пускает робота, а адрес может остаться в выдаче.

Как найти все дубли на своём сайте

Начните с Яндекс.Вебмастера: «Индексирование → Страницы в поиске», вкладка исключённых, фильтр по статусу «Дубль». Это готовый список адресов, которые робот уже схлопнул, с указанием, в пользу какой страницы. Часто уже здесь видно закономерность — например, что все дубли имеют один и тот же параметр в адресе.

Дальше — сравнение чисел. Сколько адресов в вашей карте сайта, сколько робот обошёл всего и сколько держит в поиске. Если обойдено в разы больше, чем есть страниц, вы точно кормите робота копиями. Там же, в «Статистике обхода», видно, по каким адресам он ходит: список параметров и служебных URL обычно объясняет всё за пару минут.

Третий шаг — краулер вроде Screaming Frog (до 500 адресов бесплатно) или Netpeak Spider. Он обходит сайт как робот и позволяет отсортировать страницы по совпадающим title и description: одинаковые заголовки на разных адресах — самый быстрый способ найти дубли, которые ещё не попали в отчёты Вебмастера. Отдельно проверьте, куда указывает canonical на каждой странице: пустой или ссылающийся сам на себя тег — норма, тег, ведущий на неожиданный адрес, — повод разобраться.

Поиск и устранение дублей на сайте с каталогом

Техническое SEO

Внедряем технические исправления: индексация, дубли, редиректы, скорость, разметка. Работаем по своему или вашему отчёту. От 35 000 ₽, срок 7-14 дней.

Разобрать дубли на вашем каталоге

Как убирать дубли, не потеряв то, что уже работает

Порядок действий важнее, чем сам инструмент. Первое — снять текущую картину: список адресов, которые получают переходы из поиска, и их позиции. Отчёт по посадочным страницам в Яндекс.Метрике даёт это за пару минут. Регулярно оказывается, что трафик идёт как раз на тот адрес, который выглядит «неправильным», и склеивать нужно в его пользу, а не наоборот.

Второе — не менять всё разом. Сначала разбираются варианты хоста и слеша, потом параметры, потом карточки и пагинация. Между блоками нужно дать роботу переобойти сайт и посмотреть, что изменилось в отчётах. Если выкатить пять изменений одновременно и трафик просядет, вы не поймёте, какое из них виновато.

Третье — выдержка по срокам. Склейка адресов не мгновенная: роботу нужно заново обойти страницы, увидеть редиректы и canonical и пересобрать индекс. На небольшом сайте первые изменения обычно видны в пределах нескольких недель, на крупном каталоге процесс идёт дольше. Просадка в первые дни после массовой склейки — нормальная часть процесса, а не сигнал срочно откатывать изменения.

И четвёртое — не создавать дубли заново. Если сайт собирается или пересобирается, структура адресов закладывается сразу: один материал — один постоянный адрес, параметры не участвуют в формировании страницы, фильтры под реальный спрос выносятся в отдельные посадочные осознанно. Это дешевле, чем потом разгребать одиннадцать тысяч адресов вместо четырёхсот.

Бесплатно

3 точки роста вашего сайта

Посмотрим сайт руками и пришлём в Telegram три конкретные вещи, которые сейчас мешают ему приводить заявки. Без презентации и коммерческого предложения.

  • Что на первом экране мешает понять, чем вы помогаете и сколько это стоит
  • Где теряются заявки: формы, скорость, версия для смартфонов
  • По каким запросам сайт уже близко к топу и чего ему не хватает

Разбор присылаем в течение суток в рабочие дни: Пн–Пт 9:00–19:00, Сб 10:00–18:00 (МСК). Ответ приходит в Telegram, звонить и продавать по телефону не будем.

FAQ по теме

Опасно ли ставить canonical на страницу саму на себя?+
Нет, это нормальная и даже полезная практика: самоссылающийся canonical на каждой странице подстраховывает от адресов с utm-метками и случайными параметрами. Опасно другое — canonical, который по ошибке ведёт на главную или на первую страницу пагинации со всех страниц сайта разом. Такую ошибку в шаблоне стоит проверить в первую очередь.
Утекает ли «вес» страницы при 301-редиректе?+
Основная часть сигналов передаётся на целевой адрес, но это не мгновенная операция: роботу нужно обойти старый адрес, увидеть редирект и переиндексировать целевой. Существенно хуже ситуация с цепочками, когда адрес А ведёт на Б, Б на В, В на Г. Ставьте редирект сразу на конечный адрес, а не достраивайте новое звено к старой цепочке.
utm-метки из рекламы создают дубли в поиске?+
Потенциально да: адрес с меткой — технически отдельный документ, и если на него где-то появится ссылка, робот его обойдёт. На практике эта проблема закрывается двумя вещами: самоссылающимся canonical на странице и директивой Clean-param для Яндекса. Отдельно проверьте, что адреса с метками не попадают в карту сайта — иногда их туда затягивает генератор.
Что делать с фильтром, по которому реально есть спрос в поиске?+
Такой фильтр перестаёт быть дублем и становится посадочной страницей. Ему нужен постоянный человекопонятный адрес, свой заголовок H1, свой title и хотя бы небольшой собственный текст, объясняющий выбор в этой подкатегории. Делать это стоит точечно, под конкретные запросы с подтверждённым спросом, а не генерировать страницы под все возможные комбинации фильтров.
Считаются ли дублями одинаковые описания товаров, взятые у поставщика?+
Это другая проблема — не технические дубли внутри сайта, а неуникальный контент, повторяющийся на десятках магазинов. Технические инструменты вроде canonical здесь не помогут. Работает переписывание описаний хотя бы у ходовых позиций, добавление собственных характеристик, фотографий и ответов на вопросы покупателей — начинать имеет смысл с товаров, которые приносят основную выручку.
Можно ли просто закрыть все адреса с параметрами в robots.txt и не мучиться?+
Так делают часто, и это половинчатое решение. Робот перестанет заходить на эти адреса, но уже проиндексированные могут остаться в выдаче, а накопленные ими сигналы никуда не передадутся — в отличие от редиректа или canonical. Плюс запрет обхода мешает роботу увидеть canonical, если вы решите настроить его позже. Запрет уместен для явного служебного мусора, а не как основной способ борьбы с дублями.
Через сколько после склейки адресов можно оценивать результат?+
Ориентируйтесь на скорость переобхода вашего сайта, её видно в статистике обхода Вебмастера. На сайте из нескольких сотен страниц картина обычно проясняется за несколько недель, на крупном каталоге — дольше. Смотреть надо не на позиции отдельного запроса, а на два показателя: сколько страниц робот держит в поиске и как меняется общее число переходов из органики.
Григорий Аникеев

Григорий Аникеев

Основатель Web Sprint, автор статьи

Контролирую качество каждого этапа: от первого аудита до финального релиза. Отвечаю репутацией за результат.

Применить к проекту

Разобрать дубли на вашем каталоге

Если хотите применить рекомендации к своему сайту, нише или рекламной воронке, не нужно идти в отдельный раздел контактов. Отсюда удобнее сразу запросить короткий разбор по вашей ситуации.

  • Покажем, что стоит делать в первую очередь, а что можно отложить
  • Сверим рекомендации статьи с вашими страницами, трафиком и воронкой
  • Разберём задачу без лишних услуг и расплывчатых обещаний
Обсудить задачу

Связанные услуги

Полезные материалы