Главная Статьи Оптимизация

Дубли страниц на сайте

Один и тот же контент открывается по нескольким адресам — это и есть дубли. Сайт думает, что страница одна. А поисковик видит три-четыре копии и не понимает, какую показывать в выдаче. В итоге он может выбрать не ту, а вес страницы — размазать между копиями. Позиции от этого только страдают.

Четыре адреса — одна страница site.ru www.site.ru site.ru/page/ site.ru/page?utm=... одна каноническаястраница
Задача — склеить все копии в один главный адрес.

Откуда берутся дубли

Чаще всего — сами собой, из-за настроек. Сайт открывается и с www, и без. И с http, и с https. С завершающим слешем и без него. К адресам цепляются метки рекламы (utm) и параметры сортировки. В интернет-магазинах один товар попадает в разные категории и получает несколько адресов. Каждый такой вариант для поисковика — отдельная страница, хотя контент один.

Как их найти

Первый помощник — анализатор: он сразу проверит, не открывается ли сайт по нескольким версиям сразу. Дальше загляните в Яндекс.Вебмастер и Google Search Console — там есть отчёты по дублям и исключённым страницам. И посмотрите число страниц в индексе: если их заметно больше, чем реальных, — это тревожный звонок.

🔍
Проверьте склейку версий: анализ сайта и проверка домена (www/http-дубли). Число страниц в индексе — в проверке индексации.

Как убрать: три рабочих способа

Способ зависит от типа дубля. Главных инструмента три.

301-редирект — когда нужно навсегда перенаправить с копии на основной адрес. Так склеивают www и без-www, http и https, слеши. Один раз настроили — и все попадают на правильную версию.

Тег canonical — когда страницы должны остаться доступны, но в индекс идёт одна. Например, товар в разных категориях: на всех копиях ставите ссылку на главную версию.

<link rel="canonical" href="https://site.ru/glavnyj-adres/">

robots.txt — чтобы вообще не пускать роботов на технические адреса с параметрами, например /*?.

Склейте www и слеши раз и навсегда

Базовая гигиена, с которой стоит начать. Выберите одну главную версию сайта — с www или без, с https. И настройте 301-редирект всех остальных вариантов на неё. Нужные правила можно собрать в готовый файл, не разбираясь в синтаксисе вручную.

🛠
Правила склейки соберёт генератор .htaccess, а закрыть лишнее поможет генератор robots.txt.

Какие бывают дубли: полные и частичные

Дубли делятся на два вида, и лечатся по-разному. Полные — когда один и тот же контент открывается по разным адресам: www и без-www, http и https, со слешем и без, с метками и параметрами. Частичные — когда страницы разные, но слишком похожи: одинаковые Title и Description у десятка карточек, почти идентичные тексты в категориях разных городов, страницы фильтров и пагинации. Полные склеивают редиректом и canonical, а частичные приходится делать по-настоящему разными — переписывать тексты и мета-теги.

Чем дубли реально вредят

Вред не абстрактный, а вполне конкретный. Во-первых, размывается вес: ссылки и поведенческие делятся между копиями вместо того, чтобы усиливать одну страницу. Во-вторых, поисковик может выбрать в выдачу не ту версию — например, адрес с меткой вместо чистого. В-третьих, робот тратит краулинговый бюджет на обход копий, и до новых страниц у него доходят руки позже. В-четвёртых, масса похожих страниц может потянуть сайт под фильтр за малоценный контент.

Тип дубля — свой инструмент www / без-www, http/https, слеши 301-редирект Один товар в разных категориях canonical Адреса с ?utm, ?sort, фильтры robots / Clean-param Одинаковые Title и Description уникальные мета
Под каждый тип дубля — свой способ устранения.

Дубли Title и Description

Самый частый частичный дубль, который многие не замечают. Когда у пачки страниц одинаковые Title и Description, поисковик считает их похожими и может склеить или понизить. Обычно это болезнь шаблонных страниц: карточек товара, пагинации, фильтров. Лечится уникальными мета-тегами — хотя бы по шаблону с подстановкой названия, цены, города. Подробно — в статье про дубли Title и Description.

Частые ошибки при борьбе с дублями

Главных промахов четыре. Первый — склеивать через 302 вместо 301: временный редирект не передаёт вес так, как постоянный. Второй — ставить canonical на разные страницы или на несуществующий адрес, и тогда из индекса выпадает не то. Третий — закрыть страницу и в robots.txt, и через canonical одновременно: робот не зайдёт и каноникал не увидит. Четвёртый — делать цепочку редиректов (копия → копия → оригинал) вместо прямого перехода в один шаг.

Проверьте сайт на дубли

Узнайте, не открывается ли он по нескольким адресам сразу.

Проверить сайт →

Подытожим: дубли путают поисковик и крадут позиции, но убираются понятными средствами. Склейте версии 301-редиректом, разметьте копии через canonical, закройте технический мусор в robots.txt. Сделаете один раз — и забудете. Как это вписано в общую проверку — в статье про технический аудит сайта и в гайде как раскрутить сайт самостоятельно.

Частые вопросы

Что такое дубли страниц на сайте?
Это когда один и тот же контент открывается по нескольким адресам: с www и без, http и https, со слешем и без, с метками и параметрами. Для поисковика это разные страницы-копии, и он не понимает, какую показывать в выдаче.
Чем опасны дубли страниц?
Они размывают вес между копиями, заставляют поисковик выбирать в выдачу не ту версию, тратят краулинговый бюджет робота на обход копий, а масса похожих страниц может потянуть сайт под фильтр за малоценный контент.
Как найти дубли на сайте?
Проверьте через анализатор, не открывается ли сайт по нескольким версиям сразу (www/http). Загляните в отчёты Яндекс.Вебмастера и Google Search Console по дублям и исключённым страницам. И сравните число страниц в индексе с реальным — если в индексе заметно больше, это тревожный сигнал.
Как убрать дубли страниц?
Зависит от типа. Полные дубли (www, http, слеши) склеивают 301-редиректом на главный адрес. Копии, которые должны остаться доступными (товар в разных категориях), размечают canonical. Технические адреса с параметрами закрывают в robots.txt или через Clean-param. Одинаковые Title и Description переписывают уникально.
Какую версию сайта выбрать главной — с www или без?
Любую — важно выбрать одну и склеить на неё все остальные варианты 301-редиректом (с www или без, обязательно на https). Это базовая гигиена, с которой стоит начинать борьбу с дублями. Правила удобно собрать генератором .htaccess.