Перейти к содержимому
SEO/Опубликовано 5 сентября 2026 г./5 мин

Дубли страниц: восемь источников и как найти каждый

Восемь способов получить две страницы с одним содержимым — от слеша на конце до шаблонного заголовка. По каждому: как проверить за минуту и что показали наши замеры на живых сайтах.

Дубли страниц: восемь источников и как найти каждый
С
Команда NEXFORCE
SEO-эксперт NEXFORCE

Дубли — это когда у одного содержимого две ссылки. Поисковик выбирает между ними сам и выбирает не всегда ту, которая нужна вам. Ниже восемь источников, каждый с проверкой на минуту, и наши замеры по ним.

Первые пять: ссылка, а не содержание

Здесь текст один, а ссылок несколько. Проверяется пятью запросами — мы проверили себя 5 сентября 2026 года:

Что проверяемНаш ответ
http:// вместо https://301 на https
www. перед доменом301 без www
Без слеша на конце301 со слешем
/index.html301 на корень
Параметр ?utm_source=test200, без переадресации

1. Протокол. Сайт, доступный и по http, и по https, — это две копии. Проверка: открыть по http и посмотреть код ответа. Должен быть 301.

2. Домен с www и без. То же самое: две ссылки, одно содержимое.

3. Слеш на конце. /blog и /blog/ для поисковика разные. Какой вариант выбрать — не важно, важна одинаковость.

4. Индексный файл. /index.html, /index.php и корень — три пути к одной странице.

5. Параметры. Метки рекламы, идентификаторы переходов, сортировки. Здесь переадресации быть не должно — ссылка с меткой обязана открываться. Склейка делается иначе: у нас в robots.txt перечислены десять параметров директивой Clean-param, а на странице стоит canonical без параметра. Отдельный разбор того, где canonical помогает, а где вредит, — у нас есть.

Ещё три: содержание

6. Одинаковый Title или H1 у разных адресов. Самый частый и самый дешёвый в исправлении: шаблон, в который подставили одно название. Ищется сравнением всех заголовков между собой.

7. Совпадение текста выше порога. Тот самый near-duplicate. Тут важна оговорка, без которой мера бесполезна: сравнивать надо без шапки, подвала и меню. С ними любые две страницы одного сайта совпадают примерно на треть, и любой сайт выглядит состоящим из дублей.

8. Один текст на двух ссылках из-за пагинации, фильтров или версии для печати. Формально это уже пункты 1–5, но берётся не из настроек сервера, а из движка сайта, и находится только сравнением содержимого.

Что показал наш движок на живых сайтах

Проверка берёт до 25 ссылок из карты сайта и сравнивает их попарно. Обходить сайт по ссылкам мы намеренно не станем: карту владелец сам отдал поисковикам, а обход чужого сайта — это поведение сканера.

Замер 5 сентября 2026 года:

Что проверялиРезультат
Наш сайт, 25 страниц из карты0 дублей, 0 одинаковых заголовков
Автомойка из нашего разбора ниши, 25 страниц203 пары совпадающих
Другая автомойка, 25 страниц17 пар
Ещё четыре сайта нишикарта не нашлась — сравнивать нечего

Двести три пары из двадцати пяти страниц — это почти полное совпадение всех со всеми: шаблон, в котором меняется только название услуги.

И вторая строка снизу важна не меньше: у четырёх сайтов из шести не нашлось карты сайта, а значит, проверка не отвечает «дублей нет» — она отвечает «сравнивать было нечего». Это разные ответы, и подменять первым второй нельзя.

Порядок проверки за десять минут

  • Пять запросов на склейку. http, www, слеш, индексный файл, параметр. Четыре первых должны давать 301 в одну точку.
  • Заголовки списком. Выгрузите Title всех страниц и отсортируйте: повторы видно сразу.
  • Сравнение текста без обвязки. Либо инструментом, либо руками, но обязательно выбросив шапку, подвал и меню.
  • Проверьте, что карта есть. Без неё половина проверок не работает — ни у вас, ни у поисковика.

Проверить дубли на своём сайте можно нашей проверкой: она читает карту, берёт до 25 страниц и показывает пары с процентом совпадения. И честно говорит, когда карты нет.

Вопросы и ответы

FAQ по теме

Что считается дублем страницы?+
Три разные вещи, и путать их нельзя. Одинаковый заголовок у разных адресов — обычно шаблон, куда подставили только название. Совпадение текста выше порога — так называемый near-duplicate. И один и тот же текст на двух адресах, различающихся слешем или параметром, — это уже не про содержание, а про склейку адресов.
Почему при сравнении страниц надо выбрасывать шапку и подвал?+
Потому что с ними любые две страницы одного сайта совпадают примерно на треть, и мера перестаёт что-либо значить. Наш движок сравнивает содержимое без шапки, подвала и меню — иначе дублем оказывается весь сайт.
Как быстро проверить склейку адресов?+
Пятью запросами: открыть сайт по http, с www, без слеша на конце, с index.html и с любым параметром. Всё, кроме параметра, должно отвечать кодом 301 и вести на один адрес. Мы так проверили себя — четыре из пяти случаев отдают 301.
Сколько страниц надо сравнивать?+
Все, до которых дотягиваетесь. Наш движок берёт до 25 адресов из карты сайта: этого хватает, чтобы увидеть шаблонную проблему, но не хватает, чтобы объявить сайт чистым.