Как найти и удалить дубли страниц в WordPress

Если в поиске появляются одинаковые или почти одинаковые страницы, проблема обычно не в одной «плохой» записи, а в наборе технических дублей: архивы, теги, пагинация, URL с параметрами, версии с www и без, http и https, а иногда и несколько адресов одной и той же страницы. Убирать это нужно аккуратно: сначала понять, какие URL реально дублируют контент, а какие просто нужны для навигации сайта.

Ниже разберём, где искать дубли в WordPress, как отличить опасные случаи от нормальных, и что именно делать, чтобы сократить количество страниц в индексе без поломки сайта.

Сначала определите, какие именно дубли у вас есть

Под «дублем» часто понимают разные вещи. Для SEO и индексации важно разделять три сценария:

  • полные дубли — один и тот же контент доступен по разным URL;
  • почти дубли — страницы очень похожи, но отличаются только частью текста, сортировкой, фильтром или пагинацией;
  • технические варианты одного адреса — например, www и без www, http и https, URL с ?replytocom= или другими параметрами.

Если не разделить эти случаи, легко удалить не то, что нужно. Например, архив категории сам по себе не дубль записи, но может стать дублем другой страницы, если в него попал тот же текст без добавленной ценности. А пагинация — не дубль первой страницы, а отдельная часть архива, которую обычно не стоит закрывать грубо, если она нужна пользователю.

Где чаще всего появляются дубли в WordPress

В WordPress одинаковые или почти одинаковые страницы чаще всего возникают в нескольких местах.

Архивы рубрик, тегов и авторов

Одна и та же запись может быть доступна через саму запись и через архивы, где она отображается в списке. Если на сайте много коротких записей или теги используются слишком широко, архивы начинают собирать страницы с очень похожим набором материалов. Особенно это заметно, когда в тегах по одной-две записи.

Пагинация архивов

Страницы вида /page/2/, /page/3/ и дальше содержат часть того же архива. Это не ошибка, но если заголовки, мета-описания и контент шаблона не отличаются, поисковая система может считать такие страницы слабыми или малоценными.

Параметры URL

Фильтры, сортировка, UTM-метки, внутренний поиск, технические параметры и комментарии могут создавать десятки адресов с одним и тем же контентом. Самый частый пример — когда одна и та же страница открывается как чистый URL и как URL с параметрами, а в индекс попадают оба варианта.

Разные версии домена и протокола

Если сайт доступен одновременно по http и https, а также с www и без него, это уже четыре варианта одного адреса. Для пользователя это может быть незаметно, но для поисковика — разные URL. Без редиректа и каноникализации такие версии быстро расползаются по индексу.

Страницы вложений и медиафайлов

WordPress создаёт отдельные страницы вложений для изображений и других файлов. На многих сайтах они бесполезны для поиска и только добавляют мусорные URL, особенно если на странице изображения нет нормального контента.

Как найти дубли без догадок

Начинать лучше не с плагинов, а с проверки того, какие адреса уже видит поисковик и какие URL реально доступны на сайте.

Проверьте выдачу поисковой системы

Самый простой способ — поискать в Google или Яндексе адрес сайта с оператором site:. Это не даст полной картины, но быстро покажет, какие типы страниц уже попали в индекс. Обратите внимание на:

  • страницы с параметрами в URL;
  • архивы тегов и авторов;
  • дубли главной страницы с разными вариантами домена;
  • страницы вложений;
  • дубли пагинации.

Если в выдаче видно много однотипных URL, это повод идти дальше и смотреть источник дублей в самом WordPress.

Сравните канонический адрес и фактический URL

Откройте проблемную страницу и посмотрите, какой адрес указан в HTML как канонический. В WordPress это обычно задаётся темой или SEO-плагином через тег rel="canonical". Канонический URL должен совпадать с основным адресом страницы без лишних параметров и без альтернативных версий домена.

Если каноникал указывает не туда, поисковик может индексировать не тот вариант страницы. Это особенно часто случается после смены темы, SEO-плагина или ручной правки шаблонов.

Проверьте шаблоны архивов и таксономий

Если дубли идут из рубрик или тегов, откройте несколько архивов и сравните:

  • уникален ли заголовок страницы;
  • есть ли на архиве собственный текст-описание;
  • не показываются ли на разных архивах одинаковые наборы записей;
  • не создаются ли пустые или почти пустые теги.

На практике именно пустые и слабые теги чаще всего создают лишние страницы, которые не несут пользы ни пользователю, ни поиску.

Что делать с дублями: безопасные способы убрать лишнее

Универсального решения нет: часть URL нужно закрыть от индексации, часть — склеить редиректом, а часть — оставить как есть, но правильно обозначить канонический адрес.

Настройте один основной вариант домена

Если сайт открывается и с www, и без него, оставьте только один вариант и сделайте постоянный редирект 301 со второго на основной. То же самое касается перехода на https. Это базовая настройка, без которой борьба с дублями будет неполной.

Проверять нужно не только главную страницу, но и внутренние URL: редирект должен сохранять путь, а не отправлять все запросы на главную.

Используйте 301-редирект для настоящих дублей

Если у вас есть две страницы с одинаковым содержимым, но одна из них больше не нужна, правильный вариант — перенаправить старый адрес на новый через 301. Это подходит для:

  • старых URL после смены структуры;
  • дубликатов страниц, созданных вручную;
  • страниц вложений, если вы не используете их как отдельные посадочные;
  • дублирующих адресов с параметрами, когда они не нужны для пользователя.

Редирект лучше, чем просто удаление страницы, если на старый адрес уже есть ссылки или он успел попасть в индекс.

Поставьте canonical там, где страница должна остаться доступной

Если страница нужна пользователю, но у неё есть варианты с параметрами или сортировкой, чаще всего достаточно канонического URL. Так поисковик понимает, какой адрес считать основным, а остальные варианты не раздувают индекс.

Это полезно для:

  • страниц с UTM-метками;
  • сортировок и фильтров, если они не должны индексироваться отдельно;
  • пагинации, когда каждая страница архива остаётся частью одного раздела;
  • страниц, доступных по нескольким техническим путям.

Но canonical не заменяет редирект, если речь о реально лишнем URL. Если страница не нужна вообще, лучше убрать сам адрес, а не только подсказать поисковику основной вариант.

Закройте от индексации слабые архивы и служебные страницы

Не все страницы нужно удалять. Иногда достаточно убрать их из индекса, чтобы не плодить мусор. Обычно это касается:

  • пустых или почти пустых тегов;
  • архивов авторов на небольших сайтах, если они не несут ценности;
  • страниц поиска по сайту;
  • служебных страниц, которые не должны конкурировать с основным контентом.

Здесь важно не путать индексацию и доступность. Страница может оставаться доступной для пользователя, но не участвовать в поиске.

Уберите страницы вложений, если они не нужны

Если у изображений есть отдельные страницы без полезного текста, их лучше либо перенаправить на родительскую запись, либо закрыть от индексации. На многих сайтах это даёт заметное сокращение мусорных URL без потери функциональности.

Перед массовым удалением проверьте, не используются ли страницы вложений как посадочные в старых ссылках или в медиа-галереях. Если используются, сначала настройте редиректы.

Как не создать новые дубли после чистки

После удаления лишних URL проблема часто возвращается, если не поправить источник дублей.

  • Не создавайте много тегов ради каждого ключевого слова. Если тег не собирает нормальный архив, он почти всегда лишний.
  • Не плодите категории с одинаковым смыслом. Одна запись не должна одновременно жить в пяти почти одинаковых рубриках.
  • Следите, чтобы тема и SEO-плагин не генерировали разные canonical для одной страницы.
  • Проверьте, не создаёт ли плагин фильтров или сортировки новые адреса без необходимости.
  • После смены структуры ссылок всегда делайте карту редиректов со старых URL на новые.

Если на сайте уже накопилось много технических дублей, удобнее сначала навести порядок в шаблонах и таксономиях, а потом чистить индекс. Иначе новые дубли будут появляться снова.

Как проверить, что дубли действительно убраны

После настройки не ограничивайтесь визуальной проверкой в браузере. Нужны три простых шага.

  1. Откройте старый URL и убедитесь, что он отдаёт 301-редирект на нужный адрес.
  2. Проверьте исходный код основной страницы: canonical должен указывать на правильный URL.
  3. Через несколько дней или недель посмотрите, как поисковик переобходит страницы и уменьшается ли число лишних адресов в индексе.

Если редирект работает, но дубли всё равно остаются в выдаче, обычно проблема в том, что где-то ещё доступны альтернативные URL: с параметрами, с другим протоколом, с другим вариантом домена или через архивы.

Когда стоит использовать плагин, а когда лучше править вручную

Если дублей немного и они понятны, безопаснее править вручную: настроить редиректы, canonical и шаблоны архивов. Это даёт больше контроля и меньше риска случайно закрыть нужные страницы.

Если же на сайте много технических дублей, а вы не хотите собирать всё по кускам, можно использовать SEO-плагин или инструмент для чистки дублей и служебных URL. Например, Clearfy Pro помогает закрывать часть типовых дублей и упрощает работу с техническими настройками WordPress. Но даже в этом случае сначала стоит понять, какие именно URL нужно убрать, а не включать всё подряд.

Главная идея простая: не пытайтесь «удалить дубли» одним действием. Сначала найдите источник одинаковых адресов, потом решите, что должно остаться доступным, что нужно склеить редиректом, а что достаточно закрыть от индексации. Такой подход безопаснее и даёт предсказуемый результат.

Как отключить XML Sitemap в WordPress и не потерять индексацию
29.09.2026
Как отключить emoji в WordPress и убрать лишние скрипты из head
22.09.2026
Как заменить default-аватар в WordPress: практическое руководство
03.10.2026
Как создать динамические таблицы в WordPress с помощью шорткодов
27.09.2026
Как изменить имя пользователя в WordPress без доступа к базе данных
15.09.2026