WordPress Notes WPTicket

Как найти и удалить дубли страниц в WordPress

Дубли страниц в WordPress обычно появляются не из-за одной ошибки, а из-за набора мелких настроек: архивы тегов, пагинация, параметры в URL, версии со слешем и без него, страницы автора, результаты поиска, а иногда и дубли из-за темы или SEO-плагина. Пока сайт маленький, это незаметно. На живом проекте дубли начинают размывать сигналы для поисковиков, плодить лишние URL в индексе и мешать нормальной аналитике.

Ниже — рабочий сценарий: как быстро найти источник дублей, что закрывать, что редиректить, а что лучше оставить как есть. Без лишней теории, только то, что можно проверить на своем сайте.

Как понять, что у вас именно дубли, а не просто много страниц

Сначала нужно отличить нормальные архивы от настоящих дублей. В WordPress одна и та же сущность может быть доступна по нескольким адресам: с www и без него, с конечным слешем и без, через ?replytocom=, через параметры сортировки, через пагинацию, через AMP-версию, если она есть. Не все такие URL нужно удалять. Часть из них должна быть закрыта от индексации, часть — склеена редиректом, а часть — просто не должна появляться в sitemap.

Диагностика в Search Console и на сайте

Начните с отчета по страницам в Google Search Console. Ищите группы URL с одинаковым содержанием или одинаковым заголовком, но разными адресами. Затем проверьте сайт вручную:

  • откройте одну и ту же страницу с www и без www;
  • проверьте вариант со слешем и без слеша;
  • посмотрите, не индексируются ли страницы тегов, авторов, поиска и архивов по датам;
  • проверьте URL с параметрами вроде ?replytocom=, ?utm_, ?orderby=;
  • сравните canonical на похожих страницах.

Если canonical указывает на саму страницу, а в индексе есть ее копии с параметрами или альтернативными адресами, проблема уже не в контенте, а в технической настройке.

Откуда берутся дубли в WordPress

На практике источники почти всегда одни и те же. Важно не лечить симптомы, а убрать причину появления лишних URL.

Источник дубляЧто делатьРиск, если не трогать
Параметры URLРедиректить или закрывать от индексацииРазмножение копий одной страницы
Архивы тегов и авторовОставить только если они реально нужныМного слабых страниц в индексе
Страницы поискаЗакрыть от индексацииМусорный индекс и лишний crawl budget
Дубли со слешем/безНастроить единый вариант через редиректРазные URL для одной страницы
Пагинация архивовПроверить canonical и robotsПутаница в индексации серий страниц

Пошаговое решение: что делать с дублями

Шаг 1. Выберите канонический вариант URL

Для сайта должен быть один основной формат адресов: с www или без, со слешем или без. Это задается в настройках WordPress и на уровне сервера. Если у вас уже есть индексация в обоих вариантах, сначала настройте 301-редирект на один основной формат, а потом проверьте canonical.

Для Apache это обычно делается через .htaccess. Пример редиректа на HTTPS и без www:

RewriteEngine On
RewriteCond %{HTTPS} !=on [OR]
RewriteCond %{HTTP_HOST} ^www\.example\.ru$ [NC]
RewriteRule ^ https://example.ru%{REQUEST_URI} [L,R=301]

Если у вас Nginx, правило нужно писать в конфиге сервера, а не в WordPress. Не пытайтесь решать это плагином, если редирект должен работать на уровне хоста.

Шаг 2. Закройте технические страницы от индексации

Страницы поиска, служебные архивы и некоторые таксономии часто не несут ценности для поиска. Их можно оставить для пользователей, но убрать из индекса. Если используете SEO-плагин, проверьте настройки архивов. Если настраиваете вручную, добавьте noindex там, где это уместно.

Пример для вывода noindex на страницах поиска и архивов автора:

add_action('wp_head', function () {
    if (is_search() || is_author()) {
        echo '<meta name="robots" content="noindex,follow" />' . "\n";
    }
});

Это не замена нормальной SEO-настройке, а рабочий способ для точечной правки, если тема или плагин не дают нужного контроля.

Шаг 3. Уберите параметры, которые создают копии

Особенно часто дубли создают параметры комментариев и сортировки. Если они не нужны для индексации, их лучше не пускать в поисковую выдачу. Для URL с ?replytocom= обычно достаточно редиректа или настройки плагина комментариев, если он его добавляет.

Для параметров, которые появляются из-за фильтров или сортировки, важно понять: это отдельная страница с уникальной ценностью или просто копия. Если копия — не индексировать. Если отдельная посадочная страница — тогда уже нужен отдельный URL и контент, а не параметр.

Шаг 4. Проверьте canonical и sitemap

Canonical должен указывать на основную версию страницы. Если canonical ведет на URL с параметром или на неканонический вариант, поисковик может игнорировать ваши редиректы. После настройки откройте исходный код страницы и проверьте тег:

<link rel="canonical" href="https://example.ru/page/" />

Также проверьте sitemap. Туда не должны попадать страницы поиска, служебные архивы и URL с параметрами. Если sitemap генерируется SEO-плагином, отключите лишние типы архивов в его настройках.

Когда лучше редирект, а когда noindex

Это частый вопрос, и здесь нельзя отвечать одинаково для всех URL. Если у страницы есть один очевидный правильный адрес, используйте 301-редирект. Если страница нужна пользователю, но не должна участвовать в поиске, ставьте noindex. Если страница вообще не нужна, удаляйте ее и отдавайте 410 или 404 в зависимости от сценария.

  • 301 — для дублей одного и того же контента;
  • noindex — для служебных страниц, которые должны работать, но не индексироваться;
  • 410/404 — для удаленных страниц без замены;
  • canonical — для указания основного URL, но не вместо редиректа, если дубль уже живет в индексе.

Как проверить, что решение сработало

После правок не ограничивайтесь визуальной проверкой. Нужно убедиться, что поисковый робот видит именно то, что вы задумали.

  1. Откройте дублирующий URL и проверьте, что он редиректит на канонический адрес с кодом 301.
  2. Посмотрите исходный код основной страницы и убедитесь, что canonical указывает на нее же.
  3. Проверьте, что страницы поиска и авторов отдают noindex, если вы это настроили.
  4. Сравните sitemap до и после: технические URL не должны там появляться.
  5. В Search Console отправьте на переобход важные страницы и следите, как меняется статус индексации.

Если после редиректа старый URL все еще показывается в выдаче, это не значит, что настройка не работает. Поисковику нужно время на переобход. Но если через несколько обходов дубль остается доступным без редиректа, значит правило сработало не в том месте.

Частые ошибки и как их исправить

Редирект настроен в WordPress, но не на сервере

Если дубль возникает до загрузки WordPress, например на уровне www/без www или HTTP/HTTPS, PHP-код не поможет. Нужен серверный редирект.

На странице стоит noindex, но она все равно попадает в индекс

Так бывает, если страница уже была проиндексирована и поисковик еще не переобходил ее после изменений. Проверьте, не закрыта ли она одновременно в robots.txt. Если закрыта, робот может не увидеть новый noindex.

Canonical указывает не туда

Некоторые темы и плагины формируют canonical автоматически, но ошибаются на архивных страницах, пагинации или страницах с параметрами. В этом случае нужно отключить конфликтующую логику в теме или SEO-плагине и оставить один источник canonical.

Удалили страницу, но не настроили редирект

Если у удаленной страницы был трафик или входящие ссылки, просто 404 — плохой вариант. Нужен 301 на ближайшую релевантную страницу. Если релевантной замены нет, тогда уже 410.

Практические советы по безопасности и производительности

Чистка дублей — это не только про SEO. Лишние URL создают нагрузку на обход, раздувают логи и усложняют сопровождение. Не ставьте несколько SEO-плагинов одновременно: они часто конфликтуют по canonical, robots и sitemap. Если используете плагины для редиректов, храните правила в одном месте, иначе потом сложно понять, кто именно отдает ответ.

Перед массовыми изменениями сделайте резервную копию базы и файлов. Если на сайте много старых URL, сначала проверьте логи и карту редиректов на тестовой среде. Это особенно важно, если вы удаляете архивы, меняете структуру ссылок или отключаете таксономии.

Если нужен более жесткий контроль над дублями, служебными страницами и очисткой технического мусора, в экосистеме WPShop есть Clearfy Pro — его имеет смысл рассматривать именно как инструмент для техничной чистки сайта, а не как замену нормальной SEO-логике. Ссылка: Clearfy Pro.

Главная проверка простая: один контент — один индексируемый URL. Все остальное должно либо редиректить, либо быть закрыто от индексации, либо вообще не существовать. Если после правок это правило выполняется, дубли перестают накапливаться и сайт становится предсказуемее для поисковиков и для вас.

×

AI-плагин от WPShop.ru

анализирует конкурентов

пишет статьи

готовит SEO

генерирует изображения

и еще кое-что...
WPGPT
Плагин, который наполняет ваш сайт WordPress
Узнать больше