Дубли страниц в WordPress обычно появляются не из-за одной ошибки, а из-за набора мелких настроек: архивы тегов, пагинация, параметры в URL, версии со слешем и без него, страницы автора, результаты поиска, а иногда и дубли из-за темы или SEO-плагина. Пока сайт маленький, это незаметно. На живом проекте дубли начинают размывать сигналы для поисковиков, плодить лишние URL в индексе и мешать нормальной аналитике.
Ниже — рабочий сценарий: как быстро найти источник дублей, что закрывать, что редиректить, а что лучше оставить как есть. Без лишней теории, только то, что можно проверить на своем сайте.
Как понять, что у вас именно дубли, а не просто много страниц
Сначала нужно отличить нормальные архивы от настоящих дублей. В WordPress одна и та же сущность может быть доступна по нескольким адресам: с www и без него, с конечным слешем и без, через ?replytocom=, через параметры сортировки, через пагинацию, через AMP-версию, если она есть. Не все такие URL нужно удалять. Часть из них должна быть закрыта от индексации, часть — склеена редиректом, а часть — просто не должна появляться в sitemap.
Диагностика в Search Console и на сайте
Начните с отчета по страницам в Google Search Console. Ищите группы URL с одинаковым содержанием или одинаковым заголовком, но разными адресами. Затем проверьте сайт вручную:
- откройте одну и ту же страницу с
wwwи безwww; - проверьте вариант со слешем и без слеша;
- посмотрите, не индексируются ли страницы тегов, авторов, поиска и архивов по датам;
- проверьте URL с параметрами вроде
?replytocom=,?utm_,?orderby=; - сравните canonical на похожих страницах.
Если canonical указывает на саму страницу, а в индексе есть ее копии с параметрами или альтернативными адресами, проблема уже не в контенте, а в технической настройке.
Откуда берутся дубли в WordPress
На практике источники почти всегда одни и те же. Важно не лечить симптомы, а убрать причину появления лишних URL.
| Источник дубля | Что делать | Риск, если не трогать |
|---|---|---|
| Параметры URL | Редиректить или закрывать от индексации | Размножение копий одной страницы |
| Архивы тегов и авторов | Оставить только если они реально нужны | Много слабых страниц в индексе |
| Страницы поиска | Закрыть от индексации | Мусорный индекс и лишний crawl budget |
| Дубли со слешем/без | Настроить единый вариант через редирект | Разные URL для одной страницы |
| Пагинация архивов | Проверить canonical и robots | Путаница в индексации серий страниц |
Пошаговое решение: что делать с дублями
Шаг 1. Выберите канонический вариант URL
Для сайта должен быть один основной формат адресов: с www или без, со слешем или без. Это задается в настройках WordPress и на уровне сервера. Если у вас уже есть индексация в обоих вариантах, сначала настройте 301-редирект на один основной формат, а потом проверьте canonical.
Для Apache это обычно делается через .htaccess. Пример редиректа на HTTPS и без www:
RewriteEngine On
RewriteCond %{HTTPS} !=on [OR]
RewriteCond %{HTTP_HOST} ^www\.example\.ru$ [NC]
RewriteRule ^ https://example.ru%{REQUEST_URI} [L,R=301]Если у вас Nginx, правило нужно писать в конфиге сервера, а не в WordPress. Не пытайтесь решать это плагином, если редирект должен работать на уровне хоста.
Шаг 2. Закройте технические страницы от индексации
Страницы поиска, служебные архивы и некоторые таксономии часто не несут ценности для поиска. Их можно оставить для пользователей, но убрать из индекса. Если используете SEO-плагин, проверьте настройки архивов. Если настраиваете вручную, добавьте noindex там, где это уместно.
Пример для вывода noindex на страницах поиска и архивов автора:
add_action('wp_head', function () {
if (is_search() || is_author()) {
echo '<meta name="robots" content="noindex,follow" />' . "\n";
}
});Это не замена нормальной SEO-настройке, а рабочий способ для точечной правки, если тема или плагин не дают нужного контроля.
Шаг 3. Уберите параметры, которые создают копии
Особенно часто дубли создают параметры комментариев и сортировки. Если они не нужны для индексации, их лучше не пускать в поисковую выдачу. Для URL с ?replytocom= обычно достаточно редиректа или настройки плагина комментариев, если он его добавляет.
Для параметров, которые появляются из-за фильтров или сортировки, важно понять: это отдельная страница с уникальной ценностью или просто копия. Если копия — не индексировать. Если отдельная посадочная страница — тогда уже нужен отдельный URL и контент, а не параметр.
Шаг 4. Проверьте canonical и sitemap
Canonical должен указывать на основную версию страницы. Если canonical ведет на URL с параметром или на неканонический вариант, поисковик может игнорировать ваши редиректы. После настройки откройте исходный код страницы и проверьте тег:
<link rel="canonical" href="https://example.ru/page/" />Также проверьте sitemap. Туда не должны попадать страницы поиска, служебные архивы и URL с параметрами. Если sitemap генерируется SEO-плагином, отключите лишние типы архивов в его настройках.
Когда лучше редирект, а когда noindex
Это частый вопрос, и здесь нельзя отвечать одинаково для всех URL. Если у страницы есть один очевидный правильный адрес, используйте 301-редирект. Если страница нужна пользователю, но не должна участвовать в поиске, ставьте noindex. Если страница вообще не нужна, удаляйте ее и отдавайте 410 или 404 в зависимости от сценария.
- 301 — для дублей одного и того же контента;
- noindex — для служебных страниц, которые должны работать, но не индексироваться;
- 410/404 — для удаленных страниц без замены;
- canonical — для указания основного URL, но не вместо редиректа, если дубль уже живет в индексе.
Как проверить, что решение сработало
После правок не ограничивайтесь визуальной проверкой. Нужно убедиться, что поисковый робот видит именно то, что вы задумали.
- Откройте дублирующий URL и проверьте, что он редиректит на канонический адрес с кодом 301.
- Посмотрите исходный код основной страницы и убедитесь, что canonical указывает на нее же.
- Проверьте, что страницы поиска и авторов отдают
noindex, если вы это настроили. - Сравните sitemap до и после: технические URL не должны там появляться.
- В Search Console отправьте на переобход важные страницы и следите, как меняется статус индексации.
Если после редиректа старый URL все еще показывается в выдаче, это не значит, что настройка не работает. Поисковику нужно время на переобход. Но если через несколько обходов дубль остается доступным без редиректа, значит правило сработало не в том месте.
Частые ошибки и как их исправить
Редирект настроен в WordPress, но не на сервере
Если дубль возникает до загрузки WordPress, например на уровне www/без www или HTTP/HTTPS, PHP-код не поможет. Нужен серверный редирект.
На странице стоит noindex, но она все равно попадает в индекс
Так бывает, если страница уже была проиндексирована и поисковик еще не переобходил ее после изменений. Проверьте, не закрыта ли она одновременно в robots.txt. Если закрыта, робот может не увидеть новый noindex.
Canonical указывает не туда
Некоторые темы и плагины формируют canonical автоматически, но ошибаются на архивных страницах, пагинации или страницах с параметрами. В этом случае нужно отключить конфликтующую логику в теме или SEO-плагине и оставить один источник canonical.
Удалили страницу, но не настроили редирект
Если у удаленной страницы был трафик или входящие ссылки, просто 404 — плохой вариант. Нужен 301 на ближайшую релевантную страницу. Если релевантной замены нет, тогда уже 410.
Практические советы по безопасности и производительности
Чистка дублей — это не только про SEO. Лишние URL создают нагрузку на обход, раздувают логи и усложняют сопровождение. Не ставьте несколько SEO-плагинов одновременно: они часто конфликтуют по canonical, robots и sitemap. Если используете плагины для редиректов, храните правила в одном месте, иначе потом сложно понять, кто именно отдает ответ.
Перед массовыми изменениями сделайте резервную копию базы и файлов. Если на сайте много старых URL, сначала проверьте логи и карту редиректов на тестовой среде. Это особенно важно, если вы удаляете архивы, меняете структуру ссылок или отключаете таксономии.
Если нужен более жесткий контроль над дублями, служебными страницами и очисткой технического мусора, в экосистеме WPShop есть Clearfy Pro — его имеет смысл рассматривать именно как инструмент для техничной чистки сайта, а не как замену нормальной SEO-логике. Ссылка: Clearfy Pro.
Главная проверка простая: один контент — один индексируемый URL. Все остальное должно либо редиректить, либо быть закрыто от индексации, либо вообще не существовать. Если после правок это правило выполняется, дубли перестают накапливаться и сайт становится предсказуемее для поисковиков и для вас.