Если в поиске всплывают одинаковые или почти одинаковые страницы, проблема обычно не в «плохой индексации», а в том, что WordPress отдаёт один и тот же контент по разным URL. Для SEO это лишний шум: поисковик тратит обход на копии, а сигналы ранжирования размазываются между дублями. Хорошая новость в том, что в WordPress такие URL почти всегда можно найти и привести в порядок без полной переделки сайта.
Сначала нужно понять, какие именно дубли у вас есть: полные копии страниц, почти одинаковые записи, архивы с тем же текстом, версии с параметрами в адресе или страницы, доступные по нескольким путям. От этого зависит способ удаления: где-то достаточно поставить редирект, где-то — закрыть архив, а где-то — оставить одну каноническую страницу и убрать лишние варианты из генерации.
Откуда берутся дубли страниц в WordPress
На практике дубли появляются не из-за одной ошибки, а из-за нескольких типичных источников. Самый частый случай — одна и та же страница открывается по разным адресам: с www и без него, с http и https, со слэшем на конце и без него. Если сайт настроен неаккуратно, поисковик видит это как разные URL.
Второй источник — архивы. WordPress может показывать один и тот же фрагмент текста на странице записи, в рубрике, в метках, в архиве автора и в архиве даты. Если шаблон темы выводит полный текст в архивах, копий становится ещё больше. Похожая ситуация бывает с пагинацией: /page/2/, /page/3/ и так далее содержат тот же набор материалов, но в другом порядке.
Третий источник — технические параметры в адресе. Это могут быть UTM-метки, сортировка, фильтры, поиск по сайту, а также служебные параметры, которые добавляют плагины. Для пользователя это одна и та же страница, а для поисковика — отдельный URL.
Наконец, дубли часто создают сами настройки сайта: одинаковые страницы категорий и тегов, вложенные страницы с похожими заголовками, копии материалов для разных языков или версий, а также старые адреса после смены структуры постоянных ссылок.
Как быстро найти лишние URL
Начинать лучше не с удаления, а с диагностики. Если сразу закрыть или удалить всё подряд, можно потерять нужные страницы или сломать внутренние ссылки.
Проверьте, какие адреса уже в индексе
Самый простой способ — поискать сайт в Google или Яндекс с оператором site:вашдомен.ru. Это не покажет все дубли, но даст понимание, какие типы URL уже попали в индекс. Обратите внимание на:
- страницы с одинаковыми заголовками, но разными адресами;
- архивы рубрик и тегов, которые повторяют содержимое записей;
- URL с параметрами;
- версии страниц с
www, безwww, сindex.phpили старой структурой ссылок.
Если у вас подключены Google Search Console или Яндекс.Вебмастер, там удобнее смотреть отчёты по страницам в индексе и исключённым URL. Это помогает увидеть не только дубли, но и причины, по которым поисковик выбрал не ту страницу.
Сравните адреса внутри самого WordPress
Откройте несколько подозрительных страниц и посмотрите, действительно ли это разные материалы или один и тот же контент в разных оболочках. Для проверки полезно сравнить:
- заголовок страницы;
- основной текст;
- canonical URL в исходном коде;
- хлебные крошки и путь в адресной строке;
- наличие параметров после
?.
Если canonical указывает на основную страницу, а в индексе всё равно сидит дубль, значит проблема либо в старых ссылках, либо в том, что поисковик ещё не переобходил сайт.
Проверьте сайт на массовые дубли через краулер
Если страниц много, вручную их не собрать. Удобнее прогнать сайт краулером вроде Screaming Frog, Sitebulb или аналогом, который умеет находить одинаковые title, description, H1 и повторяющиеся URL. Это особенно полезно, когда дубли не полные, а почти одинаковые: текст совпадает на 80–90%, но адреса разные.
Для WordPress это часто показывает проблему в шаблоне: например, рубрики выводят полный текст записи, а не анонс, или один и тот же материал доступен через несколько архивов.
Что удалять, а что лучше закрыть от индексации
Не все дубли нужно удалять физически. Иногда правильнее оставить страницу для пользователей, но убрать её из поиска. Выбор зависит от того, есть ли у URL самостоятельная ценность.
| Ситуация | Что делать |
|---|---|
| Старая версия страницы, которая больше не нужна | Поставить 301-редирект на актуальный URL |
| Дубль с параметрами, который не нужен пользователю | Закрыть от индексации и по возможности не генерировать такие ссылки |
| Архив тега или автора повторяет контент записей | Оставить для навигации, но убрать из индекса или улучшить шаблон архива |
| Одинаковая страница доступна по двум адресам | Сделать один основной URL и настроить редирект со второго |
Если дубль уже получил внешние ссылки или может быть полезен трафику, не удаляйте его бездумно. В таких случаях безопаснее сохранить адрес и склеить его с основным через редирект 301 или canonical. Полное удаление с кодом 404 уместно только тогда, когда страница действительно больше не нужна.
Как удалить дубли страниц в WordPress на практике
1. Настройте один основной вариант адреса
Сначала приведите сайт к единому формату URL. Проверьте, чтобы главная открывалась только в одной версии: либо с www, либо без него; либо на https, если сертификат уже установлен. В WordPress это обычно решается в настройках Адрес WordPress (URL) и Адрес сайта (URL), а также на уровне редиректов веб-сервера или хостинга.
Если у вас остались старые адреса после переезда или смены структуры ссылок, настройте 301-редиректы со старых URL на новые. Это можно сделать через конфигурацию сервера, через панель хостинга или плагином редиректов. Главное — чтобы редирект был именно постоянным, а не временным.
2. Уберите лишние архивы и служебные страницы из индекса
Если дубли создают архивы тегов, авторов, дат или пагинация, их не всегда нужно удалять. Часто достаточно закрыть от индексации те разделы, которые не несут самостоятельной ценности. В WordPress это обычно делают через SEO-плагин или правку шаблона, чтобы поисковик не воспринимал архив как отдельную целевую страницу.
Но здесь важно не путать закрытие от индексации и удаление. Если страница нужна для навигации пользователю, она может оставаться доступной, просто не должна конкурировать с основным материалом в выдаче.
3. Исправьте шаблон, если дубли создаёт тема
Иногда проблема не в контенте, а в теме. Например, на страницах рубрик выводится полный текст записи, а не анонс, или один и тот же блок контента повторяется в нескольких шаблонах. В таком случае удаление дублей через редиректы не решит корень проблемы: копии будут появляться снова.
Проверьте шаблоны category.php, tag.php, archive.php, author.php и вывод карточек записей. Для архивов обычно безопаснее показывать анонсы, а не полный текст. Если тема не позволяет это настроить без правки кода, лучше менять шаблон аккуратно, чтобы не сломать верстку и пагинацию.
4. Уберите дубли с параметрами
Если лишние URL появляются из-за параметров в адресе, сначала посмотрите, нужны ли они вообще. Параметры сортировки, фильтров и поиска часто не должны индексироваться. Для таких страниц обычно используют canonical на основную версию или закрывают их от индексации, если они не нужны для SEO.
Если параметры создаёт плагин, проверьте его настройки. Иногда достаточно отключить генерацию лишних вариантов ссылок, чтобы проблема исчезла без дополнительной правки.
Как проверить, что дубли действительно убраны
После правок не стоит ждать мгновенного исчезновения копий из поиска. Сначала проверьте техническую сторону:
- основной URL открывается без редиректных цепочек;
- старые адреса отдают 301 на нужную страницу;
- дубли с параметрами не попадают в индекс как отдельные страницы;
- canonical указывает на основную версию;
- в sitemap.xml нет мусорных URL, которые не должны индексироваться.
Затем отправьте важные страницы на переобход в Google Search Console или Яндекс.Вебмастер. Если дубли были удалены физически, поисковику нужно время, чтобы выкинуть их из индекса и переоценить основную страницу.
Хороший признак — когда в поиске остаётся один стабильный URL, а остальные либо редиректят на него, либо не индексируются. Если через несколько недель копии всё ещё возвращаются, значит где-то осталась внутренняя ссылка, архив, параметр или старый шаблон, который продолжает генерировать лишние адреса.
Что делать, если дубль уже в индексе и мешает ранжированию
Если в выдаче уже сидит не та страница, не пытайтесь просто удалить её из админки и ждать чуда. Сначала найдите источник URL, потом поставьте редирект или canonical, затем обновите внутренние ссылки на сайте. Только после этого поисковик начнёт воспринимать основную страницу как единственную версию.
На сайтах с большим количеством архивов и технических дублей удобно использовать инструменты, которые помогают чистить SEO-мусор и управлять дублями на уровне WordPress. Если вам нужен именно такой набор задач, у WPShop есть Clearfy Pro: https://wpshop.ru/plugins/clearfy. Но даже с плагином логика остаётся той же: сначала найти источник дубля, потом убрать причину, а не только следствие.
Если коротко, рабочая схема всегда одна: определить тип дубля, оставить один основной URL, лишние варианты либо редиректить, либо закрывать от индексации, а шаблоны и настройки WordPress привести к единому правилу. Тогда сайт перестаёт плодить копии, а поисковик быстрее понимает, какую страницу считать основной.