Как убрать дубли страниц в WordPress из-за архивов и пагинации

Дубли в WordPress чаще всего появляются не из-за «плохого контента», а из-за штатной генерации архивов, пагинации, тегов, авторских страниц и параметров в URL. На небольшом сайте это может быть незаметно, но в индексе быстро накапливаются десятки однотипных страниц с одинаковыми заголовками, сниппетами и каноническими адресами. В итоге поисковик тратит краулинговый бюджет на мусор, а нужные страницы получают меньше внимания.

Ниже разберём не абстрактную SEO-теорию, а рабочий сценарий: как найти источник дублей, что закрывать от индексации, что оставлять, и как не сломать навигацию и внутреннюю перелинковку.

Какие дубли в WordPress встречаются чаще всего

Обычно проблема выглядит так: одна и та же запись доступна через несколько URL, либо WordPress создаёт похожие страницы архива, которые отличаются только номером страницы или параметром сортировки. Самые частые источники:

  • архивы рубрик и меток;
  • архивы авторов и дат;
  • страницы пагинации вида /page/2/;
  • страницы вложений изображений;
  • URL с параметрами сортировки, фильтров, UTM и служебных query string;
  • страницы поиска по сайту;
  • дубли главной через разные адреса, если не настроен каноникал.

Не все из них нужно удалять. Часть страниц полезна для пользователей и поиска, а часть — чистый технический шум. Ошибка здесь одна: пытаться закрыть всё подряд.

Диагностика: как понять, что именно дублируется

Сначала проверьте, какие URL уже попали в индекс и как они выглядят в поисковой выдаче. Если у вас есть доступ к Google Search Console или Яндекс Вебмастеру, посмотрите отчёты по страницам с дублирующимися title и description, а также список проиндексированных URL с параметрами.

На самом сайте полезно проверить три вещи:

  1. Открывается ли одна и та же запись по нескольким адресам.
  2. Есть ли у архивов пагинация и не индексируются ли её страницы.
  3. Не создаёт ли тема или плагин отдельные страницы для вложений, тегов и поиска без необходимости.

Быстрый технический тест можно сделать через консоль браузера или curl. Например, сравнить заголовки и canonical у основной страницы и её копий:

curl -I https://example.com/category/news/page/2/
curl -I https://example.com/tag/news/

Если у страниц пагинации и архивов одинаковые title, а canonical указывает не туда или отсутствует, это уже причина для правки.

Что закрывать, а что оставлять: короткое сравнение подходов

ВариантКогда подходитПлюсМинус
Плагин SEO/чисткиНужно быстро закрыть служебные архивы и параметрыМеньше кода, проще поддержкаЛегко переборщить настройками
Код в теме или mu-pluginНужна точечная логика под конкретный сайтКонтроль над поведениемНужно следить за обновлениями и тестами
Комбинированный вариантЕсть SEO-плагин, но часть правил удобнее задать вручнуюГибкостьВажно не задублировать правила

Если задача типовая, проще начать с SEO-плагина. Если нужен точечный контроль над архивами и canonical, лучше добавить небольшой код в mu-plugin или в дочернюю тему. Для чистки дублей и служебных страниц на практике часто используют Clearfy Pro, но только если вам действительно нужен набор именно таких настроек, а не «ещё один комбайн».

Пошаговое решение: убираем дубли без потери полезных страниц

1. Отключите индексирование лишних архивов

Если на сайте нет смысла в архивах авторов или дат, их лучше закрыть от индексации. Это не значит удалять страницы физически: достаточно выставить noindex и оставить их доступными для пользователей, если они нужны в интерфейсе.

В SEO-плагинах это обычно делается в настройках архивов. Если хотите сделать это кодом, можно добавить мета-robots для архивов авторов и дат:

<?php
add_action('wp_head', function () {
    if (is_author() || is_date()) {
        echo '<meta name="robots" content="noindex,follow">' . "\n";
    }
});

Такой вариант рабочий, но если у вас уже стоит SEO-плагин, проверьте, не выводит ли он свой robots meta. Два разных тега на странице — частая причина путаницы.

2. Уберите страницы вложений и их дубли

Страницы вложений часто создаются автоматически и почти никогда не несут самостоятельной ценности. Обычно лучше перенаправить их на сам файл или на родительскую запись.

Если тема или плагин не делают этого корректно, можно настроить редирект для attachment pages:

<?php
add_action('template_redirect', function () {
    if (is_attachment()) {
        $url = wp_get_attachment_url(get_queried_object_id());
        if ($url) {
            wp_redirect($url, 301);
            exit;
        }
    }
});

Перед включением проверьте, не используются ли attachment pages в вашем дизайне или в галереях как отдельные посадочные страницы. Если используются, редирект делать нельзя.

3. Настройте canonical для пагинации и архивов

Canonical должен указывать на саму страницу, а не на главную или случайный архив. Для страниц пагинации canonical обычно остаётся на текущую страницу пагинации, а не на первую страницу архива. Если плагин SEO уже делает это правильно, не вмешивайтесь без причины.

Проверить canonical можно в исходном коде страницы:

<link rel="canonical" href="https://example.com/category/news/page/2/" />

Если canonical указывает на первую страницу архива там, где должна быть вторая, поисковик может игнорировать содержимое пагинации или склеивать страницы не так, как вы ожидаете.

4. Сократите количество индексируемых таксономий

Если на сайте много тегов, но у большинства из них по 1–2 записи, они создают тонкие архивы без пользы. В таком случае лучше либо закрыть теги от индексации, либо оставить только те, которые реально собирают тематические подборки.

Практический критерий простой: если архив не даёт пользователю дополнительной навигационной ценности и не содержит достаточного объёма уникального контента, его лучше не продвигать в индекс.

Как проверить, что решение сработало

После изменений не ограничивайтесь визуальной проверкой. Нужно убедиться, что:

  • страницы с дублями отдают нужный статус и мета-robots;
  • canonical указывает на правильный URL;
  • служебные страницы не попадают в sitemap, если их не нужно индексировать;
  • редиректы не создают цепочки;
  • основные записи и рубрики остались доступны без ошибок.

Минимальный чек-лист проверки:

  • открыть 3–5 страниц архива и пагинации в браузере;
  • посмотреть исходный код на наличие noindex,follow или корректного canonical;
  • проверить редиректы через curl -I или любой HTTP-проверщик;
  • сравнить sitemap до и после правок;
  • убедиться, что внутренние ссылки не ведут на удалённые или закрытые URL.

Если используете Search Console, обновления индекса не ждите мгновенно. Сначала проверьте, что технически всё стало правильно, а потом уже смотрите динамику обхода и исключённых страниц.

Частые ошибки и как их исправить

Закрыли от индексации всё подряд

Иногда вместе с дублями закрывают и полезные архивы рубрик. В результате сайт теряет часть навигации и внутренней структуры. Исправление простое: оставьте в индексе только те архивы, которые реально помогают пользователю и содержат уникальный набор материалов.

Поставили noindex, но оставили страницу в sitemap

Это не критическая ошибка, но сигнал для поисковика получается противоречивым. Если страница не должна индексироваться, уберите её из карты сайта. Если должна — не ставьте noindex.

Сделали редирект на главную вместо релевантной страницы

Так часто поступают со страницами вложений или устаревшими архивами. Но редирект на главную — слабое решение: пользователь теряет контекст, а поисковик получает неочевидный сигнал. Лучше вести на родительскую запись, категорию или сам файл, если это логично.

Не проверили конфликт с SEO-плагином

Если у вас уже работает Yoast SEO, Rank Math или другой SEO-плагин, ручной код может конфликтовать с его настройками. Перед внедрением проверьте, кто именно выводит canonical, robots meta и sitemap. Дублирующая логика — частая причина странных результатов.

Практические советы по безопасности и производительности

Любые правки лучше вносить не в основную тему, а в дочернюю тему или отдельный mu-plugin. Тогда обновление темы не затрёт изменения. Для точечных SEO-правил это особенно важно: такие правки редко должны зависеть от дизайна.

Если вы используете плагин для чистки дублей и служебных страниц, не включайте сразу все опции. Сначала отключите только очевидно лишнее: страницы вложений, архивы дат, часть тегов и служебные мета-данные. Потом проверьте индексацию и только после этого двигайтесь дальше.

Ещё один практический момент: не полагайтесь только на robots.txt. Запрет в robots.txt не убирает URL из индекса, если он уже известен поисковику. Для дублей важнее canonical, noindex и корректные редиректы.

Если нужна более широкая чистка сайта вместе с SEO-настройками, дублями и служебными архивами, смотрите на инструменты, где эти функции собраны в одном месте, например Clearfy Pro: https://wpshop.ru/plugins/clearfy. Но даже в этом случае сначала проверьте, какие именно страницы у вас реально создают дубли, а уже потом включайте автоматические правила.

Когда лучше не трогать архивы вручную

Если сайт уже давно в индексе и на него идут переходы из архивов тегов, категорий или авторов, резкое закрытие этих страниц может временно просадить трафик. В такой ситуации лучше действовать поэтапно: сначала оценить трафик по URL, потом закрывать только самые слабые и бесполезные архивы, затем смотреть на переобход и изменения в индексе.

То же касается крупных сайтов с десятками тысяч страниц. Там ручная правка без карты URL и без проверки шаблонов часто создаёт больше проблем, чем решает. Для таких проектов сначала нужен аудит шаблонов архива, пагинации и генерации canonical, а уже потом точечные изменения.

Добавь в закладки и поделись с друзьями:

⭐⭐⭐⭐⭐
Как найти и убрать дубли страниц в WordPress без потери SEO
26.08.2026
Как создать адаптивный обзор постов с помощью AJAX в WordPress
13.02.2026
Как удалить разные типы кешей в WordPress: практическое руководство
26.01.2026
Как изменить функции WooCommerce без изменения основных файлов WordPress
18.11.2025
Как отключить Emoji в WordPress без плагинов
11.12.2025
×
Quizle
Получите больше лидов и увеличьте продажи!
-15%

на премиум плагин WordPress

Получить скидку ⋙