Как закрыть дубли страниц от пагинации в WordPress

Если в индексе появляются почти одинаковые страницы вида /category/page/2/, /tag/page/3/ или архивы с параметрами, проблема обычно не в «плохом SEO», а в том, что WordPress и тема отдают поисковикам слишком много однотипных URL. Для небольшого сайта это незаметно. Для проекта с рубриками, тегами и архивами дубли быстро размывают краулинговый бюджет и мешают понять, какая страница должна ранжироваться.

Ниже — рабочий сценарий: как диагностировать источник дублей, что закрывать от индексации, а что лучше оставить, и как проверить, что после правок сайт не потерял полезные страницы.

Какие дубли чаще всего создаёт WordPress

На практике чаще всего всплывают четыре источника:

  • страницы пагинации архивов рубрик, тегов и записей автора;
  • архивы с сортировкой или фильтрами через GET-параметры;
  • страницы вложений с тонким контентом, которые дублируют медиафайл или запись;
  • страницы поиска и служебные URL, которые не должны конкурировать с основным контентом.

Пагинация сама по себе не ошибка. Ошибка начинается, когда в индекс попадают десятки страниц с одинаковыми заголовками, описаниями и почти тем же списком записей. Тогда поисковик видит не структуру сайта, а набор повторов.

Диагностика: где именно появляются дубли

Сначала нужно понять, что именно индексируется. Не ориентируйтесь только на отчёты плагина — проверьте фактические URL в поиске и в HTML-коде.

Что смотреть в первую очередь

  • результаты site:example.com по рубрикам и тегам;
  • страницы с /page/2/, /page/3/ и выше;
  • мета-теги robots и каноникал на архивных страницах;
  • наличие одинаковых title и description на разных страницах;
  • страницы вложений, если они открыты для индексации.

Если есть доступ к консоли, удобно быстро проверить заголовки и каноникал через curl:

curl -I https://example.com/category/news/page/2/

И отдельно посмотреть HTML:

curl -s https://example.com/category/news/page/2/ | grep -iE 'canonical|robots|title'

Если на второй и третьей страницах архива стоят такие же title, как на первой, это уже повод вмешаться. Если каноникал указывает на саму страницу пагинации, это не всегда ошибка, но для многих проектов такой вариант не нужен.

Что закрывать, а что оставить

Не стоит без разбора закрывать все архивы. Иногда рубрики и пагинация нужны для обхода роботом и для пользователей. Вопрос в том, какие URL реально несут ценность.

ВариантКогда подходитКомпромисс
Оставить в индексеСильные рубрики с уникальным описанием и полезной навигациейНужно следить за title, canonical и качеством контента
Закрыть noindexТеги, служебные архивы, страницы автора на небольшом сайтеСтраница остаётся доступной, но не участвует в поиске
Удалить из sitemapЛюбые URL, которые не должны быстро переобходитьсяНужно не забыть про внутренние ссылки

Если у вас много пустых тегов или архивов без смысла, лучше не пытаться «дотянуть» их контентом ради индекса. Проще убрать их из индекса и оставить только те архивы, которые реально помогают навигации.

Пошаговое решение: как убрать дубли от пагинации

Шаг 1. Ограничьте индексацию служебных архивов

Если вы используете SEO-плагин, проверьте настройки архивов. В большинстве случаев можно отключить индексацию тегов, архивов автора или дат, если они не нужны для продвижения. Для небольших сайтов это часто самый безопасный путь.

Если нужен кодовый вариант, можно добавить noindex для страниц пагинации архивов и некоторых служебных страниц через wp_head:

add_action('wp_head', function () {
    if (is_paged() && (is_category() || is_tag() || is_author() || is_date())) {
        echo '<meta name="robots" content="noindex,follow" />' . "\n";
    }
});

Это не удаляет страницу, а только просит поисковик не включать её в индекс. Для большинства архивов это достаточно.

Шаг 2. Уберите страницы вложений из поиска

Страницы вложений часто создают тонкие дубли: заголовок файла, пустая страница и ссылка на сам медиафайл. Если они не нужны как отдельные посадочные, лучше редиректить их на сам файл или на родительскую запись.

Простой вариант через код:

add_action('template_redirect', function () {
    if (is_attachment()) {
        $parent = wp_get_post_parent_id(get_the_ID());
        if ($parent) {
            wp_redirect(get_permalink($parent), 301);
            exit;
        }
    }
});

Если у вложения нет родителя, можно отправлять на главную или на страницу медиафайла, но это уже зависит от структуры сайта. Главное — не оставлять пустые attachment-страницы в индексе без причины.

Шаг 3. Проверьте canonical на пагинации

Для страниц /page/2/ и дальше каноникал должен быть осознанным. Не всегда нужно указывать на первую страницу архива. Если страница содержит уникальный набор записей и пользователь может на неё перейти, самоканоникал часто безопаснее, чем принудительный canonical на первую страницу.

Если тема или плагин ставят неправильный canonical, исправляйте это точечно. Например, через фильтр wpseo_canonical в Yoast SEO или аналогичный фильтр в вашем SEO-плагине. Но сначала проверьте, действительно ли проблема в canonical, а не в title или sitemap.

Шаг 4. Исключите мусорные URL из sitemap

Если страницы не должны индексироваться, они не должны попадать и в sitemap. Иначе поисковик будет регулярно возвращаться к ним, даже если вы поставили noindex. В SEO-плагине отключите архивы, которые не нужны, и проверьте, что в карте сайта остались только полезные URL.

Для проверки откройте sitemap и убедитесь, что там нет:

  • страниц поиска;
  • вложений;
  • архивов с пустым или слабым содержимым;
  • пагинации, если она не должна индексироваться.

Проверка результата после внедрения

После правок не ограничивайтесь визуальной проверкой. Нужно убедиться, что поисковик видит именно те сигналы, которые вы планировали.

  • Откройте несколько URL пагинации и проверьте <meta name="robots">.
  • Сравните canonical на первой и второй страницах архива.
  • Проверьте, что страницы вложений отдают 301 на родителя или другой целевой URL.
  • Убедитесь, что мусорные URL исчезли из sitemap.
  • Через Search Console посмотрите, не растёт ли число «Просканировано, но не проиндексировано» для закрытых страниц.

Если после изменений в индексе остались старые URL, это нормально: поисковику нужно время на переобход. Важнее, чтобы новые дубли больше не появлялись.

Частые ошибки и как их исправить

Ставят noindex на всё подряд

Самая частая ошибка — закрыть от индексации и рубрики, и теги, и автора, и пагинацию, а потом удивляться падению внутренней перелинковки. Если архивы реально помогают пользователю, не убирайте их без разбора. Закрывайте только те страницы, которые не несут самостоятельной ценности.

Оставляют страницы в sitemap после noindex

Это создаёт конфликт сигналов: вы говорите поисковику не индексировать URL, но одновременно подсовываете его в карту сайта. В результате робот продолжает тратить обход на бесполезные страницы.

Путают canonical и редирект

Canonical — это подсказка, а не жёсткое правило. Если у вас откровенно пустая страница вложения, лучше 301-редирект, а не надежда на canonical. Для дублей пагинации canonical может быть уместен, но он не заменяет нормальную структуру архива.

Ломают пагинацию в теме

Иногда после правок в шаблоне на страницах /page/2/ пропадают ссылки на следующие страницы или ломается навигация. После любого изменения проверьте, что листинг работает, а не только мета-теги.

Практические советы по безопасности и производительности

Если вы решаете проблему кодом, не вносите правки прямо в файлы темы. Используйте дочернюю тему или небольшой mu-plugin, чтобы обновление не затёрло изменения. Для точечных SEO-правок это особенно важно: такие изменения часто забывают и потом теряют при апдейте.

Ещё один полезный момент: чем меньше мусорных архивов и страниц вложений открыто для обхода, тем меньше лишних запросов делает робот и тем чище становится логика индексации. Это не «ускорение сайта» в прямом смысле, но на больших проектах помогает сократить шум вокруг контента.

Если нужен более системный подход к чистке дублей и технических хвостов, можно посмотреть в сторону инструментов вроде Clearfy Pro: https://wpshop.ru/plugins/clearfy. Но даже с плагином всё равно стоит понимать, какие URL вы закрываете и почему — иначе легко спрятать не только мусор, но и полезные страницы.

Если нужно быстро проверить, что решение не сломало навигацию, откройте в браузере:

/category/news/
/category/news/page/2/
/attachment/sample-image/

И сравните: есть ли доступ к контенту, корректен ли robots, не появились ли лишние редиректы и не исчезли ли ссылки на следующие страницы архива. Когда эти четыре пункта в порядке, проблема с дублями обычно закрыта без побочных эффектов.

Как закрыть дубли страниц от пагинации в WordPress
17.08.2026