Проблема с дублями пагинации в WordPress обычно всплывает не на главной, а в архивах, рубриках, тегах и на страницах блога. Поисковик видит десятки похожих URL вида /category/news/page/2/, /page/3/, а иногда еще и варианты с параметрами фильтрации. В итоге в индексе оказываются страницы, которые не несут самостоятельной ценности, но расходуют краулинговый бюджет и размывают сигналы релевантности.
Ниже — рабочий сценарий: как диагностировать именно дубли пагинации, чем их закрывать, где лучше использовать noindex, а где достаточно канонического URL, и как проверить, что после правок сайт не потерял важные страницы из поиска.
Когда это действительно проблема
Не каждая страница пагинации — мусор. Если у вас большой архив статей, вторая и третья страницы могут быть полезны пользователю. Но для SEO важен вопрос: есть ли у этих URL самостоятельный поисковый спрос и уникальная ценность. Если нет, то индексировать их обычно не нужно.
Типичные признаки дублей
- в Google Search Console растет число проиндексированных URL с
/page/2/,/page/3/и дальше; - в выдаче появляются страницы архива вместо целевых статей;
- в логах краулера много обходов однотипных страниц;
- в HTML у пагинации нет нормального
rel=canonicalили он указывает на саму страницу без логики; - страницы с параметрами сортировки и фильтров начинают конкурировать с основными архивами.
Диагностика: что именно индексируется
Сначала не трогайте код. Снимите фактическую картину: какие URL уже попали в индекс, как они выглядят в HTML и не закрыты ли случайно важные разделы.
Проверка в Search Console и краулере
- Откройте отчет по индексированию страниц и найдите URL с
/page/. - Проверьте, есть ли среди них архивы рубрик, тегов, авторов и страниц поиска.
- Прогоните сайт через Screaming Frog или аналогичный краулер и посмотрите, какие мета-теги стоят на пагинации.
- Сравните количество внутренних ссылок на страницы пагинации и на основные статьи.
Что смотреть в исходном коде
На проблемной странице откройте исходник и проверьте три вещи: canonical, мета-robots и ссылки пагинации. Если canonical указывает на саму страницу, а вы хотите исключить ее из индекса, этого недостаточно. Если стоит noindex, но страница все равно активно участвует во внутренней перелинковке, поисковик может продолжать тратить на нее ресурсы обхода.
<link rel="canonical" href="https://example.com/category/news/page/2/" />
<meta name="robots" content="noindex,follow" />
Какой способ выбрать: noindex, canonical или чистка URL
Универсального ответа нет. Для WordPress лучше сначала убрать источник дублей, а уже потом решать, закрывать ли остаток от индексации. Если у вас дубли создают параметры, фильтры или лишние архивы, одной мета-строки мало.
| Подход | Когда подходит | Минус |
|---|---|---|
noindex,follow |
Для архивов пагинации, которые не нужны в поиске | Страница остается доступной для обхода |
| canonical на основную страницу | Когда есть явный дубль одного и того же контента | Не спасает от мусорных параметров в URL |
| Удаление источника дубля | Для фильтров, сортировок, лишних архивов и внутренних ссылок | Требует правки темы, плагина или настроек |
Пошаговое решение для WordPress
Если задача именно в пагинации архивов, рабочая схема обычно такая: закрыть от индексации страницы глубже первой, оставить их доступными для пользователей и не ломать навигацию.
Шаг 1. Добавьте noindex,follow для пагинации архивов
Если у вас нет SEO-плагина, который уже делает это корректно, можно добавить логику в functions.php дочерней темы или в небольшой mu-plugin. Пример ниже закрывает от индексации страницы архива, если это не первая страница.
<?php
add_action('wp_head', function () {
if (is_paged() && (is_category() || is_tag() || is_author() || is_post_type_archive() || is_home())) {
echo '<meta name="robots" content="noindex,follow" />' . "\n";
}
}, 1);
Это не идеальный универсальный вариант для всех сайтов, но для типового блога он решает задачу без лишней магии. Если у вас уже есть SEO-плагин, не дублируйте мета-теги вручную: два разных robots в одном документе создают путаницу.
Шаг 2. Проверьте canonical
Для пагинации canonical обычно должен указывать на саму страницу пагинации, если она нужна пользователю и должна быть доступна. Если же вы хотите исключить ее из индекса, canonical сам по себе не заменяет noindex. На практике именно noindex,follow дает более предсказуемый результат для архивов, которые не должны ранжироваться.
Шаг 3. Уберите лишние источники дублей
Часто проблема не в самой пагинации, а в том, что один и тот же список материалов доступен по нескольким URL. Например:
- архив рубрики и архив тега показывают одни и те же записи;
- страницы поиска индексируются вместе с пагинацией;
- параметры
?orderby=,?filter=,?ampсоздают новые версии URL; - в теме есть отдельные шаблоны для архивов, но без нормальной логики canonical и robots.
Если вы используете плагин для SEO и чистки дублей, вроде Clearfy Pro, проверьте, не включены ли одновременно несколько механизмов, которые делают одно и то же. Дублирование логики — частая причина конфликтов.
Шаг 4. Закройте технические URL, которые не должны индексироваться
Для страниц поиска, служебных архивов и некоторых параметров лучше не полагаться только на robots.txt. Если URL уже в индексе, robots.txt не вытащит его оттуда. В таких случаях нужен noindex на уровне HTML или HTTP-заголовка, а затем — повторная проверка в Search Console.
Если нужен более точный контроль через фильтр
Иногда удобнее управлять мета-robots через фильтр SEO-плагина, а не печатать тег в wp_head. У Yoast SEO и Rank Math есть свои фильтры, но если вы не уверены, какой плагин установлен на проекте, не привязывайтесь к конкретной интеграции. В чистом WordPress надежнее использовать собственную логику, как в примере выше.
Если же у вас уже есть SEO-плагин и вы хотите избежать ручного кода, проверьте его настройки для архивов, пагинации и таксономий. Часто там можно отдельно отключить индексирование страниц глубже первой.
Проверка результата после внедрения
После правок не ограничивайтесь просмотром исходника. Нужно убедиться, что поисковик видит именно то, что вы задумали.
Чек-лист проверки
- На страницах
/page/2/и глубже естьnoindex,follow, если это было задумано. - В исходнике нет двух разных мета-тегов robots.
- Canonical не указывает на случайную главную страницу раздела без причины.
- Страницы пагинации доступны без редиректов и без 404.
- В Search Console после переобхода статус URL меняется в ожидаемую сторону.
- Основные статьи и рубрики не потеряли внутренние ссылки.
Как проверить через браузер и curl
Быстрая проверка — открыть страницу и посмотреть исходник. Более надежная — запросить заголовки и HTML через curl.
curl -I https://example.com/category/news/page/2/
curl -s https://example.com/category/news/page/2/ | grep -i "robots\|canonical"
Если вы используете серверный X-Robots-Tag, проверьте и заголовки ответа. Это полезно, когда мета-тег в HTML может быть перезаписан шаблоном или плагином.
Частые ошибки и как их исправить
Закрыли в robots.txt, но URL уже в индексе
Это частая ошибка. robots.txt запрещает обход, но не гарантирует удаление из индекса. Если URL уже известен поисковику, он может остаться в выдаче без сниппета. Решение: вернуть доступ для обхода, поставить noindex, дождаться переобхода и только потом при необходимости снова ограничивать доступ.
Поставили noindex на все архивы подряд
Так можно случайно убрать из поиска полезные страницы рубрик, которые реально приводят трафик. Сначала разделите типы архивов: главная блога, рубрики, теги, авторы, поиск, пагинация. Не все они должны вести себя одинаково.
Дубли создают не пагинация, а фильтры и параметры
Если в индексе много URL с параметрами, закрытие /page/2/ ничего не даст. Сначала найдите источник: сортировка, фильтрация, AMP, UTM, внутренний поиск. Потом уже решайте, нужен ли noindex, canonical или полное удаление генерации таких URL.
Два SEO-плагина одновременно правят robots
На практике это приводит к конфликтам: один плагин пишет canonical, другой — meta robots, третий — переопределяет шаблон заголовка. Если вы видите странное поведение, временно оставьте один источник SEO-логики и проверьте результат заново.
Что делать, если сайт большой и ручная правка не подходит
На крупных проектах лучше не разбрасывать логику по шаблонам темы. Вынесите правила в отдельный mu-plugin или мини-плагин, чтобы они не потерялись при обновлении темы. Это особенно важно, если у вас несколько типов архивов, кастомные таксономии и отдельные шаблоны для мобильной версии.
Если задача шире, чем просто пагинация, имеет смысл сначала навести порядок в дублях и технических страницах, а уже потом заниматься контентом. Для этого удобно использовать инструменты, которые умеют чистить лишние архивы, дубли мета-тегов и служебные элементы без переписывания темы.
В проектах, где много технического мусора и дублирующихся страниц, обычно выигрывает не один «магический» тег, а последовательность: найти источник дубля, убрать его, затем ограничить индексацию оставшихся URL и проверить результат в Search Console.