Если в поиске всплывают страницы категорий, архивов или разделов на страницах 2, 3 и дальше, проблема обычно не в самой пагинации, а в том, как поисковик видит повторяющийся контент. Полностью закрывать такие страницы от индексации нужно не всегда: в одних случаях это помогает убрать дубли, в других — мешает обходу и ухудшает обнаружение материалов. В WordPress решение зависит от типа архива, структуры сайта и того, есть ли у пагинированных страниц самостоятельная ценность.
Короткий ответ такой: если страницы пагинации не несут отдельной пользы для поиска, их обычно закрывают от индексации через noindex,follow, а canonical оставляют на саму пагинированную страницу, а не на первую. Если же это важный архив, по которому пользователи реально переходят и который нужен для обхода новых записей, лучше не ломать его целиком, а сначала проверить, не создаёт ли дубль сама тема или плагин SEO.
Когда страницы пагинации действительно стоит закрывать
Пагинация становится проблемой, когда поисковик видит почти одинаковые страницы: /category/news/page/2/, /category/news/page/3/ и так далее. На них обычно повторяются заголовок архива, хлебные крошки, часть описания и набор записей, который лишь частично меняется. Для поисковой системы это слабый сигнал уникальности, и такие URL могут попадать в индекс без пользы для сайта.
Закрывать от индексации имеет смысл, если:
- страницы 2+ не содержат уникального текста, который нужен в поиске;
- в выдаче уже есть дубли категорий, тегов, архивов автора или даты;
- на сайте много тонких архивов, и индекс разрастается за счёт повторяющихся URL;
- вы хотите оставить доступ для обхода, но не показывать эти страницы пользователю из поиска.
Если же на странице пагинации есть заметно отличающийся контент, например ручное описание, подборка материалов или отдельная навигационная логика, сначала проверьте, не лучше ли доработать сам архив, а не прятать его от индекса.
Что выбрать: noindex или canonical
Для пагинированных страниц часто путают две разные задачи. noindex говорит поисковику не показывать URL в выдаче. canonical подсказывает, какая страница считается основной. Это не одно и то же, и для пагинации важно не перепутать их назначение.
| Ситуация | Что делать | Почему |
|---|---|---|
| Страница 2+ — обычный архив без уникальной ценности | noindex,follow | Убирает дубль из индекса, но не мешает роботам переходить по ссылкам дальше |
| Нужно указать основную страницу архива | canonical на саму текущую страницу | Пагинированная страница не является дублем первой, у неё свой набор записей |
| Поставить canonical на первую страницу на всех страницах пагинации | Обычно не нужно | Так можно ухудшить понимание структуры архива и потерять часть сигналов по страницам 2+ |
Для WordPress-пагинации безопаснее исходить из того, что каждая страница архива — это отдельный URL с отдельным набором записей. Поэтому canonical на первую страницу для всех страниц пагинации обычно не лучший вариант. Если SEO-плагин уже ставит корректный canonical на саму страницу, не спешите его переписывать вручную.
Как закрыть пагинацию в WordPress без вреда для обхода
Самый практичный вариант — оставить страницы пагинации доступными для обхода, но запретить их индексацию. Тогда робот сможет пройти по ссылкам к более глубоким страницам архива, а в выдачу они не попадут.
Если у вас установлен SEO-плагин, проверьте настройки архивов и метатегов. Во многих случаях там можно задать noindex для:
- архивов категорий;
- архивов тегов;
- архивов автора;
- архивов даты;
- страниц пагинации внутри этих архивов.
Логика настройки зависит от плагина, но принцип один: не закрывать URL от обхода через robots.txt, а именно убрать их из индекса через мета-тег robots или HTTP-заголовок. Если запретить обход в robots.txt, поисковик может не увидеть ссылки на следующих страницах и хуже обойти новые записи.
Это важный момент: noindex и запрет обхода — не одно и то же. Для пагинации обычно нужен именно noindex,follow, а не блокировка в robots.txt.
Если SEO-плагин уже управляет метатегами
Сначала проверьте, не делает ли плагин нужную работу автоматически. Многие SEO-плагины умеют закрывать архивы от индексации без ручного кода. Если вы добавите ещё и собственные правила, легко получить конфликт: один источник ставит canonical на первую страницу, другой — на текущую, третий — noindex только на часть архивов. В итоге поисковик видит противоречивые сигналы.
Проверять нужно не по названию настройки, а по итоговому HTML страницы. Откройте страницу пагинации и посмотрите исходный код: там должен быть мета-тег robots с noindex, если именно это вам нужно. Если его нет, настройка либо не применена, либо переопределяется темой или другим плагином.
Когда нужен код и как добавить его аккуратно
Код нужен только если тема или SEO-плагин не дают нужного результата. В WordPress это обычно решают через фильтр wp_robots, который позволяет добавить директиву noindex для страниц пагинации. Такой способ подходит, если вы хотите управлять индексированием на уровне сайта, а не вручную в каждом архиве.
Перед изменениями сделайте резервную копию и добавляйте код в дочернюю тему или через небольшой функциональный плагин. Не правьте напрямую файлы основной темы: после обновления изменения пропадут.
Пример, который добавляет noindex только на страницы пагинации архива:
add_filter( 'wp_robots', function( array $robots ) : array {
if ( is_paged() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Здесь is_paged() срабатывает на страницах 2, 3 и дальше. Директива follow оставляет роботам возможность переходить по ссылкам, что важно для обхода сайта. Если у вас уже есть другой код или SEO-плагин, который тоже управляет robots-метатегом, сначала проверьте, не дублируется ли логика.
Если нужно закрыть не все пагинированные страницы, а только конкретные типы архивов, условие можно уточнить. Например, отдельно для категорий, тегов или архивов автора. Но без необходимости лучше не усложнять: чем меньше правил, тем проще поддержка и меньше риск ошибки.
Как не ухудшить обход сайта
Главная ошибка при закрытии пагинации — перепутать индексацию и обход. Если убрать страницы 2+ из индекса, но оставить их доступными для обхода, поисковик всё равно сможет дойти до более глубоких записей. Если же закрыть их слишком жёстко, робот может хуже находить новые материалы, особенно на больших архивах.
Чтобы не навредить обходу, придерживайтесь нескольких правил:
- не закрывайте пагинацию через
robots.txt, если цель — только убрать дубли из выдачи; - не ставьте одинаковый
canonicalна первую страницу для всех страниц архива без необходимости; - не прячьте ссылки на следующие страницы через JavaScript, если это ломает обычную HTML-навигацию;
- не отключайте пагинацию полностью, если архив реально нужен для навигации по сайту.
Если сайт небольшой и новые записи появляются редко, влияние пагинации на обход может быть минимальным. На крупных проектах с сотнями архивных страниц ошибка в настройке заметнее: робот тратит время на бесполезные URL или, наоборот, перестаёт нормально проходить глубину разделов.
Как проверить, что всё работает
После настройки не ограничивайтесь визуальной проверкой. Откройте страницу пагинации, например вторую страницу категории, и посмотрите исходный код. Вам нужно убедиться в трёх вещах:
- в HTML есть
noindex, если вы именно его настраивали; canonicalуказывает на ожидаемый URL, а не на случайную страницу;- страница по-прежнему открывается и не отдает запрет на обход.
Дальше проверьте, как страница выглядит для поисковика в инструментах вебмастера. Если URL уже был в индексе, удаление может занять время: поисковик не убирает такие страницы мгновенно. Это нормально, особенно если на сайте много архивов и краулинговый бюджет распределяется неравномерно.
Если после настройки страницы пагинации всё ещё появляются в поиске, обычно причина одна из трёх: метатег не выводится, его переопределяет другой плагин, либо поисковик ещё не переобходил URL. В таком случае сначала ищите конфликт настроек, а не добавляйте ещё одно правило поверх старого.
Что делать в типичных спорных случаях
Иногда универсального ответа нет. Например, на новостном сайте страницы категории с пагинацией полезны для пользователей, но сами по себе редко нужны в поиске. На небольшом блоге, наоборот, закрытие пагинации может быть избыточным, если архивов мало и они не создают заметного дубля.
Ориентируйтесь на смысл страницы:
- если это просто продолжение списка записей — обычно достаточно
noindex,follow; - если страница даёт отдельную ценность и на неё есть смысл приводить трафик — не закрывайте её автоматически;
- если дубли возникают из-за темы, которая генерирует лишние архивы или повторяющиеся блоки, сначала исправьте источник дубля, а не маскируйте последствия.
В WordPress пагинация сама по себе не проблема. Проблема появляется, когда поисковик индексирует десятки почти одинаковых URL и начинает считать их отдельными страницами без ценности. В большинстве проектов достаточно аккуратно закрыть страницы 2+ от индексации, оставить им возможность обхода и проверить, что canonical и robots не конфликтуют между собой.