Пагинированные архивы в WordPress часто пытаются «лечить» одним движением: закрыть всё от индексации, убрать ссылки или переписать canonical на первую страницу. В результате поисковик перестаёт нормально обходить глубину архива, а страницы категорий и тегов начинают вести себя непредсказуемо. Если задача не в том, чтобы спрятать архивы полностью, а в том, чтобы убрать мусор из индекса и сохранить обход, нужен более аккуратный подход.
Ниже разберём рабочую схему для категорий, тегов и других архивов с пагинацией: когда использовать noindex, когда оставить canonical как есть, как проверить, что WordPress и SEO-плагин не конфликтуют, и какие ошибки чаще всего ломают индексацию.
Когда проблема действительно в пагинации, а не в дублировании
Сначала стоит понять, что именно вы исправляете. Пагинированный архив — это не всегда дубль. Страница /category/news/ и /category/news/page/2/ показывают разный набор записей, и поисковик это понимает. Проблема возникает, когда:
- в индекс попадают страницы, которые не несут самостоятельной ценности;
- canonical у всех страниц архива указывает только на первую страницу;
- вместе с
noindexвы случайно убираете и ссылки на следующие страницы; - SEO-плагин и тема одновременно меняют мета-теги, из-за чего в HTML появляется конфликт.
Что проверить в первую очередь
- Есть ли у пагинированных страниц собственный URL и доступен ли он без редиректов.
- Какой canonical реально отдаётся в исходном коде.
- Не закрыты ли архивы в
robots.txtили через правила плагина. - Не дублируются ли title и description на страницах 1, 2, 3 архива.
Если архивы нужны только как навигация по сайту, а не как посадочные страницы, обычно достаточно noindex,follow для страниц глубже первой. Если же архивы должны ранжироваться, закрывать их от индексации не стоит — лучше убрать только лишние шаблонные дубли и привести canonical в порядок.
Рабочая схема: что делать с первой страницей и пагинацией
Базовая логика простая:
- первая страница архива остаётся индексируемой, если она полезна;
- страницы
/page/2/,/page/3/и дальше получаютnoindex,follow; - canonical на пагинации остаётся сам на себя, если вы не хотите ломать обход и отладку;
- title и description для пагинации можно сделать уникальными, но без переоптимизации.
На практике это лучше реализовывать на уровне SEO-плагина, если он уже управляет мета-тегами. Если плагина нет или он ведёт себя нестабильно, можно добавить точечный код в functions.php дочерней темы или в небольшой mu-plugin.
Вариант через код: noindex для страниц архива глубже первой
Ниже пример, который добавляет noindex,follow для пагинированных архивов категорий, тегов и таксономий. Он не трогает первую страницу и не вмешивается в canonical.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_admin() ) {
return $robots;
}
if ( is_category() || is_tag() || is_tax() ) {
global $paged;
if ( $paged > 1 ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
}
return $robots;
} );Этот способ опирается на встроенный фильтр wp_robots, который есть в современных версиях WordPress. Он безопаснее, чем ручная вставка мета-тега в шаблон, потому что не ломает другие правила robots, которые может добавить плагин или ядро.
Если нужно ограничить только конкретные таксономии
Иногда закрывать все архивы подряд нельзя: например, рубрики нужны в индексе, а теги — нет. Тогда лучше сузить условие.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_tag() && ! is_admin() ) {
global $paged;
if ( $paged > 1 ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
}
return $robots;
} );Если у вас уже стоит SEO-плагин, сначала проверьте, не умеет ли он делать это штатно. Код нужен тогда, когда настройка отсутствует или плагин закрывает не те страницы.
Сравнение подходов: плагин, код, ручная правка шаблона
| Подход | Когда подходит | Плюсы | Минусы |
|---|---|---|---|
| SEO-плагин | Если архивами управляет один инструмент | Быстро, без правки темы | Не всегда есть точечная настройка для пагинации |
Код через wp_robots | Нужна точная логика для отдельных архивов | Прозрачно и предсказуемо | Требует аккуратной проверки условий |
| Правка шаблона | Когда нужно менять вывод title/canonical в теме | Полный контроль | Легко сломать совместимость с плагином |
Если задача только в noindex для пагинации, код через фильтр обычно надёжнее, чем ручная вставка мета-тегов в header.php. Если же у вас уже есть SEO-плагин, не дублируйте логику в двух местах.
Диагностика: как понять, что canonical и noindex не конфликтуют
После внедрения важно проверить не «на глаз», а по факту HTML-ответа. Откройте исходный код страницы архива и посмотрите:
- есть ли
<meta name="robots" content="noindex,follow">на страницах глубже первой; - не появился ли второй robots-meta от плагина;
- какой canonical указан на странице
/page/2/; - не редиректит ли пагинация обратно на первую страницу.
Для быстрой проверки можно использовать curl:
curl -I https://example.com/category/news/page/2/Или посмотреть HTML-фрагмент:
curl -s https://example.com/category/news/page/2/ | grep -iE 'robots|canonical'Если canonical на странице пагинации указывает на первую страницу, это не всегда ошибка, но в сочетании с noindex и закрытыми ссылками может ухудшить обход. В большинстве случаев безопаснее оставить canonical сам на себя, а индексацию регулировать через robots-мета.
Что должно получиться после правки
- Первая страница архива доступна и индексируется, если это нужно.
- Страницы пагинации не попадают в индекс.
- Ссылки на следующие страницы остаются доступны для обхода.
- В HTML нет конфликтующих robots-мета от темы и SEO-плагина.
Частые ошибки и как их исправить
Ставят noindex на весь архив целиком
Так делают, когда используют слишком широкое условие вроде is_archive(). В итоге закрываются и первая страница, и пагинация, и иногда даже полезные архивы авторов или кастомных таксономий. Исправление простое: ограничьте условие только пагинированными страницами и только нужными типами архивов.
Дублируют robots-мета в теме и плагине
Если SEO-плагин уже выводит robots, а тема добавляет свой тег вручную, поисковик увидит два набора инструкций. Это часто заканчивается непредсказуемым поведением. Оставьте один источник правды: либо плагин, либо код.
Закрывают пагинацию в robots.txt
Это не то же самое, что noindex. Запрет в robots.txt мешает обходу, но не гарантирует удаление URL из индекса, если на него уже есть ссылки. Для страниц архива, которые нужно убрать из индекса, обычно лучше использовать robots-мета, а не блокировку обхода.
Переписывают canonical на первую страницу без проверки
Такой приём иногда советуют для «склейки» дублей, но для пагинации он спорный. Если вы не уверены, что это именно ваш кейс, не трогайте canonical без теста в Search Console и без просмотра исходного кода.
Практические советы по безопасности и производительности
Если вы решаете задачу кодом, не вносите правки прямо в родительскую тему. Используйте дочернюю тему или небольшой плагин. Это снижает риск потерять изменения после обновления.
- Перед правкой сделайте резервную копию файлов и базы.
- Проверьте изменения на staging-окружении, если оно есть.
- Не ставьте несколько SEO-плагинов одновременно.
- После релиза очистите кеш страницы и объектный кеш, если он используется.
Если на сайте много архивов и шаблонных дублей, имеет смысл посмотреть в сторону инструментов для технической чистки и SEO-настроек. Например, Clearfy Pro полезен именно там, где нужно централизованно отключать лишние элементы, управлять дублями и не разносить логику по теме.
Проверка результата в Search Console и в браузере
После публикации изменений не ограничивайтесь просмотром страницы в браузере. Откройте URL в Search Console и проверьте, как Google видит страницу: есть ли robots-мета, какой canonical выбран, не блокируется ли ресурс robots.txt. Для новых правил важно дождаться повторного обхода, а не делать выводы по старому кешу.
Хороший практический тест — сравнить три URL:
- первая страница архива;
- страница
/page/2/; - страница
/page/3/или глубже.
Если на всех трёх одинаковый robots-мета и canonical, значит условие сработало слишком широко. Если пагинация закрыта, но ссылки на неё исчезли из HTML, проверьте шаблон архива и настройки кеширования.
Когда нужно не просто закрыть дубли, а аккуратно убрать лишнее из индекса и не сломать обход, лучше идти от конкретного сценария: какие архивы нужны в поиске, какие — только для навигации, и кто именно управляет мета-тегами на сайте. Тогда решение получается коротким, проверяемым и без побочных эффектов.