Если в Search Console всплывают дубли из архивов, тегов и категорий, проблема обычно не в одном «плохом» URL, а в логике генерации контента. WordPress по умолчанию создаёт много страниц-архивов, и часть из них начинает конкурировать друг с другом: одинаковые сниппеты, похожие заголовки, пустые или слабые страницы тегов, пагинация, страницы авторов и дат. На небольшом сайте это не критично, но на проекте с активной публикацией такие дубли быстро размывают релевантность.
Ниже разберём, что именно закрывать от индексации, что лучше оставить, и как сделать это без хаотичного удаления архивов из шаблона.
Когда это действительно проблема
Сначала стоит понять, что именно вы считаете дублем. Не каждая страница архива — лишняя. Категория может быть полезной посадочной страницей, а тег — бесполезным мусором, если на нём 2–3 записи и нет уникального текста. Ошибка многих сайтов в том, что они либо закрывают всё подряд, либо вообще ничего не трогают.
Типичные симптомы
- в индексе есть страницы
/tag/...,/category/...,/author/..., которые дублируют смысл записей; - в отчёте по индексированию много URL с параметрами пагинации и сортировки;
- одна и та же запись доступна через несколько архивов и внутренние ссылки ведут на разные версии;
- в выдаче вместо нужной категории ранжируется архив тега или дата-архив;
- страницы архивов имеют одинаковые title и description, собранные шаблоном.
Что не стоит закрывать без проверки
- основные категории, если они реально используются как рубрики-лендинги;
- страницы пагинации, если они нужны для обхода и не создают мусор в индексе;
- архивы авторов на редакционных сайтах, где авторские страницы полезны пользователю;
- страницы таксономий с уникальным текстом, фильтрацией и нормальной внутренней перелинковкой.
Диагностика: какие архивы плодят дубли
Перед правками проверьте, какие типы архивов реально индексируются. Самый простой способ — посмотреть отчёт Search Console и пройтись по сайту с помощью site:-запросов. Но для технической проверки лучше открыть исходный код страниц архива и посмотреть, что там уже есть: canonical, robots, title, description.
На что смотреть в первую очередь
- есть ли у архивов одинаковый
<title>; - ставится ли canonical на саму страницу или на главную/другой архив;
- не закрыты ли важные категории случайно через
noindex; - не создают ли плагины SEO и фильтров конфликтующие мета-теги;
- не дублируется ли контент между архивом категории и страницей записи.
Если у вас установлен SEO-плагин, сначала проверьте его настройки. Часто проблема решается не кодом, а выключением индексации для тегов, дат или авторов. Если же нужна точечная логика, тогда уже имеет смысл вмешиваться в шаблон или использовать фильтры.
Пошаговое решение: что закрыть, а что оставить
Ниже — рабочая схема, которая подходит для большинства контентных сайтов. Смысл простой: оставить в индексе только те архивы, которые несут самостоятельную ценность, а остальные закрыть от индексации и не давать им конкурировать с основными страницами.
Шаг 1. Оставьте в индексе только полезные категории
Категории обычно полезнее тегов. Если категория — это полноценная рубрика с текстом, подборкой материалов и нормальным URL, её можно оставить. Если категория пустая или служит технической группировкой, лучше закрыть её от индексации.
Для точечной настройки можно использовать фильтр wp_robots. Он позволяет добавить noindex на архивы тегов, дат и авторов, не трогая записи и страницы.
<?php
add_filter('wp_robots', function( array $robots ) {
if ( is_tag() || is_date() || is_author() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
});
Этот вариант хорош тем, что не ломает обход ссылок поисковиком. Страницы не индексируются, но ссылки на них могут быть пройдены.
Шаг 2. Уберите дубли из тегов, если они не несут пользы
Теги чаще всего создают больше шума, чем пользы. На многих сайтах они дублируют категории или превращаются в свалку из одноразовых меток. Если теговые архивы не нужны как посадочные страницы, их лучше закрыть от индексации и не генерировать для них отдельные SEO-мета-теги.
Если используете Yoast SEO, Rank Math или другой SEO-плагин, сначала проверьте встроенную настройку для таксономий. Это предпочтительнее, чем код, потому что плагин сам корректно выставит canonical и robots.
| Подход | Когда использовать | Плюсы | Минусы |
|---|---|---|---|
| Настройки SEO-плагина | Если нужно быстро закрыть теги, даты, авторов | Без кода, меньше риска | Не всегда хватает для точечной логики |
Фильтр wp_robots |
Если нужно управлять правилами программно | Гибко, работает на уровне WordPress | Нужно аккуратно тестировать темы и плагины |
| Удаление архивов из шаблона | Если архивы вообще не нужны на сайте | Просто визуально | Не решает индексацию и может сломать навигацию |
Шаг 3. Настройте canonical для архивов, если есть похожие страницы
Если у вас есть несколько страниц с близким смыслом, canonical помогает указать основную версию. WordPress и SEO-плагины обычно делают это сами, но после кастомизации шаблонов или фильтров стоит проверить, не сбился ли canonical.
Например, если категория и тег показывают почти один и тот же набор записей, лучше оставить индексируемой только категорию, а тег закрыть. Не пытайтесь «склеить» две разные таксономии canonical-ом в одну страницу — это не замена нормальной структуры сайта.
Если нужно закрыть архивы кодом, а не настройкой плагина
Иногда SEO-плагин не установлен или его настройки не подходят под вашу структуру. Тогда можно добавить правила в тему или в небольшой mu-plugin. Для production-сайта mu-plugin даже удобнее: он не зависит от темы и не потеряется после обновления.
<?php
/**
* Plugin Name: WP Auth - Archive Robots Rules
*/
add_filter('wp_robots', function( array $robots ) {
if ( is_tag() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
if ( is_date() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
});
Если нужно закрыть только часть тегов, а не все, можно проверять конкретный term ID или slug через get_queried_object() и добавлять noindex выборочно.
<?php
add_filter('wp_robots', function( array $robots ) {
if ( is_tag() ) {
$term = get_queried_object();
if ( $term && ! empty($term->slug) && in_array($term->slug, ['news', 'misc', 'test'], true) ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
}
return $robots;
});
Проверка результата после внедрения
После изменений не ограничивайтесь визуальной проверкой. Нужно убедиться, что поисковик видит именно те сигналы, которые вы ожидали.
Чек-лист проверки
- откройте несколько архивов тегов и категорий в браузере;
- посмотрите исходный код страницы и найдите
meta name="robots"; - убедитесь, что у закрытых архивов есть
noindex; - проверьте canonical на категориях и записях;
- после переобхода в Search Console посмотрите, исчезают ли лишние URL из отчёта по индексированию;
- сравните title и description у архивов: они не должны быть одинаковыми для всех страниц без необходимости.
Если используете кэш, очистите его после правок. Иначе вы можете смотреть старую версию страницы и решить, что код не сработал.
Частые ошибки и как их исправить
Закрыли все архивы подряд
Это частая ошибка после чтения общих советов. В результате сайт теряет полезные посадочные страницы, а внутренние ссылки становятся менее логичными. Исправление простое: оставьте в индексе только те категории, которые реально помогают пользователю, и закройте только мусорные архивы.
Удалили архив из шаблона, но не закрыли от индексации
Если страница больше не видна в меню, это не значит, что поисковик перестал её обходить. URL может остаться в индексе ещё долго. Нужно либо поставить noindex, либо вернуть корректный 404/410, если страница действительно больше не нужна.
Сломали canonical конфликтом плагинов
Иногда SEO-плагин, тема и кастомный код одновременно пытаются управлять мета-тегами. В итоге canonical дублируется или указывает не туда. Решение — оставить один источник правды: либо настройки SEO-плагина, либо собственный код, но не оба варианта сразу для одной и той же логики.
Закрыли архивы, но оставили пустые теги
Если тег не нужен, его лучше не только закрыть, но и перестать использовать в редакторском процессе. Иначе база данных будет продолжать расти, а админка — захламляться. Для чистки лишних таксономий иногда полезнее сначала провести аудит контента, а уже потом менять robots.
Практические советы по производительности и чистке сайта
Если дублей много, проблема часто шире, чем одна настройка индексации. Стоит проверить, не генерируются ли лишние архивы из-за плагинов, которые автоматически создают теги, авторские страницы или дополнительные таксономии. Чем меньше мусорных архивов, тем проще обход, кэширование и поддержка структуры.
Для сайтов, где нужно одновременно убрать дубли, почистить служебные элементы и не трогать полезные страницы, удобно использовать инструменты уровня Clearfy Pro: он закрывает часть типовых SEO- и технических задач без ручного набора разрозненных сниппетов. Но если у вас уже есть своя логика в теме или mu-plugin, не дублируйте её настройками плагина — выберите один способ управления.
Если хотите проверить, как это выглядит на практике в связке с SEO-чисткой, смотрите описание плагина здесь: Clearfy Pro.
Когда лучше не закрывать архив, а переработать его
Если категория приносит трафик, имеет уникальный текст, нормальную перелинковку и понятную структуру, не спешите ставить noindex. Иногда правильнее доработать архив: добавить описание рубрики, убрать лишние теги, настроить вывод записей и сделать страницу полезной как отдельный входной URL.
И наоборот: если архив пустой, дублирует записи и не даёт ценности, его лучше закрыть или удалить из структуры сайта. В этом сценарии важна не «магическая» настройка, а последовательная чистка: сначала аудит, потом решение по каждому типу архивов, затем проверка индексации.