Как отключить дубли страниц архива в WordPress и не сломать индексацию

Если в Search Console всплывают одинаковые title и description на страницах категорий, тегов, авторов и пагинации, проблема обычно не в контенте, а в том, как WordPress отдаёт архивы. По умолчанию CMS создаёт много технически валидных URL, которые поисковик может считать дублями: страницы тегов, архивы дат, вложенные страницы пагинации, страницы вложений, иногда ещё и результаты внутреннего поиска.

Задача здесь не в том, чтобы «закрыть всё от индексации», а в том, чтобы оставить полезные страницы и убрать мусорные точки входа. Ниже — рабочий сценарий: сначала диагностика, потом настройка через код и плагины, затем проверка результата.

Что именно считается дублем в WordPress

На практике чаще всего дублируются не записи, а архивные представления одного и того же набора материалов. Например, категория доступна по основному URL, по пагинации, по тегу, по архиву автора и по архиву даты. Если на этих страницах почти одинаковые заголовки, описания и список записей, поисковик видит много похожих страниц и выбирает сам, что индексировать. Это нормально для CMS, но плохо для управляемого SEO.

Типовые источники дублей

  • архивы тегов, которые дублируют категории;
  • архивы авторов на сайтах с одним автором;
  • архивы дат, если они не нужны как посадочные страницы;
  • страницы вложений медиафайлов;
  • страницы поиска по сайту;
  • пагинация архивов с одинаковыми мета-тегами;
  • страницы с параметрами, которые не должны индексироваться.

Диагностика проблемы: где искать дубли

Начните не с правок, а с проверки того, какие URL уже попали в индекс и как они выглядят для поисковика. В Search Console откройте отчёт по страницам и посмотрите, какие типы URL индексируются чаще всего. Если у вас есть доступ к краулу, проверьте, повторяются ли title, meta description и H1 на архивных страницах. Для небольшого сайта достаточно ручной выборки: откройте категорию, её пагинацию, тег и архив автора, сравните HTML.

Отдельно проверьте, не создаёт ли тема или SEO-плагин одинаковые шаблоны для всех архивов. Частая ошибка — когда на всех страницах тегов стоит один и тот же title вроде «Теги сайта», а description вообще отсутствует. В таком виде архивы не помогают ни пользователю, ни поиску.

Что проверить вручную

  • есть ли в индексе страницы /tag/, /author/, /date/;
  • открываются ли страницы вложений по отдельным URL;
  • совпадают ли title у первой и второй страницы пагинации;
  • не индексируются ли внутренние результаты поиска;
  • не создают ли фильтры и параметры URL с одинаковым контентом.

Пошаговое решение: что закрывать, а что оставить

Самый безопасный подход — не трогать всё подряд. Сначала отключите только те архивы, которые не несут самостоятельной ценности. Для большинства проектов это страницы вложений, архивы дат и, иногда, архивы авторов на сайтах с одним редактором. Теги и категории лучше не закрывать автоматически: иногда они дают хороший трафик, если заполнены осмысленно.

Если используете SEO-плагин, проверьте его настройки архивов. В Yoast SEO и Rank Math можно отключать индексацию отдельных типов архивов без правки кода. Но если нужна точечная логика, надёжнее сделать это в теме или мини-плагине, чтобы поведение не зависело от интерфейса.

Пример: закрыть архивы дат, авторов и вложения через код

Добавьте это в functions.php дочерней темы или в свой мини-плагин:

add_action('template_redirect', function () {
    if (is_attachment()) {
        wp_redirect(home_url('/'), 301);
        exit;
    }
});

add_filter('author_link', function ($link) {
    return $link;
});

add_action('wp_head', function () {
    if (is_date() || is_author() || is_search()) {
        echo '<meta name="robots" content="noindex,follow" />' . "\n";
    }
});

Этот вариант простой, но у него есть ограничение: он не убирает URL из выдачи мгновенно и не заменяет полноценную SEO-настройку. Для архивов лучше использовать noindex,follow, а для вложений — редирект на родительскую запись или главную, если родителя нет.

Если нужен более чистый вариант через SEO-плагин

Вместо ручного вывода meta robots настройте типы архивов в интерфейсе плагина. Это удобнее, если редакторы сами создают теги и категории. Но следите, чтобы плагин не генерировал лишние canonical на страницы пагинации и не прятал нужные архивы целиком.

ПодходКогда подходитМинус
Код в теме/мини-плагинеНужна точечная логика и контрольНужно сопровождать при обновлениях
SEO-плагинУ сайта есть редакторы и много контентаЧасть логики зависит от настроек плагина
Только robots.txtНужно быстро закрыть отдельные путиНе решает дубли в индексе и не убирает страницы из обхода полностью

Как убрать дубли пагинации и не потерять страницы 2, 3, 4

Пагинация сама по себе не проблема. Проблема появляется, когда все страницы архива имеют одинаковые мета-теги, а canonical указывает только на первую страницу. Тогда поисковик может игнорировать полезные страницы списка. На больших сайтах это особенно заметно в категориях с десятками материалов.

Проверьте, что у страниц пагинации есть собственный canonical на саму страницу, а не на первую. Если SEO-плагин делает иначе, это надо исправить. Для архивов с реальной ценностью пагинация должна быть доступна и для пользователя, и для робота. Закрывать её noindex имеет смысл только в узких случаях, когда страницы 2+ не несут самостоятельной пользы и сильно размывают индекс.

Пример проверки canonical на пагинации

add_filter('get_canonical_url', function ($canonical) {
    if (is_paged()) {
        return $canonical;
    }
    return $canonical;
});

Этот фрагмент не меняет поведение сам по себе, а показывает, что canonical должен формироваться штатно. Если у вас уже есть фильтр от темы или SEO-плагина, проверьте, не переписывает ли он canonical для всех архивов на один и тот же URL.

Проверка результата после внедрения

После изменений не ограничивайтесь открытием страниц в браузере. Смотрите HTML и ответ сервера. Для вложений должен быть 301 на родительскую запись или на главную, если родителя нет. Для архивов, которые вы закрыли, в исходном коде должен появиться noindex,follow или соответствующая настройка SEO-плагина. Для страниц, которые оставили в индексе, canonical должен указывать на саму страницу, а не на общий архив.

Проверяйте ещё и поведение в Search Console. Новые настройки не дают мгновенного эффекта, но вы должны увидеть, что число страниц с одинаковыми title и description снижается, а в отчёте по индексированию исчезают ненужные типы URL. Если этого не происходит, значит, где-то остался второй источник дублей: тема, кэш, плагин или старые ссылки в sitemap.

Мини-чек-лист проверки

  • страницы вложений редиректят на нужный URL;
  • архивы дат и авторов закрыты или отключены;
  • у пагинации корректный canonical;
  • в sitemap нет мусорных URL;
  • в Search Console не растёт число дублей заголовков;
  • robots.txt не блокирует то, что должно быть доступно для обхода.

Частые ошибки и как их исправить

Закрыли всё через robots.txt

Это частая попытка «быстро убрать дубли». Но robots.txt не удаляет URL из индекса, если они уже известны поисковику, и не помогает, когда проблема в canonical или одинаковых мета-тегах. Для дублей архивов лучше использовать noindex, редиректы и настройку sitemap.

Поставили noindex на всё подряд

Если закрыть категории, теги и пагинацию без разбора, можно потерять полезные страницы, которые реально собирают трафик. Сначала оцените каждую группу архивов отдельно. На контентных проектах теги иногда стоит оставить открытыми, если они оформлены как полноценные подборки.

Оставили страницы вложений без редиректа

Медиафайлы часто создают тонкие страницы без контента. Если они индексируются, это почти всегда лишний шум. Редирект на родительскую запись — самый практичный вариант. Если вложение используется как самостоятельная посадочная страница, тогда нужен отдельный шаблон и осмысленный контент, а не стандартная пустая страница.

Сломали canonical в теме

Иногда разработчик вручную вставляет canonical в шаблон и не учитывает архивы, пагинацию и главную. В результате все страницы начинают ссылаться на один URL. Проверяйте исходный код после каждого изменения и не дублируйте логику SEO-плагина в теме.

Что ещё стоит учесть для безопасности и производительности

Если сайт большой, не делайте массовые правки в живой теме без резервной копии. Лучше вынести логику в отдельный мини-плагин: так она не исчезнет при смене темы и проще откатывается. После изменений очистите кэш страниц и объектный кэш, если он есть. Иначе вы будете проверять старую версию HTML и решите, что настройка не сработала.

Если используете Clearfy Pro, часть задач по чистке дублей и служебных страниц можно закрыть через интерфейс без ручного кода. Это удобно, когда нужно быстро отключить лишние архивы и не трогать шаблоны. Но даже в этом случае всё равно проверьте итоговый HTML и sitemap, а не только галочки в админке.

Для сайтов с частыми публикациями полезно держать под контролем генерацию архивов и карту сайта: чем меньше лишних URL попадает в sitemap, тем меньше мусора получает поисковик. Это не заменяет нормальную структуру контента, но помогает не раздувать индекс техническими страницами.

Как отключить дубли страниц архива в WordPress и не сломать индексацию
15.08.2026
Как отключить emojis в WordPress без поломки визуализации и лишних запросов
22.08.2026
Как отключить открытые XML sitemap в WordPress и оставить только нужные страницы
25.08.2026
Как отключить ответные изображения srcset в WordPress для отдельных страниц
29.08.2026
Как отключить открытые архивы целей в WordPress и не ломать индексацию
05.09.2026

Поддержка по WP: консультации по работе с движком, созданию контента, настройке тем и плагинов.