Как найти и удалить дублирующиеся archive-страницы в WordPress без потери SEO

Дубли в WordPress часто появляются не на самих записях, а на архивных страницах: категории, теги, авторы, даты, страницы вложений, пагинация, а иногда и архивы кастомных таксономий. В результате поисковик видит несколько URL с почти одинаковым содержимым и начинает выбирать канонический адрес не так, как вы ожидаете.

Если задача не в том, чтобы «всё закрыть от индексации», а в том, чтобы оставить полезные архивы и убрать мусорные дубли, нужен точечный подход: сначала найти источник дубля, потом решить, что должно индексироваться, а что — нет.

Где именно возникают дубли archive-страниц

В реальных проектах проблема обычно выглядит так:

  • одна и та же запись доступна через архив категории, тега и автора;
  • страницы вложений индексируются отдельно и дублируют контент медиафайла или записи-родителя;
  • архивы с пагинацией создают десятки URL с одинаковыми заголовками и сниппетами;
  • технические архивы по дате и автору не несут ценности, но попадают в индекс;
  • кастомные таксономии генерируют пустые или почти пустые страницы.

Самая частая ошибка — закрывать всё подряд через noindex. Это убирает шум, но может сломать полезную структуру сайта, если архивы реально приводят трафик.

Диагностика: как понять, что проблема именно в archive-дублях

Начните с простого списка URL, которые уже попали в индекс или подозрительно похожи друг на друга. Проверять удобно в Google Search Console, но для локальной диагностики достаточно пройтись по сайту и посмотреть шаблоны архивов.

Признаки, которые стоит искать

  • одинаковые title и meta description на страницах разных архивов;
  • одинаковый H1 на страницах пагинации;
  • архивы без уникального текста и без полезной навигации;
  • страницы вложений, которые открываются как отдельные посты;
  • дубли с параметрами сортировки или фильтрации, если они не закрыты от индексации.

Если у вас есть доступ к серверным логам или аналитике, полезно посмотреть, какие archive-URL реально получают переходы. Иногда оказывается, что авторские архивы вообще не нужны, а категории — наоборот, дают стабильный трафик.

Что оставить в индексе, а что закрыть

Здесь лучше не действовать по шаблону. Для новостного или контентного сайта категории часто полезны, а теги — нет. Для корпоративного блога может быть наоборот: категории нужны как навигация, а архивы по датам только создают шум.

ВариантКогда подходитКомпромисс
Оставить в индексеАрхив даёт трафик и имеет уникальный текстНужно следить за дублями title и canonical
Закрыть через noindexАрхив полезен пользователям, но не нужен в поискеСтраница остаётся доступной, но не ранжируется
Удалить шаблон или редиректитьАрхив пустой, не используется и не нужен в навигацииМожно потерять внутренние ссылки, если не проверить их заранее

Пошаговое решение: как убрать дублирующиеся archive-страницы

Шаг 1. Отключите индексирование ненужных архивов

Если вы не хотите, чтобы архивы по датам и авторам попадали в индекс, проще всего добавить noindex, follow через фильтр wp_robots. Это штатный механизм WordPress, без выдуманных хуков и без вмешательства в шаблоны.

<?php
add_filter( 'wp_robots', function( array $robots ) {
    if ( is_date() || is_author() ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Такой вариант хорош тем, что не ломает доступность страниц для пользователей и ботов, но убирает их из поисковой выдачи. Если архивы авторов у вас важны, условие можно сузить до конкретных ролей или шаблонов.

Шаг 2. Уберите страницы вложений из индекса и ссылайтесь на родителя

Страницы вложений — частый источник мусора. Если медиафайл не должен жить отдельной страницей, лучше перенаправлять его на запись-родителя или сам файл, в зависимости от структуры сайта.

<?php
add_action( 'template_redirect', function() {
    if ( is_attachment() ) {
        $parent_id = wp_get_post_parent_id( get_queried_object_id() );

        if ( $parent_id ) {
            wp_safe_redirect( get_permalink( $parent_id ), 301 );
            exit;
        }

        wp_safe_redirect( home_url( '/' ), 301 );
        exit;
    }
} );

Если у вложений уже есть внешние ссылки, проверьте, что редирект не ведёт на 404 и не уводит пользователя в пустую категорию.

Шаг 3. Добавьте canonical на архивы с пагинацией

Пагинация сама по себе не проблема, но часто страницы /page/2/, /page/3/ и так далее получают одинаковые мета-данные. В большинстве случаев canonical должен указывать на саму текущую страницу архива, а не на первую страницу, иначе поисковик может игнорировать полезные страницы пагинации.

Если вы используете SEO-плагин, сначала проверьте его настройки. Если canonical генерируется неправильно, исправляйте это в шаблоне или через фильтры плагина, а не через хаотичную правку HTML.

Шаг 4. Удалите пустые архивы или спрячьте их из навигации

Если тег, автор или кастомная таксономия не содержит материалов, такой архив лучше не показывать в меню и не выводить в блоках ссылок. Это уменьшает число бесполезных переходов и снижает риск появления тонких страниц.

<?php
add_filter( 'get_the_archive_title', function( $title ) {
    if ( is_author() ) {
        $author = get_queried_object();
        if ( ! empty( $author->ID ) ) {
            $count = count_user_posts( $author->ID );
            if ( 0 === $count ) {
                return '';
            }
        }
    }

    return $title;
} );

Этот пример не удаляет архив физически, а только помогает не показывать пустой заголовок там, где он не нужен. Для удаления лучше работать на уровне шаблона и логики вывода ссылок.

Как проверить, что решение сработало

После внедрения изменений не ограничивайтесь просмотром страницы в браузере. Проверьте именно то, что видит поисковый робот.

  • Откройте проблемный URL и посмотрите исходный код: есть ли noindex и правильный canonical.
  • Проверьте, что страницы вложений отдают 301, а не 200.
  • Убедитесь, что архивы с пагинацией не дублируют title и description.
  • В Search Console отправьте на повторную проверку только те URL, которые реально изменились.
  • Сравните список проиндексированных страниц до и после через отчет по страницам и sitemap.

Если используете кэш, очистите его после правок. Иначе можно проверить старую версию шаблона и решить, что код не работает.

Частые ошибки и как их исправить

Ставят noindex на все архивы подряд

Так делают, когда хотят быстро убрать дубли, но в итоге теряют полезные страницы категорий. Исправление простое: разделите архивы на полезные и технические, а затем применяйте правила точечно.

Редиректят страницы вложений на главную

Это плохая замена нормальной логике. Для вложений лучше вести на родительскую запись или на сам файл, если медиа реально используется отдельно.

Оставляют одинаковые title на страницах пагинации

Поисковик видит такие страницы как почти одинаковые. Добавьте номер страницы в title там, где это уместно, или настройте шаблон SEO-плагина.

Путают canonical и noindex

Canonical не запрещает индексацию, а только подсказывает предпочтительный URL. Если архив не нужен в поиске, одного canonical недостаточно.

Безопасность и производительность: что учесть перед правками

Любые изменения в архивных шаблонах лучше вносить в дочернюю тему или через небольшой mu-plugin, а не в файлы основной темы. Так обновление не затрёт правки.

Перед массовыми редиректами сделайте резервную копию базы и списка URL, которые уже получают трафик. Особенно это важно для сайтов, где архивы используются как посадочные страницы.

Если вы хотите закрыть сразу несколько типов дублей, иногда проще использовать специализированный SEO-инструмент для чистки технических страниц. Например, у Clearfy Pro есть набор настроек для удаления дублей и лишних элементов, но перед включением всё равно стоит сверить, какие типы архивов реально нужны вашему сайту: https://wpshop.ru/plugins/clearfy?utm_source=wp-code.ru&utm_medium=article&utm_campaign=kak-najti-i-udalit-dubliruyushhiesya-archive-stranicy-v-wordpress

Мини-чек-лист перед публикацией изменений

  • Проверены категории, теги, авторы, даты и вложения.
  • Для ненужных архивов задан noindex, follow.
  • Страницы вложений отдают 301-редирект.
  • Canonical не конфликтует с пагинацией.
  • Пустые архивы не выводятся в меню и блоках.
  • Кэш очищен, а изменения проверены в исходном коде и Search Console.

Если после правок дубли всё равно остаются, смотрите не только на WordPress-шаблоны, но и на серверные редиректы, параметры URL и генерацию sitemap. Именно там часто прячется вторая половина проблемы.

Как найти и удалить дублирующиеся заголовки и meta description в WordPress
22.08.2026
Как удалить и заблокировать неиспользуемые методы оплаты в WooCommerce
12.09.2026
Как закрыть от индексации старые версии страниц после редизайна в WordPress
29.09.2026
Как программно удалить методы оплаты в WooCommerce по условиям
28.09.2026
Как программно удалить неиспользуемые метаполя в WooCommerce без плагинов
20.09.2026

Разработка под WordPress: подробные руководства, список встроенных функций, готовые решения.