Как исправить дубли страниц в WordPress из-за архивов и пагинации

Дубли в WordPress часто появляются не из-за «плохого SEO-плагина», а из-за обычной структуры сайта: архивы категорий, теги, авторы, даты, страницы пагинации, результаты поиска и служебные URL. На небольшом сайте это может быть незаметно, но в индексе такие страницы быстро начинают конкурировать друг с другом и размывать релевантность.

Ниже — практический разбор: как найти источник дублей, что закрывать от индексации, а что лучше оставить, и как проверить, что после правок сайт не потерял важные страницы.

Откуда берутся дубли и как это увидеть в реальности

Самая частая ошибка — пытаться «закрыть всё подряд». В WordPress не все похожие URL являются дублями в строгом смысле. Например, архив категории и отдельная запись в этой категории — это нормальная связка. Проблема начинается, когда в индекс попадают:

  • архивы авторов на сайтах с одним автором;
  • архивы дат, если они не несут самостоятельной ценности;
  • теги, которые дублируют категории по смыслу;
  • страницы пагинации, если они индексируются без необходимости;
  • страницы поиска и служебные URL с параметрами;
  • варианты одного и того же контента с разными путями, если тема или плагин генерируют лишние ссылки.

Быстрая диагностика

Перед правками проверьте, что именно уже попало в индекс. Удобно смотреть:

  • отчёт по страницам в Google Search Console;
  • поиск по site:example.com с типовыми шаблонами URL;
  • наличие дублей в sitemap;
  • канонические URL в исходном коде страниц;
  • заголовки noindex и robots на архивных страницах.

Если у вас есть доступ к консоли, полезно проверить конкретный URL:

curl -I https://example.com/author/admin/page/2/

В ответе смотрите на X-Robots-Tag, редиректы и статус-код. Если страница должна быть закрыта, а отдаёт 200 и индексируется, это уже рабочая проблема, а не теоретическая.

Что закрывать, а что оставлять

Здесь важно не путать «лишнее для SEO» и «лишнее для пользователя». Архивы категорий обычно полезны: они помогают навигации и собирают тематический трафик. А вот архивы дат на большинстве контентных сайтов редко дают самостоятельную ценность. То же самое с архивами авторов на блоге с одним редактором: они почти всегда дублируют главную ленту или страницу автора без дополнительной пользы.

ВариантЧто делаетКомпромисс
SEO-плагинБыстро ставит noindex для архивов, тегов, авторов, датМеньше контроля над логикой, зависит от настроек плагина
Код в теме/плагинеТочечно управляет meta robots и canonicalНужна аккуратность и тестирование после обновлений
Комбинированный подходПлагин для базовых правил, код для исключенийСложнее поддержка, но меньше случайных побочных эффектов

Если нужен быстрый и понятный контроль над дублями, на практике часто используют плагин уровня Clearfy Pro для SEO-очистки и закрытия архивов, а нестандартные случаи добивают кодом. Это не обязательное решение, но оно удобно, когда нужно быстро привести в порядок архивы, sitemap и служебные страницы. Ссылка на продукт: Clearfy Pro.

Пошаговое решение без лишнего риска

Шаг 1. Определите, какие архивы реально нужны

Сначала составьте список типов страниц, которые должны остаться в индексе. Обычно это:

  • главная;
  • записи;
  • категории;
  • страницы услуг или контента, если они есть;
  • отдельные важные архивы, если они действительно используются как посадочные.

После этого можно закрывать всё остальное точечно, а не «по ощущениям».

Шаг 2. Закройте архивы авторов и дат, если они не нужны

Если сайт ведётся одним автором, архив автора почти всегда дублирует ленту записей. Архивы дат тоже редко нужны в выдаче. В таком случае можно добавить noindex, follow для этих страниц через wp_head:

add_action('wp_head', function () {
    if (is_author() || is_date()) {
        echo '<meta name="robots" content="noindex, follow" />' . "\n";
    }
}, 1);

Этот вариант рабочий, но он не должен конфликтовать с SEO-плагином. Если плагин уже выводит robots meta, лучше управлять настройкой в одном месте, а не дублировать теги.

Шаг 3. Уберите теги из индекса, если они повторяют категории

Теги полезны не всегда. Если на сайте теги используются как «вторые категории», они часто создают тонкие страницы с тем же набором материалов. В этом случае лучше закрыть их от индексации и оставить только для внутренней навигации.

add_filter('wp_robots', function ($robots) {
    if (is_tag()) {
        $robots['noindex'] = true;
        $robots['follow'] = true;
    }
    return $robots;
});

Такой подход предпочтительнее, чем правка шаблона вручную, потому что он использует штатный фильтр WordPress для robots.

Шаг 4. Проверьте пагинацию архивов

Пагинация сама по себе не ошибка. Проблема возникает, когда в индекс попадают страницы /page/2/, /page/3/ и дальше, хотя они не несут самостоятельной ценности. На некоторых сайтах это нормально, на других — лишний шум.

Если вы решаете закрывать пагинацию, делайте это осознанно. Не стоит ломать навигацию для пользователя. Обычно безопаснее оставить пагинацию доступной, но не продвигать её как отдельные посадочные страницы. Для этого достаточно проверить canonical и robots, а не удалять ссылки из шаблона.

Проверка результата после внедрения

После правок не ограничивайтесь визуальной проверкой. Нужно убедиться, что поисковики видят именно то, что вы задумали.

  • Откройте архив автора или даты и проверьте наличие <meta name="robots" content="noindex, follow" />.
  • Убедитесь, что важные категории не получили случайный noindex.
  • Проверьте canonical на архивных страницах: он должен указывать на саму страницу, а не на случайный URL.
  • Посмотрите sitemap: там не должно быть страниц, которые вы закрыли от индексации.
  • Сделайте запрос site:example.com author и site:example.com /page/2/, чтобы увидеть, не всплывают ли старые URL.

Если используете Search Console, отправьте на повторную проверку только те URL, которые реально изменили статус. Массовая переиндексация без нужды обычно только мешает анализу.

Частые ошибки и как их исправить

Закрыли в robots.txt то, что нужно было убрать через noindex

Это распространённая путаница. Если страница уже закрыта в robots.txt, поисковик может не увидеть на ней meta robots и canonical. В результате URL может оставаться в индексе как «URL без описания». Для архивов и дублей чаще нужен именно noindex, а не запрет обхода.

Поставили noindex на всё подряд

Иногда после установки SEO-плагина закрывают и категории, и записи, и страницы пагинации, а потом удивляются падению видимости. Проверяйте, что noindex не затронул основные посадочные страницы и контентные разделы.

Дублируют robots meta плагином и кодом

Если один плагин выводит robots, а тема добавляет второй тег, поисковик может получить противоречивые сигналы. Оставьте один источник правды: либо настройки SEO-плагина, либо код в теме/мини-плагине.

Удалили архивы, но не обновили внутренние ссылки

Если вы отключили теги или авторские архивы, проверьте, не ведут ли на них меню, блоки «об авторе» и виджеты. Иначе пользователь будет попадать на страницы, которые вы сами считаете мусорными.

Безопасность и производительность: что учесть

Любые правки в functions.php лучше сначала делать в дочерней теме или в небольшом mu-plugin. Так вы не потеряете изменения после обновления темы. Перед внедрением проверьте код на тестовой копии сайта, особенно если у вас уже есть SEO-плагин, который управляет robots и sitemap.

Если сайт большой, не пытайтесь решать проблему через массовое удаление контента. Дубли в WordPress чаще лечатся настройкой индексации и структуры, а не чисткой базы данных. Удаление страниц без анализа может сломать перелинковку и дать больше вреда, чем пользы.

Для сайтов с большим количеством архивов и служебных страниц удобнее сначала зафиксировать правила в одном месте: какие типы архивов индексируются, какие закрываются, какие исключаются из sitemap. Это проще поддерживать, чем потом ловить случайные дубли по всему проекту.

Если после правок дубли всё ещё появляются, проверьте не только WordPress, но и серверные редиректы, кэш, CDN и настройки темы. Иногда проблема не в SEO-настройке, а в том, что один и тот же контент доступен по нескольким URL с разными параметрами или слешами.

Добавь в закладки и поделись с друзьями:

⭐⭐⭐⭐⭐
Как отключить дубли архивов в WordPress и не сломать индексацию
13.09.2026
Как отключить XML-карту сайта в WordPress без лишних побочных эффектов
16.09.2026
Как закрыть старые ответы 404 в WordPress и убрать мусор из индекса
22.09.2026
Как отключить XML-RPC в WordPress и не сломать нужные интеграции
19.09.2026
×
Сделай WordPress мощнее!

Скидка -20% на топовые премиум плагины

Выбрать плагин сейчас ⋙