Если в Search Console всплывают дубли страниц, а в индексе оказываются архивы тегов, авторов, дат и пагинации, проблема обычно не в «плохом SEO», а в том, что WordPress по умолчанию генерирует слишком много однотипных URL. На небольшом сайте это незаметно, но на контентном проекте такие страницы быстро размывают краулинговый бюджет и мешают поисковику понять, какие URL действительно важны.
Ниже — рабочая схема: сначала находим, какие архивы и служебные страницы реально создают мусор, затем отключаем или закрываем их точечно, а после проверяем, что каноникал, robots и индексация ведут себя ожидаемо.
Какие дубли в WordPress встречаются чаще всего
Обычно речь не про один источник, а про несколько одновременно. WordPress может отдавать:
- архивы автора, если на сайте один автор или авторские страницы не несут ценности;
- архивы дат, которые дублируют ленту новостей;
- пустые или слабые архивы рубрик и меток;
- страницы пагинации архивов;
- служебные страницы поиска, вложений и результатов фильтров;
- дубли с параметрами, если тема или плагин добавляют query string в URL.
Не все из них нужно удалять. Иногда достаточно закрыть от индексации, иногда — вообще убрать из генерации ссылок и карты сайта. Выбор зависит от того, есть ли у страницы самостоятельная ценность.
Диагностика: что именно создает дубли
Перед правками проверьте, какие URL уже попали в индекс и как они выглядят в выдаче. Для этого полезно смотреть не только Search Console, но и сам HTML страницы.
Что проверить руками
- Есть ли в индексе
/author/,/date/,/tag/и страницы пагинации/page/2/. - Не дублируются ли рубрики через разные пути: с / без слеша, с параметрами сортировки, с UTM в индексе.
- Есть ли у архивов корректный
rel="canonical". - Не попадают ли в sitemap страницы, которые вы не хотите индексировать.
Быстрая проверка через консоль
Если есть доступ к серверу, можно быстро посмотреть, какие архивы вообще доступны и как они отвечают:
curl -I https://example.com/author/admin/
curl -I https://example.com/date/2026/01/
curl -I https://example.com/tag/seo/
curl -I https://example.com/category/news/page/2/Ищите не только код ответа 200, но и заголовки, которые намекают на каноникализацию или запрет индексации. Если страница доступна, но должна быть скрыта, это еще не ошибка — вопрос в том, как она оформлена для поисковика.
Пошаговое решение: что отключать, а что оставлять
Универсального ответа нет, поэтому удобнее идти от ценности страницы. Если архив не нужен пользователю и не несет уникального контента, его лучше убрать из индекса или отключить совсем. Если страница полезна, но дублирует основной контент, обычно достаточно noindex и исключения из sitemap.
| Подход | Когда использовать | Плюс | Минус |
|---|---|---|---|
| Отключить генерацию | Страница не нужна вообще | Нет дубля в интерфейсе и индексе | Нужно аккуратно проверить шаблоны и ссылки |
| Noindex | Страница полезна пользователю, но не для поиска | Сохраняется навигация | URL остается доступным для обхода |
| Canonical на основную страницу | Есть явный дубль с параметрами или пагинацией | Сигнализирует поисковику приоритет | Не всегда решает проблему, если страница слишком слабая |
Вариант 1: закрыть архивы через SEO-плагин
Если у вас уже стоит SEO-плагин, проще всего использовать его настройки для архивов автора, дат и меток. Это безопаснее, чем править шаблоны вручную, если проект ведется не одним разработчиком. Важно не путать noindex с удалением из sitemap: иногда архив остается в карте сайта, и поисковик продолжает его активно обходить.
После изменения настроек проверьте:
- есть ли на странице мета-тег
noindex; - исчезла ли страница из XML sitemap;
- не остались ли внутренние ссылки на закрытые архивы в блоках темы.
Вариант 2: отключить архивы кодом
Если архивы автора или даты на сайте не нужны, их можно убрать на уровне WordPress. Это особенно полезно на сайтах с одним автором, где страница автора повторяет главную ленту.
<?php
add_action('template_redirect', function () {
if (is_author() || is_date()) {
wp_safe_redirect(home_url('/'), 301);
exit;
}
});Такой вариант подходит только если вы уверены, что эти архивы не используются в навигации и не нужны посетителям. Для многоавторского блога редирект всех авторских страниц на главную обычно плохая идея: лучше оставить страницу автора, но доработать ее контент и SEO-разметку.
Вариант 3: убрать архивы из sitemap
Если архив должен открываться, но не должен активно индексироваться, его лучше исключить из карты сайта. В WordPress это зависит от SEO-плагина или кастомной генерации sitemap. Смысл простой: поисковик не должен тратить лишний обход на страницы, которые вы сами считаете вторичными.
Если sitemap собирается вручную или через кастомный код, логика обычно строится на фильтрации URL перед выводом. Важно не удалять из карты сайта страницы, которые реально нужны для поиска и навигации, например важные рубрики или посадочные страницы.
Код для точечной очистки дублей в теме
Иногда проблема не в архиве как таковом, а в том, что тема добавляет лишние элементы: ссылки на автора, дату, метки, а также пагинацию там, где она не нужна. Тогда имеет смысл поправить шаблон вывода.
<?php
// Убираем ссылку на автора из метаданных записи, если сайт однопользовательский.
add_filter('the_author_posts_link', function ($link) {
if (count_users()['total_users'] === 1) {
return '';
}
return $link;
});Этот пример не универсален для всех тем, потому что некоторые темы выводят автора не через the_author_posts_link, а через собственные шаблонные функции. Но сама идея рабочая: если авторская страница не нужна, не провоцируйте на нее внутренние ссылки.
Если проблема в пагинации архивов
Пагинация сама по себе не ошибка. Ошибка начинается, когда страницы /page/2/, /page/3/ и дальше индексируются как самостоятельные дубль-страницы без ценности. В таком случае обычно оставляют их доступными для обхода, но закрывают от индексации или задают каноникал на первую страницу архива — в зависимости от структуры сайта и SEO-стратегии.
Если вы меняете поведение пагинации, проверьте, что не сломались:
- переходы между страницами архива;
- хлебные крошки;
- канонические URL;
- ссылки в sitemap и внутренних блоках.
Проверка результата после внедрения
После правок не ограничивайтесь открытием страницы в браузере. Нужно убедиться, что поисковик видит именно то, что вы задумали.
- Откройте страницу архива и проверьте исходный код на наличие
noindexили корректного canonical. - Проверьте HTTP-ответ через
curl -I, если настроили редирект. - Посмотрите XML sitemap: закрытые страницы не должны туда попадать.
- В Search Console отправьте URL на повторную проверку и посмотрите, изменился ли статус.
Если вы закрывали архивы через код, полезно проверить и фронт, и серверный ответ. Иногда тема продолжает выводить ссылку на закрытую страницу, и пользователь попадает на URL, который вы уже не хотите продвигать.
Частые ошибки и как их исправить
Закрыли страницу, но оставили ее в sitemap
Это самая частая ситуация. Поисковик видит противоречивые сигналы: в карте сайта URL есть, а в HTML стоит noindex. Исправление простое — синхронизировать настройки sitemap и мета-роботов.
Сделали 301 на главную для всех архивов
Такой редирект часто выглядит как быстрый способ «убрать дубли», но на практике он обнуляет полезные страницы и может ухудшить навигацию. Если архив реально нужен пользователю, не редиректите его без причины.
Поменяли canonical, но не убрали внутренние ссылки
Canonical — это подсказка, а не магическая кнопка. Если тема и блоки продолжают массово ссылаться на дубль, поисковик будет видеть его как важный URL. Сначала убирайте источник ссылок, потом настраивайте canonical.
Скрыли архивы, но не проверили пагинацию
Иногда закрывают первую страницу архива, а страницы /page/2/ остаются открытыми и продолжают индексироваться. Проверяйте всю цепочку, а не только корневой URL архива.
Что делать для безопасности и производительности
Любые изменения в шаблонах и функциях лучше вносить через дочернюю тему или небольшой mu-plugin, а не прямо в файлы родительской темы. Тогда обновление не сотрет правки. Перед изменениями сохраните резервную копию и проверьте сайт на staging, если он есть.
Если задача шире, чем точечное закрытие дублей, имеет смысл посмотреть на инструменты, которые помогают чистить служебные страницы, настраивать SEO-мета и убирать лишние архивы без ручного кода. Например, Clearfy Pro уместен как вспомогательный инструмент для технической чистки сайта: https://wpshop.ru/plugins/clearfy?utm_source=wpdetect.ru&utm_medium=article&utm_campaign=otklyuchit-dubl-archive-v-wordpress.
Как понять, что решение сработало
Считайте задачу решенной только тогда, когда совпали три вещи: закрытые URL больше не попадают в sitemap, в HTML или заголовках есть нужный сигнал для поисковика, а в Search Console снижается число дублей и страниц с низкой ценностью. Если хотя бы один из этих пунктов не выполнен, проблема обычно не в поисковике, а в неполной настройке на стороне WordPress.