Как убрать дубли страниц авторов и пагинации в WordPress без потери нужных URL в индексе

Если в Search Console всплывают страницы вида /author/, /page/2/, /feed/ или дубли архивов с одинаковыми заголовками и сниппетами, проблема обычно не в «плохом SEO», а в стандартной структуре WordPress. Сайт сам генерирует больше URL, чем реально нужно для поиска. Задача не в том, чтобы всё закрыть подряд, а в том, чтобы оставить в индексе полезные страницы и убрать мусорные варианты.

Что именно считать дублем в WordPress

На практике дубли чаще всего появляются в трёх местах: архивы авторов, пагинация архивов и служебные страницы, которые повторяют контент без самостоятельной ценности. Если у сайта один редактор или несколько авторов, но страницы авторов пустые, индексировать их обычно нет смысла. То же касается страниц /page/2/ и дальше, если они не дают уникального контекста и только размазывают сигналы.

Типичные симптомы

  • в индексе есть страницы архивов, которые не приносят трафик;
  • в отчётах видны дубли title и description у архивов;
  • поиск показывает несколько версий одной и той же категории или автора;
  • боты тратят краулинговый бюджет на второстепенные URL;
  • в выдаче всплывают страницы пагинации вместо основной категории.

Диагностика: что проверить до правок

Сначала нужно понять, какие именно URL реально мешают. Не стоит сразу ставить noindex на всё подряд: иногда архив автора полезен, если это сильная экспертная рубрика с заполненным профилем и уникальным описанием. Но если архив пустой или дублирует ленту записей, его лучше убрать из индекса.

Проверка в Search Console и на сайте

  • откройте отчёт по страницам с исключением и найдите URL с пометками про дубли, альтернативные канонические URL или сканирование, но не индексирование;
  • проверьте, есть ли у архивов авторов уникальный текст, а не только список записей;
  • сравните title и H1 у основной страницы архива и её пагинации;
  • посмотрите исходный код: есть ли rel="canonical" на правильный URL;
  • проверьте robots.txt и мета-теги: иногда конфликт возникает из-за одновременного Disallow и noindex.

Как закрыть архивы авторов и пагинацию: рабочая схема

Есть три подхода: плагин, код в теме или дочерней теме, и компромиссный вариант через SEO-плагин. Если нужен быстрый и управляемый результат, проще всего использовать SEO-плагин с настройками индексации архивов. Если нужна точечная логика, удобнее добавить фильтры в код.

ПодходКогда подходитПлюсыМинусы
SEO-плагинНужно быстро закрыть архивы без разработкиПросто, безопасно, легко откатитьМеньше гибкости, зависит от интерфейса плагина
Код в темеНужна точная логика для авторов и пагинацииПолный контроль, без лишних настроекНужно тестировать после обновлений темы
Комбинированный вариантЧасть URL закрыть настройками, часть — кодомБаланс удобства и контроляРиск конфликтов, если правила заданы в двух местах

Вариант через код: убрать архивы авторов из индекса

Если у вас один автор или архивы авторов не несут ценности, можно добавить noindex и убрать их из карты сайта через фильтры. Пример ниже рассчитан на установку в дочернюю тему или в небольшой mu-plugin.

<?php
add_filter('wp_robots', function ($robots) {
    if (is_author()) {
        $robots['noindex'] = true;
        $robots['nofollow'] = true;
    }

    return $robots;
});

add_filter('wp_sitemaps_post_types', function ($post_types) {
    // Если архивы авторов не нужны, их лучше не тащить в sitemap через отдельную логику SEO-плагина.
    return $post_types;
});

Первый фильтр добавляет директивы для страниц авторов. Второй блок здесь показан как напоминание: карту сайта обычно контролирует SEO-плагин, а не ядро WordPress. Если у вас Yoast, Rank Math или аналог, отключайте архивы авторов именно в их настройках, а не через случайные хаки.

Пагинация архивов: не путать с пагинацией каталога

Страницы /page/2/ и дальше не всегда нужно закрывать. Если это пагинация категории с большим количеством материалов, она может быть полезной для обхода. Но если у вас пустые архивы, слабые рубрики или страницы пагинации дублируют title и description, их лучше сделать noindex, follow. Так бот сможет пройти по ссылкам, но страница не будет конкурировать с основной.

<?php
add_filter('wp_robots', function ($robots) {
    if (is_paged() && (is_category() || is_tag() || is_archive())) {
        $robots['noindex'] = true;
        $robots['follow'] = true;
    }

    return $robots;
});

Здесь важно не переборщить: условие is_archive() широкое, и его нужно применять только если вы понимаете, какие архивы попадут под правило. Для живого проекта лучше сузить логику до конкретных таксономий или типов архивов.

Если нужен быстрый путь без кода

Когда задача типовая, удобнее закрыть дубли через SEO-плагин и не трогать шаблоны. Например, в Clearfy Pro есть инструменты для чистки сайта и удаления лишних дублей, а также настройки, которые помогают убрать из индекса служебные страницы и лишние архивы. Это полезно, если вы не хотите держать отдельный код для каждой мелочи и предпочитаете управлять индексированием из админки.

Но даже в этом случае проверьте, что плагин не конфликтует с уже добавленными фильтрами темы. Две разные системы могут одновременно менять canonical, robots и sitemap, и тогда результат будет хуже, чем без правок.

Пошаговое внедрение без поломки индексации

  1. Составьте список URL, которые нужно убрать из индекса: архивы авторов, пагинация, пустые таксономии, служебные страницы.
  2. Проверьте, есть ли на них трафик и внешние ссылки. Если есть, не закрывайте их бездумно.
  3. Выберите один способ управления: SEO-плагин или код. Не дублируйте правила в двух местах.
  4. Добавьте noindex только там, где страница не должна конкурировать в поиске.
  5. Убедитесь, что важные страницы остаются в sitemap и доступны по canonical.
  6. После публикации изменений отправьте на переобход только ключевые URL, а не весь сайт.

Как проверить, что решение сработало

Проверка нужна не только в коде, но и в поиске. Сначала откройте исходный код страницы автора или пагинации и убедитесь, что там появился нужный meta robots. Затем проверьте canonical: он должен указывать на правильную основную страницу, а не на случайный архив или первую страницу пагинации.

Что смотреть после внедрения

  • в HTML есть noindex для закрытых архивов;
  • canonical ведёт на основную страницу, если это предусмотрено логикой;
  • закрытые URL постепенно уходят из индекса;
  • в отчётах Search Console уменьшается число дублей и альтернативных страниц;
  • основные категории и записи не потеряли видимость.

Если страница всё ещё индексируется, не делайте вывод по одному дню. Поисковику нужно время, чтобы пересканировать URL и обновить статус. Но если спустя несколько обходов ничего не меняется, проверьте, не блокирует ли robots.txt саму страницу раньше, чем поисковик увидит noindex.

Частые ошибки и как их исправить

Закрыли URL в robots.txt и ждёте, что он выпадет из индекса

Если страница уже в индексе, один только Disallow не гарантирует удаление. Поисковик может не увидеть мета-тег noindex, потому что вы сами запретили обход. В таких случаях сначала дайте роботу доступ к странице, затем примените noindex, а уже потом при необходимости ограничивайте обход.

Поставили noindex на всё подряд

Это частая ошибка после установки SEO-плагина или копирования чужого сниппета. В итоге в индексе исчезают не только архивы, но и полезные категории, страницы авторов с экспертным контентом или пагинация, которая помогает обходу. Всегда проверяйте условия: is_author(), is_paged(), конкретные таксономии и типы записей.

Не обновили sitemap

Если закрытые страницы продолжают попадать в карту сайта, поисковик будет тратить время на их повторное сканирование. После изменения правил индексации проверьте sitemap и исключите из него то, что больше не должно продвигаться.

Конфликт canonical и noindex

Когда canonical указывает на одну страницу, а robots говорит noindex для другой, это нормально только если логика выстроена осознанно. Если же canonical ведёт на несуществующий или нерелевантный URL, поисковик может игнорировать ваши подсказки. Проверяйте canonical в исходнике и в инструменте проверки URL в Search Console.

Практические советы по безопасности и производительности

Любые правки лучше держать в дочерней теме или в отдельном mu-plugin, а не в файлах основной темы. Тогда обновление шаблона не сотрёт вашу логику. Если вы добавляете фильтры через functions.php, делайте это только после резервной копии и с возможностью быстрого отката.

Для производительности полезно не только убрать дубли из индекса, но и сократить лишние запросы к архивам. Если архивы авторов не используются, можно отключить их отображение в шаблоне и не выводить ссылки на них в навигации. Это уменьшит число бесполезных переходов и упростит структуру сайта для пользователей и ботов.

Если нужен более системный подход к чистке дублей и технических хвостов, имеет смысл посмотреть в сторону Clearfy Pro: он закрывает часть типовых задач без ручного кода. Но даже с плагином полезно понимать, какие именно URL вы закрываете и почему. Иначе легко спрятать проблему, а не решить её.

В итоге рабочая схема простая: сначала находите конкретные дубли, потом выбираете один способ управления, затем проверяете canonical, robots и sitemap. Если держать эти три точки под контролем, WordPress перестаёт плодить лишние URL и не мешает индексации нормальных страниц.

Как закрыть старые 404 после смены структуры URL в WordPress
08.09.2026
Как убрать дубли страниц авторов и пагинации в WordPress без потери нужных URL в индексе
30.08.2026
Как отключить XML-RPC в WordPress и не сломать Jetpack, мобильные приложения и внешние сервисы
03.09.2026
Как закрыть дубли страниц тегов и архивов в WordPress без потери нужных страниц в индексе
27.08.2026
Как убрать бесконечные редиректы в WordPress и найти их источник
12.09.2026
×

AI-плагин от WPShop.ru

анализирует конкурентов

пишет статьи

готовит SEO

генерирует изображения

и еще кое-что...
WPGPT
Плагин, который наполняет ваш сайт WordPress
Узнать больше