Как убрать дубли страниц в WordPress из-за архивов тегов, авторов и дат

Если в Search Console растут страницы-дубли, а в индексе всплывают архивы тегов, авторов и дат, проблема обычно не в «плохом SEO», а в стандартной структуре WordPress. Сайт сам генерирует много однотипных URL: записи, рубрики, теги, архивы по датам, страницы автора, пагинацию. Для небольшого проекта это часто лишний шум, который размывает релевантность и усложняет индексацию.

Ниже — рабочая схема: как диагностировать источник дублей, что закрывать, что оставлять, и как проверить, что после правок поисковик видит именно нужные страницы.

Какие дубли в WordPress встречаются чаще всего

Сначала важно понять, что именно считать дублем. Не каждый архив нужно удалять из индекса. Проблема возникает, когда одна и та же смысловая группа доступна по нескольким URL без явной пользы для пользователя.

Типовые источники дублей

  • архивы тегов, которые повторяют рубрики или почти не отличаются по содержанию;
  • страницы автора на сайтах с одним автором;
  • архивы по датам, если сайт не новостной и дата не несёт самостоятельной ценности;
  • служебные страницы пагинации, если они индексируются отдельно и создают лишний объём;
  • страницы вложений медиафайлов, которые дублируют контент записи;
  • страницы поиска и фильтров, если они попадают в индекс.

На практике чаще всего достаточно не «удалять всё подряд», а аккуратно закрыть от индексации то, что не должно конкурировать с основными посадочными страницами.

Диагностика: где искать проблему

Начните не с плагинов, а с проверки индекса. Откройте Google Search Console и посмотрите отчёты по страницам: какие URL попадают в индекс, какие отмечены как дубли, а какие выбраны как канонические. Дальше сопоставьте это с реальной структурой сайта.

Полезно пройтись по таким признакам:

  • в выдаче есть страницы вида /tag/..., /author/..., /2024/05/;
  • одна и та же статья доступна с разными параметрами или через архивы;
  • внутренние ссылки ведут и на запись, и на её архивные копии;
  • в sitemap попадают страницы, которые вы не хотите продвигать;
  • в отчёте «Страницы» растёт число URL без трафика и без смысла для пользователя.

Если у вас есть доступ к серверным логам или аналитике, посмотрите, не тратит ли бот crawl budget на архивы и служебные страницы. Для небольших сайтов это не критично, но на больших проектах лишние URL быстро становятся проблемой.

Что закрывать, а что оставлять

Здесь нет универсального ответа. Логика простая: индексировать нужно то, что может ранжироваться как самостоятельная посадочная страница. Всё остальное — под вопросом.

Тип страницыОставить в индексеКомментарий
РубрикиДа, если это полноценные тематические разделыИмеют смысл как посадочные страницы
ТегиЧасто нетОсобенно если тегов много и они дублируют рубрики
Архивы автораОбычно нет на сайтах с одним авторомНа мультиавторных проектах решение зависит от структуры
Архивы по датамЧаще нетПолезны в новостях и хрониках, но не в обычном блоге
Страницы вложенийНетОбычно это пустые или почти пустые страницы
Поиск и фильтрыНетНе должны конкурировать с контентом

Пошаговое решение без лишнего риска

Если нужен быстрый и предсказуемый путь, удобнее всего использовать SEO-плагин, который умеет управлять индексированием архивов и служебных страниц. Например, в Clearfy Pro есть инструменты для чистки сайта и удаления дублей, если вам нужен практический контроль над типовыми проблемами WordPress. Но даже с плагином важно понимать, что именно вы меняете.

Шаг 1. Закройте от индексации ненужные архивы

В админке WordPress или в SEO-плагине отключите индексацию:

  • архивов тегов, если они не несут самостоятельной ценности;
  • архивов автора на сайтах с одним автором;
  • архивов по датам, если они не нужны для поиска;
  • страниц вложений;
  • служебных страниц поиска.

Если плагин позволяет, не просто ставьте noindex, а ещё убирайте такие URL из sitemap. Это снижает шанс, что поисковик продолжит их активно обходить.

Шаг 2. Настройте канонические URL

Для страниц, которые могут существовать в нескольких вариантах, проверьте тег rel="canonical". WordPress и SEO-плагины обычно умеют ставить его автоматически, но после правок структуры лучше убедиться, что каноникал указывает на основную версию записи, а не на архив или параметризованный URL.

Шаг 3. Уберите вложения из индекса

Если медиафайлы открываются как отдельные страницы, чаще всего это лишний слой дублей. Для вложений лучше делать редирект на родительскую запись или отключать их индексацию. Это особенно полезно для сайтов, где изображения массово попадают в поиск.

Шаг 4. Проверьте sitemap

После настройки откройте XML-карту сайта и убедитесь, что там нет мусорных URL. Если в sitemap остаются теги, архивы или вложения, поисковик будет получать противоречивый сигнал: с одной стороны вы закрыли страницу, с другой — явно предложили её к обходу.

Решение кодом: когда плагина недостаточно

Если нужен точечный контроль, часть задач можно решить через functions.php дочерней темы или через небольшой mu-plugin. Такой подход полезен, когда вы хотите отключить конкретный тип архивов без лишних настроек в админке.

<?php
// Отключаем архивы автора на сайте с одним автором.
add_action('template_redirect', function () {
    if (is_author()) {
        wp_redirect(home_url('/'), 301);
        exit;
    }
});

// Закрываем страницы вложений и отправляем на родительскую запись.
add_action('template_redirect', function () {
    if (is_attachment()) {
        $parent_id = get_post_field('post_parent', get_queried_object_id());
        if ($parent_id) {
            wp_redirect(get_permalink($parent_id), 301);
            exit;
        }
        wp_redirect(home_url('/'), 301);
        exit;
    }
});

Этот вариант не заменяет SEO-настройки, но помогает убрать самые бесполезные URL на уровне поведения сайта. Если используете редиректы, проверяйте, чтобы не было цепочек и циклов.

Как проверить, что решение сработало

Проверка нужна не только в браузере. Сначала убедитесь, что URL реально закрыт или перенаправлен, потом — что поисковик получил правильный сигнал.

  • откройте проблемный URL и проверьте код ответа: 200, 301 или noindex;
  • посмотрите исходный код страницы и найдите rel="canonical";
  • проверьте XML sitemap: закрытых страниц там быть не должно;
  • в Search Console отправьте страницу на повторную проверку, если она уже была в индексе;
  • через несколько дней сравните отчёт по индексированию и число дублей.

Для быстрой диагностики можно использовать curl:

curl -I https://example.com/author/admin/
curl -I https://example.com/tag/seo/

Если вы ожидаете редирект, в ответе должен быть 301 и новый Location. Если ожидаете закрытие от индексации, проверьте наличие noindex в мета-теге или в заголовках, если плагин использует именно такой способ.

Частые ошибки и как их исправить

Ставят noindex, но оставляют страницу в sitemap

Это одна из самых частых ошибок. Поисковик получает противоречивые сигналы и продолжает тратить ресурсы на обход. Решение: убрать URL из карты сайта и проверить, что он не генерируется в других местах.

Закрывают всё подряд, включая полезные рубрики

Иногда под нож попадают не только теги, но и рубрики, которые реально собирают тематический трафик. Перед отключением проверьте, есть ли у архива уникальный текст, нормальная структура и внутренняя перелинковка.

Делают 302 вместо 301

Если страница должна исчезнуть из индекса навсегда, временный редирект не лучший выбор. Для постоянного переноса используйте 301.

Оставляют страницы вложений без родителя

Если у изображения нет родительской записи, редиректить его некуда. В таком случае лучше отправлять на главную или закрывать от индексации, но не оставлять пустую страницу в открытом доступе.

Путают каноникал и редирект

rel="canonical" не убирает страницу из доступа, а только подсказывает поисковику основную версию. Если URL не должен существовать для пользователя, нужен редирект или закрытие от индексации, а не только каноникал.

Что ещё стоит проверить после чистки дублей

Когда базовая структура уже приведена в порядок, посмотрите на соседние технические проблемы. Часто вместе с дублями всплывают:

  • лишние параметры в URL;
  • дубли заголовков title и h1;
  • пустые или слабые архивы;
  • медленные страницы категорий;
  • ошибки в хлебных крошках;
  • неаккуратная пагинация.

Если вам нужен более системный подход к чистке сайта и SEO-настройкам, имеет смысл смотреть не только на отдельные правки, но и на общую конфигурацию WordPress: что индексируется, что закрыто, какие архивы реально работают на трафик, а какие только создают шум.

В итоге задача сводится не к «убрать всё лишнее», а к тому, чтобы у поисковика осталась одна понятная версия каждой важной страницы и не было конкуренции между техническими копиями одного и того же контента.

Как убрать дубли страниц в WordPress из-за архивов тегов, авторов и дат
30.08.2026