Как закрыть дубли страниц от индексации в WordPress без поломки SEO

В WordPress дубли чаще всего появляются не из-за одной ошибки, а из-за набора мелких настроек: архивы тегов, страницы авторов, пагинация, параметры сортировки, версии с ?replytocom, а иногда и одинаковые материалы в категориях и на главной. Проблема в том, что поисковик видит несколько URL с почти одинаковым содержимым и начинает тратить обход на мусорные страницы вместо важных.

Ниже — рабочая схема, как найти такие дубли, закрыть лишнее от индексации и не сломать полезные страницы. Подход рассчитан на обычный WordPress-сайт без выдуманных плагинов и магии.

Как понять, что дубли уже есть

Сначала не трогайте настройки наугад. Сначала проверьте, какие URL реально доступны и индексируются. На практике дубли обычно проявляются так:

  • одна и та же статья открывается в нескольких адресах из-за категорий, тегов или параметров;
  • в индексе есть страницы тегов, которые повторяют ленту записей почти без добавленной ценности;
  • страницы пагинации /page/2/, /page/3/ дают мало смысла для поиска, но активно обходятся;
  • служебные страницы автора, архива дат или поиска попадают в выдачу;
  • в Search Console растёт число страниц, но не растёт число полезных посадочных.

Что проверить вручную

Откройте несколько типовых URL и сравните заголовок, canonical и содержимое:

  • запись в обычном виде;
  • архив категории;
  • архив тега;
  • страницу автора;
  • страницу пагинации;
  • URL с параметрами, если они есть.

Если title и основной контент почти совпадают, а страницы отличаются только оболочкой архива, это кандидат на закрытие от индексации или на canonical.

Какие страницы WordPress обычно стоит закрывать

Нет универсального списка для всех сайтов, но для большинства контентных проектов разумно начать с типовых служебных и малополезных архивов. Важно не путать noindex и удаление страницы: страница может оставаться доступной для пользователей, но не должна участвовать в поиске.

Тип страницыЧто делатьКомментарий
ТегиЧасто noindexЕсли теговые архивы не дают уникальной навигации, они редко нужны в индексе
Архивы автораЗависит от сайтаНа блоге с несколькими авторами могут быть полезны, на маленьком сайте — обычно нет
Архивы датОбычно noindexЧасто дублируют ленту и не несут самостоятельной ценности
Страницы поискаNoindex, followПоиск нужен пользователю, но не как посадочная для выдачи
Пагинация архивовОсторожноНе всегда нужно закрывать; зависит от структуры сайта и глубины архива

Пошаговое решение: как убрать дубли без лишнего риска

Шаг 1. Определите источник дублей

Если у вас установлен SEO-плагин, сначала посмотрите, не создаёт ли он отдельные правила для архивов. Если плагина нет, проверьте тему и кастомный код: иногда разработчики добавляют лишние архивы или выводят одинаковый контент в нескольких шаблонах.

Для быстрой диагностики удобно использовать поиск по сайту и проверку исходного кода страницы. Ищите:

  • <link rel="canonical";
  • meta name="robots";
  • повторяющиеся title и description;
  • страницы с одинаковым основным текстом, но разными URL.

Шаг 2. Закройте служебные архивы через SEO-плагин или код

Если у вас есть SEO-плагин, используйте его настройки для тегов, авторов, дат и поиска. Это проще поддерживать, чем разносить логику по теме. Если нужен код, можно добавить фильтр в functions.php дочерней темы или в небольшой mu-plugin.

<?php
add_action('wp_head', function () {
    if (is_tag() || is_date() || is_author() || is_search()) {
        echo '<meta name="robots" content="noindex,follow" />' . "\n";
    }
}, 1);

Этот вариант рабочий, но применять его стоит только если вы понимаете, что SEO-плагин не делает того же самого. Иначе получите дублирующиеся meta robots.

Шаг 3. Настройте canonical для похожих страниц

Если страница существует в нескольких вариантах, canonical помогает поисковику выбрать основной адрес. Это особенно полезно для URL с параметрами сортировки, фильтрации или UTM-параметрами, которые не должны становиться отдельными страницами в индексе.

В WordPress canonical часто уже выводится ядром или SEO-плагином. Если вы пишете свою логику, не подменяйте canonical без необходимости. Лучше менять его только для конкретных шаблонов или параметров.

<?php
add_filter('get_canonical_url', function ($canonical, $post) {
    if (is_singular('post') && !empty($canonical)) {
        return $canonical;
    }
    return $canonical;
}, 10, 2);

Здесь пример скорее как точка расширения: сам по себе фильтр не решает проблему дублей, но показывает, где безопасно вмешиваться, если у вас есть нестандартная логика.

Шаг 4. Уберите лишние архивы из карты сайта

Если страница закрыта от индексации, она не должна продолжать активно светиться в sitemap без причины. Иначе вы сами подсказываете поисковику, что этот URL важен. В SEO-плагине проверьте, не попадают ли туда теги, авторы, архивы дат и служебные страницы.

Если sitemap генерируется кодом, исключайте лишние типы контента на уровне генератора, а не через robots.txt. Robots.txt не убирает URL из индекса, если он уже найден и связан с другими страницами.

Когда лучше не закрывать страницу полностью

Иногда теговый или авторский архив действительно полезен. Например, если у вас крупный сайт с редакцией, где авторские страницы помогают навигации и имеют уникальное описание, закрывать их без анализа не стоит. То же самое касается категорий: если категория — это полноценная тематическая посадочная с собственным текстом, хлебными крошками и подборкой материалов, она может быть полезнее, чем отдельная запись в выдаче.

Правило простое: если архив отвечает на отдельный пользовательский запрос и не повторяет ленту почти дословно, его можно оставить открытым. Если это просто копия списка записей с другим заголовком — закрывайте.

Проверка результата после внедрения

После изменений не ориентируйтесь только на визуальный осмотр. Проверьте три вещи: код страницы, доступность URL и статус в поисковой системе.

  • Откройте закрытую страницу и убедитесь, что в исходнике есть meta robots с noindex,follow или нужное вам правило.
  • Проверьте canonical: он должен вести на основной URL, а не на параметрическую версию.
  • Убедитесь, что страница не исчезла для пользователей и не сломала навигацию.
  • В Search Console отправьте проверку URL и посмотрите, как робот видит страницу.
  • Через несколько обходов сравните число проиндексированных служебных страниц и количество ошибок обхода.

Если после правок в индексе всё ещё остаются старые URL, это не всегда проблема. Поисковику нужно время, чтобы переобойти сайт и пересчитать сигналы.

Частые ошибки и как их исправить

Ставят noindex и одновременно закрывают в robots.txt

Это частая ошибка. Если страница закрыта в robots.txt, поисковик может не увидеть meta robots и canonical на самой странице. В итоге URL может продолжать жить в индексе как «запрещённый к сканированию», но не обязательно исчезнет быстро. Обычно лучше сначала дать роботу увидеть noindex, а уже потом решать, нужен ли запрет сканирования.

Закрывают всё подряд, включая полезные категории

Так можно случайно убрать из поиска страницы, которые реально собирают трафик. Перед массовым закрытием проверьте, есть ли у архива уникальный текст, внутренние ссылки и собственный поисковый спрос.

Дублируют правила в плагине и в теме

Если SEO-плагин уже выводит canonical и robots, а вы добавляете то же самое через wp_head, получите конфликтующие сигналы. Поисковик обычно переживает это, но диагностировать потом неудобно. Оставьте один источник правды.

Считают, что удаление из sitemap решает всё

Нет. Sitemap — это подсказка, а не запрет. Если URL уже связан внутренними ссылками, он может продолжать индексироваться. Для дублей нужен либо noindex, либо canonical, либо переработка структуры ссылок.

Практические советы по безопасности и производительности

Если вы добавляете собственный код, не правьте ядро и не вносите изменения в родительскую тему. Используйте дочернюю тему или mu-plugin, чтобы не потерять настройки после обновления. Для сайтов с несколькими редакторами полезно документировать, какие типы архивов закрыты и почему — иначе через месяц кто-то снова включит их в SEO-плагине.

Если дублей много, полезно сначала убрать причину на уровне структуры: сократить число тегов, пересмотреть категории, отключить лишние архивы в теме, убрать параметры, которые создают отдельные URL без смысла. Это обычно даёт более чистый результат, чем бесконечная раздача noindex.

Для частой чистки дублей и служебных страниц можно посмотреть Clearfy Pro: у него есть инструменты для отключения лишних элементов WordPress и управления техническим мусором, что удобно как стартовая точка для аудита https://wpshop.ru/plugins/clearfy.

Если нужен быстрый рабочий порядок действий, он обычно такой: найти тип дубля, проверить canonical и robots, закрыть только лишнее, убрать URL из sitemap и затем перепроверить индексацию. В WordPress именно последовательность важнее, чем сам набор инструментов.

Как удалить ненужные шорткоды в WordPress без ошибок
03.09.2026
Как удалить пустые мета данные в WordPress для оптимизации базы данных
28.09.2026
Как найти и убрать дубли страниц в WordPress без потери индексации
15.08.2026
Как отключить XML-RPC в WordPress без поломки сайта
24.09.2026
Как автоматизировать обновление тем и плагинов в WordPress без рисков
28.09.2026

Ниже мы подобрали самые актуальные материалы по Вордпресс