Как отключить индексацию архивов таксономий в WordPress без потери полезных страниц

Архивы рубрик и тегов часто создают лишние страницы в индексе: часть из них дублирует контент, часть выглядит как тонкие страницы без ценности для поиска. Но отключать всё подряд нельзя — у некоторых таксономий есть реальная поисковая польза, особенно если архивы вручную наполнены описанием и ведут на тематическую подборку материалов.

Ниже разберём, как понять, какие архивы таксономий стоит закрыть от индексации, как сделать это через код и SEO-плагин, и как проверить, что поисковики действительно перестали считать такие страницы полезными для индекса.

Когда архивы таксономий мешают SEO

Проблема обычно проявляется не в одной странице, а в серии похожих URL. Например, у сайта есть десятки тегов, но на каждом архиве по 1–2 записи. В результате поисковик видит много слабых страниц, а не концентрируется на основных материалах. Ещё один типичный сценарий — архивы рубрик дублируют подборки из главного меню, хлебных крошек или блока связанных материалов.

Есть и обратная ситуация: рубрика с нормальным описанием, уникальной структурой и десятками материалов может быть полезной посадочной страницей. Поэтому решение лучше принимать по типу таксономии, а не по принципу «закрыть всё, что архив».

Что обычно стоит проверить в первую очередь

  • сколько записей в каждой рубрике или теге;
  • есть ли у архива уникальный заголовок и описание;
  • не дублирует ли архив уже существующую страницу категории или раздела;
  • попадает ли архив в sitemap;
  • есть ли у него входящие внутренние ссылки;
  • не создаёт ли плагин SEO отдельный canonical, который указывает на сам архив.

Диагностика: какие архивы реально индексируются

Перед изменениями полезно посмотреть, что уже находится в индексе. Самый простой способ — поиск по оператору site: и фильтрация по URL таксономий. Если у вас стандартные рубрики и теги, адреса обычно выглядят как /category/ и /tag/, но в WordPress они могут быть переименованы.

В панели Google Search Console стоит открыть отчёт по страницам и посмотреть, какие URL попадают в индекс, а какие исключены. Если архивы таксономий там уже отмечены как дубли или страницы с альтернативным canonical, это хороший сигнал, что закрытие от индексации не ухудшит ситуацию.

Для быстрой проверки на самом сайте можно посмотреть HTML исходник архива и найти мета-тег robots. Если там уже стоит noindex, возможно, проблема не в индексации, а в том, что архивы продолжают попадать в sitemap или внутренние ссылки.

Пошаговое решение через код

Если нужно управлять индексацией без зависимости от интерфейса SEO-плагина, можно задать noindex для выбранных таксономий через фильтр wp_robots. Это штатный механизм WordPress, который добавляет директивы в robots meta.

Ниже пример: закрываем от индексации архивы тегов, но оставляем рубрики открытыми. Такой подход удобен, если рубрики у вас — основная структура сайта, а теги используются только для внутренней навигации.

<?php
add_filter( 'wp_robots', function( array $robots ) {
    if ( is_tag() ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Если нужно закрыть конкретную рубрику, а не всю таксономию, лучше проверять term ID или slug. Так вы не сломаете SEO полезных разделов.

<?php
add_filter( 'wp_robots', function( array $robots ) {
    if ( is_category( 'news' ) ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Такой код лучше добавлять в дочернюю тему или в небольшой mu-plugin, если вы не хотите потерять настройку после обновления темы.

Если используете SEO-плагин

В большинстве случаев проще и безопаснее настроить индексацию в SEO-плагине, если он уже отвечает за sitemap, canonical и robots. Тогда не будет конфликта между кодом темы и настройками плагина. Важно не задавать noindex одновременно в двух местах, иначе потом сложно понять, откуда именно берётся директива.

ПодходКогда подходитМинус
SEO-плагинЕсли уже используется для sitemap и robotsЗависимость от интерфейса и настроек плагина
Код через wp_robotsЕсли нужен точечный контрольНужно аккуратно поддерживать код
Оставить индексируемымиЕсли архивы реально полезны как посадочные страницыРиск дублей и тонких страниц

Как не сломать полезные архивы

Не все таксономии одинаковы. Если в рубрике есть уникальное описание, несколько десятков материалов и понятная структура, закрывать её от индексации не всегда разумно. В таком случае лучше не ставить noindex, а улучшить страницу: добавить текст, убрать мусорные элементы, проверить canonical и сделать нормальную перелинковку.

Для тегов ситуация обычно обратная. Если тегов много, а страницы пустые, их часто выгоднее закрыть от индексации и оставить только для навигации внутри сайта. Это снижает шум в индексе и помогает поисковику быстрее обходить действительно важные страницы.

Проверка результата после внедрения

После изменения не ограничивайтесь просмотром исходного кода. Нужно убедиться, что директива дошла до поисковика и не конфликтует с sitemap или canonical.

  • откройте архив таксономии и проверьте наличие <meta name="robots" content="noindex,follow"> или эквивалентной директивы;
  • посмотрите, не осталась ли страница в XML sitemap;
  • проверьте canonical: он должен указывать на саму страницу, если вы не делаете отдельную схему каноникализации;
  • в Search Console отправьте URL на повторную проверку;
  • через несколько дней сравните статус страницы в отчёте по индексированию.

Если архив всё ещё индексируется, причина может быть не в robots meta, а в том, что поисковик ещё не переобошёл страницу. В этом случае помогает только время и повторная проверка через Search Console.

Частые ошибки и как их исправить

Закрыли от индексации нужные рубрики

Это происходит, когда правило написано слишком широко, например для всех архивов таксономий сразу. Исправление простое: сузьте условие до конкретных тегов или отдельных рубрик, которые действительно не нужны в поиске.

Оставили страницу в sitemap

Если URL продолжает попадать в sitemap, поисковик получает противоречивые сигналы. Для закрытых архивов их лучше исключить из карты сайта на уровне SEO-плагина или фильтра генерации sitemap.

Поставили noindex, но не убрали внутренние ссылки

Это не критическая ошибка, но если таких ссылок слишком много, вы продолжаете тратить краулинговый бюджет на слабые страницы. Проверьте блоки тегов, виджеты и хлебные крошки.

Смешали код темы и настройки плагина

Когда robots meta задаётся и в коде, и в плагине, итоговый HTML может стать непредсказуемым. Оставьте один источник правды: либо плагин, либо код.

Практические советы по безопасности и производительности

Если вы вносите изменения через код, не редактируйте основную тему напрямую. Используйте дочернюю тему или mu-plugin, чтобы настройка не исчезла после обновления. Перед правкой сделайте резервную копию и проверьте изменения на staging-копии, если сайт уже получает трафик из поиска.

Для больших сайтов полезно сначала собрать список таксономий, которые реально имеют поисковую ценность, и только потом закрывать остальные. Такой подход лучше, чем массово ставить noindex на всё подряд и потом вручную откатывать последствия.

Если вам нужна более широкая чистка дублей и технических страниц, иногда удобнее использовать специализированный SEO-инструмент вроде Clearfy Pro: он помогает управлять дублями, архивами и частью технических настроек без разрозненных правок в коде. Но даже в этом случае логику индексации лучше проверять вручную, а не полагаться только на галочки в интерфейсе.

⭐⭐⭐⭐⭐