Как исключить страницы архива из индексации в WordPress

Архивы в WordPress часто становятся источником лишних URL в индексе: архивы рубрик, меток, дат, авторов, форматы записей и страницы пагинации. Проблема обычно не в самом архиве, а в том, что он не несет самостоятельной ценности для поиска, но при этом создает дубли, размазывает релевантность и тратит краулинговый бюджет.

Если у вас уже настроены теговые страницы, поиск, авторы и старые URL, следующий логичный шаг — разобрать именно архивы. Здесь важно не «закрыть всё подряд», а понять, какие типы архивов нужны пользователю, а какие лучше оставить доступными только для навигации.

Когда архивы нужно закрывать от индексации

Не каждый архив в WordPress нужно убирать из поиска. Например, рубрика с сильной тематической структурой может приносить трафик и быть полезной посадочной страницей. А вот архивы по датам, пустые рубрики, технические таксономии и страницы пагинации часто только создают шум.

Типичные признаки проблемы

  • в Google Search Console много URL вида /category/, /tag/, /author/, /2024/05/;
  • в индексе есть страницы архивов без уникального текста и без спроса;
  • одна и та же статья доступна через несколько архивов и пагинацию;
  • поисковик показывает архив вместо нужной записи или рубрики;
  • в отчетах по сканированию растет число «обнаружено, но не проиндексировано» для служебных URL.

Если архив нужен только для внутренней навигации, его обычно имеет смысл закрыть от индексации, но оставить доступным для обхода ссылок. Это важная разница: noindex не равно запрету на сканирование через robots.txt.

Какие варианты есть: плагин, код или SEO-настройка

На практике есть три рабочих подхода. Выбор зависит от того, насколько тонко вы хотите управлять индексацией и есть ли у вас SEO-плагин.

ПодходКогда подходитПлюсыМинусы
SEO-плагинНужно быстро закрыть архивы без правки темыПросто, безопасно для редактораНе всегда удобно для нестандартных архивов
Код в теме или плагинеНужен точечный контрольГибко, без лишних зависимостейНужно аккуратно тестировать
КомбинацияЧасть архивов оставить, часть закрытьЛучше всего для реальных проектовТребует дисциплины в настройках

Если у вас уже стоит SEO-плагин, сначала проверьте его настройки. Если нет — проще и надежнее сделать это кодом через фильтр wp_robots или через add_action( 'wp_head' ... ), но только для тех архивов, которые действительно нужно закрыть.

Пошаговое решение через код

Самый предсказуемый способ — добавить условную директиву noindex,follow для архивных страниц, которые не должны попадать в индекс. Для этого лучше использовать отдельный мини-плагин или mu-plugin, а не править functions.php активной темы.

Пример: закрыть архивы дат и авторов

<?php
/**
 * Plugin Name: Archive Noindex Rules
 */

add_filter( 'wp_robots', function( array $robots ) {
    if ( is_date() || is_author() ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Этот вариант работает на уровне стандартного механизма WordPress и не требует ручной вставки meta-тега в шаблон. Для большинства современных тем этого достаточно.

Если нужно закрыть только страницы пагинации архивов

Иногда сам архив полезен, но его страницы /page/2/, /page/3/ и дальше не нужны в индексе. Тогда условие нужно строить точнее.

<?php
add_filter( 'wp_robots', function( array $robots ) {
    if ( is_paged() && ( is_category() || is_tag() || is_tax() || is_post_type_archive() ) ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Такой подход полезен, если первая страница архива должна индексироваться, а последующие — нет. Это частый сценарий для крупных сайтов с большим количеством записей.

Когда лучше использовать SEO-плагин

Если у вас уже есть плагин, который умеет управлять мета-роботами для архивов, не дублируйте логику кодом. Двойная настройка часто приводит к конфликтам: один источник добавляет index, другой — noindex, и в итоге в HTML получается каша.

Например, в Clearfy Pro есть инструменты для удаления дублей и настройки технических страниц. Это уместно, если задача шире, чем один архив, и вы хотите собрать все служебные настройки в одном месте: Clearfy Pro.

Диагностика: что проверить до и после правки

Перед изменениями стоит понять, какие архивы уже попали в индекс и как именно они отдаются. Это экономит время: иногда проблема не в мета-роботах, а в том, что архивы уже есть в sitemap, внутренних ссылках или каноникалах.

  • откройте архив в браузере и посмотрите исходный код;
  • проверьте наличие <meta name="robots" content="noindex,follow"> или эквивалентного заголовка;
  • посмотрите, не попадает ли архив в XML-карту сайта;
  • проверьте, не ведут ли на архивы меню, хлебные крошки и блоки «похожие записи»;
  • в Search Console найдите URL архивов и посмотрите статус сканирования.

Для быстрой проверки можно использовать curl и посмотреть HTML-ответ:

curl -I https://example.com/2024/05/

Если вы закрываете архивы через wp_robots, удобнее проверить именно исходный HTML страницы, а не только заголовки ответа. Важно убедиться, что директива применяется только там, где нужно.

Проверка результата после внедрения

После публикации изменений не ждите мгновенного исчезновения URL из индекса. Сначала убедитесь, что страница отдает правильные сигналы, а потом уже наблюдайте за переобходом.

Что должно измениться

  • в исходном коде архивной страницы появился noindex,follow;
  • страница больше не добавляется в sitemap, если вы исключили ее на уровне SEO-плагина;
  • в Search Console статус URL меняется после повторного сканирования;
  • новые архивы не появляются в отчетах как страницы, которые нужно индексировать;
  • внутренние ссылки продолжают работать, если архив нужен для навигации.

Если архив уже был в индексе, удаление может занять время. Это нормально. Главное — не мешать поисковику противоречивыми сигналами: noindex в HTML, но при этом URL в sitemap и десятки внутренних ссылок на него.

Частые ошибки и как их исправить

Закрыли архив в robots.txt вместо noindex

Это одна из самых частых ошибок. Если вы запретили сканирование в robots.txt, поисковик может не увидеть директиву noindex на самой странице. В результате URL может остаться в индексе как «известный, но не просканированный». Для архивов чаще нужен именно noindex,follow, а не блокировка обхода.

Случайно закрыли полезные рубрики

Рубрика может быть полноценной посадочной страницей, особенно если у нее есть уникальный текст, нормальная структура и спрос. Перед закрытием проверьте, не приносит ли она трафик и не используется ли как основная точка входа. Если рубрика полезна, лучше оставить ее индексируемой и доработать контент.

Дублирующие правила из темы и плагина

Если тема выводит свои meta robots, а SEO-плагин — свои, итоговый HTML может стать непредсказуемым. В таких случаях отключите дублирующую логику в одном месте и оставьте один источник правды. Это особенно важно на старых темах с самописными SEO-вставками.

Архив закрыт, но остался в sitemap

Поисковик все равно будет регулярно возвращаться к URL из карты сайта. Если архив не должен индексироваться, уберите его и из sitemap. Иначе вы сами подаете поисковику сигнал, что страница важна, а затем просите ее не индексировать.

Практические советы по безопасности и производительности

Если вы добавляете код вручную, не правьте тему напрямую. Используйте мини-плагин или mu-plugin: так изменения не потеряются при обновлении и их проще отключить в случае ошибки.

  • храните правила индексации отдельно от шаблонов;
  • не закрывайте массово все архивы без анализа трафика;
  • проверяйте, не создают ли архивы лишнюю нагрузку из-за бесконечной пагинации;
  • если архивов много, следите за внутренней перелинковкой и глубиной вложенности;
  • после изменений прогоняйте хотя бы выборочную проверку через Search Console и просмотр исходного кода.

Если задача не ограничивается одним архивом, а включает чистку дублей, служебных страниц и технических настроек, удобнее собрать это в одном инструменте, чем поддерживать набор разрозненных сниппетов. Но даже в этом случае проверка результата вручную обязательна: автоматическая настройка не отменяет контроль HTML и индексации.

⭐⭐⭐⭐⭐