wpcompany.ru wordpress WPCompany

Как запретить индексацию архивов авторов и дат в WordPress

Архивы авторов и дат часто остаются в индексе как отдельные страницы, хотя для проекта они не несут самостоятельной ценности. На небольших сайтах это выглядит безобидно, но на контентных проектах такие страницы быстро разрастаются, начинают конкурировать с основными разделами и создают лишние URL для обхода поисковыми роботами.

Задача здесь не в том, чтобы «спрятать всё от поисковиков», а в том, чтобы аккуратно убрать из индекса именно те архивы, которые не нужны пользователю и не дают полезного контента. Для WordPress это можно сделать несколькими способами: через SEO-плагин, через код темы или плагина, либо комбинированно — с noindex и отключением ссылок в шаблоне.

Когда архивы авторов и дат действительно мешают

Проблема обычно проявляется не сразу. Сайт может нормально ранжироваться, но в отчётах по индексации появляются страницы вида /author/ivan/ или /2024/08/. Если на архиве автора один-два поста, а на архиве даты вообще пусто или почти пусто, поисковику там нечего показывать. В результате индекс раздувается, а полезные страницы получают меньше внимания при обходе.

Типичные симптомы

  • в поиске находятся архивы авторов вместо самих статей;
  • страницы архивов попадают в индекс, хотя на них нет уникального текста;
  • в Search Console растёт число «Просканировано, но не проиндексировано» для служебных URL;
  • в шаблоне темы есть ссылки на архив автора в метаданных поста, и они ведут на пустые или слабые страницы.

Диагностика: что именно индексируется

Перед правками стоит проверить, какие архивы реально доступны и как они отдаются. Откройте несколько URL архивов авторов и дат, посмотрите исходный код и заголовки. Если на странице уже стоит noindex, а она всё равно всплывает в индексе, значит, проблема может быть в старых ссылках, кеше или в том, что поисковик ещё не переобходил страницу.

Полезно проверить три вещи: наличие тега robots meta, канонический URL и статус ответа сервера. Если архив отдаёт 200 OK и не имеет noindex, он почти наверняка может попасть в индекс.

<?php
// Быстрая проверка в шаблоне или через временный mu-plugin.
add_action('wp_head', function () {
    if (is_author() || is_date()) {
        echo "<!-- archive detected: author/date -->\n";
    }
});

Это не решение, а способ убедиться, что нужные шаблоны действительно отрабатывают. Для реальной диагностики лучше смотреть исходный HTML и заголовки ответа через DevTools, curl или инструменты SEO-сканера.

Как запретить индексацию через SEO-плагин

Если на сайте уже стоит SEO-плагин, самый безопасный путь — использовать его настройки. У большинства таких плагинов есть отдельные переключатели для архивов автора и даты. Это предпочтительнее, чем править шаблоны вручную, потому что плагин обычно сам корректно добавляет robots meta и canonical.

Логика простая: архивы, которые не нужны в выдаче, получают noindex, follow. Это позволяет роботам переходить по ссылкам внутри сайта, но не сохранять сам архив как отдельную страницу в индексе.

ПодходПлюсыМинусы
SEO-плагинбыстро, без кода, меньше риска сломать шаблонзависит от конкретного плагина и его настроек
Код в теме/плагинеполный контроль, не зависит от интерфейсанужно аккуратно тестировать после обновлений
Только убрать ссылкиуменьшает видимость архивов для пользователейне решает индексацию, если URL уже известен поисковику

Решение через код: noindex для архивов авторов и дат

Если нужен независимый от плагинов вариант, можно добавить фильтр в functions.php дочерней темы или в небольшой mu-plugin. Ниже пример для WordPress, который добавляет noindex, follow на архивы авторов и дат.

<?php
add_filter('wp_robots', function (array $robots) {
    if (is_author() || is_date()) {
        $robots['noindex'] = true;
        $robots['follow'] = true;
    }

    return $robots;
});

Этот способ работает на уровне стандартного API WordPress для robots meta. Он не требует правки шаблона header.php и обычно переживает смену темы, если код вынесен в отдельный плагин или mu-plugin.

Когда этого недостаточно

Если тема или SEO-плагин уже выводят собственный robots meta, проверьте, нет ли конфликта. Два разных блока с robots meta в одном документе — плохая идея. Поисковик может проигнорировать часть директив или интерпретировать страницу не так, как вы ожидаете.

В таких случаях сначала отключают дублирующий вывод, а потом оставляют один источник правды: либо SEO-плагин, либо код.

Как убрать ссылки на архивы из шаблона

Даже если архивы закрыты от индексации, ссылки на них в карточках автора или в метаданных поста могут оставаться лишними. Для пользователя они часто не нужны, особенно если архив пустой или служебный. В этом случае имеет смысл убрать ссылку на автора в шаблоне, но оставить имя автора как текст.

<?php
$author_name = get_the_author();
echo '<span class="post-author">' . esc_html($author_name) . '</span>';

Если ссылка всё же нужна, но вы хотите контролировать её вывод, используйте стандартные функции WordPress и проверяйте, что архив автора не конфликтует с вашей SEO-логикой.

Пошаговый порядок внедрения

  1. Проверьте, какие архивы авторов и дат уже доступны по URL.
  2. Определите, нужен ли архив пользователю или это служебная страница без ценности.
  3. Выберите один источник управления robots meta: SEO-плагин или код.
  4. Добавьте noindex, follow для архивов авторов и дат.
  5. При необходимости уберите ссылки на архивы из шаблона.
  6. Очистите кеш сайта и CDN, если они используются.
  7. Переобойдите страницы в Search Console и проверьте результат.

Проверка результата после внедрения

После правок не ограничивайтесь визуальной проверкой. Откройте архив автора и архив даты, затем проверьте исходный код страницы. В нём должен быть один корректный robots meta с нужной директивой. Если используется SEO-плагин, убедитесь, что он не добавляет второй конфликтующий тег.

Что проверить вручную:

  • в исходном коде есть noindex на нужных архивах;
  • страница отдаёт 200 OK, если вы не меняли статус ответа специально;
  • канонический URL не указывает на случайную страницу;
  • после очистки кеша изменения видны не только в админке, но и в браузере без старой копии HTML;
  • в Search Console архивы постепенно исчезают из индекса или помечаются как исключённые.

Если архивы уже были в индексе, не ждите мгновенного исчезновения. Поисковику нужно переобойти страницы и увидеть новые директивы. Это нормальный процесс, а не ошибка настройки.

Частые ошибки и как их исправить

Ставят noindex только в robots.txt

Это частая путаница. robots.txt управляет обходом, но не гарантирует удаление URL из индекса. Если страница уже известна поисковику, одного запрета в robots.txt обычно недостаточно. Для архивов нужен именно noindex в HTML или заголовках.

Оставляют два robots meta одновременно

Так бывает, когда один тег выводит тема, а второй — SEO-плагин. В итоге страница получает противоречивые директивы. Решение простое: оставьте один механизм и отключите второй.

Закрывают архивы, но не чистят внутренние ссылки

Если в шаблоне по-прежнему много ссылок на архивы авторов, поисковик будет продолжать их обходить. Это не критично само по себе, но лишний шум для индексации остаётся. Если архив не нужен, лучше убрать и ссылку, и индексирование.

Проверяют только в админке

Настройка в плагине не равна фактическому HTML на фронтенде. Всегда смотрите исходный код опубликованной страницы и, если есть кеш, проверяйте ещё и очищенную версию.

Безопасность и производительность

С точки зрения производительности это небольшая правка, но она помогает сократить количество бесполезных страниц, которые обходят роботы и открывают пользователи. На больших сайтах это снижает шум в отчётах и упрощает контроль индексации.

Если вы часто правите SEO-логики вручную, лучше вынести код в отдельный mu-plugin, а не держать его в активной теме. Тогда изменение темы не сломает настройку. Для проектов, где нужно не только закрывать архивы, но и чистить дубли, служебные страницы и лишние мета-данные, удобно использовать инструменты вроде Clearfy Pro: https://wpshop.ru/plugins/clearfy.

Если вы работаете с кастомной темой, держите такую логику отдельно от верстки. Это уменьшает риск случайно потерять настройки при редизайне или обновлении шаблона.

Когда архивы лучше не закрывать

Не все архивы авторов и дат нужно отключать. Если у вас редакционный сайт с сильными авторскими страницами, биографиями, подборками публикаций и уникальным описанием автора, архив может быть полезной посадочной страницей. То же касается тематических архивов по датам, если они реально помогают навигации и содержат значимый контент.

В таких случаях вместо полного noindex лучше доработать шаблон архива: добавить уникальное описание, список материалов, блоки навигации и убрать пустые участки. Тогда страница становится самостоятельной, а не техническим дублем.

×
Прокачай свой сайт WordPress!

WordPress

-20% на премиум темы и плагины

Создай сайт своей мечты ⋙