Архивы авторов и дат часто остаются в индексе как отдельные страницы, хотя для проекта они не несут самостоятельной ценности. На небольших сайтах это выглядит безобидно, но на контентных проектах такие страницы быстро разрастаются, начинают конкурировать с основными разделами и создают лишние URL для обхода поисковыми роботами.
Задача здесь не в том, чтобы «спрятать всё от поисковиков», а в том, чтобы аккуратно убрать из индекса именно те архивы, которые не нужны пользователю и не дают полезного контента. Для WordPress это можно сделать несколькими способами: через SEO-плагин, через код темы или плагина, либо комбинированно — с noindex и отключением ссылок в шаблоне.
Когда архивы авторов и дат действительно мешают
Проблема обычно проявляется не сразу. Сайт может нормально ранжироваться, но в отчётах по индексации появляются страницы вида /author/ivan/ или /2024/08/. Если на архиве автора один-два поста, а на архиве даты вообще пусто или почти пусто, поисковику там нечего показывать. В результате индекс раздувается, а полезные страницы получают меньше внимания при обходе.
Типичные симптомы
- в поиске находятся архивы авторов вместо самих статей;
- страницы архивов попадают в индекс, хотя на них нет уникального текста;
- в Search Console растёт число «Просканировано, но не проиндексировано» для служебных URL;
- в шаблоне темы есть ссылки на архив автора в метаданных поста, и они ведут на пустые или слабые страницы.
Диагностика: что именно индексируется
Перед правками стоит проверить, какие архивы реально доступны и как они отдаются. Откройте несколько URL архивов авторов и дат, посмотрите исходный код и заголовки. Если на странице уже стоит noindex, а она всё равно всплывает в индексе, значит, проблема может быть в старых ссылках, кеше или в том, что поисковик ещё не переобходил страницу.
Полезно проверить три вещи: наличие тега robots meta, канонический URL и статус ответа сервера. Если архив отдаёт 200 OK и не имеет noindex, он почти наверняка может попасть в индекс.
<?php
// Быстрая проверка в шаблоне или через временный mu-plugin.
add_action('wp_head', function () {
if (is_author() || is_date()) {
echo "<!-- archive detected: author/date -->\n";
}
});
Это не решение, а способ убедиться, что нужные шаблоны действительно отрабатывают. Для реальной диагностики лучше смотреть исходный HTML и заголовки ответа через DevTools, curl или инструменты SEO-сканера.
Как запретить индексацию через SEO-плагин
Если на сайте уже стоит SEO-плагин, самый безопасный путь — использовать его настройки. У большинства таких плагинов есть отдельные переключатели для архивов автора и даты. Это предпочтительнее, чем править шаблоны вручную, потому что плагин обычно сам корректно добавляет robots meta и canonical.
Логика простая: архивы, которые не нужны в выдаче, получают noindex, follow. Это позволяет роботам переходить по ссылкам внутри сайта, но не сохранять сам архив как отдельную страницу в индексе.
| Подход | Плюсы | Минусы |
|---|---|---|
| SEO-плагин | быстро, без кода, меньше риска сломать шаблон | зависит от конкретного плагина и его настроек |
| Код в теме/плагине | полный контроль, не зависит от интерфейса | нужно аккуратно тестировать после обновлений |
| Только убрать ссылки | уменьшает видимость архивов для пользователей | не решает индексацию, если URL уже известен поисковику |
Решение через код: noindex для архивов авторов и дат
Если нужен независимый от плагинов вариант, можно добавить фильтр в functions.php дочерней темы или в небольшой mu-plugin. Ниже пример для WordPress, который добавляет noindex, follow на архивы авторов и дат.
<?php
add_filter('wp_robots', function (array $robots) {
if (is_author() || is_date()) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
});
Этот способ работает на уровне стандартного API WordPress для robots meta. Он не требует правки шаблона header.php и обычно переживает смену темы, если код вынесен в отдельный плагин или mu-plugin.
Когда этого недостаточно
Если тема или SEO-плагин уже выводят собственный robots meta, проверьте, нет ли конфликта. Два разных блока с robots meta в одном документе — плохая идея. Поисковик может проигнорировать часть директив или интерпретировать страницу не так, как вы ожидаете.
В таких случаях сначала отключают дублирующий вывод, а потом оставляют один источник правды: либо SEO-плагин, либо код.
Как убрать ссылки на архивы из шаблона
Даже если архивы закрыты от индексации, ссылки на них в карточках автора или в метаданных поста могут оставаться лишними. Для пользователя они часто не нужны, особенно если архив пустой или служебный. В этом случае имеет смысл убрать ссылку на автора в шаблоне, но оставить имя автора как текст.
<?php
$author_name = get_the_author();
echo '<span class="post-author">' . esc_html($author_name) . '</span>';
Если ссылка всё же нужна, но вы хотите контролировать её вывод, используйте стандартные функции WordPress и проверяйте, что архив автора не конфликтует с вашей SEO-логикой.
Пошаговый порядок внедрения
- Проверьте, какие архивы авторов и дат уже доступны по URL.
- Определите, нужен ли архив пользователю или это служебная страница без ценности.
- Выберите один источник управления robots meta: SEO-плагин или код.
- Добавьте
noindex, followдля архивов авторов и дат. - При необходимости уберите ссылки на архивы из шаблона.
- Очистите кеш сайта и CDN, если они используются.
- Переобойдите страницы в Search Console и проверьте результат.
Проверка результата после внедрения
После правок не ограничивайтесь визуальной проверкой. Откройте архив автора и архив даты, затем проверьте исходный код страницы. В нём должен быть один корректный robots meta с нужной директивой. Если используется SEO-плагин, убедитесь, что он не добавляет второй конфликтующий тег.
Что проверить вручную:
- в исходном коде есть
noindexна нужных архивах; - страница отдаёт
200 OK, если вы не меняли статус ответа специально; - канонический URL не указывает на случайную страницу;
- после очистки кеша изменения видны не только в админке, но и в браузере без старой копии HTML;
- в Search Console архивы постепенно исчезают из индекса или помечаются как исключённые.
Если архивы уже были в индексе, не ждите мгновенного исчезновения. Поисковику нужно переобойти страницы и увидеть новые директивы. Это нормальный процесс, а не ошибка настройки.
Частые ошибки и как их исправить
Ставят noindex только в robots.txt
Это частая путаница. robots.txt управляет обходом, но не гарантирует удаление URL из индекса. Если страница уже известна поисковику, одного запрета в robots.txt обычно недостаточно. Для архивов нужен именно noindex в HTML или заголовках.
Оставляют два robots meta одновременно
Так бывает, когда один тег выводит тема, а второй — SEO-плагин. В итоге страница получает противоречивые директивы. Решение простое: оставьте один механизм и отключите второй.
Закрывают архивы, но не чистят внутренние ссылки
Если в шаблоне по-прежнему много ссылок на архивы авторов, поисковик будет продолжать их обходить. Это не критично само по себе, но лишний шум для индексации остаётся. Если архив не нужен, лучше убрать и ссылку, и индексирование.
Проверяют только в админке
Настройка в плагине не равна фактическому HTML на фронтенде. Всегда смотрите исходный код опубликованной страницы и, если есть кеш, проверяйте ещё и очищенную версию.
Безопасность и производительность
С точки зрения производительности это небольшая правка, но она помогает сократить количество бесполезных страниц, которые обходят роботы и открывают пользователи. На больших сайтах это снижает шум в отчётах и упрощает контроль индексации.
Если вы часто правите SEO-логики вручную, лучше вынести код в отдельный mu-plugin, а не держать его в активной теме. Тогда изменение темы не сломает настройку. Для проектов, где нужно не только закрывать архивы, но и чистить дубли, служебные страницы и лишние мета-данные, удобно использовать инструменты вроде Clearfy Pro: https://wpshop.ru/plugins/clearfy.
Если вы работаете с кастомной темой, держите такую логику отдельно от верстки. Это уменьшает риск случайно потерять настройки при редизайне или обновлении шаблона.
Когда архивы лучше не закрывать
Не все архивы авторов и дат нужно отключать. Если у вас редакционный сайт с сильными авторскими страницами, биографиями, подборками публикаций и уникальным описанием автора, архив может быть полезной посадочной страницей. То же касается тематических архивов по датам, если они реально помогают навигации и содержат значимый контент.
В таких случаях вместо полного noindex лучше доработать шаблон архива: добавить уникальное описание, список материалов, блоки навигации и убрать пустые участки. Тогда страница становится самостоятельной, а не техническим дублем.