Архивы авторов и дат в WordPress часто остаются в индексе по умолчанию, хотя на небольшом или корпоративном сайте они не дают полезного трафика, а иногда создают дубли и размывают структуру выдачи. Проблема обычно не в самом архиве, а в том, что он начинает конкурировать с рубриками, тегами и страницами-обзорами.
Ниже разберём, когда их действительно стоит закрывать от индексации, как это сделать без плагинного хаоса и как проверить, что поисковик получил нужные сигналы.
Когда архивы авторов и дат лучше закрыть
Не каждый архив нужно отключать. Если на сайте несколько авторов, у каждого есть нормальная биография, список публикаций и отдельная редакционная ценность, архив автора может быть полезен. То же самое с датами: на новостном или журнале архив по месяцу иногда помогает навигации.
Но на большинстве сайтов встречается другая картина:
- один автор и один шаблонный архив, который дублирует список записей;
- архивы дат с тонким контентом и почти пустой страницей;
- страницы архивов попадают в индекс, хотя не несут самостоятельной ценности;
- в выдаче появляются лишние URL, которые перехватывают внутренний вес и создают шум.
Диагностика: как понять, что проблема именно в архиве
Сначала проверьте, что именно индексируется. Откройте в браузере архив автора и архив даты, посмотрите исходный код и мета-теги. Если на странице есть index,follow, поисковик получает прямой сигнал индексировать её.
Полезно также проверить, не закрывает ли архивы SEO-плагин частично: иногда в интерфейсе стоит запрет на индексацию, но шаблон темы всё равно выводит каноникал или заголовки так, что страница остаётся доступной для обхода.
Что смотреть в первую очередь:
- мета-тег robots в HTML;
- HTTP-заголовок
X-Robots-Tag, если он используется; - наличие канонического URL;
- есть ли ссылки на архивы из меню, хлебных крошек и блока автора;
- попадают ли архивы в sitemap.
Быстрая проверка в браузере и через curl
Если нужен быстрый технический осмотр, достаточно открыть заголовки ответа:
curl -I https://example.com/author/admin/Или посмотреть HTML страницы на наличие robots:
curl -s https://example.com/author/admin/ | grep -i robotsЕсли видите noindex, но страница всё равно индексируется, значит проблема может быть в кеше, в конфликте плагинов или в том, что поисковик ещё не переобходил URL.
Как закрыть архивы авторов и дат: рабочие варианты
Есть три нормальных подхода: через SEO-плагин, через код темы или плагина, либо через серверные заголовки. Для большинства сайтов удобнее первый или второй вариант. Серверные заголовки полезны, если вы хотите жёстко контролировать поведение без зависимости от шаблона.
| Способ | Плюсы | Минусы |
|---|---|---|
| SEO-плагин | Быстро, без кода, удобно для редактора | Зависимость от интерфейса и настроек плагина |
| Код в теме/мини-плагине | Точный контроль, не зависит от UI | Нужно аккуратно тестировать после обновлений |
| X-Robots-Tag на сервере | Работает на уровне ответа, сложно сломать шаблоном | Не всегда удобно для выборочного управления |
Вариант 1: через SEO-плагин
Если у вас уже стоит SEO-плагин, найдите настройки архивов автора и даты. В популярных решениях обычно есть отдельные переключатели для noindex архивов авторов, дат, тегов и иногда пагинации. Это самый безопасный путь для редактора: не нужно лезть в код, а изменения легко откатить.
Важно не ограничиваться только галочкой в интерфейсе. После сохранения проверьте исходный код страницы и убедитесь, что плагин действительно меняет robots на нужное значение.
Вариант 2: через код в functions.php или мини-плагине
Если нужен контроль без плагинов, можно повеситься на фильтр wp_robots и добавить noindex для архивов авторов и дат. Это современный и понятный способ для WordPress 5.7+.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_author() || is_date() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Этот код лучше размещать не в родительской теме, а в дочерней теме или в небольшом mu-plugin, чтобы не потерять настройку после обновления.
Если у вас старый сайт и тема вручную выводит meta robots, сначала проверьте, не конфликтует ли это с фильтром. В идеале должен остаться один источник правды.
Вариант 3: через X-Robots-Tag
Если нужна жёсткая серверная политика, можно отдавать заголовок X-Robots-Tag: noindex, follow для архивов. Это полезно, когда шаблон сложный, а SEO-плагин не должен участвовать в логике.
<?php
add_action( 'send_headers', function() {
if ( is_author() || is_date() ) {
header( 'X-Robots-Tag: noindex, follow', true );
}
} );Такой вариант стоит использовать осторожно: он влияет на ответ сервера, поэтому сначала проверьте, что заголовок не ломает кеширование и не конфликтует с CDN.
Пошаговая схема внедрения
- Определите, какие архивы нужно закрыть: только авторов, только даты или оба типа.
- Проверьте, не используются ли они как навигационные страницы на сайте.
- Выберите один способ управления: SEO-плагин, код или серверный заголовок.
- Внесите изменение и очистите кеш сайта, сервера и CDN.
- Проверьте HTML и заголовки ответа на тестовом URL.
- Убедитесь, что архивы не попадают в sitemap.
- Через несколько дней проверьте статус в Search Console или аналогичном инструменте.
Проверка результата после внедрения
После изменения откройте архив автора и архив даты в браузере. В исходном коде должен появиться noindex или соответствующий HTTP-заголовок. Если вы используете SEO-плагин, проверьте, не дублируется ли robots в HTML и заголовке одновременно — обычно это не критично, но лучше иметь один понятный механизм.
Дальше проверьте три вещи:
- страница отвечает с кодом 200, а не редиректит на главную без причины;
- в robots нет случайного
noindex,nofollow, если вы хотите сохранить обход ссылок; - архив не включён в XML sitemap.
Если URL уже был в индексе, не ждите мгновенного исчезновения. Поисковику нужно переобойти страницу и увидеть новый сигнал. На этом этапе полезно отправить URL на повторную проверку через инструменты для вебмастеров.
Частые ошибки и как их исправить
Закрыли архив в robots.txt вместо noindex
Это частая ошибка. Если вы просто запретите обход в robots.txt, поисковик может продолжать хранить URL в индексе без контента. Для удаления из выдачи это слабый инструмент. Нужен именно noindex на самой странице или заголовок ответа.
Сломали архив автора на сайте с несколькими редакторами
Если у каждого автора есть уникальная страница с биографией и полезным списком материалов, закрывать архив без анализа не стоит. В таком случае лучше доработать шаблон: добавить описание автора, ссылки на рубрики и нормальную навигацию, а потом уже решать, нужен ли noindex.
Забыли очистить кеш
После изменения robots старый HTML может продолжать отдаваться из кеша. Это особенно заметно на сайтах с серверным кешем или CDN. Очистите кеш в плагине, на хостинге и на стороне CDN, иначе проверка покажет старую версию страницы.
Поставили noindex, но архив всё ещё в sitemap
Такое бывает, если SEO-плагин и карта сайта живут разными настройками. Если URL остаётся в sitemap, поисковик получает противоречивые сигналы. Уберите архив из карты сайта или отключите его генерацию в настройках плагина.
Практические советы по безопасности и производительности
Если вы вносите код, не редактируйте functions.php на боевом сайте через админку. Лучше использовать дочернюю тему, mu-plugin или деплой из репозитория. Так меньше риск получить белый экран из-за синтаксической ошибки.
Для сайтов с большим количеством архивов и сложной логикой лучше держать правило в одном месте. Когда noindex задаётся одновременно в теме, SEO-плагине и сервере, отладка превращается в поиск случайного конфликта.
Если вы используете Clearfy Pro, у него есть отдельные инструменты для удаления дублей и технической чистки сайта; в таких задачах это может быть удобнее, чем собирать логику вручную. Но даже в этом случае всё равно стоит проверить итоговый HTML и заголовки ответа, а не полагаться только на интерфейс.
Перед выкладкой на продакшен полезно прогнать короткий чек-лист:
- архивы авторов и дат действительно не нужны как посадочные страницы;
- noindex задан только там, где это требуется;
- robots не конфликтует с sitemap;
- кеш очищен;
- проверка в браузере и curl показывает ожидаемый результат.
Если нужна соседняя задача из той же области, обычно следующим шагом идёт настройка индексации рубрик, тегов и страниц внутреннего поиска. Но начинать лучше именно с архивов, потому что они чаще всего создают лишний шум без заметной пользы.