Архивы авторов и дат в WordPress часто создают лишние URL, которые не дают трафик, но забирают краулинговый бюджет и размывают структуру сайта. На небольших проектах это не критично, а вот на контентных сайтах и блогах такие страницы быстро превращаются в набор слабых архивов с одинаковыми заголовками, короткими сниппетами и дублирующимися списками записей.
Задача обычно не в том, чтобы удалить архивы полностью. Чаще нужно оставить их для навигации, но убрать из индекса поисковых систем и, при необходимости, запретить попадание в sitemap. Ниже — рабочие способы для WordPress: через SEO-плагин, через код и с проверкой результата.
Когда архивы авторов и дат становятся проблемой
Сначала стоит понять, действительно ли эти страницы мешают. Не каждый архив нужно закрывать. Если у вас несколько авторов, у каждого есть уникальная экспертная страница с биографией, ссылками и подборкой материалов, архив автора может быть полезен. То же касается архивов дат на новостных сайтах, где они выполняют роль навигации.
Типичные признаки, что архивы лучше закрыть
- в поиске индексируются страницы вида
/author/username/и/2024/05/, но они не получают трафик; - в Google Search Console растут страницы без кликов и с низким качеством контента;
- архивы дублируют логику рубрик и тегов, не добавляя новой ценности;
- на сайте один автор, а архив автора фактически повторяет главную страницу блога;
- архивы дат создаются автоматически, но не используются посетителями.
Диагностика: что именно индексируется сейчас
Перед изменениями проверьте, какие архивы уже доступны поисковикам. Это важно, потому что способ решения зависит от текущей настройки темы, SEO-плагина и карты сайта.
Что проверить вручную
- откройте архив автора в браузере и посмотрите, есть ли на странице уникальный контент, кроме списка записей;
- посмотрите исходный код страницы и найдите
meta name="robots"; - проверьте, есть ли архивы в XML sitemap;
- в Search Console посмотрите, не попадают ли такие URL в отчет «Страницы».
Если на архиве уже стоит noindex, но он все равно появляется в индексе, проблема может быть в старых обходах, внутренних ссылках или в том, что поисковик еще не переобходил страницу. В этом случае нужно не только поставить мета-тег, но и проверить sitemap, каноникал и внутренние ссылки.
Пошаговое решение через SEO-плагин
Самый безопасный путь — использовать SEO-плагин, который умеет управлять архивами без правки темы. Это удобнее, если сайт уже поддерживается редактором или контент-менеджером, а не только разработчиком.
Что обычно нужно отключить
- индексацию архивов авторов;
- индексацию архивов дат;
- показ архивов в XML sitemap, если плагин это поддерживает;
- при необходимости — саму страницу архива, если она не нужна пользователям.
В популярных SEO-плагинах это обычно находится в настройках архивов или таксономий. Логика одна: архив остается доступным для пользователей, но получает noindex,follow или аналогичную настройку.
Если на сайте используется Clearfy Pro, его удобно применять для чистки технических дублей и SEO-настроек, когда нужно быстро закрыть лишние архивы без ручного кода: https://wpshop.ru/plugins/clearfy.
Решение через код: отключаем архивы авторов и дат точечно
Если вы не хотите зависеть от плагина или у вас кастомная тема, можно задать поведение через код. Ниже пример, который ставит noindex,follow для архивов авторов и дат, а также убирает их из XML sitemap, если тема или SEO-стек не делают этого автоматически.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_author() || is_date() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );
add_filter( 'wp_sitemaps_posts_query_args', function( array $args, string $post_type ) {
// Этот фильтр относится к sitemap записей, поэтому здесь он не помогает
// для архивов авторов и дат напрямую. Оставлен как напоминание: sitemap
// лучше контролировать через SEO-плагин или отдельную логику.
return $args;
}, 10, 2 );
add_action( 'template_redirect', function() {
if ( is_author() || is_date() ) {
// Если архивы не нужны вообще, можно отдать 404 или редирект.
// Но это уже более жесткое решение, его стоит применять осторожно.
}
} );
Этот вариант хорош тем, что не ломает навигацию и не требует менять шаблоны архивов. Но он решает только часть задачи: если архивы уже попали в sitemap через SEO-плагин, нужно отключить их и там.
Если архивы нужно не только закрыть, но и убрать из интерфейса
Иногда архивы авторов на сайте с одним автором вообще не нужны. Тогда можно скрыть ссылки на архив автора в шаблоне и отключить саму страницу через редирект на главную или на страницу «О сайте». Но это уже решение под конкретную структуру сайта, а не универсальная настройка.
<?php
add_action( 'template_redirect', function() {
if ( is_author() ) {
wp_safe_redirect( home_url( '/' ), 301 );
exit;
}
} );
Такой редирект стоит использовать только если вы уверены, что архив автора не нужен ни пользователям, ни поисковикам. Для архивов дат редирект обычно менее оправдан: лучше закрыть их от индексации, чем ломать старые ссылки.
Сравнение подходов: плагин, код или редирект
| Подход | Когда подходит | Плюсы | Минусы |
|---|---|---|---|
| SEO-плагин | Нужна быстрая настройка без разработки | Просто поддерживать, меньше риска сломать шаблоны | Зависимость от интерфейса и логики плагина |
Код через wp_robots | Нужна точечная настройка в теме или mu-plugin | Прозрачно, контролируемо, без лишних плагинов | Нужно следить за sitemap и внутренними ссылками |
| 301-редирект | Архив точно не нужен | Убирает страницу из обхода и из пользовательского пути | Можно потерять полезную навигацию и историю URL |
Проверка результата после внедрения
После изменений не ограничивайтесь просмотром страницы в браузере. Нужно проверить, как именно она отдается поисковику и не осталась ли в sitemap.
Чек-лист проверки
- откройте архив автора или даты и убедитесь, что в коде страницы есть
noindex; - проверьте заголовок ответа и мета-тег robots через «Просмотр кода страницы» или curl;
- посмотрите XML sitemap и убедитесь, что там нет закрытых архивов;
- внутренние ссылки на архивы либо удалены, либо оставлены осознанно;
- в Search Console отправьте страницу на повторную проверку, если она уже была проиндексирована.
Для быстрой проверки можно использовать curl:
curl -I https://example.com/author/username/
Если вы используете мета-тег robots в HTML, дополнительно проверьте исходник страницы:
curl -s https://example.com/author/username/ | grep -i robots
Важно: если архив уже в индексе, noindex не удаляет его мгновенно. Поисковику нужно переобойти страницу. Обычно это происходит после очередного обхода, если страница доступна и не заблокирована в robots.txt.
Частые ошибки и как их исправить
Закрыли архив в robots.txt вместо noindex
Это распространенная ошибка. Если вы запретили обход через robots.txt, поисковик может не увидеть noindex на странице и дольше держать URL в индексе. Для удаления из индекса чаще нужен именно noindex, а не только запрет обхода.
Оставили архив в sitemap
Если URL продолжает попадать в карту сайта, вы сами подсказываете поисковику, что страница важна. После закрытия архивов проверьте sitemap и уберите оттуда все лишнее.
Поставили редирект там, где нужен архив для навигации
Редирект удобен, но он необратимо меняет пользовательский сценарий. Если архив автора нужен как страница профиля, лучше оставить его доступным и просто закрыть от индексации.
Не проверили тему и плагины на дублирование настроек
Иногда SEO-плагин ставит один robots-тег, а тема — другой. В результате в HTML появляется конфликтующая разметка. Проверьте, кто именно формирует meta robots, и оставьте один источник истины.
Практические советы по безопасности и производительности
Если вы вносите изменения через код, лучше не править functions.php активной темы напрямую. Безопаснее использовать дочернюю тему или небольшой mu-plugin. Так настройка не пропадет после обновления темы.
Для сайтов с большим количеством контента полезно держать SEO-логику отдельно от шаблонов. Это упрощает поддержку и снижает риск случайно сломать вывод архивов при редизайне.
- не закрывайте в
noindexстраницы, которые реально нужны пользователям; - не смешивайте редиректы и
noindexбез необходимости; - после правок проверьте кэш страницы и серверный кэш, если он есть;
- если используете CDN или плагин кэширования, очистите кэш после изменения robots-настроек.
Если нужен более широкий контроль над дублями, архивами и технической чисткой сайта, имеет смысл смотреть в сторону инструментов, которые закрывают SEO-рутинy комплексно, а не точечно. Но даже в этом случае проверка руками остается обязательной: именно она показывает, что страница реально отдает нужный robots-режим и не конфликтует с sitemap.