Архивы авторов и дат часто остаются в индексе даже на небольших сайтах, где они не несут самостоятельной ценности. В результате поисковик видит дополнительные страницы с почти тем же набором записей, а в отчётах по индексации появляются лишние URL. Если задача не в том, чтобы продвигать страницы авторов или архивы по датам, их лучше либо закрыть от индексации, либо отдать noindex и убрать из карты сайта.
Ниже разберём, как понять, что именно мешает, какие есть рабочие способы и как проверить, что изменения реально сработали.
Когда архивы авторов и дат становятся проблемой
На практике это видно по нескольким признакам:
- в поиске появляются страницы вида
/author/...,/2024/05/или похожие архивы, хотя они не нужны пользователю; - в Google Search Console растёт число страниц с низкой ценностью или дублирующих URL;
- архивы тянут на себя внутренний вес, но не дают трафика;
- на сайте есть один автор, и архив автора дублирует ленту записей почти полностью;
- архивы дат пустые или показывают слишком мало контента.
Если архивы используются как полноценные посадочные страницы, например на новостном сайте с редакцией, закрывать их бездумно не стоит. Но для большинства корпоративных и контентных проектов это лишний слой индексации.
Диагностика: что именно индексируется
Сначала проверьте, какие архивы доступны и как они отдаются поисковику. Не полагайтесь только на визуальный вид страницы — важны заголовки ответа и мета-теги.
Что проверить вручную
- открывается ли архив автора по адресу
/author/имя/; - есть ли архивы по датам, например
/2024/08/; - какой
titleиmeta robotsу этих страниц; - попадают ли они в XML-карту сайта;
- не используются ли эти архивы в хлебных крошках или внутренних ссылках как важные страницы.
Если у вас установлен SEO-плагин, сначала посмотрите его настройки. Многие плагины уже умеют отключать индексацию архивов авторов и дат без кода. Но если нужен точечный контроль или плагин не покрывает сценарий, проще сделать это через тему или небольшой mu-plugin.
Сравнение подходов
| Подход | Когда подходит | Плюсы | Минусы |
|---|---|---|---|
| Настройки SEO-плагина | Если нужен быстрый и понятный способ без кода | Просто включить, обычно есть управление noindex и sitemap | Зависит от конкретного плагина и его логики |
| Код в теме или mu-plugin | Если нужен точный контроль и предсказуемое поведение | Не зависит от интерфейса плагина, легко проверить | Нужно аккуратно тестировать после обновлений |
| robots.txt | Если нужно только ограничить обход | Быстро и просто | Не убирает URL из индекса, если на них уже есть ссылки |
Для удаления дублей из поиска лучше ориентироваться на noindex и исключение из sitemap, а не только на robots.txt. Запрет обхода и запрет индексации — не одно и то же.
Решение через код: отключаем архивы авторов и дат
Если вам нужен стабильный вариант без зависимости от интерфейса SEO-плагина, добавьте код в functions.php дочерней темы или, что надёжнее, в небольшой mu-plugin. Ниже пример, который:
- ставит
noindex,followдля архивов авторов и дат; - убирает архивы из XML-карты сайта, если тема или плагин её формирует через стандартные механизмы WordPress;
- не ломает обычные записи и страницы.
<?php
add_filter('wp_robots', function ($robots) {
if (is_author() || is_date()) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
});
add_filter('wp_sitemaps_posts_query_args', function ($args, $post_type) {
// Для стандартных записей ничего не меняем, но пример оставлен как ориентир.
return $args;
}, 10, 2);
add_filter('wp_sitemaps_taxonomies', function ($taxonomies) {
return $taxonomies;
});
add_filter('wp_sitemaps_add_provider', function ($provider, $name) {
return $provider;
}, 10, 2);
Сам по себе фильтр wp_robots уже решает основную задачу: поисковик увидит директиву noindex на нужных архивах. Но если у вас подключён SEO-плагин, он может переопределять мета-robots и карту сайта. Тогда важно проверить итоговый HTML и sitemap после внедрения.
Если нужно полностью отключить архивы авторов
Иногда архивы авторов не просто закрывают от индексации, а вообще убирают с фронтенда. Это оправдано на сайтах с одним автором или без публичных профилей редакции. В таком случае можно перенаправить архив автора на главную или на страницу «О сайте».
<?php
add_action('template_redirect', function () {
if (is_author()) {
wp_safe_redirect(home_url('/'), 301);
exit;
}
});
Этот вариант жёстче. Он подходит не всем, потому что ломает прямые ссылки на архивы авторов. Если на сайте есть внешние ссылки на такие страницы, лучше сначала оставить noindex, а редирект делать только после проверки логов и Search Console.
Пошагово: что делать на живом сайте
- Проверьте, нужны ли архивы авторов и дат как отдельные страницы.
- Посмотрите, не закрывает ли их уже SEO-плагин.
- Если нет — добавьте
noindex,followчерезwp_robotsили настройку плагина. - Исключите эти URL из XML-карты сайта, если они туда попадают.
- При необходимости настройте 301-редирект с архивов авторов на главную или на страницу профиля.
- Очистите кеш сайта и CDN.
Если используете Clearfy Pro, часть таких задач можно закрыть через настройки SEO и чистки дублей без ручного кода: https://wpshop.ru/plugins/clearfy. Но даже в этом случае полезно понимать, что именно меняется в HTML и sitemap.
Как проверить результат после внедрения
Проверка должна быть не только визуальной. Нужны три уровня контроля: HTML, sitemap и индексация в поиске.
Проверка HTML
Откройте архив автора или даты и посмотрите исходный код страницы. В нём должно быть что-то вроде:
<meta name="robots" content="noindex,follow" />Если вместо этого вы видите обычный индексируемый шаблон, значит фильтр не сработал или его перезаписывает SEO-плагин.
Проверка sitemap
Откройте XML-карту сайта и убедитесь, что архивы авторов и дат там не перечислены как отдельные URL. Если они всё ещё присутствуют, поисковик может продолжать их обходить и переоценивать.
Проверка в Search Console
- отправьте страницу на повторную проверку через инспектор URL;
- посмотрите статус индексации через несколько переобходов;
- проверьте, не остались ли старые URL в отчёте по страницам;
- если был редирект, убедитесь, что он отдаёт именно
301, а не302.
Не ждите мгновенного исчезновения URL из индекса. Поисковик должен заново обойти страницу и увидеть новые сигналы.
Частые ошибки и как их исправить
Только закрыли в robots.txt
Это частая ошибка. Disallow не гарантирует удаление URL из индекса, если на него уже есть ссылки. Для технических дублей нужен noindex или редирект.
Поставили noindex, но оставили страницу в sitemap
Так поисковику вы отправляете противоречивые сигналы. Если страница не должна индексироваться, уберите её из карты сайта.
Сделали редирект без проверки
Иногда архив авторов ведёт на полезные страницы профиля, и резкий редирект ломает навигацию. Сначала проверьте, есть ли внешние ссылки и используется ли архив внутри сайта.
Не учли SEO-плагин
Если плагин уже управляет мета-robots, ваш код может не дать эффекта или, наоборот, конфликтовать с его настройками. В таких случаях лучше оставить один источник правды: либо плагин, либо код.
Практические советы по безопасности и производительности
Если вы вносите код вручную, не правьте файлы активной темы напрямую. Используйте дочернюю тему или mu-plugin, чтобы изменения не пропали после обновления. Перед выкладкой проверьте код на тестовой копии сайта.
- делайте бэкап файлов и базы перед правками;
- после изменения очищайте кеш страницы, объекта и CDN;
- не закрывайте от индексации страницы, которые реально приносят трафик;
- если архивы нужны только для админки или внутренней логики, лучше скрыть их от публичного доступа, а не просто прятать от поиска.
Если на сайте много технических дублей, полезно сначала навести порядок в SEO-настройках и чистке шаблонов. В таких задачах часто помогает не точечный костыль, а системная настройка индексации и дублей на уровне темы и плагинов.