Архивы авторов и дат на WordPress-сайте часто создают лишние страницы, которые не дают трафик, но могут попадать в индекс и раздувать количество дублей. Это типичная история для новостных, корпоративных и контентных сайтов, где один и тот же материал доступен через рубрики, теги, архивы автора и архивы по дате.
Задача здесь не в том, чтобы «спрятать всё подряд», а в том, чтобы оставить в индексе полезные страницы и убрать технический шум. Ниже — рабочие варианты: через SEO-плагин и через код, если нужен контроль без лишних зависимостей.
Когда архивы авторов и дат действительно мешают
Проблема обычно проявляется не сразу. Сайт может нормально открываться, а в поиске уже есть страницы вида /author/username/ или /2026/08/, которые дублируют списки записей и не несут самостоятельной ценности. Для небольшого сайта это может быть незаметно, но на проекте с регулярными публикациями такие архивы быстро начинают конкурировать с основными страницами.
Диагностика проблемы
Проверьте три вещи:
- есть ли архивы авторов и дат в индексе через запросы вида
site:example.com authorиsite:example.com 2026/08; - открываются ли эти страницы без ограничений и отдают ли они полноценный HTML;
- есть ли на них уникальный текст, который реально нужен пользователю, или это просто список записей.
Если на сайте один автор и архив автора повторяет главную ленту, индексировать такую страницу обычно нет смысла. То же самое касается архивов по датам, если они не используются как навигационный раздел.
Что выбрать: плагин или код
Если на сайте уже стоит SEO-плагин, проще и безопаснее использовать его настройки. Если плагина нет или нужен точечный контроль, можно выставить noindex через код и при необходимости убрать архивы из карты сайта.
| Подход | Плюсы | Минусы |
|---|---|---|
| SEO-плагин | Быстро, без правки темы, обычно есть отдельные переключатели | Зависимость от интерфейса и логики плагина |
| Код в теме или mu-plugin | Точный контроль, не зависит от UI | Нужно аккуратно тестировать после обновлений |
| Оставить как есть | Ничего не нужно настраивать | Риск дублей и мусорных страниц в индексе |
Пошаговое решение через SEO-плагин
В большинстве случаев этого достаточно. В популярных SEO-плагинах можно отдельно отключить индексацию архивов авторов и дат. Логика обычно одна: архив остаётся доступным для пользователей, но поисковым роботам отдаётся noindex,follow.
Что проверить в настройках
- архивы авторов — выключить индексирование, если на сайте нет полноценной страницы автора;
- архивы дат — отключить почти всегда, если они не используются как самостоятельный раздел;
- карта сайта — убедиться, что эти архивы не попадают туда без необходимости;
- канонические URL — проверить, что они не указывают на случайные дубликаты.
После сохранения настроек откройте архив автора и посмотрите исходный код страницы. В <head> должен появиться meta robots с noindex, если плагин работает корректно.
Настройка через код без SEO-плагина
Если вы хотите решить задачу на уровне темы или небольшого сайта без тяжёлого SEO-стека, можно добавить фильтр в functions.php дочерней темы или в отдельный mu-plugin. Ниже пример, который ставит noindex,follow для архивов авторов и дат.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_author() || is_date() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Этот вариант работает на современных версиях WordPress, где используется фильтр wp_robots. Он не ломает страницу для посетителей, а только меняет подсказки для поисковых систем.
Если нужно убрать архивы из sitemap
Сам по себе noindex не всегда означает, что URL исчезнет из карты сайта. Если вы генерируете sitemap кодом или через плагин, проверьте, не попадают ли туда архивы авторов и дат. В WordPress можно исключать лишние типы URL на стороне плагина или через его настройки. Если sitemap собирается вручную, логика должна быть простой: в карту сайта идут только страницы, которые вы действительно хотите индексировать.
<?php
add_filter( 'wp_sitemaps_add_provider', function( $provider, $name ) {
if ( 'users' === $name ) {
return false;
}
return $provider;
}, 10, 2 );Этот пример отключает provider пользователей в стандартных sitemap WordPress. Используйте его только если вам действительно не нужен sitemap авторов. Для архивов дат отдельного provider в core нет, но если вы добавляете их сторонним кодом, исключайте их там же, где формируете список URL.
Проверка результата после внедрения
После настройки не ограничивайтесь визуальной проверкой. Откройте архив автора и архив даты в браузере, затем проверьте исходный код страницы и ответ сервера.
- В
<head>должен быть meta robots сnoindex. - Страница должна открываться с кодом ответа
200, если вы не делали редирект. - В sitemap не должно быть лишних архивов, если вы их исключали.
- Через несколько обходов поисковиком страницы должны начать выпадать из индекса.
Для быстрой проверки удобно использовать инструменты браузера или команду curl:
curl -I https://example.com/author/admin/Если вы видите редирект, 404 или неожиданный заголовок, сначала разберитесь с темой, плагином кэша или SEO-плагином. Иногда meta robots выставлен правильно, но кэш отдает старую версию страницы.
Частые ошибки и как их исправить
Поставили noindex, но архив всё равно в индексе
Это нормально в краткосрочной перспективе. Поисковику нужно время, чтобы переобойти страницу. Если страница ещё и есть в sitemap, процесс может затянуться. Проверьте, что noindex реально отдается в HTML, а не только в настройках плагина.
Закрыли архивы robots.txt вместо noindex
Это частая ошибка. Если запретить обход через robots.txt, поисковик может не увидеть meta robots и не понять, что страницу надо убрать из индекса. Для удаления из поиска обычно полезнее noindex, а не блокировка обхода.
Сломали страницу автора, которая приносила трафик
Если у автора есть уникальная биография, подборка материалов и реальная поисковая ценность, не отключайте индексирование вслепую. Сначала посмотрите статистику и запросы. Иногда лучше оставить индексируемым только один-две авторские страницы, а остальные закрыть.
Забыли про кэш
После изменения robots-меток очистите кэш плагина, серверный кэш и CDN, если он есть. Иначе вы будете проверять старую версию страницы и решите, что настройка не сработала.
Практические советы по безопасности и производительности
Если вы вносите правки кодом, не редактируйте родительскую тему напрямую. Используйте дочернюю тему или mu-plugin, чтобы не потерять изменения после обновления. Это особенно важно, если на сайте несколько разработчиков и настройки SEO могут меняться параллельно.
Для сайтов с большим количеством архивов полезно держать логику простой: индексируются только те страницы, которые имеют самостоятельную ценность. Всё остальное — либо noindex, либо исключение из sitemap, либо редирект, если страница вообще не нужна пользователям.
Если вы уже используете Clearfy Pro, в нём есть инструменты для удаления дублей и технической чистки сайта. В таких задачах это может быть удобнее, чем собирать всё вручную, но всё равно проверяйте итоговый HTML и sitemap после изменений: настройки интерфейса не заменяют фактическую проверку ответа сервера.
Короткий чек-лист перед публикацией изменений
- Проверил, нужны ли архивы авторов и дат пользователям.
- Убедился, что
noindexотдается в HTML. - Проверил, что лишние архивы не попадают в sitemap.
- Очистил кэш сайта и CDN.
- Открыл страницу в режиме инкогнито и посмотрел исходный код.
- Сделал контрольный запрос через
curl -Iили аналогичный инструмент.
Если после этого архивы продолжают индексироваться, проблема обычно не в самом noindex, а в кэше, sitemap или в том, что на сайте есть ещё один источник этих URL — например, тема, SEO-плагин или кастомный генератор карты сайта.