На WordPress старые archive-страницы часто копят мусор: страницы авторов без контента, теги с одной записью, архивы дат, вложения медиа, пагинация пустых рубрик. В итоге поисковик тратит краулинговый бюджет на страницы, которые не дают трафика и иногда дублируют уже существующие материалы. Задача здесь не в том, чтобы «всё запретить», а в том, чтобы оставить в индексе полезные архивы и убрать технический шум.
Ниже — рабочий сценарий: как найти проблемные архивы, чем их закрывать, где лучше использовать код, а где достаточно настроек SEO-плагина, и как проверить, что после правок сайт не потерял нужные страницы из поиска.
Когда archive-страницы становятся проблемой
Сама по себе архивная страница не вредна. Проблема начинается, когда на сайте появляются десятки или сотни URL, которые почти не отличаются друг от друга. Типичный пример: архивы тегов с одной записью, страницы авторов на сайте с одним редактором, архивы по датам без уникального контента, страницы вложений, которые дублируют медиафайл или запись.
Если такие URL уже проиндексированы, в Search Console обычно видно одну из двух картин: много страниц в индексе, но мало показов и кликов, либо «Просканировано — сейчас не проиндексировано» для большого числа архивов. Это не всегда критично, но почти всегда сигнал, что индексацию стоит почистить.
Что именно стоит проверить в первую очередь
- архивы тегов с низкой ценностью;
- архивы авторов на сайте с одним автором;
- архивы дат, если они не нужны пользователям;
- страницы вложений media attachment;
- пагинацию пустых или почти пустых архивов;
- дубли из-за разных вариантов URL с параметрами.
Диагностика: какие URL реально мешают
Не закрывайте всё подряд. Сначала посмотрите, какие архивы уже есть в индексе и какие из них получают переходы. Для этого достаточно трех источников: Google Search Console, отчета по страницам в SEO-плагине и обычного поиска по сайту через оператор site:.
Если у вас есть доступ к серверным логам или аналитике, полезно посмотреть, какие archive-URL чаще всего обходит бот. Иногда оказывается, что поисковик активно ходит по страницам, которые не несут пользы, а важные рубрики обходятся реже из-за лишнего мусора.
Для быстрой ручной проверки откройте несколько типовых архивов и сравните:
- есть ли на странице уникальный текст, а не только список записей;
- не дублируется ли title и description между разными архивами;
- не выглядит ли страница как пустой каталог без смысла для пользователя;
- есть ли внутренние ссылки, которые ведут в тупик.
Как закрывать архивы: плагин или код
Если сайт ведется через SEO-плагин, проще всего управлять индексированием там. Если нужна точечная логика — например, закрыть только архивы тегов, но оставить рубрики, — удобнее добавить небольшой код в тему или мини-плагин. Ниже — сравнение подходов.
| Подход | Когда подходит | Плюсы | Минусы |
|---|---|---|---|
| SEO-плагин | Нужно быстро закрыть типы архивов без кода | Просто, видно в интерфейсе, меньше риска | Не всегда хватает гибкости для точечных правил |
| Код | Нужна выборочная логика по типам архивов | Точный контроль, не зависит от интерфейса | Нужно аккуратно тестировать и обновлять |
| Комбинированный вариант | Часть архивов закрывается плагином, часть — кодом | Удобно для сложных сайтов | Важно не задвоить правила |
Пошаговое решение через код
Если вы хотите закрыть, например, архивы тегов и дат от индексации, но оставить рубрики доступными, можно использовать фильтр wp_robots. Он позволяет добавить директиву noindex для конкретных типов страниц.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_tag() || is_date() || is_author() ) {
$robots['noindex'] = true;
$robots['nofollow'] = false;
}
return $robots;
} );
Этот вариант работает на уровне robots meta и подходит для большинства типовых задач. Но важно понимать: noindex не равен запрету обхода. Страница может продолжать сканироваться, просто не должна попадать в индекс.
Если нужно убрать из индекса страницы вложений, можно дополнительно перенаправлять их на родительскую запись или файл, если это уместно для структуры сайта. Для медиа-страниц без ценности часто используют редирект на сам файл или на запись-источник.
<?php
add_action( 'template_redirect', function() {
if ( is_attachment() ) {
$parent = wp_get_post_parent_id( get_the_ID() );
if ( $parent ) {
wp_safe_redirect( get_permalink( $parent ), 301 );
exit;
}
wp_safe_redirect( home_url( '/' ), 301 );
exit;
}
} );
Такой редирект лучше применять только если вы уверены, что attachment-страницы не нужны пользователям и не несут трафика. Если на сайте есть медиа-архив как отдельный полезный раздел, редирект может навредить.
Настройка через SEO-плагин
Если на сайте уже стоит SEO-плагин, проще сначала решить задачу там. В большинстве случаев нужно отключить индексацию для архивов тегов, дат, авторов или медиа-страниц. Логика простая: оставляем индексируемыми только те архивы, которые реально помогают навигации и приносят трафик.
После изменения настроек не спешите массово удалять URL из индекса. Дайте поисковику переобойти страницы, а затем проверьте, как изменилось количество проиндексированных архивов и не исчезли ли важные рубрики.
Что важно не перепутать
noindex— это не то же самое, что удаление страницы;canonicalдолжен указывать на релевантную основную страницу, а не на случайный URL;- не закрывайте рубрики, если именно они собирают тематическую структуру сайта;
- не ставьте одновременно конфликтующие правила в плагине и в коде.
Проверка результата после внедрения
После настройки откройте несколько URL из каждой группы и проверьте исходный HTML. В коде страницы должна появиться директива noindex для тех архивов, которые вы закрывали. Если вы использовали редирект для вложений, убедитесь, что ответ сервера действительно 301, а не цепочка из нескольких переходов.
Проверять лучше в таком порядке:
- открыть страницу в браузере и убедиться, что она доступна или редиректится как задумано;
- посмотреть исходный код на наличие
noindex; - проверить заголовки ответа, если настроен редирект;
- отправить URL на повторную проверку в Search Console;
- через несколько дней сравнить статус индексации и количество обходов.
Если у вас есть доступ к консоли, можно быстро проверить заголовки так:
curl -I https://example.com/author/admin/
Для страниц, которые должны быть закрыты от индексации, ищите либо мета-robots в HTML, либо заголовок ответа, если вы используете серверные правила. Главное — не смешивать несколько механизмов без необходимости.
Частые ошибки и как их исправить
Самая распространенная ошибка — закрыть архив в robots.txt и считать задачу решенной. Это не всегда работает так, как ожидают: если страница уже известна поисковику, она может оставаться в индексе без полноценного обхода. Для удаления из индекса обычно нужен noindex или корректный редирект.
Еще одна ошибка — закрыть все архивы подряд. После этого сайт теряет внутреннюю структуру, а поисковику становится сложнее понимать тематические кластеры. Особенно осторожно нужно обращаться с рубриками: если они хорошо оформлены и полезны пользователю, их лучше оставить открытыми.
Третья проблема — дублирование правил. Например, SEO-плагин уже ставит noindex, а в теме дополнительно прописан свой фильтр. В итоге отладка превращается в угадывание, какой именно код сработал. Если есть плагин, сначала проверьте его настройки, а уже потом добавляйте код.
Короткий чек-лист перед публикацией изменений
- проверены типы архивов, которые реально нужны пользователям;
- не закрыты важные рубрики и посадочные архивы;
- нет конфликтов между плагином и кодом;
- страницы вложений либо редиректятся, либо осознанно оставлены;
- в Search Console отправлены на проверку только нужные URL;
- после правок не выросло число 404 и цепочек редиректов.
Практические советы по безопасности и производительности
Любые правки, связанные с индексированием, лучше вносить через дочернюю тему или мини-плагин, а не напрямую в файлы активной темы. Тогда обновление темы не затрет изменения. Перед внедрением сохраните резервную копию и проверьте код на тестовой копии сайта, если она есть.
Если архивов много, не пытайтесь решить всё через тяжелые плагины с лишними функциями. Для простой задачи часто достаточно одной-двух настроек и небольшого фрагмента кода. Это снижает риск конфликтов и упрощает поддержку.
Когда нужен более широкий аудит дублей, полезно посмотреть в сторону инструментов, которые умеют чистить технический мусор и управлять SEO-настройками без лишней нагрузки. Например, Clearfy Pro уместен именно как набор точечных технических опций, а не как замена ручной проверке.
В итоге рабочая схема выглядит так: сначала находите архивы без ценности, затем закрываете их точечно, после этого проверяете HTML, заголовки и статус в Search Console. Если на каком-то шаге результат не совпал с ожиданием, откатывайте только последнюю правку и проверяйте конфликт настроек, а не весь сайт целиком.