В WordPress дубли чаще всего появляются не из-за «плохого SEO-плагина», а из-за штатной логики: архивы тегов, авторов, дат, пагинация, страницы с параметрами, версии для печати, поиск по сайту. Если не контролировать индексирование, поисковик тратит краулинговый бюджет на мусорные URL, а в отчётах растёт число страниц без трафика.
Ниже — рабочая схема: как диагностировать проблему, что именно закрывать, чем отличается noindex от nofollow, и как проверить, что после правок сайт не потерял важные страницы.
Какие дубли в WordPress встречаются чаще всего
Сначала полезно понять источник. У WordPress дубли обычно появляются в нескольких местах:
- архивы тегов и рубрик, если они дублируют контент записей;
- страницы авторов, когда на сайте один автор или биографии пустые;
- архивы по датам, которые не несут самостоятельной ценности;
- страницы пагинации, если они индексируются без необходимости;
- URL с параметрами вроде
?replytocom=,?utm_,?ampили фильтрами; - служебные страницы поиска, вложений и медиа-страницы;
- дубли из-за HTTP/HTTPS, www/non-www или слэша на конце, если редиректы настроены криво.
Не все из этого нужно закрывать. Например, рубрики часто полезны для структуры сайта, а вот теги на небольшом сайте нередко только размножают тонкие страницы.
Диагностика: как найти, что именно индексируется
Перед правками проверьте, что уже попало в индекс и какие URL поисковик считает отдельными страницами. Для этого достаточно нескольких источников.
Что смотреть в первую очередь
- Google Search Console: отчёт по страницам и исключённым URL.
site:example.comв поиске — не как точный инструмент, а как быстрый сигнал.- Список URL в SEO-плагине: теги, архивы, авторы, медиа.
- Логи сервера или аналитика: какие служебные URL реально открывают боты и пользователи.
Если у вас есть доступ к консоли, полезно быстро проверить, нет ли в индексе мусорных параметров. Например:
site:example.com inurl:replytocomИли для поиска страниц автора, если на сайте один редактор:
site:example.com inurl:/author/Если такие URL находятся в заметном количестве, их имеет смысл закрывать или редиректить, но не вслепую. Сначала оцените, есть ли у них входящий трафик и внешние ссылки.
Что закрывать, а что оставить
Самая частая ошибка — ставить noindex на всё подряд. Это ломает структуру сайта и иногда мешает внутренней перелинковке. Проще ориентироваться на задачу страницы.
| Тип страницы | Обычно делать | Комментарий |
|---|---|---|
| Теги без трафика | noindex, follow | Если тегов много и они дублируют рубрики |
| Архивы авторов на блоге с одним автором | noindex, follow или отключить | Если страница не несёт самостоятельной пользы |
| Архивы дат | Обычно отключить | Редко нужны в индексе |
| Пагинация рубрик | Чаще оставить | Если страницы помогают обходу и навигации |
| Поиск по сайту | Закрыть | Результаты поиска почти всегда мусорные для индекса |
| Медиа-вложения | Редирект на файл или запись | Страницы вложений часто бесполезны |
Пошаговое решение через SEO-плагин
Если у вас уже стоит SEO-плагин, проще всего управлять индексированием через него. Логика обычно одна и та же: отключить индексацию для архивов, которые не нужны, и оставить те, что реально помогают навигации.
1. Отключите лишние архивы
Проверьте настройки архивов тегов, авторов и дат. На небольшом сайте часто достаточно:
- теги —
noindex; - архивы дат — отключить;
- архивы авторов — отключить, если автор один;
- медиа-страницы — редиректить на файл или запись.
Если используете Clearfy Pro, это можно делать через разделы чистки и SEO-настроек без ручного кода. Важно не включать сразу всё подряд: сначала меняйте один тип архивов, потом проверяйте результат в индексе.
2. Добавьте canonical там, где есть параметры
Если на сайте есть URL с параметрами фильтрации или сортировки, canonical должен указывать на основную версию страницы. Это не всегда решает проблему полностью, но помогает поисковику понять приоритетный URL.
3. Закройте поиск и служебные страницы
Страницы внутреннего поиска, страницы вложений и технические URL лучше не оставлять в индексе. Для поиска это особенно важно: такие страницы быстро плодят тонкие дубли.
Решение через код: когда плагина недостаточно
Если вы не хотите зависеть от плагина или нужно точечно закрыть конкретный тип архивов, используйте фильтры WordPress. Ниже — безопасный вариант для robots meta через wp_robots.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_tag() || is_author() || is_date() || is_search() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Этот код добавляет noindex, follow для тегов, авторов, дат и поиска. Он не ломает обход ссылок, но говорит поисковику не включать такие страницы в индекс.
Если нужно закрыть вложения и перенаправить их на родительскую запись, можно использовать редирект:
<?php
add_action( 'template_redirect', function() {
if ( is_attachment() ) {
$parent = get_post_field( 'post_parent', get_queried_object_id() );
if ( $parent ) {
wp_redirect( get_permalink( $parent ), 301 );
exit;
}
}
} );Такой вариант лучше, чем оставлять отдельную страницу вложения без контента. Но если у вложения есть самостоятельная ценность, например, это отдельная галерея, редирект может быть неуместен.
Проверка результата после внедрения
После изменений не ограничивайтесь просмотром кода страницы. Нужно проверить и HTML, и фактическое поведение бота.
- Откройте несколько закрытых URL и убедитесь, что в
<head>появилсяnoindex. - Проверьте, что важные страницы не получили случайный
noindex. - Посмотрите, не сломались ли canonical и пагинация.
- Убедитесь, что редиректы для вложений и служебных URL возвращают
301, а не302. - В Search Console отправьте на переобход несколько изменённых страниц и отслеживайте статус индексации.
Быстрая проверка через командную строку может выглядеть так:
curl -I https://example.com/tag/sample/
curl -I https://example.com/?s=testДля страниц, которые должны быть закрыты, вы не обязательно увидите X-Robots-Tag в заголовках, если используете мета-тег в HTML. Тогда проверяйте исходный код страницы и наличие noindex в блоке <head>.
Частые ошибки и как их исправить
Ставят noindex на рубрики, которые реально нужны
Это частая ошибка на контентных сайтах. Рубрика может быть полезной посадочной страницей, особенно если в ней есть описание, фильтрация и нормальная перелинковка. Если рубрика даёт трафик, не закрывайте её только потому, что она похожа на «архив».
Путают noindex и disallow в robots.txt
Disallow не удаляет URL из индекса, если на него уже есть ссылки. Для удаления из индекса нужен либо noindex, либо редирект, либо удаление страницы с корректным ответом сервера. Robots.txt полезен для экономии обхода, но не как единственный инструмент очистки индекса.
Закрывают страницы, но оставляют внутренние ссылки на них
Если в меню, хлебных крошках или блоках рекомендаций остаются ссылки на мусорные архивы, поисковик продолжит их находить. После закрытия лишних страниц проверьте навигацию и шаблоны темы.
Используют 302 вместо 301
Для постоянного переноса вложений, дублей с параметрами или старых URL нужен именно 301. Временный редирект может затянуть переобход и создать путаницу в индексации.
Ожидают мгновенного исчезновения из поиска
После правок поисковик не пересобирает индекс сразу. Это нормальное поведение. Сначала меняется статус страницы, потом она постепенно выпадает из выдачи или перестаёт обновляться.
Когда лучше решать проблему не кодом, а структурой сайта
Если дублей много, причина часто не в настройках, а в архитектуре контента. Например, на сайте с десятками тегов и короткими заметками проще сократить число тегов, чем бесконечно закрывать их от индексации. То же касается архивов авторов на сайте с одним редактором: иногда правильнее отключить их в шаблоне и убрать ссылки из интерфейса.
Для таких задач полезно сначала упростить структуру, а уже потом добивать точечные URL. Иначе вы получите набор исключений, который сложно поддерживать после обновления темы или плагинов.
Что проверить через неделю после правок
Через несколько дней или неделю после внедрения вернитесь к отчётам и посмотрите на динамику. Ищите не «идеальную цифру», а признаки, что сайт стал чище:
- меньше мусорных URL в отчётах по страницам;
- нет новых ошибок в обходе;
- важные страницы продолжают индексироваться;
- снижается число дублей с параметрами;
- поиск по сайту и служебные архивы не появляются в выдаче.
Если после закрытия тегов или авторов трафик упал на конкретные страницы, значит, вы закрыли не мусор, а полезный раздел. В таком случае верните индексацию и пересмотрите контент на этих страницах: возможно, им не хватало описания, внутренней перелинковки или уникального текста.