Проблема с пагинацией в WordPress обычно всплывает не в момент запуска сайта, а когда в индексе уже лежат десятки похожих URL: архивы страниц, рубрики с /page/2/, теги, авторские архивы, результаты поиска и служебные страницы. Поисковик тратит обход на мусорные дубли, а важные URL получают меньше внимания. При этом грубое решение в стиле «закрыть всё подряд» часто ломает навигацию и ухудшает внутреннюю перелинковку.
Ниже — рабочая схема: как понять, что именно дублируется, что закрывать через noindex, где уместен canonical, и как проверить, что после правок сайт не потерял полезные страницы из индекса.
Когда пагинация становится проблемой
Не каждая страница /page/2/ — ошибка. Для больших рубрик и архивов пагинация нужна, чтобы пользователь и бот могли добраться до старых материалов. Проблема начинается, когда в индексе оказываются:
- страницы пагинации с почти одинаковыми заголовками и описаниями;
- архивы тегов, которые дублируют рубрики по смыслу;
- страницы поиска, сортировки и фильтров, если они есть;
- пустые или малонаполненные архивы автора;
- страницы с параметрами, которые создают новые URL без новой ценности.
Если сайт небольшой и у него 2–3 рубрики, закрывать пагинацию обычно не нужно. Если же у вас сотни материалов, а в Search Console растёт число «Просканировано, но не проиндексировано», стоит проверить именно дубли архивов.
Диагностика: что именно индексируется лишнего
Сначала не трогайте настройки. Посмотрите, какие типы URL реально попали в индекс и как они выглядят в выдаче. Удобно начать с трёх проверок.
1. Поиск по сайту и оператор site:
Проверьте, есть ли в индексе страницы пагинации и служебные архивы:
site:example.com/page/
site:example.com/tag/
site:example.com/author/
site:example.com/?s=
Если поисковик показывает много страниц, которые не несут самостоятельной ценности, это уже повод для настройки.
2. Отчёт «Страницы» в Google Search Console
Смотрите не только на количество исключённых URL, но и на причины. Для этой задачи важны статусы вроде «Просканировано, но не проиндексировано», «Дублирующаяся страница, выбран другой канонический URL» и «Обнаружено, но не проиндексировано». Если таких URL много именно в архивах, значит, поисковик видит повторяющийся шаблон.
3. Проверка исходного кода
Откройте несколько страниц пагинации и посмотрите, есть ли там корректный canonical и не закрыта ли страница случайно от индексации. Если тема или SEO-плагин уже добавляет мета-теги, не дублируйте их в коде вручную.
Что закрывать, а что оставить
Здесь важна не универсальная схема, а разделение по типам страниц. Для большинства проектов работает такой подход:
| Тип URL | Что делать | Комментарий |
|---|---|---|
| Рубрики с полезной навигацией | Оставить в индексе | Если архив помогает найти контент и содержит уникальный текст |
| Страницы пагинации рубрик | Чаще оставить, но следить за canonical | Не стоит массово закрывать, если это основной путь к старым постам |
| Теги-дубли | Закрыть или удалить | Если теговая страница повторяет рубрику и не даёт новой ценности |
| Авторские архивы | Зависит от сайта | На новостных и экспертных проектах могут быть полезны, на корпоративных — часто лишние |
| Поиск по сайту и параметры URL | Закрыть | Обычно не должны попадать в индекс |
Пошаговое решение: как убрать дубли без поломки навигации
Ниже — безопасная последовательность. Она подходит, если у вас обычный WordPress без сложной кастомной логики.
Шаг 1. Закройте служебные страницы от индексации
Если у вас есть доступ к SEO-плагину, используйте его настройки для noindex на поиске, тегах, авторах и архиве дат, если они не нужны. Это лучше, чем править шаблоны вручную, потому что плагин обычно сам ставит корректный meta robots.
Если нужно сделать это кодом, можно добавить фильтр в functions.php дочерней темы или в мини-плагин:
add_filter('wp_robots', function (array $robots) {
if (is_search() || is_tag() || is_date() || is_author()) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
});
Этот вариант не трогает рубрики и записи. Он только добавляет директивы для страниц, которые чаще всего создают мусор в индексе.
Шаг 2. Не ломайте пагинацию рубрик и архивов
Распространённая ошибка — ставить noindex на все страницы с /page/2/. Так делать можно только после анализа конкретного сайта. Если рубрика большая и в ней есть полезные материалы на второй, третьей и последующих страницах, закрытие пагинации может ухудшить обход старых записей.
Если проблема именно в дублирующихся заголовках и описаниях, лучше исправить шаблон архива: сделать уникальный <title> для страниц пагинации и не дублировать одинаковый текст в шапке каждого архива.
add_filter('document_title_parts', function (array $parts) {
if (is_paged()) {
$paged = max(2, get_query_var('paged'));
$parts['title'] = $parts['title'] . ' — страница ' . $paged;
}
return $parts;
});
Это не магия SEO, а просто способ убрать одинаковые title на всех страницах архива. Для поисковика это полезнее, чем бездумно прятать всё в noindex.
Шаг 3. Проверьте canonical на страницах пагинации
На страницах /page/2/ canonical должен указывать на саму страницу пагинации, а не на первую страницу архива, если вы хотите, чтобы бот понимал структуру раздела. Некоторые плагины и темы ошибочно ставят canonical на первую страницу, из-за чего в индексе остаётся только первая часть архива.
Если у вас есть SEO-плагин, проверьте его настройку canonical для архивов. Если canonical формируется темой, не дублируйте его вручную в шаблоне.
Шаг 4. Уберите лишние архивы, если они не нужны
На небольших корпоративных сайтах часто достаточно рубрик и записей. Теги, архивы по датам и авторские страницы могут только раздувать индекс. В таком случае лучше либо отключить вывод этих архивов в интерфейсе, либо закрыть их от индексации, либо удалить лишние таксономии совсем.
Если вы используете плагин для технической чистки сайта, например Clearfy Pro, его удобно применять именно для таких задач: отключение ненужных архивов, чистка дублей и служебных страниц. Но перед включением любой опции проверьте, не зависит ли от неё навигация или хлебные крошки.
Проверка результата после внедрения
После правок не ограничивайтесь просмотром исходника. Нужно проверить и код страницы, и поведение поисковика.
- Откройте несколько страниц рубрик, тегов и пагинации в браузере.
- Посмотрите исходный код: есть ли
noindexтам, где он нужен, и нет ли его на полезных страницах. - Проверьте
canonicalна страницах/page/2/. - В Search Console отправьте на повторную проверку важные URL, если меняли индексацию.
- Через несколько дней сравните отчёт по страницам и количество дублей.
Если после изменений из индекса исчезли полезные архивы, значит, вы закрыли слишком много. Если же мусорные URL всё ещё активно сканируются, проблема может быть не в meta robots, а в внутренних ссылках: например, теги и фильтры продолжают генерировать новые адреса.
Частые ошибки и как их исправить
Ставят noindex на все архивы подряд
Так делают, когда хотят быстро «почистить индекс». Итог — поисковик хуже понимает структуру сайта, а старые записи становятся менее доступны через рубрики. Исправление простое: оставьте в индексе полезные рубрики, а закрывайте только служебные и пустые архивы.
Закрывают пагинацию в robots.txt
Это грубый приём. Если URL запрещён в robots.txt, поисковик может не увидеть meta robots и canonical на странице. В результате дубли не исчезают корректно, а диагностика становится сложнее. Для индексации лучше использовать noindex, а не блокировку обхода, если речь о страницах, которые уже известны поисковику.
Дублируют настройки в плагине и в теме
Например, SEO-плагин уже выводит canonical и meta robots, а в шаблоне дополнительно вставлены свои теги. Это приводит к конфликтам и непредсказуемому HTML. Исправление: оставьте один источник правды — либо плагин, либо код темы.
Не проверяют пагинацию после смены шаблона
После редизайна часто меняются title, хлебные крошки и ссылки на страницы архива. Если не проверить /page/2/ и дальше, можно случайно сломать доступ к старым материалам. Минимум — открыть несколько страниц вручную и посмотреть, что ссылки работают и не ведут на 404.
Практические советы по безопасности и производительности
Любые правки, связанные с индексацией, лучше вносить не в основной файл темы, а в дочернюю тему или мини-плагин. Тогда обновление шаблона не затрёт изменения.
Если вы добавляете код в functions.php, сначала проверьте его на staging-копии. Ошибка в фильтре wp_robots или в логике is_paged() может затронуть сразу весь сайт.
Для производительности полезно не только закрывать лишнее, но и уменьшать число внутренних ссылок на мусорные URL. Если в сайдбаре, футере или блоках рекомендаций выводятся теги и архивы, которые вы уже решили не индексировать, имеет смысл убрать их из шаблонов. Это снижает шум и для пользователей, и для бота.
Если нужен быстрый путь без ручного кода
Когда на сайте нет разработчика под рукой, проще использовать SEO-плагин или инструмент для технической чистки. Но даже в этом случае не включайте все опции подряд. Сначала определите, какие архивы реально нужны. На проектах, где важна именно техническая гигиена, обычно достаточно точечной настройки: закрыть поиск, теги-дубли, архивы дат и лишние служебные страницы, а рубрики оставить доступными.
Если вы используете Clearfy Pro, его логика как раз подходит для такой точечной чистки: убрать дубли, отключить ненужные элементы и не переписывать тему вручную. Но итог всё равно нужно проверять по исходному коду и в Search Console — без этого легко закрыть не то, что планировали.
Главный критерий успеха здесь простой: в индексе остаются полезные страницы, а служебные и повторяющиеся URL перестают засорять отчёты. Если это так, значит, настройка сработала.