WordPress Notes WPBit

Как отключить индексацию страниц пагинации в WordPress без потери трафика

Страницы пагинации вроде /page/2/, /page/3/ часто попадают в индекс, хотя сами по себе редко нужны в поиске. Проблема обычно не в том, что они существуют, а в том, что поисковик тратит на них обход, а в выдаче начинают всплывать слабые служебные страницы вместо основных материалов. При этом закрывать пагинацию нужно аккуратно: если сделать это грубо, можно сломать переходы по архивам, canonical или внутреннюю перелинковку.

Ниже — рабочий сценарий для WordPress: как диагностировать ситуацию, что именно закрывать, чем отличается noindex от disallow, и как проверить, что после изменений сайт не потерял доступность для обхода.

Когда пагинация действительно мешает

Не каждая пагинированная страница требует вмешательства. Если у вас большой архив записей, каталог материалов или рубрика с десятками страниц, поисковик может использовать пагинацию как путь к глубоким материалам. Но если на страницах 2–10 дублируются заголовки, метаописания и блоки с почти одинаковым списком постов, это уже технический шум.

Типичные признаки проблемы

  • в Google Search Console появляются URL вида /page/2/, /page/3/ и дальше;
  • в выдаче ранжируются не записи, а архивные страницы;
  • на страницах пагинации одинаковые title и meta description;
  • в логах обхода много запросов к страницам, которые не дают новой ценности;
  • внутренние ссылки ведут на архив, а не на конкретные материалы.

Диагностика: что именно индексируется сейчас

Перед правками проверьте, как WordPress и тема отдают пагинацию. Откройте несколько URL вручную и посмотрите исходный код страницы. Важно понять три вещи: есть ли noindex, не закрыт ли путь в robots.txt, и не конфликтует ли canonical с реальным адресом.

Что смотреть в исходнике

  • <meta name="robots" content="noindex,follow"> или другой вариант robots;
  • <link rel="canonical" href="..."> — должен указывать на саму пагинированную страницу или на корректный канонический URL по вашей логике;
  • нет ли дублирующего SEO-плагина, который переписывает метатеги поверх темы;
  • не отдает ли сервер редирект на первую страницу архива.

Если у вас установлен SEO-плагин, сначала проверьте его настройки. Часто задача решается без кода, а ручной фильтр нужен только для нестандартной темы или сложной логики архивов.

Что выбрать: noindex, robots.txt или редирект

Для пагинации в WordPress обычно безопаснее использовать noindex,follow. Это значит, что страница не должна попадать в индекс, но поисковый робот может переходить по ссылкам дальше. Полный запрет в robots.txt хуже для диагностики: URL может остаться в индексе без возможности переобхода, а поисковик не увидит мета-тег noindex.

ПодходКогда уместенМинус
noindex,followДля архивов, рубрик, тегов с пагинациейНужно следить за canonical и SEO-плагином
Disallow в robots.txtРедко, если нужно ограничить обход служебных URLURL может дольше выпадать из индекса
Редирект на первую страницуПочти никогда для архивовЛомает навигацию и ухудшает UX

Пошаговое решение через SEO-плагин

Если вы используете плагин, который умеет управлять мета-роботами архивов, начните с него. В большинстве случаев это проще и безопаснее, чем править тему. Смысл такой: для архивов и их страниц пагинации задается noindex,follow, а canonical остается корректным.

Если в плагине есть отдельная настройка для архивов, проверьте, не отключает ли она случайно индексацию всех страниц рубрик целиком. Это частая ошибка: владелец сайта хотел закрыть только /page/2/, а получил noindex на весь архив.

Когда нужен код

Код имеет смысл, если SEO-плагин не дает нужной гранулярности, тема переопределяет метатеги, или вы хотите закрывать только пагинацию конкретных типов архивов. В этом случае можно использовать фильтр wp_robots, который есть в современных версиях WordPress.

<?php
add_filter( 'wp_robots', function( array $robots ) {
    if ( is_paged() && ( is_archive() || is_home() || is_search() ) ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Этот вариант работает на уровне генерации robots-метатега. Он не трогает контент страницы и не ломает навигацию. Но применять его нужно осознанно: если у вас есть архивы, которые должны индексироваться, добавьте условия точнее.

Более точечный вариант: закрыть только пагинацию рубрик

Иногда проблема не во всех архивах, а только в рубриках с большим количеством страниц. Тогда лучше ограничить правило только для категорий. Это уменьшает риск случайно закрыть полезные архивы авторов, поиска или пользовательских таксономий.

<?php
add_filter( 'wp_robots', function( array $robots ) {
    if ( is_paged() && is_category() ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Если тема выводит собственный canonical, проверьте, что он не указывает на первую страницу рубрики для всех страниц пагинации. Для пагинированных архивов canonical должен быть логичным и стабильным, иначе поисковик начнет игнорировать ваши сигналы.

Проверка результата после внедрения

После правок не ограничивайтесь просмотром страницы в браузере. Нужно проверить именно то, что увидит робот.

  • Откройте /page/2/ и проверьте исходный код.
  • Убедитесь, что в robots есть noindex и follow.
  • Проверьте canonical: он должен быть ожидаемым, без лишних редиректов.
  • Посмотрите, не изменился ли статус ответа сервера на 200 или 301 без причины.
  • В Search Console отправьте URL на проверку и дождитесь повторного обхода.

Если используете кэш, очистите его после изменения кода или настроек SEO-плагина. Иначе вы можете смотреть старую версию страницы и сделать ложный вывод, что правило не сработало.

Как быстро проверить через браузер

Откройте исходный код страницы и найдите строку с robots. Если нужно проверить с сервера, можно использовать curl:

curl -I https://example.com/category/news/page/2/

Команда покажет статус ответа и редиректы. Для проверки мета-тегов нужен уже HTML-ответ:

curl -s https://example.com/category/news/page/2/ | grep -i robots

Частые ошибки и как их исправить

1. Закрыли пагинацию в robots.txt

Это не лучший первый шаг. Если URL уже в индексе, поисковик может дольше убирать его из выдачи, а вы не увидите мета-робот на самой странице. Исправление: уберите запрет из robots.txt и поставьте noindex,follow на уровне HTML.

2. Поставили noindex на все архивы

Такое случается, когда правило написано слишком широко. В результате из поиска исчезают полезные рубрики и страницы навигации. Исправление: сузьте условие до is_paged() и нужного типа архива.

3. Canonical указывает на первую страницу

Это конфликтует с логикой пагинации. Поисковик может игнорировать часть сигналов или склеивать страницы не так, как вы ожидаете. Исправление: проверьте, не переписывает ли canonical SEO-плагин, тема или кастомный код.

4. Кэш мешает увидеть изменения

После настройки мета-тегов старый HTML может оставаться в кэше страницы, CDN или браузера. Исправление: очистите все уровни кэширования и повторно проверьте исходник.

Практические советы по безопасности и производительности

Не вносите такие правки прямо в файл темы, если он обновляется. Лучше использовать дочернюю тему или небольшой mu-plugin. Тогда изменение не потеряется после апдейта. Если правка касается только robots-метатега, mu-plugin часто удобнее: он включается всегда и не зависит от активной темы.

Если на сайте много архивов и пагинации, полезно дополнительно проверить внутреннюю перелинковку. Сильная пагинация сама по себе не решает проблему индексации, если на архивы ведут десятки лишних ссылок из меню, виджетов и блоков «похожие записи».

Для сайтов, где техническая чистка и SEO-настройки часто пересекаются, удобно держать под рукой инструменты вроде Clearfy Pro: он закрывает часть типовых задач по дублям, служебным страницам и техническим настройкам без ручного кода. Но даже с плагином проверка исходного HTML и Search Console остается обязательной.

Когда лучше не трогать пагинацию

Если у вас небольшой сайт и каждая страница архива реально помогает пользователю находить контент, закрывать пагинацию только ради «чистоты» не стоит. В таком случае лучше сначала улучшить заголовки, описания, хлебные крошки и структуру рубрик. Техническое решение должно следовать за задачей, а не подменять ее.

Если же пагинация уже создает шум в индексе, начинайте с noindex,follow, проверяйте canonical и только потом решайте, нужно ли дополнительно менять структуру архивов или навигацию.

×
Сделай WordPress мощнее!

Скидка -20% на топовые премиум плагины

Выбрать плагин сейчас ⋙