Если в поиске начинают появляться страницы архивов и блога вида /page/2/, /page/3/ и дальше, это обычно не ошибка WordPress, а следствие того, как поисковик обходит пагинированные архивы. Задача здесь не в том, чтобы «сломать» пагинацию, а в том, чтобы аккуратно убрать такие страницы из индекса, не трогая сами рубрики, записи и другие важные разделы сайта.
На практике есть несколько рабочих способов: закрыть пагинированные страницы через noindex, ограничить их обход через robots.txt или настроить логику индексации на уровне SEO-плагина. Для большинства сайтов правильный вариант — noindex,follow для страниц пагинации. Он сохраняет переходы по ссылкам для роботов, но не просит поисковик хранить сами страницы в индексе.
Когда пагинацию действительно стоит убирать из индекса
Не каждая страница с номером страницы мешает сайту. Проблема обычно возникает в блогах, категориях товаров, тегах и других архивах, где в индекс попадают почти одинаковые страницы с повторяющимся списком записей. В результате поисковик тратит обход на второстепенные URL, а в выдаче могут всплывать не самые полезные страницы.
Убирать пагинацию из индекса имеет смысл, если:
- страницы 2, 3, 4 и далее почти не несут самостоятельной ценности;
- вы хотите, чтобы в поиске оставались только первые страницы архивов;
- на сайте много архивов, и поисковик индексирует их слишком активно;
- нужно снизить количество дублей и «тонких» страниц в индексе.
При этом сами архивы закрывать полностью не нужно. Если убрать из индекса и первую страницу рубрики, и все пагинированные страницы без разбора, можно потерять полезные точки входа из поиска.
Самый безопасный способ: noindex для страниц пагинации
Для WordPress обычно лучше всего работает метатег noindex на страницах пагинированных архивов. Поисковик видит страницу, может по ней пройти, но не должен добавлять её в индекс. Для ссылок внутри архива это удобно: робот всё равно добирается до следующих страниц, если ему это нужно.
Если у вас уже стоит SEO-плагин, сначала проверьте его настройки. Многие плагины умеют отдельно управлять индексированием архивов и пагинации. Это предпочтительнее ручных правок в теме, потому что после обновления темы код не сломается.
Как проверить, есть ли настройка в SEO-плагине
Откройте настройки плагина и ищите разделы, связанные с архивами, индексированием или метатегами robots. В зависимости от плагина логика может отличаться, но смысл один: для страниц пагинации должен быть установлен noindex, а не полное закрытие от обхода.
Если плагин позволяет задать правила для архивов отдельно, проверьте именно:
- рубрики;
- метки;
- авторские архивы;
- архивы дат;
- страницы пагинации этих архивов.
После сохранения настроек откройте страницу архива со второй или третьей страницей и посмотрите исходный код. В <head> должен появиться метатег robots с noindex. Если плагин ещё и ставит follow, это нормально для этой задачи.
Если плагина нет: добавить noindex через код
Когда SEO-плагин не используется или в нём нет нужной настройки, можно добавить правило в тему или, лучше, в дочернюю тему. Этот вариант подходит тем, кто понимает, где хранится код сайта и умеет откатить изменение при ошибке. Перед правкой сделайте резервную копию файлов темы.
Ниже пример для WordPress, который добавляет noindex,follow только на пагинированные страницы архивов. Он не затрагивает обычные записи и первую страницу архива.
add_filter( 'wp_robots', function( array $robots ) : array {
if ( is_paged() && ( is_home() || is_archive() ) ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Этот код использует встроенный фильтр WordPress wp_robots, который работает в современных версиях ядра. Если у вас очень старая версия WordPress, поведение может отличаться, но для актуальных установок этот способ штатный.
Что делает условие:
is_paged()— проверяет, что это не первая страница архива;is_home()— главная страница блога, если она у вас отдельная;is_archive()— архивы рубрик, меток, авторов и дат;noindex— просит не индексировать страницу;follow— не мешает обходу ссылок внутри страницы.
Если вам нужно закрыть только рубрики, а не все архивы, условие можно сузить до is_category(). Но делать это стоит только если вы понимаете структуру сайта и точно не хотите менять поведение других архивов.
Почему robots.txt обычно не решает задачу сам по себе
Иногда пытаются закрыть пагинацию через Disallow в robots.txt. Для этой задачи это не лучший первый шаг. Если запретить обход, поисковик может перестать видеть содержимое страницы и не всегда корректно обработает сигналы, которые вы хотели передать через ссылки и метатеги. Кроме того, URL может остаться в индексе как найденный ранее адрес без нормального обхода.
Robots.txt полезен, когда нужно ограничить обход технических разделов или тяжёлых файлов, но для пагинированных архивов WordPress чаще нужен именно noindex. Это более точный и предсказуемый инструмент.
Как не закрыть лишнее и не потерять важные разделы
Главная ошибка — ставить noindex на все архивы подряд, не проверив, какие страницы реально нужны в поиске. Если у сайта хорошо работают рубрики как посадочные страницы, закрывать их полностью не стоит. Если в индексе мешают только страницы 2+, ограничьте правило именно пагинацией.
Проверьте отдельно:
- главную страницу блога;
- первую страницу рубрики;
- вторую и последующие страницы той же рубрики;
- страницы тегов, если они у вас индексируются;
- архивы автора и даты, если они вообще нужны в поиске.
Если после настройки поисковик продолжает показывать старые URL, это не всегда означает, что правило не работает. Индексация обновляется не мгновенно. Сначала поисковик должен заново обойти страницу и увидеть новый robots-метатег.
Как проверить результат после настройки
Проверка простая и не требует специальных инструментов. Откройте страницу архива со второй или любой следующей страницей, например /category/news/page/2/, и посмотрите исходный код страницы. В <head> должен быть robots-метатег с noindex. Если вы используете SEO-плагин, он может добавить этот тег автоматически.
Дальше проверьте несколько моментов:
- первая страница архива не получила
noindexслучайно; - вторая и последующие страницы действительно закрыты;
- ссылки внутри архива по-прежнему доступны для перехода;
- в Search Console со временем уменьшается число проиндексированных пагинированных URL.
Если вы меняли код вручную, после обновления темы проверьте, не пропало ли правило. Для долгосрочного использования лучше держать такую логику в дочерней теме или в небольшом функциональном плагине, а не в файле, который часто перезаписывается.
Что выбрать на практике
| Способ | Когда подходит | Плюсы | Минусы |
|---|---|---|---|
| SEO-плагин | Если он уже установлен и умеет управлять robots | Безопасно, удобно, не зависит от правки темы | Нужно найти нужную настройку |
Код через wp_robots | Если плагина нет или нужна точная логика | Гибко и штатно для WordPress | Требует аккуратной правки и проверки |
| robots.txt | Редкие технические случаи | Просто добавить правило | Не лучший вариант для индексации пагинации |
Если нужен практичный и быстрый путь без ручного кода, обычно достаточно настроек SEO-плагина. Если вы ведёте сайт без плагина или хотите контролировать логику точнее, используйте фильтр wp_robots. Именно он позволяет убрать пагинацию из индексации в WordPress без лишних побочных эффектов и без закрытия нужных разделов сайта.