Пагинация в WordPress почти всегда нужна, если в рубрике или блоге много записей. Проблема начинается там, где страницы /page/2/, /page/3/ и дальше начинают выглядеть для поисковика как почти одинаковые документы: заголовки те же, список записей тот же, а полезного уникального контента мало. Если не настроить это аккуратно, сайт получает лишние URL в индексе, а сигналы ранжирования размазываются между страницами архива.
Хорошая новость в том, что в WordPress не нужно изобретать сложную схему. Обычно достаточно правильно настроить саму пагинацию, не ломать канонические адреса и понимать, какие архивы вообще стоит отдавать в индекс, а какие — нет.
Что именно создаёт дубли в пагинации
Когда WordPress выводит архив записей, он делит список на страницы. Первая страница рубрики обычно открывается по адресу самой рубрики, а следующие — по адресам вида /category/news/page/2/. Формально это разные URL, но содержимое у них очень похоже: меняется только набор записей ниже по списку.
Для поисковой системы это не всегда проблема сама по себе. Проблема появляется, если:
- на страницах пагинации почти нет уникального текста;
- все страницы архива попадают в индекс без необходимости;
- тема или плагин неправильно формируют
canonical; - фильтры, сортировки и параметры в URL создают дополнительные варианты одного и того же архива;
- вместо обычной пагинации используется бесконечная подгрузка без нормальных URL, а старые адреса всё равно остаются доступны.
В блоге и рубриках это особенно заметно: первая страница часто важна как витрина, а страницы 2, 3, 4 и далее редко несут самостоятельную ценность для поиска. Поэтому задача не в том, чтобы полностью запретить пагинацию, а в том, чтобы не плодить лишние версии одного архива.
Что нужно сделать в WordPress в первую очередь
Начинать стоит не с robots.txt и не с массового закрытия страниц от индексации, а с проверки базовой настройки самих архивов. В WordPress пагинация должна работать штатно: ссылки на следующую страницу должны вести на реальные URL, а не на дубли через параметры вроде ?paged=2, если тема это может избежать.
Проверьте три вещи:
- В теме используется стандартная пагинация WordPress через
paginate_links()или аналогичный корректный механизм. - Первая страница архива открывается по чистому адресу рубрики или блога, а не по
/page/1/. - На страницах пагинации есть корректный тег
canonical, который указывает на саму страницу, а не на первую страницу архива без причины.
Если тема написана нормально, этого уже достаточно, чтобы не создавать технических дублей на уровне URL. Если же тема старая или самописная, именно здесь чаще всего и появляются проблемы.
Какой вариант индексации выбрать для страниц 2, 3, 4 и далее
Универсального ответа нет: всё зависит от того, зачем вам архив вообще нужен. Для большинства блогов и контентных сайтов рабочая схема такая: первую страницу рубрики оставляют в индексе, а страницы пагинации не пытаются продвигать как самостоятельные посадочные. Они нужны пользователю для навигации, но не как отдельные целевые страницы.
На практике есть два подхода.
| Подход | Когда подходит | Что даёт |
|---|---|---|
| Оставить пагинацию доступной, но не делать её отдельной SEO-целью | Обычный блог, рубрики, новостные архивы | Поисковик видит структуру сайта, а лишние страницы не конкурируют с основными |
| Закрыть архивы пагинации от индексации | Если архивы почти не несут ценности и в индексе уже много мусора | Снижает количество слабых страниц в поиске |
Для большинства сайтов лучше первый вариант. Полное закрытие пагинации имеет смысл только тогда, когда вы понимаете, что именно хотите убрать из индекса и не потеряете полезные переходы из поиска по архивам.
Как правильно настроить canonical и meta robots
Если на сайте уже есть дубли, сначала проверьте, что отдают страницы пагинации. В исходном коде страницы /page/2/ должен быть свой canonical, а не ссылка на первую страницу архива, если страница действительно существует и доступна пользователю. Иначе поисковик может начать путаться: одна страница показывает список записей, а канонической объявлена другая.
Для WordPress это обычно делает сама тема или SEO-плагин. Важно не сломать логику вручную. Частая ошибка — прописать для всех страниц архива один и тот же canonical на первую страницу. Это выглядит как попытка «склеить» страницы, но на практике может ухудшить обход и индексацию, потому что поисковик получает противоречивые сигналы.
Если вы хотите закрыть именно страницы пагинации от индексации, а не весь архив, используйте noindex,follow только там, где это действительно нужно. Но не смешивайте это с запретом обхода через robots.txt: если страницу нельзя обходить, поисковик не увидит её содержимое и не сможет нормально учитывать ссылки внутри архива. Для пагинации это часто плохая идея.
Когда стоит править тему, а когда достаточно SEO-плагина
Если проблема только в мета-тегах, обычно достаточно SEO-плагина. Он умеет управлять canonical, noindex и заголовками архивов без правки шаблонов. Но если пагинация в теме собрана криво, плагин не исправит всё: он не заменит неправильную разметку ссылок и не уберёт дубли, которые создаёт сама тема.
Править тему нужно, если:
- страницы пагинации имеют одинаковые URL с параметрами и чистыми адресами одновременно;
- первая страница архива дублируется через
/page/1/; - в шаблоне архива вручную выведены одинаковые блоки на всех страницах без логики;
- пагинация генерируется нестандартно и ломает навигацию.
Если же у вас обычная тема и проблема только в том, что в индексе слишком много архивных страниц, проще настроить это через SEO-плагин или через фильтры WordPress, чем переписывать шаблоны.
Как проверить, что пагинация настроена нормально
После настройки откройте несколько страниц рубрики вручную: первую, вторую и третью. Проверьте три вещи.
- Адреса страниц разные и не содержат лишних параметров.
- На каждой странице есть свой заголовок и корректный
canonical. - Страница 2 не редиректит на первую без причины и не отдаёт ошибку.
Затем посмотрите исходный код страницы и найдите rel="canonical". Если вы используете SEO-плагин, проверьте его настройки для архивов и пагинации. Если плагина нет, убедитесь, что тема сама не подставляет неправильный canonical.
Дополнительно полезно открыть site:вашдомен.ru/page/2/ в поиске и посмотреть, какие страницы уже попали в индекс. Это не точный технический инструмент, но он помогает быстро понять, есть ли проблема с массовой индексацией архивов.
Что обычно ломает пагинацию и создаёт лишние дубли
На практике чаще всего мешают не сами страницы пагинации, а ошибки вокруг них. Вот что встречается особенно часто:
- одинаковые title и description на всех страницах архива;
- canonical на первую страницу для всех страниц пагинации;
- дублирующие архивы по тегам, рубрикам и автору без необходимости;
- страницы с сортировкой по параметрам URL, которые индексируются отдельно;
- неправильная настройка главной страницы блога, из-за которой
/blog/page/2/и/page/2/начинают конфликтовать.
Если у вас уже есть много похожих архивных страниц, не пытайтесь лечить это только закрытием в robots.txt. Сначала уберите причину дублей, а потом решайте, какие URL должны остаться доступными для поиска.
Практичная схема для блога и рубрик
Если нужен короткий рабочий ориентир, используйте такую схему:
- пагинацию оставьте включённой, чтобы пользователь мог листать архивы;
- проверьте, что первая страница рубрики открывается по чистому адресу;
- убедитесь, что у страниц 2, 3, 4 и далее корректный canonical;
- не делайте одинаковые title для всех страниц архива;
- не закрывайте пагинацию в robots.txt без необходимости;
- если архивы не нужны в поиске, закрывайте их точечно через
noindex, а не ломайте доступность страниц.
Такой подход обычно решает основную проблему: страницы пагинации остаются полезными для навигации, но не превращаются в источник дублей и не размывают индексацию сайта.
Если на сайте уже накопилось много архивных дублей, иногда проще сначала привести в порядок тему и настройки SEO-плагина, а потом уже смотреть, нужно ли дополнительно чистить индекс. В WordPress это почти всегда даёт лучший результат, чем попытка одним запретом закрыть всё подряд.