Дубли из-за пагинации — типичная проблема на новостных, блоговых и каталоговых сайтах. Один и тот же контент начинает индексироваться в нескольких вариантах: первая страница архива, страницы /page/2/, /page/3/, иногда ещё и версии с параметрами фильтрации. В итоге поисковик тратит краулинговый бюджет на второстепенные URL, а в индексе появляются слабые или повторяющиеся страницы.
Важно сразу разделить два сценария: пагинация в архиве записей и пагинация внутри отдельной статьи или страницы. Для архивов обычно нужен один подход, для многостраничных материалов — другой. Если перепутать их, можно случайно закрыть от индексации нужные страницы или сломать навигацию.
Как понять, что проблема именно в пагинации
Сначала проверьте, какие URL реально попали в индекс и как они выглядят в выдаче. Если в поиске есть страницы вида /category/news/page/2/, /tag/seo/page/3/ или /author/admin/page/2/, это уже сигнал. Дополнительно смотрите:
- дубли title и description у страниц архива;
- одинаковый текст на первой и последующих страницах архива;
- страницы пагинации без уникального контента, но с открытой индексацией;
- ошибки в
canonical, когда все страницы указывают на первую, хотя должны быть разнесены по логике сайта.
Для быстрой диагностики удобно открыть исходный код страницы и проверить тег <link rel="canonical">. На второй и третьей странице архива canonical должен вести на саму текущую страницу, а не на первую, если вы хотите сохранить корректную пагинацию для обхода и навигации. Если же задача — убрать из индекса именно страницы пагинации, canonical сам по себе не всегда решает вопрос.
Что делать: три рабочих подхода
Единого решения для всех сайтов нет. Выбор зависит от того, как устроен архив и что вы хотите получить в индексе. Ниже — практическое сравнение.
| Подход | Когда подходит | Плюсы | Минусы |
|---|---|---|---|
| Плагин для SEO | Нужно быстро закрыть архивы и не лезть в код | Меньше ручной работы, есть настройки canonical и robots | Зависимость от плагина, не всегда тонкая настройка |
| Код в теме или мини-плагине | Нужен точечный контроль над архивами и мета-тегами | Прозрачная логика, без лишних функций | Нужно аккуратно тестировать после обновлений |
| Комбинация robots + canonical | Нужно уменьшить индексирование и сохранить обход | Гибкий вариант для крупных сайтов | Требует проверки на каждом типе архива |
Вариант 1: закрыть пагинацию архивов от индексации через код
Если у вас кастомная тема или вы хотите обойтись без лишнего плагина, можно добавить noindex,follow для страниц пагинации архивов. Это не удаляет URL из обхода, но снижает вероятность попадания в индекс. Код лучше размещать в мини-плагине или в functions.php дочерней темы.
add_action( 'wp_head', function () {
if ( is_paged() && ( is_home() || is_archive() || is_search() ) ) {
echo '<meta name="robots" content="noindex,follow" />' . "\n";
}
}, 1 );Этот вариант полезен, если вы хотите оставить ссылки на следующие страницы доступными для робота, но не показывать их в выдаче. Для поиска это обычно безопаснее, чем полностью закрывать пагинацию в robots.txt.
Вариант 2: поправить canonical для архивов
Если SEO-плагин или тема генерируют неверный canonical, поисковик может считать страницы дублями даже при нормальной навигации. Для архивов canonical должен быть самоссылочным: страница /page/2/ должна ссылаться на себя, а не на первую страницу архива. Если canonical уже корректный, не трогайте его без необходимости.
Проверить и при необходимости переопределить canonical можно через фильтр wpseo_canonical, если используется Yoast SEO, или через соответствующий фильтр вашего SEO-плагина. Но если вы не уверены в конкретном плагине, лучше не писать универсальный «хак» на все случаи: он часто ломает другие типы страниц.
Более безопасный путь — сначала найти источник ошибки. Часто проблема не в WordPress, а в теме, которая вручную выводит canonical в <head> поверх SEO-плагина.
Вариант 3: убрать лишние архивы из индекса целиком
На небольших сайтах иногда проще не индексировать теги, авторские архивы и часть рубрик, если они не несут самостоятельной ценности. Это не про пагинацию как таковую, но на практике именно такие архивы создают больше всего дублей. Если архив пустой по смыслу, его лучше закрыть на уровне SEO-настроек или через noindex.
Например, в Yoast SEO можно отключить индексацию отдельных типов архивов в настройках. В этом случае не нужно городить ручной код для каждой таксономии. Но если у вас сложная структура и часть архивов должна индексироваться, а часть нет, код даёт больше контроля.
Диагностика перед изменениями
Перед правками зафиксируйте исходное состояние. Это поможет понять, что именно сработало, а что нет.
- Проверьте 3–5 URL с пагинацией в браузере и в исходном коде.
- Сравните canonical на первой и последующих страницах архива.
- Посмотрите, не закрыты ли нужные страницы в
robots.txt. - Проверьте, нет ли дублей title и description в SEO-плагине.
- Убедитесь, что тема не выводит второй canonical вручную.
Если у вас есть доступ к Search Console, посмотрите отчёт по страницам и исключённым URL. Там часто видно, какие типы страниц поисковик считает дублями или «просканированными, но не проиндексированными».
Пошаговое решение без лишнего риска
Для большинства сайтов рабочая схема выглядит так:
- Оставить пагинацию доступной для обхода.
- Добавить
noindex,followна страницы архивов, которые не должны ранжироваться. - Проверить canonical, чтобы он не конфликтовал с логикой SEO-плагина.
- Закрыть от индексации только те архивы, которые реально не нужны в поиске.
- Не трогать
robots.txtбез необходимости, если цель — именно убрать дубли из индекса, а не запретить обход.
Если сайт большой, изменения лучше внедрять поэтапно: сначала одна рубрика или один тип архива, потом остальные. Так проще отследить побочные эффекты.
Проверка результата после внедрения
После правок не ограничивайтесь визуальной проверкой. Нужно убедиться, что поисковый робот видит именно то, что вы задумали.
- Откройте страницу архива с пагинацией и проверьте наличие
meta robots. - Убедитесь, что canonical указывает на правильный URL.
- Проверьте, что ссылки на следующую и предыдущую страницы архива работают.
- В Search Console отправьте URL на повторную проверку после индексации.
- Сравните статус страниц через несколько дней или недель, а не сразу после публикации правок.
Если вы используете кэш-плагин, очистите кэш после изменений. Иначе в браузере вы можете видеть старую версию страницы, а не актуальную разметку.
Частые ошибки и как их исправить
Закрыли пагинацию в robots.txt
Это частая ошибка. Если запретить обход /page/ в robots.txt, поисковик может не увидеть canonical и другие сигналы. В результате URL останутся в индексе как «запрещённые к сканированию», а не исчезнут нормально. Для удаления дублей чаще нужен noindex, а не запрет обхода.
Поставили noindex на все архивы без разбора
Так можно случайно убрать из поиска полезные страницы рубрик или авторов, которые реально приводят трафик. Сначала проверьте, какие архивы у вас ранжируются и какие дают переходы. Не закрывайте всё подряд.
Оставили два canonical одновременно
Если тема и SEO-плагин оба выводят canonical, поисковик получает конфликтующие сигналы. Это нужно исправлять в теме или в настройках плагина, а не добавлять третий canonical поверх первых двух.
Не проверили пагинацию внутри контента
На многостраничных статьях WordPress использует теги <!--nextpage-->. Если вы меняете логику архивов, не перепутайте её с постраничным разбиением одной записи. Там другой сценарий индексации и другая логика canonical.
Практические советы по безопасности и производительности
Любые изменения в functions.php лучше вносить в дочернюю тему или мини-плагин. Так вы не потеряете правки после обновления темы. Перед внедрением сделайте резервную копию файлов и базы, особенно если будете трогать SEO-логику или шаблоны архива.
Если сайт работает на тяжёлой теме и архивы генерируют много лишних запросов, имеет смысл отдельно посмотреть на производительность шаблонов. Иногда проблема дублей идёт вместе с медленной загрузкой страниц пагинации: лишние блоки, тяжёлые виджеты, повторные запросы к базе. В таком случае сначала упрощайте шаблон архива, потом уже правьте мета-теги.
Для сайтов, где нужно системно чистить дубли, мета-теги и служебные страницы, удобно использовать SEO-утилиты вроде Clearfy Pro: он помогает закрывать типовые дубли и управлять техническими настройками без ручного разбрасывания кода по теме. Если нужен именно плагинный путь, смотрите на то, чтобы он не конфликтовал с уже установленным SEO-решением.
Если после изменений страницы пагинации всё ещё попадают в индекс, не пытайтесь «дожать» ситуацию массовыми редиректами на первую страницу. Это часто ухудшает навигацию и может создать новые ошибки обхода. Лучше сначала проверить, не генерирует ли тема лишние URL с параметрами, и только потом принимать решение по редиректам.