Страницы с параметрами в WordPress появляются чаще, чем кажется: сортировка, фильтры, UTM-метки, внутренний поиск, пагинация, служебные параметры плагинов. Если такие URL начинают индексироваться, в поиске быстро растёт мусор: дубли, слабые страницы и лишняя нагрузка на краулинг. При этом закрывать всё подряд через robots.txt — плохая идея: поисковик может не увидеть канонический адрес и не поймёт, что именно нужно считать основной версией.
Ниже — практический сценарий: как диагностировать проблему, какие URL закрывать, чем отличаются noindex, canonical и редиректы, и как проверить, что решение действительно сработало.
Какие URL с параметрами обычно нужно убирать из индекса
Не каждый параметр вреден. Проблема начинается там, где параметр меняет только представление страницы, а не её смысл. Типичные примеры:
?sort=price,?orderby=date— сортировка;?filter_color=red,?size=m— фильтры каталога или архива;?replytocom=123— служебные ссылки комментариев;?s=...— внутренний поиск;?utm_source=...и похожие метки — если они попадают в индекс как отдельные URL;?ampи другие параметры, если у вас есть альтернативные версии страниц.
Если параметр не нужен пользователю как отдельная страница, его обычно не стоит индексировать. Но решение зависит от того, как именно WordPress и тема формируют URL, и есть ли у страницы канонический адрес без параметров.
Диагностика: где именно возникает индексируемый дубль
Сначала не правьте код вслепую. Посмотрите, какие URL уже попали в индекс и как они отдаются сервером.
Проверка в поиске и в логике сайта
Откройте в поиске запросы вида site:example.com inurl:? и посмотрите, какие параметры индексируются. Затем проверьте несколько проблемных URL вручную:
- есть ли у страницы
<link rel="canonical">; - не закрыта ли она случайно в
robots.txt; - не отдаёт ли она код 200 там, где логичнее 301 на чистый URL;
- не меняется ли контент страницы слишком сильно из-за параметра.
Если у вас есть доступ к консоли, полезно быстро посмотреть заголовки:
curl -I