Параметры URL и UTM-метки: как не засорить индекс мусором

Параметры URL — это тихий разрушитель индекса, который превращает один полезный товар в сотню бесполезных дублей. Фильтры, сортировки, пагинация, сессии и особенно рекламные UTM-метки плодят адреса с одинаковым содержимым, съедают краулинговый бюджет и заставляют поисковик метаться между копиями. На крупном интернет-магазине параметрические дубли могут составлять девяносто процентов всех просканированных URL, при том что реальной поисковой ценности в них ноль. В этом руководстве разберём, какие бывают параметры, чем они вредят, и как с ними бороться по-разному в Яндексе и Google.

Какие бывают параметры URL

Параметр — это всё, что идёт после знака вопроса в адресе. Например, в URL site.ru/katalog/?color=red&sort=price параметров два: color и sort. Параметры выполняют разные функции, и относиться к ним нужно по-разному.

  • Фильтры — ?color=red, ?brand=nike. Сужают выборку товаров по характеристике.
  • Сортировки — ?sort=price, ?order=desc. Меняют порядок вывода, но не состав.
  • Пагинация — ?page=2. Разбивает длинный список на страницы.
  • Сессионные — ?sid=abc123, ?PHPSESSID=. Идентифицируют сессию пользователя.
  • UTM-метки — ?utm_source=yandex&utm_medium=cpc. Отслеживают источники рекламного трафика.

Ключевое различие: одни параметры меняют контент существенно (некоторые фильтры формируют осмысленную выборку под спрос), а другие не меняют его вовсе (UTM-метки, сессии, большинство сортировок). Именно вторая группа — главный источник мусора в индексе.

Как параметры плодят дубли и съедают бюджет

Представьте категорию с тремя фильтрами по цвету, размеру и бренду, каждый с десятком значений, плюс четыре варианта сортировки. Комбинаторика даёт тысячи уникальных URL, каждый из которых робот воспринимает как отдельную страницу. Добавьте UTM-метки из рекламных кампаний — и одна категория порождает десятки тысяч адресов с практически идентичным контентом.

Последствия двойные. Во-первых, краулинговый бюджет — лимит страниц, которые робот готов обойти за визит, — тратится на бесполезные комбинации вместо новых товаров и важных страниц. Робот может неделями ходить по фильтрам, так и не добравшись до свежих карточек. Подробно механика расхода бюджета разобрана в материале об оптимизации краулингового бюджета и обхода. Во-вторых, вес ссылок и поведенческие сигналы размываются между копиями, и ни одна версия не получает достаточной силы для хорошего ранжирования.

Каждый параметр, не меняющий контент, — это потенциальный дубль. Сто меток на одной странице означают сто конкурентов самой себе.

Почему UTM-страницы попадают в индекс и чем это вредит

UTM-метки добавляются к ссылкам в рекламе, email-рассылках и постах в соцсетях для отслеживания источников трафика в системах аналитики. Сами по себе они безвредны для пользователя, но опасны для SEO. Когда человек делится ссылкой с UTM-меткой, ставит её на сторонний сайт или метка попадает в карту сайта по ошибке, поисковик находит этот адрес и индексирует его как отдельную страницу.

В результате в выдаче появляются страницы с длинными хвостами параметров вместо чистых URL. Это портит вид сниппета, размывает сигналы и создаёт дубли. Хуже того, если рекламная посадочная с UTM-меткой проиндексировалась и набрала вес, чистая версия страницы может проигрывать ей в ранжировании — абсурдная ситуация, когда страница конкурирует сама с собой. Эта проблема — частный случай более общей темы, описанной в гайде о том, как найти и устранить дублированный контент.

Решения: чем чистить индекс от параметров

Существует арсенал инструментов, и правильный выбор зависит от типа параметра и поисковой системы.

Canonical на чистый URL

Самый универсальный приём: каждая параметрическая страница содержит canonical, указывающий на чистую версию без параметров. Адрес ?utm_source=yandex каноничен на адрес без меток. Это работает и в Яндексе, и в Google. Детально механика канонизации разобрана в гайде по canonical URL и rel=canonical. Важно: canonical не запрещает обход, поэтому бюджет он экономит не полностью, но консолидирует сигналы.

Директива Clean-param для Яндекса

Яндекс предлагает мощный инструмент — директиву Clean-param в файле robots.txt. Она сообщает роботу, какие параметры игнорировать при обходе, склеивая все вариации с чистым URL. Синтаксис: Clean-param: utm_source&utm_medium&utm_campaign для всего сайта, либо с указанием пути. Например, строка Clean-param: sort /katalog/ скажет Яндексу не различать страницы каталога по параметру sort.

Clean-param эффективнее canonical для Яндекса, потому что напрямую экономит краулинговый бюджет: робот вообще не обходит параметрические версии. Правильное оформление этой директивы и всего файла описано в руководстве о том, как настроить robots.txt и sitemap.xml.

Управление параметрами в Google

Раньше в Google Search Console был отдельный инструмент параметров URL, но он закрыт. Сегодня для Google остаётся два рычага: корректный canonical на чистую версию и единообразие внутренних ссылок. Если все ссылки на сайте ведут на чистые URL без параметров, а параметрические версии каноничны на них, Google со временем сам разберётся и сконцентрирует сигналы на правильных адресах.

Noindex и robots.txt

Для заведомо бесполезных комбинаций фильтров можно применить noindex, follow — страница не попадёт в индекс, но ссылки на товары останутся живыми. Закрытие в robots.txt уместно лишь тогда, когда вы точно не хотите, чтобы робот тратил на эти URL обход, и при этом они уже не нужны в индексе. Помните о ловушке: нельзя одновременно закрывать в robots.txt и ставить noindex — робот не увидит вторую директиву.

Разница подхода: Яндекс против Google

Поскольку поисковики работают с параметрами по-разному, грамотная стратегия учитывает оба. Сведём различия в таблицу.

ИнструментЯндексGoogle
Clean-param в robots.txtПоддерживается, рекомендуетсяНе учитывается
rel=canonicalУчитываетсяУчитывается, основной способ
Инструмент параметров в консолиНетЗакрыт
Экономия краулингового бюджетаЧерез Clean-param напрямуюЧерез единообразие ссылок

Оптимальная связка для большинства сайтов: самоссылающийся canonical на чистые URL для обоих поисковиков плюс директива Clean-param для UTM-меток и сессионных параметров специально для Яндекса. Так вы покрываете обе системы их родными инструментами.

Как найти параметрические дубли

Прежде чем чистить, нужно понять масштаб проблемы. Есть три надёжных источника данных.

  • Логи сервера — самый честный источник. В них видно, по каким URL реально ходит робот. Если в логах десятки тысяч заходов на адреса с UTM-метками и фильтрами, проблема налицо. Методика разбора описана в материале об анализе логов сервера для SEO.
  • Google Search Console — отчёт об индексировании показывает проиндексированные параметрические URL и страницы, помеченные как дубли с выбранным каноническим адресом.
  • Краулер Screaming Frog или Netpeak Spider при полном сканировании покажет всё дерево параметрических URL и позволит отфильтровать адреса с конкретными параметрами.

Хорошие и плохие параметры

Не все параметры — зло. Некоторые фильтры создают ценные посадочные страницы под реальный спрос. Запрос «купить красные кроссовки nike» — это спрос, и страница фильтра, отвечающая на него, должна быть в индексе и приносить трафик. Закрывать или каноникализировать её на общую категорию — потеря денег.

ПараметрРешениеПочему
UTM-меткиCanonical + Clean-paramНе меняют контент, мусор
СортировкиCanonical на чистый URLТот же состав, другой порядок
СессииClean-param, не плодитьПолный мусор
Фильтр под спросИндексировать, ЧПУОтвечает на реальный запрос
Редкий фильтр без спросаCanonical или noindexДубль без ценности

Решение о том, какие комбинации фильтров превратить в полноценные индексируемые страницы, принимается на основе анализа спроса и подробно разбирается в материале о фасетной навигации и фильтрах в SEO. Ценные фильтры лучше переводить на человекопонятные URL, а не оставлять в виде параметров. Грамотная реализация такой системы — часть работ по доработке сайта.

Чек-лист по работе с параметрами

  • Все параметрические URL имеют canonical на чистую версию.
  • Для Яндекса настроена директива Clean-param для UTM и сессий.
  • Внутренние ссылки ведут на чистые URL без параметров.
  • UTM-метки не попадают в карту сайта.
  • Ценные фильтры под спрос индексируются, желательно на ЧПУ.
  • Бесполезные комбинации фильтров закрыты canonical или noindex.
  • Проверены логи сервера на расход бюджета параметрами.
  • Search Console не показывает параметрический мусор как проиндексированный.
  • Сессионные параметры не генерируются в URL без необходимости.
  • Сайт просканирован краулером для полной картины параметров.

Чистый индекс без параметрического мусора — это эффективный расход краулингового бюджета, сконцентрированные сигналы и стабильные позиции. Разобраться, какие из тысяч параметрических URL вашего магазина нужно закрыть, какие склеить, а какие превратить в трафиковые посадочные, — задача для опытного специалиста. Закажите SEO-продвижение сайта или закажите комплексный SEO-аудит, и мы наведём порядок в параметрах, освободим бюджет робота для важных страниц и превратим полезные фильтры в источник дополнительного трафика.

Услуги LSI Продвижение

Наша команда предлагает полный спектр услуг по SEO-продвижению и технической доработке сайтов. Мы работаем только белыми методами, ориентируемся на реальный бизнес-результат — трафик, заявки и продажи, а не только позиции в отчёте, — и выстраиваем продвижение системно, под конкретные задачи и нишу вашего проекта. Начать можно с бесплатной диагностики, чтобы понять текущее состояние сайта и точки роста, а затем перейти к комплексной работе. Выберите подходящую услугу из списка ниже:

Закажите SEO продвижение сайта

Выведем ваш сайт в ТОП Яндекса и Google. Бесплатная консультация — разберём сайт, найдём точки роста и предложим стратегию продвижения.

Оставить заявку Бесплатный SEO аудит
Аудит сайта

Оставить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

Этот сайт использует Akismet для борьбы со спамом. Узнайте, как обрабатываются ваши данные комментариев.