GET-параметры URL
Также: URL-параметры
GET-параметры URL — это часть адреса после знака вопроса, которая передаёт странице дополнительные данные: метку источника, сортировку, номер страницы, значение фильтра. Для поисковика каждый набор параметров — отдельный URL.
Как работает
Параметры добавляются к адресу после ? в формате ключ=значение, несколько разделяются &:
https://example.com/catalog/kettles/?sort=price&color=white&utm_source=yandex
Здесь три параметра: сортировка, фильтр по цвету и метка рекламной кампании. Все они меняют URL, но содержимое страницы могут не менять вовсе (как utm) или менять лишь порядок и состав элементов (как sort и color).
Проблема в том, что поисковик считает каждый уникальный URL отдельной страницей. Один и тот же список чайников, доступный по адресам с разными метками и сортировками, превращается для робота в десятки почти одинаковых страниц.
Параметры бывают активными — они реально меняют контент (?category=, значимый фильтр) — и пассивными, которые на содержимое не влияют (?utm_, ?sessionid, ?ref).
Почему важно для SEO
Неконтролируемые параметры порождают дубли и съедают краулинговый бюджет. Робот тратит ресурс на обход сотен вариантов одной страницы вместо новых товаров. Внешние ссылки и поведенческие сигналы размазываются между версиями с разными метками, вместо того чтобы работать на один чистый URL.
Управляют этим несколькими способами. rel="canonical" со всех вариантов на чистый URL склеивает дубли и консолидирует сигналы — это основной инструмент. Незначащие параметры убирают из ссылок внутри сайта, чтобы робот их не находил. В Яндексе дополнительно помогает директива Clean-param в robots.txt: она прямо указывает роботу игнорировать перечисленные параметры при склейке.
Проблему усугубляет непостоянный порядок параметров и их регистр: адреса ?color=white&sort=price и ?sort=price&color=white для поисковика — две разные страницы с одинаковым содержимым. То же с идентификаторами сессий, которые CMS иногда подставляет в URL для незалогиненных посетителей, — они плодят почти бесконечное число копий одной страницы. Единый порядок параметров, отказ от session id в адресе и сквозной canonical на чистый URL снимают большую часть таких дублей ещё до того, как робот успеет их размножить.
Проверим весь сайт?
Пара минут — и увидите отчёт по каждой странице.
Проверить сайтЧастые ошибки
- На страницах с utm-метками нет canonical на чистый URL — в индекс попадают рекламные версии.
- Каждая комбинация сортировки и фильтра доступна для обхода и индексируется как отдельная страница.
- Внутренние ссылки ведут на URL с параметрами вместо чистых адресов — робот множит дубли.
- Порядок параметров в ссылках непостоянен:
?a=1&b=2и?b=2&a=1дают два URL с одним содержимым. - Значимые параметры (реальные фильтры-категории) закрыты наравне с мусорными, и нужные страницы выпадают из индекса.
Как проверить
В Google Search Console отчёт «Индексирование страниц» показывает дубли и страницы, исключённые с пометкой «Страница-дубликат». В Яндекс.Вебмастере это раздел «Страницы в поиске → Исключённые» и статистика по параметрам. Оператор site: с фрагментом параметра покажет, сколько версий попало в индекс.
SEO Crawler при обходе группирует URL, отличающиеся только параметрами, находит дубли контента и проверяет, стоит ли на них canonical на чистый адрес. В отчёте это разделы о дублях и каноникализации: видно, какие параметры реально плодят копии и где чистый URL остался без склейки.
Вывод
GET-параметры — удобный механизм передачи данных, который без контроля превращается в фабрику дублей. Ставьте canonical с параметрических URL на чистые, не ссылайтесь на адреса с метками внутри сайта и используйте Clean-param для Яндекса. Особого внимания требует фасетная навигация, где параметры множатся комбинаторно.
Проверим весь сайт?
Пара минут — и увидите отчёт по каждой странице.
Проверить сайт