Почему моя страница продукта отображается в Google три раза?
Различные варианты URL одной и той же страницы заставляют Google сомневаться, какая версия учитывается, и это лишает вас видимости, которую вы восстановите одной технической операцией.
Что точно означает каноникализация параметров URL
Предположим, вы продаете обувь. Посетитель попадает на ваш сайт через объявление: ваш-магазин.nl/schoenen?utm_source=facebook. Другой сортирует по цене: ваш-магазин.nl/schoenen?sort=laag-hoog. Третий фильтрует по размеру: ваш-магазин.nl/schoenen?maat=42. Для посетителя это одна и та же страница с разной подачей. Для Google без вмешательства это три или более отдельных страниц.
Каноникализация означает, что вы говорите Google: это все варианты, но настоящая, учитываемая версия — ваш-магазин.nl/schoenen — без добавлений. Это чистое обращение называется канонической URL. Вы таким образом даете один ясный ответ на вопрос, какая версия должна появиться в результатах поиска.
Это не вопрос скрывать или блокировать что-то. Варианты могут спокойно существовать и работать для посетителей, которые фильтруют или сортируют. Вы только говорите поисковым системам: учитывайте всю ценность и оценку одной версии, а не десяти параметрических вариантов рядом.
Это похоже на то, что происходит при разбиении на страницы, как мы объясняем при разбиении на страницы. Там тоже есть несколько URL, которые содержательно сильно перекрываются. Разница в том, что параметры часто еще более случайны: сортировка и отслеживание не добавляют ничего к содержимому, тогда как номера страниц иногда добавляют.
Как понять, имеет ли это место у вас
Самая быстрая проверка: в Google Search Console найдите свой домен с помощью поиска по сайту, например site:ваш-магазин.nl/schoenen. Если появляются несколько вариантов со знаками вопроса и параметрами, то велика вероятность, что это установлено неправильно. Вы также можете просто просмотреть свой сайт, включить фильтры и опции сортировки и посмотреть, что происходит в адресной строке.
В Search Console можно посмотреть на странице Страницы причину неиндексирования страниц. Если там написано что-то вроде дублированного контента, Google выбрал другую каноническую URL, чем пользователь, то это часто как раз ваша проблема. Это один из самых явных сигналов, которые дает этот отчет.
Посмотрите также исходный код отфильтрованной страницы или попросите кого-то это сделать за вас. Там должна быть строка, указывающая на чистый URL как каноническую версию. Если эта строка отсутствует или указывает на саму версию с параметрами, то нужна работа.
Указание вы получите также через вашу аналитику: если вы видите десятки URL-вариантов того, что на самом деле одна страница, каждый с небольшим количеством трафика, то этот трафик распылился по копиям вместо того, чтобы быть собран на главной странице.
Что это стоит, если это не в порядке
Самый большой риск — это потраченное внимание Google для вашего сайта. Поисковые системы посвящают каждому сайту ограниченное количество времени и мощности на просмотр страниц, также называемое бюджетом краулинга. Если Google потратит это время на сотню вариаций одной страницы обуви, то останется меньше для новых или важных страниц в другом месте вашего сайта.
Кроме того, вы разбавляете собственную релевантность. Если ценность ссылок и сигналы признания распределяются по десяти URL-вариантам вместо того, чтобы быть сконцентрированными на одной странице, ни один вариант не будет достаточно сильным для хорошего ранжирования. Вы по сути боретесь сами с собой в результатах поиска.
Также есть реальный риск того, что Google сам выберет каноническую версию, и не всегда ту, которую вы хотели бы. Это может быть версия с параметрами с неприглядным URL или страница, которая не является вашей предпочтительной посадочной страницей для этого запроса. Вы тогда теряете контроль над тем, что именно видят и нажимают люди.
Для AI-ассистентов, которые суммируют веб-контент, та же проблема возникает, но в более острой форме. Языковая модель, столкнувшись с тремя слегка отличающимися версиями одной и той же страницы продукта, может подхватить запутанную или противоречивую информацию — например, другую цену из-за старого кэша варианта сортировки. Ясность относительно того, какая версия правильная, помогает шире, чем только в Google.
Что нужно сделать, чтобы решить эту проблему
Суть проста: каждый вариант страницы — с отслеживанием, сортировкой или фильтрами в URL — должен указывать, что чистая версия — это настоящая. Это инструкция, которую вы один раз правильно настраиваете для каждого типа страницы, а не что-то, что вы делаете вручную для каждой страницы. Подумайте о固ном правиле для всех страниц продуктов, другом фиксированном правиле для всех страниц категорий.
Это должно быть частью более широкого обзора того, какие страницы у вас есть и как они себя ведут, как мы обсуждаем в матрице индексирования по типам страниц. Там вы определяете для каждого типа, и, следовательно, для каждого типа параметра, какова цель: может ли он существовать, должен ли он вести к канонической версии или не должен ли он вообще включаться в индекс.
Некоторые параметры заслуживают другого подхода, чем просто каноникализация. Результаты внутреннего поиска, например, когда кто-то ищет на вашем сайте и это создает отдельный URL, часто лучше прямо исключить из индексирования, как описано в результатах внутреннего поиска на noindex. Каноникализация и исключение — это два разных инструмента для разных ситуаций.
После внесения изменений подождите несколько недель и снова проверьте в Search Console, исчезли ли дублирующиеся варианты из отчета о проблемах. Это не происходит в один день: Google должна повторно посетить страницы и обработать новую инструкцию. Терпение и повторная проверка — часть этого процесса.
Как это связано с другими основными техническими вопросами
Каноникализация не стоит отдельно. Если ваш файл robots.txt уже блокирует части сайта, как обсуждается в контрольной точке 1.1 о robots.txt и контрольной точке 1.2, это может помешать работе ваших канонических инструкций. Страница, которая заблокирована, Google не сможет посетить, чтобы прочитать каноническую инструкцию.
Плохо настроенная обработка 404 также затрагивает эту тему. Если удаленная версия с параметром не перенаправляется хорошо, а вместо этого выдает запутанную страницу без правильного кода состояния, мы говорим о мягкой ошибке 404, как объяснено в мягких ошибках 404. То же самое относится к плохой странице ошибок, см. полезную страницу 404. Все эти точки соприкасаются: всегда речь идет о том, чтобы дать Google ясность относительно того, что именно представляет собой и означает страница.
Наконец: если ваш сайт сильно полагается на JavaScript для отображения контента, как обсуждается в основном контенте, доступном без JavaScript, для Google уже может быть сложно увидеть базовый контент, не говоря уже о канонической ссылке, которая иногда добавляется к нему динамически. Технически стабильная основа делает каноникализацию по-настоящему надежной.
Часто задаваемые вопросы
Должен ли я теперь удалить все мои URL-адреса со знаком вопроса
Нет. Версии с параметрами могут оставаться, потому что они полезны для посетителей, которые фильтруют, сортируют или приходят через объявление. Вам ничего не нужно удалять. Вы просто добавляете инструкцию, указывающую, что чистая версия без параметров — это настоящая, считаемая страница для поисковых машин. Вариант и инструкция существуют рядом.
Могу ли я это проверить самостоятельно без технических знаний
Частично да. Вы можете посмотреть в Google Search Console, есть ли уведомления о дублирующихся страницах или другом выбранном каноническом URL-адресе. Вы также можете сами кликать по сайту и смотреть, что происходит в адресной строке при фильтрации и сортировке. Фактическая оценка исходного кода и внедрение решения требует кого-то с техническими знаниями вашего сайта или системы веб-магазина.
Это также важно, если у меня нет веб-магазина
Да, хотя вероятность ниже. Обычный корпоративный веб-сайт также получает параметры через маркетинговые кампании, такие как utm-коды в объявлениях или информационные рассылки. Каждый раз, когда кто-то переходит по такой ссылке, теоретически создается новый вариант URL одной и той же страницы. Без фильтров интернет-магазина проблема меньше по масштабу, но решение и логика остаются идентичными.
Дальнейшее чтение
Как дела с вашим собственным веб-сайтом?
Две цифры, в течение минуты, бесплатно — и вам не нужно ничего оставлять.
Предпочитаете сразу получить полный отчёт? Расширенное сканирование — € 49 →
Хотите узнать, в чем причина?
Эта сканирование показывает вам статус. Отчет показывает вам причины и порядок, в котором их решать.
- По каждому выводу, что не так и что нужно сделатьБесплатное сканирование показывает вам статус. Отчет дает вам список — на обычном языке, в порядке серьезности, без необходимости понимать что-либо техническое.
- Все четыре помощника на базе AI вместо одногоБесплатный результат — это выборочная проверка у одного ассистента. Отчет задает восемь вопросов всем четырем, так что вы узнаете, связано ли это с одним ассистентом или со всеми.
- Какие компании упоминаютсяКто получает клиента, которого вы теряете? Эти имена указаны в отчете с указанием того, как часто они появляются там, где вас нет.
- Более глубокое измерение вашего веб-сайтаБесплатное сканирование проверяет десять страниц. Отчет доходит до пятидесяти, поэтому также до страниц, куда в итоге попадают ваши клиенты.